MultiSensor-Home: Multi-modal multi-view dataset and benchmarks for action recognition in home environments
Trung Thanh Nguyen,
Yasutomo Kawanishi,
Vijay John,
Takahiro Komamizu,
Ichiro Ide Pattern Recognition, 179(113810), pp.1-12, To be published in November 2026.
MultiSensor-Home: Multi-modal multi-view dataset and benchmarks for action recognition in home environments
Trung Thanh Nguyen,
Yasutomo Kawanishi,
Vijay John,
Takahiro Komamizu,
Ichiro Ide Pattern Recognition, 179(113810), pp.1-12, To be published in November 2026.
Grouped Causal Query Adapter for Efficient Visual Adaptation in Video Captioning
Junan Chen,
Trung Thanh Nguyen,
Takahiro Komamizu,
Ichiro Ide Meeting on Image Recognition & Understanding, pp.1-5, To be published in August 2026.
Grouped Causal Query Adapter for Efficient Visual Adaptation in Video Captioning
Junan Chen,
Trung Thanh Nguyen,
Takahiro Komamizu,
Ichiro Ide Meeting on Image Recognition & Understanding, pp.1-5, To be published in August 2026.
Linear-time 3D Forest Point Cloud Segmentation with Geometry-guided Queries
Trung Thanh Nguyen,
Tuan-Anh Vu,
Duc Viet Le,
Yasutomo Kawanishi,
Takahiro Komamizu,
Ichiro Ide,
Teja Katternborn Meeting on Image Recognition & Understanding, pp.1-5, To be published in August 2026.
Linear-time 3D Forest Point Cloud Segmentation with Geometry-guided Queries
Trung Thanh Nguyen,
Tuan-Anh Vu,
Duc Viet Le,
Yasutomo Kawanishi,
Takahiro Komamizu,
Ichiro Ide,
Teja Katternborn Meeting on Image Recognition & Understanding, pp.1-5, To be published in August 2026.
Beyond Single-view: Cross-view Context Modeling for Multi-view Action Recognition
Trung Thanh Nguyen,
Yasutomo Kawanishi,
Takahiro Komamizu,
Ichiro Ide Meeting on Image Recognition & Understanding, pp.1-5, To be published in August 2026.
Beyond Single-view: Cross-view Context Modeling for Multi-view Action Recognition
Trung Thanh Nguyen,
Yasutomo Kawanishi,
Takahiro Komamizu,
Ichiro Ide Meeting on Image Recognition & Understanding, pp.1-5, To be published in August 2026.
Estimation of Cooking Proficiency based on Motion and Posture Information
View-aware Cross-modal Distillation for Multi-view Action Recognition
Trung Thanh Nguyen,
Yasutomo Kawanishi,
Vijay John,
Takahiro Komamizu,
Ichiro Ide IEEE/CVF Winter Conference on Applications of Computer Vision, p.7769–7778, March 2026.
View-aware Cross-modal Distillation for Multi-view Action Recognition
Trung Thanh Nguyen,
Yasutomo Kawanishi,
Vijay John,
Takahiro Komamizu,
Ichiro Ide IEEE/CVF Winter Conference on Applications of Computer Vision, p.7769–7778, March 2026.
Analysis and prediction of attractive fonts on title-overlaid food image
Nanami Takagi,
Haruya Kyutoku,
Keisuke Doman,
Takahiro Komamizu,
Ichiro Ide IEICE Transactions on Information and Systems, E109, No.2, pp.284-287, February 2026.
Analysis and prediction of attractive fonts on title-overlaid food image
Nanami Takagi,
Haruya Kyutoku,
Keisuke Doman,
Takahiro Komamizu,
Ichiro Ide IEICE Transactions on Information and Systems, E109, No.2, pp.284-287, February 2026.
Hierarchical Global-Local Fusion for One-stage Open-vocabulary Temporal Action Detection
Trung Thanh Nguyen,
Yasutomo Kawanishi,
Takahiro Komamizu,
Ichiro Ide ACM Transactions on Multimedia Computing, Communications, and Applications, 2(1), p.6_1–6_23, January 2026.
Hierarchical Global-Local Fusion for One-stage Open-vocabulary Temporal Action Detection
Trung Thanh Nguyen,
Yasutomo Kawanishi,
Takahiro Komamizu,
Ichiro Ide ACM Transactions on Multimedia Computing, Communications, and Applications, 2(1), p.6_1–6_23, January 2026.
Q-Adapter: Visual Query Adapter for Extracting Textually-related Features in Video Captioning
Junan Chen,
Trung Thanh Nguyen,
Takahiro Komamizu,
Ichiro Ide ACM International Conference on Multimedia in Asia, No.7, pp.1-10, December 2025.
Q-Adapter: Visual Query Adapter for Extracting Textually-related Features in Video Captioning
Junan Chen,
Trung Thanh Nguyen,
Takahiro Komamizu,
Ichiro Ide ACM International Conference on Multimedia in Asia, No.7, pp.1-10, December 2025.
Origami Crease Recognition for Automatic Folding Diagrams Generation
Hitomi Kato,
Hirotaka Kato,
Takatsugu Hirayama,
Takahiro Komamizu,
Ichiro Ide Pattern Recognition and Computer Vision, 16175(2), pp.16-31, December 2025.
Origami Crease Recognition for Automatic Folding Diagrams Generation
Hitomi Kato,
Hirotaka Kato,
Takatsugu Hirayama,
Takahiro Komamizu,
Ichiro Ide Pattern Recognition and Computer Vision, 16175(2), pp.16-31, December 2025.
Semantic Alignment on Action for Image Captioning
Da Huo,
Marc A Kastner,
Takatsugu Hirayama,
Takahiro Komamizu,
Yasutomo Kawanishi,
Ichiro Ide IEEE Access, 13(2025), p.199615–199629, November 2025.
Semantic Alignment on Action for Image Captioning
Da Huo,
Marc A Kastner,
Takatsugu Hirayama,
Takahiro Komamizu,
Yasutomo Kawanishi,
Ichiro Ide IEEE Access, 13(2025), November 2025.
Semantic Alignment on Action for Image Captioning
Da Huo,
Marc A Kastner,
Takatsugu Hirayama,
Takahiro Komamizu,
Yasutomo Kawanishi,
Ichiro Ide IEEE Access, 13(2025), p.199615–199629, November 2025.
Lip Shape-Aware Word Selection for Lyric Translation
Kotaro Ikeda,
Chihaya Matsuhira,
Hirotaka Kato,
Marc A. Kastner,
Takatsugu Hirayama,
Takahiro Komamizu,
Ichiro Ide Pattern Recognition and Computer Vision, Vol.16175, p.48–62, November 2025.
Last updated: 2026-07-28 00:17:06.979781136 +0000 UTC m=+5.740938582.