| D01 |
See Speech in Motion: Synchronization Three-Dimensional Vocal-Tract Motion and Synthesized Speech via Joint-Embedding Predictive Architecture Alignment |
Sheng Li, Pengcheng Wang, Takahiro Shinozaki (Institute of Science Tokyo) |
| D02 |
Esper: On-device Agentic Photography |
Marcos Conde, Ph.D. (Tenkai AI, University of Würzburg), Leo Hoshikawa, Lev Markhasin (Sony, Tenkai AI) |
| D03 |
CADDIE Live: Real-Time Golf Club Pose Estimation from a Single Camera |
Changsoo Jung (Fujitsu Research of America & Colorado State University), Fan Yang (Fujitsu Research) |
| D04 |
Interactive Novel View Synthesis of Large-Scale Outdoor Scenes Using Ground and Aerial Images |
Chunyu Li, Qiheng Li, Yusuke Monno, Masatoshi Okutomi (Institute of Science Tokyo), Eiichiro Yoshioka (MICWARE Co., Ltd.), Kazuya Inoue (DNP Marcom Products Co., Ltd.), Kazutoshi Sumiya (Kwansei Gakuin University) |
| D05 |
Chain-of-Clues: An Auditable Interface for Visually Grounded Safety Inspection of Construction Sites |
Takashi Shibata, Shota Takano (NTT EAST, Inc.) |
| D06 |
AR-based Shamisen Training System with Handwritten Kateishiki-fu Recognition |
Emika Kurita, Shuhei Yamada, Haruyoshi Suzuki (Keio University) |