NEP: Autoregressive lmage Editing via Next EditingToken Prediction Huimin Wu, Xiaojian Ma, Haozhe Zhao, Yanpeng Zhao, Qing Li† NeurIPS 2025 下载 查看更多
VideoLLaMB: Long-context Video Understanding with Recurrent Memory Bridges Yuxuan Wang*, Yiqi Song*, Cihang Xie, Yang Liu, and Zilong Zheng† ICCV 2025 下载 查看更多
TACO: Taming Diffusion for in-the-wild Video Amodal Completion Ruijie Lu*, Yixin Chen✉, Yu Liu, Jiaxiang Tang, Junfeng Ni, Diwen Wan, Gang Zeng✉, Siyuan Huang✉ ICCV 2025 下载 查看更多
GWM: Towards Scalable Gaussian World Models for Robotic Manipulation Guanxing Lu*, Baoxiong Jia*, Puhao Li*, Yixin Chen, Ziwei Wang,· Yansong Tang, Siyuan Huang✉ ICCV 2025 下载 查看更多
Trace3D: Consistent Segmentation Lifting via Gaussian Instance Tracing Hongyu Shen*, Junfeng Ni*, Weishuo Li, Mingtao Pei, Yixin Chen✉, Siyuan Huang✉ ICCV 2025 下载 查看更多
Embodied VideoAgent: Persistent Memory from Egocentric Videos and Embodied Sensors Enables Dynamic Scene Understanding Yue Fan* , Xiaojian Ma* ✉, Rongpeng Su , Jun Guo , Rujie Wu , Xi Chen , and Qing Li✉ ICCV 2025 下载 查看更多