SPHERE: Mitigating the Loss of Spectral Plasticity in Mixture-of-Experts for Deep Reinforcement Learning Lirui Luo*, Guoxi Zhang*, Hongming Xu, Cong Fang†, Qing Li† ICML 2026 下载 查看更多
UniCode: Augmenting Evaluation for Code Reasoning Xinyue Zheng*, Haowei Lin*, Shaofei Cai, Yaodong Yang, Zilong Zheng#, and Yitao Liang# ICML 2026 下载 查看更多
Active Kinematic Modeling for Precise Manipulation of Unseen Articulated Objects Boyuan Zhang, Yuxuan Wang, Yizhou Wang, Wei Wang✉, Zhenliang Zhang✉ RA-L 2026 下载 查看更多
Integrated Exploration for Sequential Manipulation on Scene Graph with LLM-based Situated Replanning Heqing Yang*, Ziyuan Jiao†, Shu Wang, Yida Niu, Si Liu†, Hangxin Liu ICRA 2026 下载 查看更多
Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcement Learning Tong Wu*, Yang Liu*, Jun Bai*, Zixia Jia, Shuyi Zhang, Ziyong Lin, Yanting Wang, Song-Chun Zhu, Zilong Zheng† ICML 2026 下载 查看更多
Modeling Decision-Making with Will for Cooperation in Social Dilemmas Yizhe Huang*, Bin Ling*, Song-Chun Zhu, Xue Feng† CogSci 2026 下载 查看更多