北京通用人工智能研究院BIGAI

科研成果

SPHERE: Mitigating the Loss of Spectral Plasticity in Mixture-of-Experts for Deep Reinforcement Learning

UniCode: Augmenting Evaluation for Code Reasoning

Active Kinematic Modeling for Precise Manipulation of Unseen Articulated Objects

Integrated Exploration for Sequential Manipulation on Scene Graph with LLM-based Situated Replanning

Native Parallel Reasoner: Reasoning in Parallelism via Self-Distilled Reinforcement Learning

Modeling Decision-Making with Will for Cooperation in Social Dilemmas