Thinking with Imagination: Agentic Visual Spatial Reasoning with World Simulators
思考与想象:基于世界模拟器的智能视觉空间推理
Chenming Zhu, Jingli Lin, Yilin Long, Peizhou Cao, Tai Wang, Jiangmiao Pang, Xihui Liu
机构
*
The University of Hong Kong(香港大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
Fudan University(复旦大学)
;
Beihang University(北航大学)
Quantum enhanced rare event discovery and sampling
量子增强的罕见事件发现与采样
Naixu Guo, Po-Wei Huang, Qisheng Wang, Jayne Thompson, Patrick Rebentrost, Mile Gu, Chengran Yang
机构
*
Centre for Quantum Technologies, National University of Singapore(量子技术中心,新加坡国立大学)
;
Mathematical Institute, University of Oxford(牛津大学数学研究所)
;
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
;
School of Informatics, University of Edinburgh(爱丁堡大学信息学院)
;
College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)
;
Nanyang Quantum Hub, School of Physical and Mathematical Sciences, Nanyang Technological University(南洋量子中心,南洋理工大学物理与数学科学学院)
When Denser Credit Is Not Enough: Evidence-Calibrated Policy Optimization for Long-Horizon LLM Agent Training
当更密集的信用不足时:面向长周期LLM智能体训练的基于证据校准的策略优化
Yuanfan Li, Qi Zhou, Wenjing Duan, Lu Chen
机构
*
X-LANCE Lab, School of Computer Science, Shanghai Jiao Tong University, Shanghai, China(X-LANCE实验室,计算机科学学院,上海交通大学,上海,中国)
;
Faculty of Electronic and Information Engineering, Xi’an Jiaotong University(电子与信息工程学院,西安交通大学)
LeanMarathon: Toward Reliable AI Co-Mathematicians through Long-Horizon Lean Autoformalization
LeanMarathon:通过长视界Lean自动形式化实现可靠的AI合作数学家
Yuanhe Zhang, Yuekai Sun, Taiji Suzuki, Jason D. Lee, Fanghui Liu
机构
*
Department of Statistics, University of Warwick, UK(英国沃里克大学统计系)
;
Center for Advanced Intelligence Project, RIKEN, Japan(日本理化学研究所高级智能项目)
;
Department of Statistics, University of Michigan, USA(美国密歇根大学统计系)
;
Department of Mathematical Informatics, The University of Tokyo(东京大学数学信息学系;日本理化学研究所高级智能项目)
;
also Center for Advanced Intelligence Project, RIKEN, Japan(加州大学伯克利分校电气工程与计算机科学系;统计系)
;
Department of Electrical Engineering and Computer Sciences, also Department of Statistics, University of California, Berkeley, USA(上海交通大学数学科学学院,自然科学院和MOE-LSC)
;
School of Mathematical Sciences, Institute of Natural Sciences and MOE-LSC, Shanghai Jiao Tong University, China
Reward-Decomposed Reinforcement Learning for Immersive Video Role-Playing
面向沉浸式视频角色扮演的奖励分解强化学习
Miao Wang, Yuling Shi, Yijiang Li, Yeheng Chen, Xiaodong Gu, Bin Li, Bo Gao, Jun Wang, Zengxin Han, Jingtong Wu, Yaduan Ruan
机构
*
Nanjing University(南京大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
University of California, San Diego(加州大学圣地亚哥分校)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院)
;
School of Information Engineering, Beijing Institute of Graphic Communication(北京印刷学院信息工程学院)
;
Ant International, Ant Group(蚂蚁集团国际部)
;
Independent Researcher(独立研究者)
机构
*
Institute of AI (TeleAI), China Telecom(人工智能研究院(TeleAI),中国电信)
;
Lumos Robotics(Lumos机器人)
;
University of Science and Technology of China(中国科学技术大学)
;
Northwestern Polytechnical University(西北工业大学)
;
Shanghai Jiao Tong University(上海交通大学)
;
East China University of Science and Technology(东华大学)
;
Harbin Engineering University(哈尔滨工程大学)
;
Fudan University(复旦大学)
机构
*
School of Mathematics and Statistics, Nanjing University of Information Science and Technology(南京信息工程大学数学与统计学院)
;
School of Communication and Artificial Intelligence, Nanjing Institute of Technology(南京理工大学通信与人工智能学院)
;
School of Integrated Circuits, Nanjing Institute of Technology(南京理工大学集成电路学院)
;
Jiangsu Province Engineering Research Center of IntelliSense Technology and System(江苏省智能感知技术与系统工程研究中心)
;
Hubei Key Laboratory of Applied Mathematics, Hubei University(湖北省应用数学重点实验室)
;
Key Laboratory of System Control and Information Processing, Ministry of Education, Shanghai Jiao Tong University(教育部系统控制与信息处理重点实验室,上海交通大学)