BackendForge: Benchmarking Agentic End-to-End Code Generation with Backend Services
BackendForge:使用后端服务对智能端到端代码生成进行基准测试
Yuzhe Guo, Mengzhou Wu, Yuan Cao, Jialei Wei, Dezhi Ran, Wei Yang, Tao Xie
机构
*
Key Lab of HCST (PKU), MOE(北京大学计算机科学与技术国家重点实验室;软件学院,北京大学)
;
SCS, Peking University(北京通明湖信息技术应用创新中心)
;
Beijing Tongming Lake Information Technology Application Innovation Center (TLAIC)(复旦大学高级计算系统研究所)
;
Fudan University Institute of Systems for Advanced Computing(上海开放计算系统研究所)
;
Shanghai Institute of Systems for Open Computing
Imaging-101: Benchmarking LLM Coding Agents on Scientific Computational Imaging
成像101:在科学计算成像上对大语言模型编码智能体进行基准测试
Siyi Chen, Jiahe Ying, Yixuan Jia, Yuxuan Gu, Enze Ye, Weimin Bai, Zhijun Zeng, Shaochi Ren, Binhong Gao, Yubing Li, Tianhan Zhang, He Sun
机构
*
College of Future Technology and the National Biomedical Imaging Center, Peking University(北京大学未来技术学院和国家生物医学成像中心)
;
AI for Science Institute (AISI)(科学人工智能研究所)
;
University of Michigan(密歇根大学)
;
State Key Laboratory of Acoustics and Marine Information, Institute of Acoustics, Chinese Academy of Sciences(中国科学院声学研究所声场声信息国家重点实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
School of Astronautics, Beihang University(北京航空航天大学宇航学院)
;
Key Laboratory of Spacecraft Design Optimization and Dynamic Simulation Technologies, Ministry of Education(教育部航天器设计优化与动态仿真技术重点实验室)
UNIBROWSE: A Data-to-Agent Framework for Multimodal BrowseComp
UNIBROWSE:用于多模态浏览比较的数据到智能体框架
Xiyu Wei, Qingwei Zong, Zhuocheng Yu, Sujian Li
机构
*
Key Laboratory of Computational Linguistics, MOE, Peking University(教育部计算语言学重点实验室,北京大学)
;
School of Software and Microelectronics, Peking University(北京大学软件与微电子学院)
;
School of Computer Science, Peking University(北京大学计算机科学学院)
Robo-ValueRL: Reliable Value Estimation for Offline-to-Online Reinforcement Learning
Robo-ValueRL:离线到在线强化学习的可靠价值估计
Wenke Xia, Pei Ren, Wenbo Yu, Yizhuo Zhang, Jifan Li, Yixue Zhang, Yinuo Zhao, Qingyang Gao, Jianlong Fu, Jian Tang, Ji-Rong Wen, Zhengping Che, Di Hu
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)
;
Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)
;
Beijing Forestry University(北京林业大学)
;
Peking University(北京大学)
;
Microsoft Research(微软研究院)
机构
*
Tsinghua University(清华大学)
;
State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室,字节跳动公司人工智能研究院)
;
Harbin Institute of Technology(哈尔滨工业大学)
;
Peking University(北京大学)
机构
*
Peking University(北京大学)
;
Kling Team, Kuaishou Technology(快手团队)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Sun Yat-sen University(中山大学)
XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion Representations
XR-1:通过学习统一的视觉-运动表示实现多功能的视觉-语言-动作模型
Shichao Fan, Kun Wu, Zhengping Che, Xinhua Wang, Di Wu, Fei Liao, Ning Liu, Yixue Zhang, Zhen Zhao, Zhiyuan Xu, Meng Li, Qingjie Liu, Shanghang Zhang, Min Wan, Jian Tang
机构
*
Beijing Innovation Center of Humanoid Robotics, Beijing, China(北京人形机器人创新中心,北京,中国)
;
School of Mechanical Engineering and Automation, Beihang University, Beijing, China(北京航空航天大学机械工程及自动化学院,北京,中国)
;
State Key Laboratory of Virtual Reality Technology and Systems, SCSE, Beihang University, Beijing, China(虚拟现实技术与系统国家重点实验室,SCSE,北京航空航天大学,北京,中国)
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, Beijing, China(多媒体信息处理国家重点实验室,计算机科学学院,北京大学,北京,中国)
Zichen Liu, Wei Zhang, Christof Schütte, Tiejun Li
机构
*
Center for Data Science, Peking University(数据科学中心,北京大学)
;
Zuse Institute Berlin(柏林Zuse研究所)
;
Institute of Mathematics, Freie Universität Berlin(柏林自由大学数学研究所)
;
LMAM and School of Mathematical Sciences, Center for Machine Learning Research and Center for Data Science, Peking University(LMAM和数学系,机器学习研究中心和数据科学中心,北京大学)
机构
*
Center for Data Science(数据科学中心)
;
Peking University(北京大学)
;
Guanghua School of Management(光华管理学院)
;
Department of Statistics and Data Science(统计与数据科学系)
;
Tsinghua University(清华大学)
机构
*
Robotics and Control Laboratory, School of Advanced Manufacturing and Robotics, and the State Key Laboratory of Turbulence and Complex Systems, Peking University(机器人与控制实验室,先进制造与机器人学院,湍流与复杂系统国家重点实验室,北京大学)
;
National Innovation Institute of Defense Technology(国防技术创新研究院)
Distributionally Robust Reinforcement Learning with Interactive Data Collection: Fundamental Hardness and Near-Optimal Algorithms
具有交互式数据收集的分布鲁棒强化学习:基本难度与近最优算法
Miao Lu, Han Zhong, Tong Zhang, Jose Blanchet
机构
*
Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系)
;
Center for Data Science, Peking University(北京大学数据科学中心)
;
Department of Computer Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算机科学系)