Bridging the Agent-World Gap: Text World Models for LLM-based Agents
弥合智能体-世界鸿沟:面向基于LLM的智能体的文本世界模型
Yixia Li, Hongru Wang, Peng Lai, Zhiwen Ruan, He Zhu, Youxin Zhu, Ganlong Zhao, Minda Hu, Yun Chen, Sibei Yang, Peng Li, Jeff Z. Pan, Jia Pan, Guanhua Chen, Yang Liu, Guanbin Li
机构
*
Southern University of Science and Technology(南方科技大学)
;
University of Edinburgh(爱丁堡大学)
;
Peking University(北京大学)
;
Sun Yat-sen University(中山大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shanghai University of Finance and Economics(上海财经大学)
;
Tsinghua University(清华大学)
;
The University of Hong Kong(香港大学)
A multi-agent system for spine MRI report generation from multi-sequence imaging
基于多序列影像的脊柱MRI报告生成多智能体系统
Zhiping Xiao, Junwei Yang, Gongbo Sun, Han Zhang, Hanwen Xu, Yi Yao, Zachary D. Miller, William E. King, Mohammed M. Kanani, Jalal B. Andre, Sammy Chu, Ming Zhang, Paul E. Kinahan, Nathan M. Cross, Sheng Wang
机构
*
University of Washington(华盛顿大学)
;
Peking University(北京大学)
;
University of Wisconsin–Madison(威斯康星大学麦迪逊分校)
;
New York University(纽约大学)
;
University of Washington Medical Center(华盛顿大学医学中心)
Dream-Tac: A Unified Tactile World Action Model for Contact-Rich Robot Manipulation
Dream-Tac: 用于接触丰富机器人操作任务的统一触觉世界动作模型
Yunfan Lou, Yifan Ye, Yankai Fu, Jun Cen, Xiaowei Chi, Yaoxu Lyu, Peidong Jia, Sirui Han, Zhihe Lu, Shanghang Zhang
机构
*
Peking University(北京大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
;
Nanjing University(南京大学)
;
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室)
机构
*
State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室)
;
Central South University(中南大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Peking University(北京大学)
;
Huawei Technologies(华为技术有限公司)
机构
*
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Peking University(北京大学)
;
The Hong Kong University of Science and Technology(香港科技大学)
ZAS-SQL: Distilling Rules from Failures for Zero-Shot Text-to-SQL
ZAS-SQL: 从失败中提炼规则用于零样本文本到SQL
Hongzhou Zheng, Yixin Gou, Wenjia Zhang
机构
*
Shanghai Research Institute for Intelligent Autonomous Systems, Tongji University(同济大学上海自主智能无人系统科学中心)
;
College of Architecture and Urban Planning, Tongji University(同济大学建筑与城市规划学院)
;
Behavioral and Spatial AI Lab, Peking University & Tongji University(北京大学与同济大学行为与空间人工智能实验室)
Support Vector Rubrics: Closing the Gap Between Self-Generated and Human Rubrics
支持向量评分准则:弥合自生成与人工评分准则之间的差距
Mengyuan Sun, Yu Li, Zhuohao Yu, Shikun Zhang, Wei Ye
机构
*
National Engineering Research Center for Software Engineering, Peking University(北京大学软件工程国家工程研究中心)
;
University of Science and Technology of China(中国科学技术大学)
机构
*
Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院)
;
Weixin, Tencent(腾讯微信)
;
Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)
MIRAGE: Mobile Agents with Implicit Reasoning and Generative World Models
MIRAGE: 具有隐式推理和生成世界模型的移动智能体
Zhichao Yang, Yuanze Hu, Haojie Hao, Longkun Hao, Dongshuo Huang, Hongyu Lin, Gen Li, Lanqing Hong, Yihang Lou, Yan Bai
机构
*
Beihang University(北京航空航天大学)
;
Northwestern Polytechnical University(西北工业大学)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
National University of Singapore(新加坡国立大学)
;
Peking University(北京大学)
On the Superlinear Relationship between SGD Noise Covariance and Loss Landscape Curvature
关于SGD噪声协方差与损失景观曲率之间的超线性关系
Yikuan Zhang, Ning Yang, Yuhai Tu
机构
*
School of Physics, Peking University(北京大学物理系)
;
Peking University Chengdu Academy for Advanced Interdisciplinary Biotechnologies(北京大学成都先进交叉生物技术研究院)
;
Flatiron Institute(Flatiron研究所)
Towards Automated Kernel Generation in the Era of LLMs
面向LLM时代的自动化内核生成
Yang Yu, Peiyu Zang, Chi Hsu Tsai, Haiming Wu, Yixin Shen, Jialing Zhang, Haoyu Wang, Zhiyou Xiao, Jingze Shi, Yuyu Luo, Wentao Zhang, Chunlei Men, Guang Liu, Yonghua Lin
机构
*
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
;
Beijing Normal University(北京师范大学)
;
Peking University(北京大学)
;
Beijing Institute of Technology(北京理工大学)
;
Cornell University(康奈尔大学)
;
Beijing Jiaotong University(北京交通大学)
;
Renmin University of China(中国人民大学)
;
Hong Kong University of Science and Technology (Guangzhou)(广州科技大学)
SMART: Shot-Aware Multimodal Video Moment Retrieval with Audio-Enhanced MLLM
SMART: 基于音频增强多模态大模型的镜头感知视频时刻检索
An Yu, Weiheng Lu, Jian Li, Zhenfei Zhang, Yunhang Shen, Felix X. -F. Ye, Ming-Ching Chang
机构
*
Department of Computer Science, University at Albany - SUNY(University at Albany - SUNY 计算机科学系)
;
School of Software & Microelectronics, Peking University(北京大学软件与微电子学院)
;
Nanjing University(南京大学)
;
Xiamen University(厦门大学)
;
Department of Mathematics and Statistics, University at Albany - SUNY(University at Albany - SUNY 数学与统计学系)
Discovering Expert-Level Nash Equilibrium Algorithms with Large Language Models
利用大型语言模型发现专家级纳什均衡算法
Hanyu Li, Dongchen Li, Xiaotie Deng
机构
*
CFCS, School of Computer Science, Peking University, Beijing, China(计算机科学系,北京大学,北京,中国)
;
School of Computing and Data Science, The University of Hong Kong, Pokfulam, Hong Kong(计算与数据科学学院,香港大学,薄扶林,香港)