MASEval: Extending Multi-Agent Evaluation from Models to Systems
MASEval: 从模型到系统的多智能体评估扩展
Cornelius Emde, Alexander Rubinstein, Anmol Goel, Ahmed Heakl, Sangdoo Yun, Seong Joon Oh, Martin Gubri
机构
*
Parameter Lab(参数实验室)
;
University of Oxford(牛津大学)
;
University of Tübingen(图宾根大学)
;
TU Darmstadt(德累斯顿理工大学)
;
MBZUAI
;
NAVER AI Lab(NAVER AI实验室)
;
KAIST(韩国科学技术院)
It Takes Two to Tango: A Holistic Simulator for Joint Order Scheduling and Multi-Agent Path Finding in Robotic Warehouses
双人探戈也需要两人:一种综合模拟器用于机器人仓库中的联合订单调度和多智能体路径寻找
Haozheng Xu, Wenhao Li, Zifan Wei, Bo Jin, Hongxing Bai, Ben Yang, Xiangfeng Wang
机构
*
East China Normal University(东华大学)
;
Tongji University(同济大学)
;
Zhejiang Galaxis Technology Group Co.,Ltd(浙江伽利西科技集团有限公司)
;
Shenzhen Loop Area Institute (SLAI)(深圳环 area 研究院)
OIG-Bench: A Multi-Agent Annotated Benchmark for Multimodal One-Image Guides Understanding
Jiancong Xie, Wenjin Wang, Zhuomeng Zhang, Zihan Liu, Qi Liu, Ke Feng, Zixun Sun, Yuedong Yang
机构
*
School of Computer Science and Engineering, Sun Yat-sen University, China(中山大学计算机科学与工程学院)
;
Interactive Entertainment Group, Tencent Inc, China(腾讯互动娱乐集团)
;
Key Laboratory of Machine Intelligence and Advanced Computing (MOE), China(机器智能与先进计算重点实验室)
Controlling AI Agent Participation in Group Conversations: A Human-Centered Approach
Stephanie Houde, Kristina Brimijoin, Michael Muller, Steven I. Ross, Dario Andres Silva Moran, Gabriel Enrique Gonzalez, Siya Kunde, Morgan A. Foreman, Justin D. Weisz
Comments31 pages, 7 figures. In Proceedings of the 30th International Conference on Intelligent User Interfaces (IUI '25), March 24-27, 2025, Cagliari, Italy
Shayegan Omidshafiei, Christos Papadimitriou, Georgios Piliouras, Karl Tuyls, Mark Rowland, Jean-Baptiste Lespiau, Wojciech M. Czarnecki, Marc Lanctot, Julien Perolat, Remi Munos
Agentic Commerce World: An Auditable and Verifiable Environment for Vibe Commerce
智能体商业世界:一种可审计可验证的氛围式商业环境
Shicheng Fan, Mingdai Yang, Duohao Wang, Canyu Chen, Yongfeng Zhang, Hua Wei, Manling Li, Julian McAuley, Kun Zhang, Philip S. Yu, Kejing Yu, Zhiwei Liu
机构
*
University of Illinois at Chicago(伊利诺伊大学芝加哥分校)
;
Springbrand(斯普林布兰德公司)
;
Northwestern University(西北大学)
;
Rutgers University(罗格斯大学)
;
Arizona State University(亚利桑那州立大学)
;
University of California San Diego(加州大学圣迭戈分校)
;
Carnegie Mellon University(卡内基梅隆大学)
;
MBZUAI(Mohamed bin Zayed 人工智能大学)
;
Microsoft AI(微软人工智能部门)
A Unified Framework for the Evaluation of LLM Agentic Capabilities
LLM 代理能力评估的统一框架
Pengyu Zhu, Lijun Li, Yaxing Lyu, Qianxin Luo, Jingyi Yang, Yi Liu, Tingfeng Hui, Xinyu Yuan, Li Sun, Sen Su, Jing Shao
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
Chongqing University of Posts and Telecommunications(重庆邮电大学)
;
North China Electric Power University(华北电力大学)