ARA: Agentic Reproducibility Assessment For Scalable Support Of Scientific Peer-Review
ARA:面向大规模科学同行评审的代理可重复性评估
Kevin Riehl, Andres L. Marin, Nikofors Zacharof, Fan Wu, Patrick Langer, Robert Jakob, Anastasios Kouvelas, Georgios Fontaras, Michail A. Makridis
机构
*
ETH Zürich, IVT & Agentic Systems Lab (ASL)(苏黎世联邦理工学院,信息与通信技术研究所及代理系统实验室)
;
European Commission, Joint Research Centre(欧洲委员会,联合研究中心)
;
University of Konstanz(康斯坦茨大学)
;
Ideas Forward
BioXArena: Benchmarking LLM Agents on Multi-Modal Biomedical Machine Learning Tasks
BioXArena:在多模态生物医学机器学习任务上评估LLM代理的基准测试
Loka Li, Duzhen Zhang, Xingbo Du, Leonard Song, Zixiao Wang, Assanali Aukenov, Noel Thomas, Shakhnazar Sailaukan, Yonghan Yang, Feilong Chen, Jiahua Dong, Kun Zhang, Bin Zhang, Le Song
VideoSeeker: Incentivizing Instance-level Video Understanding via Native Agentic Tool Invocation
VideoSeeker:通过原生代理工具调用激励实例级视频理解
Yiming Zhao, Yu Zeng, Wenxuan Huang, Zhen Fang, Qing Miao, Qisheng Su, Jiawei Zhao, Jiayin Cai, Lin Chen, Zehui Chen, Yukun Qi, Yao Hu, Xiaolong Jiang, Feng Zhao
机构
*
University of Science and Technology of China(中国科学技术大学)
;
Xiaohongshu Inc.(小红书公司)
;
East China Normal University(华东师范大学)
;
Xi’an Jiaotong University(西安交通大学)
机构
*
City University of Hong Kong Hong Kong China
;
Xi'an Jiaotong University \& City University of Hong Kong Xi'an China
;
University of Science
;
Independent Researcher Beijing China
;
Tsinghua University Beijing China
;
City University of Hong Kong
;
Xi'an Jiaotong University \& City University of Hong Kong
;
Independent Researcher
;
Tsinghua University
ShadowMerge: A Novel Poisoning Attack on Graph-Based Agent Memory via Relation-Channel Conflicts
ShadowMerge:一种通过关系通道冲突的图基agent内存新型污染攻击
Yang Luo, Zifeng Kang, Tiantian Ji, Xinran Liu, Yong Liu, Shuyu Li, Lingyun Peng
机构
*
Key Laboratory of Trustworthy Distributed Computing and Service (MoE)(可信分布式计算与服务重点实验室)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Zhongguancun Laboratory(中关村实验室)
From Failure to Feedback: Group Revision Unlocks Hard Cases in Object-Level Grounding
从失败到反馈:群体修订解锁对象级 grounding 的难题
Yuyuan Liu, Yiping Ji, Anjie Le, Jiayuan Zhu, Jiazhen Pan, Can Peng, Jiajun Deng, Fengbei Liu, Junde Wu
机构
*
Department of Engineering Science, University of Oxford(牛津大学工程科学系)
;
Australian Institute for Machine Learning, Adelaide University(阿德莱德大学人工智能研究所)
;
Technical University of Munich(慕尼黑技术大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Cornell University(康奈尔大学)