arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Cambridge(剑桥大学)

2026-04-21 至 2026-04-21 共收录 10
2601.03154 2026-04-21 cs.CL

Decoupling the Effect of Chain-of-Thought Reasoning: A Human Label Variation Perspective

解耦链式推理的影响:从人类标签变异视角出发

Beiduo Chen, Tiancheng Hu, Caiqi Zhang, Robert Litschko, Anna Korhonen, Barbara Plank

机构 * MaiNLP Center for Information and Language Processing, LMU Munich(信息与语言处理中心,慕尼黑大学) LMU Munich, Germany(慕尼黑大学,德国) Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心(MCML),慕尼黑,德国) Language Technology Lab, University of Cambridge, United Kingdom(语言技术实验室,剑桥大学,英国)

AI总结 本文通过系统解耦实验探讨了链式推理对分布任务的影响,发现推理内容对最终准确性贡献大,而模型先验对分布排名起主导作用。

Comments Accepted by ACL 2026 Findings, 21 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16054 2026-04-21 cs.CR cs.CL

Privacy-R1: Privacy-Aware Multi-LLM Agent Collaboration via Reinforcement Learning

Privacy-R1: 通过强化学习实现隐私意识的多LLM代理协作

Zheng Hui, Yijiang River Dong, Sanhanat Sivapiromrat, Ehsan Shareghi, Nigel Collier

机构 * University of Cambridge(剑桥大学) University College London(伦敦大学学院)

AI总结 本文提出Privacy-R1框架,通过强化学习动态路由文本块,在隐私泄露与任务性能间取得平衡,引入医疗数据集验证方法有效性,实现隐私-效用前沿的新状态。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17389 2026-04-21 cs.CV

Deep learning based Non-Rigid Volume-to-Surface Registration for Brain Shift compensation Using Point Cloud

基于深度学习的非刚性体积分到表面注册用于脑移位补偿的点云方法

Eashrat Jahan Muniya, Gernot Kronreif, Ander Biguri, Wolfgang Birkfellner, Sepideh Hatamikia

机构 * Austrian Center for Medical Innovation and Technology(奥地利医学创新与技术中心) Medical University of Vienna(维也纳医学大学) University of Cambridge(剑桥大学) Danube Private University (DPU)(多瑙私人大学(DPU))

AI总结 本文提出基于深度学习的非刚性体积分到表面注册方法,利用稀疏手术表面观测进行密集位移场估计,实现有限视野下的脑移位补偿。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03846 2026-04-21 cs.MA cs.AI

When Numbers Start Talking: Implicit Numerical Coordination Among LLM-Based Agents

当数字开始说话:基于大语言模型的智能体间的隐性数字协调

Alessio Buscemi, Daniele Proverbio, Alessandro Di Stefano, The-Anh Han, German Castignani, Pietro Liò

机构 * Luxembourg Institute of Science and Technology(卢森堡科学与技术研究所) University of Trento(特伦托大学) Teesside University(泰赛大学) University of Cambridge(剑桥大学)

AI总结 本文研究了基于大语言模型的多智能体系统中隐性沟通的博弈理论,分析了不同沟通模式下协调与战略结果的变化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17408 2026-04-21 cs.AI cs.LG

The Impact of Off-Policy Training Data on Probe Generalisation

偏离策略训练数据对探测泛化的影响

Nathalie Kirch, Samuel Dower, Adrians Skapars, Helen Yannakoudakis, Ekdeep Singh Lubana, Dmitrii Krasheninnikov

机构 * King’s College London(伦敦国王学院) Imperial College London(伦敦帝国学院) LASR Labs(LASR实验室) University of Manchester(曼彻斯特大学) Goodfire AI University of Cambridge(剑桥大学)

AI总结 本文研究了偏离策略训练数据对八个不同LLM行为探测泛化的影响,发现训练策略显著影响探测性能,尤其在涉及响应意图的行为上表现更差,并提出预测泛化失败的测试方法。

Comments 10 pages, ACL 2026 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16586 2026-04-21 cs.LG cs.AI q-bio.QM

A Systematic Survey and Benchmark of Deep Learning for Molecular Property Prediction in the Foundation Model Era

在基础模型时代对深度学习用于分子性质预测的系统调查和基准测试

Zongru Li, Xingsheng Chen, Honggang Wen, Regina Qianru Zhang, Ming Li, Xiaojin Zhang, Hongzhi Yin, Qiang Yang, Kwok-Yan Lam, Pietro Lio, Siu-Ming Yiu

机构 * The University of Hong Kong, Hong Kong SAR(香港大学) Nanyang Technological University, Singapore(南洋理工大学) University of Cambridge, United Kingdom(剑桥大学) Zhejiang Normal University, China(浙江师范大学) The Hong Kong University of Science and Technology, Hong Kong SAR(香港科学与技术大学) The University of Queensland(昆士兰大学) The Hong Kong Polytechnic University, Hong Kong SAR(香港理工大学)

AI总结 本文系统调查了深度学习在分子性质预测中的应用,探讨了四种互补范式,并提出了未来三个发展方向,包括物理感知学习、可信推理的基础模型和整合计算与实验数据的基准生态系统。

Comments 32 pages. It is just accepted by Journal of Chemical Theory and Computation 2026

Journal ref Journal of Chemical Theory and Computation 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16465 2026-04-21 cs.AI econ.GN q-fin.EC

Healthcare AI for Automation or Allocation? A Transaction Cost Economics Framework

医疗AI用于自动化还是分配?一种交易成本经济学框架

Ari Ercole

机构 * Department of Medicine, University of Cambridge, Addenbrooke’s Hospital, Hills Road, Cambridge CB2 0QQ, UK(剑桥大学医学系,加德纳医院,剑桥,英国)

AI总结 本文通过交易成本经济学框架分析医疗工作中协调成本的差异,发现临床角色的协调成本高于非临床角色,表明数字和AI干预的机会分布受协调结构影响更大。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16403 2026-04-21 cs.AI cs.CY

Computational Hermeneutics: Evaluating generative AI as a cultural technology

计算阐释学:评估生成式AI作为文化技术

Cody Kommers, Ruth Ahnert, Maria Antoniak, Emmanouil Benetos, Steve Benford, Mercedes Bunz, Baptiste Caramiaux, Shauna Concannon, Martin Disley, James Dobson, Yali Du, Edgar Duéñez-Guzmán, Kerry Francksen, Evelyn Gius, Jonathan W. Y. Gray, Ryan Heuser, Sarah Immel, Richard Jean So, Sang Leigh, Dalaki Livingston, Hoyt Long, Meredith Martin, Georgia Meyer, Daniela Mihai, Ashley Noel-Hirst, Kirsten Ostherr, Deven Parker, Yipeng Qin, Jessica Ratcliff, Emily Robinson, Karina Rodriguez, Adam Sobey, Ted Underwood, Aditya Vashistha, Matthew Wilkens, Youyou Wu, Yuan Zheng, Drew Hemment

机构 * The Alan Turing Institute(艾伦·图灵研究所) Queen Mary University of London(伦敦玛丽女王大学) University of Colorado(科罗拉多大学) University of Nottingham(诺丁汉大学) King’s College London(伦敦国王学院) Sorbonne Université(索邦大学) Durham University(杜伦大学) University of Edinburgh(爱丁堡大学) Dartmouth College(达特茅斯学院) Gibran AI(吉布兰人工智能) University of Coventry(科文特大学) Technische Universität Darmstadt(德累斯顿技术大学) University of Cambridge(剑桥大学) McGill University(麦吉尔大学) Cornell University(康奈尔大学) University of Utah(犹他大学) University of Chicago(芝加哥大学) Princeton University(普林斯顿大学) London School of Economics(伦敦经济学院) University of Southampton(南安普顿大学) Rice University(德克萨斯大学稻谷分校) University of Glasgow(格拉斯哥大学) Cardiff University(卡迪夫大学) University of Exeter(埃克塞特大学) University of Brighton(布里斯托尔大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University College London(伦敦大学学院) University of Sheffield(谢菲尔德大学)

AI总结 本文提出计算阐释学框架,旨在通过阐释学理论评估生成式AI作为文化技术的含义生成与理解挑战。

Comments Published in Frontiers in Artificial Intelligence

Journal ref Front. Artif. Intell. 9:1753041

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16311 2026-04-21 cs.CL cs.AI cs.SI

Multimodal Claim Extraction for Fact-Checking

多模态声明提取用于事实核查

Joycelyn Teo, Rui Cao, Zhenyun Deng, Zifeng Ding, Michael Sejr Schlichtkrull, Andreas Vlachos

机构 * Defence Science and Technology Agency, Singapore(新加坡国防科学与技术局) University of Cambridge, UK(英国剑桥大学) Queen Mary University of London, UK(英国伦敦大学学院)

AI总结 本文提出首个多模态社交媒体声明提取基准,评估了最先进的多模态大语言模型,在语义对齐、忠实度和去上下文化框架下发现基线模型难以建模修辞意图和上下文线索,引入意图感知框架MICE提升关键意图场景性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16304 2026-04-21 cs.SE cs.AI cs.HC

Results-Actionability Gap: Understanding How Practitioners Evaluate LLM Products in the Wild

结果-可行动性差距:理解从业者如何在实际中评估大语言模型产品

Willem van der Maden, Malak Sadek, Ziang Xiao, Aske Mottelson, Q. Vera Liao, Jichen Zhu

机构 * HCI \& Design Section IT University of Copenhagen Copenhagen Denmark Centre for Human-Inspired Artificial Intelligence, Cambridge University Cambridge United Kingdom Computer Science Johns Hopkins University Baltimore Maryland United States Engineering University of Michigan Ann Arbor Michigan United States IT University of Copenhagen Centre for Human-Inspired Artificial Intelligence, Cambridge University Johns Hopkins University University of Michigan

AI总结 研究探讨从业者如何评估大语言模型产品,发现'结果-可行动性差距'问题,提出策略帮助从业者从非正式评估转向系统化评估。

详情

展开后加载摘要…

URL PDF HTML 收藏