arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

2026-05-28 至 2026-05-28 共收录 4
2602.20020 2026-05-28 cs.CL

CodeGENCAT: Generative Computerized Adaptive Testing for Open-ended Coding Problems

CodeGENCAT:面向开放式编程问题的生成式计算机自适应测试

Wanyong Feng, Alexander Scarlatos, Ruochen Sun, Andrew Lan

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Independent Researcher(独立研究者)

AI总结 提出CodeGENCAT框架,通过生成式项目反应理论模型预测学生代码响应,并设计三种选题算法,在编程教育数据集上优于现有CAT基线。

Comments 23 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15198 2026-05-28 cs.MA cs.AI cs.CL

Colosseum: Auditing Collusion in Cooperative Multi-Agent Systems

Colosseum: 审计合作多智能体系统中的合谋行为

Mason Nakamura, Abhinav Kumar, Saswat Das, Sahar Abdelnabi, Saaduddin Mahmud, Ferdinando Fioretto, Shlomo Zilberstein, Eugene Bagdasarian

机构 * University of Massachusetts Amherst(马萨诸塞大学阿姆赫斯特分校) University of Virginia(弗吉尼亚大学) ELLIS Institute Tübingen(图宾根ELLIS研究所) MPI for Intelligent Systems, Tübingen(图宾根智能系统研究所) AI Center(人工智能中心)

AI总结 提出Colosseum框架,通过形式化决策框架和基于遗憾的度量审计LLM智能体在合作多智能体系统中的合谋行为,发现大多数模型存在新兴合谋倾向,并观察到“纸上合谋”现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17620 2026-05-28 cs.CL

Forget to Know, Remember to Use: Context-Aware Unlearning for Large Language Models

忘记知识,记住使用:面向大型语言模型的上下文感知遗忘

Yuefeng Peng, Parnian Afshar, Megan Ganji, Thomas Butler, Amir Houmansadr, Mingxian Wang, Dezhi Hong

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校) Amazon(亚马逊)

AI总结 针对现有遗忘方法损害上下文可用性的问题,提出一种插件式目标项,在保持遗忘效果和保留集性能的同时恢复模型对已遗忘知识的上下文使用能力。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19342 2026-05-28 cs.LG cs.AI

ASTRA: Communication-Efficient Acceleration for Multi-Device Transformer Inference

ASTRA:面向多设备Transformer推理的通信高效加速

Xiao Liu, Lijun Zhang, Deepak Ganesan, Hui Guan

机构 * Manning College of Information and Computer Sciences, University of Massachusetts Amherst, MA, US(信息与计算机科学学院,马萨诸塞大学阿默斯特分校,马萨诸塞州,美国) Amazon, Seattle, WA, US(亚马逊,华盛顿州西雅图,美国) Amazon AWS, Washington, D.C., US(亚马逊AWS,华盛顿特区,美国)

AI总结 提出ASTRA框架,通过序列并行与混合精度注意力机制,在低带宽环境下实现高效多设备Transformer推理,显著加速并保持精度。

详情

展开后加载摘要…

URL PDF HTML 收藏