arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Annual Meeting of the Association for Computational Linguistics · 会议 · Natural Language Processing

2026-07-28 至 2026-07-28 共收录 7
2601.14896 2026-07-28 cs.CL 版本更新

Language-Coupled Reinforcement Learning for Multilingual Retrieval-Augmented Generation

多语言耦合强化学习用于多语言检索增强生成

Rui Qi, Fengran Mo, Yufeng Chen, Xue Zhang, Shuo Wang, Hongliang Li, Jinan Xu, Jian-Yun Nie, Kaiyu Huang

机构 * School of Computer Science and Technology, Beijing Jiaotong University(计算机科学与技术学院,北京交通大学) University of Montreal(蒙特利尔大学) Tsinghua University(清华大学) University of Notre Dame(Notre Dame 大学)

AI总结 本文提出LcRL框架,通过语言耦合组相对策略优化减少知识偏差和冲突,提升多语言检索增强生成的性能,适用于受限训练数据和多语言大规模集合的场景。

Comments Accepted to ACL 2026 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05132 2026-07-28 cs.CL cs.AI 版本更新

PrinciplismQA: A Philosophy-Grounded Approach to Assessing LLM-Human Clinical Medical Ethics Alignment

PrinciplismQA: 一种基于哲学的评估LLM与人类临床医学伦理对齐的方法

Chang Hong, Minghao Wu, Qingying Xiao, Yuchi Wang, Xiang Wan, Guangjun Yu, Benyou Wang, Yan Hu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) National Health Data Institute, Shenzhen(深圳国家健康数据研究院) Shenzhen Research Institute of Big Data(深圳大数据研究院)

AI总结 本文提出PrinciplismQA,一种基于哲学框架的评估方法,用于评估LLM在临床医学伦理上的对齐情况,通过专家验证的问题集揭示模型在伦理推理上的不足。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09515 2026-07-28 cs.CL 版本更新

SERM: Self-Evolving Relevance Model with Agent-Driven Learning from Massive Query Streams

SERM:具有代理驱动学习的自演化相关性模型

Chenglong Wang, Canjia Li, Xingzhao Zhu, Yifu Huo, Huiyu Wang, Weixiong Lin, Yun Yang, Qiaozhi He, Tianhua Zhou, Xiaojia Chang, Jingbo Zhu, Tong Xiao

机构 * Northeastern University, Shenyang, China(东北大学,沈阳,中国) ByteDance(字节跳动) Peking University(北京大学)

AI总结 针对大规模查询流中相关性模型泛化能力不足的问题,SERM通过多代理模块检测分布偏移并生成可靠标签,实现迭代自演化提升性能。

Comments Accepted by Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09624 2026-07-28 cs.LG cs.AI cs.CL cs.CV 版本更新

A Mechanistic Perspective and Circuit-Guided Difficulty Metric for Unlearning

迈向理解遗忘难度:一种机制视角和电路引导的难度度量

Jiali Cheng, Ziheng Chen, Chirag Agarwal, Hadi Amiri

机构 * University of Massachusetts Lowell(马萨诸塞大学洛约拉分校) Walmart Global Tech(沃尔玛全球技术) University of Virginia(弗吉尼亚大学)

AI总结 本文提出CUD度量,通过分析模型电路揭示遗忘难度的机制特征,为设计基于模型机制的遗忘方法提供理论基础。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24411 2026-07-28 cs.AI cs.CL cs.CV cs.HC 版本更新

OS-Sentinel: Towards Safety-Enhanced Mobile GUI Agents via Hybrid Validation in Realistic Workflows

OS-Sentinel: 通过现实工作流中的混合验证实现安全增强的移动GUI代理

Qiushi Sun, Mukai Li, Zhoumianze Liu, Zhihui Xie, Fangzhi Xu, Zhangyue Yin, Kanzhi Cheng, Zehao Li, Zichen Ding, Qi Liu, Zhiyong Wu, Zhuosheng Zhang, Ben Kao, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 OS-Sentinel通过结合形式验证器和VLM上下文判断者,提升移动GUI代理的安全性,实验显示在多个指标上优于现有方法。

Comments ACL 2026 (Oral) & Best Paper at AIWILD @ ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.22080 2026-07-28 cs.SE cs.AI cs.CL 版本更新

CodeEvo: Interaction-Driven Synthesis of Code-centric Data through Hybrid and Iterative Feedback

CodeEvo:通过混合和迭代反馈以交互驱动方式合成以代码为中心的数据

Qiushi Sun, Jinyang Gong, Lei Li, Qipeng Guo, Fei Yuan

机构 * Shanghai AI Laboratory(上海人工智能实验室) The University of Hong Kong(香港大学) New York University(纽约大学) Carnegie Mellon University(卡内基梅隆大学) Shanghai Innovation Institute(上海创新研究院)

AI总结 为解决高质量指令-代码对获取难题,提出双智能体架构CodeEvo,审查器制定模式并结合混合验证协议,构建CodeEvo-100K数据集,实验表明基于此数据微调的模型在代码生成基准测试中表现出色。

Comments ACL 2026 (Oral)

详情

展开后加载摘要…

URL PDF HTML 收藏
1805.11546 2026-07-28 cs.CL cs.AI 版本更新

Like a Baby: Visually Situated Neural Language Acquisition

像婴儿一样:视觉情境下的神经语言习得

Alexander G. Ororbia, Ankur Mali, Mary Alexandria Kelly, David Reitter

AI总结 研究视觉情境对神经语言模型下一词预测的好处,引入多模态神经架构,微调预训练BERT嵌入,发现多模态环境下语言模型表现更好,符合情境认知理论,不同语言和模型中视觉情境训练优势明显。

Comments Final submission (camera-ready), accepted to ACL 2019

详情

展开后加载摘要…

URL PDF HTML 收藏