arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

Annual Meeting of the Association for Computational Linguistics · 会议 · Natural Language Processing

2026-05-05 至 2026-05-05 共收录 18
2605.01566 2026-05-05 cs.AI

Multi-Agent Reasoning Improves Compute Efficiency: Pareto-Optimal Test-Time Scaling

多智能体推理提升计算效率:帕累托最优测试时缩放

Florian Valentin Wunderlich, Lars Benedikt Kaesberg, Jan Philip Wahle, Terry Ruas, Bela Gipp

机构 * University of Göttingen(戈滕堡大学)

AI总结 本文分析了多智能体推理策略的计算效率,通过实验确定在不同模型规模下,帕累托最优方法能以最低计算成本获得最高准确性,尤其在复杂任务中多智能体方法表现更优。

Comments Accepted at SRW at ACL 2026, long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01484 2026-05-05 cs.LG stat.ML

Evaluating LLMs on Large-Scale Graph Property Estimation via Random Walks

通过随机游走评估大图属性估计中的LLM

Sunil Kumar Maurya, Xin Liu

机构 * University of Tokyo(东京大学) AIST(日本产业技术综合研究所)

AI总结 本文提出EstGraph基准数据集,设计四类任务估计大图属性,通过随机游走采样生成提示,评估LLM在大图场景下的推理能力。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01474 2026-05-05 cs.CL

ReMedi: Reasoner for Medical Clinical Prediction

ReMedi:医疗临床预测的推理器

Yushi Cao, Yiming Chen, Hongchao Jiang, Hung-yi Lee, Robby T. Tan

机构 * ASUS Intelligent Cloud Services (AICS)(ASUS智能云服务(AICS)) NTU Artificial Intelligence Center of Research Excellence (NTU AI-CoRE)(国立科技大学人工智能研究中心(NTU AI-CoRE)) National University of Singapore(新加坡国立大学)

AI总结 ReMedi通过生成推理-答案对提升电子健康记录的临床预测能力,利用真实答案提示增强推理过程,实验显示在多个任务中F1得分提升达19.9%。

Comments ACL 2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01399 2026-05-05 cs.CL cs.AI cs.IR

Verbal-R3: Verbal Reranker as the Missing Bridge between Retrieval and Reasoning

Verbal-R3:作为检索与推理之间缺失桥梁的语义重排序

Sangkwon Park, Donghun Kang, Jisoo Mok, Sungroh Yoon

机构 * Department of Electrical and Computer Engineering, Seoul National University(首尔国立大学电子与计算机工程系) Interdisciplinary Program in Artificial Intelligence, Seoul National University(首尔国立大学人工智能跨学科项目) AIIS, ASRI, INMC, and ISRC, Seoul National University(首尔国立大学人工智能研究所、人工智能研究室、智能网络研究中心和智能系统研究中心) DGIST(延世大学)

AI总结 本文提出Verbal-R3框架,通过语义注释增强LLM的推理能力,实现检索与推理的高效整合,提升问答任务性能。

Comments ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.01256 2026-05-05 cs.CL

GIFT: Guided Fine-Tuning and Transfer for Enhancing Instruction-Tuned Language Models

GIFT:指导微调与迁移以增强指令微调语言模型

Zhiwen Ruan, Yichao Du, Jianjie Zheng, Longyue Wang, Yun Chen, Peng Li, Jinsong Su, Yang Liu, Guanhua Chen

机构 * Southern University of Science and Technology(南方科技大学) Alibaba Group(阿里巴巴集团) Shanghai University of Finance and Economics(上海财经大学) Tsinghua University(清华大学) Xiamen University(厦门大学)

AI总结 GIFT通过整合指令模型的指导信息,提升指令微调语言模型的任务适应能力,实验显示其在数学和知识密集型基准上优于直接微调和迁移基线。

Journal ref Main of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00842 2026-05-05 cs.AI cs.LG

Understanding Emergent Misalignment via Feature Superposition Geometry

通过特征叠加几何理解涌现对齐问题

Gouki Minegishi, Hiroki Furuta, Takeshi Kojima, Yusuke Iwasawa, Yutaka Matsuo

机构 * The University of Tokyo(东京大学) Google DeepMind(谷歌DeepMind)

AI总结 研究通过特征叠加几何解释了微调窄任务导致有害行为的机制,发现有害特征在几何上更接近,并通过过滤接近毒特征的数据减少对齐问题。

Comments Accepted to ACL2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27924 2026-05-05 cs.CL cs.AI

Can AI Be a Good Peer Reviewer? A Survey of Peer Review Process, Evaluation, and the Future

人工智能能成为良好的同行评审者吗?同行评审流程、评估与未来的调查

Sihong Wu, Owen Jiang, Yilun Zhao, Tiansheng Hu, Yiling Ma, Kaiyan Zhang, Manasi Patwardhan, Arman Cohan

机构 * Yale University(耶鲁大学) New York University(纽约大学)

AI总结 本文调查了同行评审流程中的生成、 rebuttals 和 meta-review 等任务,以及评估方法,探讨了 LLM 在整个同行评审流程中的应用与未来方向。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13331 2026-05-05 cs.LG

Text-Attributed Knowledge Graph Enrichment with Large Language Models for Medical Concept Representation

基于大语言模型的文本属性知识图谱增强用于医学概念表示

Mohsen Nayebi Kerdabadi, Arya Hadizadeh Moghaddam, Chen Chen, Dongjie Wang, Zijun Yao

机构 * University of Kansas, USA(堪萨斯大学)

AI总结 本文提出MedCo框架,通过结合统计关联和LLM提示构建医学知识图谱,并利用LLM生成节点描述和边解释,最终融合文本语义与图结构生成统一的概念嵌入,提升临床预测性能。

Comments This paper has been accepted at ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06091 2026-05-05 cs.CL cs.AI cs.MA

Social Dynamics as Critical Vulnerabilities that Undermine Objective Decision-Making in LLM Collectives

社交动态作为削弱LLM集体客观决策的脆弱性

Changgeon Ko, Jisu Shin, Hoyun Song, Huije Lee, Eui Jun Hwang, Jong C. Park

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

AI总结 研究探讨了社交动态如何影响LLM集体中代表代理的决策准确性,发现社交压力增加时,代理性能显著下降,且修辞策略会影响判断。

Comments ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03380 2026-05-05 cs.CL

Noise Steering for Controlled Text Generation: Improving Diversity and Reading-Level Fidelity in Arabic Educational Story Generation

噪声引导用于受控文本生成:在阿拉伯语教育故事生成中提高多样性与阅读水平的保真度

Haziq Mohammad Khalid, Salsabeel Shapsough, Imran Zualkernan

机构 * American University of Sharjah(阿联酋沙迦美国大学)

AI总结 本文探讨了噪声引导方法在生成阿拉伯语早期阅读评估故事中的应用,通过对比不同策略发现内部表示扰动比输出层面的随机性更适用于受约束的教育内容生成。

Comments Accepted to BEA @ ACL 26'

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05254 2026-05-05 cs.IR cs.CL

TagRAG: Tag-guided Hierarchical Knowledge Graph Retrieval-Augmented Generation

TagRAG:基于标签的分层知识图谱检索增强生成

Wenbiao Tao, Xinyuan Li, Yunshi Lan, Weining Qian

机构 * East China Normal University(东华师范大学)

AI总结 TagRAG通过构建标签知识图谱和标签引导的检索生成框架,提升小语言模型的全局推理能力和知识增量效率,实验显示其在多个领域数据集上表现优异。

Comments Accepted by ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09883 2026-05-05 cs.CL cs.LG

DELTA: Dynamic Layer-Aware Token Attention for Efficient Long-Context Reasoning

DELTA: 动态层感知令牌注意力机制用于高效的长上下文推理

Hossein Entezari Zarch, Lei Gao, Chaoyi Jiang, Murali Annavaram

机构 * University of Southern California(南加州大学)

AI总结 DELTA通过动态层感知令牌注意力机制提升长上下文推理效率,减少计算成本而不牺牲准确性,在AIME和GPQA-Diamond等基准上表现优异。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.17677 2026-05-05 cs.AI

EngiBench: A Benchmark for Evaluating Large Language Models on Engineering Problem Solving

EngiBench:用于评估大型语言模型在工程问题解决上的基准

Xiyuan Zhou, Xinlei Wang, Yirui He, Yang Wu, Ruixi Zou, Yuheng Cheng, Yulu Xie, Wenxuan Liu, Huan Zhao, Yan Xu, Jinjin Gu, Junhua Zhao

机构 * Nanyang Technological University(南洋理工大学) The University of Sydney(悉尼大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shenzhen Loop Area Institute(深圳河套学院) The University of Hong Kong(香港大学) Hong Kong Polytechnic University(香港理工大学) AIRS

AI总结 EngiBench是一个分层基准,用于评估大型语言模型在解决工程问题上的能力,涵盖基础知识检索、情境推理和开放性建模三个层次,揭示当前LLM在现实工程中仍缺乏高级推理能力。

Comments Accepted at ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19227 2026-05-05 cs.CL cs.AI cs.HC

Generative Interfaces for Language Models

生成式接口用于语言模型

Jiaqi Chen, Yanzhe Zhang, Yutong Zhang, Yijia Shao, Diyi Yang

机构 * Stanford University(斯坦福大学) Georgia Tech(佐治亚理工学院)

AI总结 本文提出生成式接口,通过主动生成用户界面提升多轮交互效率,实验表明其在人类偏好上提升达72%。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12778 2026-05-05 cs.CL

HeteroRAG: A Heterogeneous Retrieval-Augmented Generation Framework for Medical Vision Language Tasks

HeteroRAG:一种用于医疗视觉语言任务的异构检索增强生成框架

Zhe Chen, Yusheng Liao, Zhiyuan Zhu, Haolin Li, Hongcheng Liu, Yanfeng Wang, Yu Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 本文提出HeteroRAG框架,通过异构知识源增强医疗大视觉语言模型,解决异构数据检索问题,提升事实准确性与可靠性。

Comments ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02046 2026-05-05 cs.RO cs.LG

NaviMaster: Learning a Unified Policy for GUI and Embodied Navigation Tasks

NaviMaster: 学习GUI和具身导航任务的统一策略

Zhihao Luo, Wentao Yan, Jingyu Gong, Min Wang, Zhizhong Zhang, Xuhong Wang, Yuan Xie, Xin Tan

机构 * East China Normal University(东华大学) Shanghai AI Laboratory(上海人工智能实验室) SenseTime Research(商汤科技研究院)

AI总结 本文提出NaviMaster,通过统一框架整合GUI导航和具身导航,采用视觉目标轨迹收集管道、统一强化学习框架和距离感知奖励,提升泛化能力。

Comments ACL 2026 Main Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10920 2026-05-05 cs.CL cs.LG

Constructing Interpretable Features from Compositional Neuron Groups

从组合神经元组中构建可解释特征

Or Shafran, Atticus Geiger, Mor Geva

机构 * Blavatnik School of Computer Science and AI, Tel Aviv University(特拉维夫大学Blavatnik计算机科学与人工智能学院)

AI总结 本文提出SNMF方法,通过半非负矩阵分解直接分解MLP激活,生成稀疏线性组合的可解释特征,并在多个模型上验证其在因果操控中的优越性。

Comments Accepted at ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03820 2026-05-05 cs.CL

Automatic Correction of Writing Anomalies in Hausa Texts

Hausa 文本中书写异常的自动纠正

Ahmad Mustapha Wali, Sergiu Nisioi

机构 * Human Language Technologies Research Center(人类语言技术研究中心) Faculty of Mathematics and Computer Science(数学与计算机科学学院) University of Bucharest(布加勒斯特大学)

AI总结 本文提出通过微调变压器模型自动纠正 Hausa 文本中的书写异常,构建了大规模噪声-清洁句子对数据集,并展示了 M2M100 等模型在提升下游任务中的效果。

Comments Accepted at ACL2026

详情

展开后加载摘要…

URL PDF HTML 收藏