Chain-of-Thought Prompting for Speech Translation
专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);分类 cs.CL
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
Comments Accepted to ICASSP 2025. Project Website: https://github.com/kuan2jiu99/audio-hallucination
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI
Comments AI4EDA co-located with 38th Conference on Neural Information Processing Systems (NeurIPS 2024)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);分类 cs.AI
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.LG
Comments Oral Presentation at 2024 NeurIPS Workshop on Time Series in the Age of Large Models
专题命中 其他推理 :reasoning(title,abstract);CoT(abstract);分类 cs.AI
专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL
Comments arXiv admin note: text overlap with arXiv:2212.14548
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
Comments Accepted at NeurIPS 2024 Workshop on Causality and Large Models (CaLM)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
专题命中 其他推理 :chain-of-thought(title,abstract);CoT(abstract);分类 cs.CL
专题命中 其他推理 :chain-of-thought(title);reasoning(abstract);CoT(abstract);分类 cs.CL
Comments Accepted by BioNLP2024 Workshop
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
Comments Accepted at EACL 2024
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.CL
Comments Accepted to ICLR 2024
专题命中 其他推理 :chain-of-thought(title);reasoning(abstract);CoT(abstract);分类 cs.CL
Comments modification
CosmicFish-HRM:紧凑语言模型中基于层次循环机制的适应性推理
机构 * Mistyoz AI Hyderabad, India(Mistyoz AI 德里, 印度)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 提出一种紧凑语言模型CosmicFish-HRM,通过层次推理模块动态分配推理深度,在保持较小参数量的同时实现适应性推理。
Comments 17 pages, 4 figures. Exploratory study of adaptive reasoning depth in compact autoregressive language models. Code available at https://github.com/MistyozAI/CosmicFish-HRM
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to the 1st Natural Language Reasoning and Structured Explanations Workshop (NLRSE@ACL'23). 8 pages, 4 figures, 3 tables
面向长上下文语言模型的可合并模型侧聚合状态
专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI
AI总结 针对长上下文语言模型在非加性集合聚合任务中的性能缺陷,提出带HLL草图状态的模型侧聚合接口,该接口可合并跨段状态,在多任务上较基线方法实现显著性能提升。
大语言模型中的信息压制:对DeepSeek的信息审查、量化与特征化
机构 * Thomas Lord Department of Computer Science, University of Southern California, USA(汤姆斯·劳德计算机科学系,南加州大学) ; Information Sciences Institute, University of Southern California, USA(信息科学研究所,南加州大学) ; Annenberg School of Communication, University of Southern California, USA(安纳伯格传播学院,南加州大学)
专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI
AI总结 本研究通过审计框架揭示DeepSeek在处理政治敏感提示时的信息压制现象,指出模型在内部推理中保留敏感内容,但在最终输出中进行过滤或改写,强调了对AI模型中信息压制机制进行系统审查的重要性。
Journal ref Inf. Sci. 724, C (Jan 2026)
残差上下文扩散语言模型
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他推理 :CoT(summary_cn,abstract);reasoning(abstract);分类 cs.CL、cs.AI
AI总结 提出残差上下文扩散(RCD)模块,通过回收丢弃令牌的上下文残差提高扩散语言模型的解码效率,在长/短CoT任务上以极少额外计算提升准确率4-11个百分点。
面向通用图挖掘的大语言模型图导向指令微调
机构 * Engineering Research Center of Big Data Intelligence, Ministry of Education(教育部大数据智能工程研究中心) ; Fujian Key Laboratory of Network Computing and Intelligent Information Processing(福建省网络计算与智能信息处理重点实验室) ; College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院) ; Department of Computer Science, Emory University(埃默里大学计算机科学系)
专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI
AI总结 提出MuseGraph框架,通过紧凑图描述、基于思维链的指令生成和图感知指令微调,将GNN与LLM结合,实现跨任务和数据集的高效图挖掘。
Comments Accepted by TPAMI 2025
Journal ref IEEE Trans. Pattern Anal. Mach. Intell., vol. 48, no. 1, pp. 155-169, Jan. 2026
从被动代理到策略谈判者:用SocialRL强化小型语言模型的社会推理能力
机构 * Microsoft Research(微软研究院)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 该研究提出SocialRL方法训练4B语言模型的社会推理能力,经多领域实验,其跨领域整合后模型平均效用达0.627,优于多数GPT系列模型,心智理论蒸馏可提升效用与泛化性。
Comments 25 pages, 3 figures
LLM推理轨迹中的认知片段实现可解释的人类项目难度预测
机构 * Virginia Tech(弗吉尼亚理工大学) ; University of Maryland(马里兰大学) ; MBZUAI(穆桑大学人工智能研究所) ; University of Pittsburgh(匹兹堡大学)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 提出Epi2Diff框架,将大型推理模型的推理轨迹映射为认知片段序列,通过推理规模、努力分配和状态转换建模项目难度,在真实数据集上优于基线方法。
Comments 32 pages, 8 figures, 10 tables
多任务GRPO:跨任务的可靠大语言模型推理
机构 * UCL Department of EEE(伦敦大学学院电子工程系) ; UCL Centre for AI(伦敦大学学院人工智能中心) ; Huawei Noah’s Ark Lab(华为诺亚实验室) ; UNIST Graduate School of AI(延世大学人工智能研究生院) ; University of Edinburgh(爱丁堡大学) ; University of Basel(巴塞尔大学)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出MT-GRPO算法,通过动态调整任务权重和比例保持采样器,提升多任务场景下大语言模型的可靠推理性能。
Comments Accepted at ICML 2026
推理的代价:神经机器翻译强化学习中的成本-质量权衡
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究神经机器翻译强化学习中推理痕迹对翻译质量的影响,通过在训练或推理阶段省略推理痕迹进行实验,发现推理尤其是推理阶段能提升质量,还研究了推理导致计算需求增加与翻译质量提升间的成本-质量权衡。
Journal ref Proceedings of the 2026 ACM Symposium on Document Engineering (DocEng '26)
翻译前推理:用结构化推理增强法律机器翻译
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究法律领域神经机器翻译难题,通过比较多种方法,评估小型语言模型在不同再训练范式下的表现,以瑞士法律系统为测试平台,发现强化学习效果好,增强小型模型接近前沿推理模型,再训练范式随模型规模收益递减。
Comments Code available at https://github.com/aixiuxiuxiu/Legal-MT-SFT-RL
NRR-Core:非解析推理作为情境身份和歧义保留的计算框架
机构 * Independent Researcher, Japan(日本独立研究员)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出NRR框架,通过多向量嵌入、非坍缩注意力和情境身份追踪,解决人工智能系统过早解析歧义的问题,保持歧义保留以提升推理灵活性。
Comments 14 pages, 2 figures, 2 tables. Replacement synced to the current GitHub repository snapshot. Series hub: https://github.com/kei-saito-research/nrr-series-hub
路由、通信与推理:用于高效多智能体推理的门控路由与自适应深度
机构 * Yardi School of Artificial Intelligence, Indian Institute of Technology Delhi(印度理工学院德里分校雅迪人工智能学院) ; Department of Electrical Engineering, Indian Institute of Technology Delhi(印度理工学院德里分校电气工程系)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究针对多智能体推理中未解决的问题,提出GRADE分层多智能体系统,用四个轻量级学习门控及CoGRPO训练方法,智能体模型可热插拔。该系统在多个任务上优于基线,消融实验明确关键因素,证明校准对热插拔必要。
Agon:具有隐式推理对手评分的竞争性跨模型强化学习
机构 * Independent Researcher(独立研究者)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 研究针对可验证奖励强化学习只评最终答案的问题,提出Agon方法,让两个竞争模型相互评分,通过轮流扮演角色隐式判断推理,在难题上提升了模型表现,且该排序在多种场景和模型家族中可复制。
Comments 15 pages, 7 figures, 8 tables
通过操作草图和自监督学习推广表格数据中的数值推理
机构 * Seoul National University(首尔国立大学) ; Soongsil University(顺天大学)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL、cs.AI、cs.LG
AI总结 本文提出TaNOS框架,通过操作草图和自监督学习提升表格数据中数值推理的泛化能力,实验显示其在FinQA数据集上表现优异,且在领域转移中鲁棒性更强。
Comments Accepted to TACL. This is a pre-MIT Press publication version