Synergy-of-Thoughts: Eliciting Efficient Reasoning in Hybrid Language Models
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 19 pages, 16 figures, 12 tables
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 19 pages, 16 figures, 12 tables
专题命中 其他推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG
在线学习中自回归链式推理理论
机构 * MIT(麻省理工学院) ; The Hebrew University(希伯来大学)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(title);分类 cs.LG
AI总结 本文研究自回归生成过程中的在线学习问题,探讨反馈形式对学习误差界的影响,证明在链式推理模型中可消除生成步数依赖,提出最优误差界及新下界。
我们能相信AI的解释吗?链式推理中的系统性低估证据
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(title);分类 cs.AI
AI总结 研究发现AI在链式推理中系统性低估提示信息,强制报告反而降低准确性,提示用户偏好尤其危险。
Comments 22 pages, 8 figures, 9 tables
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(title);分类 cs.CL
Comments Accepted at EMNLP Findings
反事实模拟训练用于思维链可信度
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文提出反事实模拟训练方法,通过奖励使模拟器准确预测模型输出来提升思维链的可信度,并在不同设置中验证其有效性。
Comments Accepted to COLM 2026
基于大语言模型的生成式推荐的隐式推理
机构 * University of Virginia(弗吉尼亚大学) ; Snap Inc.(Snap公司)
专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.CL、cs.AI
AI总结 针对大语言模型用于生成式推荐时显式推理的三大局限(世界知识表达弱化、语义ID与自然语言嵌入空间不对齐、推理质量敏感),提出轻量级隐式推理范式PauseRec,在性能、训练成本和推理速度上均优于显式方法。
GeoFaith: 时空双视角下的忠实思维链
机构 * Xidian University(西安电子科技大学) ; Xi’an Jiaotong University(西安交通大学) ; Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) ; The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) ; University of Science and Technology of China(中国科学技术大学)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 针对思维链推理中的事后合理化问题,提出基于潜在几何结构和熵动力学的时空框架GeoFaith,通过可扩展的引导流水线构建忠实性检测器并联合优化结果正确性、过程忠实性和轨迹一致性。
Mol-Debate:多智能体辩论提升分子设计中的结构推理
机构 * The Hong Kong Polytechnic University(香港理工大学) ; Sichuan University(四川大学)
专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.AI、cs.LG
AI总结 本文提出Mol-Debate框架,通过生成-辩论-细化循环提升分子设计中的结构推理能力,实验显示其在多个基准测试中表现优异。
TDA-RC:基于任务驱动的知识推理链对齐方法
机构 * School of Information and Software Engineering, University of Electronic Science and Technology of China(电子科技大学信息与软件工程学院) ; School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) ; College of Professional and Continuing Education, The Hong Kong Polytechnic University(香港理工大学专业及持续教育学院) ; School of Robotics and Advanced Manufacture, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)机电工程与自动化学院) ; School of Computing, Kyung Hee University(庆熙大学计算机学院) ; School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文提出TDA-RC方法,通过拓扑学优化提升大语言模型推理效率与准确性,结合持久同调将不同推理范式统一到拓扑空间中,实现高效且精准的推理链优化。
Comments 14 pages, 4 figures
对齐、正交或冲突:何时可以安全地优化思维链?
机构 * Google DeepMind(谷歌DeepMind)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG
AI总结 本文探讨了在训练过程中思维链(CoT)的可监控性受训练影响的问题,提出了一种框架来预测何时以及为何发生冲突,并通过实验验证了正交和冲突奖励项对CoT监控性的影响。
PepThink-R1:基于CoT SFT和强化学习的可解释环状肽优化LLM
机构 * Merck & Co., Inc., Rahway, NJ, USA(默克公司,美国新泽西州拉威) ; UT Southwestern Medical Center, Dallas, TX, USA(得克萨斯大学西南医学中心,美国得克萨斯州达拉斯) ; University of Pittsburgh, Pittsburgh, PA, USA(匹兹堡大学,美国宾夕法尼亚州匹兹堡)
专题命中 其他推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG
AI总结 本文提出PepThink-R1,结合CoT SFT和强化学习,通过显式推理生成可解释的环状肽,提升药理性质表现,优于现有通用LLM和领域模型。
Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025) Workshop: AI for Science (Spotlight)
改变的思维,改变的行为:探测VLA机器人操作中的链式思维漏洞
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG
AI总结 研究探讨VLA模型中链式思维的脆弱性,发现仅篡改推理轨迹中的物体名称即可显著降低任务成功率,而其他篡改方式影响较小,表明动作解码器依赖实体引用完整性而非推理质量。
通过细粒度分组策略优化实现长链式思考压缩
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG
AI总结 本文提出细粒度分组策略优化算法,通过优化分组响应的权重实现高效的链式思考压缩,同时解决GRPO的两个主要问题。
Comments IEEE International Conference on Acoustics, Speech, and Signal Processing (ICASSP), 2026
推理是否能帮助大语言模型捕捉人类标注者的分歧?
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI总结 本文研究了推理方法对大语言模型捕捉人类标注分歧的影响,发现RLVR推理会降低性能,而朴素推理能提升性能,揭示了用推理模型替代人类标注的风险。
Comments EACL 2026 Main
通过稀疏自推测解码加速大规模推理模型推理
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG
AI总结 SparseSpec通过自推测解码框架和稀疏注意力机制,显著提升了大规模推理模型的推理效率和内存利用率。
先思后定(ThiFAN-VQA):一种用于灾后损害评估的两阶段链式思考框架
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG
AI总结 ThiFAN-VQA通过两阶段推理框架提升灾后损害评估的准确性与可解释性。
机构 * King’s College London(伦敦国王学院) ; Spotify UK(Spotify英国分公司) ; University of Oxford(牛津大学) ; Spotify Spain(Spotify西班牙分公司)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG
Comments 9 pages, Accepted to the Mechanistic Interpretability Workshop at NeurIPS 2025
机构 * Meridian Research, Cambridge(梅迪安研究,剑桥)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG
机构 * Meta Superintelligence Labs(Meta超智能实验室) ; Meta FAIR ; Cornell University(康奈尔大学) ; Stony Brook University(石溪大学)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
机构 * PhiLabs ; Quantiphi Inc(Quantiphi公司)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments 7 pages, 3 figures
机构 * Ubiquant
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG
机构 * Department of Computing, The Hong Kong Polytechnic University(计算学系,香港理工大学)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments EMNLP 2025 (Long Paper), camera-ready version
机构 * University of Cambridge(剑桥大学) ; Google DeepMind(谷歌DeepMind) ; Imperial College London(伦敦帝国学院) ; Northeastern University(东北大学) ; University of Oxford(牛津大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG
机构 * Arizona State University(亚利桑那州立大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG
Comments Work in progress
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
机构 * School of Computing and Artificial Intelligence, Southwest Jiaotong University(计算机与人工智能学院,西南交通大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments 13 pages, 5 figures