Reasoning Boosts Opinion Alignment in LLMs
推理提升大语言模型中的观点一致性
专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.LG
AI总结 本研究通过结构化推理提升大语言模型的观点一致性,验证了推理在改善观点建模中的有效性,但指出仍需进一步机制以减少偏见。
Comments Accepted at ICLR 2026
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
推理提升大语言模型中的观点一致性
专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL、cs.LG
AI总结 本研究通过结构化推理提升大语言模型的观点一致性,验证了推理在改善观点建模中的有效性,但指出仍需进一步机制以减少偏见。
Comments Accepted at ICLR 2026
DeReason: 一种考虑难度的课程改进了解耦的SFT-然后-RL训练以促进一般推理
机构 * University of Zurich(苏黎世大学) ; University of Pennsylvania(宾夕法尼亚大学) ; ETH Zurich(苏黎世联邦理工学院) ; HKUST (GZ)(香港科技大学(广州))
专题命中 数学推理 :reasoning(title,abstract);分类 cs.CL
AI总结 DeReason通过基于难度的数据解耦策略,优化SFT与RL的训练分配,提升一般推理能力。
Comments 13 pages, 6 figures
理论物理研究能否从语言代理中受益?
专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 本文探讨了语言代理在理论物理研究中的潜力,指出需专门训练和工具支持,以实现多模态数据处理、物理假设提出和理论验证的AI代理。
Comments 8+2 pages + references
逐步验证数学问题
机构 * Peking University(北京大学)
专题命中 数学推理 :reasoning(abstract);分类 cs.CL、cs.AI
AI总结 ValiMath是一个包含2147个经过人类验证的数学问题的基准测试集,MathQ-Verify是用于验证数学问题正确性的流程,能有效提升数学数据集的质量和准确性。