arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-09 至 2026-03-09 共收录 3 信号源:cs.CL, cs.AI, cs.LG

1. 测试时计算 3 篇

2603.05706 2026-03-09 cs.AI 87%

Reasoning Models Struggle to Control their Chains of Thought

推理模型难以控制其推理链

Chen Yueh-Han, Robert McCarthy, Bruce W. Lee, He He, Ian Kivlichan, Bowen Baker, Micah Carroll, Tomek Korbak

机构 * NYU(纽约大学) MATS(马歇尔应用科学与技术学院) UCL(伦敦大学学院) UPenn(宾夕法尼亚大学) OpenAI

专题命中 测试时计算 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);test-time compute(abstract)

AI总结 研究发现推理模型的CoT可控性低于输出可控性,且受模型规模、训练和问题难度影响,建议未来跟踪CoT可控性以维持监控有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06317 2026-03-09 cs.LG cs.AI 62%

From Entropy to Calibrated Uncertainty: Training Language Models to Reason About Uncertainty

从熵到校准的不确定性:训练语言模型以推理不确定性

Azza Jenane, Nassim Walha, Lukas Kuhn, Florian Buettner

机构 * German Cancer Research Center (DKFZ)(德国癌症研究中心(DKFZ)) German Cancer Consortium (DKTK)(德国癌症联盟(DKTK)) Goethe University Frankfurt, Germany(法兰克福歌德大学)

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出一种三阶段流程,通过训练语言模型以在测试时高效推断校准的不确定性,提升模型在高风险领域的可靠性与泛化能力。

Comments 4 pages, submitted to AISTATS Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.11629 2026-03-09 cs.LG cs.AI 62%

Reasoned Safety Alignment: Ensuring Jailbreak Defense via Answer-Then-Check

理性安全对齐:通过答案后检查确保对抗攻击防御

Chentao Cao, Xiaojun Xu, Bo Han, Hang Li

机构 * TMLR Group, Department of Computer Science, Hong Kong Baptist University(TMLR小组,计算机科学系,香港 Baptist大学)

专题命中 测试时计算 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出答案后检查方法,通过推理增强模型对抗攻击防御能力,实验表明其在安全性和效率上的优势。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏