arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-14 至 2026-04-14 共收录 9 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 9 篇

2509.13356 2026-04-14 cs.CY cs.CL 79%

CogniAlign: Survivability-Grounded Multi-Agent Moral Reasoning for Safe and Transparent AI

CogniAlign:基于生存性的多智能体道德推理以实现安全透明的AI

Hasin Jawad Ali, Ilhamul Azam, Ajwad Abrar, Md. Kamrul Hasan, Hasan Mahmud

机构 * Islamic University of Technology(伊斯兰科技大学)

专题命中 代码与定理证明 :reasoning(title,abstract);分类 cs.CL

AI总结 CogniAlign通过基于自然主义道德现实的多智能体框架,将道德推理 grounded 在生存性上,通过学科专家智能体的结构化辩论实现透明和经验锚定的判断,证明了可审计的AI对齐方法的可行性。

Comments Under Review

Journal ref AI and Ethics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11206 2026-04-14 cs.SE cs.AI 74%

Designing Adaptive Digital Nudging Systems with LLM-Driven Reasoning

基于LLM驱动推理的自适应数字引导系统设计

Tiziano Santilli, Mina Alipour, Mahyar Tourchi Moghaddam

机构 * Syddansk Universitet(南丹麦大学)

专题命中 代码与定理证明 :reasoning(title);分类 cs.AI

AI总结 本文提出一种将行为科学与软件设计结合的自适应数字引导系统架构,通过整合多维用户建模与伦理合规,验证了其在住宅能源可持续性中的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10087 2026-04-14 cs.AI 70%

Ontological Trajectory Forecasting via Finite Semigroup Iteration and Lie Algebra Approximation in Geopolitical Knowledge Graphs

通过有限半群迭代和李代数近似进行本体轨迹预测:在地缘政治知识图谱中的应用

Qihang Wu

机构 * Department of Industrial and Systems Engineering, The Hong Kong Polytechnic University(香港理工大学工业及系统工程学系)

专题命中 代码与定理证明 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI

AI总结 本文提出EL-DRUIN系统,结合形式本体、有限半群代数和李代数近似,预测地缘政治长期关系轨迹,通过半群操作和李代数空间向量嵌入实现可解释的概率预测。

Comments 18 pages. Code and system available at https://github.com/wuqihang-brave/El-druin

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17270 2026-04-14 cs.LG cs.AI cs.CL 67%

Understanding Generalization in Role-Playing Models via Information Theory

通过信息论理解角色扮演模型的泛化能力

Yongqi Li, Hao Lang, Fei Huang, Tieyun Qian, Yongbin Li

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) Tongyi Lab(通义实验室) Zhongguancun Academy(中关村学院)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过信息理论提出R-EMID指标,分析角色扮演模型在分布偏移下的泛化问题,提出协同强化学习框架提升对话生成概率,发现用户偏移对泛化影响最大。

Comments Accepted to ACL 2026 (Findings), camera-ready version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10392 2026-04-14 cs.LG cs.AI cs.LO cs.PL cs.SE 62%

Intent-aligned Formal Specification Synthesis via Traceable Refinement

通过可追溯的细化实现意图对齐的正式规范合成

Zhe Ye, Aidan Z. H. Yang, Huangyuan Su, Zhenyu Liao, Samuel Tenka, Zhizhen Qin, Udaya Ghai, Dawn Song, Soonho Kong

机构 * Amazon Web Services(亚马逊云服务) Harvard University(哈佛大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出VeriSpecGen框架,通过需求级归因和局部修复生成意图对齐的规范,提升规范合成的准确性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11514 2026-04-14 cs.SE cs.CL 57%

DuET: Dual Execution for Test Output Prediction with Generated Code and Pseudocode

DuET:通过生成代码和伪代码的双执行进行测试输出预测

Hojae Han, Jaejin Kim, Seung-won Hwang, Yu Jin Kim, Moontae Lee

机构 * ETRI(韩国电子通信研究院) Seoul National University(首尔大学) SNU-LG AI Research Center(首尔大学-LG人工智能研究中心) LG AI Research(LG人工智能研究院)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

AI总结 本文提出DuET框架,结合生成代码和伪代码执行,通过功能多数投票提升测试输出预测的准确性,实验表明其在LiveCodeBench上达到最优性能,Pass@1提升13.6个百分点。

Comments Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11378 2026-04-14 cs.AI cs.SY eess.SY 57%

From Agent Loops to Structured Graphs:A Scheduler-Theoretic Framework for LLM Agent Execution

从代理循环到结构化图:一个用于LLM代理执行的调度理论框架

Hu Wei

专题命中 代码与定理证明 :planning(abstract);分类 cs.AI

AI总结 本文提出SGH框架,通过将控制流显式化为静态DAG,解决代理循环的隐式依赖、无限恢复循环和调试困难问题,同时分析可控性、表达性和可实现性之间的权衡。

Comments 51 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10989 2026-04-14 cs.AI 57%

MAFIG: Multi-agent Driven Formal Instruction Generation Framework

MAFIG:多智能体驱动的正式指令生成框架

Shixing Zhao, Zheng Si, Pengpeng Ouyang, Zhengqing Hu, Wanqi Zhu, Dong Chen, Yibo Guo, Mingliang Xu

机构 * School of Computer and Artificial Intelligence, Zhengzhou University(郑州大学计算机与人工智能学院) Engineering Research Center of Intelligent Swarm Systems, Ministry of Education(教育部智能集群系统工程研究中心) National Supercomputing Center in Zhengzhou(国家超级计算郑州中心) Henan Research Center for Large Model Technology and New Quality Software Engineering(河南省大模型技术与新质软件工程研究中心)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 本文提出MAFIG框架,通过多智能体生成局部正式指令以应对调度系统紧急情况,采用span-focused loss-driven local distillation机制提升决策效率,实验结果显示在港口、仓储和甲板调度数据集上成功率高且处理速度快。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17330 2026-04-14 cs.SE 50%

Agentic Verification of Software Systems

软件系统的代理验证

Haoxin Tu, Huan Zhao, Yahui Song, Mehtab Zafar, Ruijie Meng, Abhik Roychoudhury

专题命中 代码与定理证明 :reasoning(abstract)

AI总结 本文提出AutoRocq代理,通过与Rocq定理证明器协作实现程序验证,采用迭代优化提升证明质量,实验显示在SV-COMP和Linux内核模块上具有良好的自动验证效果。

Comments Camera-ready version appeared in the Proceedings of the ACM International Conference on the Foundations of Software Engineering (FSE 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏