A closed-loop AI framework for hypothesis-driven and interpretable materials design
专题命中 代码与定理证明 :reasoning(abstract);chain-of-thought(abstract)
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 代码与定理证明 :reasoning(abstract);chain-of-thought(abstract)
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
机构 * Department of Applied Mathematics and Theoretical Physics(应用数学与理论物理系) ; University of Cambridge(剑桥大学)
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);chain-of-thought(abstract)
Comments 45 pages, 23 figures
机构 * Sebastian Dumbrava(独立研究者)
专题命中 代码与定理证明 :planning(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 56 pages, 12 figures
机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) ; Shanghai Qi Zhi Institute(上海启智研究院) ; IIIS, Tsinghua University(清华大学智能技术学院长)
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 15 pages with 3 figures
机构 * Siebel School of Computing and Data Science University of Illinois, Urbana-Champaign(计算机与数据科学学院 伊利诺伊大学厄巴纳-香槟分校)
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :chain-of-thought(abstract);分类 cs.CL、cs.AI、cs.LG
Comments NAACL 2025. Code and data are available at https://github.com/princeton-nlp/ELIZA-Transformer
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);logical reasoning(abstract)
Comments 12 pages, 10 figures, 6 tables
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);planning(abstract)
Comments version 1.0
专题命中 代码与定理证明 :planning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ICLR 2024 camera-ready
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Project webpage: https://agent-force.github.io/unified-alignment-for-agents.html
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 代码与定理证明 :reasoning(abstract);planning(abstract)
专题命中 代码与定理证明 :reasoning(abstract,comments);分类 cs.AI、cs.LG
Comments Accepted to the Proceedings of the 19th Conference on Neurosymbolic Learning and Reasoning (NeSy 2025)
专题命中 代码与定理证明 :reasoning(abstract,journal_ref);分类 cs.AI、cs.LG
Journal ref In Thomas Eiter and David Sands, editors, 21st International Conference on Logic for Programming, Artificial Intelligence and Reasoning (LPAR-21). EPiC Series in Computing, vol. 46, pages 85-105, EasyChair, 2017. ISSN 2398-7340
TCS-BENCH:评估最先进生成式AI理论计算机科学研究能力的基准
专题命中 代码与定理证明 :verifier(abstract);分类 cs.CL、cs.AI
AI总结 研究人员推出TCS-Bench基准,基于STOC、FOCS、SODA论文的定理证明任务评估LLMs,结合验证智能体,参考验证器在专家标注集准确率超90%,为评估生成式AI的TCS研究能力提供工具
基于LLM符号化结构化过程的可解释无监督社区检测
机构 * Shanghai Jiao Tong University(上海交通大学) ; University of New South Wales(新南威尔士大学)
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 本研究提出LLM引导的无监督社区检测方法LUCID,通过四阶段流程结合LLM生成规则实现可解释性,在真实数据集上性能优于主流无监督与半监督基线。
网络系统的不变量发现
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 研究网络系统不变量发现问题,核心方法是将其分为人工智能驱动的语法“发现”与统计驱动的“搜索”问题,设计实现Autogram系统,贡献是能在多种数据上高覆盖率、低误报地恢复专家不变量并讨论开放问题。
Comments 8 pages, 4 figures, 1 table
OS-Sentinel: 通过现实工作流中的混合验证实现安全增强的移动GUI代理
机构 * The University of Hong Kong(香港大学) ; Fudan University(复旦大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Nanyang Technological University(南洋理工大学) ; Nanjing University(南京大学) ; Shanghai Jiao Tong University(上海交通大学)
专题命中 代码与定理证明 :verifier(abstract);分类 cs.CL、cs.AI
AI总结 OS-Sentinel通过结合形式验证器和VLM上下文判断者,提升移动GUI代理的安全性,实验显示在多个指标上优于现有方法。
Comments ACL 2026 (Oral) & Best Paper at AIWILD @ ICLR 2026
LeanFlow:工作流驱动的精益自动形式化案例研究
机构 * Moonshot AI(月球计划人工智能公司) ; epfl-lara(洛桑联邦理工学院拉腊实验室)
专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI、cs.LG
AI总结 研究通过对两篇数学论文案例研究,探讨文档到项目形式化中运行时机制对相关指标的影响,使用Kimi2.6和GPT5.5进行消融实验,报告多项数据,展示LeanFlow在特定任务上的表现及校准成果。
Comments 14 pages, 3 figures, ICML 2026: AI for Math Workshop
ETAS:一种用于智能体系统的效果类型化语言
机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)
专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG
AI总结 研究针对智能体系统设计ETAS语言,核心方法是通过规范一致性分配类型并用行为索引跟踪计算,主要贡献是为智能体执行相关推理提供编程语言基础,涵盖授权、非确定性等方面,还实现了该语言并形式化相关性质。
迈向可靠的人工智能辅助模拟设计:用于逐次逼近寄存器型模数转换器生成的模板约束大语言模型智能体
机构 * Massachusetts Institute of Technology(麻省理工学院)
专题命中 代码与定理证明 :planning(abstract);分类 cs.AI、cs.LG
AI总结 研究针对大语言模型在模拟电子设计自动化应用的瓶颈,提出端到端多步骤的ATLAS框架,利用专家知识结合模板约束生成,能生成成功通过仿真验证的SAR ADC,为集成LLMs到可靠模拟设计方法奠定基础。