arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 1124 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 1124 篇

2506.21329 2025-12-16 cs.AI physics.soc-ph 57%

Active Inference AI Systems for Scientific Discovery

主动推断AI系统用于科学发现

Karthik Duraisamy

机构 * Michigan Institute for Computational Discovery & Engineering(密歇根计算发现与工程研究所) University of Michigan(密歇根大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 本文提出主动推断AI系统,通过结合缓慢假设生成与快速验证推理,利用因果和多模态模型促进科学发现,强调人类判断在处理不确定性中的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09443 2025-12-12 cs.HC cs.AI math.OC 57%

Advancing Mathematical Research via Human-AI Interactive Theorem Proving

通过人机交互定理证明推进数学研究

Chenyi Li, Zhijian Lai, Dong An, Jiang Hu, Zaiwen Wen

机构 * Beijing International Center for Mathematical Research, Peking University(北京大学北京国际数学研究中心) Yau Mathematical Sciences Center, Tsinghua University(清华大学尤伊数学科学中心)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 本文提出了一种人机交互的定理证明流程,利用大语言模型辅助数学研究,通过案例研究展示其在流形优化与Grover算法间连接的探索能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11180 2025-12-10 cs.SE cs.AI cs.ET cs.SY eess.SY 57%

Beyond Formal Semantics for Capabilities and Skills: Model Context Protocol in Manufacturing

超越能力与技能的形式语义:制造业中的模型上下文协议

Luis Miguel Vieira da Silva, Aljosha Köcher, Felix Gehlhoff

专题命中 代码与定理证明 :planning(abstract);分类 cs.AI

AI总结 本文提出基于模型上下文协议(MCP)的制造业能力与技能建模方法,通过标准化接口实现与LLM的高效交互,提升工业自动化灵活性。

Comments \c{opyright} 2025 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07038 2025-12-09 cs.CR cs.LG stat.ML 57%

Ideal Attribution and Faithful Watermarks for Language Models

语言模型中的理想归因与忠实水印

Min Jae Song, Kameron Shahabi

机构 * Data Science Institute, University of Chicago(芝加哥大学数据科学研究院) Paul G. Allen School of Computer Science & Engineering, University of Washington(华盛顿大学保罗·G·阿伦计算机科学与工程学院)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.LG

AI总结 本文提出了一种理想归因机制和水印方案框架,通过统一的语言和明确的保证,提升水印方案的理论基础和实际应用价值。

Comments 30 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05836 2025-12-08 cs.AI 57%

Using Large Language Models to Create Personalized Networks From Therapy Sessions

利用大语言模型从治疗会谈中创建个性化网络

Clarissa W. Ong, Hiba Arnaout, Kate Sheehan, Estella Fox, Eugen Owtscharow, Iryna Gurevych

机构 * Department of Psychological and Brain Sciences, University of Louisville, U.S.A(心理与脑科学系,路易斯维尔大学,美国) Department of Computer Science, TU Darmstadt, Germany(计算机科学系,图恩-达姆斯塔特大学,德国) Department of Psychology, University of Toledo, U.S.A(心理学系,托莱多大学,美国)

专题命中 代码与定理证明 :planning(abstract);分类 cs.AI

AI总结 本研究利用大语言模型从治疗记录中自动生成个性化网络,通过上下文学习和聚类方法提升临床效用和可解释性,为治疗个性化提供新方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04374 2025-12-05 cs.CL cs.FL 57%

LangSAT: A Novel Framework Combining NLP and Reinforcement Learning for SAT Solving

LangSAT:一种结合自然语言处理和强化学习的SAT求解新框架

Muyu Pan, Matthew Walter, Dheeraj Kodakandla, Mahfuza Farooque

机构 * Pennsylvania State University(宾夕法尼亚州立大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

AI总结 LangSAT结合自然语言处理和强化学习,通过将英语描述转换为CNF并优化求解过程,提升SAT求解的效率和普及性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00214 2025-12-02 cs.CL 57%

Towards Corpus-Grounded Agentic LLMs for Multilingual Grammatical Analysis

迈向基于语料库的代理LLM用于多语言语法分析

Matej Klemen, Tjaša Arčon, Luka Terčon, Marko Robnik-Šikonja, Kaja Dobrovoljc

机构 * University of Ljubljana, Faculty of Computer and Information Science(卢布尔雅那大学计算机与信息科学学院) University of Ljubljana, Faculty of Arts(卢布尔雅那大学艺术学院) Jožef Stefan Institute(乔塞夫·斯塔芬研究所)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

AI总结 本文提出基于语料库的代理LLM框架,用于多语言语法分析,通过数据驱动推理提升语法探究的可解释性和扩展性。

Comments Pre-print, submission under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21638 2025-11-27 cs.LG 57%

Aligning LLMs Toward Multi-Turn Conversational Outcomes Using Iterative PPO

通过迭代PPO对齐大语言模型以实现多轮对话结果

Daniel R. Jiang, Jalaj Bhandari, Yukai Yang, Rémi Munos, Tyler Lu

机构 * Meta FAIR at Meta(Meta的FAIR)

专题命中 代码与定理证明 :planning(abstract);分类 cs.LG

AI总结 本文提出Iterative PPO方法,通过迭代优化多轮对话中的Q函数和策略,实现更稳定的对话生成。

Comments 12 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19423 2025-11-25 q-bio.QM cs.AI 57%

Beyond Protein Language Models: An Agentic LLM Framework for Mechanistic Enzyme Design

超越蛋白质语言模型:一种用于机制酶设计的代理LLM框架

Bruno Jacob, Khushbu Agarwal, Marcel Baer, Peter Rice, Simone Raugei

机构 * Pacific Northwest National Laboratory(太平洋西北国家实验室)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 Genie-CAT通过整合文献推理、结构解析、静电势计算和机器学习预测,实现蛋白质设计中可解释的科学假设生成,提升计算发现效率。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13290 2025-11-24 cs.PL cs.AI 57%

Towards Formal Verification of LLM-Generated Code from Natural Language Prompts

向自然语言提示生成的LLM代码形式验证

Aaron Councilman, David Jiahao Fu, Aryan Gupta, Chengxiao Wang, David Grove, Yu-Xiong Wang, Vikram Adve

机构 * University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) IBM Research(IBM研究院)

专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI

AI总结 Astrogator通过形式查询语言和知识库实现对LLM生成代码的正确性验证,验证准确率达83%。

Comments 28 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16588 2025-11-21 cs.AI cs.LO 57%

Formal Abductive Latent Explanations for Prototype-Based Networks

基于原型网络的正式归纳性隐式解释

Jules Soria, Zakaria Chihani, Julien Girard-Satabin, Alban Grastien, Romain Xu-Darme, Daniela Cancila

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于原型网络的正式归纳性隐式解释方法,通过形式化方法提升模型可解释性,适用于图像分类任务。

Comments Accepted at AAAI-26

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14435 2025-11-19 cs.SE cs.AI cs.LO 57%

Watchdogs and Oracles: Runtime Verification Meets Large Language Models for Autonomous Systems

Angelo Ferrando

机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments In Proceedings FMAS 2025, arXiv:2511.13245

Journal ref EPTCS 436, 2025, pp. 80-87

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13293 2025-11-18 cs.AI 57%

Grounded by Experience: Generative Healthcare Prediction Augmented with Hierarchical Agentic Retrieval

Chuang Zhao, Hui Tang, Hongke Zhao, Xiaofang Zhou, Xiaomeng Li

机构 * Department of Electronic and Computer Engineering, The Hong Kong University of Science and Technology(电子与计算机工程系,香港科技大学) College of Management and Economics, Laboratory of Computation and Analytics of Complex Management Systems (CACMS), Tianjin University(管理学院与经济学学院,复杂管理系统的计算与分析实验室,天津大学) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(计算机科学与工程系,香港科技大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10356 2025-11-14 cs.AI 57%

SITA: A Framework for Structure-to-Instance Theorem Autoformalization

Chenyi Li, Wanli Ma, Zichen Wang, Zaiwen Wen

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16725 2025-11-14 cs.AI 57%

Enhancing Conflict Resolution in Language Models via Abstract Argumentation

Zhaoqun Li, Xiaotong Fang, Chen Chen, Mengze Li, Beishui Liao

机构 * School of Philosophy, Zhejiang University(浙江大学哲学系) College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) The State Key Lab of Brain-Machine Intelligence(脑机智能国家重点实验室)

专题命中 代码与定理证明 :chain-of-thought(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09092 2025-11-13 cs.AI math.OC 57%

OR-R1: Automating Modeling and Solving of Operations Research Optimization Problem via Test-Time Reinforcement Learning

Zezhen Ding, Zhen Tan, Jiheng Zhang, Tianlong Chen

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments 9 pages, 5 figures, AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07690 2025-11-12 cs.AI 57%

Towards AI-Assisted Generation of Military Training Scenarios

Soham Hans, Volkan Ustun, Benjamin Nye, James Sterrett, Matthew Green

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07083 2025-11-11 cs.AI 57%

Increasing AI Explainability by LLM Driven Standard Processes

Marc Jansen, Marcel Pehlke

机构 * Computer Science Institute University of Applied Sciences Ruhr West Bottrop(应用科学鲁尔西贝特大学计算机科学研究所)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04706 2025-11-10 cs.CY cs.AI cs.HC 57%

Prioritize Economy or Climate Action? Investigating ChatGPT Response Differences Based on Inferred Political Orientation

Pelin Karadal, Dilara Kekulluoglu

机构 * Sabanci University(萨班奇大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03108 2025-11-06 cs.AI 57%

miniF2F-Lean Revisited: Reviewing Limitations and Charting a Path Forward

Azim Ospanov, Farzan Farnia, Roozbeh Yousefzadeh

机构 * Huawei Hong Kong Research Center(华为香港研究中心) Department of Computer Science & Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23081 2025-11-05 cs.CL 57%

A Survey on LLM Mid-Training

Chengying Tu, Xuemiao Zhang, Rongxiang Weng, Rumei Li, Chen Zhang, Yang Bai, Hongfei Yan, Jingang Wang, Xunliang Cai

机构 * Peking University(北京大学) Meituan(美团)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00125 2025-11-04 cs.SE cs.AI cs.LO cs.PL 57%

Inferring multiple helper Dafny assertions with LLMs

Álvaro Silva, Alexandra Mendes, Ruben Martins

机构 * INESC TEC, Faculty of Engineering, University of Porto(葡萄牙波尔图大学工程学院INESC TEC) Computer Science Department of Carnegie Mellon University(卡内基梅隆大学计算机科学系)

专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20621 2025-11-03 cs.AI 57%

Towards the Formalization of a Trustworthy AI for Mining Interpretable Models explOiting Sophisticated Algorithms

Riccardo Guidotti, Martina Cinquini, Marta Marchiori Manerba, Mattia Setzu, Francesco Spinnato

机构 * University of Pisa(比萨大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.21717 2025-10-28 cs.HC cs.AI cs.SE 57%

AI-Enhanced Operator Assistance for UNICOS Applications

Bernard Tam, Jean-Charles Tournier, Fernando Varela Rodriguez

机构 * The University of Sydney(悉尼大学)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments Prepared as part of the CERN openlab programme 2025. Also available on Zenodo, a repository operated by CERN and co-funded by the European Union

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06239 2025-10-22 cs.AI 57%

Proof2Silicon: Prompt Repair for Verified Code and Hardware Generation via Reinforcement Learning

Manvi Jha, Jiaxin Wan, Deming Chen

机构 * Electrical and Computer Engineering(电气与计算机工程系) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17919 2025-10-22 cs.CR cs.AI 57%

ParaVul: A Parallel Large Language Model and Retrieval-Augmented Framework for Smart Contract Vulnerability Detection

Tenghui Huang, Jinbo Wen, Jiawen Kang, Siyong Chen, Zhengtao Li, Tao Zhang, Dongning Liu, Jiacheng Wang, Chengjun Cai, Yinqiu Liu, Dusit Niyato

机构 * School of Automation, Guangdong University of Technology(广东科技大學自動化學院) College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(南京航空航天大學計算機科學與技術學院) School of Cyberspace Science and Technology, Beijing Jiaotong University(北京交通大學網絡空間科學與技術學院) School of Computer Science and Technology, Guangdong University of Technology(廣東科技大學計算機科學與技術學院) College of Computing and Data Science, Nanyang Technological University(南洋理工大學計算與數據科學學院)

专题命中 代码与定理证明 :chain-of-thought(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14252 2025-10-17 cs.CL 57%

MoM: Mixtures of Scenario-Aware Document Memories for Retrieval-Augmented Generation Systems

Jihao Zhao, Zhiyuan Ji, Simin Niu, Hanyu Wang, Feiyu Xiong, Zhiyu Li

机构 * School of Information, Renmin University of China, Beijing, China(中国人民大学信息学院) MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)技术有限公司) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03178 2025-10-06 cs.SE cs.CL 57%

When Names Disappear: Revealing What LLMs Actually Understand About Code

Cuong Chi Le, Minh V. T. Pham, Cuong Duc Van, Hoang N. Phan, Huy N. Phan, Tien N. Nguyen

机构 * FPT Software AI Center(FPT软件AI中心) Nanyang Technological University(南洋理工大学) University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.00732 2025-10-02 cs.AI 57%

EvolProver: Advancing Automated Theorem Proving by Evolving Formalized Problems via Symmetry and Difficulty

Yuchen Tian, Ruiyuan Huang, Xuanwu Wang, Jing Ma, Zengfeng Huang, Ziyang Luo, Hongzhan Lin, Da Zheng, Lun Du

机构 * Hong Kong Baptist University(香港 Baptist 大学) Ant Group(蚂蚁集团) School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24127 2025-09-30 cs.AI cs.DB 57%

Transparent, Evaluable, and Accessible Data Agents: A Proof-of-Concept Framework

Nooshin Bahador

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏