arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 1117 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 1117 篇

2411.07107 2025-04-15 cs.CL cs.LG 62%

Training Neural Networks as Recognizers of Formal Languages

Alexandra Butoi, Ghazal Khalighinejad, Anej Svete, Josef Valvoda, Ryan Cotterell, Brian DuSell

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 44 pages, 3 figures. ICLR 2025. Official camera-ready version; applies minor corrections to previous version

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16533 2025-03-24 cs.CL cs.AI 62%

From Patient Consultations to Graphs: Leveraging LLMs for Patient Journey Knowledge Graph Construction

Hassan S. Al Khatib, Sudip Mittal, Shahram Rahimi, Nina Marhamati, Sean Bozorgzad

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.13508 2025-03-19 cs.CL cs.AI cs.CY 62%

It is Too Many Options: Pitfalls of Multiple-Choice Questions in Generative AI and Medical Education

Shrutika Singh, Anton Alyakin, Daniel Alexander Alber, Jaden Stryker, Ai Phuong S Tong, Karl Sangwon, Nicolas Goff, Mathew de la Paz, Miguel Hernandez-Rovira, Ki Yun Park, Eric Claude Leuthardt, Eric Karl Oermann

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06366 2025-03-11 cs.LG cs.AI math.CO math.RT 62%

Machine Learning meets Algebraic Combinatorics: A Suite of Datasets Capturing Research-level Conjecturing Ability in Pure Mathematics

Herman Chau, Helen Jenne, Davis Brown, Jesse He, Mark Raugas, Sara Billey, Henry Kvinge

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 26 pages, comments welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05346 2025-03-10 cs.CL cs.AI cs.SE 62%

AutoIOT: LLM-Driven Automated Natural Language Programming for AIoT Applications

Leming Shen, Qiang Yang, Yuanqing Zheng, Mo Li

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.06209 2025-03-07 cs.LG cs.AI cs.LO 62%

LeanAgent: Lifelong Learning for Formal Theorem Proving

Adarsh Kumarappan, Mo Tiwari, Peiyang Song, Robert Joseph George, Chaowei Xiao, Anima Anandkumar

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00093 2025-03-04 cs.CY cs.AI cs.CL 62%

Rethinking LLM Bias Probing Using Lessons from the Social Sciences

Kirsten N. Morehouse, Siddharth Swaroop, Weiwei Pan

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.21290 2025-03-03 cs.AI cs.LG q-bio.QM 62%

Contextualizing biological perturbation experiments through language

Menghua Wu, Russell Littman, Jacob Levine, Lin Qiu, Tommaso Biancalani, David Richmond, Jan-Christian Huetter

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments The Thirteenth International Conference on Learning Representations (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18532 2025-02-27 cs.AI cs.LG 62%

CuDIP: Enhancing Theorem Proving in LLMs via Curriculum Learning-based Direct Preference Optimization

Shuming Shi, Ruobing Zuo, Gaolei He, Jianlin Wang, Chenyang Xu, Zhengfeng Yang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.15797 2025-02-11 cs.LG cs.CL cs.IR 62%

LemmaHead: RAG Assisted Proof Generation Using Large Language Models

Tianbo Yang, Mingqi Yan, Hongyi Zhao, Tianshuo Yang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09005 2025-01-09 cs.CR cs.AI cs.ET cs.GT cs.LG 62%

Proof-of-Learning with Incentive Security

Zishuo Zhao, Zhixuan Fang, Xuechao Wang, Xi Chen, Hongxu Su, Haibo Xiao, Yuan Zhou

专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01827 2025-01-06 cs.CL cs.AI 62%

The Proof is in the Almond Cookies

Remi van Trijp, Katrien Beuls, Paul Van Eecke

专题命中 代码与定理证明 :planning(abstract);分类 cs.CL、cs.AI

Journal ref In Steels, L. & Porzel, R. (eds). 2024. Narrative-based Understanding of Everyday Activities: A Cookbook. Venice: Venice International University. Pages 59-77

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11427 2024-12-24 cs.LG cs.AI 62%

Towards Scientific Discovery with Generative AI: Progress, Opportunities, and Challenges

Chandan K Reddy, Parshin Shojaee

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments AAAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10942 2024-12-17 cs.AI cs.LG 62%

Effective Generative AI: The Human-Algorithm Centaur

Soroush Saghafian, Lihi Idan

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments To Appear in SI: Future Shock, Harvard Data Science Review (https://hdsr.mitpress.mit.edu/specialissue5)

Journal ref Harvard Data Science Review (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06512 2024-12-10 cs.AI cs.CL cs.SE 62%

The Fusion of Large Language Models and Formal Methods for Trustworthy AI Agents: A Roadmap

Yedi Zhang, Yufan Cai, Xinyue Zuo, Xiaokun Luan, Kailong Wang, Zhe Hou, Yifan Zhang, Zhiyuan Wei, Meng Sun, Jun Sun, Jing Sun, Jin Song Dong

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 24 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.02975 2024-12-05 cs.LG cs.AI cs.CC cs.DS 62%

Theoretical limitations of multi-layer Transformer

Lijie Chen, Binghui Peng, Hongxun Wu

专题命中 代码与定理证明 :chain-of-thought(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03736 2024-11-26 cs.HC cs.AI cs.LG 62%

CliMB: An AI-enabled Partner for Clinical Predictive Modeling

Evgeny Saveliev, Tim Schubert, Thomas Pouplin, Vasilis Kosmoliaptsis, Mihaela van der Schaar

专题命中 代码与定理证明 :planning(abstract);分类 cs.AI、cs.LG

Comments * Evgeny Saveliev and Tim Schubert contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12671 2024-11-20 cs.AI cs.CL cs.ET 62%

Neurosymbolic Graph Enrichment for Grounded World Models

Stefano De Giorgis, Aldo Gangemi, Alessandro Russo

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12074 2024-11-20 cs.CL cs.LG 62%

Mitigating Gender Bias in Contextual Word Embeddings

Navya Yarrabelly, Vinay Damodaran, Feng-Guang Su

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11595 2024-11-15 cs.CL cs.AI 62%

Examining Inter-Consistency of Large Language Models Collaboration: An In-depth Analysis via Debate

Kai Xiong, Xiao Ding, Yixin Cao, Ting Liu, Bing Qin

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2023 Findings Camera Ready Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07428 2024-11-06 cs.GT cs.AI cs.LG 62%

GemNet: Menu-Based, Strategy-Proof Multi-Bidder Auctions Through Deep Learning

Tonghan Wang, Yanchen Jiang, David C. Parkes

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments This paper received the Exemplary Paper Award for the AI track at the Twenty-Fifth ACM Conference on Economics and Computation (ACM EC '24), where it appeared as an extended abstract; The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.22642 2024-10-31 cs.CL cs.AI 62%

Prove Your Point!: Bringing Proof-Enhancement Principles to Argumentative Essay Generation

Ruiyu Xiao, Lei Wu, Yuhang Gou, Weinan Zhang, Ting Liu

专题命中 代码与定理证明 :planning(abstract);分类 cs.CL、cs.AI

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17503 2024-10-31 cs.SE cs.AI cs.CL cs.PL 62%

Code Repair with LLMs gives an Exploration-Exploitation Tradeoff

Hao Tang, Keya Hu, Jin Peng Zhou, Sicheng Zhong, Wei-Long Zheng, Xujie Si, Kevin Ellis

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14219 2024-10-21 cs.AI cs.LG cs.LO 62%

Formal Explanations for Neuro-Symbolic AI

Sushmita Paul, Jinqiang Yu, Jip J. Dekker, Alexey Ignatiev, Peter J. Stuckey

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01940 2024-10-15 cs.CL cs.LG cs.LO 62%

Process-Driven Autoformalization in Lean 4

Jianqiao Lu, Yingjia Wan, Zhengying Liu, Yinya Huang, Jing Xiong, Chengwu Liu, Jianhao Shen, Hui Jin, Jipeng Zhang, Haiming Wang, Zhicheng Yang, Jing Tang, Zhijiang Guo

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.LG

Comments 32 pages, 1 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00830 2024-09-04 cs.AI cs.CL cs.IR 62%

Building FKG.in: a Knowledge Graph for Indian Food

Saransh Kumar Gupta, Lipika Dey, Partha Pratim Das, Ramesh Jain

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 14 pages, 3 figures, 25 references, Formal Ontology in Information Systems Conference 2024 - Integrated Food Ontology Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.17227 2024-07-25 cs.AI cs.CL 62%

LEAN-GitHub: Compiling GitHub LEAN repositories for a versatile LEAN prover

Zijian Wu, Jiayu Wang, Dahua Lin, Kai Chen

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00744 2024-07-02 cs.AI cs.LG q-bio.NC 62%

Disentangled Representations for Causal Cognition

Filippo Torresan, Manuel Baltieri

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI、cs.LG

Comments 49 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.12147 2024-06-12 cs.AI cs.CL 62%

Eliciting Problem Specifications via Large Language Models

Robert E. Wray, James R. Kirk, John E. Laird

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments 18 pages, Appendix. Revised in response to reviewer feedback. Accepted for Advances in Cognitive Systems (Jun 2024, Palermo)

详情

展开后加载摘要…

URL PDF HTML 收藏
2204.09140 2024-06-03 cs.CL cs.AI cs.IR 62%

Multi-hop Question Answering

Vaibhav Mavi, Anubhav Jangra, Adam Jatowt

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL、cs.AI

Comments Published at Foundations and Trends in Information Retrieval

详情

展开后加载摘要…

URL PDF HTML 收藏