arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 45051 信号源:cs.CL, cs.AI, cs.LG

1. 代码与定理证明 1129 篇

2405.15880 2024-11-04 cs.PL cs.AI 57%

HYSYNTH: Context-Free LLM Approximation for Guiding Program Synthesis

Shraddha Barke, Emmanuel Anaya Gonzalez, Saketh Ram Kasibatla, Taylor Berg-Kirkpatrick, Nadia Polikarpova

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.23299 2024-11-01 cs.AR cs.AI 57%

FVEval: Understanding Language Model Capabilities in Formal Verification of Digital Hardware

Minwoo Kang, Mingjie Liu, Ghaith Bany Hamad, Syed Suhaib, Haoxing Ren

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21141 2024-10-29 cs.LG stat.ML 57%

LLM-initialized Differentiable Causal Discovery

Shiv Kampani, David Hidary, Constantijn van der Poel, Martin Ganahl, Brenda Miao

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.12300 2024-10-15 cs.AI cs.GT 57%

Autoformalization of Game Descriptions using Large Language Models

Agnieszka Mensfelt, Kostas Stathis, Vince Trencsenyi

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments code: https://github.com/dicelab-rhul/game-formaliser

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.01379 2024-10-14 cs.CL 57%

Verification and Refinement of Natural Language Explanations through LLM-Symbolic Theorem Proving

Xin Quan, Marco Valentino, Louise A. Dennis, André Freitas

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

Comments Camera-ready for EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.04397 2024-10-11 cs.CR cs.AI 57%

Towards Understanding and Enhancing Security of Proof-of-Training for DNN Model Ownership Verification

Yijia Chang, Hanrui Jiang, Chao Lin, Xinyi Huang, Jian Weng

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments Accepted by USENIX Security 2025 (Major Revision -> Accept)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03203 2024-10-07 cs.FL cs.AI 57%

TheoremLlama: Transforming General-Purpose LLMs into Lean4 Experts

Ruida Wang, Jipeng Zhang, Yizhen Jia, Rui Pan, Shizhe Diao, Renjie Pi, Tong Zhang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07453 2024-09-12 cs.AI cs.HC 57%

"My Grade is Wrong!": A Contestable AI Framework for Interactive Feedback in Evaluating Student Essays

Shengxin Hong, Chang Cai, Sixuan Du, Haiyue Feng, Siyuan Liu, Xiuyi Fan

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19238 2024-08-23 cs.AI 57%

Human-Aware Belief Revision: A Cognitively Inspired Framework for Explanation-Guided Revision of Human Models

Stylianos Loukas Vasileiou, William Yeoh

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09939 2024-08-23 cs.AI 57%

A Survey on Deep Learning for Theorem Proving

Zhaoyu Li, Jialiang Sun, Logan Murphy, Qidong Su, Zenan Li, Xian Zhang, Kaiyu Yang, Xujie Si

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00147 2024-08-02 cs.AI cs.LO 57%

Formal Ethical Obligations in Reinforcement Learning Agents: Verification and Policy Updates

Colin Shea-Blymyer, Houssam Abbas

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.12188 2024-07-23 cs.AI stat.AP 57%

ChatGPT and post-test probability

Samuel J. Weisenthal

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments 138 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.07408 2024-06-06 cs.CR cs.AI 57%

Large Language Models are Few-shot Generators: Proposing Hybrid Prompt Algorithm To Generate Webshell Escape Samples

Mingrui Ma, Lansheng Han, Chunjie Zhou

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments 21 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.14333 2024-05-24 cs.AI 57%

DeepSeek-Prover: Advancing Theorem Proving in LLMs through Large-Scale Synthetic Data

Huajian Xin, Daya Guo, Zhihong Shao, Zhizhou Ren, Qihao Zhu, Bo Liu, Chong Ruan, Wenda Li, Xiaodan Liang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.08848 2024-05-16 cs.SE cs.AI 57%

Automated Repair of AI Code with Large Language Models and Formal Verification

Yiannis Charalambous, Edoardo Manino, Lucas C. Cordeiro

专题命中 代码与定理证明 :verifier(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00011 2024-04-02 cs.HC cs.CL 57%

A novel interface for adversarial trivia question-writing

Jason Liu

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

Comments 17 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16719 2024-03-26 cs.MA cs.AI 57%

Towards a Formalisation of Value-based Actions and Consequentialist Ethics

Adam Wyner, Tomasz Zurek, DOrota Stachura-Zurek

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09444 2024-01-19 cs.AI 57%

Online Handbook of Argumentation for AI: Volume 4

Lars Bengel, Lydia Blümel, Elfia Bezou-Vrakatseli, Federico Castagna, Giulia D'Agostino, Isabelle Kuhlmann, Jack Mumford, Daphne Odekerken, Fabrizio Russo, Stefan Sarkadi, Madeleine Waller, Andreas Xydis

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00812 2024-01-09 cs.CL 57%

If LLM Is the Wizard, Then Code Is the Wand: A Survey on How Code Empowers Large Language Models to Serve as Intelligent Agents

Ke Yang, Jiateng Liu, John Wu, Chaoqi Yang, Yi R. Fung, Sha Li, Zixuan Huang, Xu Cao, Xingyao Wang, Yiquan Wang, Heng Ji, Chengxiang Zhai

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.02675 2024-01-08 cs.NI cs.GT cs.LG 57%

LMaaS: Exploring Pricing Strategy of Large Model as a Service for Communication

Panlong Wu, Qi Liu, Yanjie Dong, Fangxin Wang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07948 2023-11-15 cs.PL cs.LG 57%

Finding Inductive Loop Invariants using Large Language Models

Adharsh Kamath, Aditya Senthilnathan, Saikat Chakraborty, Pantazis Deligiannis, Shuvendu K. Lahiri, Akash Lal, Aseem Rastogi, Subhajit Roy, Rahul Sharma

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.00656 2023-10-30 cs.AI 57%

LEGO-Prover: Neural Theorem Proving with Growing Libraries

Haiming Wang, Huajian Xin, Chuanyang Zheng, Lin Li, Zhengying Liu, Qingxing Cao, Yinya Huang, Jing Xiong, Han Shi, Enze Xie, Jian Yin, Zhenguo Li, Heng Liao, Xiaodan Liang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10180 2023-10-25 cs.CL 57%

TRIGO: Benchmarking Formal Mathematical Proof Reduction for Generative Language Models

Jing Xiong, Jianhao Shen, Ye Yuan, Haiming Wang, Yichun Yin, Zhengying Liu, Lin Li, Zhijiang Guo, Qingxing Cao, Yinya Huang, Chuanyang Zheng, Xiaodan Liang, Ming Zhang, Qun Liu

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

Comments Accepted by EMNLP 2023. Code is available at https://github.com/menik1126/TRIGO

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.02829 2023-08-08 cs.LO cs.AI 57%

Multi-Agent Verification and Control with Probabilistic Model Checking

David Parker

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2105.14452 2023-07-11 cs.LO cs.AI math.LO 57%

A unified logical framework for explanations in classifier systems

Xinghan Liu, Emiliano Lorini

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments 36 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.06970 2023-07-10 cs.AI cs.MA 57%

Signifiers as a First-class Abstraction in Hypermedia Multi-Agent Systems

Danai Vachtsevanou, Andrei Ciortea, Simon Mayer, Jérémy Lemée

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Journal ref Proceedings of the 2023 International Conference on Autonomous Agents and Multiagent Systems (2023) p. 1200-1208

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.13298 2023-06-26 cs.SE cs.AI 57%

Exploring Qualitative Research Using LLMs

Muneera Bano, Didar Zowghi, Jon Whittle

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.01417 2023-06-05 cs.CY cs.LG 57%

The Flawed Foundations of Fair Machine Learning

Robert Lee Poe, Soumia Zohra El Mestari

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.LG

Comments This article is a preprint submitted to the Minds and Machines Special Issue on the (Un)fairness of AI on May 31st, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2106.07824 2023-05-23 cs.AI 57%

Communicating Natural Programs to Humans and Machines

Samuel Acquaviva, Yewen Pu, Marta Kryven, Theodoros Sechopoulos, Catherine Wong, Gabrielle E Ecanow, Maxwell Nye, Michael Henry Tessler, Joshua B. Tenenbaum

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.AI

Comments equal contributions: (author 1,2) and (author 3,4,5). 36th Conference on Neural Information Processing Systems (NeurIPS 2022) Track on Datasets and Benchmarks

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.04557 2023-05-09 cs.CL 57%

Toward Adversarial Training on Contextualized Language Representation

Hongqiu Wu, Yongxiang Liu, Hanwen Shi, Hai Zhao, Min Zhang

专题命中 代码与定理证明 :reasoning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏