arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18788 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18788 篇

2602.07830 2026-05-08 cs.AI 90%

Time Series Reasoning via Process-Verifiable Thinking Data Synthesis and Scheduling for Tailored LLM Reasoning

通过过程可验证的思维数据合成与调度实现时间序列推理

Jiahui Zhou, Dan Li, Boxin Li, Xiao Zhang, Erli Meng, Lin Li, Zhuomin Chen, Jian Lou, See-Kiong Ng

机构 * Sun Yat-sen University(中山大学) Xiaomi Corporation(小米公司) National University of Singapore(新加坡国立大学)

专题命中 推理与问题求解 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出VeriTime框架,通过数据合成、调度和强化学习训练,提升LLM在时间序列推理任务中的性能,使小模型达到或超越大模型效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05410 2026-05-08 cs.AI cs.HC physics.ed-ph 90%

LaTA: A Drop-in, FERPA-Compliant Local-LLM Autograder for Upper-Division STEM Coursework

LaTA:一个符合FERPA规定的本地LLM自动评分器,用于大二STEM课程作业

Jesse A. Rodríguez

机构 * School of Mechanical, Industrial, and Manufacturing Engineering(机械、工业与制造工程学院)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.AI

AI总结 LaTA是一种本地LLM自动评分器,可有效减轻大二STEM课程的评分负担,通过本地运行和LaTeX流程,实现零成本评分,提升学生自信心并提高考试成绩。

Comments Submitted to Computers & Education

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.00136 2026-05-04 cs.AI 90%

Are Tools All We Need? Unveiling the Tool-Use Tax in LLM Agents

工具是否足够?揭示LLM代理中的工具使用税

Kaituo Zhang, Zhen Xiong, Mingyu Zhong, Zhimeng Jiang, Zhouyuan Yuan, Zhecheng Li, Ying Lin

机构 * University of Houston(休斯顿大学) University of Southern California(南加州大学) New York University(纽约大学) Texas A&M University(德克萨斯农工大学) University of California, San Diego(加州大学圣地亚哥分校)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.AI

AI总结 本文研究了工具增强推理在LLM代理中的有效性,发现语义干扰下工具性能可能下降,提出Factorized Intervention Framework分析工具使用成本,并引入G-STEP缓解协议误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27713 2026-05-01 cs.AI 90%

Knowledge Graph Representations for LLM-Based Policy Compliance Reasoning

基于LLM的政策合规推理的知识图谱表示

Wilder Baldwin, Sepideh Ghanavati

机构 * University of Maine(缅因大学)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出一个框架,通过构建知识图谱从AI政策文档中检索相关信息,评估五种LLM在42个政策问答任务上的表现,证明知识图谱增强提升了模型性能,且开放的LLM发现模式达到或超越了正式本体。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21199 2026-04-28 cs.AI 90%

A Fano-Style Accuracy Upper Bound for LLM Single-Pass Reasoning in Multi-Hop QA

为LLM单步推理在多跳问答中的准确性设定一种Fano风格的上限

Kaiyang Wan, Lang Gao, Honglin Mu, Preslav Nakov, Yuxia Wang, Xiuying Chen

机构 * MBZUAI(马克斯·普朗克智能研究院) INSAIT(索菲亚大学)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出了一种Fano风格的准确性上限,用于分析LLM在多跳问答中的单步推理能力,通过容量感知的任务分解与主动剪枝,构建了InfoQA框架以提升性能和鲁棒性。

Comments 22 pages, 6 figures, ICLR 2026. Reported by MIT Technology Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20560 2026-04-23 cs.CL 90%

LLM StructCore: Schema-Guided Reasoning Condensation and Deterministic Compilation

LLM StructCore: 基于模式的推理压缩与确定性编译

Serhii Zabolotnii

机构 * Cherkasy State Business College(切尔卡西州商业学院)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.CL

AI总结 本文提出LLM StructCore,通过基于模式的推理压缩和确定性编译,解决临床笔记中填写病例报告表的挑战,采用合同驱动的两阶段设计,提升准确率与稳定性。

Comments 16 pages, 1 figure, 5 tables. Preprint of a paper accepted to the Third Workshop on Patient-oriented Language Processing (CL4Health), co-located with LREC-COLING 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18464 2026-04-21 cs.LG 90%

Semantic Step Prediction: Multi-Step Latent Forecasting in LLM Reasoning Trajectories via Step Sampling

语义步预测:通过步采样进行LLM推理轨迹中的多步潜在预测

Yidi Yuan

机构 * Home Team Science and Technology Agency(家庭团队科技机构)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文通过步采样改进语义管预测方法,提升多步潜在预测的准确性,并提出新的评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17364 2026-04-21 cs.AI cs.MA cs.PL 90%

LLM-Guided Strategy Synthesis for Scalable Equality Saturation

基于大型语言模型的策略合成用于可扩展的等式饱和

Chenyun Yin, Youwei Xiao, Yuze Luo, Yuyang Zou, Yun Liang

机构 * Peking University(北京大学) School of Integrated Circuits(集成电路学院)

专题命中 推理与问题求解 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出EggMind框架,通过领域特定语言EqSatL和LLM引导的代理工作流,高效合成可重用的等式饱和策略,提升资源质量平衡,减少成本和内存消耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06094 2026-04-20 cs.CL 90%

ConlangCrafter: Constructing Languages with a Multi-Hop LLM Pipeline

ConlangCrafter:基于多跳LLM流水线的语言构建

Morris Alper, Moran Yanuka, Raja Giryes, Gašper Beguš

机构 * Tel Aviv University(特拉维夫大学) Carnegie Mellon University(卡内基梅隆大学) UC Berkeley(伯克利大学)

专题命中 推理与问题求解 :LLM(title,title_cn);foundation model(abstract);分类 cs.CL

AI总结 本文提出ConlangCrafter,通过多阶段流水线实现语言构建,利用LLM的元语言能力生成一致且多样化的构想语言。

Comments Accepted to ACL 2026. Project page: https://conlangcrafter.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07043 2026-04-20 cs.LG 90%

COMPASS: Benchmarking Constrained Optimization in LLM Agents

COMPASS:评估LLM代理在约束优化中的表现

Tian Qin, Felix Bai, Ting-Yao Hu, Raviteja Vemulapalli, Hema Swetha Koppula, Zhiyang Xu, Bowen Jin, Mert Cemri, Jiarui Lu, Zirui Wang, Meng Cao

机构 * Harvard University(哈佛大学) Apple(苹果公司) Virginia Tech(弗吉尼亚理工学院) UIUC(伊利诺伊大学香槟分校) UC Berkeley(加州大学伯克利分校)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.LG

AI总结 COMPASS基准测试评估LLM代理在真实旅行规划中的约束优化能力,揭示当前模型在可行性与最优性之间存在显著差距,表明搜索空间探索不足是核心限制,编码代理提供潜在解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14178 2026-04-17 cs.AI q-bio.NC 90%

Simulating Human Cognition: Heartbeat-Driven Autonomous Thinking Activity Scheduling for LLM-based AI systems

模拟人类认知:基于心跳驱动的自主思考活动调度机制用于基于大语言模型的AI系统

Hong Su

机构 * School of Computer Science, Chengdu University of Information Technology(成都信息学院计算机科学学院)

专题命中 推理与问题求解 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出基于心跳驱动的自主思考活动调度机制,通过动态认知模块实现自适应和持续自我调节,提升LLM代理的适应性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01016 2026-04-17 cs.CL 90%

Prompt-R1: Collaborative Automatic Prompting Framework via End-to-end Reinforcement Learning

Prompt-R1: 通过端到端强化学习实现的协作自动提示框架

Wenjin Liu, Haoran Luo, Xueyuan Lin, Haoming Liu, Tiesunlong Shen, Jiapu Wang, Rui Mao, Erik Cambria

机构 * Hainan University(海南大学) Nanyang Technological University(南洋理工大学) Hithink Research(慧思研究) HKUST (Guangzhou)(香港科技大学(广州)) IDEA Research(IDEA研究院) Tsinghua University(清华大学) National University of Singapore(新加坡国立大学) Nanjing University of Science and Technology(南京理工大学)

专题命中 推理与问题求解 :LLM(summary_cn,abstract);prompting(title);large language model(abstract);language model(abstract)

AI总结 本文提出Prompt-R1框架,通过小规模LLM与大规模LLM协作,利用强化学习提升复杂问题解决能力,实验表明其在多个数据集上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12721 2026-04-15 cs.CL 90%

InsightFlow: LLM-Driven Synthesis of Patient Narratives for Mental Health into Causal Models

InsightFlow: 基于LLM的患者心理健康叙事合成至因果模型

Shreya Gupta, Prottay Kumar Adhikary, Bhavyaa Dave, Salam Michael Singh, Aniket Deroy, Tanmoy Chakraborty

机构 * Department of Mathematics, IIT Delhi(印度德里理工学院数学系) Department of Electrical Engineering, IIT Delhi(印度德里理工学院电气工程系) Department of Computer Science and Engineering, IIIT Manipur(曼尼普尔理工学院计算机科学与工程系)

专题命中 推理与问题求解 :LLM(title,title_cn);分类 cs.CL

AI总结 InsightFlow利用LLM自动从患者-治疗师对话生成与5P框架对齐的因果图,通过结构、语义和专家评估验证,证明其在临床案例构建中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07543 2026-03-03 cs.AI cond-mat.mtrl-sci 90%

MSP-LLM: A Unified Large Language Model Framework for Complete Material Synthesis Planning

MSP-LLM:一种用于完整材料合成规划的统一大语言模型框架

Heewoong Noh, Gyoung S. Na, Namkyeong Lee, Chanyoung Park

机构 * Department of Industrial \& Systems Engineering, KAIST, Daejeon, Korea Graduate School of Data Science, KAIST, Daejeon, Republic of Korea Korea Research Institute of Chemical Technology, KRICT, Daejeon, Korea

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title);language model(title);分类 cs.AI

AI总结 MSP-LLM提出一种统一的大语言模型框架,通过整合前驱材料预测和合成操作预测,有效解决材料合成规划问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22389 2026-02-18 cs.DL cs.AI 90%

Can Small and Reasoning Large Language Models Score Journal Articles for Research Quality and Do Averaging and Few-shot Help?

小模型和推理大模型能否对期刊文章进行科研质量评分?平均和少样本学习是否有帮助?

Mike Thelwall, Ehsan Mohammadi

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文评估了小模型和推理模型对期刊文章科研质量评分的能力,发现4b以上的小模型在使用评分平均时表现良好,但推理模型无明显优势。

Comments Thelwall, M. & Mohammadi, E. (2026). Can small and reasoning Large Language Models score journal articles for research quality and do averaging and few-shot help? Scientometrics

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19299 2026-02-02 cs.AI 90%

Helios: A Foundational Language Model for Smart Energy Knowledge Reasoning and Application

Helios:一种面向智能能源知识推理与应用的基础语言模型

Haoyu Jiang, Fanjie Zeng, Boan Qu, Xiaojie Lin, Wei Zhong

机构 * College of Energy Engineering, Zhejiang University(浙江大学能源工程学院) Polytechnic Institute, Zhejiang University(浙江大学 polytechnic 院) Shanghai Institute for Advanced Study, Zhejiang University(浙江大学上海研究院)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);pretraining(abstract)

AI总结 Helios是一种专为智能能源领域设计的基础语言模型,通过构建多智能体协作框架和相关数据集,提升领域知识、任务执行准确性和与人类偏好的对齐程度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16887 2025-09-23 cs.AI cs.MA cs.RO 90%

A Large Language Model-based multi-agent manufacturing system for intelligent shopfloor

Zhen Zhao, Dunbing Tang, Changchun Liu, Liping Wang, Zequn Zhang, Haihua Zhu, Kai Chen, Qingwei Nie, Yuchen Ji

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Journal ref Zhao Z, Tang D, Liu C, et al. A Large language model-based multi-agent manufacturing system for intelligent shopfloors[J]. Advanced Engineering Informatics, 2026, 69: 103888

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11701 2025-09-05 cs.AI 90%

DMN-Guided Prompting: A Framework for Controlling LLM Behavior

Shaghayegh Abedi, Amin Jalali

机构 * Politecnico di Torino(都灵理工大学) Stockholm University(斯德哥尔摩大学)

专题命中 推理与问题求解 :prompting(title,abstract);LLM(title);large language model(abstract,comments);language model(abstract,comments)

Comments Large Language Models, Decision Model and Notation, Automated Feedback, Prompt Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04848 2025-08-08 cs.AI 90%

Large Language Models Reasoning Abilities Under Non-Ideal Conditions After RL-Fine-Tuning

Chang Tian, Matthew B. Blaschko, Mingzhe Xing, Xiuxing Li, Yinliang Yue, Marie-Francine Moens

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI

Comments large language models, large vision-language model, reasoning, non-ideal conditions, reinforcement learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.10039 2025-07-15 cs.LG q-bio.GN 90%

Towards Applying Large Language Models to Complement Single-Cell Foundation Models

Steven Palayew, Bo Wang, Gary Bader

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) Peter Munk Cardiac Centre, University Health Network(彼得·穆恩心脏中心,大学健康网络) AI Hub, University Health Network(人工智能中心,大学健康网络) Princess Margaret Cancer Centre, University Health Network(玛格丽特公主癌症中心,大学健康网络) Lunenfeld-Tanenbaum Research Institute, Sinai Health System(伦纳尔德-坦恩堡研究所,辛纳医院系统)

专题命中 推理与问题求解 :foundation model(title,abstract);large language model(title);language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16635 2025-05-23 cs.AI 90%

Judgment-of-Thought Prompting: A Courtroom-Inspired Framework for Binary Logical Reasoning with Large Language Models

Sungjune Park, Heehwan Kim, Haehyun Cho, Daeseon Choi

机构 * Soongsil University(松溪大学)

专题命中 推理与问题求解 :prompting(title,abstract);large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05407 2024-11-11 cs.CL 90%

Gap-Filling Prompting Enhances Code-Assisted Mathematical Reasoning

Mohammad Ghiasvand Mohammadkhani

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.02246 2024-10-23 cs.CL 90%

PHAnToM: Persona-based Prompting Has An Effect on Theory-of-Mind Reasoning in Large Language Models

Fiona Anting Tan, Gerard Christopher Yeo, Kokil Jaidka, Fanyou Wu, Weijie Xu, Vinija Jain, Aman Chadha, Yang Liu, See-Kiong Ng

专题命中 推理与问题求解 :prompting(title,abstract);large language model(title);language model(title);分类 cs.CL

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16149 2023-10-02 cs.CL cs.AI cs.LG 90%

Jais and Jais-chat: Arabic-Centric Foundation and Instruction-Tuned Open Generative Large Language Models

Neha Sengupta, Sunil Kumar Sahu, Bokang Jia, Satheesh Katipomu, Haonan Li, Fajri Koto, William Marshall, Gurpreet Gosal, Cynthia Liu, Zhiming Chen, Osama Mohammed Afzal, Samta Kamboj, Onkar Pandit, Rahul Pal, Lalit Pradhan, Zain Muhammad Mujahid, Massa Baali, Xudong Han, Sondos Mahmoud Bsharat, Alham Fikri Aji, Zhiqiang Shen, Zhengzhong Liu, Natalia Vassilieva, Joel Hestness, Andy Hock, Andrew Feldman, Jonathan Lee, Andrew Jackson, Hector Xuguang Ren, Preslav Nakov, Timothy Baldwin, Eric Xing

专题命中 推理与问题求解 :language model(title,abstract);large language model(title,abstract);分类 cs.CL、cs.AI、cs.LG;LLM(comments)

Comments Arabic-centric, foundation model, large-language model, LLM, generative model, instruction-tuned, Jais, Jais-chat

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08525 2026-08-17 cs.AI cs.CL cs.CY 版本更新 90%

Ads in AI Chatbots? An Analysis of How Large Language Models Navigate Conflicts of Interest

AI聊天机器人中的广告:大型语言模型如何应对利益冲突分析

Addison J. Wu, Ryan Liu, Shuyue Stella Li, Yulia Tsvetkov, Thomas L. Griffiths

机构 * Princeton University(普林斯顿大学) University of Washington(华盛顿大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 本文分析了大型语言模型在面临用户与公司利益冲突时的决策问题,通过实验发现多数模型优先考虑公司利益而非用户福祉,展示了在广告推荐中潜在的风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09898 2026-08-11 cs.CL cs.LG 新提交 90%

Consilience for Verifier-Free Test-Time Scaling

无验证器的测试时扩展的一致性方法

Lecheng Kong, Like Hui, Haitao Mao, Jun Huan

专题命中 推理与问题求解 :LLM(summary_cn,abstract);large language model(abstract,abstract_cn);language model(abstract,abstract_cn);分类 cs.CL、cs.LG

AI总结 本文针对现有基于置信度的无验证器测试时扩展(VF-TTS)方法在复杂任务上失效的问题,提出一致性(consilience)框架,通过评估置信度时间不对称性提升LLM推理性能,在数学和代码生成任务上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17266 2026-07-21 cs.CL cs.AI 新提交 90%

Debate-on-Graph: Reliable and Adaptive Reasoning of Large Language Model on Uncertain Knowledge Graph

图上辩论:大语言模型在不确定知识图谱上的可靠且自适应推理

Peiji Yu, Xin Chen, Tianxing Wu

机构 * School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University)(教育部新一代人工智能技术及其跨学科应用重点实验室(东南大学))

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型在不确定知识图谱上问答时的问题,提出Debate-on-Graph框架,设计启发式搜索算法提取子图并引入多智能体辩论机制,经实验验证该框架能实现可靠且自适应推理,性能优于现有方法。

Comments 18 pages, Accepted by ECML-PKDD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12811 2026-07-16 cs.CL cs.AI q-bio.NC 版本更新 90%

Left-right asymmetry in predicting brain activity from LLMs' representations emerges with their formal linguistic competence

在LLM表示中预测脑活动的左右不对称性随着其正式语言能力的出现而出现

Laurent Bonnasse-Gahot, Christophe Pallier

机构 * Centre d’Analyse et de Mathématique Sociales CNRS, EHESS, Paris, France(分析与数学社会中心 CNRS,EHESS,巴黎,法国) Cognitive Neuroimaging Unit CNRS, INSERM, CEA, Neurospin Center, 91191 Gif-sur-Yvette, France(认知神经成像单元 CNRS,INSERM,CEA,Neurospin中心,法国91191 Gif-sur-Yvette)

专题命中 推理与问题求解 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究发现LLM的正式语言能力与大脑预测活动的左右不对称性同步发展,且与算术或世界知识任务无关。

Journal ref Neurobiology of Language 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10296 2026-07-14 cs.AI cs.CL 新提交 90%

SPARK: Susceptibility-Guided Profiling and Steering of Latent Reasoning States in Large Language Models

SPARK:大语言模型中基于敏感性的潜在推理状态分析与引导

Dongxu Zhang, Yiding Sun, Zihao Guo, Xiangyang Yang, Kai Tang, Lin Chen, Cheng Tan, Jihua Zhu

机构 * Xi’an Jiaotong University(西安交通大学) Peking University(北京大学) Tencent(腾讯)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型推理失败问题,提出SPARK方法,利用隐藏状态响应诊断推理状态并引导测试时干预,通过长度控制敏感性等手段,在实验中提升了Qwen3系列模型性能,证明敏感性对推理失败诊断及干预的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07779 2026-07-10 cs.CL cs.AI 新提交 90%

From Solvers to Research: Large Language Model-Driven Formal Mathematics at the Research Frontier

从求解器到研究:前沿研究中的大语言模型驱动形式数学

Eric Jiang, Xiao Liang, Yikai Zhang, Yingjia Wan, Mengting Li, Haikang Deng, Alexander K. Taylor, Justin Baker, Rushil Raghavan, Junyi Zhang, Ying Nian Wu, Andrea L. Bertozzi, Kai-Wei Chang, Raghu Meka, Matthew Sottile, Nanyun Peng, Amit Sahai, Terence Tao, Wei Wang

机构 * University of California, Los Angeles(加利福尼亚大学洛杉矶分校) Lawrence Livermore National Laboratory(劳伦斯利弗莫尔国家实验室)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 探讨AI4Math领域进展,指出当前系统处理前沿数学问题有局限。主张从预定义求解器转向研究代理,对该领域进行系统综述,识别现有系统局限性,为AI4Math未来发展规划战略路线图。

详情

展开后加载摘要…

URL PDF HTML 收藏