arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18810 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18810 篇

2512.20745 2026-03-03 cs.AI cs.CL cs.LG 89%

AgentMath: Empowering Mathematical Reasoning for Large Language Models via Tool-Augmented Agent

AgentMath: 通过工具增强代理赋能大语言模型的数学推理

Haipeng Luo, Huawen Feng, Qingfeng Sun, Can Xu, Kai Zheng, Yufei Wang, Tao Yang, Han Hu, Yansong Tang

专题命中 推理与问题求解 :language model(title,abstract);large language model(title);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 AgentMath通过整合语言模型和代码解释器,提升大语言模型在复杂数学问题上的推理能力,实现高效训练和高准确率。

Comments This paper has been accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19551 2026-03-03 eess.SY cs.SY eess.SP 89%

Customising Electricity Contracts at Scale with Large Language Models

利用大语言模型大规模定制电力合同

Jochen L. Cremer

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文利用大语言模型大规模定制电力合同,解决电网约束下的自动化合同设计问题,提升电网规划和客户管理效率。

Comments 14 pages, 21 figures

Journal ref IEEE Transactions on Power Systems, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07360 2026-02-10 eess.SY cs.SY 89%

In-Context System Identification for Nonlinear Dynamics Using Large Language Models

基于大语言模型的非线性动力学在境系统识别

Linyu Lin

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出一种利用大语言模型辅助SINDy的方法,通过在境学习迭代优化方程结构,提升复杂动力学系统的符号恢复精度与可解释性。

Comments 6 pages, 5 figures, submitted to The 10th IEEE Conference on Control Technology and Applications (CCTA) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11397 2026-02-10 cs.CV 89%

EAGLE: Elevating Geometric Reasoning through LLM-empowered Visual Instruction Tuning

通过LLM赋能的视觉指令微调提升几何推理能力

Zhihao Li, Yao Du, Yang Liu, Yan Zhang, Yufang Liu, Mengdi Zhang, Xunliang Cai, Charles Ling, Boyu Wang

机构 * Department of Computer Science, Western University(计算机科学系,西部大学) Meituan Inc.(美团公司) Department of Automation, Tsinghua University(自动化系,清华大学) School of Computer Science and Technology, East China Normal University(计算机科学与技术学院,东华大学)

专题命中 推理与问题求解 :LLM(title,abstract);instruction tuning(title);large language model(abstract);language model(abstract)

AI总结 EAGLE通过视觉增强框架提升几何推理能力,解决MLLMs在几何理解与视觉感知上的不足。

Comments revised version

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05239 2026-02-10 cs.RO 89%

Lan-grasp: Using Large Language Models for Semantic Object Grasping and Placement

Lan-grasp:利用大语言模型进行语义物体抓取与放置

Reihaneh Mirjalili, Michael Krawez, Yannik Blei, Simone Silenzi, Florian Walter, Wolfram Burgard

机构 * Department of Computer Science and Artificial Intelligence, University of Technology Nuremberg(计算机科学与人工智能系,图恩技术大学) Department of Engineering ``Enzo Ferrari'' (DIEF), University of Modena and Reggio Emilia(恩佐·费尔拉蒂工程系(DIEF),摩德纳和雷吉奥艾米利亚大学) Technical University of Munich(慕尼黑技术大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract)

AI总结 Lan-grasp利用大语言模型实现更精确的语义抓取与放置,通过结合多种模型提升抓取效果和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01523 2026-02-03 cs.LG cs.AI cs.CL 89%

A Relative-Budget Theory for Reinforcement Learning with Verifiable Rewards in Large Language Model Reasoning

一种用于大语言模型推理中可验证奖励的相对预算理论

Akifumi Wachi, Hirota Kinoshita, Shokichi Takakura, Rei Higuchi, Taiji Suzuki

机构 * LY Corporation(LY公司) Toyota Technological Institute at Chicago(丰田技术研究所(芝加哥)) University of Tokyo(东京大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出一种相对预算理论,通过相对预算ξ=H/E[T]解释强化学习在大语言模型推理中的样本效率差异,并通过实验证明在ξ∈[1.5,2.0]时学习效率最高。

Comments 28 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01226 2026-02-03 cs.RO cs.HC 89%

SkySim: A ROS2-based Simulation Environment for Natural Language Control of Drone Swarms using Large Language Models

SkySim: 一种基于ROS2的无人机群自然语言控制仿真环境

Aditya Shibu, Marah Saleh, Mohamed Al-Musleh, Nidhal Abdulaziz

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 SkySim通过基于ROS2的仿真框架,利用大型语言模型实现无人机群的自然语言控制,结合人工势场算法确保安全执行,验证了空间推理精度和实时碰撞避免能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00085 2026-02-03 cs.LG cs.AI cs.CL 89%

CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models

CARE-RFT:基于置信度的强化微调用于大语言模型中的可靠推理

Shuozhe Li, Jincheng Cao, Bodun Hu, Aryan Mokhtari, Leqi Liu, Amy Zhang

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 CARE-RFT通过引入置信度锚定的正则化方法,在保持大语言模型推理能力的同时提升其可信度和校准性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21293 2026-01-29 cs.RO cs.HC 89%

Quadrupped-Legged Robot Movement Plan Generation using Large Language Model

四足机器人运动计划生成使用大语言模型

Muhtadin, Vincentius Gusti Putu A. B. M., Ahmad Zaini, Mauridhi Hery Purnomo, I Ketut Eddy Purnama, Chastine Fatichah

机构 * Institut Teknologi Sepuluh Nopember(十月份十号技术学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出利用大语言模型生成四足机器人运动计划,通过分布式架构和实时传感器融合实现直观自然语言导航,实验显示系统在多种场景中成功率超过90%。

Journal ref 2025 International Conference on Computer Engineering, Network and Intelligent Multimedia (CENIM)

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19280 2026-01-28 cs.LG cs.AI cs.CL 89%

Group Distributionally Robust Optimization-Driven Reinforcement Learning for LLM Reasoning

基于组分布鲁棒优化的强化学习用于大语言模型推理

Kishan Panaganti, Zhenwen Liang, Wenhao Yu, Haitao Mi, Dong Yu

机构 * Tencent AI Lab in Bellevue WA USA(腾讯AI实验室(西雅图华盛顿州))

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract,comments);language model(abstract,comments);post-training(abstract)

AI总结 本文提出多对手组分布鲁棒优化框架,通过动态调整训练分布提升大语言模型推理性能,实现训练后精度提升10.6%和10.1%。

Comments Keywords: Large Language Models, Reasoning Models, Reinforcement Learning, Distributionally Robust Optimization, GRPO

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18044 2026-01-27 cs.SE 89%

RGFL: Reasoning Guided Fault Localization for Automated Program Repair Using Large Language Models

RGFL:基于大语言模型的自动化程序修复中的推理引导故障定位

Melika Sepidband, Hamed Taherkhani, Hung Viet Pham, Hadi Hemmati

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 RGFL通过引入分层推理模块和反事实分析,提升自动化程序修复中的文件和元素级故障定位精度,显著提高修复成功率。

Comments 23 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08241 2026-01-14 cs.CV cs.DC 89%

Improving Zero-shot ADL Recognition with Large Language Models through Event-based Context and Confidence

通过基于事件的上下文和置信度提升零样本ADL识别

Michele Fiori, Gabriele Civitarese, Marco Colussi, Claudio Bettini

机构 * Dept. of Computer Science University of Milan, Milan, Italy(计算机科学系米兰大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出通过基于事件的上下文分割和新的置信度估计方法,改进零样本ADL识别,实验表明其在复杂数据集上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09896 2026-01-12 cs.CR 89%

ChatIoT: Large Language Model-based Security Assistant for Internet of Things with Retrieval-Augmented Generation

ChatIoT: 基于大语言模型的物联网安全助手与检索增强生成

Ye Dong, Yan Lin Aung, Sudipta Chattopadhyay, Jianying Zhou

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 ChatIoT是一种基于大语言模型的物联网安全助手,通过检索增强生成技术整合安全信息,提升用户在物联网安全实践中的指导与响应能力。

Comments preprint, under revision, 19 pages, 13 figures, 8 tables

Journal ref ACNS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00730 2026-01-05 cs.CV 89%

Grading Handwritten Engineering Exams with Multimodal Large Language Models

用多模态大语言模型评分手写工程考试

Janez Perš, Jon Muhovič, Andrej Košir, Boštjan Murovec

机构 * University of Ljubljana, Faculty of Electrical Engineering(卢布尔雅那大学电子工程学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

AI总结 本研究利用多模态大语言模型对斯洛文尼亚语手写工程考试进行自动评分,通过多阶段设计实现高可靠性,达到与人工评分约8分的均方差,验证了结构化提示和参考定位的重要性。

Comments 10 pages, 5 figures, 2 tables. Supplementary material available at https://lmi.fe.uni-lj.si/en/janez-pers-2/supplementary-material/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01930 2026-01-01 cs.RO 89%

Large Language Model-Driven Closed-Loop UAV Operation with Semantic Observations

基于大语言模型的闭环无人机操作与语义观测

Wenhao Wang, Yanyan Li, Long Jiao, Jiawei Yuan

机构 * Department of CIS, University of Massachusetts Dartmouth(CIS系,马萨诸塞大学达特茅斯分校) Department of CSIS, California State University San Marcos(CSIS系,加州州立大学桑马科斯分校)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出基于大语言模型的闭环无人机操作框架,通过代码生成器和评估器实现可靠操作,提升复杂任务的成功率和完整性。

Comments 13 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.01681 2025-12-30 physics.flu-dyn 89%

Large Language Model Driven Development of Turbulence Models

基于大语言模型的湍流模型开发

Zhongxin Yang, Yuanwei Bin, Yipeng Shi, Xiang I. A. Yang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文提出利用大语言模型开发湍流模型,通过闭环迭代流程生成可解释且性能更优的近壁湍流模型,解决了不利压力梯度、系统旋转和表面粗糙度等问题。

Journal ref Flow (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02324 2025-12-23 cs.CL cs.AI cs.LG 89%

PromptCoT: Synthesizing Olympiad-level Problems for Mathematical Reasoning in Large Language Models

PromptCoT: 为大型语言模型中的数学推理合成竞赛级问题

Xueliang Zhao, Wei Wu, Jian Guan, Lingpeng Kong

机构 * The University of Hong Kong(香港大学) Ant Group(蚂蚁集团)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 PromptCoT通过模拟竞赛级问题设计者的思维过程,自动生成高质量数学问题,提升大型语言模型的数学推理能力。

Comments Preprint

Journal ref Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17911 2025-12-23 cs.CL cs.AI cs.LG 89%

Towards Reasoning-Preserving Unlearning in Multimodal Large Language Models

面向多模态大语言模型的推理保留反学习

Hongji Li, Junchi yao, Manjiang Yu, Priyanka Singh, Xue Li, Di Wang, Lijie Hu

机构 * Mohamed bin Zayed University of Artificial Intelligence (MBZUAI)(Mohamed bin Zayed人工智能大学) University of Queensland(昆士兰大学) Provable Responsible AI and Data Analytics (PRADA) Lab(可证明责任人工智能与数据分析实验室) King Abdullah University of Science and Technology (KAUST)(卡塔尔科学与技术大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出R-MUSE框架,通过子空间指导和自适应引导,在推理过程中有效消除多模态大语言模型中的推理痕迹,同时保留通用推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09245 2025-12-18 cs.CV 89%

DriveMLM: Aligning Multi-Modal Large Language Models with Behavioral Planning States for Autonomous Driving

DriveMLM: 通过行为规划状态对齐多模态大语言模型以实现自动驾驶

Erfei Cui, Wenhai Wang, Zhiqi Li, Jiangwei Xie, Haoming Zou, Hanming Deng, Gen Luo, Lewei Lu, Xizhou Zhu, Jifeng Dai

机构 * Department of Electronic Engineering, Tsinghua University(清华大学电子工程系) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 DriveMLM通过多模态大语言模型对齐行为规划状态,提升自动驾驶系统的决策能力与闭环性能。

Comments Accepted to Visual Intelligence

Journal ref Visual Intelligence, Volume 3, article number 22, (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10966 2025-12-17 physics.ed-ph 89%

Can Large Language Models Correctly Interpret Equations with Errors?

大型语言模型能否正确解释有误的方程?

Lachlan McGinness, Peter Baumgartner

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文研究了大型语言模型在解析学生输入中存在错误的方程时的准确性,发现开源模型无法达到预期效果,并提出未来改进方向。

Comments Published in Physics Review Physics Education Research here: https://journals.aps.org/prper/abstract/10.1103/v8f8-s11v

Journal ref Phys. Rev. Phys. Educ. Res. 21, 020155 Published 15 December, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01926 2025-12-05 cs.AI cs.CL cs.LG 89%

Large language models can learn and generalize steganographic chain-of-thought under process supervision

大语言模型可以在过程监督下学习和泛化隐写链式思维

Joey Skaf, Luis Ibanez-Lissen, Robert McCarthy, Connor Watts, Vasil Georgiv, Hannes Whittingham, Lorena Gonzalez-Manzano, David Lindner, Cameron Tice, Edward James Young, Puria Radmard

机构 * Mentorship for Alignment Research Students (MARS)(对齐研究 mentorship 项目) University College London(伦敦大学学院) Queen Mary University of London(伦敦女王学院) ML Alignment & Theory Scholars (MATS)(对齐与理论学者) Meridian Impact, Cambridge(剑桥 Meridian Impact) Universidad Carlos III de Madrid(马德里卡洛斯三世大学) Geodesic Research and University of Cambridge(Geodesic Research 和剑桥大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 大语言模型在过程监督下能够学习并泛化隐写链式思维,通过替换特定字符串实现推理编码,提升监控可靠性。

Comments 10 pages main text, 3 figures main text, 17 pages supplementary material, 1 figure supplementary material, accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03722 2025-12-04 cs.NI 89%

Tutorial on Large Language Model-Enhanced Reinforcement Learning for Wireless Networks

无线网络中增强型强化学习教程:大型语言模型

Lingyi Cai, Wenjie Fu, Yuxi Huang, Ruichen Zhang, Yinqiu Liu, Jiawen Kang, Zehui Xiong, Tao Jiang, Dusit Niyato, Xianbin Wang, Shiwen Mao, Xuemin Shen

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文介绍了利用大型语言模型增强无线网络强化学习的方法,涵盖分类框架、角色功能及应用场景,探讨未来发展方向。

Comments 30 pages, 12 figures, survey paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03421 2025-12-04 cs.SE 89%

Exploring the Potential and Limitations of Large Language Models for Novice Program Fault Localization

探索大型语言模型在初级程序员故障定位中的潜力与局限性

Hexiang Xu, Hengyuan Liu, Yonghao Wu, Xiaolan Kang, Xiang Chen, Yong Liu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 本文评估了LLM在初级程序员故障定位中的性能,发现高级模型在准确性上表现优异,但存在推理过度和计算成本高等问题。

Comments The paper has been accepted for publication in The Journal of Systems & Software

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09060 2025-12-04 cs.DB 89%

GenRewrite: Query Rewriting via Large Language Models

GenRewrite: 通过大语言模型实现查询重写

Jie Liu, Barzan Mozafari

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 GenRewrite 利用大语言模型实现查询重写,通过自然语言重写规则和反例引导技术提升查询优化效率。

Comments 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17052 2025-11-24 cs.CV 89%

PathAgent: Toward Interpretable Analysis of Whole-slide Pathology Images via Large Language Model-based Agentic Reasoning

PathAgent: 通过基于大型语言模型的代理推理实现全切片病理图像的可解释分析

Jingyun Chen, Linghan Cai, Zhikang Wang, Yi Huang, Songhan Jiang, Shenjin Huang, Hongpeng Wang, Yongbing Zhang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Fudan University(复旦大学) Sichuan University(四川大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

AI总结 PathAgent通过基于大型语言模型的代理推理,实现全切片病理图像的可解释分析,展现出强大的零样本泛化能力和临床应用潜力。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10207 2025-11-14 eess.SY cs.SY 89%

Generalized Intelligence for Tactical Decision-Making: Large Language Model-Driven Dynamic Weapon Target Assignment

Johannes Autenrieb, Ole Ostermann

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 8 Pages, 6 figures, submitted to IEEE Transactions on Aerospace and Electronic Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10017 2025-11-14 cs.CV 89%

AffordBot: 3D Fine-grained Embodied Reasoning via Multimodal Large Language Models

Xinyi Wang, Xun Yang, Yanlong Xu, Yuchen Wu, Zhen Li, Na Zhao

机构 * University of Science and Technology of China(科学技术大学) Singapore University of Technology and Design(新加坡科技设计大学) Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06888 2025-11-12 cs.CV 89%

A Two-Stage System for Layout-Controlled Image Generation using Large Language Models and Diffusion Models

Jan-Hendrik Koch, Jonas Krumme, Konrad Gadzicki

机构 * Cognitive Neuroinformatics University of Bremen(认知神经信息学不莱梅大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05912 2025-11-11 eess.SP 89%

RadioSim Agent: Combining Large Language Models and Deterministic EM Simulators for Interactive Radio Map Analysis

Sajjad Hussain, Conor Brennan

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Submitted to EuCAP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18069 2025-11-10 cs.LO 89%

$\text{C}^2\text{P}$: Featuring Large Language Models with Causal Reasoning

Abdolmahdi Bagheri, Matin Alinejad, Mahdi Dehshiri, Kevin Bello, Alireza Akhondi-Asl

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

Comments arXiv admin note: text overlap with arXiv:2306.05836 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏