arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18810 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18810 篇

2504.08694 2025-12-12 cs.CL 89%

TP-RAG: Benchmarking Retrieval-Augmented Large Language Model Agents for Spatiotemporal-Aware Travel Planning

TP-RAG:用于时空感知旅行规划的检索增强型大语言模型代理基准测试

Hang Ni, Fan Liu, Xinyu Ma, Lixin Su, Shuaiqiang Wang, Dawei Yin, Hui Xiong, Hao Liu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 TP-RAG提出了一种用于时空感知旅行规划的检索增强型大语言模型基准测试,通过整合参考轨迹提升旅行计划的空间效率和兴趣点合理性,采用EvoRAG框架实现更高效的时空合规性。

Journal ref Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.21051 2025-12-12 cs.CR cs.AI cs.NI 89%

Toward Intelligent and Secure Cloud: Large Language Model Empowered Proactive Defense

迈向智能和安全的云:大型语言模型赋能的主动防御

Yuyang Zhou, Guang Cheng, Kang Du, Zihan Chen, Yuyu Zhao

机构 * School of Cyber Science and Engineering, Southeast University, Purple Mountain Laboratories, and Jiangsu Province Engineering Research Center of Security for Ubiquitous Network(网络安全学院、东南大学、紫山实验室以及江苏省物联网安全工程技术研究中心)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出LLM-PD,一种基于大型语言模型的主动防御架构,用于有效应对云网络中的DoS攻击,通过数据分析和自我进化提升防御效率。

Comments 7 pages; Accepted by IEEE Communications Magazine

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09251 2025-12-11 cs.CV cs.AI 89%

GLACIA: Instance-Aware Positional Reasoning for Glacial Lake Segmentation via Multimodal Large Language Model

GLACIA:基于多模态大语言模型的冰湖分割实例感知位置推理

Lalit Maurya, Saurabh Kaushik, Beth Tellman

机构 * Portsmouth AI and Data Science Centre (PAIDS), School of Computing, University of Portsmouth(普森大学计算学院) Center for Sustainability and the Global Environment (SAGE), University of Wisconsin–Madison(威斯康星大学麦迪逊分校可持续性与全球环境中心)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.AI

AI总结 GLACIA通过多模态大语言模型实现冰湖分割的实例感知位置推理,提升分割精度与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08145 2025-12-10 cs.RO cs.AI 89%

Chat with UAV -- Human-UAV Interaction Based on Large Language Models

与无人机对话——基于大语言模型的人机交互

Haoran Wang, Zhuohang Chen, Guang Li, Bo Ma, Chuanghuang Li

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出基于大语言模型的双智能体HUI框架,通过任务规划和执行智能体提升无人机交互的个性化和灵活性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10072 2025-12-09 cs.CL 89%

Unilaw-R1: A Large Language Model for Legal Reasoning with Reinforcement Learning and Iterative Inference

Unilaw-R1:基于强化学习和迭代推理的法律推理大语言模型

Hua Cai, Shuang Zhao, Liang Zhang, Xuli Shen, Qing Xu, Weilin Shen, Zihao Wen, Tianke Ban

机构 * UniDT Fudan University(复旦大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);SFT(abstract);分类 cs.CL

AI总结 Unilaw-R1通过强化学习和迭代推理,提升法律推理能力,在多个基准测试中超越同类模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05757 2025-12-09 cs.AI 89%

Hyperbolic Large Language Models

双曲大语言模型

Sarang Patil, Zeyong Zhang, Yiran Huang, Tengfei Ma, Mengjia Xu

机构 * Department of Data Science, New Jersey Institute of Technology(数据科学系,新泽西理工学院) Department of Biomedical Informatics, Stony Brook University(生物医学信息学系,石溪大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出双曲大语言模型,通过双曲几何提升语义表示学习和多尺度推理能力。

Comments 27 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07640 2025-12-08 cs.AI 89%

Enhancing Large Language Models through Neuro-Symbolic Integration and Ontological Reasoning

通过神经符号整合和本体推理增强大型语言模型

Ruslan Idelfonso Magana Vsevolodovna, Marco Monti

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出一种结合符号本体推理和机器学习的方法,通过迭代反馈提升LLM输出的一致性和事实准确性。

Comments Withdrawn because Version 1 contains inaccuracies in references and architecture description. A corrected and improved version will be submitted separately

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04748 2025-12-05 cs.CL 89%

Model Whisper: Steering Vectors Unlock Large Language Models' Potential in Test-time

模型Whisper:引导向量解锁大型语言模型在测试时的潜力

Xinyue Kang, Diwei Shi, Li Chen

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 Model Whisper通过轻量级引导向量在测试时提升大型语言模型的推理能力,实现高效且稳定的性能提升。

Comments accepted to aaai2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03955 2025-12-04 cs.AI cs.ET 89%

Benchmark for Planning and Control with Large Language Model Agents: Blocksworld with Model Context Protocol

基于大语言模型代理的规划与控制基准:带有模型上下文协议的积木世界

Niklas Jobs, Luis Miguel Vieira da Silva, Jayanth Somashekaraiah, Maximilian Weigand, David Kube, Felix Gehlhoff

机构 * Institute of Automation Technology, Helmut Schmidt University / University of the Federal Armed Forces Hamburg, Germany(自动化技术研究所,海姆·施密特大学/联邦武装部队大学汉堡,德国) Siemens AG, Nuremberg, Germany(西门子股份公司,纽伦堡,德国)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出一个基于大语言模型的规划与控制基准,通过积木世界问题和模型上下文协议,提供五个复杂度类别以评估不同代理架构的性能。

Comments This work has been submitted to IFAC for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02499 2025-12-03 cs.AI 89%

COPE: Chain-Of-Thought Prediction Engine for Open-Source Large Language Model Based Stroke Outcome Prediction from Clinical Notes

COPE:基于开源大语言模型的链式推理预测引擎用于从临床笔记预测中风结局

Yongkai Liu, Helena Feng, Bin Jiang, Yixin Wang, Max Wintermark, David S. Liebeskind, Michael Moseley, Maarten Lansberg, Gregory Albers, Jeremy Heit, Greg Zaharchuk

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 COPE通过链式推理框架从临床笔记预测中风预后,优于现有模型,提供轻量级且可解释的解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01958 2025-12-02 cs.AI 89%

Learned-Rule-Augmented Large Language Model Evaluators

学习规则增强的大语言模型评估器

Jie Meng, Jin Mao

机构 * Wuhan University(武汉大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出规则增强的LLM评估器,通过规则蒸馏和强化学习提升评估器的泛化能力与一致性,适用于多种评估场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10695 2025-12-02 cs.CL 89%

"As Eastern Powers, I will veto." : An Investigation of Nation-level Bias of Large Language Models in International Relations

作为东方国家,我将 veto。:对大型语言模型在国际关系领域国家层面偏见的调查

Jonghyeon Choi, Yeonjun Choi, Hyun-chul Kim, Beakcheol Jang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在国际关系领域中的国家层面偏见,提出了一种去偏框架以减少偏见并提升性能。

Comments 21 pages, 4 figures. This is the extended version of the paper accepted at AAAI 2026, which includes all technical appendices and additional experimental details

Journal ref AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12861 2025-12-01 cs.CL cs.CV 89%

From Perception to Reasoning: Deep Thinking Empowers Multimodal Large Language Models

从感知到推理:深度思考赋能多模态大语言模型

Wenxin Zhu, Andong Chen, Yuchen Song, Kehai Chen, Conghui Zhu, Ziyan Chen, Tiejun Zhao

机构 * Harbin Institute of Technology(哈尔滨工业大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Global Tone Communication Technology(全球语音通信技术)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.CL

AI总结 本文提出多模态链式思维方法,旨在提升多模态大语言模型的推理能力,通过系统性综述分析其理论基础、实现方法及未来发展方向。

Comments Survey; 7 figures, 3 tables, 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21591 2025-11-27 cs.AI 89%

On the Limits of Innate Planning in Large Language Models

大语言模型中内生规划的极限

Charles Schepanowski, Charles Ling

机构 * Western University(温斯洛大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 研究发现大语言模型在无外部工具的情况下,规划和状态推理能力有限,主要问题在于内部状态表示脆弱和启发式规划能力不足。

Comments 33 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20471 2025-11-27 cs.AI 89%

Universe of Thoughts: Enabling Creative Reasoning with Large Language Models

思想宇宙:通过大语言模型实现创造性推理

Yuto Suzuki, Farnoush Banaei-Kashani

机构 * Department of Computer Science and Engineering University of Colorado Denver(计算机科学与工程系科罗拉多大学丹佛分校)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 通过引入思想宇宙框架,UoT提出了三种创造性推理范式,以提升大语言模型在复杂问题中的创造性解决能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19727 2025-11-26 cs.CR cs.AI 89%

Prompt Fencing: A Cryptographic Approach to Establishing Security Boundaries in Large Language Model Prompts

提示围栏:一种通过密码学建立大语言模型提示安全边界的方案

Steven Peh

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 Prompt Fencing通过密码学方法在LLM提示中建立安全边界,有效防止提示注入攻击。

Comments 44 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09738 2025-11-26 cs.LG 89%

Towards Multimodal Graph Large Language Model

迈向多模态图大规模语言模型

Xin Wang, Zeyang Zhang, Linxin Xiao, Haibo Chen, Chendi Ge, Wenwu Zhu

机构 * Department of Computer Science and Technology(计算机科学与技术系) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出多模态图大规模语言模型(MG-LLM),旨在统一和泛化多模态图数据和任务,通过统一空间、多任务处理、上下文学习等五个核心特性,推动多模态图学习的发展。

Comments 4 figures, 2 tables

Journal ref Science China Information Sciences (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19055 2025-11-25 eess.SY cs.AI cs.SY math.OC 89%

Large Language Model-Assisted Planning of Electric Vehicle Charging Infrastructure with Real-World Case Study

基于大语言模型的电动汽车充电基础设施规划与现实案例研究

Xinda Zheng, Canchen Jiang, Hao Wang

机构 * Department of Data Science and AI, Faculty of Information Technology, Monash University(数据科学与人工智能系,信息科技学院,莫纳什大学) Monash Energy Institute, Monash University(莫纳什能源研究所,莫纳什大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型优化电动汽车充电基础设施规划,通过空间-时间需求动态建模和分布式优化算法,实现实用案例中总成本降低30%。

Journal ref Sustainable Energy Technologies and Assessments, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14813 2025-11-21 cs.LG 89%

DEVAL: A Framework for Evaluating and Improving the Derivation Capability of Large Language Models

DEVAL:一个用于评估和提升大语言模型推导能力的框架

Yifan Li, Qin Li, Min Zhang, Min Zhang

机构 * East China Normal University(华东师范大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.LG

AI总结 DEVAL框架通过评估和提升大语言模型的推导能力,提出了一种新的提示工程方法DP,显著提高了模型在问题解决中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07979 2025-11-21 cs.AI 89%

Benchmarking Multi-Step Legal Reasoning and Analyzing Chain-of-Thought Effects in Large Language Models

对多步骤法律推理进行基准测试并分析思维链效应在大型语言模型中的表现

Wenhan Yu, Xinbo Lin, Lanxin Ni, Jinhua Cheng, Lei Sha

机构 * School of Artificial Intelligence, Beihang University, Beijing, China(北京航空航天大学人工智能学院) KoGuan School of Law, Shanghai Jiao Tong University, Shanghai, China(上海交通大学KoGuan法学院) School of Criminal Law, China University of Political Science and Law, Beijing, China(中国政法大学刑事法律学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出MSLR数据集,用于评估大型语言模型在多步骤法律推理中的表现,并通过实验展示自主生成的思维链提示提升了推理质量。

Comments 21 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12312 2025-11-20 cs.CL 89%

Socrates or Smartypants: Testing Logic Reasoning Capabilities of Large Language Models with Logic Programming-based Test Oracles

Zihao Xu, Junchen Ding, Yiling Lou, Kun Zhang, Dong Gong, Yuekang Li

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14435 2025-11-19 cs.SE cs.AI cs.LO 89%

Watchdogs and Oracles: Runtime Verification Meets Large Language Models for Autonomous Systems

Angelo Ferrando

机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments In Proceedings FMAS 2025, arXiv:2511.13245

Journal ref EPTCS 436, 2025, pp. 80-87

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13771 2025-11-19 cs.CR cs.AI 89%

ExplainableGuard: Interpretable Adversarial Defense for Large Language Models Using Chain-of-Thought Reasoning

Shaowei Guan, Yu Zhai, Zhengyu Zhang, Yanze Wang, Hin Chi Kwok

机构 * Centre for Smart Health, School of Nursing, The Hong Kong Polytechnic University(智能健康研究中心、护理学院、香港理工大学) Department of Language Science and Technology, The Hong Kong Polytechnic University(语言科学与技术系、香港理工大学) Department of Electrical and Electronic Engineering, The Hong Kong Polytechnic University(电子与电气工程系、香港理工大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 9 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26023 2025-11-17 cs.AI cs.RO 89%

Large Language Model-assisted Autonomous Vehicle Recovery from Immobilization

Zhipeng Bao, Qianwen Li

机构 * School of Environmental, Civil, Agricultural, and Mechanical Engineering(环境、土木、农业和机械工程学院) University of Georgia(佐治亚大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10688 2025-11-17 cs.CL 89%

Modeling and Predicting Multi-Turn Answer Instability in Large Language Models

Jiahang He, Rishi Ramachandran, Neel Ramachandran, Aryan Katakam, Kevin Zhu, Sunishchal Dev, Ashwinee Panda, Aryan Shrivastava

机构 * Algoverse AI Research(Algoverse AI研究)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10201 2025-11-14 cs.CL 89%

EffiReason-Bench: A Unified Benchmark for Evaluating and Advancing Efficient Reasoning in Large Language Models

Junquan Huang, Haotian Wu, Yubo Gao, Yibo Yan, Junyan Zhang, Yonghua Hei, Song Dai, Jie Zhang, Puay Siew Tan, Xuming Hu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanyang Technological University(南洋理工大学) The Hong Kong University of Science and Technology(香港科技大学) Singapore Institute of Manufacturing Technology, A*STAR(新加坡制造技术研究所,A*STAR)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments 11 pages, 4 figures, 4 tables. Appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03133 2025-11-13 cs.CL 89%

ReliableMath: Benchmark of Reliable Mathematical Reasoning on Large Language Models

Boyang Xue, Qi Zhu, Rui Wang, Sheng Wang, Hongru Wang, Minda Hu, Fei Mi, Yasheng Wang, Lifeng Shang, Qun Liu, Kam-Fai Wong

机构 * The Chinese University of Hong Kong(香港中文大学) Huawei Noah’s Ark Lab(华为诺亚实验室) The University of Hong Kong(香港大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08392 2025-11-12 cs.CL 89%

PCRLLM: Proof-Carrying Reasoning with Large Language Models under Stepwise Logical Constraints

Tangrui Li, Pei Wang, Hongzheng Wang Christian Hahm, Matteo Spatola, Justin Shi

机构 * Temple University(特拉华大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07396 2025-11-11 cs.LG 89%

C3PO: Optimized Large Language Model Cascades with Probabilistic Cost Constraints for Reasoning

Antonios Valkanas, Soumyasundar Pal, Pavel Rumiantsev, Yingxue Zhang, Mark Coates

机构 * McGill University(麦吉尔大学) Mila - Quebec AI Institute(魁北克AI研究所) Int. Lab. Learning Systems(国际学习系统实验室) Huawei Montréal, Canada(华为蒙特利尔加拿大分公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12059 2025-11-11 cs.CL 89%

Evaluating the Ability of Large Language Models to Reason about Cardinal Directions, Revisited

Anthony G Cohn, Robert E Blackwell

机构 * School of Computer Science, University of Leeds, UK(利兹大学计算机科学学院) Alan Turing Institute, London, UK(艾伦·图灵研究所)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 8 pages, 5 figures. Accepted at QR 2025 : 38th International Workshop on Qualitative Reasoning at IJCAI. arXiv admin note: substantial text overlap with arXiv:2406.16528

详情

展开后加载摘要…

URL PDF HTML 收藏