arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18857 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18857 篇

2506.02918 2025-09-22 cs.AI cs.LG 88%

World Modelling Improves Language Model Agents

Shangmin Guo, Omar Darwiche Domingues, Raphaël Avalos, Aaron Courville, Florian Strub

机构 * University of Edinburgh(爱丁堡大学) Cohere Vrije Universiteit Brussel(布鲁塞尔自由大学) Université de Montréal(蒙特利尔大学)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.13237 2025-09-17 cs.LG cs.AI 88%

Metacognitive Reuse: Turning Recurring LLM Reasoning Into Concise Behaviors

Aniket Didolkar, Nicolas Ballas, Sanjeev Arora, Anirudh Goyal

机构 * Meta Mila-Quebec AI Institute, University of Montreal(魁北克AI研究所,蒙特利尔大学) Princeton University(普林斯顿大学) Mila--Quebec AI Institute, Université de Montréal(魁北克AI研究所,蒙特利尔大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments 18 pages, 9 Figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15868 2025-09-09 cs.CL cs.AI 88%

CARFT: Boosting LLM Reasoning via Contrastive Learning with Annotated Chain-of-Thought-based Reinforced Fine-Tuning

Wenqiao Zhu, Ji Liu, Rongjuncheng Zhang, Haipang Wu, Yulun Zhang

机构 * HiThink Research(HiThink研究院) Shanghai Jiao Tong University(上海交通大学)

专题命中 推理与问题求解 :LLM(title);large language model(abstract);language model(abstract);foundation model(abstract)

Comments 14 pages, to appear in EMNLP25

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15310 2025-08-22 cs.CR cs.AI cs.CL 88%

IPIGuard: A Novel Tool Dependency Graph-Based Defense Against Indirect Prompt Injection in LLM Agents

Hengyu An, Jinghuai Zhang, Tianyu Du, Chunyi Zhou, Qingming Li, Tao Lin, Shouling Ji

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12604 2025-08-19 cs.LG cs.AI 88%

SSPO: Self-traced Step-wise Preference Optimization for Process Supervision and Reasoning Compression

Yuyang Xu, Yi Cheng, Haochao Ying, Zhuoyun Du, Renjun Hu, Xing Shi, Wei Lin, Jian Wu

专题命中 推理与问题求解 :preference optimization(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08653 2025-08-13 cs.CL cs.AI 88%

LLM driven Text-to-Table Generation through Sub-Tasks Guidance and Iterative Refinement

Rajmohan C, Sarthak Harne, Arvind Agarwal

机构 * IBM Research(IBM研究院) IIIT-Bangalore(班加罗尔印度理工学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07106 2025-08-01 cs.CL cs.AI 88%

Theorem-of-Thought: A Multi-Agent Framework for Abductive, Deductive, and Inductive Reasoning in Language Models

Samir Abdaljalil, Hasan Kurban, Khalid Qaraqe, Erchin Serpedin

机构 * Texas A&M University(德克萨斯大学) Hamad Bin Khalifa University(哈马德·本·卡伊夫大学)

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments ACL 2025 KnowFM

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17944 2025-07-25 cs.CL cs.AI 88%

Evaluating the Performance of AI Text Detectors, Few-Shot and Chain-of-Thought Prompting Using DeepSeek Generated Text

Hulayyil Alshammari, Praveen Rao

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03051 2025-07-08 cs.CR cs.AI cs.CL 88%

Improving LLM Reasoning for Vulnerability Detection via Group Relative Policy Optimization

Marco Simoni, Aleksandar Fontana, Giulio Rossolini, Andrea Saracino

机构 * Institute of Informatics and Telematics, National Research Council of Italy(意大利国家研究理事会信息与电信研究所) Department of Excellence in Robotics and AI, TeCIP, Scuola Superiore Sant'Anna(卓越机器人与人工智能系,TeCIP,圣安娜高等学院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02508 2025-06-17 cs.CL cs.AI 88%

Satori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive Search

Maohao Shen, Guangtao Zeng, Zhenting Qi, Zhang-Wei Hong, Zhenfang Chen, Wei Lu, Gregory Wornell, Subhro Das, David Cox, Chuang Gan

机构 * MIT(麻省理工学院) Singapore University of Technology(新加坡科技设计大学) MIT-IBM Watson AI Lab, IBM Research(麻省理工-IBM沃森人工智能实验室,IBM研究院)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10627 2025-06-13 cs.CL cs.AI 88%

NeuralNexus at BEA 2025 Shared Task: Retrieval-Augmented Prompting for Mistake Identification in AI Tutors

Numaan Naeem, Sarfraz Ahmad, Momina Ahsan, Hasan Iqbal

机构 * MBZUAI(穆萨大学人工智能研究所)

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 6 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22942 2025-06-10 cs.CL cs.AI 88%

WorkForceAgent-R1: Incentivizing Reasoning Capability in LLM-based Web Agents via Reinforcement Learning

Yuchen Zhuang, Di Jin, Jiaao Chen, Wenqi Shi, Hanrui Wang, Chao Zhang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Work in Progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04920 2025-06-06 cs.CL cs.AI 88%

Simulating LLM-to-LLM Tutoring for Multilingual Math Feedback

Junior Cedric Tonga, KV Aditya Srivatsa, Kaushal Kumar Maurya, Fajri Koto, Ekaterina Kochmar

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫莫德·本·泽德人工智能大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Preprint, in submission

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01475 2025-06-03 cs.AI cs.CL 88%

PGPO: Enhancing Agent Reasoning via Pseudocode-style Planning Guided Preference Optimization

Zouying Cao, Runze Wang, Yifei Yang, Xinbei Ma, Xiaoyong Zhu, Bo Zheng, Hai Zhao

专题命中 推理与问题求解 :preference optimization(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments 20 pages, 12 figures, 14 tables, ACL'25 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17952 2025-05-26 cs.CL cs.AI 88%

Beyond Distillation: Pushing the Limits of Medical LLM Reasoning with Minimalist Rule-Based RL

Che Liu, Haozhe Wang, Jiazhen Pan, Zhongwei Wan, Yong Dai, Fangzhen Lin, Wenjia Bai, Daniel Rueckert, Rossella Arcucci

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14038 2025-05-21 cs.AI cs.CL 88%

ProMind-LLM: Proactive Mental Health Care via Causal Reasoning with Sensor Data

Xinzhe Zheng, Sijie Ji, Jiawei Sun, Renqi Chen, Wei Gao, Mani Srivastava

机构 * California Institute of Technology(加州理工学院) UCLA(加州大学洛杉矶分校) National University of Singapore(新加坡国立大学) Hangzhou Dianzi University(杭州电子科技大学) Fudan University(复旦大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10260 2025-05-16 cs.CL cs.AI 88%

Comparing LLM Text Annotation Skills: A Study on Human Rights Violations in Social Media Data

Poli Apollinaire Nemkova, Solomon Ubani, Mark V. Albert

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01262 2025-03-18 cs.CL cs.AI cs.HC 88%

Exploring ReAct Prompting for Task-Oriented Dialogue: Insights and Shortcomings

Michelle Elizabeth, Morgan Veyret, Miguel Couceiro, Ondrej Dusek, Lina M. Rojas-Barahona

专题命中 推理与问题求解 :prompting(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.05618 2025-03-17 cs.CL cs.AI 88%

The Benefits of a Concise Chain of Thought on Problem-Solving in Large Language Models

Matthew Renze, Erhan Guven

专题命中 推理与问题求解 :large language model(title,journal_ref);language model(title,journal_ref);prompting(abstract);分类 cs.CL、cs.AI

Journal ref 2nd International Conference on Foundation and Large Language Models (FLLM 2024), pp.476-483

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09542 2025-03-03 cs.CL cs.AI 88%

MIRAGE: Evaluating and Explaining Inductive Reasoning Process in Language Models

Jiachun Li, Pengfei Cao, Zhuoran Jin, Yubo Chen, Kang Liu, Jun Zhao

专题命中 推理与问题求解 :language model(title,abstract);LLM(abstract);large language model(abstract);prompting(abstract)

Comments Accepted as ICLR 2025 conference paper (26 pages, 16 tables, 9 figures)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14922 2025-02-24 cs.CL cs.AI 88%

SIFT: Grounding LLM Reasoning in Contexts via Stickers

Zihao Zeng, Xuyao Huang, Boxiu Li, Zhijie Deng

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11149 2025-02-20 cs.LG cs.AI 88%

Large Language-Geometry Model: When LLM meets Equivariance

Zongzhao Li, Jiacheng Cen, Bing Su, Wenbing Huang, Tingyang Xu, Yu Rong, Deli Zhao

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10732 2025-02-18 cs.LG cs.AI 88%

Rule-Bottleneck Reinforcement Learning: Joint Explanation and Decision Optimization for Resource Allocation with Language Agents

Mauricio Tec, Guojun Xiong, Haichuan Wang, Francesca Dominici, Milind Tambe

专题命中 推理与问题求解 :language agent(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02152 2025-01-07 cs.AI cs.CL 88%

Table as Thought: Exploring Structured Thoughts in LLM Reasoning

Zhenjie Sun, Naihao Deng, Haofei Yu, Jiaxuan You

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15242 2024-12-23 cs.CL cs.AI 88%

Script-Based Dialog Policy Planning for LLM-Powered Conversational Agents: A Basic Architecture for an "AI Therapist"

Robert Wasenmüller, Kevin Hilbert, Christoph Benzmüller

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments 9 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.14484 2024-11-25 cs.CL cs.AI 88%

Robust Planning with Compound LLM Architectures: An LLM-Modulo Approach

Atharva Gundawar, Karthik Valmeekam, Mudit Verma, Subbarao Kambhampati

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.10541 2024-11-19 cs.CL cs.LG 88%

Does Prompt Formatting Have Any Impact on LLM Performance?

Jia He, Mukund Rungta, David Koleczek, Arshdeep Sekhon, Franklin X Wang, Sadid Hasan

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Submitted to NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.16247 2024-11-12 cs.AI cs.CL 88%

AutoManual: Constructing Instruction Manuals by LLM Agents via Interactive Environmental Learning

Minghao Chen, Yihang Li, Yanting Yang, Shiyu Yu, Binbin Lin, Xiaofei He

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11200 2024-11-01 cs.LG cs.CL 88%

AvaTaR: Optimizing LLM Agents for Tool Usage via Contrastive Reasoning

Shirley Wu, Shiyu Zhao, Qian Huang, Kexin Huang, Michihiro Yasunaga, Kaidi Cao, Vassilis N. Ioannidis, Karthik Subbian, Jure Leskovec, James Zou

专题命中 推理与问题求解 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

Comments NeurIPS 2024 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09136 2024-11-01 cs.CL cs.LG 88%

Chain of Preference Optimization: Improving Chain-of-Thought Reasoning in LLMs

Xuan Zhang, Chao Du, Tianyu Pang, Qian Liu, Wei Gao, Min Lin

专题命中 推理与问题求解 :preference optimization(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏