arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18731 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18731 篇

2509.25346 2026-04-28 cs.AI cs.LG q-bio.CB q-bio.GN 92%

SynthPert: Enhancing LLM Biological Reasoning via Synthetic Reasoning Traces for Cellular Perturbation Prediction

SynthPert: 通过合成推理轨迹增强LLM的生物推理以进行细胞扰动预测

Lawrence Phillips, Marc Boubnovski Martell, Aditya Misra, Josefa Lia Stoisser, Cesar A. Prada-Medina, Rory Donovan-Maiye, Kaspar Märtens

机构 * InverseBio Novo Nordisk

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SynthPert方法,通过合成推理轨迹提升LLM在细胞扰动预测中的性能,展现了合成数据在生物推理中的有效性,并实现了跨细胞类型泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.22760 2026-04-28 cs.IR cs.AI cs.CL 92%

Quantifying Divergence in Inter-LLM Communication Through API Retrieval and Ranking

通过API检索和排序量化跨LLM通信中的分歧

Eyhab Al-Masri

机构 * School of Engineering and Technology(工程与技术学院)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出一个统一的基准框架,量化在相同任务下不同LLM在API发现和排序上的差异。研究发现结构化任务稳定性较高,而开放性任务分歧显著,结果为多代理系统中可靠性感知的协调提供了依据。

Comments AAAI 2026 Conference (LAMAS Workshop)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01188 2026-04-28 cs.CL cs.AI 92%

ZoFia: Zero-Shot Fake News Detection with Entity-Guided Retrieval and Multi-LLM Interaction

ZoFia:基于实体引导检索和多LLM交互的零样本假新闻检测

Lvhua Wu, Xuefeng Jiang, Sheng Sun, Yan Lei, Tian Wen, Yuwei Wang, Min Liu

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出ZoFia框架,通过实体引导检索和多LLM交互解决假新闻检测中的知识截止和事实幻觉问题,实验表明其优于现有零样本基线和多数少样本方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21584 2026-04-24 cs.AI cs.CE cs.LG 92%

CoFEE: Reasoning Control for LLM-Based Feature Discovery

CoFEE:基于LLM的特征发现的推理控制

Maximilian Westermann, Ben Griffin, Aaron Ontoyin Yin, Zakari Salifu, Yagiz Ihlamur, Kelvin Amoaba, Joseph Ternasky, Fuat Alican, Yigit Ihlamur

机构 * University of Oxford(牛津大学) Vela Research(Vela研究) Amazon(亚马逊)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出CoFEE框架,通过引入认知行为提升LLM特征发现的预测性和效率,实验显示其在预测性和成本控制上优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10779 2026-04-21 cs.CL cs.AI 92%

Improving Speech Recognition of Named Entities in Classroom Speech with LLM Revision and Phonetic-Semantic Context

通过LLM修订和音义上下文提高课堂语音中命名实体的语音识别

Viet Anh Trinh, Xinlu He, Jacob Whitehill

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出利用LLM修订和音义上下文提升课堂语音中命名实体的识别准确率,通过MIT课程数据集验证,实现30%的WER降低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15344 2026-04-20 cs.HC cs.AI cs.IR cs.LG 92%

To LLM, or Not to LLM: How Designers and Developers Navigate LLMs as Tools or Teammates

对LLM而言,是使用还是不使用:设计师和开发者如何将LLM视为工具或队友

Varad Vishwarupe, Ivan Flechais, Nigel Shadbolt, Marina Jirotka

机构 * Department of Computer Science, University of Oxford(牛津大学计算机科学系)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究探讨了设计师和开发者在系统设计过程中如何将LLM视为工具或队友,分析了角色框架对决策权、问责制、监督策略和组织接受度的影响。

Comments 6 pages, 2 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08125 2026-04-20 cs.LG cs.CL 92%

Not All Tokens Matter: Towards Efficient LLM Reasoning via Token Significance in Reinforcement Learning

并非所有标记都重要:通过强化学习中的标记重要性实现高效的LLM推理

Hanbing Liu, Lang Cao, Yuanyi Ren, Mengyu Zhou, Haoyu Dong, Xiaojun Ma, Shi Han, Dongmei Zhang

机构 * Tsinghua University(清华大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Peking University(北京大学) Qwen Large Model Application Team, Alibaba(阿里云文大模型应用团队) Microsoft(微软) Shenzhen Key Laboratory of Ubiquitous Data Enabling, Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院 ubiquitous 数据赋能重点实验室)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出通过标记重要性优化强化学习,减少冗余并提升LLM推理效率和准确性,实验显示响应长度显著缩短且正确性保持或提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13759 2026-04-16 cs.AI cs.LG 92%

The cognitive companion: a lightweight parallel monitoring architecture for detecting and recovering from reasoning degradation in LLM agents

认知伙伴:一种轻量级并行监控架构,用于检测和从LLM代理的推理退化中恢复

Rafflesia Khan, Nafiul Islam Khan

机构 * IBM Dublin(IBM都柏林) Citi Polytechnic Institute Khulna(基蒂理工学院库尔纳)

专题命中 推理与问题求解 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出认知伙伴,一种轻量级并行监控架构,用于检测和恢复LLM代理的推理退化。通过实验验证了其在不同任务类型中的有效性,并指出任务类型依赖性和潜在的规模限制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05077 2026-02-26 cs.CL cs.AI 92%

Slm-mux: Orchestrating small language models for reasoning

Slm-mux: 通过协调小型语言模型进行推理

Chenyu Wang, Zishen Wan, Hao Kang, Emma Chen, Zhiqiang Xie, Tushar Krishna, Vijay Janapa Reddi, Yilun Du

机构 * Harvard University(哈佛大学) Georgia Institute of Technology(佐治亚理工学院) Stanford University(斯坦福大学)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);SLM(title,abstract);分类 cs.CL、cs.AI

AI总结 SLM-MUX通过协调多个小型语言模型提升推理准确性,实现比单个模型更高的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13210 2026-02-17 cs.NI cs.AI cs.LG 92%

Large Language Model (LLM)-enabled Reinforcement Learning for Wireless Network Optimization

基于大语言模型的强化学习用于无线网络优化

Jie Zheng, Ruichen Zhang, Dusit Niyato, Haijun Zhang, Jiacheng Wang, Hongyang Du, Jiawen Kang, Zehui Xiong

机构 * State-Province Joint Engineering and Research Center of Advanced Networking and Intelligent Information Services, College of Computer Science, Northwest University(高级网络与智能信息服务省-市联合工程与研究中心,计算机科学学院,西北大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学) Institute of Artificial Intelligence, University of Science and Technology Beijing(人工智能研究院,北京科技大学) Department of Electrical and Electronic Engineering, the University of Hong Kong(电子与电气工程系,香港大学) Automation of School, Guangdong University of Technology(自动化学院,广东工业大学) Queen’s University Belfast(贝尔法斯特女王大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出利用大语言模型增强强化学习,以优化6G无线网络,通过多智能体强化学习框架提升网络性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08108 2026-01-14 cs.CL cs.AI 92%

Debiasing Large Language Models via Adaptive Causal Prompting with Sketch-of-Thought

通过适应性因果提示的草图思维去偏Large Language Models

Bowen Li, Ziqi Xu, Jing Ren, Renqiang Luo, Xikun Zhang, Xiuzhen Zhang, Yongli Ren, Feng Xia

机构 * RMIT University(皇家墨尔本理工大学) Jilin University(吉林大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

AI总结 ACPS通过适应性因果提示与草图思维方法,提升Large Language Models的推理效率与泛化能力。

Comments Accepted by Findings of EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.23888 2025-12-04 cs.CL cs.LG 92%

Advancing Multi-Step Mathematical Reasoning in Large Language Models through Multi-Layered Self-Reflection with Auto-Prompting

通过多层自反思与自动提示推进大语言模型的多步数学推理

André de Souza Loureiro, Jorge Valverde-Rebaza, Julieta Noguez, David Escarcega, Ricardo Marcacini

机构 * Luiz de Queiroz College of Agriculture University of São Paulo(圣保罗大学农业学院) School of Engineering and Sciences Tecnologico de Monterrey(蒙特雷技术学院工程与科学学院) Institute of Mathematics and Computer Sciences University of São Paulo(圣保罗大学数学与计算机科学研究所)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.LG

AI总结 本文提出MAPS框架,通过多层自反思与自动提示提升大语言模型的多步数学推理能力,实验证明其在多个基准测试中优于标准CoT并接近优化模型。

Comments Accepted for publication in: European Conference on Machine Learning and Principles and Practice of Knowledge Discovery in Databases (ECML PKDD 2025). Research Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08146 2025-11-20 cs.CL cs.LG 92%

Bias after Prompting: Persistent Discrimination in Large Language Models

Nivedha Sivakumar, Natalie Mackraz, Samira Khorshidi, Krishna Patel, Barry-John Theobald, Luca Zappella, Nicholas Apostoloff

机构 * Apple(苹果公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15293 2025-10-24 cs.LG cs.AI 92%

LLM-Explorer: A Plug-in Reinforcement Learning Policy Exploration Enhancement Driven by Large Language Models

Qianyue Hao, Yiwen Song, Qingmin Liao, Jian Yuan, Yong Li

机构 * Department of Electronic Engineering, BNRist, Tsinghua University(电子工程系、北京理工大学、清华大学)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11425 2025-06-18 cs.CL cs.AI 92%

Counterfactual-Consistency Prompting for Relative Temporal Understanding in Large Language Models

Jongho Kim, Seung-won Hwang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

Comments ACL 2025 main (short)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15226 2025-06-11 cs.CL cs.AI cs.HC 92%

Understand User Opinions of Large Language Models via LLM-Powered In-the-Moment User Experience Interviews

Mengqiao Liu, Tevin Wang, Cassandra A. Cohen, Sarah Li, Chenyan Xiong

机构 * Amazon(亚马逊公司) School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学学院) University of California, Berkeley(加州大学伯克利分校)

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04135 2025-05-08 cs.CL cs.LG 92%

Enhancing Granular Sentiment Classification with Chain-of-Thought Prompting in Large Language Models

Vihaan Miriyala, Smrithi Bukkapatnam, Lavanya Prahallad

机构 * John F Kennedy High school Fremont, USA(约翰·F·肯尼迪高中弗里蒙特分校) Queensland Academy for Science Mathematics and Technology(昆士兰科学数学与技术学院) Research Spark Hub Inc(Research Spark Hub公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.LG

Comments 5 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.02511 2025-04-10 cs.RO cs.AI cs.CL 92%

LLM-A*: Large Language Model Enhanced Incremental Heuristic Search on Path Planning

Silin Meng, Yiwei Wang, Cheng-Fu Yang, Nanyun Peng, Kai-Wei Chang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Findings of the Association for Computational Linguistics: EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09656 2025-03-14 cs.LG cs.CL 92%

LLM-PS: Empowering Large Language Models for Time Series Forecasting with Temporal Patterns and Semantics

Jialiang Tang, Shuo Chen, Chen Gong, Jing Zhang, Dacheng Tao

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11603 2025-02-18 cs.CL cs.AI 92%

DR.GAP: Mitigating Bias in Large Language Models using Gender-Aware Prompting with Demonstration and Reasoning

Hongye Qiu, Yue Xu, Meikang Qiu, Wenjie Wang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00830 2025-02-05 cs.CL cs.AI 92%

LLM+AL: Bridging Large Language Models and Action Languages for Complex Reasoning about Actions

Adam Ishay, Joohyung Lee

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 42 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08068 2024-10-11 cs.CL cs.AI 92%

Teaching-Inspired Integrated Prompting Framework: A Novel Approach for Enhancing Reasoning in Large Language Models

Wenting Tan, Dongxiao Chen, Jieting Xue, Zihao Wang, Taijie Chen

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.08337 2024-06-13 eess.SY cs.AI cs.LG cs.SY 92%

LLM-Assisted Light: Leveraging Large Language Model Capabilities for Human-Mimetic Traffic Signal Control in Complex Urban Environments

Maonan Wang, Aoyu Pang, Yuheng Kan, Man-On Pun, Chung Shue Chen, Bo Huang

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13872 2024-05-30 cs.AI cs.CL cs.CV 92%

Image-of-Thought Prompting for Visual Reasoning Refinement in Multimodal Large Language Models

Qiji Zhou, Ruochen Zhou, Zike Hu, Panzhong Lu, Siyang Gao, Yue Zhang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

Comments Correct the case title

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06707 2024-05-14 cs.CL cs.AI 92%

Hypothesis Testing Prompting Improves Deductive Reasoning in Large Language Models

Yitian Li, Jidong Tian, Hao He, Yaohui Jin

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.05342 2024-03-22 cs.CL cs.AI 92%

Metacognitive Prompting Improves Understanding in Large Language Models

Yuqing Wang, Yun Zhao

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

Comments NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.12173 2024-03-20 cs.CL cs.AI cs.IR 92%

TnT-LLM: Text Mining at Scale with Large Language Models

Mengting Wan, Tara Safavi, Sujay Kumar Jauhar, Yujin Kim, Scott Counts, Jennifer Neville, Siddharth Suri, Chirag Shah, Ryen W White, Longqi Yang, Reid Andersen, Georg Buscher, Dhruv Joshi, Nagu Rangan

专题命中 推理与问题求解 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 9 pages main content, 8 pages references and appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.11657 2024-03-18 cs.CL cs.AI 92%

Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models

Jiashuo Sun, Yi Luo, Yeyun Gong, Chen Lin, Yelong Shen, Jian Guo, Nan Duan

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

Comments Accepted by NAACL 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.18252 2024-02-29 cs.CL cs.AI 92%

Towards Generalist Prompting for Large Language Models by Mental Models

Haoxiang Guan, Jiyan He, Shuxin Zheng, En-Hong Chen, Weiming Zhang, Nenghai Yu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16132 2024-02-27 cs.CL cs.AI 92%

LSTPrompt: Large Language Models as Zero-Shot Time Series Forecasters by Long-Short-Term Prompting

Haoxin Liu, Zhiyuan Zhao, Jindong Wang, Harshavardhan Kamarthi, B. Aditya Prakash

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

Comments 9 pages, 4 figures, 3 tables, 2 page references, 2 page appendix

详情

展开后加载摘要…

URL PDF HTML 收藏