arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18837 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18837 篇

2601.19673 2026-01-28 cs.SD cs.AI 88%

A Benchmark for Audio Reasoning Capabilities of Multimodal Large Language Models

多模态大语言模型音频推理能力的基准测试

Iwona Christop, Mateusz Czyżnikiewicz, Paweł Skórzewski, Łukasz Bondaruk, Jakub Kubiak, Marcin Lewandowski, Marek Kubis

机构 * Adam Mickiewicz University(亚当·密克维茨大学) Samsung R&D Institute Poland(三星波兰研发中心)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本文提出Audio Reasoning Tasks基准测试,用于评估多模态模型在结合不同音频任务进行推理方面的能力。

Comments 31 pages, 2 figures, accepted to EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.13547 2026-01-28 cs.CL 88%

ThinkNote: Enhancing Knowledge Integration and Utilization of Large Language Models via Constructivist Cognition Modeling

ThinkNote: 通过建构主义认知建模增强大型语言模型的知识整合与利用

Zhipeng Xu, Zhenghao Liu, Yukun Yan, Shuo Wang, Shi Yu, Zheni Zeng, Chaojun Xiao, Zhiyuan Liu, Ge Yu, Chenyan Xiong

机构 * School of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Language Technologies Institute, Carnegie Mellon University(卡内基梅隆大学语言技术研究所)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 ThinkNote通过建构主义认知建模提升大型语言模型的知识整合与利用能力,实验表明其在问答任务中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14313 2026-01-27 cs.CL 88%

Teaching Small Language Models to Learn Logic through Meta-Learning

通过元学习让小型语言模型学习逻辑

Leonardo Bertolazzi, Manuel Vargas Guzmán, Raffaella Bernardi, Maciej Malicki, Jakub Szymanik

机构 * University of Trento(特伦托大学) University of Warsaw(华沙大学) Free University of Bozen-Bolzano(博兹纳-博尔扎诺自由大学)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title);large language model(abstract);分类 cs.CL

AI总结 本文通过元学习方法提升小型语言模型在三段论推理任务中的逻辑推理能力,实验表明其在低数据环境下表现优于GPT-4o和o3-mini。

Comments EACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17426 2026-01-27 cs.AI cs.LO 88%

A Syllogistic Probe: Tracing the Evolution of Logic Reasoning in Large Language Models

直言探针:追踪大型语言模型中逻辑推理的演变

Zhengqing Zang, Yuqi Ding, Yanmei Gu, Changkai Song, Zhengkai Yang, Guoping Du, Junbo Zhao, Haobo Wang

机构 * Zhejiang University(浙江大学) University of Chinese Academy of Social Sciences(中国社会科学院大学) Ant Group(蚂蚁集团) Chinese Academy of Social Sciences(中国社会科学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究通过三段论测试揭示大型语言模型在逻辑推理演变中的特性,发现模型规模、思考机制和基础模型对逻辑发展有重要影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.14290 2026-01-22 cs.CL 88%

Project Aletheia: Verifier-Guided Distillation of Backtracking for Small Language Models

项目Aletheia:指导验证的回溯蒸馏

Aradhya Dixit, Tianxi Liang, Jai Telang

机构 * Wake Technical Community College(韦克技术社区学院) Cornell University(康奈尔大学) Algoverse

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);分类 cs.CL

AI总结 项目Aletheia通过指导验证的蒸馏方法,使小型语言模型能够通过回溯和冲突检测提升其在约束满足问题上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01562 2026-01-21 cs.AI 88%

Logics-STEM: Empowering LLM Reasoning via Failure-Driven Post-Training and Document Knowledge Enhancement

Logics-STEM: 通过故障驱动的微调和文档知识增强赋能大语言模型推理

Mingyu Xu, Cheng Fang, Keyue Jiang, Yuqian Zheng, Yanghua Xiao, Baojian Zhou, Qifang Zhao, Suhang Zheng, Xiuwen Zhu, Jiyang Tang, Yongchi Zhao, Yijia Luo, Zhiqi Bai, Yuchi Xu, Wenbo Su, Wei Wang, Bing Zhao, Lin Qu, Xiaoxiao Xu

机构 * Alibaba Group(阿里巴巴集团) Shanghai Key Laboratory of Data Science, Fudan University(上海数据科学国家重点实验室,复旦大学) College of Computer Science and Artificial Intelligence, Fudan University(复旦大学计算机科学与人工智能学院) School of Data Science, Fudan University(复旦大学数据科学学院)

专题命中 推理与问题求解 :post-training(title,abstract);LLM(title);SFT(abstract);分类 cs.AI

AI总结 Logics-STEM通过故障驱动微调和文档知识增强,提升大语言模型在STEM领域的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12995 2026-01-21 cs.CL 88%

Graph Reasoning Paradigm: Structured and Symbolic Reasoning with Topology-Aware Reinforcement Learning for Large Language Models

图推理范式:基于拓扑感知强化学习的结构化和符号推理用于大语言模型

Runxuan Liu, Xianhao Ou, Xinyan Ma, Jiyuan Wang, Jiafeng Liang, Jiaqi Li, Tao He, Zheng Chu, Rongchuan Mu, Zekun Wang, Baoxin Wang, Dayong Wu, Ming Liu, Shijin Wang, Guoping Hu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) Tianjin Normal University(天津师范大学) Pengcheng Laboratory(鹏城实验室)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 图推理范式通过拓扑感知强化学习实现结构化和符号推理,提升大语言模型的数学推理和代码生成能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.01652 2026-01-21 cs.CL 88%

MIRAGE: Exploring How Large Language Models Perform in Complex Social Interactive Environments

MIRAGE:探索大型语言模型在复杂社会互动环境中的表现

Yin Cai, Zhouhong Gu, Zhaohan Du, Zheyu Ye, Shaosheng Cao, Yiqian Xu, Hongwei Feng, Ping Chen

机构 * Institute of Big Data, Fudan University(复旦大学大数据研究院) Shanghai Key Laboratory of Data Science, School of Computer Science, Fudan University(复旦大学计算机学院) School of Computer Science, Fudan University(复旦大学计算机学院) Xiaohongshu Inc.(小红书公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 MIRAGE通过谋杀谜案游戏评估LLMs在复杂社会互动环境中的表现,揭示其在信任、线索调查、互动和指令遵循方面的挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10148 2026-01-16 cs.AI 88%

DecisionLLM: Large Language Models for Long Sequence Decision Exploration

DecisionLLM: 用于长序列决策探索的大型语言模型

Xiaowei Lv, Zhilin Zhang, Yijun Li, Yusen Huo, Siyuan Ju, Xuyan Li, Chunxiang Hong, Tianyu Wang, Yongcai Wang, Peng Sun, Chuan Yu, Jian Xu, Bo Zheng

机构 * Renmin University of China, Beijing China(中国人民大学) Alibaba Group, Beijing, China(阿里巴巴集团)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 DecisionLLM基于Transformer架构,通过将轨迹视为独立模态,解决LLMs在连续值解释上的不足,实现长序列决策任务的高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19126 2026-01-16 cs.CL 88%

AWPO: Enhancing Tool-Use of Large Language Models through Adaptive Integration of Reasoning Rewards

AWPO: 通过适应性整合推理奖励增强大语言模型的工具使用

Zihan Lin, Xiaohan Wang, Hexiong Yang, Jiajun Chai, Jie Cao, Guojun Yin, Wei Lin, Ran He

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 AWPO通过适应性整合推理奖励提升大语言模型的工具使用性能,实现多轮场景中的卓越表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09260 2026-01-15 cs.AI 88%

Efficient Paths and Dense Rewards: Probabilistic Flow Reasoning for Large Language Models

高效路径与密集奖励:用于大语言模型的概率流推理

Yan Liu, Feng Zhang, Zhanyu Ma, Jun Xu, Jiuchong Gao, Jinghua Hao, Renqing He, Han Liu, Yangdong Deng

机构 * Meituan(美团) Tsinghua University(清华大学) Peking University(北京大学) Dalian University of Technology(大连理工大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 CoT-Flow通过概率流框架提升大语言模型的推理效率与性能,采用流引导解码和流强化学习方法实现信息高效推理路径和密集奖励函数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07780 2026-01-13 cs.CL 88%

Enhancing Self-Correction in Large Language Models through Multi-Perspective Reflection

通过多视角反思增强大语言模型的自我纠正能力

Mariana Costa, Alberlucia Rafael Soarez, Daniel Kim, Camila Ferreira

机构 * University of Brasilia(巴西大学)

专题命中 推理与问题求解 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

AI总结 PR-CoT通过多视角反思提升大语言模型的自我纠正能力,有效增强推理的逻辑一致性和准确性,尤其在伦理决策等复杂领域表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07180 2026-01-13 cs.CL 88%

Structured Reasoning for Large Language Models

为大型语言模型引入结构化推理

Jinyi Han, Zixiang Di, Zishang Jiang, Ying Liao, Jiaqing Liang, Yongqi Wang, Yanghua Xiao

机构 * East China Normal University(华东师范大学) Fudan University(复旦大学) Beijing Institute of Technology(北京理工大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出结构化推理框架SCR,通过生成-验证-修改范式提升LLM的推理效率和自我验证能力,减少输出标记长度达50%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06848 2026-01-13 cs.CL 88%

Explainable Multimodal Aspect-Based Sentiment Analysis with Dependency-guided Large Language Model

可解释的多模态基于方面的情感分析与依赖引导的大语言模型

Zhongzheng Wang, Yuanhe Tian, Hongzhi Wang, Yan Song

机构 * Harbin Institute of Technology(哈尔滨工程大学) Zhongguancun Academy(中关村学院) Zhongguancun Institute of Artificial Intelligence(中关村人工智能研究院) University of Science and Technology of China(中国科学技术大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出了一种基于依赖引导的大语言模型的多模态情感分析方法,通过生成可解释的自然语言解释来提升情感分类的准确性。

Comments 9 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06707 2026-01-13 cs.CL 88%

Evaluating Accounting Reasoning Capabilities of Large Language Models

评估大型语言模型的会计推理能力

Jie Zhou, Xin Chen, Jie Zhang, Hai Li, Jie Wang, Zhe Li

机构 * School of Computer Engineering, Jiangsu Ocean University(计算机工程学院,江苏海洋大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文评估了大型语言模型在会计推理任务中的能力,通过定义垂直领域会计推理标准,分析了GLM和GPT-4等模型的表现,发现提示设计对性能影响显著,但现有模型仍需优化以满足实际需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05009 2026-01-09 cs.AI 88%

An Empirical Investigation of Robustness in Large Language Models under Tabular Distortions

对大型语言模型在表格扭曲下的鲁棒性进行实证研究

Avik Dutta, Harshit Nigam, Hosein Hasanbeig, Arjun Radhakrishna, Sumit Gulwani

机构 * Microsoft Corp.(微软公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究探讨了大型语言模型在表格数据扭曲下的鲁棒性问题,发现模型在缺乏显式提示时难以自动纠正表格错误,且顶级模型在扭曲下准确率显著下降。

Comments 4 pages, 1 figure, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04777 2026-01-09 cs.CV cs.AI 88%

GeM-VG: Towards Generalized Multi-image Visual Grounding with Multimodal Large Language Models

GeM-VG:迈向通用多图像视觉 grounding 的多模态大语言模型

Shurong Zheng, Yousong Zhu, Hongyin Zhao, Fan Yang, Yufei Zhan, Ming Tang, Jinqiao Wang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 GeM-VG通过引入MG-Data-240K数据集和混合强化微调策略,提升多图像视觉 grounding 和通用多图像理解能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04458 2026-01-09 cs.LG 88%

Using Large Language Models to Detect Socially Shared Regulation of Collaborative Learning

利用大语言模型检测协作学习中的社会共享调节

Jiayi Zhang, Conrad Borchers, Clayton Cohn, Namrata Srivastava, Caitlin Snyder, Siyuan Guo, Ashwin T S, Naveeduddin Mohammed, Haley Noh, Gautam Biswas

机构 * University of Pennsylvania(宾夕法尼亚大学) Carnegie Mellon University(卡内基梅隆大学) Vanderbilt University(范德堡大学) University of Detroit Mercy(底特律默克大学) New York University(纽约大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本文利用大语言模型检测协作学习中的社会共享调节行为,通过嵌入方法提升学习分析的预测能力。

Comments Short research paper accepted at Learning Analytics and Knowledge (LAK '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11529 2026-01-09 cs.CL 88%

Hallucination Detection via Internal States and Structured Reasoning Consistency in Large Language Models

通过内部状态和结构化推理一致性检测大语言模型中的幻觉

Yusheng Song, Lirong Qiu, Xi Zhang, Zhihao Tang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 通过内部状态和结构化推理一致性检测大语言模型中的幻觉,提出统一框架解决检测困境,提升事实和逻辑任务的检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19640 2026-01-08 cs.CL 88%

Interleaved Reasoning for Large Language Models via Reinforcement Learning

通过强化学习实现大型语言模型的交错推理

Roy Xie, David Qiu, Deepak Gopinath, Dong Lin, Yanchao Sun, Chong Wang, Saloni Potdar, Bhuwan Dhingra

机构 * Apple(苹果公司) Duke University(杜克大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 通过强化学习实现大型语言模型的交错推理,提升推理效率和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02968 2026-01-07 cs.AI 88%

Rationale-Grounded In-Context Learning for Time Series Reasoning with Multimodal Large Language Models

基于理由的上下文学习用于多模态大语言模型的时间序列推理

Qingxiang Liu, Zhiqing Cui, Xiaoliang Luo, Yuqian Wu, Zhuoyang Jiang, Huaiyu Wan, Sheng Sun, Lvchun Wang, Wei Yu, Yuxuan Liang

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) China Mobile (Jiangxi) Virtual Reality Technology Co., Ltd.(中国移动(江西)虚拟现实技术有限公司) School of Computer and Information Technology, Beijing Jiaotong University(北京交通大学计算机与信息学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究提出RationaleTS方法,通过基于理由的上下文学习提升多模态大语言模型在时间序列推理中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02739 2026-01-07 cs.CL 88%

Mitigating Prompt-Induced Hallucinations in Large Language Models via Structured Reasoning

通过结构化推理缓解大型语言模型中的提示诱导幻觉

Jinbo Hao, Kai Yang, Qingzhen Su, Yang Chen, Yifan Li, Chao Jiang

机构 * School of Computer Engineering, Jiangsu Ocean University(江苏海洋大学计算机工程学院) School of Computer Science and Technology, Soochow University(苏州大学计算机科学与技术学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文通过引入代码模块和结构化推理方法,有效缓解了大型语言模型中的提示诱导幻觉问题,提升了模型的准确性和可验证性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01544 2026-01-06 cs.AI 88%

Causal Consistency Regularization: Training Verifiably Sensitive Reasoning in Large Language Models

因果一致性正则化:在大型语言模型中训练可验证的敏感推理

Sanjeda Akter, Ibne Farabi Shihab, Anuj Sharma

机构 * Department of Computer Science, Iowa State University(计算机科学系,爱荷华州立大学) Department of Civil, Construction & Environmental Engineering, Iowa State University(土木、建筑与环境工程系,爱荷华州立大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 CSR通过强制因果一致性提升大语言模型的推理忠实性,实现更可靠的结构化领域推理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.01407 2026-01-06 cs.CL 88%

From Emotion Classification to Emotional Reasoning: Enhancing Emotional Intelligence in Large Language Models

从情绪分类到情绪推理:提升大语言模型情感智能

Arjhun Sreedar, Rohan Pillay, Laukik Patade

机构 * University of Massachusetts Amherst(马萨诸塞大学阿默斯特分校)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文通过合成情绪链式思维数据提升大语言模型的情感推理能力,实验表明微调后模型在情绪理解与意识评估上显著提升。

Comments 10 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23356 2025-12-30 cs.CL 88%

A Stepwise-Enhanced Reasoning Framework for Large Language Models Based on External Subgraph Generation

基于外部子图生成的大型语言模型逐步增强推理框架

Xin Zhang, Yang Cao, Baoxing Wu, Xinyi Chen, Kai Song, Siying Li

机构 * School of Information Science and Engineering, Chongqing Jiaotong University(重庆交通大学信息科学与工程学院) School of Computer Science and Technology, Chongqing University of Posts and Telecommunications(重庆邮电大学计算机科学与技术学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 SGR通过外部子图生成提升LLM的推理能力,通过多步骤推理和整合路径生成最终答案,实验表明其优于现有基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19466 2025-12-30 cs.CV cs.LG 88%

ForgerySleuth: Empowering Multimodal Large Language Models for Image Manipulation Detection

ForgerySleuth: 赋能多模态大语言模型进行图像篡改检测

Zhihao Sun, Haoran Jiang, Haoran Chen, Yixin Cao, Xipeng Qiu, Zuxuan Wu, Yu-Gang Jiang

机构 * Shanghai Key Lab of Intell. Info. Processing, School of CS, Fudan University(上海智能信息处理关键实验室,复旦大学计算机学院) Shanghai Collaborative Innovation Center of Intelligent Visual Computing(上海智能视觉计算协同创新中心)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 ForgerySleuth通过多模态大语言模型进行图像篡改检测,利用线索融合和数据集构建提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18033 2025-12-29 cs.RO cs.AI 88%

OpenNav: Open-World Navigation with Multimodal Large Language Models

OpenNav: 基于多模态大语言模型的开放世界导航

Mingfeng Yuan, Letian Wang, Steven L. Waslander

机构 * University of Toronto Institute for Aerospace Studies(多伦多大学航空航天研究 institute) University of Toronto Robotics Institute(多伦多大学机器人研究所)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 OpenNav利用多模态大语言模型实现开放世界导航,通过生成价值图增强机器人空间理解,并在真实场景中验证其鲁棒性。

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21238 2025-12-25 cs.SE cs.CR cs.LG 88%

Assessing the Software Security Comprehension of Large Language Models

评估大语言模型的软件安全理解能力

Mohammed Latif Siddiq, Natalie Sekerak, Antonio Karam, Maria Leal, Arvin Islam-Gomes, Joanna C. S. Santos

机构 * University of Notre Dame(诺丁汉大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.LG

AI总结 本研究评估了五种大语言模型在软件安全方面的认知能力,发现其在低阶任务表现良好,但在高阶任务如推理和系统设计上存在显著不足,并识别出51种常见误解模式。

Comments Submitted to Empirical Software Engineering (EMSE) journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15210 2025-12-23 cs.CL cs.IR 88%

Deliberation on Priors: Trustworthy Reasoning of Large Language Models on Knowledge Graphs

对先验的探讨:大型语言模型在知识图谱上的可信推理

Jie Ma, Ning Qu, Zhitao Gao, Rui Xing, Jun Liu, Hongbin Pei, Jiang Xie, Linyun Song, Pinghui Wang, Jing Tao, Zhou Su

机构 * MOE KLINNS Lab, Xi’an Jiaotong University(MOE KLINNS实验室,西安交通大学) School of Computer Science and Technology, Xi’an Jiaotong University(计算机科学与技术学院,西安交通大学) Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室) School of Artificial Intelligence, Chongqing University of Post and Telecommunications(人工智能学院,重庆邮电大学) School of Computer Science, Northwestern Polytechnical University(计算机学院,西北工业大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究提出DP框架,通过整合知识图谱的结构和约束先验,提升大型语言模型在知识图谱上的推理准确性和响应可靠性。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11792 2025-12-23 cs.AI 88%

Solver-Informed RL: Grounding Large Language Models for Authentic Optimization Modeling

Solver-Informed RL: 为真实优化建模奠定大语言模型基础

Yitian Chen, Jingfan Xia, Siyu Shao, Dongdong Ge, Yinyu Ye

机构 * Cardinal Operations, China(中国卡迪纳尔运营公司) Shanghai University of Finance and Economics(上海财经大学) The University of Hong Kong(香港大学) Antai School of Economics and Management, Shanghai Jiao Tong University(上海交通大学安泰经济管理学院) Department of Management Science and Engineering, Stanford University(斯坦福大学管理科学与工程系)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 SIRL通过强化学习与外部优化求解器结合,提升大语言模型在优化建模中的准确性与实用性。

Journal ref 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏