arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 18810 信号源:cs.CL, cs.AI, cs.LG

1. 推理与问题求解 18810 篇

2602.20722 2026-03-17 cs.AI 89%

Buffer Matters: Unleashing the Power of Off-Policy Reinforcement Learning in Large Language Model Reasoning

缓冲区很重要:在大语言模型推理中释放离策略强化学习的潜力

Xu Wan, Yansheng Wang, Wenqi Huang, Mingyang Sun

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI

AI总结 本文提出BAPO框架,通过动态选择训练批次和保证策略改进下限,提升大语言模型训练效率,实验显示在数学、规划和视觉推理任务中平均提升12.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10313 2026-03-12 cs.CL 89%

Large language models can disambiguate opioid slang on social media

大语言模型可以区分社交媒体上的阿片类药物俚语

Kristy A. Carpenter, Issah A. Samori, Mathew V. Kiang, Keith Humphreys, Anna Lembke, Johannes C. Eichstaedt, Russ B. Altman

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 大语言模型能有效区分社交媒体上的阿片类药物俚语,提升低发病率主题的数据分析能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.07997 2026-03-12 cs.CL 89%

BiasCause: Evaluate Socially Biased Causal Reasoning of Large Language Models

BiasCause: 评估大型语言模型的社会偏见因果推理

Tian Xie, Tongxin Yin, Vaishakh Keshava, Xueru Zhang, Siddhartha Reddy Jonnalagadda

机构 * Google(谷歌) The Ohio State University(俄亥俄州立大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出BiasCause框架,评估LLMs在回答社会偏见问题时的因果推理,揭示其偏见产生机制及去偏策略。

Comments This work has been done when the first author is at Google. The first author is a student at the Ohio State University

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06416 2026-03-09 cs.CL 89%

Evaluation of Deontic Conditional Reasoning in Large Language Models: The Case of Wason's Selection Task

对大型语言模型中规范条件推理能力的评估:瓦森选择任务案例

Hirohiko Abe, Kentaro Ozeki, Risako Ando, Takanobu Morishita, Koji Mineshima, Mitsuhiro Okada

机构 * Keio University(Keio大学) University of Tokyo(东京大学) abelard.flet.keio.ac.jp(Keio大学abelard.flet实验室)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本研究通过瓦森选择任务评估大型语言模型在规范规则下的条件推理能力,发现其表现与人类相似,存在匹配偏误等认知偏差。

Comments To appear in the Proceedings of EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06222 2026-03-09 cs.CL 89%

SPOT: Span-level Pause-of-Thought for Efficient and Interpretable Latent Reasoning in Large Language Models

SPOT:基于跨度的思考暂停,用于大语言模型中高效且可解释的潜在推理

Yunlong Chu, Minglai Shao, Yuhang Liu, Bing Hao, Yumeng Lin, Jialu Wang, Ruijie Wang

机构 * School of New Media and Communication, Tianjin University(新媒体与传播学院,天津大学) School of Computer Science and Engineering, Beihang University(计算机科学与工程学院,北航大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

AI总结 SPOT通过压缩显式推理步骤为紧凑的潜在暂停token,提升大语言模型的推理效率和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10534 2026-03-06 cs.AI 89%

Achieving Olympia-Level Geometry Large Language Model Agent via Complexity Boosting Reinforcement Learning

通过复杂度提升强化学习实现奥lympia级几何大语言模型代理

Haiteng Zhao, Junhao Shen, Yiming Zhang, Songyang Gao, Kuikun Liu, Tianyou Ma, Fan Zheng, Dahua Lin, Wenwei Zhang, Kai Chen

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) ICMAT Spanish National Research Council(西班牙国家研究委员会ICMAT) The Chinese University of Hong Kong(香港中文大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 InternGeometry通过复杂度提升强化学习实现几何问题求解,仅用13K训练示例解决44个IMO问题,超越平均金牌得主得分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02939 2026-03-04 cs.AI 89%

ShipTraj-R1: Reinforcing Ship Trajectory Prediction in Large Language Models via Group Relative Policy Optimization

ShipTraj-R1: 通过群体相对策略优化在大型语言模型中强化船舶轨迹预测

Yang Zhan, Yunhao Li, Zhang Chao, Yuxu Lu, Yan Li

机构 * School of Artificial Intelligence, Optics, and Electronics (iOPEN)(人工智能、光学与电子学院) Northwestern Polytechnical University(西北工业大学) Department of Logistics and Maritime Studies(物流与海洋研究系) The Hong Kong Polytechnic University(香港理工大学) State Key Laboratory of Information Engineering in Surveying, Mapping and Remote Sensing(测绘遥感信息工程国家重点实验室) Wuhan University(武汉大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 ShipTraj-R1通过群体相对策略优化在大型语言模型中强化船舶轨迹预测,利用动态提示和规则奖励机制提升预测准确性。

Comments Accepted by the 30th Pacific-Asia Conference on Knowledge Discovery and Data Mining (PAKDD2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14899 2026-03-04 cs.RO cs.CL 89%

REFLEX: Metacognitive Reasoning for Reflective Zero-Shot Robotic Planning with Large Language Models

REFLEX:基于大语言模型的反思零样本机器人规划的元认知推理

Wenjie Lin, Jin Wei-Kocsis, Jiansong Zhang, Byung-Cheol Min, Dongming Gan, Paul Asunda, Ragu Athinarayanan

机构 * School of Applied and Creative Computing, Purdue University(应用与创意计算学院,普渡大学) Bowen School of Construction, Purdue University(建设学院,普渡大学) School of Engineering Technology, Purdue University(工程技术学院,普渡大学) Department of Technology Leadership and Innovation, Purdue University(技术领导与创新部门,普渡大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 REFLEX通过引入元认知学习,提升大语言模型在机器人任务中的推理、反思与创造力,实现零样本下的高效规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21082 2026-03-03 cs.CL 89%

RPM: Reasoning-Level Personalization for Black-Box Large Language Models

RPM:面向黑盒大语言模型的推理层面个性化

Jieyong Kim, Tongyoung Kim, Soojin Yoon, Jaehyung Kim, Dongha Lee

机构 * Department of Artificial Intelligence, Yonsei University(人工智能系,延世大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 RPM通过构建用户行为结构模型,实现黑盒大语言模型的推理层面个性化,提升个性化性能与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23668 2026-03-02 cs.AI cs.SY eess.SY 89%

PseudoAct: Leveraging Pseudocode Synthesis for Flexible Planning and Action Control in Large Language Model Agents

PseudoAct: 通过伪代码合成实现大型语言模型代理的灵活规划与动作控制

Yihan, Wen, Xin Chen

机构 * Department of Electrical and Computer Engineering, Texas A&M University(电气与计算机工程系,德克萨斯A&M大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 PseudoAct通过伪代码合成实现LLM代理的灵活规划与动作控制,提升长时决策效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21786 2026-02-26 cs.CL 89%

D-COT: Disciplined Chain-of-Thought Learning for Efficient Reasoning in Small Language Models

D-COT:为小语言模型高效推理的纪律性推理学习

Shunsuke Ubukata

机构 * Shunsuke Ubukata(独立研究者)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 D-CoT通过引入控制标签强制结构化推理,提升小语言模型在推理任务中的性能并减少计算成本。

Comments 9 pages, 3 figures. Code: https://github.com/gitpullpull/DisciplinedChainOfThought | Benchmarks: https://huggingface.co/datasets/gitpullpull/D-CoT-Benchmarks | Dataset: https://huggingface.co/datasets/gitpullpull/D-CoT-datasets

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21533 2026-02-26 cond-mat.mtrl-sci cs.LG 89%

Reasoning-Driven Design of Single Atom Catalysts via a Multi-Agent Large Language Model Framework

通过多智能体大语言模型框架进行基于推理的单原子催化剂设计

Dong Hyeon Mok, Seoin Back, Victor Fung, Guoxiang Hu

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出一种多智能体大语言模型框架,用于基于推理的单原子催化剂设计,通过迭代推理和上下文学习发现高性能催化剂并突破传统缩放关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.11963 2026-02-25 cs.CR cs.AI 89%

MARVEL: Multi-Agent RTL Vulnerability Extraction using Large Language Models

MARVEL:基于大语言模型的多智能体RTL漏洞提取

Luca Collini, Baleegh Ahmad, Joey Ah-kiow, Ramesh Karri

机构 * NYU Tandon School of Engineering(纽约大学Tandon工程学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 MARVEL通过多智能体框架利用大语言模型,高效识别RTL代码中的安全漏洞,发现有效漏洞和警告,提升硬件安全验证效率。

Comments Submitted for Peer Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.00574 2026-02-24 cs.LG 89%

Bayesian Network Structure Discovery Using Large Language Models

利用大语言模型进行贝叶斯网络结构发现

Yinghuan Zhang, Yufei Zhang, Parisa Kordjamshidi, Zijun Cui

机构 * Department of Computer Science and Engineering(计算机科学与工程系) Michigan State University(密歇根州立大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出了一种利用大语言模型进行贝叶斯网络结构发现的统一框架,支持数据自由和数据感知设置,在无数据场景下通过PromptBN生成完整DAG,在有数据时通过ReActBN进一步优化结构。

Comments Accepted to TMLR

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13979 2026-02-17 cs.CL 89%

Chain-of-Thought Reasoning with Large Language Models for Clinical Alzheimer's Disease Assessment and Diagnosis

基于大语言模型的链式推理在临床阿尔茨海默病评估与诊断中的应用

Tongze Zhang, Jun-En Ding, Melik Ozolcer, Fang-Ming Hung, Albert Chih-Chieh Yang, Feng Liu, Yi-Rou Ji, Sang Won Bae

机构 * Stevens Institute of Technology(斯蒂文斯理工学院) Surgical Trauma Intensive Care Unit(外科创伤重症护理科) Institute of Brain Science(脑科学研究所) National Yang Ming Chiao Tung University(国立阳明交通大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出利用大语言模型的链式推理进行阿尔茨海默病的评估与诊断,通过生成推理路径提升诊断稳定性和性能,F1分数提升达15%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12574 2026-02-16 cs.DB cs.AI 89%

Monte Carlo Tree Search with Reasoning Path Refinement for Small Language Models in Conversational Text-to-NoSQL

具有推理路径细化的蒙特卡洛树搜索用于对话文本到NoSQL

Xubang Xiong, Raymond Chi-Wing Wong, Yuanfeng Song

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 推理与问题求解 :language model(title,abstract);small language model(title,abstract);SFT(abstract);分类 cs.AI

AI总结 本文提出Stage-MCTS框架,通过蒙特卡洛树搜索和推理路径细化,提升小型语言模型在对话文本到NoSQL任务中的查询生成能力,实验显示其EVM准确性提升达7.93%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10485 2026-02-12 cs.AI 89%

Abstraction Generation for Generalized Planning with Pretrained Large Language Models

基于预训练大语言模型的通用规划抽象生成

Zhenhe Cui, Huaxiang Xia, Hangjun Shen, Kailun Luo, Yong He, Wei Liang

机构 * Hunan University of Science and Technology(湖南科技大学) Dongguan University of Technology(东莞理工学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 本文提出利用预训练大语言模型生成通用规划的抽象,并通过自动化调试修正抽象,以提升规划效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08804 2026-02-10 cs.AI 89%

Root Cause Analysis Method Based on Large Language Models with Residual Connection Structures

基于大语言模型与残差连接结构的根因分析方法

Liming Zhou, Ailing Liu, Hongwei Liu, Min He, Heng Zhang

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出一种基于大语言模型与残差连接结构的根因分析方法,通过整合多源遥测数据和建模因果依赖,提升复杂微服务架构中的根因定位能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00380 2026-02-10 cs.CL 89%

Clause-Internal or Clause-External? Testing Turkish Reflexive Binding in Adapted versus Chain of Thought Large Language Models

内部短语还是外部短语?测试土耳其反身代词在适应型与思维链大型语言模型中的绑定

Sercan Karakaş

机构 * University of Chicago(芝加哥大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本研究通过对比两种大型语言模型,探讨土耳其反身代词在不同模型中的绑定行为差异,揭示模型架构和训练数据对指代依赖表示的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08085 2026-02-10 physics.soc-ph cs.AI cs.CE 89%

Large language models for spreading dynamics in complex systems

复杂系统中传播动力学的大型语言模型

Shuyu Jiang, Hao Ren, Yichang Gao, Yi-Cheng Zhang, Li Qi, Dayong Xiao, Jie Fan, Rui Tang, Wei Wang

机构 * School of Cyber Science and Engineering, Sichuan University(四川大学计算机科学与工程学院) Key Laboratory of Data Protection and Intelligent Management (Sichuan University), Ministry of Education(数据保护与智能管理重点实验室(四川大学)) Cyber Science Research Institute, Sichuan University(网络科学研究院) Royal Melbourne Institute of Technology University(皇家墨尔本理工大学) Physics Department, University of Fribourg(弗里堡大学物理系) Chongqing Academy of Preventive Medicine(重庆预防医学研究院) School of Public Health and Emergency Management, Chongqing Medical and Pharmaceutical College(重庆医药学院公共卫生与应急管理学院) School of Public Health, Chongqing Medical University(重庆医科大学公共卫生学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文探讨了大型语言模型在复杂系统中传播动力学研究中的应用,涵盖数字流行病和生物流行病两个领域,分析了LLMs在流行病建模、检测与预测中的作用及未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07609 2026-02-10 cs.SE cs.AI 89%

Evaluating Large Language Models for Detecting Architectural Decision Violations

评估大型语言模型在检测架构决策违规方面的表现

Ruoyu Su, Alexander Bakhtin, Noman Ahmad, Matteo Esposito, Valentina Lenarduzzi, Davide Taibi

机构 * University of Oulu, Finland(奥卢大学,芬兰) University of Southern Denmark, Vejle, Denmark(南部丹麦大学,维杰)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本研究评估了大型语言模型在检测架构决策违规方面的有效性,发现其在显式决策上表现良好,但在隐式决策上存在局限,需结合专家评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05385 2026-02-06 cs.CL 89%

IESR:Efficient MCTS-Based Modular Reasoning for Text-to-SQL with Large Language Models

IESR:基于MCTS的高效模块化推理用于文本到SQL with大型语言模型

Tao Liu, Jiafan Lu, Bohan Yu, Pengcheng Wu, Liu Haixin, Guoyu Xu, Li Xiangheng, Lixiao Li, Jiaming Hou, Zhao Shijun, Xinglin Lyu, Kunli Zhang, Yuxiang Jia, Hongyin Zan

机构 * Zhengzhou University(郑州大学) Tianjin University(天津大学) Zhongshan University(中山大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);SLM(abstract);分类 cs.CL

AI总结 IESR提出一种基于MCTS的高效模块化推理框架,用于文本到SQL任务,通过信息增强和结构化推理提升复杂查询处理能力。

Comments 25 pages, 16 figures, 8 tables. Hongyin Zan is corresponding author, Jiafan Lu is first co-author

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05279 2026-02-06 cs.AI cs.CR 89%

Hallucination-Resistant Security Planning with a Large Language Model

具备抗幻觉能力的安全规划与大语言模型

Kim Hammar, Tansu Alpcan, Emil Lupu

机构 * The University of Melbourne(墨尔本大学) Imperial College London(伦敦帝国理工学院)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出了一种抗幻觉的安全规划框架,通过迭代循环和上下文学习优化LLM决策,减少恢复时间30%。

Comments Accepted to IEEE/IFIP Network Operations and Management Symposium 2026. To appear in the conference proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04919 2026-02-06 cs.LG 89%

Gradually Compacting Large Language Models for Reasoning Like a Boiling Frog

逐步压缩大型语言模型以像沸 frog 一样进行推理

Yiran Zhao, Shengyang Zhou, Zijian Wu, Tongyan Hu, Yuhui Xu, Rengan Dou, Kenji Kawaguchi, Shafiq Joty, Junnan Li, Michael Qizhe Shieh

机构 * Salesforce AI Research(Salesforce AI研究部) National University of Singapore(新加坡国立大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.LG

AI总结 本文提出了一种渐进压缩方法,通过剪枝-微调循环逐步减少大型语言模型大小,同时保持推理性能,适用于多种剪枝策略和后期训练方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00843 2026-02-05 cs.AI cs.HC 89%

Benchmarking Large Language Models for Diagnosing Students' Cognitive Skills from Handwritten Math Work

对大型语言模型诊断学生手写数学作业认知技能的基准测试

Yoonsu Kim, Hyoungwook Jin, Hayeon Doh, Eunhye Kim, Dongyun Jung, Seungju Kim, Kiyoon Choi, Jinho Son, Juho Kim

机构 * School of Computing, KAIST, Daejeon, Republic of Korea(韩国庆熙大学计算机学院) University of Michigan, Ann Arbor, USA(美国密歇根大学) Ewha Womans University, Seoul, Republic of Korea(韩国成均馆大学) AlgorithmLabs, Seoul, Republic of Korea(韩国AlgorithmLabs公司)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文评估了18种大型语言模型在诊断学生手写数学作业认知技能时的表现,发现模型在模糊证据下表现不佳,揭示了模型在证据处理上的系统性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21826 2026-02-05 cs.CL 89%

ResT: Reshaping Token-Level Policy Gradients for Tool-Use Large Language Models

ResT: 重塑令牌级策略梯度以适应工具使用大型语言模型

Zihan Lin, Xiaohan Wang, Jie Cao, Jiajun Chai, Guojun Yin, Wei Lin, Ran He

机构 * CRIPAC, Institute of Automation(CRIPAC,自动化研究所) Meituan(美团)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 ResT通过熵引导的令牌重新加权优化工具使用任务的策略梯度,提升训练稳定性与效率,实现优于现有方法的性能。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02635 2026-02-04 cs.CL 89%

Graph-Augmented Reasoning with Large Language Models for Tobacco Pest and Disease Management

基于图增强推理的烟草害虫和疾病管理

Siyu Li, Chenwei Song, Qi Zhou, Wan Zhou, Xinyi Liu

机构 * School of Information Science and Engineering(信息科学与工程学院) Chongqing Jiaotong University(重庆交通大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出一种基于图增强推理的框架,通过整合领域知识图谱,提升烟草害虫和疾病管理的推理能力和推荐准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02295 2026-02-03 cs.LG 89%

EvalQReason: A Framework for Step-Level Reasoning Evaluation in Large Language Models

EvalQReason: 一种用于大型语言模型中分步推理评估的框架

Shaima Ahmad Freja, Ferhat Ozgur Catak, Betul Yurdem, Chunming Rong

机构 * Department of Electrical Engineering and Computer Science, University of Stavanger(电子工程与计算机科学系,斯塔万格大学) Department of Electrical and Electronics Engineering, Izmir Bakircay University(电子与电气工程系,伊兹密尔巴克伊大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 EvalQReason通过分步概率分布分析评估大型语言模型的推理质量,展示了在数学和医学领域中对推理可靠性的有效评估方法。

Comments 15 pages (including appendix), 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00770 2026-02-03 cs.CL 89%

Reasoning as State Transition: A Representational Analysis of Reasoning Evolution in Large Language Models

推理作为状态转换:大型语言模型推理演变的表征分析

Siyuan Zhang, Jialian Li, Yichi Zhang, Xiao Yang, Yinpeng Dong, Hang Su

机构 * Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center, Tsinghua University, Beijing 100084, China(计算机科学与技术系,人工智能研究所,清华-博世联合机器学习中心,THBI实验室,BNRist中心,清华大学,北京100084,中国) College of AI, Tsinghua University, Beijing 100084, China(人工智能学院,清华大学,北京100084,中国)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.CL

AI总结 本研究从表征视角分析大型语言模型推理过程的演变,揭示训练后模型通过优化表示分布提升推理能力的机制。

Comments 30 pages, 27 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08613 2026-02-02 cs.CL 89%

GraphGhost: Tracing Structures Behind Large Language Models

GraphGhost: 探索大型语言模型背后的结构

Xinnan Dai, Xianxuan Long, Chung-Hsiang Lo, Kai Guo, Shenglai Zeng, Dongsheng Luo, Jiliang Tang

机构 * Michigan State University(密歇根州立大学) Northeastern University(东北大学) Florida International University(佛罗里达国际大学)

专题命中 推理与问题求解 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 GraphGhost通过图分析揭示大型语言模型内部结构,捕捉推理过程中的关键节点与信息流,为理解模型决策提供新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏