arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 3016 信号源:cs.CL, cs.AI, cs.LG

1. 逻辑推理 3016 篇

2511.21075 2026-03-30 cs.LG cs.AI 73%

Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning

通过平衡微调对齐大语言模型与生物医学知识

Zhenchao Tang, Fang Wang, Haohuai He, Jiale Zhou, Tianxu Lv, Jun Zhu, Shouzhi Chen, Minghao Yang, Yu Wang, Jiayang Wu, Yidong Song, Yaokun Li, Jiehui Huang, Dawei Huang, Zhi Song, Jianhua Yao

机构 * Tencent AI for Life Sciences Lab(腾讯AI生命科学实验室) Sun Yat-sen University(中山大学) The Hong Kong Polytechnic University(香港理工大学) Westlake University(西湖大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出平衡微调方法,通过双尺度后训练技术提升大语言模型对生物医学知识的理解与生成能力,实验表明其在医疗和生物学推理任务中优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23577 2026-03-26 cs.LG cs.CL cs.CY 73%

The Geometric Price of Discrete Logic: Context-driven Manifold Dynamics of Number Representations

离散逻辑的几何价格:数表示的上下文驱动流形动力学

Long Zhang, Dai-jun Lin, Wei-neng Chen

机构 * School of Computer Science and Engineering(计算机科学与工程学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.LG

AI总结 本研究通过分析语言模型中的流形动力学,揭示了离散逻辑形成所需的拓扑变形成本,提出了一种双调控机制以解释语义分类和逻辑边界生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19276 2026-03-23 cs.CL cs.AI 73%

From Flat to Structural: Enhancing Automated Short Answer Grading with GraphRAG

从平面到结构:利用GraphRAG增强自动简答评分

Yucheng Chu, Haoyu Han, Shen Dong, Hang Li, Kaiqi Yang, Yasemin Copur-Gencturk, Joseph Krajcik, Namsoo Shin, Hui Liu

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出GraphRAG框架,通过构建结构化知识图谱解决传统RAG在复杂教育内容中的不足,实验表明其在评估科学与工程实践方面表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18074 2026-03-20 cs.LG cs.AI cs.IR stat.AP 73%

Lightweight Adaptation for LLM-based Technical Service Agent: Latent Logic Augmentation and Robust Noise Reduction

轻量级适应用于基于LLM的技术服务代理:潜在逻辑增强与鲁棒噪声消除

Yi Yu, Junzhuo Ma, Chenghuang Shen, Xingyan Liu, Jing Gu, Hangyi Sun, Guangquan Hu, Jianfeng Liu, Weiting Liu, Mingyue Pu, Yu Wang, Zhengdong Xiao, Rui Xie, Longjiu Luo, Qianrong Wang, Gurong Cui, Honglin Qiao, Wenlian Lu

机构 * School of Mathematics and Sciences, Fudan University, Shanghai, China(复旦大学数学科学学院,上海,中国) Shanghai Center for Mathematical Sciences, Fudan University, Shanghai, China(复旦大学上海数学中心,上海,中国) Alibaba Group, Hangzhou, China(阿里巴巴集团,杭州,中国) Institute of Science and Technology for Brain-Inspired Intelligence, Fudan University, Shanghai, China(脑启发式智能科学技术研究院,复旦大学,上海,中国) Center for Applied Mathematics & Shanghai Key Laboratory of Contemporary Applied Mathematics, Fudan University, Shanghai, China(应用数学中心及上海当代应用数学重点实验室,复旦大学,上海,中国)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出轻量级适应框架,通过潜在逻辑增强和鲁棒噪声消除提升技术服务代理的稳定性和性能,同时采用混合奖励机制降低训练成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06617 2026-03-10 cs.LG cs.AI 73%

Evo: Autoregressive-Diffusion Large Language Models with Evolving Balance

Evo:具有进化平衡的自回归-扩散大语言模型

Junde Wu, Minhao Hu, Jiayuan Zhu, Yuyuan Liu, Tianyi Zhang, Kang Li, Jingkun Chen, Jiazhen Pan, Min Xu, Yueming Jin

机构 * University of Oxford(牛津大学) National University of Singapore(新加坡国立大学) Technical University of Munich(慕尼黑技术大学) Carnegie Mellon University(卡内基梅隆大学)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.AI、cs.LG

AI总结 Evo通过进化平衡机制,结合自回归和扩散模型,实现高效且高质量的语言生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10195 2026-02-27 cs.LG cs.AI hep-th 73%

Versor: A Geometric Sequence Architecture

Versor:一种几何序列架构

Truong Minh Huy, Edward Hirst

机构 * Trương Minh Huy Independent Researcher(Trương Minh Huy 独立研究者) Instituto de Matemática, Estatística e Computação Científica University of Campinas (UNICAMP), Brazil(巴西坎皮纳斯大学数学、统计与科学计算研究所)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 Versor通过共形几何代数实现结构泛化和高效任务处理,优于Transformer等基线模型。

Comments 19+28 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03868 2026-02-25 cs.CL cs.AI cs.CR 73%

What Matters For Safety Alignment?

安全对齐中什么重要?

Xing Li, Hui-Ling Zhen, Lihao Yin, Xianzhi Yu, Zhenhua Dong, Mingxuan Yuan

机构 * Huawei Technologies Co., Ltd.(华为技术有限公司)

专题命中 逻辑推理 :reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

AI总结 本文研究了安全对齐中关键因素,发现集成推理和自我反思机制的重要性,揭示了CoT攻击的高成功率及安全风险,强调了安全约束在模型训练中的必要性。

Comments Added more commercial model results, majority voting scores, and theoretical analysis in v2

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11666 2026-02-13 cs.AI cs.CL 73%

PhyNiKCE: A Neurosymbolic Agentic Framework for Autonomous Computational Fluid Dynamics

PhyNiKCE:一种用于自主计算流体动力学的神经符号代理框架

E Fan, Lisong Shi, Zhengtong Li, Chih-yung Wen

专题命中 逻辑推理 :planning(abstract);self-correction(abstract);分类 cs.CL、cs.AI

AI总结 PhyNiKCE通过神经符号框架提升CFD模拟的可信度与效率,实现96%的性能提升并减少59%的自我校正循环。

Comments 30 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04144 2026-02-05 cs.AI cs.LG 73%

OMG-Agent: Toward Robust Missing Modality Generation with Decoupled Coarse-to-Fine Agentic Workflows

OMG-Agent:迈向鲁棒缺失模态生成的解耦粗到细代理工作流

Ruiting Dai, Zheyu Wang, Haoyu Yang, Yihan Liu, Chengzhi Wang, Zekun Zhang, Zishan Huang, Jiaman Cen, Lisi Mo

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 OMG-Agent通过解耦粗到细的代理工作流,有效解决多模态数据缺失问题,提升生成的鲁棒性和保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08169 2026-01-14 cs.CL cs.LG 73%

Relational Knowledge Distillation Using Fine-tuned Function Vectors

基于微调函数向量的关系知识蒸馏

Andrea Kang, Yingnian Wu, Hongjing Lu

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.LG

AI总结 通过微调函数向量提升关系知识表示,增强语言模型的类比推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04727 2026-01-14 cs.AI cs.LG 73%

Sequential Enumeration in Large Language Models

大语言模型中的序列枚举

Kuinan Hou, Marco Zorzi, Alberto Testolin

机构 * University of Padova(帕多瓦大学)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了大语言模型在序列枚举任务中的能力,发现其在被提示时可部署计数程序,但无法自发进行计数,揭示了神经方法与符号方法在组合泛化上的差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18695 2026-01-12 cs.AI cs.CE cs.CL 73%

KALE-LM-Chem: Vision and Practice Toward an AI Brain for Chemistry

KALE-LM-Chem:迈向化学人工智能脑的愿景与实践

Weichen Dai, Yezeng Chen, Zijie Dai, Yubo Liu, Zhijie Huang, Yixuan Pan, Baiyang Song, Chengli Zhong, Xinhe Li, Zeyu Wang, Zhuoying Feng, Yi Zhou

机构 * University of Science and Technology of China(科学技术大学) ShanghaiTech University(上海科技大学) USTC Knowledge Computing Lab(USTC知识计算实验室) State Key Laboratory of Communication Content Cognition People's Daily Online(通信内容认知国家重点实验室)

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI

AI总结 本文提出KALE-LM-Chem模型,旨在通过整合领域知识和逻辑,推动化学领域的智能AI发展,提升科学发现效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14989 2025-12-18 cs.CL cs.AI cs.CV 73%

Evaluating Large Language Models on Multimodal Chemistry Olympiad Exams

评估大型语言模型在多模态化学奥林匹克考试中的表现

Yiming Cui, Xin Yao, Yuxuan Qin, Xin Li, Shijin Wang, Guoping Hu

机构 * State Key Laboratory of Cognitive Intelligence(认知智能国家重点实验室) iFLYTEK AI Research(iFLYTEK人工智能研究院)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 本文评估了多种多模态LLM在化学奥林匹克考试中的表现,发现其在多模态融合和科学推理方面存在显著局限,提出通过链式思维提示提升模型性能的方法。

Comments Published at Communications Chemistry

Journal ref Commun. Chem. 8 (2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09340 2025-12-11 cs.AI cs.CV cs.LG 73%

Visual Categorization Across Minds and Models: Cognitive Analysis of Human Labeling and Neuro-Symbolic Integration

跨心灵与模型的视觉分类:人类标注与神经符号整合的认知分析

Chethana Prasad Kabgere

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

AI总结 本文通过对比人类与AI在低分辨率图像标注中的表现,探讨了认知策略与神经符号整合方法的异同,旨在推动更可解释和认知对齐的AI系统发展。

Comments 12 pages, 3 figures. Research manuscript based on the final project for CS6795 (Introduction to Cognitive Science), Georgia Tech

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15365 2025-12-10 cs.HC cs.AI cs.CL cs.CY 73%

Identifying Features that Shape Perceived Consciousness in Large Language Model-based AI: A Quantitative Study of Human Responses

识别塑造大语言模型基AI中感知意识的特征:人类反应的定量研究

Bongsu Kang, Jundong Kim, Tae-Rim Yun, Hyojin Bae, Chang-Eop Kim

机构 * Department of Physiology Gachon University College of Korean Medicine(生理学系高丽大学医学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过分析人类对AI意识感知的特征,揭示了元认知自我反思和情绪表达对意识感知的影响,同时指出知识过度强调会降低感知意识。

Comments 11 pages, 3 figures, 4 tables

Journal ref Computers in Human Behavior Reports, Volume 21 (2026) 100901

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15703 2025-11-27 cs.CV cs.AI cs.CL 73%

Think Visually, Reason Textually: Vision-Language Synergy in ARC

视觉优先,文本推理:ARC中的视觉-语言协同

Beichen Zhang, Yuhang Zang, Xiaoyi Dong, Yuhang Cao, Haodong Duan, Dahua Lin, Jiaqi Wang

机构 * The Chinese University of Hong Kong(香港中文大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院)

专题命中 逻辑推理 :reasoning(abstract);self-correction(abstract);分类 cs.CL、cs.AI

AI总结 本文提出视觉-语言协同推理和模态切换自我纠正策略,通过结合视觉抽象与语言推理提升ARC-AGI任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26298 2025-10-31 cs.CL cs.AI 73%

Can Agent Conquer Web? Exploring the Frontiers of ChatGPT Atlas Agent in Web Games

Jingran Zhang, Ning Li, Justin Cui

机构 * UC San Deigo(圣德戈大学) UCLA(加州大学洛杉矶分校)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25595 2025-10-30 cs.CL cs.AI 73%

Communication and Verification in LLM Agents towards Collaboration under Information Asymmetry

Run Peng, Ziqiao Ma, Amy Pang, Sikai Li, Zhang Xi-Jia, Yingzhuo Yu, Cristian-Paul Bara, Joyce Chai

机构 * University of Michigan(密歇根大学) UNC, Chapel Hill(北卡罗来纳大学教堂山分校) Georgia Tech(佐治亚理工学院) Apple(苹果公司) Robert Bosch SRL(博世股份有限公司) Babeş-Bolyai University(巴贝什-博耶亚大学)

专题命中 逻辑推理 :planning(abstract);verifier(abstract);分类 cs.CL、cs.AI

Comments Workshop on Multi-Agent System @ ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22312 2025-10-28 cs.LG cs.AI 73%

LacMaterial: Large Language Models as Analogical Chemists for Materials Discovery

Hongyu Guo

机构 * National Research Council Canada(加拿大国家研究理事会)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19988 2025-10-24 cs.CL cs.AI 73%

LLM-Augmented Symbolic NLU System for More Reliable Continuous Causal Statement Interpretation

Xin Lian, Kenneth D. Forbus

机构 * Department of Computer Science, McCormick School of Engineering Applied Science, \ University, Evanston, IL 60208

专题命中 逻辑推理 :reasoning(abstract);planning(abstract);分类 cs.CL、cs.AI

Comments 18 pages, 2 figures

Journal ref Proceedings of the Twelfth Annual Conference on Advances in Cognitive Systems, Poster Collection (2025) 66-83

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17705 2025-10-21 cs.AI cs.CL 73%

Contextual Attention Modulation: Towards Efficient Multi-Task Adaptation in Large Language Models

Dayan Pan, Zhaoyang Fu, Jingyuan Wang, Xiao Han, Yue Zhu, Xiangyu Zhao

机构 * SCSE, Beihang University(北京航空航天大学系统工程学院) ERC of ACAT, MOE(教育部人工智能教育联合体) City University of Hong Kong(香港城市大学) Huawei Technologies Ltd.(华为技术有限公司) Key Lab of DIM, MIIT(信息通信技术重点实验室) SEM, Beihang University(北京航空航天大学电子机械学院) Zhejiang University of Technology(浙江工业大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

Comments Accepted by CIKM' 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17415 2025-10-21 cs.CL cs.AI cs.MA cs.MM cs.SE 73%

BenCao: An Instruction-Tuned Large Language Model for Traditional Chinese Medicine

Jiacheng Xie, Yang Yu, Yibo Chen, Hanyao Zhang, Lening Zhao, Jiaxuan He, Lei Jiang, Xiaoting Tang, Guanghui An, Dong Xu

机构 * Community Health Service Center Shanghai Pudong New Area(上海浦东新区社区卫生服务中心) School of Acupuncture-Moxibustion and Tuina, Shanghai University of Traditional Chinese Medicine(上海中医药大学针灸推拿学院)

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12044 2025-10-15 cs.CL cs.AI 73%

Hierarchical Alignment: Surgical Fine-Tuning via Functional Layer Specialization in Large Language Models

Yukun Zhang, Qi Dong

机构 * The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.09402 2025-09-19 cs.CL cs.AI 73%

Read Before You Think: Mitigating LLM Comprehension Failures with Step-by-Step Reading

Feijiang Han, Hengtao Cui, Licheng Guo, Zelong Wang, Zhiyuan Lyu

专题命中 逻辑推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

Comments Done in November 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20030 2025-08-28 eess.SY cs.AI cs.AR cs.LG cs.SY 73%

Large Language Models (LLMs) for Electronic Design Automation (EDA)

Kangwei Xu, Denis Schwachhofer, Jason Blocklove, Ilia Polian, Peter Domanski, Dirk Pflüger, Siddharth Garg, Ramesh Karri, Ozgur Sinanoglu, Johann Knechtel, Zhuorui Zhao, Ulf Schlichtmann, Bing Li

机构 * Technical University of Munich(慕尼黑技术大学) University of Stuttgart(斯图加特大学) New York University(纽约大学) University of Siegen(锡根大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

Comments Accepted by IEEE International System-on-Chip Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.16109 2025-08-25 cs.CL cs.LG 73%

From Indirect Object Identification to Syllogisms: Exploring Binary Mechanisms in Transformer Circuits

Karim Saraipour, Shichang Zhang

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Harvard University(哈佛大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15766 2025-08-22 cs.LG cs.AI 73%

Discovering Hidden Algebraic Structures via Transformers with Rank-Aware Beam GRPO

Jaeha Lee, Gio Huh, Ning Su, Tony Yue YU

机构 * California Institute of Technology(加州理工学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14147 2025-08-08 cs.IR cs.AI cs.CL 73%

Explainable Recommendation with Simulated Human Feedback

Jiakai Tang, Jingsen Zhang, Zihang Tian, Xueyang Feng, Lei Wang, Xu Chen

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学agate人工智能学院)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

Journal ref ACM Transactions on Information Systems, Vol. 1, No. 1, Article 1 (January 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.01903 2025-08-06 cs.CL cs.AI 73%

AI4Research: A Survey of Artificial Intelligence for Scientific Research

Qiguang Chen, Mingda Yang, Libo Qin, Jinhao Liu, Zheng Yan, Jiannan Guan, Dengyun Peng, Yiyan Ji, Hanjing Li, Mengkang Hu, Yimeng Zhang, Yihao Liang, Yuhang Zhou, Jiaqi Wang, Zhi Chen, Wanxiang Che

机构 * LARG, Research Center for Social Computing and Interactive Robotics, Harbin Institute of Technology(哈尔滨工业大学大规模学习与推理中心,社会计算与交互机器人研究所以) School of Computer Science and Engineering, Central South University(中南大学计算机科学与工程学院) The University of Hong Kong(香港大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Princeton University(普林斯顿大学) Fudan University(复旦大学) Chinese University of Hong Kong(香港中文大学) ByteDance Seed (China)(字节跳动种子(中国))

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.CL、cs.AI

Comments Preprint, Paper list is available at https://github.com/LightChen233/Awesome-AI4Research

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00914 2025-08-05 cs.AI cs.LG 73%

Knowledge Editing for Multi-Hop Question Answering Using Semantic Analysis

Dominic Simon, Rickard Ewetz

机构 * University of Florida(佛罗里达大学)

专题命中 逻辑推理 :reasoning(abstract);logical reasoning(abstract);分类 cs.AI、cs.LG

Comments 14 pages, 15 figures, pre-print of paper accepted to IJCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏