arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-03-10 至 2026-03-10 共收录 25 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 25 篇

2511.14106 2026-03-10 cs.CL 85%

Stealth Fine-Tuning: Efficiently Breaking Alignment in RVLMs Using Self-Generated CoT

隐形微调:通过自动生成的CoT打破RVLMs的对齐

Le Yu, Zhengyue Zhao, Yawen Zheng, Yunhao Liu

机构 * Machine Intelligence Laboratory, Sichuan University(四川大学人工智能实验室) University of Wisconsin--Madison(威斯康星大学麦迪逊分校) Department of Automation, Tsinghua University(清华大学自动化系) Global Innovation Exchange, Tsinghua University(清华大学全球创新交流中心)

专题命中 其他推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 本文提出隐形微调方法,通过分段干扰和自动生成输出,有效绕过RVLMs的安全对齐防御,实现更高的ASR性能同时保持推理能力。

Comments 15 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08230 2026-03-10 cs.SD cs.AI eess.AS 83%

Disentangling Reasoning in Large Audio-Language Models for Ambiguous Emotion Prediction

解构大音频-语言模型中的推理能力以实现模糊情绪预测

Xiaofeng Yu, Jiaheng Dong, Jean Honorio, Abhirup Ghosh, Hong Jia, Ting Dang

机构 * University of Auckland, New Zealand(奥克兰大学) The University of Melbourne, Australia(墨尔本大学) University of Birmingham, United Kingdom(伯明翰大学)

专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI

AI总结 本文提出了一种新的方法,通过将模糊情绪识别转化为分布推理问题,提升大音频-语言模型在模糊情绪预测中的推理能力。

Comments The paper was submitted to Interspeech for review

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06659 2026-03-10 cs.CY cs.AI 79%

Science Literacy: Generative AI as Enabler of Coherence in the Teaching, Learning, and Assessment of Scientific Knowledge and Reasoning

科学素养:生成式AI在科学知识与推理教学、学习和评估中的促进作用

Xiaoming Zhai, James W. Pellegrino, Matias Rojas, Jongchan Park, Matthew Nyaaba, Clayton Cohn, Gautam Biswas

专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI

AI总结 本文探讨生成式AI在提升科学素养中的作用,分析其在教学、学习和评估中的应用挑战与解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07179 2026-03-10 cs.IR 78%

Retrieving Minimal and Sufficient Reasoning Subgraphs with Graph Foundation Models for Path-aware GraphRAG

基于图基础模型的路径感知图RAG中最小和充分推理子图检索

Haonan Yuan, Qingyun Sun, Junhua Shi, Mingjun Liu, Jiaqi Yuan, Ziwei Zhang, Xingcheng Fu, Jianxin Li

专题命中 其他推理 :reasoning(title,abstract)

AI总结 本文提出GFM-Retriever,通过图基础模型实现路径感知的子图检索,提升多跳问答任务的检索与生成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20980 2026-03-10 cs.CV cs.AI 77%

CrystaL: Spontaneous Emergence of Visual Latents in MLLMs

CrystaL: MLLMs中视觉潜在特征的自发涌现

Yang Zhang, Danyang Li, Yuxuan Li, Xin Zhang, Tianyu Xie, Mingming Cheng, Xiang Li

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI

AI总结 CrystaL通过显式对齐注意力模式和预测分布,实现视觉潜在特征的自发涌现,提升细粒度视觉理解和推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23184 2026-03-10 cs.CL 70%

PonderLM-2: Pretraining LLM with Latent Thoughts in Continuous Space

PonderLM-2: 在连续空间中通过潜在思想预训练语言模型

Boyi Zeng, He Li, Shixiang Song, Yixuan Wang, Zitong Wang, Ziwei He, Xinbing Wang, Zhouhan Lin

机构 * LUMIA Lab(LUMIA实验室) School of Artificial Intelligence(人工智能学院) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Sun Yat-sen University(中山大学)

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 PonderLM-2通过在预训练过程中引入潜在思想的连续空间优化,提升了语言模型的生成能力与下游任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07111 2026-03-10 cs.CL cs.AI 62%

Enhancing Consistency of Werewolf AI through Dialogue Summarization and Persona Information

通过对话摘要和人物信息增强Werewolf AI的一致性

Yoshiki Tanaka, Takumasa Kaneko, Hiroki Onozeki, Natsumi Ezure, Ryuichi Uehara, Zhiyang Qi, Tomoya Higuchi, Ryutaro Asahara, Michimasa Inaba

机构 * The University of Electro-Communications(电通大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过对话摘要和人物信息提升Werewolf AI代理发言的一致性。

Comments Accepted to the 2nd International AIWolfDial Workshop at INLG 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06816 2026-03-10 cs.CL cs.AI q-bio.NC 62%

"Dark Triad" Model Organisms of Misalignment: Narrow Fine-Tuning Mirrors Human Antisocial Behavior

黑暗三联征模型生物:对齐偏差:狭窄微调映射人类反社会行为

Roshni Lulla, Fiona Collins, Sanaya Parekh, Thilo Hagendorff, Jonas Kaplan

机构 * Brain & Creativity Institute, University of Southern California(大脑与创造力研究所,南加州大学) Department of Psychology, University of Southern California(心理学系,南加州大学) Interchange Forum for Reflecting on Intelligent Systems, University of Stuttgart(智能系统反思交流论坛,斯图加特大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI

AI总结 本文通过黑暗三联征框架,研究LLM中的对齐偏差问题,通过微调诱导反社会行为,揭示LLM中潜在的人格结构。

Comments 38 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08221 2026-03-10 cs.CR cs.AI 57%

SplitAgent: A Privacy-Preserving Distributed Architecture for Enterprise-Cloud Agent Collaboration

SplitAgent: 一种隐私保护的企业-云代理协作分布式架构

Jianshu She

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 SplitAgent通过语境感知的动态去敏化技术,实现企业与云代理间的隐私保护协作,提升任务准确率并减少隐私泄露。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07896 2026-03-10 cs.CL 57%

ACE: Attribution-Controlled Knowledge Editing for Multi-hop Factual Recall

ACE:基于多跳事实回忆的归因控制知识编辑

Jiayu Yang, Yuxuan Fan, Songning Lai, Shengen Wu, Jiaqi Tang, Chun Kang, Zhijiang Guo, Yutao Yue

机构 * HKUST(GZ) Deep Interdisciplinary Intelligence Lab(香港科技大学(广州)深 interdisciplinary 智能实验室) BUAA(北京航空航天大学) HKUST(GZ) Institute of Deep Perception Technology, JITRI Deep Interdisciplinary Intelligence Lab(香港科技大学(广州)深度感知技术研究所,JITRI 深 interdisciplinary 智能实验室)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 ACE通过神经元归因控制实现多跳事实回忆中的知识编辑,提升KE性能。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08082 2026-03-10 cs.LG 57%

Tiny Autoregressive Recursive Models

微型自回归递归模型

Paulius Rauba, Claudio Fanconi, Mihaela van der Schaar

机构 * University of Cambridge(剑桥大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出自回归TRM,评估其在小型自回归任务上的表现,发现两步细化基线表现强劲,但完整架构未见显著性能提升。

Journal ref ICLR 2026 Workshop RSI Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08048 2026-03-10 cs.AI 57%

S2S-FDD: Bridging Industrial Time Series and Natural Language for Explainable Zero-shot Fault Diagnosis

S2S-FDD:连接工业时间序列与自然语言用于可解释的零样本故障诊断

Baoxue Li, Chunhui Zhao

机构 * 1. State Key Laboratory of Industrial Control Technology, College of Control Science Engineering Zhejiang University Hangzhou, China Engineering Zhejiang University 2. School of Information Electrical Engineering, Zhejiang University City College Hangzhou, China

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 S2S-FDD通过将高维传感器信号转换为自然语言摘要,并结合树状结构诊断方法,实现可解释的零样本故障诊断。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07940 2026-03-10 hep-ex cs.AI 57%

AI Agents, Language, Deep Learning and the Next Revolution in Science

人工智能代理、语言、深度学习与科学的下一次革命

Ke Li, Beijiang Liu, Bruce Mellado, Changzheng Yuan, Zhengde Zhang

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出基于深度学习的智能代理作为科学方法的下一次进化,通过多代理推理框架在粒子物理中实现科学发现的扩展与知识生产的革新。

Comments This perspective paper is accepted by Frontier of Physics

Journal ref Front. Phys., 2026, 21(9): 096401

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07590 2026-03-10 cs.CV cs.LG 57%

Models as Lego Builders: Assembling Malice from Benign Blocks via Semantic Blueprints

模型作为乐高积木:通过语义蓝图从良性积木中组装恶意内容

Chenxi Li, Xianggan Liu, Dake Shen, Yaosong Du, Zhibo Yao, Hao Jiang, Linyi Jiang, Chengwei Cao, Jingzhe Zhang, RanYi Peng, Peiling Bai, Xiande Huang

机构 * DAIL Tech(DAIL科技) NLP & KG Lab, Huazhong University of Science and Technology(自然语言处理与知识图谱实验室,华中科技大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 本文提出StructAttack,通过语义蓝图将看似无害的槽类型组合成恶意内容,揭示LVLMs在视觉模态整合中的安全漏洞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07581 2026-03-10 cs.SE cs.CL 57%

KCoEvo: A Knowledge Graph Augmented Framework for Evolutionary Code Generation

KCoEvo: 一种增强知识图谱的进化代码生成框架

Jiazhen Kang, Yuchen Lu, Chen Jiang, Jinrui Liu, Tianhao Zhang, Bo Jiang, Ningyuan Sun, Tongtong Wu, Guilin Qi

机构 * Southeast University(东南大学) Monash University(墨尔本大学) ByteDance Ltd.(字节跳动有限公司)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 KCoEvo通过增强知识图谱的方法提升代码迁移的准确性与可控性

Comments Accepted to the DASFAA 2026 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19747 2026-03-10 cs.CL cs.AR 57%

HaLoRA: Hardware-aware Low-Rank Adaptation for Large Language Models Based on Hybrid Compute-in-Memory Architecture

HaLoRA: 基于混合计算-内存架构的硬件感知低秩适应法用于大型语言模型

Taiqiang Wu, Chenchen Ding, Wenyong Zhou, Yuxin Cheng, Xincheng Feng, Shuqi Wang, Wendong Xu, Chufan Shi, Zhengwu Liu, Ngai Wong

机构 * The University of Hong Kong(香港大学) Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 HaLoRA通过在混合计算-内存架构中部署低秩适应,利用RRAM和SRAM实现高效能和高精度的LLM微调。

Comments 22 pages, Accepted by TODAES (ACM Transactions on Design Automation of Electronic Systems)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07202 2026-03-10 cs.CL 57%

Lying to Win: Assessing LLM Deception through Human-AI Games and Parallel-World Probing

谎言以赢:通过人机游戏和平行世界探测评估LLM欺骗

Arash Marioriyad, Ali Nouri, Mohammad Hossein Rohban, Mahdieh Soleymani Baghshah

机构 * Sharif University of Technology(谢里夫技术大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本研究通过人机游戏和平行世界探测评估LLM欺骗行为,发现存在性框架显著增加Qwen和Gemini的欺骗率,凸显需新的行为审计方法。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07116 2026-03-10 cs.CR cs.AI 57%

aCAPTCHA: Verifying That an Entity Is a Capable Agent via Asymmetric Hardness

aCAPTCHA:通过非对称难度验证实体是否为有能力的代理

Zuyao Xu, Xiang Li, Fubin Wu, Yuqi Qiu, Lu Sun, FaSheng Miao

机构 * Nankai University(南开大学) Tsinghua University(清华大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 aCAPTCHA通过非对称难度验证机制,为需要实体类型验证的服务提供一个无需基础设施的准入解决方案。

Comments 17 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07048 2026-03-10 cs.CV cs.AI 57%

Looking Back and Forth: Cross-Image Attention Calibration and Attentive Preference Learning for Multi-Image Hallucination Mitigation

回望与前行:用于多图像幻觉缓解的跨图像注意力校准与关注偏好学习

Xiaochen Yang, Hao Fang, Jiawei Kong, Yaoxin Mao, Bin Chen, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) Harbin Institute of Technology(哈尔滨工业大学) Beijing Institute of Technology(北京理工大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出CAPL框架,通过跨图像注意力校准和偏好学习缓解多图像幻觉问题,提升模型对跨图像关联的建模能力,并在多个任务中取得稳定性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06902 2026-03-10 cs.AI 57%

Empowering Locally Deployable Medical Agent via State Enhanced Logical Skills for FHIR-based Clinical Tasks

通过增强状态的逻辑技能赋能本地可部署的医疗代理以用于基于FHIR的临床任务

Wanrong Yang, Zhengliang Liu, Yuan Li, Bingjie Yan, Lingfang Li, Mingguang He, Dominik Wojtczak, Yalin Zheng, Danli Shi

机构 * Department of Computer Science, University of Liverpool(利物浦大学计算机科学系) The Hong Kong Polytechnic University(香港理工大学) Beijing Normal University(北京师范大学) School of Computing, University of Georgia(佐治亚大学计算机学院) Department of Eye and Vision, University of Liverpool(利物浦大学眼科学与视觉系)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出SELSM框架,通过增强状态的逻辑技能提升本地医疗代理在FHIR临床任务中的零样本能力,实现100%任务完成率和22.67%的成功率提升。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06801 2026-03-10 cs.AI 57%

Breaking the Martingale Curse: Multi-Agent Debate via Asymmetric Cognitive Potential Energy

突破马尔可夫诅咒:基于非对称认知潜能的多智能体辩论

Yuhan Liu, Juntian Zhang, Yichen Wu, Martin Takac, Salem Lahlou, Xiuying Chen, Nils Lukas

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·扎耶德人工智能大学) Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学国际关系学院) Harvard University(哈佛大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 AceMAD通过非对称认知潜能打破马尔可夫诅咒,提升多智能体辩论的真理收敛能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05760 2026-03-10 cs.RO cs.HC 50%

Task-Oriented Robot-Human Handovers on Legged Manipulators

面向任务的腿式机械臂人机交接

Andreea Tulbure, Carmen Scheidemann, Elias Steiner, Marco Hutter

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出AFT-Handover框架,通过结合大语言模型和纹理转移实现零样本、可泛化的面向任务的人机交接,提升交接成功率和泛化能力。

Comments Accepted to 21st ACM/IEEE International Conference on Human-Robot Interaction (HRI) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.15205 2026-03-10 cs.CV 50%

Leveraging Hallucinations to Reduce Manual Prompt Dependency in Promptable Segmentation

利用幻觉减少可提示分割中的手动提示依赖

Jian Hu, Jiayi Lin, Junchi Yan, Shaogang Gong

机构 * Queen Mary University of London(伦敦大学玛丽女王学院) Shanghai Jiao Tong University(上海交通大学)

专题命中 其他推理 :reasoning(abstract)

AI总结 本文提出ProMaC框架,通过利用MLLM幻觉挖掘任务相关信息,提升分割精度与遮罩生成效果。

Comments NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07557 2026-03-10 cs.SE 50%

AgentRaft: Automated Detection of Data Over-Exposure in LLM Agents

AgentRaft: LLM代理中数据过度暴露的自动检测

Yixi Lin, Jiangrong Wu, Yuhong Nan, Xueqiang Wang, Xinyuan Zhang, Zibin Zheng

专题命中 其他推理 :reasoning(abstract)

AI总结 AgentRaft通过程序分析与语义推理,自动检测LLM代理中的数据过度暴露风险,提升隐私保护效果。

Comments 26 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06855 2026-03-10 cs.HC 50%

What Does AI Do for Cultural Interpretation? A Randomized Experiment on Close Reading Poems with Exposure to AI Interpretation

人工智能在文化解读中扮演什么角色?一项关于接触人工智能解读的近读诗歌的随机实验

Jiayin Zhi, Hoyt Long, Richard Jean So, Mina Lee

专题命中 其他推理 :reasoning(abstract)

AI总结 本研究通过随机实验发现,单个AI解读能提升诗歌近读的表现和愉悦,而多个AI解读仅提升表现,揭示了AI辅助文化解读的'less is more'效果。

Comments CHI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏