arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 5804 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 5804 篇

2603.27522 2026-03-31 cs.CL cs.CR cs.LG 73%

Hidden Ads: Behavior Triggered Semantic Backdoors for Advertisement Injection in Vision Language Models

隐性广告:用于视觉语言模型中广告注入的行为触发语义后门

Duanyi Yao, Changyue Li, Zhicong Huang, Cheng Hong, Songze Li

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.LG

AI总结 本文提出隐性广告攻击,通过用户行为触发在视觉语言模型中注入未经授权的广告,利用自然用户行为实现高效且隐蔽的广告注入,同时评估了不同防御方法的失效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13719 2026-03-31 cs.CV cs.AI cs.LG cs.MM cs.RO 73%

Scaling Spatial Intelligence with Multimodal Foundation Models

通过多模态基础模型提升空间智能

Zhongang Cai, Ruisi Wang, Chenyang Gu, Fanyi Pu, Junxiang Xu, Yubo Wang, Wanqi Yin, Zhitao Yang, Chen Wei, Qingping Sun, Tongxi Zhou, Jiaqi Li, Hui En Pang, Oscar Qian, Yukun Wei, Zhiqian Lin, Xuanke Shi, Kewang Deng, Xiaoyang Han, Zukai Chen, Xiangyu Fan, Hanming Deng, Lewei Lu, Liang Pan, Bo Li, Ziwei Liu, Quan Wang, Dahua Lin, Lei Yang

机构 * SenseTime Research(商汤科技研究院) Nanyang Technological University(南洋理工大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 本文通过构建SenseNova-SI家族,利用八百万多样数据样本提升空间智能,在多个基准测试中取得优异成绩,并分析数据扩展的影响及潜在应用。

Comments Codebase: https://github.com/OpenSenseNova/SenseNova-SI ; Models: https://huggingface.co/collections/sensenova/sensenova-si . This report is based on the v1.1 version of SenseNova-SI. Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15981 2026-03-18 cs.CL cs.AI 73%

Aligning Paralinguistic Understanding and Generation in Speech LLMs via Multi-Task Reinforcement Learning

通过多任务强化学习对齐语音大语言模型中的语用理解和生成

Jingxiang Chen, Minseok Kim, Seong-Gyun Leem, Yin Huang, Rashi Rungta, Zhicheng Ouyang, Haibin Wu, Surya Teja Appini, Ankur Bansal, Yang Bai, Yue Liu, Florian Metze, Ahmed A Aly, Anuj Kumar, Ariya Rastrow, Zhaojiang Lin

机构 * Meta Reality Labs(Meta现实实验室)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 本文提出通过多任务强化学习提升语音大语言模型对语用信息的理解与生成,实验表明在多个数据集上比监督模型和 proprietary 模型提升了8-12%的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12038 2026-03-13 cs.LG cs.AI 73%

Slow-Fast Inference: Training-Free Inference Acceleration via Within-Sentence Support Stability

慢-快推理:通过句内支持稳定性实现无需训练的推理加速

Xingyu Xie, Zhaochen Yu, Yue Liao, Tao Wang, Kim-Chuan Toh, Shuicheng Yan

机构 * National University of Singapore(新加坡国立大学) ByteDance(字节跳动)

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG

AI总结 SFI通过利用句内支持稳定性,将生成过程分为快速低成本步骤和偶尔的密集注意力慢步骤,从而提高解码吞吐量并保持质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02090 2026-03-02 cs.CL cs.AI 73%

LEC-KG: An LLM-Embedding Collaborative Framework for Domain-Specific Knowledge Graph Construction -- A Case Study on SDGs

LEC-KG: 一种基于大语言模型嵌入的领域知识图谱构建协作框架——以可持续发展目标为例

Yikai Zeng, Yingchao Piao, Changhua Pei, Jianhui Li

机构 * Computer Network Information Center, Chinese Academy of Sciences(中国科学院计算机网络信息中心)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 LEC-KG通过结合大语言模型与知识图谱嵌入的双向协作框架,有效解决领域知识图谱构建中的长尾关系问题,提升低频关系的识别与验证能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04942 2026-02-17 cs.LG cs.AI 73%

Privileged Information Distillation for Language Models

特权信息蒸馏用于语言模型

Emiliano Penaloza, Dheeraj Vattikonda, Nicolas Gontier, Alexandre Lacoste, Laurent Charlin, Massimo Caccia

机构 * McGill University(麦吉尔大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 本文提出π-Distill和OPSD两种方法,通过特权信息蒸馏提升语言模型在复杂代理环境中的表现,优于传统监督微调加强化学习的方法。

Comments Abstract border should have been purple

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.00197 2026-02-04 q-bio.QM cs.AI cs.CL 73%

Rank-and-Reason: Multi-Agent Collaboration Accelerates Zero-Shot Protein Mutation Prediction

Rank-and-Reason: 多智能体协作加速零样本蛋白质突变预测

Yang Tan, Yuanxi Yu, Can Wu, Bozitao Zhong, Mingchen Li, Guisheng Fan, Jiankang Zhu, Yafeng Liang, Nanqing Dong, Liang Hong

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Southern University of Science(南方大学(科学)) East China University of Science and Technology(东中国科学与技术大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 Rank-and-Reason通过多智能体协作提升零样本蛋白质突变预测的准确性与效率,显著提高湿实验验证的成功率。

Comments 22 pages, 5 figures, 15 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16815 2026-01-27 cs.CL cs.AI 73%

Knowing the Facts but Choosing the Shortcut: Understanding How Large Language Models Compare Entities

知晓事实却选择捷径:理解大型语言模型如何比较实体

Hans Hergen Lehmann, Jae Hee Lee, Steven Schockaert, Stefan Wermter

机构 * University of Hamburg(汉堡大学) Cardiff University(卡迪夫大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

AI总结 研究发现大型语言模型在比较实体时更依赖数值知识,而小型模型则受启发式偏差影响,通过链式思考提示可引导模型更依赖数值特征。

Comments 34 pages, 20 figures. Accepted for EACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11200 2026-01-19 cs.LG cs.AI 73%

FAQ: Mitigating Quantization Error via Regenerating Calibration Data with Family-Aware Quantization

FAQ: 通过家庭感知量化减少量化误差

Haiyang Xiao, Weiqing Li, Jinyue Guo, Guochao Jiang, Guohua Liu, Yuewei Zhang

机构 * Alibaba Cloud Computing(阿里云计算)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 FAQ通过家庭感知量化方法生成高保真校准数据,有效减少量化误差,实验表明其在多个模型系列中将准确性损失降低28.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03534 2026-01-08 cs.CL cs.CV cs.HC cs.LG 73%

Persona-aware and Explainable Bikeability Assessment: A Vision-Language Model Approach

具有人格意识和可解释性的自行车适应性评估:一种视觉-语言模型方法

Yilong Dai, Ziyi Wang, Chenguang Wang, Kexin Zhou, Yiheng Qian, Susu Xu, Xiang Yan

机构 * University of Alabama(阿拉巴马大学) University of Maryland, College Park(马里兰大学学院公园分校) Stony Brook University(石溪大学) University of Florida(佛罗里达大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种视觉-语言模型框架,通过人格意识和可解释性方法评估自行车适应性,解决道路环境复杂性和用户感知异质性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24125 2025-12-11 cs.LG cs.AI 73%

The Impossibility of Inverse Permutation Learning in Transformer Models

Transformer模型中反排列学习的不可能性

Rohan Alur, Chris Hays, Manish Raghavan, Devavrat Shah

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

AI总结 Transformer模型中反排列学习的不可能性,通过解码器-only架构的表达能力限制,提出通过添加空白标记实现可行的替代方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04527 2025-11-07 cs.CL cs.AI 73%

Are language models aware of the road not taken? Token-level uncertainty and hidden state dynamics

Amir Zur, Atticus Geiger, Ekdeep Singh Lubana, Eric Bigelow

机构 * Department of Linguistics, Stanford University(斯坦福大学语言学系) Department of Psychology, Harvard University(哈佛大学心理学系) Center for Brain Science, Harvard University(哈佛大学脑科学中心) Physics of Intelligence Group, NTT Research(NTT研究物理智能小组)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18293 2025-11-06 cs.CL cs.AI cs.CY 73%

Evaluating Large Language Models for Detecting Antisemitism

Jay Patel, Hrudayangam Mehta, Jeremy Blackburn

机构 * Binghamton University(宾夕法尼亚州立大学)

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10142 2025-11-04 cs.CL cs.AI 73%

Debiasing LLMs by Masking Unfairness-Driving Attention Heads

Tingxu Han, Wei Song, Ziqi Ding, Ziming Li, Chunrong Fang, Yuekang Li, Dongfang Liu, Zhenyu Chen, Zhenting Wang

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05777 2025-11-04 cs.CL cs.AI cs.CY 73%

Medical Hallucinations in Foundation Models and Their Impact on Healthcare

Yubin Kim, Hyewon Jeong, Shan Chen, Shuyue Stella Li, Chanwoo Park, Mingyu Lu, Kumail Alhamoud, Jimin Mun, Cristina Grau, Minseok Jung, Rodrigo Gameiro, Lizhou Fan, Eugene Park, Tristan Lin, Joonsik Yoon, Wonjin Yoon, Maarten Sap, Yulia Tsvetkov, Paul Liang, Xuhai Xu, Xin Liu, Chunjong Park, Hyeonhoon Lee, Hae Won Park, Daniel McDuff, Samir Tulebaev, Cynthia Breazeal

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard Medical School(哈佛医学院) University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学) Seoul National University Hospital(首尔国立大学医院) Google Research(谷歌研究) Google DeepMind(谷歌DeepMind) Columbia University(哥伦比亚大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.00339 2025-10-14 cs.CL cs.AI 73%

VNJPTranslate: A comprehensive pipeline for Vietnamese-Japanese translation

Hoang Hai Phan, Nguyen Duc Minh Vu, Nam Dang Phuong

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

Comments The paper contains a critical error in Section 3.1, leading to invalid results in Section 3.3. This undermines the main conclusion of the paper. The authors are working on a corrected version, but in the meantime, there is not a quick fix/replacement/update available

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.09776 2025-10-14 cs.LG cs.AI stat.ML 73%

Why Do Transformers Fail to Forecast Time Series In-Context?

Yufa Zhou, Yixiao Wang, Surbhi Goel, Anru R. Zhang

机构 * Duke University(杜克大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG

Comments Code: https://github.com/MasterZhou1/ICL-Time-Series

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16429 2025-09-29 cs.CL cs.AI 73%

Beyond Static Testbeds: An Interaction-Centric Agent Simulation Platform for Dynamic Recommender Systems

Song Jin, Juntian Zhang, Yuhan Liu, Xun Zhang, Yufei Zhang, Guojun Yin, Fei Jiang, Wei Lin, Rui Yan

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院) Meituan(美团) Wuhan University(武汉大学)

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments EMNLP2025 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05714 2025-09-11 cs.CL cs.AI 73%

HIRAG: Hierarchical-Thought Instruction-Tuning Retrieval-Augmented Generation

YiHan Jiao, ZheHao Tan, Dan Yang, DuoLin Sun, Jie Feng, Yue Shen, Jian Wang, Peng Wei

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18556 2025-08-26 cs.CL cs.AI 73%

Exploring the Vulnerability of the Content Moderation Guardrail in Large Language Models via Intent Manipulation

Jun Zhuang, Haibo Jin, Ye Zhang, Zhengjian Kang, Wenbin Zhang, Gaby G. Dagher, Haohan Wang

机构 * Boise State University(博伊州立大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Pittsburgh(匹兹堡大学) New York University(纽约大学) Florida International University(佛罗里达国际大学)

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments Accepted for EMNLP'25 Findings. TL;DR: We propose a new two-stage intent-based prompt-refinement framework, IntentPrompt, that aims to explore the vulnerability of LLMs' content moderation guardrails by refining prompts into benign-looking declarative forms via intent manipulation for red-teaming purposes

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.10115 2025-08-15 cs.LG cs.AI 73%

Less is More: Learning Graph Tasks with Just LLMs

Sola Shirai, Kavitha Srinivas, Julian Dolby, Michael Katz, Horst Samulowitz, Shirin Sohrabi

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08651 2025-08-12 cs.CL cs.AI 73%

Chain of Thought Still Thinks Fast: APriCoT Helps with Thinking Slow

Kyle Moore, Jesse Roberts, Thao Pham, Douglas Fisher

机构 * Vanderbilt University(范德比大学) Tennessee Technological University(田纳西技术大学) Berea College(贝拉学院)

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments Final version. Published In Proceedings of the Annual Meeting of the Cognitive Science Society (Vol. 47) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13444 2025-07-16 cs.CL cs.AI 73%

Fine-grained Stateful Knowledge Exploration: Effective and Efficient Graph Retrieval with Large Language Models

Dehao Tao, Congqi Wang, Feng Huang, Junhao Chen, Yongfeng Huang, Minghu Jiang

机构 * Tsinghua University(清华大学) Xinjiang University(新疆大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.14337 2025-07-08 cs.LG cs.CL 73%

PENCIL: Long Thoughts with Short Memory

Chenxiao Yang, Nathan Srebro, David McAllester, Zhiyuan Li

机构 * Toyota Technological Institute at Chicago(丰田技术研究所(芝加哥))

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.CL、cs.LG

Comments Accepted to ICML 2025. Codes in https://github.com/chr26195/PENCIL

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16393 2025-06-23 cs.CL cs.AI 73%

From LLM-anation to LLM-orchestrator: Coordinating Small Models for Data Labeling

Yao Lu, Zhaiyuan Ji, Jiawei Du, Yu Shanqing, Qi Xuan, Tianyi Zhou

机构 * Zhejiang University of Technology(之江大学) Agency for Science, Technology and Research(科技研究局)

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06009 2025-06-09 cs.CL cs.AI 73%

Unlocking Recursive Thinking of LLMs: Alignment via Refinement

Haoke Zhang, Xiaobo Liang, Cunxiang Wang, Juntao Li, Min Zhang

机构 * Soochow University(苏州大学) Zhipu AI(智谱AI) Tsinghua University(清华大学) Key Laboratory of Data Intelligence and Advanced Computing, Soochow University(苏州大学数据智能与先进计算重点实验室)

专题命中 其他推理 :reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI

Comments Accepted to the Findings of ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23848 2025-06-02 cs.CL cs.LG 73%

Derailing Non-Answers via Logit Suppression at Output Subspace Boundaries in RLHF-Aligned Language Models

Harvey Dam, Jonas Knochelmann, Vinu Joseph, Ganesh Gopalakrishnan

专题命中 其他推理 :chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15554 2025-05-22 cs.CL cs.AI 73%

DayDreamer at CQs-Gen 2025: Generating Critical Questions through Argument Scheme Completion

Wendi Zhou, Ameer Saadat-Yazdi, Nadin Kökciyan

机构 * School of Informatics, University of Edinburgh(信息学院,爱丁堡大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

Comments ArgMining 2025 CQs-Gen shared task

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.04174 2025-05-21 cs.LG cs.AI cs.NI eess.SP 73%

On-Device LLM for Context-Aware Wi-Fi Roaming

Ju-Hyung Lee, Yanqing Lu, Klaus Doppler

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.07858 2025-05-14 cs.CL cs.AI 73%

Scaling Laws for Speculative Decoding

Siyuan Yan, Mo Zhu, Guo-qing Jiang, Jianfei Wang, Jiaxing Chen, Wentai Zhang, Xiang Liao, Xiao Cui, Chen Zhang, Zhuoran Song, Ran Zhu

机构 * Red Note Hi-Lab(红笔记高研实验室) Shanghai Jiaotong University(上海交通大学) Nanjing University(南京大学) Zhejiang University(浙江大学) Chinese University of Hong Kong(香港中文大学)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL、cs.AI

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏