arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

2026-04-09 至 2026-04-09 共收录 102 信号源:cs.CL, cs.AI, cs.LG

1. 其他推理 15 篇

2604.06902 2026-04-09 cs.CL 77%

iTAG: Inverse Design for Natural Text Generation with Accurate Causal Graph Annotations

iTAG:基于准确因果图标注的自然文本生成逆向设计

Wenshuo Wang, Boyu Cao, Nan Zhuang, Wei Li

机构 * School of Future Technology, South China University of Technology(华南理工大学未来技术学院) China Mobile GBA Innovation Institute(中国移动粤港澳大湾区创新研究院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL

AI总结 iTAG通过逆向设计生成具有准确因果图标注的自然文本,提升生成文本的自然度与标注准确性,为因果发现算法提供实用的基准测试数据。

Comments Accepted at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06627 2026-04-09 cs.CL 70%

DiffuMask: Diffusion Language Model for Token-level Prompt Pruning

DiffuMask: 用于令牌级提示压缩的扩散语言模型

Caleb Zheng, Jyotika Singh, Fang Tu, Weiyi Sun, Sujeeth Bharadwaj, Yassine Benajiba, Sujith Ravi, Eli Shlizerman, Dan Roth

机构 * University of Washington(华盛顿大学) Oracle AI(甲骨文人工智能)

专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);分类 cs.CL

AI总结 DiffuMask通过迭代掩码预测实现快速并行提示压缩,保留关键推理上下文,实现80%的提示长度缩减,同时保持或提升准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17421 2026-04-09 cs.CL cs.AI cs.LG 67%

LongSpec: Long-Context Lossless Speculative Decoding with Efficient Drafting and Verification

LongSpec: 长上下文无损推测解码与高效草稿生成与验证

Penghui Yang, Cunxiao Du, Fengzhuo Zhang, Haonan Wang, Tianyu Pang, Chao Du, Bo An

机构 * Sea AI Lab(Sea AI实验室) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 LongSpec通过三种创新解决长上下文场景下的推测解码问题,实现3.26倍速度提升和2.25倍时间减少,适用于长上下文理解任务。

Comments Accepted by ACL'25 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06405 2026-04-09 cs.AI cs.DB 57%

BDI-Kit Demo: A Toolkit for Programmable and Conversational Data Harmonization

BDI-Kit Demo: 一个用于可编程和对话式数据协调的工具包

Roque Lopez, Yurong Liu, Christos Koutras, Juliana Freire

机构 * New York University(纽约大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 BDI-Kit通过Python API和AI辅助对话界面,解决数据协调中的异构问题,展示如何通过自动化匹配、AI推理和用户优化实现数据协调。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06330 2026-04-09 cs.CL 57%

STDec: Spatio-Temporal Stability Guided Decoding for dLLMs

STDec:基于时空稳定性的解码方法用于dLLMs

Yuzhe Chen, Jiale Cao, Xuyang Liu, Jin Xie, Aiping Yang, Yanwei Pang

机构 * Tianjin University(天津大学) Sichuan University(四川大学) Chongqing University(重庆大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 STDec通过结合空间和时间稳定性,改进dLLM解码,提升吞吐量并保持性能。

Comments Homepage: https://yzchen02.github.io/STDec

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.19225 2026-04-09 cs.DC cs.LG 57%

RLBoost: Harvesting Preemptible Resources for Cost-Efficient Reinforcement Learning on LLMs

RLBoost: 为在大语言模型上高效强化学习利用可中断资源

Yongji Wu, Xueshen Liu, Haizhong Zheng, Juncheng Gu, Beidi Chen, Z. Morley Mao, Arvind Krishnamurthy, Ion Stoica

机构 * UC Berkeley(加州大学伯克利分校) University of Michigan(密歇根大学) Google(谷歌) CMU(卡内基梅隆大学) University of Washington(华盛顿大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.LG

AI总结 RLBoost通过高效利用可中断GPU资源提升大语言模型强化学习的效率和成本效益,采用混合架构和三种关键技术实现状态less和 embarrassingly parallel的rollout阶段与可中断资源的匹配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20765 2026-04-09 cs.CV cs.AI 57%

Looking Beyond the Obvious: A Survey on Abstract Concept Recognition for Video Understanding

超越显而易见:视频理解中抽象概念识别的综述

Gowreesh Mago, Pascal Mettes, Stevan Rudinac

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文综述了视频理解中抽象概念识别的挑战与方法,强调基础模型的进步对高阶抽象理解的重要性,指出需结合多模态基础模型避免重复发明轮子。

Comments Accepted at IJCV

Journal ref International Journal of Computer Vision 134, 217 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20906 2026-04-09 cs.CL 57%

Soft Head Selection for Injecting ICL-Derived Task Embeddings

用于注入ICL衍生任务嵌入的软头部选择

Jungwon Park, Jimyeong Kim, Changin Choi, Wonjong Rhee

机构 * Department of Intelligence and Information, Seoul National University(首尔大学智能与信息系) Daegu Gyeongbuk Institute of Science and Technology(大邱庆北科学技术院) Samsung Advanced Institute of Technology, Samsung Electronics Co., Ltd(三星电子三星综合技术院)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出SITE方法,通过梯度选择任务相关的注意力头部,有效注入任务嵌入,优于现有方法并在多种任务中表现优异,参数使用更少。

Comments Accepted by ACL 2026 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07304 2026-04-09 cs.SE cs.AI 57%

Chatbot-Based Assessment of Code Understanding in Automated Programming Assessment Systems

基于聊天机器人的代码理解评估在自动化编程评估系统中的应用

Eduard Frankford, Erik Cikalleshi, Ruth Breu

机构 * University of Innsbruck(因斯布鲁克大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文探讨了聊天机器人在自动化编程评估中的应用,提出混合苏格拉底框架以整合对话验证,解决代码理解评估中的挑战。

Comments 12 pages, accepted for publication at CSEDU 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07121 2026-04-09 cs.HC cs.AI 57%

Mixed-Initiative Context: Structuring and Managing Context for Human-AI Collaboration

混合发起式上下文:为人类-人工智能协作结构和管理上下文

Haichang Li, Qinshi Zhang, Piaohong Wang, Zhicong Lu

机构 * George Mason University(乔治梅森大学) University of California, San Diego(加利福尼亚大学圣迭戈分校) City University of Hong Kong(香港城市大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出混合发起式上下文,通过结构化和可操作的交互对象,动态组织协作流程中的上下文,提升人机协作效率与可控性。

Comments 19 pages, 3 figures, 1 table. Appendix on pages 13-19 (main text is self-contained)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07116 2026-04-09 cs.CL 57%

Yale-DM-Lab at ArchEHR-QA 2026: Deterministic Grounding and Multi-Pass Evidence Alignment for EHR Question Answering

耶鲁-DM实验室参加ArchEHR-QA 2026:用于电子病历问答的确定性接地和多轮证据对齐

Elyas Irankhah, Samah Fodeh

机构 * Yale University(耶鲁大学)

专题命中 其他推理 :reasoning(abstract);分类 cs.CL

AI总结 本文提出确定性接地和多轮证据对齐方法,用于电子病历问答任务,通过模型多样性与投票策略提升性能,实验结果显示对齐准确率受限于推理能力。

Comments 9 pages, 2 figures. System description for ArchEHR-QA 2026 shared task

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09035 2026-04-09 cs.RO cs.AI cs.SY eess.SY 57%

ManeuverGPT Agentic Control for Safe Autonomous Stunt Maneuvers

ManeuverGPT 代理控制用于安全的自动驾驶特技动作

Shawn Azdam, Pranav Doma, Aliasghar Moj Arab

机构 * New York University(纽约大学) Tandon School of Engineering, New York University(纽约大学坦登工程学院) General Autonomy Inc.(通用自主公司) Azdam AI

专题命中 其他推理 :reasoning(abstract);分类 cs.AI

AI总结 本文提出ManeuverGPT框架,利用大语言模型代理生成并执行高动态特技动作,通过迭代提示法优化车辆控制参数,实现安全的J-turn等特技动作执行。

Comments 6 Pages, Submitted to IROS

详情

展开后加载摘要…

URL PDF HTML 收藏