STRuCT-LLM: Unifying Tabular and Graph Reasoning with Reinforcement Learning for Semantic Parsing
机构 * Novo Nordisk(诺华北欧)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
机构 * Novo Nordisk(诺华北欧)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
机构 * Rensselaer Polytechnic Institute(罗切斯特理工学院) ; The Chinese University of Hong Kong(香港中文大学) ; IBM Research(IBM研究院)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.LG
机构 * ByteDance(字节跳动) ; FuDan University(复旦大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
机构 * John F Kennedy High school Fremont, USA(约翰·F·肯尼迪高中弗里蒙特分校) ; Queensland Academy for Science Mathematics and Technology(昆士兰科学数学与技术学院) ; Research Spark Hub Inc(Research Spark Hub公司)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.LG
Comments 5 pages
机构 * Novo Nordisk(诺华北欧制药)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI、cs.LG
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI、cs.LG
Comments CVPR 2025 Main Conference
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.LG
Comments 43 pages,11 figures
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments 13 pages, 5 figures
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments COLING 2025
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.LG
Comments 16 pages, 9 figures
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments Accepted for publication in The 2023 Conference on Empirical Methods in Natural Language Processing (EMNLP 2023). Author's final version
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments Accepted to ACL 2024
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments 17 pages, 12 figures
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments NeurIPS 2023
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
Comments 25 pages, 8 figures, Accepted to EMNLP 2023
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.CL、cs.AI
大推理模型高效推理的综述:语言、多模态与更远的探索
机构 * Shanghai AI Laboratory(上海人工智能实验室) ; Soochow University(苏州大学) ; Westlake University(西湖大学) ; Peking University(北京大学) ; Tongji University(同济大学) ; The Hong Kong University of Science and Technology(香港科技大学) ; Tsinghua University(清华大学) ; Huazhong University of Science and Technology(华中科技大学) ; The Chinese University of Hong Kong(香港中文大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL
AI总结 本文综述了大推理模型在提升推理效率方面的最新研究,聚焦于语言、多模态及未来方向,旨在推动该领域的发展。
Comments Update recent RL papers. Project page: https://github.com/XiaoYee/Awesome_Efficient_LRM_Reasoning
上下文视觉-语言-动作模型:通过上下文后训练与智能体工具使用为视觉-语言-动作模型赋予语言能力
专题命中 其他推理 :CoT(summary_cn,abstract);reasoning(abstract);chain-of-thought(abstract)
AI总结 该研究针对现有VLA模型用CoT会降低控制性能的问题,提出通过上下文后训练和智能体工具使用赋予VLA语言能力的方法,在多模拟和真实机器人任务上实现SOTA性能与效率。
推理前的感知:面向视频理解与问答的动态隐式推理
机构 * Rice University(莱斯大学) ; Georgia Institute of Technology(佐治亚理工学院)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);分类 cs.AI
AI总结 该研究针对视频问答现有方法依赖长文本思维链的问题,提出DyLaR模型,通过动态调整感知与推理隐式变量的使用,在9个视频基准上提升准确率且缩短响应长度。
链式思维在探测时为何有效?局部共现而非全局推导
机构 * Huazhong University of Science and Technology(华中科技大学)
专题命中 其他推理 :chain-of-thought(title,abstract);reasoning(abstract);CoT(abstract);分类 cs.AI
AI总结 研究链式思维提示在探测时提升语言模型准确率的原因,发现增益主要来自词汇激活和短距离标记共现,而非句子级逻辑推导。
SCOReD:用于推荐蒸馏的学生感知思维链优化
机构 * University of California Riverside(加州大学河滨分校) ; Meta AI
专题命中 其他推理 :CoT(title,abstract);reasoning(abstract);chain-of-thought(abstract);分类 cs.AI
AI总结 研究针对推荐蒸馏中原始教师轨迹不适用于任务的问题,提出SCOReD框架,先解析教师轨迹片段并评分,再动态选择编辑操作,使轨迹适应学生输出分布,训练能为学生模型提供清晰信号,提升指标并减少推理长度。
Comments 31 pages
ThoughtFold: 通过内省偏好学习折叠推理链
机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) ; University of Science and Technology of China(中国科学技术大学) ; MMLab, The Chinese University of Hong Kong(香港中文大学MMLab)
专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.AI
AI总结 提出ThoughtFold框架,通过细粒度偏好学习惩罚冗余探索并鼓励直接连接关键推理段,将推理链折叠为更简洁路径,在保持精度的同时大幅降低token使用量。
R2IF: 通过复合奖励对齐推理与决策以实现可解释的LLM函数调用
机构 * Shanghai Key Laboratory of Trustworthy Computing, East China Normal University, Shanghai, China(上海可信计算实验室,华东师范大学,上海,中国) ; Huazhong University of Science and Technology(华中科技大学) ; Nanyang Technological University(南洋理工大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.LG
AI总结 提出R2IF框架,通过复合奖励(格式/正确性约束、思维链有效性奖励和规范-修改-价值奖励)和GRPO优化,对齐推理过程与工具调用决策,在BFCL/ACEBench上提升函数调用准确性和可解释性。
链条保持,答案翻转:对抗压力下推理模型中的痕迹-答案分离
机构 * Carnegie Mellon University(卡内基梅隆大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI
AI总结 本研究通过2×2潜在-行为框架发现推理模型在持续对抗压力下出现“不忠实屈服”故障模式,即思维链保持正确但答案错误,并验证了推理通道对此的影响。
监控内部独白:探测轨迹揭示推理动态
机构 * NASK - National Research Institute(国家研究 institute) ; Faculty of Electronics and Information Technology(电子与信息技术学院) ; Faculty of Mathematics and Computer Science(数学与计算机科学学院) ; Jagiellonian University(雅盖隆大学) ; Tooploox ; IDEAS Research Institute(IDEAS研究所) ; Gdańsk University of Technology(格但姆大学)
专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.CL
AI总结 本文研究了大型推理模型的内部推理动态,通过分析探测轨迹来提高监控可靠性,提出了一种基于信号处理特征的方法,显著提升了未来模型状态的分离能力。
ThinKV: 基于思维适应的KV缓存压缩以提高推理模型效率
机构 * Georgia Institute of Technology(佐治亚理工学院) ; NVIDIA Research(NVIDIA研究)
专题命中 其他推理 :reasoning(title,abstract);CoT(abstract,abstract_cn);分类 cs.LG
AI总结 本文提出ThinKV,通过混合量化-驱逐策略,根据思维重要性动态调整token精度,减少KV缓存占用,提升推理效率和吞吐量。
Comments ICLR 2026 (Oral)
Fake-HR1: 重新思考视觉语言模型在合成图像检测中的推理方式
机构 * Wuhan University(武汉大学) ; AntGroup(蚂蚁集团) ; Zhejiang University(浙江大学)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.AI
AI总结 Fake-HR1通过两阶段训练框架实现自适应推理,提升合成图像检测性能与效率,优于现有LLMs。
Comments Accepted by ICASSP 2026
语音大模型是上下文推理转录器
机构 * Microsoft Core AI(微软核心人工智能)
专题命中 其他推理 :reasoning(title,abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL
AI总结 本文提出CoT-ASR,通过构建推理链使大模型先分析语音生成上下文分析,从而提升语音识别性能,实验显示WER和EER分别降低8.7%和16.9%。