Probabilistic Recursive Reasoning for Multi-Agent Reinforcement Learning
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
Comments ICLR 2019
AI 大模型
大模型数学、逻辑、规划、多步推理和测试时计算能力。
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
Comments ICLR 2019
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI、cs.LG
Comments 15 pages - fix broken pagination in v2
FAU参加2026年ImageCLEF多模态推理任务:鲁棒候选评分与简洁多语种视觉问答
机构 * Friedrich-Alexander-Universität Erlangen-Nürnberg(弗里德里希-亚历山大-埃尔兰根-纽伦堡大学)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG
AI总结 FAU提交的多模态推理系统,未做任务特定模型训练,在2026年ImageCLEF竞赛中,获Visual MCQ第三名、Visual OpenQA第一名,凸显推理工程的实用价值。
Comments 16 pages, 3 figures, 7 tables. CLEF 2026 Working Notes, ImageCLEF 2026 Multimodal Reasoning Task
MindClaw: 用于精确干预的闭环具身心理状态推理
机构 * Jilin University(吉林大学) ; Microsoft Asia(微软亚洲) ; National Taiwan University(国立台湾大学)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 提出MindClaw框架,通过闭环具身心理状态推理实现精确干预,结合多源输入、信念记忆、认知触发技能和动作生成,在动态环境中优化干预时机。
Comments Extended version of the CVPR 2026 paper *MindPower: Enabling Theory-of-Mind Reasoning in VLM-based Embodied Agents*. This work is in progress
立场:停止将中间令牌拟人化为推理/思考痕迹!
机构 * University of California, Berkeley(加州大学伯克利分校)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 本文论证将模型生成的中间令牌拟人化为“推理痕迹”或“思考痕迹”具有误导性,呼吁社区避免此类拟人化。
Comments Appears in ICML 2026. [This is a fork of v1. This fork, while overlapping with v1 in background section, differs both in the overall focus as well as the specific argument against anthropomorphization of reasoning traces]
Journal ref ICML 2026
OSS-CRS:解放AIxCC网络推理系统以应对现实中的开源安全
机构 * Georgia Institute of Technology(佐治亚理工学院) ; Microsoft(微软)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 OSS-CRS提出一个可本地部署的框架,用于运行和结合CRS技术,针对真实开源项目进行安全分析,并实现预算感知的资源管理。
Comments Version 1.1 (March 2026), OSS-CRS: an open-source framework for porting, deploying, and composing AIxCC cyber reasoning systems. Project page: https://github.com/ossf/oss-crs
嵌入空间中的几何推理
机构 * University of Ostrava(奥斯特拉瓦大学) ; Czech Technical University in Prague(布拉格捷克技术大学)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.LG
AI总结 本文提出通过图神经网络和变换器在嵌入空间中进行几何推理,证明其能有效恢复网格结构并优于变换器。
Comments published version of the article in English
Journal ref Mojzisek, D., Hula, J., Janecek, J., Herel, D., & Janota, M. (2025). Geometric Reasoning in the Embedding Space. Machine Learning and Knowledge Extraction, 7(3), 93
Monitor-Generate-Verify (MGV): 形式化语言模型推理的元认知理论
机构 * socius labs ; Centre for Philosophy of Natural and Social Science (CPNSS)(哲学自然与社会科学中心) ; London School of Economics(伦敦经济学院)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 MGV框架通过引入监控机制,弥补生成-验证范式中监控过程的缺失,以提升语言模型推理的准确性和鲁棒性。
Comments Presented at the Workshop on the Foundations of Reasoning in Language Models at NeurIPS 2025 (non-archival)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
Comments large language models, large vision-language model, reasoning, non-ideal conditions, reinforcement learning
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
Comments Large Language Model, Recommendation, Human-Interpretable Reasoning, Personalization
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL
Comments EMNLP Main 2024. Code, prompt templates, prompts, and outputs are publicly available at https://github.com/UKPLab/arxiv2024-conditional-reasoning-llms
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL
Comments This paper builds upon EIGEN (arXiv:2010.11764) and proposes a general framework for situational reasoning
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
Journal ref Proceedings of the 15th International Workshop on Non-Monotonic Reasoning (NMR 2014), Vienna, 1719 July, 2014
世界到手腕:面向精细机器人操作的任务条件未来手腕建模
机构 * The Hong Kong University of Science and Technology(香港科技大学) ; National University of Singapore(新加坡国立大学) ; Nanyang Technological University(南洋理工大学) ; Wuhan University(武汉大学) ; Sun Yat-sen University(中山大学) ; Xidian University(西安电子科技大学) ; Southeast University(东南大学)
专题命中 其他推理 :CoT(summary_cn,abstract)
AI总结 本研究提出W2-VLA模型,通过任务条件未来手腕建模结合W2-CoT辅助监督,在LIBERO等数据集及真实任务中提升了机器人精细接触敏感操作能力,动作生成速率超80Hz。
为什么思考有害:诊断并纠正大型语言模型在推荐中的语言惯性
专题命中 其他推理 :CoT(abstract,abstract_cn);reasoning(abstract);chain-of-thought(abstract)
AI总结 本文发现链式思维推理在推荐模型中会导致性能下降,归因于语言惯性,并提出无需训练的语言惯性校准解码(LICD)框架,通过推理链压缩和偏差相减对比推理来缓解该问题。
机构 * Team Project Leader(团队项目负责人)
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG
Comments update template
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 20 pages, ICML 2024 Camera Ready Version
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ICLR 2024 AGI Workshop Poster
专题命中 其他推理 :reasoning(abstract);chain-of-thought(abstract);CoT(abstract);分类 cs.CL、cs.AI、cs.LG
Comments NAACL 2024
洞察学生的思维:在LLM学生模拟器中联合建模潜在推理与行动
机构 * University of California, Berkeley(加利福尼亚大学伯克利分校)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 该研究针对LLM学生模拟器仅复现学生行动却未捕捉其潜在推理的问题,提出INSIDE框架,通过在配对思考轨迹与行动上微调LLM,提升了模拟行动保真度与推理对齐度,最高对齐度达57.9%。
Comments Accepted at the Conference on Language Modeling (COLM) 2026
UniTraffic-Agent:面向2026年AI城市挑战赛第3赛道的统一交通视频推理,含两项域外评估
机构 * School of Computer Science and Technology, University of Chinese Academy of Sciences (UCAS)(中国科学院大学计算机科学与技术学院) ; Institute of Computing Technology (ICT), Chinese Academy of Sciences (CAS)(中国科学院计算技术研究所) ; Beijing Academy of Artificial Intelligence (BAAI)(北京智源人工智能研究院) ; School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 UniTraffic-Agent是第10届AI城市挑战赛第3赛道的MR-CAS解决方案,采用观察-推理-行动-验证工作流,在TAR、FETV、PSI-VQA三项任务中取得相应排名,为交通视频推理提供了新方案。
Comments This paper has been accepted to ECCV 2026 AI City Challenge Workshop
聚焦推理,推断出异常:通过贝叶斯推理引导的聚焦VLM推理实现高速公路视频远场异常检测
机构 * School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) ; Key Laboratory of Big Data & Artificial Intelligence in Transportation, Ministry of Education(教育部交通运输大数据与人工智能重点实验室) ; Beijing Key Laboratory of Traffic Data Mining and Embodied Intelligence (2018)(北京市交通数据挖掘与具身智能重点实验室)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 本文提出VIBES框架,通过贝叶斯推理引导的聚焦VLM推理,解决远场目标异常检测中的注意力稀释和计算成本问题,提升检测准确性和实时效率。
扩散语言模型可以按EoS进行思考
机构 * Faculty of Computer Science, University of Vienna(维也纳大学计算机科学系) ; UniVie Doctoral School Computer Science, University of Vienna(维也纳大学计算机科学博士学院)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL
AI总结 研究发现扩散语言模型通过EoS标记进行推理,通过实验验证EoS标记作为隐藏计算空间的作用。
Pandora:利用代码驱动的知识迁移实现统一结构化知识推理
机构 * Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University), Ministry of Education(新一代人工智能技术及交叉应用重点实验室(东南大学)) ; China Mobile Research(中国移动研究院) ; Monash University(莫纳什大学)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL
AI总结 本文提出Pandora框架,采用Python的Pandas API构建统一知识表示,结合代码驱动的知识迁移,在六个基准测试中优于现有统一推理框架。
Comments Accepted in IEEE TKDE (2026)
思想树(Tree-of-Ideas):基于学术演化跨轨迹推理的自动化研究构想生成
机构 * Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东省人工智能与数字经济实验室(深圳)) ; University of Melbourne(墨尔本大学) ; University of Sydney(悉尼大学) ; Shenzhen University(深圳大学) ; Nanyang Technological University(南洋理工大学) ; Tsinghua University(清华大学) ; Tencent Youtu Lab, Tencent(腾讯腾讯云图实验室)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 该研究提出两阶段框架Tree-of-Ideas,通过重构学术轨迹并跨轨迹推理生成研究构想,在6个人工智能主题上的自动方法中得分最高,接近人类水平。
当批评如何提升AI辅助理论物理?SCALAR:用于代理推理的结构化批评-代理循环
机构 * Department of Physics, CCTP ; ITCP, University of Crete, 71303, Greece ; Centre for Theoretical Physics, Department of Physics ; Astronomy, Queen Mary University of London, London E1 4NS, United Kingdom ; Theoretical Physics Department, CERN, Geneva, Switzerland
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 本文研究了研究人员与代理交互对AI辅助理论物理研究的影响,通过SCALAR框架评估不同交互结构对科学发现的促进作用。
Comments V2. Expanded experiments. Accepted at ICML 2026 Workshop (AI4Physics); 18 pages; 9 figures
用于检索增强推理、物体感知与损伤分析的集成多模态AI系统
机构 * City College of New York(纽约城市学院) ; Air Force Research Lab(空军研究实验室)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 本研究提出整合RAG、热谱感知等技术的多模态AI系统,用于损伤评估,通过多模块对比实验验证了其在提升推理准确性、鲁棒性及跨场景检测方面的优势。
EMMR:异步视频面试中用于人格评估的情绪介导多模态推理
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 该研究针对异步视频面试人格评估中以文本为中心的方法忽略非言语线索的问题,提出EMMR框架,在OPVA和AVI-6数据集上提升了MAE、MSE和PCC,证明整合情绪线索可优化评估效果。
评估推理模型中的心理理论:推理的鲁棒性
机构 * Leiden University(莱顿大学) ; LIACS(莱顿高级计算机科学研究所)
专题命中 其他推理 :reasoning(title,abstract);分类 cs.CL
AI总结 本研究考察经强化学习训练的推理LLMs在ToM任务中的表现,发现其对提示与任务扰动的鲁棒性提升,支持鲁棒性解释而非ToM特有的新能力。
Comments Accepted for 29th International Conference on Discovery Science, October 5-9, 2026, Mainz, Germany
迈向人工智能法律智能的新推理语法:以《梅塞莱法典》作为其语义协议
专题命中 其他推理 :reasoning(title,abstract);分类 cs.AI
AI总结 本文针对传统法律实践的认知与方法论危机,提出以《梅塞莱法典》语义协议为核心的本体动态框架,指出法律推理不可简化为数据处理,需结合神经符号系统等技术解决法律挑战,为AI时代法律推理提供新范式。
Comments 123 pages