arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

大模型推理能力

大模型数学、逻辑、规划、多步推理和测试时计算能力。

共收录 854 信号源:cs.CL, cs.AI, cs.LG

1. 规划推理 854 篇

2606.27596 2026-06-29 cs.CV cs.AI 新提交 57%

Dismantling Pathological Shortcuts: A Causal Framework for Faithful LVLM Decoding

拆除病理性捷径:忠实LVLM解码的因果框架

Liu Yu, Can Chen, Ping Kuang, Zhikun Feng, Fan Zhou, Gillian Dobbie

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出Fox框架,通过视觉注意力熵探针定位风险中介头,利用数值logit饱和进行因果干预,并结合冲突门控协同解码,消除视觉语言模型中的对象幻觉,实现忠实解码。

Comments 29 pages, 25 figures. Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26204 2026-06-29 cs.LG 新提交 57%

Topology-Informed Neural Networks for Flood Detection in Optical and Synthetic Aperture Radar Imagery

拓扑信息神经网络用于光学和合成孔径雷达影像的洪水检测

Sophia Li, Max Zhao, Raghu G. Raj, Tianyu Chen

机构 * US Naval Research Laboratory(美国海军研究实验室) Stanford University(斯坦福大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 针对云遮挡导致光学卫星图像难以检测洪水的问题,提出将拓扑数据分析(TDA)提取的拓扑特征融入神经网络,在SEN12-FLOOD数据集上实现更鲁棒和可解释的洪水检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27188 2026-06-26 cs.AI 新提交 57%

A Process Harness for Uplifting Legacy Workflows to Agentic BPM: Design and Realization in CUGA FLO

一种将遗留工作流提升为智能体BPM的过程驾驭框架:在CUGA FLO中的设计与实现

Fabiana Fournier, Lior Limonad

机构 * IBM SIL, Israel(IBM 研究实验室,以色列) Department of Information Systems, Faculty of Computer & Information Sciences, University of Haifa(海法大学计算机与信息科学学院信息系统系)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出过程驾驭框架,通过策略驱动的智能体层在不替换工作流引擎的情况下将遗留工作流升级为智能体BPM,并基于TDF模型在CUGA FLO中实现,通过三种智能体类型和钩子机制实现指令性与规范性需求的统一。

Comments 24 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26981 2026-06-26 cs.RO cs.AI 新提交 57%

In-Context Model Predictive Generation: Open-Vocabulary Motion Synthesis from Language Models to Physics

上下文模型预测生成:从语言模型到物理的开放词汇运动合成

Xiaomeng Fu, Junfan Lin, Yang Liu, Yaowei Wang, Guanbin Li, Liang Lin, Ziliang Chen

机构 * School of Computer Science and Engineering, Sun Yat-sen University(中山大学计算机科学与工程学院) Department of Networked Intelligence, Peng Cheng Laboratory(鹏城实验室网络智能部) School of Computer Science and Engineering, Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)计算机科学与工程学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出ICMPG框架,结合语言模型规划与推理时物理反馈,通过上下文感知运动生成和模型预测生成模块实现语义忠实且物理合理的开放词汇运动合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26700 2026-06-26 cs.RO cs.AI 新提交 57%

Learning Motion Feasibility from Point Clouds in Cluttered Environments

从杂乱环境中的点云学习运动可行性

Sajid Ansari, Arthi, Girish Varma, Antony Thomas

机构 * International Institute of Information Technology Hyderabad(国际信息技术学院海得拉巴)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出直接从RGB-D观测学习7自由度机械臂运动可行性预测的方法,构建包含270万抓取可行性标签的大规模基准,并评估三种分类器架构,最佳模型GRASPFC-PTX在新型物体上AUROC达0.996且预测速度远超基于采样的运动规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26590 2026-06-26 cs.LG cs.CR 新提交 57%

Empirical Software Engineering TerraProbe: A Layered-Oracle Framework for Detecting Deceptive Fixes in LLM-Assisted Terraform

实证软件工程 TerraProbe: 用于检测LLM辅助Terraform中欺骗性修复的分层Oracle框架

Manar Alsaid, Chimdumebi Nebolisa, Faris Abbas

机构 * East Texas A&M University(东德克萨斯农工大学) Texas Woman’s University(德克萨斯女子大学)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 提出TerraProbe五层Oracle框架,评估LLM辅助Terraform安全修复,发现71.4%的真实修复为欺骗性修复,并建立四维欺骗性修复分类法。

Comments 34 pages, 12 figures, 14 tables. Journal-first manuscript submitted to Empirical Software Engineering. Primary classification: cs.SE; cross-list: cs.CR

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26346 2026-06-26 cs.AI 新提交 57%

How Do Tool-Augmented LLM Agents Perform on Real-World Energy Analytics Tasks?

工具增强的LLM智能体在真实世界能源分析任务中的表现如何?

David Akinpelu, Akintonde Abbas, Rereloluwa Alimi, Ayodeji Lana

机构 * Independent Researcher(独立研究员) Tume AI

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 针对能源领域缺乏智能体评估基准的问题,构建了包含243个专家策划问题的测试环境,评估工具增强的LLM智能体在数据检索、知识解释和定量建模三类任务上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25358 2026-06-25 cs.AI cs.MA 新提交 57%

Agentic Knowledge Tracing: A Multi-Agent LLM Architecture for Stealth Assessment of Financial Literacy in Serious Games

Agentic知识追踪:用于严肃游戏中金融素养隐形评估的多智能体大语言模型架构

Gabriel Santos, Rita Julia, Marcelo Nascimento

机构 * Federal University of Uberlândia Computer Science Faculty(伯南布哥联邦大学计算机科学学院)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出多智能体大语言模型架构Agentic BKT,通过四阶段流程从严肃游戏事件中隐形评估金融素养,实验表明其预测效度显著优于单智能体基线。

Comments 8 pages, 5 figures, IEEE CoG 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25098 2026-06-25 cs.DC cs.AI cs.PF cs.SY eess.SY 新提交 57%

Power-Flexible AI Data Centers: A New Paradigm for Grid-Responsive Compute

灵活功率的AI数据中心:一种电网响应式计算的新范式

Chris Williams, Philip Colangelo, Ayse Coskun, Ethan Levine, Andy Neale, Ciaran Roberts, Shayan Sengupta, Nikhil Shirolkar, Varun Sivaram, Sarah Soares, Ethan Tiao, Scott Underwood, Daniel Wilson, Frank Sharp, Luke Wainwright, Harry Petty, Scott Wallace, Brandon Records

机构 * Emerald AI Electric Power Research Institute (EPRI)(电力研究研究院) National Grid(国家电网) NVIDIA Oracle

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文提出将GPU集群作为电网交互式资产,通过软件编排实现负载快速削减、持续降载和碳感知运行,同时保持优先级任务服务水平,并实现跨地理集群的性能感知负载迁移。

Comments 14 pages, 7 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24889 2026-06-25 cs.CL cs.SD 新提交 57%

Graph-Based Phonetic Error Correction of Noisy ASR

基于图的噪声ASR语音错误纠正

Pratik Rakesh Singh, Mohammadi Zaki, Aneesh Mukkamala, Pankaj Wasnik

机构 * Sony Research India(索尼印度研究院)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出G-SPIN框架,结合图神经网络构建音近候选集,并用掩码语言模型和指令调优大语言模型进行上下文重排序,以纠正ASR中结构化的音近错误。

Comments Accepted at ACL Industry Track 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24842 2026-06-24 cs.AI 新提交 57%

World Models in Pieces: Structural Certification for General Agents

分片世界模型:通用智能体的结构化认证

Yikai Lu, Yifei Wu, Xinyu Lu, Tongxin Li

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen, Shenzhen, China(香港中文大学(深圳)数据科学学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 针对通用智能体在大世界场景下无法普遍胜任的问题,提出结构化认证框架,通过深度组合目标过滤特定转移,证明世界模型具有O(1/n)+O(δ)误差界,实现可认证部署。

Comments 30 pages, camera-ready version in ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24143 2026-06-24 cs.LG 新提交 57%

AsyncOPD: How Stale Can On-Policy Distillation Be?

AsyncOPD:同策略蒸馏可以有多陈旧?

Wonjun Kang, Kevin Galim, Seunghyuk Oh, Minjun Kang, Sanghyun Park, Donghoon Kim, Minjae Lee, Minseo Kim, Rishabh Tiwari, Yuchen Zeng, Hyung Il Koo, Kangwook Lee

机构 * FuriosaAI Ajou University(亚洲大学) UC Berkeley(加州大学伯克利分校) Microsoft Research(微软研究院) KRAFTON Ludo Robotics

专题命中 规划推理 :reasoning(abstract);分类 cs.LG

AI总结 研究异步同策略蒸馏中陈旧数据的影响,发现前向KL对陈旧更鲁棒,反向KL脆弱但可通过重算信号缓解,并提出AsyncOPD框架实现1.6-3.8倍加速。

Comments Code: https://github.com/furiosa-ai/async-opd

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23983 2026-06-24 cs.CR cs.AI cs.LO cs.MA 新提交 57%

Maestro Order: A Model-Agnostic Orchestration Harness

Maestro Order: 一种模型无关的编排框架

Hidayet Aksu

专题命中 规划推理 :verifier(abstract);分类 cs.AI

AI总结 提出Maestro Order框架,通过分解、集成、验证和递归四种原语组合模型,并利用预算感知控制器分配计算资源,将不可靠的求解器转化为可靠的问题解决系统,显著提升可靠性。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23585 2026-06-23 cs.MA cs.AI cs.ET cs.RO cs.SY eess.SY 新提交 57%

Decentralized Autonomous Traffic Management through Corridor Networks

通过走廊网络的去中心化自主交通管理

Jasmine Jerry Aloor, Aadarsh Govada, Hamsa Balakrishnan

机构 * Department of Aeronautics and Astronautics(航空航天系) Massachusetts Institute of Technology(麻省理工学院) University of Maryland(马里兰大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 针对高密度自主航空交通,提出基于多智能体强化学习的去中心化走廊网络交通流管理方法,零样本迁移至复杂网络,无需集中协调或重训练。

Comments Presented at the Second US-Europe Air Transportation Research and Development Symposium (ATRDS2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23348 2026-06-23 cs.LG 新提交 57%

Superhuman AI for Generals.io Using Self-Play Reinforcement Learning

基于自我对弈强化学习的Generals.io超人类AI

Matej Straka, Viliam Lisý, Martin Schmid

机构 * Department of Applied Mathematics, Charles University(查尔斯大学应用数学系) Department of Computer Science, Faculty of Electrical Engineering, Czech Technical University in Prague(捷克理工大学电气工程学院计算机科学系) EquiLibre Technologies, Inc.(EquiLibre Technologies公司)

专题命中 规划推理 :planning(abstract);分类 cs.LG

AI总结 通过自研JAX模拟器(单GPU每秒千万帧,提速万倍)和自对弈策略梯度训练视觉Transformer,在实时策略游戏Generals.io中达到超人类水平,1v1排行榜第一,对顶级人类玩家胜率199-70。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22992 2026-06-23 cs.CL 新提交 57%

Predicate Importance Estimation and Decoupled Rationale-Score Distillation for Entity Alignment

谓词重要性估计与解耦理由-分数蒸馏用于实体对齐

Keunha Kim, Yoonjin Jang, Hyeon-gu Lee, Sihyung Kim, Youngjoong Ko

机构 * SungKyunKwan University(成均馆大学) NAVER

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出谓词重要性估计和解耦理由-分数蒸馏两个模块,通过谓词感知嵌入和蒸馏小语言模型提升知识图谱实体对齐性能,并利用分数与理由的不一致实现人机协同验证。

Comments 12 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22082 2026-06-23 cs.SE cs.AI 新提交 57%

CodeTeam: An LLM-Powered Multi-Agent Framework for Repository-Level Code Generation

CodeTeam: 一个基于LLM的多智能体框架用于仓库级代码生成

Yifei Wang, Ruiyin Li, Peng Liang, Qiong Feng, Zengyang Li, Mojtaba Shahin, Arif Ali Khan

机构 * School of Computer Science, Wuhan University(武汉大学计算机学院) School of Computer Science, Nanjing University of Science and Technology(南京理工大学计算机学院) School of Computer Science, Central China Normal University(中央财经大学计算机学院) School of Computing Technologies, RMIT University(皇家墨尔本理工学院计算技术学院) M3S Research Group, SEIS Unit, University of Oulu(奥卢大学M3S研究组,SEIS单元)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出CodeTeam框架,通过分离规划、决策和实现阶段,结合多智能体协作与依赖感知调度,解决仓库级代码生成中的长程规划与跨文件一致性问题,在SketchEval和NL2Repo-Bench上取得显著提升。

Comments 36 pages, 5 images, 9 tables, Manuscript submitted to a Journal (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21802 2026-06-23 cs.CL 新提交 57%

When to Plan, When to Polish: Noise Level as a Granularity Axis for Diffusion Language Models

何时规划,何时精炼:噪声水平作为扩散语言模型的粒度轴

Peihong Li, Yuanjie Shi, Yan Yan

机构 * Washington State University(华盛顿州立大学)

专题命中 规划推理 :planning(abstract);分类 cs.CL

AI总结 提出噪声依赖粒度控制(NDGC)方法,通过噪声水平调节训练和推理的粒度,实现从粗到细的去噪,无需显式规划器或层次结构,提升生成质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20669 2026-06-23 cs.AI cs.SE 新提交 57%

Agent Behavior Mining: Generative AI Agent Governance in Business Processes

智能体行为挖掘:业务流程中的生成式AI智能体治理

Hoang Vu, Maximilian Körner, Adrian Rebmann, Gabriel Kevorkian, Michael Perscheid, Gregor Berg, Timotheus Kampik

机构 * SAP Umeå University(于默奥大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 针对生成式AI智能体在业务流程中的不可见自主性风险,提出智能体行为挖掘方法,通过事件数据模型将智能体活动转化为标准流程日志,实现决策可观测与可追溯,并验证其实用性。

Comments Accepted at BPM conference 2026 management main track

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20601 2026-06-23 cs.HC cs.AI 新提交 57%

Zhinong AI: A Design-Science Study of an AI-Enabled Agricultural Decision-Support Platform for Smallholder Production

Zhinong AI:面向小农生产的AI赋能农业决策支持平台的设计科学研究

Zhaoyang Li, Jiaqi Liu, Ruijie Zhang

机构 * University of Sanya(三亚大学) Hebei International Studies University(河北国际关系学院)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 本文通过设计科学研究,提出了一个集成信息推送、问答、诊断、日历管理等功能的小农决策支持平台,并构建了分层架构、闭环流程、评估指标和治理框架,为AI农业原型转化为可测试、负责任的基础设施提供了结构化研究框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20753 2026-06-23 physics.chem-ph cs.AI 新提交 57%

Empowering Polymeric Materials Discovery by Artificial Intelligence

人工智能赋能高分子材料发现

Chenyao Ma, Linda Zhang, Yuheng Chen, Wei Du, Shangwen Fang, Zihao Jiang, Chuanyu Liu, Xinyu Ma, Rui Su, Gang Wang, Muyao Yu, Dong Zhong, Jie Zhu, Weibo Gong, Huan Gu, Limin Li, Chen Shen, Rui Wu, Zhenghao Wu, Kan Xu, Min Zhou, Donglin He, Xiayun Huang, Shan Jiang, Pengfei Ou, Jiayu Peng, Yuwei Zhang, Jie Zhao, Di Zhang, Piao Ma, Zhenghao Li, Hao Li

机构 * Suzhou MatSource Technology Co., Ltd.(苏州MatSource科技有限公司) Gusu Laboratory of Materials(材料Gusu实验室) Advanced Institute for Materials Research (WPI-AIMR)(先进材料研究所(WPI-AIMR)) Frontier Research Institute for Interdisciplinary Sciences (FRIS)(交叉学科前沿研究所(FRIS)) State Key Laboratory of Advanced Environmental Technology, Department of Environmental Science and Engineering, University of Science and Technology of China(先进技术国家实验室,环境科学与工程系,中国科学技术大学) Jiangsu Key Laboratory of New Power Batteries, Jiangsu Collaborative Innovation Centre of Biomedical Functional Materials, School of Chemistry and Materials Science, Nanjing Normal University(新型动力电池江苏省重点实验室,生物医学功能材料协同创新中心,化学与材料科学学院,南京师范大学) Department of Chemistry, National University of Singapore(新加坡国立大学化学系) Thrust of Sustainable Energy and Environment, The Hong Kong University of Science and Technology (Guangzhou)(可持续能源与环境方向,香港科技大学(广州)) Department of Materials Design and Innovation, University at Buffalo(材料设计与创新系,布法罗大学) College of Smart Materials and Future Energy, State Key Laboratory of Molecular Engineering of Polymers, Fudan University(智能材料与未来能源学院,聚合物分子工程国家重点实验室,复旦大学) School of Physical Science and Technology, Shanghai tech University(物理科学与技术学院,上海科技大学) The State Key Laboratory of Molecular Engineering of Polymers and Department of Macromolecular Science, Fudan University(聚合物分子工程国家重点实验室和大分子科学系,复旦大学) Department of Chemistry and Materials Science, Xi'an J Liverpool University(化学与材料科学系,西安J Liverpool大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 本文综述了数据基础设施、机器学习、大模型和实验室自动化如何融合成自主发现生态系统,通过自改进反馈循环实现高分子材料的预测性、可重复和可扩展创新。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20502 2026-06-19 cs.CR cs.AI cs.SE 新提交 57%

Calibration Without Comprehension: Diagnosing the Limits of Fine-Tuning LLMs for Vulnerability Detection in Systems Software

无理解的校准:诊断微调大语言模型在系统软件漏洞检测中的局限性

Arastoo Zibaeirad, Marco Vieira

机构 * University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出CWE-Trace框架,通过834个Linux内核样本和两个诊断指标(DFI和HDD)评估LLM漏洞检测能力,发现数据污染无实质帮助,微调仅改变输出阈值而非决策策略,模型缺乏真正的安全推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20274 2026-06-19 cs.AI 新提交 57%

Lagrange: An Open-Vocabulary, Energy-Based Sparse Framework for Generalized End-to-End Driving

Lagrange: 一种面向通用端到端驾驶的开放词汇、基于能量的稀疏框架

Shihao Ji, HongXi Li, Zihui Song, Mingyu Li

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出Lagrange框架,利用掩码潜在场和视觉语言模型实现开放词汇、稀疏计算,通过拉格朗日动作最小化确保运动学约束,在nuScenes和CODA基准上验证了鲁棒性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19308 2026-06-18 cs.CL cs.MA 新提交 57%

Enhancing Decision-Making with Large Language Models through Multi-Agent Fictitious Play

通过多智能体虚拟博弈增强大语言模型的决策能力

Leyang Shen, Yang Zhang, Xiaoyan Zhao, Chun Kai Ling, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 针对多智能体系统中决策任务因立场纠缠而难以分解的问题,提出基于虚拟博弈的多智能体虚拟博弈(MAFP)范式,通过迭代最佳响应实现均衡求解,提升决策质量和鲁棒性。

Comments 18 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19172 2026-06-18 cs.AI 新提交 57%

User as Engram: Internalizing Per-User Memory as Local Parametric Edits

用户作为印迹:将每用户记忆内化为局部参数编辑

Bojie Li

机构 * Pine AI

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出User as Engram方法,将用户事实存储为Engram模型的哈希键控记忆表中的局部编辑,推理技能共享一个适配器,实现高精度间接推理且内存占用极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.15504 2026-06-18 cs.AI 新提交 57%

Toward Vibe Medicine: A Self-Evolving Multi-Agent Framework for Clinical Decision Support

迈向振动医学:一种用于临床决策支持的自演化多智能体框架

Qianxue Zhang, Yiming Ren, Shihuan Qin, Xiao Zhang, Liao Zhang, Jinyang Huang, Zhengliang Liu, Chenbin Liu, Hongying Feng, Jingyuan Chen, Yuzhen Ding, Weihang You, Hanqi Jiang, Yi Pan, Yifan Zhou, Junhao Chen, Lifeng Chen, Wei Liu, Tianming Liu, Zengren Zhao, Lian Zhang

机构 * Medical AI Lab, The First Hospital of Hebei Medical University(河北医科大学第一医院医学人工智能实验室) Hebei Provincial Engineering Research Center for AI-Based Cancer Treatment Decision-Making, The First Hospital of Hebei Medical University(河北省人工智能癌症治疗决策工程研究中心,河北医科大学第一医院) State Key Laboratory of Neurology and Oncology Drug Development(神经与肿瘤药物研发国家重点实验室) School of Computing, University of Georgia(佐治亚大学计算学院) Department of Radiation Oncology, National Cancer Center/National Clinical Research Center for Cancer/Cancer Hospital and Shenzhen Hospital, Chinese Academy of Medical Sciences and Peking Union Medical College(中国医学科学院北京协和医学院国家癌症中心/国家肿瘤临床医学研究中心/肿瘤医院深圳医院放射治疗科) Department of Radiation Oncology, Mayo Clinic(梅奥诊所放射肿瘤科) College of Mechanical and Power Engineering, China Three Gorges University(三峡大学机械与动力工程学院) Department of Radiation Oncology, Guangzhou Concord Cancer Center(广州康华肿瘤中心放射治疗科) Gastrointestinal Disease Diagnosis and Treatment Center, The First Hospital of Hebei Medical University(河北医科大学第一医院胃肠疾病诊疗中心) Department of General Surgery, The First Hospital of Hebei Medical University(河北医科大学第一医院普通外科)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出VIBEMed多智能体框架,通过自演化机制和架构级安全沙箱,从交互历史中动态学习,实现个性化临床决策支持。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12837 2026-06-18 cs.CL 新提交 57%

LoHoSearch: Benchmarking Long-Horizon Search Agents Beyond the Human Difficulty Ceiling

LoHoSearch: 超越人类难度上限的长时域搜索代理基准测试

Jiarui Zhao, Rongzhi Zhang, Lingchuan Liu, Hao Yang, Xunliang Cai, Xi Su

机构 * Meituan(美团)

专题命中 规划推理 :reasoning(abstract);分类 cs.CL

AI总结 提出LoHoSearch基准,基于700万维基实体知识图谱自动构建544个复杂问题,评估显示最强模型仅34.74%准确率,远超人类难度上限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18206 2026-06-17 cs.AI 新提交 57%

Fixed-Point Reasoners: Stable and Adaptive Deep Looped Transformers

不动点推理器:稳定且自适应的深度循环Transformer

Sajad Movahedi, Vera Milovanović, Shlomo Libo Feigin, Alexander Theus, Thomas Hofmann, Valentina Boeva, T. Konstantin Rusch, Antonio Orvieto

机构 * ELLIS Institute Tübingen, Max Planck Institute for Intelligent Systems, Tübingen AI Center(ELLIS研究所蒂宾根,马克斯·普朗克智能系统研究所,蒂宾根人工智能中心) ETH Zurich(苏黎世联邦理工学院) Swiss Institute of Bioinformatics(瑞士生物信息学研究所) Université Paris Cité(巴黎西岱大学) Liquid AI

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 针对循环架构中深度导致的信号传播问题,提出基于预层归一化和残差缩放的FPRM模型,利用不动点收敛作为端到端停止机制,在Sudoku、Maze等推理基准上自适应计算并有效提升性能。

Comments Code available at https://github.com/nilskiKonjIzDunava/fprm

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18075 2026-06-17 cs.AI 新提交 57%

A Unified Framework for Context-Aware and Relation-Aware Graph Retrieval-Augmented Generation

上下文感知与关系感知的图检索增强生成统一框架

Haoyang Zhong, Yifei Sun, Antong Zhang, Chunping Wang, Lei Chen, Yang Yang

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学) Finvolution Group(信也科技集团)

专题命中 规划推理 :reasoning(abstract);分类 cs.AI

AI总结 提出HyGRAG分层图RAG框架,通过构建融合上下文与关系的摘要、跨层级检索及动态更新,将多跳推理准确率提升9.7%。

Comments Accepted at The ACM Web Conference 2026 (WWW '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17511 2026-06-17 cs.RO cs.AI cs.CV 新提交 57%

MagicSim: A Unified Infrastructure for Executable Embodied Interaction

MagicSim: 可执行具身交互的统一基础设施

Haoran Lu, Songling Liu, Yue Chen, Guo Ye, Mutian Shen, Shuyang Yu, Yu Xiao, Jihai Zhao, Shang Wu, Jianshu Zhang, Xiangtian Gui, Chuye Hong, Yuran Wang, Maojiang Su, Jiayi Wang, Ruihai Wu, Zhaoran Wang, Han Liu

机构 * Northwestern University(西北大学) Peking University(北京大学) University of California, Berkeley(加州大学伯克利分校) ShanghaiTech University(上海科技大学)

专题命中 规划推理 :planning(abstract);分类 cs.AI

AI总结 提出MagicSim,一个基于确定性批处理运行时和共享MDP的具身交互基础设施,通过YAML规范解耦内容、放置、行为和智能体暴露,统一世界构建、执行、评估和自动生成轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏