arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-02 至 2026-06-02 共收录 432 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 144 篇

2403.06524 2026-06-02 cs.LG cs.AI cs.RO 62%

Tactical Decision Making for Autonomous Trucks by Deep Reinforcement Learning with Total Cost of Operation Based Reward

基于总运营成本奖励的深度强化学习自动驾驶卡车战术决策

Deepthi Pathare, Leo Laine, Morteza Haghir Chehreghani

机构 * Department of Computer Science and Engineering, Chalmers University of Technology and and University of Gothenburg(计算机科学与工程系,查尔姆斯理工大学和哥德堡大学) Department of Mechanics and Maritime Sciences, Chalmers University of Technology(机械与海洋科学系,查尔姆斯理工大学) Safe and Efficient Driving, Volvo Group of Trucks Technology(安全高效驾驶,沃尔沃卡车技术集团)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 提出一种深度强化学习框架,用于自动驾驶卡车在高速公路场景下的自适应巡航控制和变道战术决策,通过基于总运营成本的多目标奖励函数优化性能。

Comments Paper is accepted for publication in Artificial Intelligence Review

Journal ref Artificial Intelligence Review, Volume 59, Article number 27 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02905 2026-06-02 cs.HC cs.AI cs.LG 62%

Preference-Optimal Multi-Metric Weighting for Parallel Coordinate Plots

平行坐标图的偏好最优多度量加权

Chisa Mori, Shuhei Watanabe, Masaki Onishi, Takayuki Itoh

机构 * Preferred Networks Inc.(Preferred Networks公司)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 针对平行坐标图中多度量可视化难题,提出基于偏好最优加权的公式化方法,并利用雷达图与UMAP降维实现直观偏好选择,有效揭示控制参数重要性模式。

Comments Accepted to International Conference Information Visualisation (iV2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02497 2026-06-02 cs.AI 57%

Bridging the Last Mile of Time Series Forecasting with LLM Agents

用LLM智能体弥合时间序列预测的最后一公里

Yuhua Liao, Zetian Wang, Qiangqiang Nie, Zhenhua Zhang

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 提出一个LLM智能体框架,通过检索上下文证据和结构化约束,将统计预测转化为业务就绪的预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02215 2026-06-02 cs.CL cs.SI 57%

Better with Experience: Self-Evolving LLM Agents for Evidence-Grounded Health Community Notes

经验更优:用于证据基础健康社区笔记的自进化LLM智能体

Zihang Fu, Fanxiao Li, Jianyang Gu, Haonan Wang, Preslav Nakov, Bryan Hooi, Min-Yen Kan, Jiaying Wu

机构 * National University of Singapore(国立新加坡大学) Yunnan University(云南大学) The Ohio State University(俄亥俄州立大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 提出EvoNote框架,通过自进化经验记忆和细粒度信用分配,在健康社区笔记生成中实现证据获取、分析与撰写,显著提升笔记质量并缩短生成时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02049 2026-06-02 cs.AI 57%

Explainable Data-driven Deep Reinforcement Learning Methods for Optimal Energy Management in Buildings

面向建筑最优能量管理的可解释数据驱动深度强化学习方法

Hallah Shahid Butt, Qiong Huang, Gökhan Demirel, Kevin Förderer, Erfan Tajalli-Ardekani, Simnon Waczowicz, Luigi Spatafora, Veit Hagenmeyer, Benjamin Schäfer

机构 * Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 提出可解释深度强化学习框架,结合真实数据训练策略内与离策略算法,通过事后解释技术揭示电池管理决策过程,实现降本与透明化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01810 2026-06-02 cs.AI 57%

Token Predictors Are Not Planners: Building Physically Grounded Causal Reasoners

Token 预测器不是规划器:构建物理基础的因果推理器

Zheng Lu, Mingqi Gao, Qinlei Xie, Wanqi Zhong, Hanwen Cui, Heng Cao, Zirui Song, Yifan Yang, Chong Luo, Bei Liu, Yiming Li

机构 * Tsinghua University(清华大学) Microsoft Research Asia(微软亚洲研究院) MBZUAI

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对具身视觉-语言规划中模型依赖语言统计先验而非因果推理的问题,提出 Causal-Plan-Bench 基准和 Causal-Plan-1M 数据集,并训练 Causal Planner 模型,实现从 token 预测到物理因果推理的转变。

Comments 77 pages, appendices included. Code: https://github.com/THUSI-Lab/Causal-Reasoner

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01665 2026-06-02 cs.LG 57%

Quantifying the Energy Floor: Direct Measurement and Replay Buffer Bias in SAC-Based HVAC Control on sbsim

量化能量下限:基于sbsim的SAC HVAC控制中的直接测量与回放缓冲区偏差

Bo Li, Chen Zhang

机构 * Shanghai Jiao Tong University College of Smart Energy(上海交通大学智能能源学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 通过最小动作实验直接测量SAC HVAC控制中的能量下限,发现回放缓冲区初始化是次优性的主要来源,消除后可将成本降至接近下限。

Comments 5 pages, 3 figures, 2 tables. Presented at AI-DEEDS 2026 Workshop, ACM Sustainability Week, Banff, Canada (non-archival)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01610 2026-06-02 cs.AI 57%

Revisiting Ripple Effects in Knowledge Editing through Pressure-Aware Joint Neighborhood Optimization

重新审视知识编辑中的涟漪效应:通过压力感知联合邻域优化

Haoben Huang, Shuxin Liu, Ou Wu, Di Gao

机构 * Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(杭州高等研究院,中国科学院大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对大语言模型单次编辑引发的涟漪效应,提出联合邻域优化框架,通过压力感知协调和语义预执行门控联合优化可编辑侧与保留侧的耦合压力,在RippleEdits上传播与保留指标提升至少7.0%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01441 2026-06-02 cs.AI 57%

Dive into Ambiguity: A*-Inspired Multi-Agents Commonsense Obfuscation Attack on LLM Prompts

深入歧义:基于A*的多智能体常识混淆攻击LLM提示

Boxuan Wang, Zhuoyun Li, Xiaowei Huang, Yi Dong

机构 * University of Liverpool(利物浦大学)

专题命中 规划决策 :agentic(abstract);分类 cs.AI

AI总结 提出一种基于A*的事实错误诱导框架,通过层次化重写策略和动态语义分散系数生成语义对齐但混淆的提示,以高效攻击LLM的常识推理。

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01091 2026-06-02 cs.CL 57%

Deep Research as Rubric for Reinforcement Learning

深度研究作为强化学习的评估准则

Wangyi Mei, Zhouhong Gu, Zhenhan Bai, Yin Cai, Lefan Zhang, Zhenxin Ding, Bo Chen, Yan Gao, Yi Wu, Yao Hu, Jiaqing Liang, Deqing Yang

机构 * Fudan University(复旦大学) Xiaohongshu Inc.(小红书公司) Beijing University of Posts and Telecommunications(北京邮电大学)

专题命中 规划决策 :agentic(abstract);分类 cs.CL

AI总结 提出DR-rubric框架,通过两阶段过程(迭代多轮智能体搜索构建准则,然后蒸馏为可验证约束用于GRPO策略优化)为开放式推理和长文本生成任务生成细粒度奖励信号,实验表明该方法在多个基准上表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00963 2026-06-02 cs.CV cs.CL 57%

Reasmory: 3D Reconstruction as Explicit Memory for VLMs Spatial Reasoning

Reasmory: 3D重建作为VLMs空间推理的显式记忆

Jixuan He, Xueting Li, Chieh Hubert Lin, Ming-Hsuan Yang

机构 * Cornell Tech, Cornell University(康奈尔科技学院、康奈尔大学) NVIDIA(英伟达) illoca AI(illoca人工智能) The University of California, Merced(加州大学梅尔塞德斯分校)

专题命中 规划决策 :tool use(abstract);分类 cs.CL

AI总结 提出Reasmory框架,通过结构化程序执行重建的3D显式记忆,并引入轻量级领域特定语言约束VLM查询和操作,在空间推理任务上提升6-18%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00857 2026-06-02 cs.RO cs.AI 57%

From Cues to Horizons: Dynamic Risk Horizon Profiling for Trajectory Prediction

从线索到视野:轨迹预测的动态风险视界剖面

Xinyi Ning, Zilin Bian, Dachuan Zuo, Semiha Ergan, Kaan Ozbay

机构 * Department of Civil and Urban Engineering, New York University(纽约大学土木与城市工程系) Department of Civil Engineering Technology and Environmental Management Safety, Rochester Institute of Technology(罗切斯特理工学院土木工程技术与环境安全管理系)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出风险视界剖面(RHP)模块,通过连续可学习的势场模型对未来风险分布进行建模,以提升轨迹预测的准确性,在highD和SHRP2数据集上分别降低5秒RMSE 25.0%和5秒minFDE 29.1%。

Comments 11 pages, 7 figures, submitted to IEEE Transactions on Intelligent Transportation Systems (T-ITS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00572 2026-06-02 cs.LG 57%

Spatiotemporal Multi-Task Graph Transformer for Trip-Level Transit Prediction

时空多任务图Transformer用于行程级公交预测

Oluwaleke Yusuf, Adil Rasheed, Frank Lindseth

机构 * Department of Engineering Cybernetics, Norwegian University of Science and Technology (NTNU)(工程 cybernetics 部,挪威科学与技术大学(NTNU)) Department of Computer Science, Norwegian University of Science and Technology (NTNU)(计算机科学部,挪威科学与技术大学(NTNU))

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 提出SMT-GraphFormer,一种将行程级公交预测建模为序列到序列问题的时空多任务图Transformer,通过图嵌入、上下文编码器和多门专家混合模块,在挪威特隆赫姆公交数据上优于停靠级基线方法。

Comments 25 pages, 7 figures, 11 tables, including appendix. Code available at https://github.com/Outsiders17711/SMTGraphFormer

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00451 2026-06-02 cs.CL 57%

ProtStructQA: A Denotation Threshold in Protein Structural Reasoning

ProtStructQA: 蛋白质结构推理中的指称阈值

Aravind Mandiga, Guoming Li, Jin Lu, Ismailcem Budak Arpinar, Khaled Rasheed, Samuel E. Aggrey

机构 * University of Georgia(佐治亚大学)

专题命中 规划决策 :tool use(abstract);分类 cs.CL

AI总结 提出可执行基准ProtStructQA,通过将自然语言问题编译为DSL程序并在AlphaFold结构上执行来评估蛋白质语言模型,发现模型在1.7B到4B参数之间存在指称阈值,低于该阈值时工具辅助推理占优,高于该阈值时思维链成为最强策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00240 2026-06-02 cs.AI cs.MA 57%

MindZero: Learning Online Mental Reasoning With Zero Annotations

MindZero:零标注的在线心智推理学习

Shunchi Zhang, Jin Lu, Chuanyang Jin, Yichao Zhou, Zhining Zhang, Tianmin Shu

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 规划决策 :AI agent(abstract);分类 cs.AI

AI总结 提出MindZero框架,通过自监督强化学习训练多模态大语言模型,实现高效鲁棒的在线心智推理,无需显式心智状态标注。

Comments ICML 2026. Website: https://scai.cs.jhu.edu/MindZero

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00133 2026-06-02 cs.LG cs.ET 57%

World Models: A Comprehensive Survey of Architectures, Methodologies, Reasoning Paradigms, and Applications

世界模型:架构、方法论、推理范式与应用的全面综述

Arif Hassan Zidan, Yi Pan, Hanqi Jiang, Ruiyu Yan, Wei Ruan, Zihao Wu, Lifeng Chen, Weihang You, Xinliang Li, Bowen Chen, Huawen Hu, Peilong Wang, Sizhuang Liu, Jing Zhang, Siyuan Li, Zhengliang Liu, Yu Bao, Lin Zhao, Lichao Sun, Dajiang Zhu, Xiang Li, Jinglei Lv, Quanzheng Li, Wei Liu, Tianming Liu, Wei Zhang

机构 * School of Computer and Cyber Sciences, Augusta University(奥古斯塔大学计算机与网络科学学院) School of Computing, University of Georgia(佐治亚大学计算机学院) Department of Biomedical Engineering, New Jersey Institute of Technology(新泽西理工学院生物医学工程系) Department of Radiology, Massachusetts General Hospital, Harvard Medical School(麻省总医院放射科,哈佛医学院) Department of Computer Science and Engineering, University of Texas at Arlington(德克萨斯大学阿灵顿分校计算机科学与工程系) Department of Graduate Psychology, James Madison University(詹姆斯麦迪逊大学研究生心理学系) Computer Science and Engineering, Lehigh University(莱斯大学计算机科学与工程系) School of Biomedical Engineering, The University of Sydney(悉尼大学生物医学工程学院) Tandon School of Engineering, New York University(纽约大学泰坦工程学院) Department of Radiation Oncology, City of Hope National Medical Center(城市希望国家医学中心放射肿瘤科) Department of Mayo Clinic Comprehensive Cancer Center, Mayo Clinics(梅奥诊所综合癌症中心,梅奥诊所) Savannah River Ecology Laboratory (SREL), University of Georgia(萨凡纳河生态实验室(SREL),佐治亚大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 本文提出一个多轴分类法,从架构、方法论、推理策略和应用领域四个维度系统综述世界模型,涵盖从早期认知科学基础到PlaNet、Dreamer系列、MuZero、Sora等里程碑系统,并指出未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00087 2026-06-02 cs.CV cs.AI 57%

Structured Visual Evidence Decomposition for Evidence-Grounded Multimodal Screening of Obstructive Sleep Apnea-Hypopnea Syndrome

结构化视觉证据分解用于阻塞性睡眠呼吸暂停低通气综合征的证据驱动多模态筛查

Chen Zhan, Yingchen Wei, Xiaoyu Tan, Jingjing Huang, Xihe Qiu

机构 * School of Electronic and Electrical Engineering, Shanghai University of Engineering Science(上海工程技术大学电子与电气工程学院) Tencent Youtu Lab(腾讯云视频实验室) ENT Institute and Department of Otorhinolaryngology, Eye & ENT Hospital of Fudan University(复旦大学耳鼻喉科医院耳鼻喉科研究所) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 提出EviOSAHS框架,通过将面部图像分解为七个解剖查询并生成结构化证据卡,结合临床信息进行高灵敏度OSAHS筛查。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00057 2026-06-02 cs.ET cs.CE cs.SE cs.SY eess.SY 57%

Data Architectures for AI-Ready Interoperable Public Transportation Ecosystems

面向AI就绪的可互操作公共交通生态系统的数据架构

Diego Da Silva, Raphael Y. de Camargo, Mayuri A. Morais, Amer Shalaby

专题命中 规划决策 :planning(abstract);分类 cs.SE

AI总结 针对公共交通领域数据碎片化、更新频率不一致及缺乏可复现互操作管道的问题,提出基于企业计算模式的数据架构,融合IT与OT,支持多机构协调与实时系统操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.24828 2026-06-02 cs.AI 57%

Test-Time Deep Thinking to Explore Implicit Rules

测试时深度思考以探索隐式规则

Wentong Chen, Xin Cong, Zhong Zhang, Yaxi Lu, Siyuan Zhao, Yesai Wu, Qinyu Luo, Haotian Chen, Yankai Lin, Zhiyuan Liu, Maosong Sun

机构 * Renmin University of China(中国人民大学) Department of Statistics and Data Science, Tsinghua University(清华大学统计与数据科学系) School of Computer Science and Engineering, UESTC(UESTC计算机科学与工程学院) Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) School of Mathematical Sciences, Nankai University(南开大学数学科学学院) Whiting School, Johns Hopkins University(约翰斯·霍普金斯大学惠特林学院) School of Artificial Intelligence, Shanghai Jiaotong University(上海交通大学人工智能学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 针对智能体在隐式规则环境中失败的问题,提出TTExplore框架,通过训练专用模型Exp-Thinker进行测试时推理,平均提升基线性能14-19点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23500 2026-06-02 cs.CV cs.LG 57%

B-GRTO: Bootstrapped Group Relative Tool Optimization for Referring Segmentation

B-GRTO: 引导式分组相对工具优化用于指代分割

Mario Markov, Stefan Maria Ailuro, Mohammad Mahdi, Luc Van Gool, Danda Pani Paudel

机构 * INSAIT Sofia University "St. Kliment Ohridski"(索菲亚大学"圣克莱门特·欧赫里迪斯基")

专题命中 规划决策 :tool use(abstract);分类 cs.LG

AI总结 提出B-GRTO框架,通过引导式预训练和分组相对工具优化,联合优化策略与可微分割解码器,显著提升复杂指代分割性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13602 2026-06-02 cs.CV cs.LG 57%

Towards Sparse Video Understanding and Reasoning

迈向稀疏视频理解与推理

Chenwei Xu, Zhen Ye, Shang Wu, Weijian Li, Zihan Wang, Zhuofan Xia, Lie Lu, Pranav Maneriker, Fan Du, Manling Li, Han Liu

机构 * Northwestern University(西北大学) Johns Hopkins University(约翰霍普金斯大学) Dolby Laboratories(杜比实验室)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 提出一种多轮视频问答代理,通过稀疏帧选择、状态摘要和早期停止机制,在减少帧数和令牌数的同时提升准确率。

Comments Accepted to CVPR 2026. Project page: https://sparsevideounderstanding.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03309 2026-06-02 cs.CV cs.AI 57%

VLM4VLA: Revisiting Vision-Language-Models in Vision-Language-Action Models

VLM4VLA:重新审视视觉-语言-动作模型中的视觉-语言模型

Jianke Zhang, Xiaoyu Chen, Qiuyue Wang, Mingsheng Li, Yanjiang Guo, Yucheng Hu, Jiajun Zhang, Shuai Bai, Junyang Lin, Jianyu Chen

机构 * Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院) Qwen Team, Alibaba Inc.(阿里巴巴公司Qwen团队)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 本文通过VLM4VLA最小适配管道,系统研究视觉-语言模型(VLM)的选择和能力如何影响下游视觉-语言-动作(VLA)策略性能,发现VLM通用能力无法预测下游任务表现,且视觉模块是性能瓶颈。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03745 2026-06-02 cs.LG cs.NA math.NA 57%

Neural Low-Discrepancy Sequences

神经低差异序列

Michael Etienne Van Huffel, Nathan Kirk, Makram Chahine, Daniela Rus, T. Konstantin Rusch

机构 * MIT(麻省理工学院) CMU(卡内基梅隆大学) Harvard University(哈佛大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 提出NeuroLDS,首个基于机器学习的有限低差异序列生成框架,通过监督预训练和无监督微调两步学习,在多个应用中显著优于传统方法。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.08884 2026-06-02 cs.CV cs.AI cs.GR 57%

ShapeLib: Designing a library of programmatic 3D shape abstractions with Large Language Models

ShapeLib: 利用大型语言模型设计程序化3D形状抽象库

R. Kenny Jones, Paul Guerrero, Niloy J. Mitra, Daniel Ritchie

机构 * Stanford University(斯坦福大学) Adobe Research(Adobe研究) University College London(伦敦大学学院) Brown University(布朗大学)

专题命中 规划决策 :workflow(abstract);分类 cs.AI

AI总结 提出ShapeLib方法,利用大型语言模型的先验知识,通过引导式工作流自动设计可泛化的程序化3D形状抽象库,并支持下游形状编辑与生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08137 2026-06-02 cs.CV cs.AI 57%

IGraSS: Learning to Identify Infrastructure Networks from Satellite Imagery by Iterative Graph-constrained Semantic Segmentation

IGraSS: 通过迭代图约束语义分割从卫星图像中识别基础设施网络

Oishee Bintey Hoque, Abhijin Adiga, Aniruddha Adiga, Siddharth Chaudhary, Madhav V. Marathe, S. S. Ravi, Kirti Rajagopalan, Amanda Wilson, Samarth Swarup

机构 * Biocomplexity Institute, University of Virginia(弗吉尼亚大学生物复杂性研究所) Department of Computer Science, University of Virginia(弗吉尼亚大学计算机科学系) Department Biomedical Systems Engineering, Washington State University(华盛顿州立大学生物医学系统工程系) Earth System Science Center, University of Alabama in Huntsville(阿拉巴马大学亨茨维尔分校地球系统科学中心)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 提出IGraSS迭代框架,结合语义分割与图约束优化,将不可达运河段从18%降至3%,并提升道路网络完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04512 2026-06-02 cs.AI 57%

Safety Must Precede the Deployment of Open-Ended AI

安全必须优先于开放式AI的部署

Ivaxi Sheth, Jan Wehner, Sahar Abdelnabi, Ruta Binkyte, Mario Fritz

机构 * CISPA-Helmholtz Center of Information Security(CISPA-海德堡信息安全中心) MPI for Intelligent Systems, ELLIS Institute Tübingen, Tübingen AI Center(智能系统Max Planck研究所、图宾根ELLIS研究所、图宾根人工智能中心)

专题命中 规划决策 :AI agent(abstract);分类 cs.AI

AI总结 本文提出开放式AI系统因自主无限生成新行为而带来预测性丧失、新兴错位和控制困难等独特安全挑战,需在部署前主动研究,并给出挑战分类和研究方向。

Comments Accepted to ICML'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02529 2026-06-02 math.OC cs.GT cs.MA cs.SY eess.SY 50%

A No-Regret Framework for Adaptive Incentive Design

自适应激励设计的无遗憾框架

Georgios Vasileiou, Lantian Zhang, Silun Zhang

专题命中 规划决策 :agent(abstract)

AI总结 针对连续动作空间和私有成本的博弈,提出无遗憾自适应激励设计框架,通过切换激励策略实现参数估计和遗憾最小化。

Comments 21 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02082 2026-06-02 cs.HC 50%

Overview of the ClinicalSkillQA 2026 Shared Task on Continuous Perception and Procedural Reasoning in Clinical Skill Assessment

ClinicalSkillQA 2026 共享任务概述:临床技能评估中的连续感知与程序推理

Xiyang Huang, Renxiong Wei, Yihuai Xu, Zhiyuan Chen, Keying Wu, Jiayi Xiang, Buzhou Tang, Yanqing Ye, Jinyu Chen, Cheng Zeng, Min Peng, Qianqian Xie, Sophia Ananiadou

专题命中 规划决策 :workflow(abstract)

AI总结 本文介绍 ClinicalSkillQA 2026 共享任务,通过要求系统重建临床关键帧的正确时序并生成基于临床工作流知识的理由,评估临床技能评估中的连续感知与程序推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01985 2026-06-02 cs.CV 50%

MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching

MT-EditFlow:基于流匹配的多轮图像编辑强化学习

Jiahui Huang, Yasi Zhang, Tianyu Chen, Shu Wang, Jianwen Xie, Oscar Leong, Mingyuan Zhou, Nanzhu Wang, Ying Nian Wu

机构 * Apple(苹果公司) University of California, Los Angeles(加州大学洛杉矶分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) Lambda, Inc(Lambda公司)

专题命中 规划决策 :planning(abstract)

AI总结 提出MT-EditFlow框架,通过流匹配强化学习优化多轮图像编辑的奖励信号,解决单轮编辑模型在多轮交互中的失败和误差传播问题,显著提升多轮编辑性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.01852 2026-06-02 cs.DC quant-ph 50%

Parallelizing Large-Scale Tensor Network Contraction on Multiple GPUs

在多GPU上并行化大规模张量网络收缩

Feng Pan, Hanfeng Gu, Paul Springer, Xipeng Li

专题命中 规划决策 :planning(abstract)

AI总结 提出一种多GPU框架,通过显式通信和通信感知的分布规划,在固定收缩路径上实现高效并行,相比切片方法获得显著加速。

Comments 12 pages, 6 figures, comments are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏