arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-06-29 至 2026-06-29 共收录 26 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 26 篇

2606.27483 2026-06-29 cs.AI 新提交 88%

Internalizing the Future: A Unified Agentic Training Paradigm for World Model Planning

内化未来:一种统一的世界模型规划智能体训练范式

Xuan Zhang, Zhijian Zhou, Lingfeng Qiao, Yulei Qin, Ke Li, Xing Sun, Xiaoyu Tan, Chao Qu, Yuan Qi

机构 * Fudan University(复旦大学) Shanghai Innovation Institute(上海创新研究院) Tencent Youtu Lab(腾讯优图实验室)

专题命中 规划决策 :planning(title,abstract);agentic(title,abstract);分类 cs.AI

AI总结 提出一种三阶段训练范式(WM-AMT、FE-SFT、FC-RL),使LLM智能体内化世界模型以进行前瞻性规划,在搜索和数学推理任务上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27766 2026-06-29 cs.LG cs.AI cs.RO 新提交 81%

RS-Diffuser: Risk-Sensitive Diffusion Planning with Distributional Value Guidance

RS-Diffuser: 基于分布价值引导的风险敏感扩散规划

Shiqiang Gong

机构 * Northwestern Polytechnical University(西北工业大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出RS-Diffuser,一种结合扩散轨迹生成与分布价值评论家的风险敏感离线规划框架,通过尾部感知目标引导去噪过程,实现灵活的风险偏好行为,在风险敏感D4RL和机器人导航基准上达到最优性能。

Comments ICIC 2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07743 2026-06-29 cs.AI cs.LG 版本更新 81%

Symmetry-Aware Transformer Training for Automated Planning

面向自动规划的对称感知Transformer训练

Markus Fritzsche, Elliot Gestrin, Jendrik Seipp

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 提出对比学习目标使Transformer感知对称性,结合架构改进,解决其在自动规划中因问题对称性导致的泛化困难。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11803 2026-06-29 cs.HC cs.LG cs.RO 80%

Automating RT Planning at Scale: High Quality Data For AI Training

大规模自动化放疗计划制定:为AI训练提供高质量数据

Riqiang Gao, Mamadou Diallo, Han Liu, Anthony Magliari, Jonathan Sackett, Wilko Verbakel, Sandra Meyers, Rafe Mcbeth, Masoud Zarepisheh, Simon Arberet, Martin Kraus, Florin C. Ghesu, Ali Kamen

专题命中 规划决策 :planning(title,abstract);分类 cs.LG

AI总结 本文提出了一种可扩展的自动化放疗计划制定系统,生成高质量的治疗计划,克服了AI驱动放疗计划发展中的关键障碍,其计划质量与人工生成的计划相当。

Comments radiotherapy planning, data for AI training

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27757 2026-06-29 cs.AI 新提交 79%

Towards Reliable and Robust LLM Planning: Symbolic Feedback-Driven Iterative Self-Refinement Framework

迈向可靠稳健的LLM规划:符号反馈驱动的迭代自我精炼框架

Jiajing Zhang, Jiamei Jiang, Chenyang Zhang, Feifei Mo, Linjing Li, Daniel Zeng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出符号反馈驱动的迭代自我精炼框架,通过自然语言提示、符号验证器和计划识别器增强LLM在长时域规划中的鲁棒性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27650 2026-06-29 cs.MA 新提交 78%

GenWorld: Empirically Grounded Urban Simulation Infrastructure for Scalable LLM-Agent Studies

GenWorld:用于可扩展LLM智能体研究的经验性城市模拟基础设施

Gen Li, Jieyuan Lan, Pengcheng Xu, Zongyuan Wu, Masaki Ogura, Tao Feng

专题命中 规划决策 :agent(title,abstract)

AI总结 提出GenWorld,一种结合合成城市、结构化接口和离线编译LLM决策信号为查找策略的经验性城市模拟基础设施,实现可扩展的LLM智能体研究。

Comments 27 pages, 24 figures. Code: https://github.com/Perseus1993/genworld. Project page: https://genworld1993.netlify.app/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27495 2026-06-29 cs.RO 新提交 78%

AO-ARC: Almost-Surely Asymptotically Optimal Multi-Robot Motion Planning with ARC

AO-ARC: 基于ARC的几乎必然渐近最优多机器人运动规划

James D. Motes, Marco Morales, Nancy M. Amato

机构 * Parasol Lab, School of Computing and Data Science, University of Illinois at Urbana Champaign(伊利诺伊大学厄巴纳-香槟分校计算与数据科学学院Parasol实验室)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出AO-ARC方法,通过迭代调用ARC求解有界MRMP实例,实现初始解速度与最先进可行性求解器相当,且随机器人数量增加收敛更快更可靠,并证明其渐近最优性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27602 2026-06-29 math.OC 新提交 78%

Uncertainty-aware Power System Planning via Gradient Descent

基于梯度下降的不确定性感知电力系统规划

Mehrnoush Ghazanfariharandi, Robert Mieth

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种考虑两阶段日前和实时运行不确定性的电力系统扩展规划方法,采用投影随机梯度下降算法结合原始-对偶优化框架和指数移动平均平滑策略,实现更低的总系统成本并满足可再生能源整合目标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27534 2026-06-29 physics.med-ph 新提交 78%

Ridge-filter crosstalk in conformal proton FLASH planning: dependence on beamlet pitch and iterative mitigation

适形质子FLASH计划中的脊形滤波器串扰:对束斑间距的依赖性与迭代缓解

Zongsheng Hu, Yuting Li, Henry Meyer, Xiaochun Wang, Susan L. McGovern, Emil Scheueler, Radhe Mohan, Uwe Titt

专题命中 规划决策 :planning(title,abstract)

AI总结 本研究量化了适形质子FLASH计划中脊形滤波器串扰,发现其随束斑间距减小而增大,并通过迭代重优化将靶区平均相对剂量差异从8.9%降至3.4%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07844 2026-06-29 cs.RO 版本更新 78%

Relating Reinforcement Learning to Dynamic Programming-Based Planning

将强化学习与基于动态规划的规划联系起来

Filip V. Georgiev, Kalle G. Timperi, Başak Sakçak, Steven M. LaValle

机构 * Center for Applied Computing, Faculty of Information Technology and Electrical Engineering, University of Oulu, Finland(奥卢大学信息科技与电气工程学院应用计算中心,芬兰) Dept. of Advanced Computing Sciences, Maastricht University, the Netherlands(马斯特里赫特大学高级计算科学系,荷兰)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文通过去随机化RL、数学分析等价条件及定义真实成本,桥接了最优规划与强化学习在模型、目标和参数上的差异。

Comments 43 pages, 8 figures, World Symposium on the Algorithmic Foundations of Robotics (WAFR 2026); added requested reviewer changes

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27632 2026-06-29 cs.CL 新提交 77%

Yuvion LLM: An Adversarially-Aware Large Language Model for Content And AI Safety

Yuvion LLM:一种面向内容和AI安全的对抗感知大语言模型

Ting Ma, Xiufeng Huang, Benlei Cui, Xiaowen Xu, Shikai Qiu, Ruijie Jian, Hongxing Li, Guanghui Wang, Longtao Huang, Haiwen Hong, Haolei Xu, Wenjing Jiang, Ziwen Xu, Zhaoyu Fan, Shaoxuan He, Chuxi Xiao, Yujian Li, Xinyue Chen, Chunyang Chai, Wenxuan Liu, Ziheng Wang, Dongjie Zhang, Yangfan Zhou, Libin Dong, Yupeng Cao, Xiaoqian Xia, Jing Wang, Zhe Jiang, Zhenan Ye, Guang Yang, Bin Liu, Wei Peng, Ziqiang Zhu, Meihui Lian, Kaiwen Lv Kacuila, Haidong Ding, Bingyu Zhu, Yan Wang, Hai Zhao, Xuan Jin, Wei Zhao, Pengfei Sun, Wei Wang, Huiming Zhang, Bin Li, Hui Xue

机构 * Alibaba Security AGI Lab(阿里巴巴安全AGI实验室)

专题命中 规划决策 :tool use(abstract);planning(abstract);agentic(abstract);分类 cs.CL

AI总结 针对大语言模型在对抗性攻击下的安全脆弱性,提出Yuvion LLM,通过对抗感知数据构建、知识增强预训练及多任务安全后训练,在安全基准和对抗鲁棒性上优于GPT-5.4等更大模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27397 2026-06-29 cs.MA cs.AI cs.GT 新提交 70%

SidConArena: An Environment Evaluating Agents in Open-Ended,Positive-Sum Bargaining Game

SidConArena:一个在开放、正和博弈中评估智能体的环境

Yeqi Feng, Yuxin Chen, Tianxing He

机构 * Institute for Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 提出SidConArena基准框架,通过三阶段部分可观测随机博弈评估LLM智能体在开放、正和谈判中的经济决策能力,发现前沿模型虽表现更好但仍存在资源误估、谈判被动和长期规划不足。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18558 2026-06-29 cs.CV cs.AI 版本更新 70%

HiMu: Hierarchical Multimodal Frame Selection for Long Video Question Answering

HiMu: 面向长视频问答的分层多模态帧选择

Dan Ben-Ami, Gabriele Serussi, Kobi Cohen, Chaim Baskin

机构 * INSIGHT Lab, Ben-Gurion University of the Negev, Israel(本-古里安内盖夫大学INSIGHT实验室,以色列) Ben-Gurion University of the Negev, Israel(本-古里安内盖夫大学,以色列)

专题命中 规划决策 :agent(abstract);agentic(abstract);分类 cs.AI

AI总结 提出HiMu框架,通过文本LLM将查询分解为层次逻辑树,由视觉和音频专家处理原子谓词,经模糊逻辑算子组合生成连续帧满意度曲线,在16帧预算下达到帧选择方法的最优精度,并作为即插即用模块提升多种MLLM性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27926 2026-06-29 cs.AI cs.CL cs.CV 新提交 62%

Verifiable Geometry Problem Solving: Solver-Driven Autoformalization and Theorem Proposing

可验证几何问题求解:求解器驱动的自动形式化与定理提出

Can Li, Ting Zhang, Junbo Zhao, Hua Huang

机构 * Beijing Normal University(北京师范大学)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出SD-GPS框架,通过求解器驱动的自动形式化和可验证定理提出,解决几何问题求解中神经符号方法的瓶颈,在Geometry3K和PGPS9K上超越现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27579 2026-06-29 cs.CV cs.AI cs.LG q-bio.TO 新提交 62%

Distribution-based deep multiple instance learning for tumor proportion scoring in NSCLC

基于分布的多实例深度学习在非小细胞肺癌肿瘤比例评分中的应用

Krzysztof Pysz, Artur Bartczak, Jarosław Kwiecień, Piotr Krajewski, Witold Dyrka

机构 * Politechnika Wrocławska, Wydział Podstawowych Problemów Techniki, Katedra Inżynierii Biomedycznej(弗罗茨瓦夫理工大学,基础技术问题学院,生物医学工程系) Specjalistyczny Szpital Chorób Płuc w Zakopanem, Zakład Patomorfologii(扎科帕内专科肺病医院,病理形态学科) Narodowy Instytut Onkologii im. Marii Skłodowskiej-Curie, Oddział Kraków, Zakład Patomorfologii Nowotworów(玛丽·居里国家肿瘤研究所,克拉科夫分院,肿瘤病理形态学科)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 针对非小细胞肺癌肿瘤比例评分(TPS)中标注繁琐和专家稀缺的问题,提出嵌入提取与多分类网络结合多实例学习(MIL)的分布预测框架,通过零膨胀贝塔分布建模提升预测精度与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13544 2026-06-29 eess.AS cs.AI cs.CL 新提交 62%

Adaptive Turn-Taking for Real-time Multi-Party Voice Agents

自适应轮流发言:面向实时多方语音代理

Soumyajit Mitra, Prabhat Pandey, Abhinav Jain, Shanmukha Sahith, K V Vijay Girish

机构 * Amazon AGI(亚马逊人工智能研究院) IIT Kharagpur, India(印度克里ш格布尔理工学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.CL

AI总结 提出ModeratorLM,一种基于角色条件的语音大模型,通过分块流式处理和链式推理,在多方对话中实现自适应轮流发言,显著提升轮流精度和召回率。

Comments Accepted for publication at Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30719 2026-06-29 cs.LG cs.AI 版本更新 62%

When are LLMs Sufficient Policy Optimizers for Sequential RL Tasks?

何时LLMs足以作为序列RL任务的策略优化器?

Stephane Hatgis-Kessell, Emma Brunskill

机构 * Department of Computer Science, Stanford University(计算机科学系,斯坦福大学)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出PromptPO方法,利用LLM通过Python描述状态空间、动作空间和奖励函数,基于rollout反馈迭代生成和优化可执行策略,在多种环境中匹配或超越标准RL基线,但在细粒度连续控制任务中表现不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27872 2026-06-29 cs.RO cs.AI 新提交 57%

S$^2$-VLA: State-Space Guided Vision-Language-Action Models for Long-Horizon Manipulation

S$^2$-VLA:面向长时程操作的基于状态空间的视觉-语言-动作模型

Zhipeng Xie, Zongyi Han, Xiangyi Wei, Shiliang Sun, Yang Li, Jing Zhao

机构 * School of Computer Science and Technology, East China Normal University(华东师范大学计算机科学与技术学院) State Key Laboratory of Submarine Geoscience, School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院海底科学国家重点实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 针对长时程操作任务中累积误差导致性能下降的问题,提出S$^2$-VLA框架,通过状态空间引导的自适应注意力机制动态融合视觉、语言和动作信息,在LIBERO等基准上超越7B模型。

Comments Accepted to IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27736 2026-06-29 cs.AI cs.CR 新提交 57%

ToE: A Hierarchical and Explainable Claim Verification Framework with Dynamic Multi-source Evidence Retrieval and Aggregation

ToE:一种具有动态多源证据检索与聚合的分层可解释声明验证框架

Zhaoqi Wang, Zijian Zhang, Kun Zheng, Zhen Li, Xin Li, Chunlei Li, Jiamou Liu

机构 * School of Cyberspace Science and Technology, Beijing Institute of Technology(北京理工大学信息科学与技术学院) TravelSky Technology Limited(TravelSky技术有限公司) School of Computer Science, University of Auckland(奥克兰大学计算机科学学院)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 提出Tree of Evidence (ToE)框架,通过强化学习驱动的多源检索、证据评估和参数树聚合,实现可解释的自动事实核查,在多个数据集上提升4-24个百分点,尤其对抗性毒化输入效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27624 2026-06-29 cs.RO cs.LG 新提交 57%

Physics-Guided Robotic Radiation Source Localization along Arbitrary Measurement Paths in Unstructured Environments

物理引导的机器人辐射源定位:非结构化环境中沿任意测量路径

Hojoon Son, Kai Tan, Fan Zhang

机构 * George W. Woodruff School of Mechanical Engineering, Georgia Institute of Technology(乔治·W·伍德拉夫机械工程学院,佐治亚理工学院)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 提出基于物理信息机器学习(PIML)的框架,使机器人沿任意路径在未知环境中精确估计辐射源位置,避免接近源,并通过并行计算提高鲁棒性。

Comments 18 pages, 14 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29072 2026-06-29 cs.LG cs.NA math.NA 版本更新 57%

Diffusion Model-Based Data Assimilation for Real-World Energy Consumption Forecasting

集成得分滤波用于真实数据能耗预测修正

Ruoyu Hu, Dahai Yu, Feng Bao, Guang Wang, Guannan Zhang

机构 * University of Science and Technology of China(中国科学技术大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 针对真实能耗数据的高维数据同化问题,采用集成得分滤波器(EnSF)结合预训练黑箱时空预测模型,通过基于得分的扩散模型和闭式得分表示修正预测轨迹,实验表明EnSF优于开环传播和集成卡尔曼滤波。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27966 2026-06-29 cs.CR 新提交 50%

Decoys Cannot Go Everywhere: Mapping the Deception Surface in MITRE ATT&CK

诱饵无法无处不在:映射MITRE ATT&CK中的欺骗面

Veronica Valeros, Carlos Catania, Viliam Lisý, Harm Griffioen

专题命中 规划决策 :planning(abstract)

AI总结 本文提出四准则评估框架,分析MITRE ATT&CK v18.1中250种技术,发现仅32%可部署诱饵,并总结出Sweep和Seek两种部署模式。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27671 2026-06-29 cs.CV 新提交 50%

Multi-Modal Conditioned High-Resolution Transformer for Urban Electromagnetic Field Map Prediction Download PDF

面向城市电磁场地图预测的多模态条件高分辨率Transformer

Do-Eon Kim, Dongryul Park, Seungyoung Ahn, Namwoo Kang, Seong-heum Kim, Seongsin Kim

机构 * Soongsil University(崇实大学) Cho Chun Shik Graduate School of Mobility, Korea Advanced Institute of Science and Technology(韩国科学技术院赵春植移动研究生院) Department of Intelligent Semiconductors, Soongsil University(崇实大学智能半导体系)

专题命中 规划决策 :planning(abstract)

AI总结 提出多条件密集预测框架,利用高分辨率Transformer骨干网络,结合特征线性调制和交叉注意力机制,从建筑布局和天线配置生成500×500电磁场地图,通过复合损失函数和测试时增强提升性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27644 2026-06-29 cs.CV 新提交 50%

CascadeOcc: Rethinking 3D Occupancy World Models with Cascaded VQ Representations

CascadeOcc: 用级联VQ表示重新思考3D占用世界模型

Kyumin Hwang, Wonhyeok Choi, Jaeyeul Kim, Jihun Park, Daehee Park, Sunghoon Im

机构 * Daegu Gyeongbuk Institute of Science and Technology (DGIST)(大邱庆北科学技术院)

专题命中 规划决策 :planning(abstract)

AI总结 提出CascadeOcc,一种通过级联向量量化机制在自回归框架中利用占用表示内在结构层次,实现从粗到细的3D场景预测和运动规划,在4D占用预测和运动规划基准上取得优越性能。

Comments Accepted to IEEE Signal Processing Letters (SPL), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28312 2026-06-29 math.OC q-fin.MF 新提交 50%

Optimal Deployment of Electric Aircraft for Canadian Domestic Flights

加拿大国内航班的电动飞机优化部署

Elham Soufiani, Mehrdad Pirnia

专题命中 规划决策 :planning(abstract)

AI总结 提出多周期混合整数线性规划框架,联合优化机队、基础设施和服务分配,以加拿大Helijet短途网络为例,表明电动化可在五年内减排超70%且经济可行,但受机队容量限制导致需求未满足。

Comments 6 pages, 4 images, Presented at the IEEE ITEC EATS 2026 (Transportation Electrification Conference and Expo or Electric Aircraft Technologies Symposium) took place from June 10-12, 2026, at the VIBE Credit Union Showplace in Novi, Michigan

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.02299 2026-06-29 physics.soc-ph cs.IT math.IT physics.data-an 50%

The parenthood effect in urban mobility

城市出行中的育儿效应

Mariana Macedo, Ronaldo Menezes, Alessio Cardillo

专题命中 规划决策 :planning(abstract)

AI总结 本文研究育儿和婚姻如何重塑城市出行模式,发现不同城市对家庭安排的适应能力差异,为城市规划提供定制化策略。

Comments Updated version. Main + Supplementary; 37 pages, 5 figures, 25 tables

Journal ref NPJ Complexity 3, 23 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏