arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-01 至 2026-07-01 共收录 64 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 64 篇

2606.31200 2026-07-01 cs.AI 新提交 92%

Agentic RAG-VLM: Affordance-Aware Retrieval-Augmented Generation with Self-Reflective Planning for Robotic Grasping

Agentic RAG-VLM:基于自反规划与可操作性感知的检索增强生成在机器人抓取中的应用

Tao Chen, Lizheng Liu, Jiaxu Wang, Ziyue Jiang, Ruiqi Tian, JiGuang Huo, Zhongxue Gan

机构 * Fudan University(复旦大学) Kean University(肯恩大学)

专题命中 规划决策 :agentic(title,title_cn);planning(title,abstract);分类 cs.AI

AI总结 提出Agentic RAG-VLM框架,通过可操作性感知检索、场景图推理和自反规划,在杂乱环境中实现鲁棒抓取,成功率78.3%,比纯VLM基线提升53.3个百分点。

Comments 8 pages,5 figures,5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30940 2026-07-01 cs.RO cs.AI cs.LG 新提交 86%

Motion Planning in Compressed Representation Spaces

压缩表示空间中的运动规划

Lukas Lao Beyer, Sertac Karaman

机构 * MIT LIDS(麻省理工学院信息与决策系统实验室)

专题命中 规划决策 :planning(title,abstract);agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 提出一种生成式框架,通过高压缩率自编码器学习离散层级化潜在空间,并在其中直接搜索进行运动规划,兼顾灵活性与效率,无需任务特定训练。

Comments To appear in the Proceedings of the 43rd International Conference on Machine Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31916 2026-07-01 cs.CL 新提交 85%

Theory of Mind and Persuasion Beyond Conversation: Assessing the Capacity of LLMs to Induce Belief States via Planning and Action

超越对话的心智理论与说服:通过规划与行动评估LLMs诱导信念状态的能力

Ben Slater, Matteo G. Mecattaf, Lucy G. Cheke, John Burden, Winnie Street

机构 * Leverhulme Centre for the Future of Intelligence(勒沃霍姆未来智能中心) Prolific Google, Paradigms of Intelligence Team(谷歌智能范式团队)

专题命中 规划决策 :planning(title,abstract);agent(abstract);agentic(abstract);分类 cs.CL

AI总结 提出非对话式规划心智理论(NCP-ToM)框架,评估LLMs通过行动而非对话诱导他人信念状态的能力,发现GPT-5在80%任务中优于人类,但鲁棒性不足。

Comments 29 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30801 2026-07-01 cs.CL cs.CY cs.LG cs.SI 新提交 84%

Using AI Agents to Automate Black-Box Audits of Personalization Algorithms at Scale

使用AI代理自动化大规模黑盒审计个性化算法

Alessandro Morosini, Sarah H. Cen, Andrew Ilyas, Hedi Driss, Aleksander Mądry, Chara Podimata

机构 * Massachusetts Institute of Technology(麻省理工学院) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :AI agent(title,abstract);agent(abstract);分类 cs.CL、cs.LG

AI总结 提出用生成式AI代理作为行为引擎进行黑盒审计,通过固定人设和反事实扰动解耦用户属性与行为,在X平台部署1120个代理发现算法推荐放大有毒、极化内容且效果因用户意识形态而异。

Comments 43 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14027 2026-07-01 cs.CR cs.AI cs.CL cs.SY eess.SY 新提交 84%

Same-Origin Policy for Agentic Browsers

代理浏览器的同源策略

Xilong Wang, Xiaoxing Chen, Patrick Li, Dawn Song, Neil Gong

机构 * Duke University(杜克大学) Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校)

专题命中 规划决策 :agentic(title,abstract);AI agent(abstract);分类 cs.AI、cs.CL

AI总结 研究代理浏览器中同源策略的有效性,构建SOPBench评估基准,发现现有代理浏览器频繁违反SOP,并提出SOPGuard机制来强制执行SOP,同时保持效用和低开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31073 2026-07-01 cs.AI cs.MA cs.RO 新提交 83%

MultiUAV-Plat: An LLM-Oriented Platform, Benchmark and Framework for Multi-UAV Collaborative Task Planning

MultiUAV-Plat:面向多无人机协同任务规划的LLM平台、基准测试与框架

Sheng Zhang, Qinglin Li, Yuechao Zang, Xueqin Huang, Yijia Fu, Cheng Zhu

机构 * National Key Laboratory of Information Systems Engineering, National University of Defense Technology(国防科技大学信息系统工程国家重点实验室)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出MultiUAV-Plat平台与基准测试,以及Agent4Drone框架,通过LLM驱动的工具交互实现多无人机协同任务规划,在任务通过率等指标上显著优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30658 2026-07-01 cs.CY cs.AI 新提交 83%

Agentic AI Enhances Physician Trust in Clinical Decision Making

智能体AI增强医生在临床决策中的信任

Zhiling Yan, Zhe Fang, David J King, Ann Pongsakul, Eashan Adhikarla, Hui Ren, Sunyang Fu, Quanzheng Li, Lifang He, Xiang Li, Hongfang Liu, Yonghui Wu, Lichao Sun

机构 * Department of Computer Science and Engineering, Lehigh University(里海大学计算机科学与工程系) Department of Epidemiology, Harvard T.H. Chan School of Public Health(哈佛大学陈曾熙公共卫生学院流行病学系) Department of Medicine, Division of Cardiology, University of Florida(佛罗里达大学医学院心脏病学系) McGovern Medical School, University of Texas Health Science Center at Houston(德克萨斯大学休斯顿健康科学中心麦戈文医学院) Department of Radiology, Massachusetts General Hospital and Harvard Medical School(麻省总医院和哈佛医学院放射学系) McWilliams School of Biomedical Informatics, University of Texas Health Science Center at Houston(德克萨斯大学休斯顿健康科学中心麦克威廉姆斯生物医学信息学院) Department of Health Outcomes & Biomedical Informatics, College of Medicine, University of Florida(佛罗里达大学医学院健康结果与生物医学信息学系)

专题命中 规划决策 :agentic(title,abstract);planning(abstract);分类 cs.AI

AI总结 研究通过医生评估多模态临床病例,发现智能体AI相比非智能体基线显著提升医生的认知和行为信任,尤其在治疗规划任务中,但存在对错误输出的过度依赖。

Comments Accepted by AMIA 2026 Annual Symposium

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20055 2026-07-01 cs.RO cs.AI cs.CV 版本更新 83%

CoReLIN: Constraint-based Reasoning for Zero-shot Lifelong Interactive Navigation

CoReLIN: 基于约束推理的零样本终身交互式导航

Apoorva Vashisth, Manav Kulshrestha, Pranav Bakshi, Damon Conover, Guillaume Sartoretti, Aniket Bera

机构 * Purdue University(普渡大学) Indian Institute of Technology, Kharagpur(印度理工学院卡哈拉格普尔分校) DEVCOM Army Research Lab(DEVCOM陆军研究实验室) National University of Singapore(新加坡国立大学)

专题命中 规划决策 :planning(title,abstract);agent(abstract);分类 cs.AI

AI总结 提出CoReLIN框架,利用LLM和场景图推理,在终身交互式导航中通过移动物体开辟路径并完成任务,显著提升长期效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31106 2026-07-01 cs.RO cs.AI cs.LG 新提交 81%

What Probing Reveals about Autonomous Driving: Linking Internal Prediction Errors to Ego Planning

探测揭示自动驾驶:内部预测误差与自我规划的关联

Hyeonchang Jeon, Kyungbeom Kim, Eugene Vinitsky, Kyung-Joong Kim

机构 * Gwangju Institute of Science and Technology (GIST)(光州科学技术院) New York University(纽约大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI、cs.LG

AI总结 通过线性探测和因果干预,研究自动驾驶策略在碰撞事件中缺乏及时预测能力,导致规划缺陷,并证明纠正预测可提升安全性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29879 2026-07-01 cs.CV cs.AI 版本更新 79%

LWDrive: Layer-Wise World-Model-Guided Vision-Language Model Planning for Autonomous Driving

LWDrive: 基于逐层世界模型的视觉-语言模型自动驾驶规划

Chen Yang, Yuhao Wei, Ze Xu, Ziheng Zou, Shuang Liang, Delin Ouyang, Lingfeng Qi, Jie Li, Guofa Li

机构 * Chongqing University(重庆大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出LWDrive框架,通过逐层世界模型引导,将VLM输出的粗轨迹逐步细化为几何精确、多视角感知的规划轨迹,在NAVSIM基准上取得92.0分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31941 2026-07-01 cs.RO cs.AI 新提交 79%

LeCropFollow: Latent Space Planning for Navigation in Unstructured Crop Fields

LeCropFollow:非结构化农田中导航的潜在空间规划

Felipe Tommaselli, Francisco Affonso, Arthur Pompeu, Gianluca Capezzuto, Arun Narenthiran Sivakumar, Girish Chowdhary, Marcelo Becker

机构 * University of São Paulo(圣保罗大学) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 提出LeCropFollow框架,利用自监督语义热图和基于模型的强化学习规划器在潜在流形中优化轨迹,无需几何建模,实现从简化模拟到真实世界的零样本迁移,在玉米田间隙中语义故障减少2.4倍。

Comments 8 pages, 7 figures, 3 tables. Github Repo: https://github.com/Felipe-Tommaselli/lecropfollow

Journal ref IEEE Robotics and Automation Letters, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31023 2026-07-01 cs.CR cs.LG 新提交 79%

Certified Speculative Execution for Untrusted AI Agents

不可信AI代理的认证推测执行

Chenyu Zhou, Qiliang Jiang, Shuning Wu, Xu Zhou

机构 * School of Engineering, Institute of Science Tokyo, Japan(东京科学大学工学院) College of Control Science and Engineering, Zhejiang University, China(浙江大学控制科学与工程学院) Department of Electrical and Computer Engineering, National University of Singapore, Singapore(新加坡国立大学电气与计算机工程系)

专题命中 规划决策 :AI agent(title,abstract);分类 cs.LG

AI总结 提出证书门控前缀接受(CGPA)方法,通过可信验证器、保形校准值边界和求解器延迟机制,实现安全、遗憾和速度的解耦,将不可信AI代理的违规率降至零。

Comments 15 pages, 2 figures, 24 tables. Includes a technical appendix (full proofs and all supplementary tables)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30650 2026-07-01 cs.CY cs.AI 新提交 79%

Qualified Educational Capacity Planning under Heterogeneous Student Support Needs: A Synthetic Benchmark and Decision-Support Framework

异构学生支持需求下的合格教育能力规划:一个合成基准与决策支持框架

Carlos Eduardo Sanoja, Oscar Enrique Moreno Mayz

机构 * Quanta Labs, LLC(Quanta Labs有限责任公司) Universidad Monteávila(蒙特阿维拉大学)

专题命中 规划决策 :planning(title,abstract);分类 cs.AI

AI总结 针对教育支持服务中资格衰减、训练与需求冲突的合格能力问题,提出一个合成基准与决策支持框架,通过多控制器比较揭示新资格获取可达性决定最优策略的机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31948 2026-07-01 cs.RO 新提交 78%

RRT-Rope: A deterministic shortening approach for fast near-optimal path planning in large-scale uncluttered 3D environments

RRT-Rope:一种用于大规模无杂波3D环境中快速近最优路径规划的确定性缩短方法

Louis Petit, Alexis Lussier Desbiens

机构 * University of Sherbrooke(舍布鲁克大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出RRT-Rope算法,通过改进RRT-Connect快速生成可行路径,并利用确定性缩短技术后处理,在大型无杂波3D环境中实现比现有RRT变体快70%的近最优路径规划。

Comments 8 pages, accepted at the 2021 IEEE International Conference on Systems, Man, and Cybernetics (SMC), Melbourne, Australia

Journal ref 2021 IEEE International Conference on Systems, Man, and Cybernetics (SMC), Melbourne, Australia, 2021, pp. 1111-1118

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31071 2026-07-01 cs.CV cs.RO 新提交 78%

Hierarchical 3D Scene Graph Construction and Belief-based Planning for Semantic Navigation

层次化3D场景图构建与基于信念的语义导航规划

Bing Wu, Zuyao Chen, Changwen Chen

机构 * The Hong Kong Polytechnic University(香港理工大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出零样本语义导航框架,通过在线维护层次化3D场景图(HSG)实现多粒度语义拓扑,并基于信念规划进行有限视野推演,在长距离导航中显著提升成功率与路径效率。

Comments Camera-ready version accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30817 2026-07-01 cs.RO 新提交 78%

TAPE: Tether-Aware Path Planning for Autonomous Exploration of Unknown 3D Cavities Using a Tangle-Compatible Tethered Aerial Robot

TAPE:面向自主探索未知三维空腔的系绳感知路径规划,采用防缠绕系绳空中机器人

Louis Petit, Alexis Lussier Desbiens

机构 * Createk Design Lab, University of Sherbrooke(谢布克大学Createk设计实验室)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种两级分层路径规划方法,通过全局TSP最小化距离和局部可调决策函数平衡路径成本与系绳长度,实现未知三维空腔的自主探索,仿真和实地测试验证了有效性。

Comments 8 pages

Journal ref IEEE Robotics and Automation Letters, vol. 7, no. 4, pp. 10550-10557, 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14410 2026-07-01 eess.SY cs.SY math.OC 版本更新 78%

Integrated Investment and Policy Planning for Power Systems via Differentiable Scenario Generation

通过可微场景生成实现电力系统的投资与政策规划整合

Robert Mieth

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种方法,联合优化电力系统容量规划决策与政策投资,通过可微场景生成技术提升规划模型的求解效率。

Comments Accepted to PowerUp 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13748 2026-07-01 cs.RO cs.MA 版本更新 78%

Multi-Robot Coordination for Planning under Context Uncertainty

上下文不确定性下的多机器人协调规划

Pulkit Rustagi, Kyle Hollins Wray, Sandhya Saisubramanian

机构 * Collaborative Robotics and Intelligent Systems (CoRIS) Institute, Oregon State University(俄勒冈州立大学协作机器人与智能系统研究所) Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出多机器人上下文不确定随机最短路径问题,通过两阶段方法(CIMOP推断上下文,LCBS进行无碰撞路径规划)实现上下文未知时的协调与安全操作。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13844 2026-07-01 cs.RO 版本更新 78%

LDHP: Library-Driven Hierarchical Planning for Non-prehensile Dexterous Manipulation

LDHP:基于库的非抓取灵巧操作分层规划

Tierui He, Jiahui Zuo, Fumin Zhang, Chao Zhao

专题命中 规划决策 :planning(title,abstract)

AI总结 提出库驱动分层规划器LDHP,通过顶层接触状态规划器与底层抓取规划器协同,实现非抓取操作的可执行性,在零自由度提升和槽插入任务中验证了鲁棒性。

Comments 8 pages,accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31222 2026-07-01 cs.AI 新提交 74%

Thinking Before Retrieving: Robust Zero-Shot Composed Image Retrieval via Strategic Planning and Self-Criticism

先思考再检索:通过战略规划与自我批评实现鲁棒的零样本组合图像检索

Gunho Jung, Jeong-Woo Park, Seon Bin Kim, Seong-Whan Lee

机构 * Department of Artificial Intelligence, Korea University(高丽大学人工智能系)

专题命中 规划决策 :planning(title);分类 cs.AI

AI总结 提出PEC-CIR框架,通过规划器-执行器-批评家多阶段推理流水线构建查询,在零样本组合图像检索中减少生成错误,提升检索精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25519 2026-07-01 cs.AI cs.LG 新提交 73%

Quantization Inflates Reasoning: Token Inflation as a Hidden Cost of Low-Bit Reasoning Models

量化膨胀推理:低比特推理模型的隐藏成本——令牌膨胀

Xinyu Lian, Walid Krichene, Beichen Huang, Masahiro Tanaka, Olatunji Ruwase, Li Zhang, Minjia Zhang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Microsoft(微软) Anyscale Snowflake

专题命中 规划决策 :tool-use(abstract);agentic(abstract);分类 cs.AI、cs.LG

AI总结 研究发现低比特后训练量化虽保持推理准确性,但会显著增加推理令牌使用量,导致端到端服务性能下降,并提出了CoT令牌膨胀比来量化该效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09045 2026-07-01 cs.AI cs.CR cs.SE 版本更新 73%

Containment Verification: AI Safety Guarantees Independent of Alignment

包含性验证:与对齐无关的AI安全保证

Royce Moon, Lav R. Varshney

机构 * AI Innovation Institute, Stony Brook University(石溪大学人工智能创新研究所)

专题命中 规划决策 :AI agent(abstract);agentic(abstract);分类 cs.AI、cs.SE

AI总结 本文提出包含性验证,通过代理框架本身提供安全保证。通过前向模拟细化和Dafny机制化,证明了在模型类型动作边界内对所有AI输出的边界策略强制性,首次实现了代理框架的演绎形式验证。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31425 2026-07-01 math.OC 新提交 71%

Joint Planning and Scheduling of Modular Vehicles for Passenger-Freight Integration

客货一体化模块化车辆的联合规划与调度

Wanru Chen, Jiaming Wu, Balázs Kulcsár

专题命中 规划决策 :planning(title)

AI总结 针对双向公交走廊,提出模块化车辆系统,通过联合优化服务路线、时刻表、车辆组成等,最小化成本并处理乘客需求不确定性,使用Benders分解算法求解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31252 2026-07-01 cs.AI 新提交 70%

Embodied CAD: Solver-Grounded LLM Agents for Parametric B-Rep Assembly Modeling

具身CAD:基于求解器的LLM代理用于参数化B-Rep装配建模

Fumin Liu, Haoyu Zhou, Fei Hao, Lin Yang

机构 * Nanjing University(南京大学)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 提出Embodied CAD框架,通过分层技能库和求解器反馈,让LLM代理迭代生成并修复参数化B-Rep装配模型,实现高可执行率和任务完成率。

Comments This paper contains 12 pages, 7 figures. This is an original unpublished manuscript submitted to the arXiv preprint server, with no prior publication or conference presentation

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31866 2026-07-01 cs.LO cs.MA 新提交 67%

Inquisitive Action Logic

探究性行动逻辑

Ivano Ciardelli

专题命中 规划决策 :agent(abstract);multi-agent(abstract)

AI总结 提出探究性行动逻辑InqAL,一种用于推理行动的多主体模态逻辑,通过问题模态分析主体对结果的确定作用,并证明其完备性和可判定性。

Comments In Proceedings AiML 2026, arXiv:2606.29444

Journal ref EPTCS 447, 2026, pp. 222-241

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31260 2026-07-01 cs.RO 新提交 67%

Plan Right, Then Plan Tight: Symbolic RL for Efficient Embodied Reasoning

先规划正确,再规划紧凑:面向高效具身推理的符号强化学习

Xiangli Shi, Xiaomeng Zhu, Ye Tian, Yuchun Guo, Ziyang Sun, Lujie Yin, Yuxuan Zhou, Yufei Huang

机构 * Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学) Tencent(腾讯) University of London(伦敦大学)

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 针对具身任务规划中缺乏低成本确定性验证的问题,提出基于BDDL规范的符号强化学习框架,通过视频解析、LLM验证和轻量符号引擎提供毫秒级密集反馈,并引入难度感知长度调度GroupAdapt,在BEHAVIOR-1000上实现97.3的严格通过率,相对Qwen3-8B提升25.9%。

Comments 18 pages, 10 figures, 14 tables; includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30649 2026-07-01 cs.CY 新提交 67%

Thinking Out Loud: Real-Time Deception Monitoring in Asymmetric LLM Negotiations

大声思考:非对称LLM谈判中的实时欺骗监控

Nolan Coffey, Faithful Odoi, Makenzie Johnson, Nasir U. Eisty

专题命中 规划决策 :agent(abstract);agentic(abstract)

AI总结 提出轻量级实时思维链监控器,在二手车销售场景中检测卖家隐藏缺陷的欺骗行为,实验表明监控能提高买家退出率但存在智能差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31795 2026-07-01 astro-ph.IM 新提交 67%

Test Management and Coordination During the Vera C. Rubin Observatory Commissioning and Early Operations Using Zephyr Scale

Vera C. Rubin 天文台调试和早期运行期间使用 Zephyr Scale 的测试管理与协调

Bruno Quint, Tiago Ribeiro, Erik Dennihy, Brian Stalder, David Sanmartim, Keith Bechtol

专题命中 规划决策 :planning(abstract);workflow(abstract)

AI总结 采用 Jira 原生测试管理工具 Zephyr Scale 协调数百项集成和天空测试,通过测试用例和测试周期管理流程,并集成调度器实现部分自动化,总结了其在大规模天文台调试中的优缺点。

Comments 4 pages, 3 figures. To be published in Proc. SPIE 13381, Observatory Operations: Strategies, Processes, and Systems X, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29980 2026-07-01 cs.AI cs.LG 版本更新 62%

Exploration and Online Transfer with Behavioral Foundation Models

基于行为基础模型的探索与在线迁移

Louis Bagot, Mathieu Lefort, Laëtitia Matignon

专题命中 规划决策 :agent(abstract);分类 cs.AI、cs.LG

AI总结 针对零样本强化学习中在线迁移的探索问题,提出利用行为基础模型生成探索策略,将在线学习建模为类似多臂赌博机的探索-利用问题,并通过不确定性矩阵特征值最小化实现探索。

Comments Retirer la mention ''European Workshop on Reinforcement Learning'' (qui correspond {à} la template de la version {é}tendue, mais le papier n'y est pas encore accept{é})

Journal ref Conf{é}rence sur l'Apprentissage automatique, Universit{é} de Montpellier, Jul 2026, Montpellier, France

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.32026 2026-07-01 cs.LG cs.AI 新提交 62%

AdaJEPA: An Adaptive Latent World Model

AdaJEPA:一种自适应潜在世界模型

Ying Wang, Oumayma Bounou, Yann LeCun, Mengye Ren

机构 * New York University(纽约大学) AMI Labs(AMI实验室)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 提出AdaJEPA,一种在模型预测控制闭环中进行测试时自适应的潜在世界模型,通过自监督信号持续校准模型,显著提升规划成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏