arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

共收录 2976 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 909 篇

2607.03987 2026-07-14 cs.RO 版本更新 78%

Fast Asymptotically Optimal Kinodynamic Planning via Vectorization

通过向量化实现快速渐近最优运动动力学规划

Yitian Gao, Andrew Lu, Zachary Kingston

机构 * Department of Computer Science, Purdue University(普渡大学计算机科学系)

专题命中 规划决策 :planning(title,abstract)

AI总结 研究复杂运动动力学系统的规划问题,提出基于JAX和XLA编译器的并行渐近最优运动动力学RRT规划器,结合AO - x元算法实现渐近最优,经理论分析和实验验证其性能优势。

Comments 8 pages, 5 figures, 4 tables. Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17527 2026-07-14 cs.RO 版本更新 78%

Safer Trajectory Planning with CBF-guided Diffusion Model for Unmanned Aerial Vehicles

基于CBF引导扩散模型的无人机安全轨迹规划

Peiwen Yang, Shiyu Bai, Weisong Wen, Yixin Gao, Jiahao Hu

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出AeroTrajGen框架,通过CBF引导采样提升扩散模型在无人机轨迹生成中的安全性与敏捷性,减少碰撞率94.7%。

Comments Some equations need to be checked

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17343 2026-07-14 cs.CV 版本更新 78%

EvoGuard: An Extensible Agentic RL-based Framework for Practical and Evolving AI-Generated Image Detection

EvoGuard: 一种基于代理强化学习的可扩展框架,用于实际和演化的AI生成图像检测

Chenyang Zhu, Maorong Wang, Jun Liu, Ching-Chun Chang, Isao Echizen

机构 * The University of Tokyo(东京大学) National Institute of Informatics(国家信息研究所)

专题命中 规划决策 :agentic(title,abstract)

AI总结 本文提出EvoGuard框架,利用多模态大语言模型和非MLLM检测器,通过能力感知的动态编排机制实现高效AIGI检测,优化后无需细粒度标注,实验表明其在准确性和可扩展性上均达最优。

Comments Template changed

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10407 2026-07-14 cs.RO 版本更新 78%

Rethinking Gaussian Trajectory Predictors: Calibrated Uncertainty for Safe Planning

重新思考高斯轨迹预测器:为安全规划校准不确定性

Fatemeh Cheraghi Pouria, Mahsa Golchoubian, Katherine Driggs-Campbell

机构 * Department of Electrical and Computer Engineering, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校电子与计算机工程系) Department of Mathematical and Computational Sciences, University of Toronto(多伦多大学数学与计算科学系)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种新的损失函数,通过核密度估计校准高斯轨迹预测器的不确定性,以提高安全规划性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03411 2026-07-13 cs.RO 版本更新 78%

Greedy Heuristics for Sampling-Based Motion Planning in High-Dimensional State Spaces

高维状态空间中基于采样的运动规划的贪心启发式算法

Phone Thiha Kyaw, Anh Vu Le, Rajesh Elara Mohan, Jonathan Kelly

专题命中 规划决策 :planning(title,abstract)

AI总结 研究高维状态空间中基于采样的运动规划问题,提出贪心有信息集,刻画其在类似RRT*规划器中的行为。基于此提出G-RRT*,实验表明它能快速找初始解并渐近收敛到最优路径,性能优于现有采样规划器。

Comments Submitted to the Autonomous Robots journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.11434 2026-07-13 cs.RO 版本更新 78%

An Incremental Sampling and Segmentation-Based Approach for Motion Planning Infeasibility

一种基于增量采样和分割的运动规划不可行性方法

Antony Thomas, Fulvio Mastrogiovanni, Marco Baglietto

机构 * Robotics Research Center, IIIT Hyderabad(IIIT海得拉巴机器人研究中心) Department of Informatics, Bioengineering, Robotics, and Systems Engineering, University of Genoa(热那亚大学信息学院、生物工程、机器人与系统工程系)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种检测运动规划不可行性的算法,通过近似机器人配置空间为离散空间,从障碍区域采样分隔起始和目标来判定规划不可行,逐步构建配置空间并划分连通分量,在多场景演示,讨论优化及高维扩展性。

Comments Accepted for publication in Robotics and Autonomous Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28746 2026-07-10 cs.RO 版本更新 78%

He3-Seeker: Robotic Information Planning for Lunar Helium-3 Distribution Mapping

He3-Seeker:用于月球氦-3分布测绘的机器人信息规划

Dong Li, Yujie Zheng, Chengdeng Cao, Siyu Teng, Yuchen Li, Yang Gao, Long Chen

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Macau University of Science and Technology(澳门科学技术大学) China University of Petroleum-Beijing(中国石油大学(北京)) Wuhan University(武汉大学) Shenzhen University(深圳大学) Technical University of Munich(慕尼黑技术大学) Hong Kong University of Science and Technology(香港科学与技术大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出He3-Seeker框架,利用机器人信息规划引导自主导航与主动感知,实现基于多点钻探采样和原位分析的月球氦-3分布快速高保真测绘。

Comments Submitted to the International Conference on Space Robotics (iSpaRo) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29358 2026-07-09 cs.RO 版本更新 78%

LAMP: Long-Horizon Adaptive Manipulation Planning for Multi-Robot Collaboration in Cluttered Space

LAMP: 杂乱空间中多机器人协作的长时域自适应操作规划

Shuai Zhou, Yorai Shaoul, Jiaoyang Li

机构 * Robotics Institute, Carnegie Mellon University(卡内基梅隆大学机器人研究所)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出LAMP框架,结合学习生成的操作模型与两种规划器(LAMPA*和LAMP-Lazy),实现多机器人在密集杂乱环境中的长时域协作操作规划,解决现有方法无法处理的复杂任务。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20182 2026-07-08 cs.RO cs.MA 版本更新 78%

IndoorR2X: Indoor Robot-to-Everything Coordination with LLM-Driven Planning

IndoorR2X: 基于大语言模型的室内机器人与万物协调

Fan Yang, Soumya Teotia, Shaunak A. Mehta, Prajit KrisshnaKumar, Quanting Xie, Jun Liu, Yueqi Song, Wenkai Li, Atsunori Moteki, Kanji Uchino, Yonatan Bisk

机构 * Fujitsu Research(富士通研究所) Carnegie Mellon University(卡内基梅隆大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 IndoorR2X通过整合移动机器人和静态物联网设备的观测数据,构建全局语义状态,实现可扩展的场景理解、减少冗余探索并利用大语言模型进行高层协调,提升多机器人系统的效率和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06924 2026-07-08 cs.RO 版本更新 78%

LIPP: Load-Aware Informative Path Planning with Physical Sampling

LIPP:基于物理采样的负载感知信息路径规划

Hojune Kim, Guangyao Shi, Gaurav S. Sukhatme

机构 * University of Southern California(南加州大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 研究针对物理样本采集场景中信息增益与负载相关遍历成本耦合问题,提出负载感知信息路径规划(LIPP),将其制定为混合整数二次规划,推导理论界限,经模拟验证其随样本质量增加能提升单位能量的不确定性降低能力。

Comments Accepted for presentation at IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07162 2026-07-08 cs.RO 版本更新 78%

First Plan Then Evaluate: Multi-Target Planning with Post-Planning Success Evaluation Improves Learning-Based Grasping Pipelines

先规划再评估:通过规划后成功评估的多目标规划改进基于学习的抓取管道

Martin Matak, Mohanraj Devendran Shanthi, Karl Van Wyk, Tucker Hermans

机构 * NVIDIA

专题命中 规划决策 :planning(title,abstract)

AI总结 研究自主多指抓取问题,提出先规划到一组抓取目标,再由评估器估计成功可能性,机器人执行最可能成功轨迹的框架,该方法在多方面优于传统框架且能推广到新环境。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23115 2026-07-07 cs.CV 版本更新 78%

AgentFoX: LLM Agent-Guided Fusion with eXplainability for AI-Generated Image Detection

AgentFoX: 基于可解释性的大语言模型引导融合的AI生成图像检测

Yangxin Yu, Yue Zhou, Bin Li, Kaiqing Lin, Haodong Li, Jiangqun Ni, Bo Cao

机构 * Guangdong Provincial Key Laboratory of Intelligent Information Processing(广东省智能信息处理重点实验室) Shenzhen Key Laboratory of Media Security(深圳媒体安全重点实验室) SZU-AFS Joint Innovation Center for AI Technology(深圳大学-AFS人工智能技术联合创新中心) Shenzhen University(深圳大学) School of Cyber Science and Technology(网络安全科学与技术学院) The Smart City Research Institute of China Electronics Technology Group Corporation(中国电子科技集团有限公司智慧城市研究院)

专题命中 规划决策 :agent(title);agentic(abstract)

AI总结 AgentFoX通过多阶段分析流程提升AI生成图像检测的可靠性,结合专家和上下文聚类资料,生成可读性强的报告以增强可解释性与可信度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01189 2026-07-03 cs.RO cs.SY eess.SY 版本更新 78%

SPOT: Spatio-Temporal Obstacle-free Trajectory Planning for UAVs in Unknown Dynamic Environments

SPOT:未知动态环境中无人机的时空无碰撞轨迹规划

Astik Srivastava, Thomas J Chackenkulam, Bitla Bhanu Teja, Antony Thomas, Madhava Krishna

机构 * Robotics Research Center, IIIT Hyderabad, India(IIIT海得拉巴机器人研究中心,印度) IIT-BHU, India(IIT-BHU,印度)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种基于4维时空规划器、视觉安全飞行走廊生成和轨迹优化的无地图反应式运动规划方法,实现无人机在未知动态环境中的避障,并通过备份规划模块应对死锁。

Comments Accepted for publication at ICRA 2026. Code available at (https://astik-2002.github.io/ICRA-2026-SPOT/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.13940 2026-07-03 cs.RO 版本更新 78%

NeHMO: Neural Hamilton-Jacobi Reachability Learning for Decentralized Safe Multi-Arm Motion Planning

NeHMO:用于分散式安全多臂运动规划的神经Hamilton-Jacobi可达性学习

Qingyi Chen, Zachary Kingston, Ahmed H. Qureshi

机构 * Department of Computer Science at Purdue University(普渡大学计算机科学系)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出基于神经Hamilton-Jacobi可达性学习的方法,学习安全值函数以捕获最坏情况下的臂间安全约束,并开发分散式轨迹优化框架,实现可扩展、数据高效的多臂运动规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18926 2026-07-02 math.OC cs.SY eess.SY 版本更新 78%

High-Fidelity Capacity Expansion Planning for Puerto Rico's Electric Power System

波多黎各电力系统容量扩展规划

Elizabeth Glista, Tomas Valencia Zuluaga, Amelia Musselman, Minda Monteagudo, Juliette Franzman, Jean-Paul Watson

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出了一种数学优化框架,用于波多黎各电力系统长期投资规划,通过高分辨率容量扩展模型识别最低成本的发电和储能投资,提高系统可靠性。

Comments Clearer framing of the modeling scope, assumptions, limitations, and data sources

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04453 2026-07-02 cs.CV 版本更新 78%

UniDrive-WM: Unified Understanding, Planning and Generation World Model for Autonomous Driving

UniDrive-WM:面向自动驾驶的统一理解、规划和生成世界模型

Zhexiao Xiong, Xin Ye, Burhan Yaman, Sheng Cheng, Yiren Lu, Jingru Luo, Nathan Jacobs, Liu Ren

机构 * Bosch Research North America & Bosch Center for Artificial Intelligence (BCAI)(博世北美研究院与博世人工智能中心) Washington University in St. Louis(圣路易斯华盛顿大学) Arizona State University(亚利桑那州立大学) Case Western Reserve University(凯斯西储大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出UniDrive-WM,一个基于VLM的统一世界模型,联合执行场景理解、轨迹规划和未来图像生成,在Bench2Drive上轨迹误差降低7.3%,碰撞率降低10.4%。

Comments Accepted to ECCV 2026. Project Page: https://unidrive-wm.github.io/UniDrive-WM

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14410 2026-07-01 eess.SY cs.SY math.OC 版本更新 78%

Integrated Investment and Policy Planning for Power Systems via Differentiable Scenario Generation

通过可微场景生成实现电力系统的投资与政策规划整合

Robert Mieth

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种方法,联合优化电力系统容量规划决策与政策投资,通过可微场景生成技术提升规划模型的求解效率。

Comments Accepted to PowerUp 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13748 2026-07-01 cs.RO cs.MA 版本更新 78%

Multi-Robot Coordination for Planning under Context Uncertainty

上下文不确定性下的多机器人协调规划

Pulkit Rustagi, Kyle Hollins Wray, Sandhya Saisubramanian

机构 * Collaborative Robotics and Intelligent Systems (CoRIS) Institute, Oregon State University(俄勒冈州立大学协作机器人与智能系统研究所) Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出多机器人上下文不确定随机最短路径问题,通过两阶段方法(CIMOP推断上下文,LCBS进行无碰撞路径规划)实现上下文未知时的协调与安全操作。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13844 2026-07-01 cs.RO 版本更新 78%

LDHP: Library-Driven Hierarchical Planning for Non-prehensile Dexterous Manipulation

LDHP:基于库的非抓取灵巧操作分层规划

Tierui He, Jiahui Zuo, Fumin Zhang, Chao Zhao

专题命中 规划决策 :planning(title,abstract)

AI总结 提出库驱动分层规划器LDHP,通过顶层接触状态规划器与底层抓取规划器协同,实现非抓取操作的可执行性,在零自由度提升和槽插入任务中验证了鲁棒性。

Comments 8 pages,accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.14701 2026-06-30 physics.med-ph 版本更新 78%

A Digital Twin Framework for Adaptive Treatment Planning in Radiotherapy

放射治疗自适应规划的数字孪生框架

Chih-Wei Chang, Sri Sai Akkineni, Mingzhe Hu, Keyur Shah, Yuan Gao, Pretesh Patel, Ashesh B. Jani, Greeshma Agasthya, Jun Zhou, Xiaofeng Yang

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种数字孪生框架,集成深度学习配准、每日CBCT更新和知识评估,在前列腺SBRT中实现快速再优化,平均再优化时间5.5分钟,剂量覆盖和危及器官保护均达临床标准。

Journal ref Physics in Medicine & Biology, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07844 2026-06-29 cs.RO 版本更新 78%

Relating Reinforcement Learning to Dynamic Programming-Based Planning

将强化学习与基于动态规划的规划联系起来

Filip V. Georgiev, Kalle G. Timperi, Başak Sakçak, Steven M. LaValle

机构 * Center for Applied Computing, Faculty of Information Technology and Electrical Engineering, University of Oulu, Finland(奥卢大学信息科技与电气工程学院应用计算中心,芬兰) Dept. of Advanced Computing Sciences, Maastricht University, the Netherlands(马斯特里赫特大学高级计算科学系,荷兰)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文通过去随机化RL、数学分析等价条件及定义真实成本,桥接了最优规划与强化学习在模型、目标和参数上的差异。

Comments 43 pages, 8 figures, World Symposium on the Algorithmic Foundations of Robotics (WAFR 2026); added requested reviewer changes

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23589 2026-06-26 math.OC 版本更新 78%

Unlocking the Informational Value of Marginal Costs for Exact Time Series Aggregation in Generation Expansion Planning

解锁边际成本的信息价值用于发电扩展规划中的精确时间序列聚合

Luca Santosuosso, Sonja Wogrin

专题命中 规划决策 :planning(title,abstract)

AI总结 针对发电扩展规划问题的计算复杂性,提出一种基于边际成本的理论化时间序列聚合方法,通过保留完整模型的活跃约束实现精确聚合,并嵌入迭代算法提供误差上界的性能保证,在完整优化不可行时恢复可解性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11906 2026-06-26 cs.RO 版本更新 78%

Visual-Language-Guided Task Planning for Horticultural Robots

面向园艺机器人的视觉-语言引导任务规划

Jose Cuaran, Kendall Koe, Aditya Potnis, Naveen Kumar Uppalapati, Girish Chowdhary

机构 * the Siebel School of Computing and Data Science(塞比尔计算与数据科学学院) the Department of Agricultural and Biological Engineering(农业与生物工程系) National Center for Supercomputing Applications(国家超级计算中心)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种模块化框架,利用视觉语言模型(VLM)主动查询异构数据源来引导机器人任务规划,在单作和混作环境中进行短期和长期作物监测任务基准测试,发现零样本VLM在短期任务中表现稳健(成功率87%),但长期多目标任务成功率低于10%,且依赖噪声语义地图时性能下降。

Comments 18 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21543 2026-06-24 cs.RO 版本更新 78%

Self-CriTeach: LLM Self-Teaching and Self-Critiquing for Improving Robotic Planning via Automated Domain Generation

Self-CriTeach: LLM 自我教学与自我批评用于通过自动领域生成提升机器人规划

Jinbang Huang, Zhiyuan Li, Yuanzhao Hu, Zhanguang Zhang, Mark Coates, Xingyue Quan, Yingxue Zhang

机构 * Huawei Noah's Ark Lab(华为诺亚实验室) University of Toronto(多伦多大学) University of British Columbia(不列颠哥伦比亚大学) McGill University(麦吉尔大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出Self-CriTeach框架,通过LLM自动生成符号规划领域,用于自我教学生成规划问题-计划对及自我批评生成结构化奖励信号,提升机器人规划性能与泛化能力。

Comments International Conference on Machine Learning (ICML) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23586 2026-06-24 math.OC cs.SY eess.SY 版本更新 78%

From Zonal to Nodal Capacity Expansion Planning: Spatial Aggregation Impacts on a Realistic Test-Case

从分区到节点容量扩展规划:空间聚合对实际测试案例的影响

Elizabeth Glista, Bernard Knueven, Jean-Paul Watson

专题命中 规划决策 :planning(title,abstract)

AI总结 本文通过加州8000+节点实际电网测试,发现精细空间聚合可近似节点规划,但粗分区模型会导致投资决策严重失真(容量投资不足高达41%)。

Comments 10 pages, 4 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16689 2026-06-23 eess.SP cs.NI 版本更新 78%

Against the Monolithic Wireless World Model: Why NextG Needs Composable and Agentic Intelligence

反对单一无线世界模型:为什么NextG需要可组合和代理智能

Aladin Djuhera, Farhan Ahmed, Vlad C. Andrei, Swanand Ravindra Kadhe, Alecio Binotto, Haris Gacanin, Holger Boche

专题命中 规划决策 :agentic(title,abstract)

AI总结 本文指出无线领域缺乏等同于LLM的数据基础,主张采用可组合和代理智能架构以实现可部署的AI原生网络。

Journal ref ICML 2026 Workshop on AI and ML for NextG

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08334 2026-06-23 cs.RO 版本更新 78%

Vec-QMDP: Vectorized POMDP Planning on CPUs for Real-Time Autonomous Driving

Vec-QMDP:面向实时自动驾驶的CPU矢量化POMDP规划

Xuanjin Jin, Yanxin Dong, Bin Sun, Huan Xu, Zhihui Hao, XianPeng Lang, Panpan Cai

机构 * Shanghai Innovation Institute(上海创新研究院)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出Vec-QMDP,一种CPU原生并行规划器,通过数据导向设计、层次化并行和矢量化碰撞检测,实现比最先进串行规划器快227-1073倍的速度,在毫秒级延迟下完成大规模自动驾驶规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04687 2026-06-23 cs.CV 版本更新 78%

WebCryptoAgent: Agentic Crypto Trading with Web Informatics

WebCryptoAgent: 基于网络信息学的智能加密货币交易

Ali Kurban, Wei Luo, Liangyu Zuo, Zeyu Zhang, Renda Han, Zhaolu Kang, Hao Tang, Yang Zhao

机构 * AI Geeks CUHK Peking University(北京大学) TJU(天津大学) La Trobe(拉特罗布大学)

专题命中 规划决策 :agentic(title,abstract)

AI总结 提出WebCryptoAgent框架,通过模态专用代理整合异构网络信息与市场信号,并采用解耦控制架构实现快速风险响应,提升交易稳定性与尾部风险处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28654 2026-06-19 cs.RO cs.SY eess.SY math.OC 版本更新 78%

Integrated Exploration-Aware UAV Route Optimization and Path Planning

集成探索感知的无人机路径优化与轨迹规划

Jimin Choi, Grant Stagg, Cameron K. Peterson, Max Z. Li

机构 * Department of Aerospace Engineering, University of Michigan(密歇根大学航空航天工程系) Department of Electrical Engineering, Brigham Young University(BYU 电子工程系) Department of Aerospace Engineering, Department of Civil and Environmental Engineering, and Department of Industrial and Operations Engineering, University of Michigan(密歇根大学航空航天工程系、土木与环境工程系和工业与运营管理工程系)

专题命中 规划决策 :planning(title,abstract)

AI总结 提出一种集成探索感知的无人机路径优化与轨迹规划框架,通过风险地图、不确定兴趣区域建模、B样条轨迹优化和在线重规划,在灾害监测中平衡报告点访问与新信息探索,实现平均KL散度降低15.9%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28185 2026-06-16 cs.CV 版本更新 78%

Visual Generation in the New Era: An Evolution from Atomic Mapping to Agentic World Modeling

新时代的视觉生成:从原子映射到智能世界建模的演进

Keming Wu, Zuhao Yang, Kaichen Zhang, Shizun Wang, Haowei Zhu, Sicong Leng, Zhongyu Yang, Qijie Wang, Sudong Wang, Ziting Wang, Zili Wang, Hui Zhang, Haonan Wang, Hang Zhou, Yifan Pu, Xingxuan Li, Fangneng Zhan, Bo Li, Lidong Bing, Yuxin Song, Ziwei Liu, Wenhu Chen, Jingdong Wang, Xinchao Wang, Xiaojuan Qi, Shijian Lu, Bin Wang

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) University of Hong Kong(香港大学) National University of Singapore(新加坡国立大学) University of Waterloo(滑铁卢大学) StepFun MiroMind Baidu(百度) Fudan University(复旦大学) Hong Kong University of Science and Technology(香港科技大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) LMMs-Lab(LMMs实验室)

专题命中 规划决策 :agentic(title,abstract)

AI总结 提出五级分类法(原子生成、条件生成、上下文生成、智能生成、世界建模生成),分析流匹配、统一理解与生成模型等关键技术,并指出现有评估高估感知质量而忽视结构、时序和因果缺陷。

Comments Project Page: https://github.com/EvolvingLMMs-Lab/Evolving-Visual-Generation

详情

展开后加载摘要…

URL PDF HTML 收藏