arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

AI Agent

智能体、工具调用、规划、工作流、多智能体和自主任务执行。

2026-07-29 至 2026-07-29 共收录 172 信号源:cs.AI, cs.CL, cs.LG, cs.SE

1. 规划决策 53 篇

2509.10692 2026-07-29 cs.RO 78%

STL-Based Motion Planning and Uncertainty-Aware Risk Analysis for Human-Robot Collaboration with a Multi-Rotor Aerial Vehicle

基于STL的运动规划与不确定性感知风险分析用于多旋翼飞行器的人机协作

Giuseppe Silano, Amr Afifi, Martin Saska, Antonio Franchi

机构 * Department of Cybernetics, Czech Technical University in Prague(捷克技术大学布拉格分校控制学系) Department of Power Generation Technologies and Materials, Ricerca sul Sistema Energetico S.p.A.(能源系统研究股份有限公司电力生成技术与材料学系) Robotics and Mechatronics Department, Electrical Engineering, Mathematics, and Computer Science Faculty, University of Twente(代尔夫特理工大学机器人与机电学系,电气工程、数学与计算机科学学院) Department of Computer, Control and Management Engineering, Sapienza University of Rome(罗马萨皮恩扎大学计算机、控制与管理工程系)

专题命中 规划决策 :planning(title,abstract)

AI总结 本文提出一种增强人机协作的框架,利用信号临时逻辑编码安全性和舒适性等关键目标,并通过优化规划生成动态可行轨迹,结合不确定性风险分析实现安全高效的协作。

Comments 46 pages, 14 figures

Journal ref Journal of Intelligent & Robotic Systems, volume 112, article number 66, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08060 2026-07-29 cs.RO cs.MA 版本更新 78%

Coverage Path Planning for Holonomic UAVs via Uniaxial-Feasible, Gap-Severity Guided Decomposition

通过单轴可行、间隙严重性引导分解的完整无人机覆盖路径规划

Pedro Antonio Alarcon Granadeno, Jane Cleland-Huang

机构 * University of Notre Dame(内布拉斯加大学)

专题命中 规划决策 :planning(title,abstract)

AI总结 针对完整无人机在应急响应中覆盖路径规划面临的问题,提出用递归双轴单调性标准及累积间隙严重性度量引导切割的分解策略,搭配全局优化器,降低路径长度和完成时间开销,优于其他15种CPP管道。

Comments Accepted to IEEE International Conference on Robotics and Automation (ICRA 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24779 2026-07-29 cs.AI cs.LG 新提交 73%

HOBA: Hierarchical On-Policy Bidding Agents for Adaptive Online Advertising

HOBA:用于自适应在线广告的分层策略性投标代理

Ji Wu, Yunshan Peng, Wentao Bai, Yunke Bai, Wenzheng Shu, Jinan Pang, Yanxiang Zeng, Xialong Liu

机构 * Kuaishou Technology(快手科技)

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.AI、cs.LG

AI总结 针对在线广告投标系统问题,提出 HOBA 分层强化学习框架,在三个时间尺度解耦相关环节,通过实验验证其优于现有基线,大规模在线部署实现目标成本提升 3.6%,证明该范式有效。

Comments 10pages,accepted by KDD 2026 ads track

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25447 2026-07-29 cs.MA 新提交 71%

CoRenew: A large language model agent-based policy simulation platform for multifamily residential redevelopment

CoRenew:一个基于大语言模型智能体的多户住宅重建政策模拟平台

Yudi Zhang, Yuming Lin, Li Tian, Yu Wang, Jianghao Yu

专题命中 规划决策 :agent(title)

AI总结 多户住宅重建政策设计面临集体行动难题,CoRenew平台基于大语言模型智能体,整合地理人口数据,能模拟多利益相关者谈判,评估政策组合效果,支持多种输入与可视化导出,经案例验证,可用于不同背景政策评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25138 2026-07-29 cs.RO math.OC 新提交 71%

Reactive 3D Motion Planning for a Franka Arm via Star-World Workspace Reshaping

通过星型世界工作空间重塑实现 Franka 手臂的反应式 3D 运动规划

Gia Dcosta, Saayuj Deshpande, Samhitha Vedire

专题命中 规划决策 :planning(title)

AI总结 研究通过星型世界工作空间重塑实现 Franka 手臂的反应式 3D 运动规划,核心方法是聚类并替换相交膨胀障碍物、用零空间人工势场项避障,对比重塑与未重塑表示,结果显示有前景但也有局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24789 2026-07-29 cs.IR cs.CV cs.LG cs.MM 新提交 70%

NEXT: Reasoning-Driven Video Recommendation via a Vision-Language Model

NEXT:通过视觉语言模型进行推理驱动的视频推荐

Yuming Liu, Hongye Yang, Harrison Zhao, Ellie Zhu, Bokai Cao, Lei Huang, Lizhu Zhang, Xiangjun Fan

专题命中 规划决策 :agent(abstract);multi-agent(abstract);分类 cs.LG

AI总结 研究提出推理驱动的视频推荐框架NEXT,通过对用户已观看视频推理推断其下一个意图来检索后续视频。训练NEXT-8B视觉语言模型,在DocVQA性能上表现出色,在特定评估中提升下一个意图逻辑质量,部署后带来生产收益,证明其可作为实用推理引擎。

Comments 13 pages, 2 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03881 2026-07-29 cs.CY cs.AI cs.HC 版本更新 70%

LLM-generated personalized nudges for improving pro-environmental behavior: Field evidence from resource conservation

利用大型语言模型的迭代个性化增强行为提示:一项关于电力和热水节约的实地实验

Zonghan Li, Yi Liu, Chunyan Wang, Song Tong, Kaiping Peng, Feng Ji

机构 * School of Environment, Tsinghua University(清华大学环境学院) Department of Applied Psychology and Human Development, University of Toronto(多伦多大学应用心理学与人类发展系) State Key Laboratory of Regional Environment and Sustainability, Tsinghua University(清华大学区域环境与可持续性国家重点实验室) Department of Psychology, Beijing Normal University at Zhuhai(北京师范大学珠海校区心理学系) Department of Psychology and Cognitive Sciences, Tsinghua University(清华大学心理学与认知科学系)

专题命中 规划决策 :agent(abstract);planning(abstract);分类 cs.AI

AI总结 本研究利用大型语言模型实现迭代个性化,通过实地实验发现其在促进节能方面效果显著,且在前两轮干预中表现更优,但热水节约效果较弱且随时间减弱。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25993 2026-07-29 cs.CV 新提交 67%

Beyond Zooming: Learning Multi-Tool Visual Reasoning for Ultra-High-Resolution Remote Sensing

超越缩放:学习用于超高分辨率遥感的多工具视觉推理

Fengxiang Wang, Jiangnan Huang, Mingshuo Chen, Yueying Li, Yang Shi, Junwei Luo, Haoyu Wang, Yansheng Li, Jing Zhang, Haiyan Zhao, Wenjing Yang

机构 * National University of Defense Technology(国防科技大学) Wuhan University(武汉大学) Tsinghua University(清华大学)

专题命中 规划决策 :tool-use(abstract);planning(abstract)

AI总结 针对超高分辨率遥感图像给多模态大语言模型带来的挑战,提出GeoMTVR数据集,结合监督微调与以工具注意力为重点的强化学习算法开发GeoLens,实验证明其在多工具视觉推理方面优于直接推理和单工具放大基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25825 2026-07-29 cs.MA 新提交 67%

CHILL-Harness: Counterfactual Harness Learning for Efficient Reasoning in Long-Horizon Agents

CHILL-Harness:用于长期智能体高效推理的反事实控制学习

Jiarun Fu, Lizhong Ding, Sida Chen, Honglei Xin, Chunhui Zhang, Pengqi Li, Qiuning Wei, Ye Yuan, Guoren Wang

专题命中 规划决策 :agent(abstract);workflow(abstract)

AI总结 研究长期智能体控制中因依赖固定策略导致效率低的问题,提出CHILL-Harness方法,通过因果干预效应学习和优势实现因果编排,结合成功保留目标与约束,在多任务实验中减少消耗与时间,保持或提高任务成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25124 2026-07-29 cs.HC 新提交 67%

UrbanTrace: LLM-Assisted Discovery and Semantics-Aware Integration of Spatial Data

UrbanTrace:基于大语言模型的空间数据发现与语义感知集成

Sonia Castelo, Eden Wu, Joao Rulff, Harish Doraiswamy, Juliana Freire, Claudio Silva

专题命中 规划决策 :AI agent(abstract);workflow(abstract)

AI总结 研究针对城市决策中异构空间数据整合问题,提出UrbanTrace视觉分析系统,利用离线分析器结合大语言模型,通过三个交互式视图实现有效空间聚合,经评估在数据发现上表现优异,将空间聚合敏感性转化为视觉资产。

Comments 11 pages, 7 figures. Accepted to IEEE VIS 2026 (Full Papers Track). Author's version accepted for publication in IEEE Transactions on Visualization and Computer Graphics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25780 2026-07-29 cond-mat.stat-mech physics.soc-ph 新提交 67%

Macroscopic wall pressure and microscopic contact load in crowds without egress: social-group cohesion and boundary buffering

无出口人群中的宏观壁面压力和微观接触载荷:社会群体凝聚力和边界缓冲

Bo-Shiun Shen, Son-Hsien Chen

专题命中 规划决策 :agent(abstract);planning(abstract)

AI总结 研究无出口人群中机械危险,通过弹性重定向模型和社会力模型及其耦合动力学,用社会群体凝聚力等量化风险,揭示耦合动力学产生的壁面压力/接触载荷权衡及相边界,为高密度场所人群风险缓解和安全规划提供指导。

Comments 16 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24991 2026-07-29 cs.SE cs.AI 新提交 62%

Preliminary Guidelines for Using and Evaluating GenAI Tools to Support Systematic Literature Reviews

使用和评估生成式人工智能工具以支持系统文献综述的初步指南

Barbara Kitchenham, Sebastián Pizard, Lech Madeyski, Ronnie de Souza Santos, Martin Shepperd, David Budgen

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.SE

AI总结 研究探讨如何用GenAI支持系统文献综述,通过快速审查、思想实验等方法,识别评估GenAI用于SLRs的问题及过程要点,形成GUEST建议,助研究人员利用GenAI开展可靠综述与评估研究,强调其需人工监督及能提供成本效益帮助。

Comments 58 pages, 2 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24892 2026-07-29 cs.LG cs.AI 新提交 62%

LLM as Forecasting Planner: Training-Free Text Conditioning for Time-Series Foundation Models

大语言模型作为预测规划器:时间序列基础模型的免训练文本条件设定

Huu Hiep Nguyen, Dung Nguyen, Minh Hoang Nguyen, Dai Do, Hung Le

机构 * Deakin University(迪肯大学) Applied Artificial Intelligence Initiative(应用人工智能倡议)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 研究文本条件时间序列预测问题,核心方法是将预测设为TSFM生成轨迹上的规划问题,以冻结TSFM为模拟器、LLM为策略和价值函数,实例化\rc{}框架,主要贡献是通过实验证明该框架能带来持续改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.14841 2026-07-29 cs.LG cs.AI cs.DC cs.ET 版本更新 62%

Real-Time Driver Safety Scoring Through Inverse Crash Probability Modeling

通过逆事故概率建模实现实时驾驶员安全评分

Joyjit Roy, Samaresh Kumar Singh, Sushanta Das

机构 * Independent Researcher(独立研究员) American Center for Mobility(美国移动中心)

专题命中 规划决策 :planning(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SafeDriver-IQ框架,结合国家事故统计数据和自动驾驶数据,将二分类事故预测模型转化为0-100连续安全评分,提升实时驾驶员反馈的可操作性和解释性。

Comments 10 pages, 13 figures, and 14 tables. Submitted in EIT 2026 Conference hosted by The University of Wisconsin-La Crosse and sponsored by IEEE Region 4 (R4)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25984 2026-07-29 cs.CV cs.LG 新提交 57%

Schrödinger's Cat: Probabilistic Representation and Prediction of Potential Scene Kinematics

薛定谔的猫:潜在场景运动学的概率表示与预测

Timy Phan, Jannik Wiese, Björn Ommer

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究如何从部分观测预测场景演变,提出GARFIELD概率模型,能学习潜在表示实现轨迹联合采样和运动分布访问,实验显示其在运动规划性能、采样速度及密度估计上优势显著。

Comments Accepted at ECCV 2026. Project page: https://compvis.github.io/schroedingers_cat

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25853 2026-07-29 cs.AI 新提交 57%

HiSkill: Empowering LLM Agents with Hierarchical Skill Graphs

HiSkill:利用分层技能图增强大语言模型智能体

Yu Hao, Jinxuan Cai, Qi Zhang, Yawen Li, Zhiqiang Zhang, Chuan Shi, Cheng Yang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) China Mobile Group Shaanxi Co., Ltd(中国移动通信集团陕西有限公司) Ant Group(蚂蚁集团)

专题命中 规划决策 :agent(abstract);分类 cs.AI

AI总结 研究提出HiSkill分层技能图框架,将交互轨迹组织成有向图,连接高级技能与可执行动作模板并捕捉多种关系。推理时检索子图引导任务执行,实验表明其在减少推理令牌消耗方面优于基线,有效弥合技能与动作差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25484 2026-07-29 cs.AI 新提交 57%

Finding Optimal Cost-Bounded Plan Reductions: Refined Model

寻找最优成本受限计划约简:优化模型

Martha Del Toro, Raquel Fuentetaja, Angel García-Olaya

专题命中 规划决策 :planning(abstract);分类 cs.AI

AI总结 研究在预算约束下从预设计划提取高效用子计划的问题,提出通过移除低效用目标动作约简计划,证明决策变体NP完全,给出基于超额预订规划和整数线性规划的精确方法,还引入优化ILP公式提升效率。

Comments Extended version of a paper accepted at ICAPS 2026 (doi: 10.1609/icaps.v36i1.42849). Includes a new model and expanded experimental results

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25233 2026-07-29 cs.LG 新提交 57%

Beyond Single-Episode Optimization: Sliding-Window Aware Generative Auto-Bidding for Long-Term Advertising Effectiveness

超越单轮优化:用于长期广告效果的滑动窗口感知生成式自动出价

Binglin Wu, Chuan Yue, Yingyi Zhang, Xianneng Li, Ruyue Deng, Weiru Zhang, Xiaoyi Zeng

机构 * Dalian University of Technology(大连理工大学) Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团) City University of Hong Kong(香港城市大学)

专题命中 规划决策 :planning(abstract);分类 cs.LG

AI总结 研究长期广告自动出价问题,提出SWAG - Bid分层框架,将其分解为轮次级规划与步骤级执行,规划器用掩码轨迹模型预测市场,控制器通过PSG - AdaLN调整,实验表明该方法在滑动窗口评估下有竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25207 2026-07-29 cs.LG 新提交 57%

A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics

表格型马尔可夫决策过程中具有转移过渡动态的混合强化学习统一算法框架

Zheshun Wu, Renjie Zheng, Jinhang Zuo, Zenglin Xu, Fang Kong

机构 * Southern University of Science and Technology(南方科技大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) City University of Hong Kong(香港城市大学) Fudan University(复旦大学) Shanghai Academy of AI for Science(上海人工智能研究院)

专题命中 规划决策 :agent(abstract);分类 cs.LG

AI总结 研究表格型MDP中混合强化学习,提出含MIN-UCB-VI和MAX-LCB-VI的统一算法框架,利用细粒度偏差信息有效利用离线数据,给出理论保证并通过实验验证,解决离线数据因转移动态而无效的问题。

Comments 59 pages, 3 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13422 2026-07-29 quant-ph cs.LG physics.flu-dyn 版本更新 57%

Practical Quantum Advantage before Fault Tolerance via Quantum-Informed Machine Learning

量子信息机器学习预测混沌的实用量子优势基础

Maida Wang, Xiao Xue, Minh Chung, Peter V. Coveney

机构 * Centre for Computational Science, University College London(大学学院伦敦计算科学中心) Leibniz Supercomputing Centre of the Bavarian Academy of Sciences and Humanities(巴伐利亚科学院和人文科学莱比锡超算中心) Centre for Advanced Research Computing, University College London(大学学院伦敦先进研究计算中心)

专题命中 规划决策 :workflow(abstract);分类 cs.LG

AI总结 提出基于高阶量子统计先验的量子优势机制,通过两阶段优势(表示与提取)证明量子-经典复制测量复杂度分离,并在湍流和天气预报中验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25159 2026-07-29 stat.ME stat.AP 新提交 50%

Covariate-Adaptive Sample Size Re-estimation for Population-Standardized Historical Control Designs in Single-Arm Trials

单臂试验中群体标准化历史对照设计的协变量自适应样本量重新估计

Keisuke Hanada, Masahiro Kojima

专题命中 规划决策 :planning(abstract)

AI总结 针对单臂试验中试验组与历史对照基线不平衡问题,提出群体标准化设计框架及协变量自适应样本量重新估计程序,该程序结合初始设计与顺序更新,模拟及示例结果显示其能维持功效,是实用设计策略。

Comments 27 pages, 6 tables, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25823 2026-07-29 cs.IR 新提交 50%

Hypothesis-Driven Shelf Generation for Personalised Recommendation

用于个性化推荐的假设驱动型货架生成

Aleksandr V. Petrov, Tarun Chillara, Matthew D. Moellman, Lucas de Haas, Yabai Song, Alina Susoykina, Melissa Crawford, Gabriel Negash, Erik Franco, Tasnim Rahman, Binal Jhaveri, Shubham Bansal, Hugues Bouchard, Roberto Mirizzi, Mounia Lalmas, Aloïs Gruson

专题命中 规划决策 :planning(abstract)

AI总结 研究针对个性化推荐中货架生成问题,提出内容假设驱动型系统,含假设生成等四个阶段,解耦货架规划与目录填充,支持独立优化,经生产管道结合多种操作,通过离线和在线评估,该系统能扩展个性化推荐供应,效果有竞争力。

Comments Accepted at ACM RecSys '26 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25053 2026-07-29 cs.RO 新提交 50%

Motion Generation With Environmental Constraints

具有环境约束的运动生成

Előd Páll, Oliver Brock

机构 * Robotics and Biology Laboratory, Technische Universität Berlin(机器人与生物学实验室,柏林工业大学) Science of Intelligence, Research Cluster of Excellence(智能科学卓越研究集群)

专题命中 规划决策 :planning(abstract)

AI总结 研究针对机器人在高维及不确定环境中运动规划的挑战,提出环境约束利用(ECE)方法,将其集成到运动规划算法,通过与环境接触降维简化规划,用基于RRT的规划器评估优势,展示其在实际应用中的效益,增强复杂环境适应性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25114 2026-07-29 eess.SY cs.SY math.OC 新提交 50%

Integrated Eco-Driving and Powertrain Optimization for Hybrid Vehicles in Complex Urban Traffic

复杂城市交通中混合动力汽车的集成生态驾驶与动力总成优化

Milad Hasanzadeh, Amin Kargarian, Mehdi Farasat

专题命中 规划决策 :planning(abstract)

AI总结 针对城市混合动力汽车,提出集成有限时域生态驾驶规划框架,联合优化交通行为与动力总成运行,同时建模多方面驾驶行为及动力总成运行,模拟研究表明该方法能在维持合规驾驶计划时改善能源性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25003 2026-07-29 physics.soc-ph 新提交 50%

System optimality versus self-organization in metro networks: An optimal transport analysis

地铁网络中的系统最优性与自组织:最优传输分析

Tianyu Dong, Jiazu Zhou, Markus Schläpfer

专题命中 规划决策 :planning(abstract)

AI总结 该研究引入数据驱动框架,用几何比较和最优传输理论,比较自组织、系统最优及实际地铁网络。以新加坡地铁系统为例,发现实际网络更接近自组织基准,表明仅系统最优性不足以指导干预,框架可跨地区支持适应性规划。

Journal ref Computers, Environment and Urban Systems (2026) 129: 102479

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25755 2026-07-29 astro-ph.IM 新提交 50%

RAISE: A Low-Frequency Space-Based Payload for Solar Radio and RFI Measurements on the SMiLE Mission

RAISE:用于SMiLE任务的基于太空的低频太阳射电和射频干扰测量载荷

Sangeetha A, Harsha Avinash Tanti, Abhirup Datta, Anshu Kumari, Rajesh Bodade

专题命中 规划决策 :planning(abstract)

AI总结 介绍用于SMiLE任务的RAISE低频无线电载荷,它能在低地球轨道运行,克服电离层影响,通过特定观测生成动态频谱测量,可用于空间天气研究等,为未来相关天基任务提供重要基础。

Comments Accepted manuscript of a paper presented at IEEE SPACE 2026; 4 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23109 2026-07-29 math.OC 版本更新 50%

A Novel Optimization Model for Solving the Timetabling Problem at Finnish Universities

一种解决芬兰大学排课问题的新型优化模型

Kimmo Nurmi, Jari Kyngäs, Pauliina Halme

专题命中 规划决策 :planning(abstract)

AI总结 研究芬兰大学排课问题,通过与三所芬兰大学及教育管理系统提供商合作,历经三个阶段,提出CRONOPT模型,能同时解决有效利用资源、关注教师、保障学生学习推进这三个目标,且优化方案可与领先管理系统集成。

Comments 26 pages, a more detailed version to be submitted to JORS, author details clarified in the new version

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22666 2026-07-29 math.OC cs.DM 版本更新 50%

The Capacitated $p$-Location Problem with Territorial Coverage Constraints: Efficient Solution and Case Study

具有领土覆盖约束的容量受限p-选址问题:高效解决方案与案例研究

Felipe Albuquerque, Rosa Figueiredo, Cyrille Genre-Grandpierre

专题命中 规划决策 :planning(abstract)

AI总结 研究容量受限p-选址问题及其扩展,提出带领土覆盖约束的多尺度变体,给出强化ILP公式和RSSV启发式算法,通过实验证明方法的效率、可靠性及对选址规划公平性的影响。

Comments 29 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31226 2026-07-29 cs.CV 版本更新 50%

ForgeDrive: Bidirectional Cross-Conditioning for Unified Visual-Action Generation in Autonomous Driving

ForgeDrive: 自动驾驶中统一视觉-动作生成的双向交叉条件

Xuchang Zhong, He Zheng, Chenxu Zhao, Tianxiong Lv, Hangqi Fan, Bohua Wang, Yushan Liu, Li Gao, Zhihao Liao, Leigang Luo, Congyang Zhao, Yang Cai

机构 * Amap, Alibaba Group(阿里巴巴集团高德地图)

专题命中 规划决策 :planning(abstract)

AI总结 提出ForgeDrive统一自回归扩散框架,通过“先动作后想象”范式实现视觉与动作的双向交叉条件,解决级联误差问题,在NAVSIM上优于现有规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.16302 2026-07-29 cs.CV 版本更新 50%

Explainable Flood Segmentation on Sentinel-1 SAR1 Imagery Using CNN and Transformer Architectures

可解释的Sentinel-1 SAR影像洪水分割:CNN与Transformer架构的比较研究

Arundhuti Banerjee, David Daou

机构 * United Nations University's Institute for Environment and Human Security (UNU-EHS)(联合国大学环境与人类安全研究所(UNU-EHS))

专题命中 规划决策 :planning(abstract)

AI总结 比较CNN和视觉Transformer在Sentinel-1 SAR影像多类洪水分割中的性能,SegFormer-b2在ETCI数据集上显著优于U-Net,但在Sen1Floods11上优势缩小,并利用可解释性技术分析模型决策。

详情

展开后加载摘要…

URL PDF HTML 收藏