arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-22 至 2026-07-22 共收录 41 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2606.31493 2026-07-22 cs.RO 版本更新 57%

ChronoFlow-Policy: Unifying Past-Current-Future Interaction Flow in Visuomotor Policy Learning

ChronoFlow-Policy:在视觉运动策略学习中统一过去-当前-未来交互流

Bokai Lin, Yifu Xu, Xinyu Zhan, Hongjie Fang, Jialin Tian, Fu-Cheng Zhang, Yong-Lu Li, Cewu Lu, Lixin Yang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Noematrix

专题命中 机器人学习 :manipulation(abstract);分类 cs.RO

AI总结 提出ChronoFlow统一表示过去、当前和未来的交互动态,并基于此设计扩散策略ChronoFlow-Policy,在模拟和真实操作任务中优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 15 篇

2511.01177 2026-07-22 cs.RO 版本更新 89%

Scaling Cross-Embodiment World Models for Dexterous Manipulation

为灵巧操作扩展跨实体世界模型

Zihao He, Bo Ai, Tongzhou Mu, Yulin Liu, Weikang Wan, Jiawei Fu, Yilun Du, Henrik I. Christensen, Hao Su

机构 * UC San Diego(UC圣迭戈大学) Harvard University(哈佛大学) Shanghai Jiao Tong University(上海交通大学) Hillbot

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究跨实体学习中不同形态机器人数据共享和控制转移问题,提出将人类和机器人手表示为3D粒子集,在随机交互数据上训练基于图的世界模型并与模型预测控制集成,实验表明该方法能提高泛化能力、有效结合数据并实现不同机器人手的控制。

Comments Accepted to IROS 2026, Project Page: https://alan-heoooh.github.io/dexwm.html

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21378 2026-07-22 cs.RO cs.AI 版本更新 88%

RoboInspector: Unveiling the Unreliability of Policy Code for LLM-enabled Robotic Manipulation

RoboInspector:揭示用于基于大语言模型的机器人操作的策略代码的不可靠性

Chenduo Ying, Linkang Du, Peng Cheng, Yuanchao Shu

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO、cs.AI

AI总结 研究基于大语言模型的机器人操作中策略代码不可靠问题,设计RoboInspector从任务复杂性和指令粒度揭示其不可靠性,通过实验识别四种不可靠行为及原因,还引入优化方法,可提高策略代码生成可靠性达35%。

Comments Accepted to ACM Transactions on Intelligent Systems and Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14852 2026-07-22 cs.RO 版本更新 88%

Towards Human-like Physical Intelligence: Lifelong Vision-Language-Action Learning for Robotic Manipulation

迈向类人物理智能:用于机器人操作的终身视觉-语言-动作学习

Yao He, Gan Sun, Wenqi Liang, Fazeng Li, Yang Cong

机构 * South China University of Technology(华南理工大学) University of Trento(特伦托大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 研究针对机器人操作中可塑性-稳定性权衡难题,提出缓存高效的终身视觉-语言-动作学习框架LifelongVLA。通过双时间尺度LoRA门控模块及缓存高效随机重放策略,有效缓解权衡问题,实现技能扩展、行为保留,减少再训练依赖,优于现有基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08541 2026-07-22 cs.RO 版本更新 85%

EquiBim: Learning Symmetry-Equivariant Policy for Bimanual Manipulation

EquiBim: 学习双臂操作的对称等变策略

Zhiyuan Zhang, Aditya Mohan, Seungho Han, Wan Shou, Dongyi Wang, Yu She

机构 * Purdue University(普渡大学) University of Arkansas(阿肯色大学)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出EquiBim框架,通过强制对称性等变性提升双臂操作的性能和鲁棒性,适用于多种感知与动作表示。

Comments Accepted to IROS 2026. Project page: https://zhangzhiyuanzhang.github.io/equibim-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13869 2026-07-22 cs.RO cs.AI 版本更新 84%

TransDex: Pre-training Visuo-Tactile Policy with Point Cloud Reconstruction for Dexterous Manipulation of Transparent Objects

TransDex:基于点云重建的视觉-触觉政策预训练用于透明物体的精细操作

Fengguan Li, Yifan Ma, Chen Qian, Wentao Rao, Weiwei Shang

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 TransDex通过点云重建预训练实现视觉-触觉融合政策,解决透明物体操作中的自遮挡和深度噪声问题,提升真实机器人系统中精细操作性能。

Comments Project page: https://transdex.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17787 2026-07-22 cs.RO cs.AI 版本更新 81%

AnchorRefine: Synergy-Manipulation Based on Trajectory Anchor and Residual Refinement for Vision-Language-Action Models

AnchorRefine:基于轨迹锚点和残差细化的轨迹-锚点与残差细化的视觉-语言-动作模型

Tingzheng Jia, Kan Guo, Lanping Qian, Yongli Hu, Daxin Tian, Guixian Qu, Chunmian Lin, Baocai Yin, Jiapu Wang

机构 * Beijing University of Technology(北京理工大学) Beihang University(北航) Nanjing University of Science and Technology(南京理工大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 本文提出AnchorRefine框架,通过分解视觉-语言-动作动作建模为轨迹锚点和残差细化,提升几何和接触精度,实验表明在模拟和现实任务中均取得显著提升。

Comments The authors have decided to withdraw this manuscript because the work requires substantial revision and further experimental validation

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11340 2026-07-22 cs.RO 版本更新 70%

CR-Solver: GPU-Accelerated Kinematics Solver for Tendon-driven Continuum Robots

CR-Solver:用于腱驱动连续体机器人的GPU加速运动学求解器

Heqing Yang, Yang Yi, Linqing Zhong, Linjiang Huang, Si Liu

机构 * Beihang University(北京航空航天大学)

专题命中 机器人操作 :manipulation(abstract);navigation(abstract);分类 cs.RO

AI总结 针对连续体机器人运动规划问题,提出CR-Solver求解器,它基于优化框架统一逆运动学等,利用GPU加速并行优化,在三项任务验证中比传统CPU求解器显著加速,成功率超95%精度达毫米级,且用纯Python实现,为高性能运动规划提供基础。

Comments IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17049 2026-07-22 cs.SE cs.RO 版本更新 70%

Evaluating Uncertainty and Quality of Visual Language Action-enabled Robots

评估具有视觉语言动作能力的机器人的不确定性和质量

Pablo Valle, Chengjie Lu, Shaukat Ali, Aitor Arrieta

机构 * Mondragon University(蒙dragon大学) Simula Research Laboratory(Simula研究实验室)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对具有视觉语言动作能力的机器人,采用八个不确定性指标和五个质量指标,通过大规模实证研究评估其有效性,发现部分指标与人类评估有相关性且能区分任务执行质量,挑战了仅依赖成功率的评估做法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10946 2026-07-22 cs.RO cs.AI cs.LG 版本更新 67%

ImplicitRDP: An End-to-End Visual-Force Diffusion Policy with Structural Slow-Fast Learning

ImplicitRDP:一种具有结构快慢学习的端到端视觉-力扩散策略

Wendi Chen, Han Xue, Yi Wang, Fangyuan Zhou, Jun Lv, Yang Jin, Shirun Tang, Chuan Wen, Cewu Lu

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Noematrix Ltd.(诺姆矩阵有限公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究人类水平接触操作中视觉与力感测信号整合难题,提出ImplicitRDP策略,用结构快慢学习机制及虚拟目标表示正则化,经实验验证其在丰富接触任务中显著优于基线,有卓越反应性与成功率。

Comments Accepted to RA-L 2026. Project page: https://implicit-rdp.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16577 2026-07-22 cs.CV cs.GR 版本更新 57%

CNS-Edit++: Category-Agnostic 3D Editing with Coupled Neural Shape Representation

CNS-Edit++:基于耦合神经形状表示的类别无关3D编辑

Jingyu Hu, Weilong Yan, Zhengzhe Liu, Haipeng Li, Ka-Hei Hui, Hao Zhang, Chi-Wing Fu

机构 * The Chinese University of Hong Kong(香港中文大学) Lingnan University(岭南大学) National University of Singapore(新加坡国立大学) The Hong Kong University of Science and Technology(香港科技大学) Autodesk AI Lab(欧特克人工智能实验室) Simon Fraser University(西蒙弗雷泽大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究提出基于耦合神经形状表示和神经特征体积优化的潜在空间3D形状编辑框架CNS-Edit++,能在特定类别和类别无关模型上实例化,有多种编辑操作符及区域控制机制,经评估其性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02838 2026-07-22 cs.SI cs.LG 版本更新 57%

Beyond Content: Behavioral Policies Reveal Actors in Information Operations

超越内容:行为策略揭示信息操作中的行为者

Philipp J. Schneider, Lanqin Yuan, Marian-Andrei Rizoiu

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 通过分析用户行为策略而非内容,有效识别恶意行为者,提升信息操作检测的鲁棒性和跨平台适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24641 2026-07-22 math.OC cs.SY eess.SY 版本更新 50%

Suboptimal and Reduced-Order MPC via Timescale Separation

基于时间尺度分离的次优与降阶MPC

Stefano Di Gregorio, Guido Carnevale, Giuseppe Notarstefano

专题命中 机器人操作 :robotic(abstract)

AI总结 提出一种通用框架,通过次优控制计算和降阶模型,结合采样时间设计,利用时间尺度分离分析闭环稳定性,保证递归可行性和指数稳定。

Comments arXiv admin note: text overlap with arXiv:2511.19336

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15366 2026-07-22 physics.app-ph 版本更新 50%

Tailoring reflectionless complex media for non-Abelian braiding of acoustic modes

设计具有完美传输的多重散射声学介质用于非阿贝尔编织及更广泛领域

Hongkuan Zhang, Guancong Ma

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出一种基于多重散射的方法,设计具有完美传输的复杂介质,实现非阿贝尔编织及任意单位运算,拓展了声学和波型应用的控制能力。

Journal ref Reports on Progress in Physics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15152 2026-07-22 math.AP 版本更新 50%

Pseudo-magnetic Fields and Effective Dynamics in Strained Honeycomb Structures

应变蜂窝结构中的伪磁场与有效动力学

Chengyu Zhang, Borui Miao, Yi Zhu

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究应变蜂窝结构介质中狄拉克点附近波包的有效动力学,通过双尺度假设和克服应变变形波算子主部及零势时谱不远离零两个难点,建立了应变诱导伪磁狄拉克动力学的严格连续波理论。

Comments 50 pages, 6 figures. Revised version, substantially updated, submitted to a journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10557 2026-07-22 cond-mat.mes-hall cond-mat.mtrl-sci 版本更新 50%

Asymmetric Antibimerons: Statics and Dynamics

不对称反双聚体:静态与动态

Pavel A. Vorobyev, Daichi Kurebayashi, Oleg A. Tretiakov

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究预测了不对称反双聚体(AAB),通过各向异性界面Dzyaloshinskii-Moriya相互作用稳定,解释其形状起源,证明相反拓扑电荷的AAB可共存,用微磁模拟等描述其电流驱动动力学及碰撞对拓扑电荷的操纵,为相关研究提供路线图。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 12 篇

2607.11063 2026-07-22 cs.AI 版本更新 83%

AdvNav: Behavior-Guided Black-Box Adversarial Attacks on Vision-Language Navigation

AdvNav:视觉语言导航中基于行为引导的黑盒对抗攻击

Chenyang Li, Kaige Li, Zeyu Jiang, Changhao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.AI

AI总结 研究视觉语言导航系统对抗攻击,提出AdvNav框架,利用双粒度行为反馈构建替代目标,采用混合优化策略。在R2R数据集上评估,对两种模型取得较高攻击成功率,证明其有效性与通用性,揭示感知漏洞并为VLN模型设计提供见解。

Comments ACM International Conference on Multimedia 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30293 2026-07-22 cs.RO 版本更新 83%

CSAR: Containerized System Architecture for Robotics

CSAR:面向机器人的容器化系统架构

Gregorio Ambrosio-Cestero, Cipriano Galindo, Javier Gonzalez-Jimenez, Jose-Raul Ruiz-Sarmiento

机构 * Machine Perception and Intelligent Robotics group (MAPIR), Dept. of System Engineering and Automation, Málaga Institute for Mechatronics Engineering and Cyber-Physical Systems (IMECH.UMA), University of Málaga(机器感知与智能机器人组(MAPIR),系统工程与自动化系,马拉加机电一体化工程与信息物理系统研究所(IMECH.UMA),马拉加大学)

专题命中 具身导航 :robotics(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出CSAR架构,结合LXC/LXD容器化、ROS 2/DDS通信和三层边缘基础设施,解决机器人团队在依赖隔离、兼容性、可复现性和异构部署中的挑战,并通过3D SLAM和GPU加速语义映射用例验证其有效性。

Comments 14 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.15875 2026-07-22 cs.RO cs.AI 版本更新 81%

Fly0: Persistent Metric Anchoring for Zero-Shot Aerial Vision-Language Navigation

Fly0: 解耦语义定位与几何规划以实现零样本空中导航

Zhenxing Xu, Yihong Lu, Weidong Bao, Zhengqiu Zhu, Jingxuan Zhou, Zhichuang Wang, Ji Wang, Lihua Liu, Wei He

机构 * National Key Laboratory of Big Data and Decision(大数据与决策国家重点实验室) National University of Defense Technology(国防科技大学) State Key Laboratory of Digital Intelligent Modeling and Simulation(数字智能建模与仿真国家重点实验室) Information Support Force Engineering University(信息支援力量工程大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 Fly0通过解耦语义推理与几何规划,实现零样本空中导航,提升导航成功率和减少导航误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13830 2026-07-22 cs.RO cs.CV 版本更新 62%

Recursive ArUco Markers: A Scalable Fiducial Marker Design for Unmanned Aerial Vehicle Landing Pads

递归ArUco标记:一种用于无人机着陆垫的可扩展基准标记设计

Rafael Munoz-Salinas, Francisco Jose Romero-Ramirez, Sergio Garrido-Jurado

机构 * Universidad de Córdoba(科尔多瓦大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究针对无人机着陆依赖的视觉基准标记操作范围有限问题,提出递归ArUco标记设计,通过改进位采样策略实现任意深度递归、遮挡下稳健检测及多唯一标识符字典,使无人机机队可同时在指定位置着陆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18537 2026-07-22 cs.RO cs.AI 版本更新 62%

SKETCH: Semantic Key-Point Conditioning for Long-Horizon Vessel Trajectory Prediction

SKETCH: 面向长时域船舶轨迹预测的语义关键点条件建模

Linyong Gan, Zimo Li, Wenxin Xu, Xingjian Li, Jianhua Z. Huang, Enmei Tu, Shuhang Chen

机构 * School of Data Science, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)数据科学学院) School of Science and Engineering, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)科学与工程学院) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen, China(香港中文大学(深圳)人工智能学院) COSCO SHIPPING Advanced Technology Institute, Shanghai, China(中远海运技术研究院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 针对长时域轨迹预测中方向漂移问题,提出基于语义关键点(NKP)的条件轨迹建模框架,将预测分解为全局语义决策与局部运动建模,采用预训练-微调策略估计NKP先验,在真实AIS数据上显著提升长时域、方向精度和细粒度预测性能。

Comments Final Camera-Ready Version. Accepted by ICML 2026 (PMLR Vol. 306)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08926 2026-07-22 cs.RO 版本更新 61%

Fly, Track, Land: Infrastructure-less Magnetic Localization for Heterogeneous UAV-UGV Teaming

飞行、跟踪、着陆:一种无基础设施的磁感应定位用于异构无人机-地面车辆协同

Valerio Brunacci, Davide Plozza, Alessio De Angelis, Michele Magno, Tommaso Polonelli

机构 * Department of Engineering, University of Perugia(工程系,佩鲁吉亚大学) Multi-Robot Systems Group, Faculty of Electrical Engineering, Czech Technical University in Prague(多机器人系统组,电气工程系,布拉格捷克技术大学) D-ITET Department, ETH Zürich(D-ITET部门,苏黎世联邦理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO;robotics(comments)

AI总结 该研究提出一种无基础设施的磁感应定位系统,使无人机在移动地面车辆上实现厘米级精度的自主悬停、跟踪和着陆。

Comments Revised version submitted to Robotics and Autonomous Systems (Elsevier). Supplementary video available

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13715 2026-07-22 cs.CV 版本更新 57%

MVGD-Net: A Novel Motion-aware Video Glass Surface Detection Method

MVGD-Net: 一种新颖的运动感知视频玻璃表面检测网络

Yiwei Lu, Hao Huang, Tao Yan

机构 * Tao Yan(谭燕)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 MVGD-Net通过利用视频中运动不一致特性,提出新颖网络检测玻璃表面,结合多模块融合与大规模数据集提升检测性能。

Comments This paper has been accepted by the 40th AAAI Conference on Artificial Intelligence (AAAI-26). It contians 9 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17913 2026-07-22 cs.AI 版本更新 57%

Learning, Reasoning, Refinement: A Framework for Kahneman's Dual-System Intelligence in GUI Agents

学习、推理、优化:GUI 智能体中卡尼曼双系统智能的框架

Jinjie Wei, Jiyao Liu, Lihao Liu, Ming Hu, Junzhi Ning, Mingcheng Li, Weijie Yin, Junjun He, Xiao Liang, Chao Feng, Dingkang Yang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(复旦大学智能机器人与先进制造学院) Institute of Science and Technology for Brain-Inspired Intelligence, Fudan University(复旦大学脑启发式智能科学技术研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Amazon(亚马逊) Shanghai Innovation Institute(上海创新研究院) ByteDance Douyin Content Group(字节跳动抖音内容部)

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 针对 GUI 智能体存在依赖试错决策、评估指标简单等问题,提出 CogniGUI 框架,结合全解析器引擎和 GRPO 基础智能体,实现自适应学习,经实验验证其在新基准测试中优于现有方法。

Comments Withdrawn due to ongoing technical improvements. The work requires further refinement and additional experiments to meet our quality standards. A revised version will be submitted in the future

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22147 2026-07-22 cs.DS 版本更新 50%

Optimal-Time Move Structure Construction

最优时间移动结构构造

Nathaniel K. Brown, Ahsan Sanaullah, Shaojie Zhang, Ben Langmead

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出一种最优时间与空间的移动结构构造算法,用于高效表示和导航排列,尤其在r远小于n时能显著压缩空间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17238 2026-07-22 cs.HC 版本更新 50%

Actionable Guidance Outperforms Map and Compass Cues in Demanding Immersive VR Wayfinding

可操作指导在 demanding immersive VR 导航中优于地图和指南针提示

Apurv Varshney, Lily M. Turkstra, Jiaxin Su, Mable Zhou, Scott T. Grafton, Barry Giesbrecht, Mary Hegarty, Michael Beyeler

专题命中 具身导航 :navigation(abstract)

AI总结 本文比较了三种VR导航技术:方向箭头、迷你地图和指南针,发现箭头指导在导航性能上最佳,提示在沉浸式导航中直接转化为行动提示的界面更有效。

Comments AV and LMT contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08745 2026-07-22 cs.IR 版本更新 50%

Towards Full Candidate Interaction: A Comprehensive Comparison Network for Better Route Recommendation

迈向完整候选交互:一种全面比较网络用于更好的路线推荐

Hanyu Guo, Chao Chen, Longfei Xu, Chengzhang Wang, Kaikui Liu, Xiangxiang Chu

专题命中 具身导航 :navigation(abstract)

AI总结 本文提出全面比较网络(CCN)用于改进路线推荐,通过比较非重叠段构建特征,解决路线推荐中的独特挑战,并在AMAP中成功部署。

Comments Accepted by the ACM Conference on Recommender Systems 2026 (RecSys '26), Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03642 2026-07-22 cs.CG 版本更新 50%

Generalized k-Cell Decomposition for Visibility Planning in Polygons

多边形中用于可见性规划的广义 k 单元分解

Yeganeh Bahoo, Sajad Saeedi, Roni Sherman

专题命中 具身导航 :robotic(abstract)

AI总结 研究多边形环境追逃问题,提出广义 k 单元分解方法,通过纳入特定可见性多边形扩展现有工作,构建分割线并证明正确性,实现可靠路径规划,为机器人监控开辟新途径,难点在于计算多边形和找分割线交点。

Comments Presented at the 32nd Annual Fall Workshop on Computational Geometry (FWCG 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 2 篇

2604.26182 2026-07-22 cs.CV cs.AI cs.LG 版本更新 85%

Lifting Embodied World Models for Planning and Control

提升具身世界模型用于规划与控制

Alex N. Wang, Trevor Darrell, Pavel Izmailov, Yutong Bai, Amir Bar

机构 * Computer Science, New York University(纽约大学计算机科学系) BAIR, UC Berkeley(伯克利大学BAIR)

专题命中 具身推理 :world model(title,abstract);embodied agent(abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出一种轻量级策略,将高层动作映射到低层关节动作序列,结合冻结的世界模型,实现预测未来观察的提升世界模型,有效降低规划复杂度。

Comments Accepted to ECCV2026. Edited policy masking

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12721 2026-07-22 cs.AI 版本更新 57%

The Theory of Mind Utility: Formal Specification of a Mentalizing Mechanism

心智理论效用:心理化机制的形式化规范

Nikolos Gurney, Stacy Marsella

机构 * Institute for Creative Technologies, University of Southern California(南加州大学创意技术研究所) Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院)

专题命中 具身推理 :world model(abstract);分类 cs.AI

AI总结 提出心智理论效用(ToM-U)框架,通过局部认知世界模型(LEWM)形式化推断他人信念的计算问题,定义结构、推理过程及失败痕迹,区别于贝叶斯心智理论等方法。

详情

展开后加载摘要…

URL PDF HTML 收藏