arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-11 至 2026-08-11 共收录 189 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 30 篇

2508.07033 2026-08-11 cs.RO 版本更新 79%

$\mathcal{P}^3$: Toward Versatile Embodied Agents

$\mathcal{P}^3$:迈向通用具身智能体

Shengli Zhou, Xiangchen Wang, Jinrui Zhang, Ruozai Tian, Jianzheng Huang, Rongtao Xu, Guanhua Chen, Feng Zheng

机构 * Southern University of Science and Technology(南方科技大学) Spatialtemporal AI(时空AI) MBZUAI

专题命中 机器人数据与评测 :embodied agent(title,abstract);分类 cs.RO

AI总结 研究针对具身智能体面临的动态环境感知、工具使用和多任务规划挑战,提出$\mathcal{P}^3$统一框架,集成实时感知与动态调度,经实验验证能打造高迁移性通用具身智能体。

Comments Accepted by RSS 2026 Workshop ExWBC

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09528 2026-08-11 cs.RO 新提交 74%

Robotic Fabric Alignment System for Sewing Using Global Local Weighted ICP

采用全局局部加权迭代最近点(GLW-ICP)的缝纫用机器人布料对位系统

Wenbo Dong, Dipankar Bhattacharya Member, Kai Tang, Akinari Kobayashi, Fuyuki Tokuda, Akira Seino, Norman C. Tien, Kazuhiro Kosuge

机构 * The University of Hong Kong(香港大学) Imperial College London(帝国理工学院) Tohoku University(东北大学) Fukushima University(福岛大学) City University of Hong Kong(香港城市大学)

专题命中 机器人数据与评测 :robotic(title);分类 cs.RO

AI总结 该研究提出采用GLW-ICP方法的机器人布料对位系统,可实现布料全局边缘与局部缝纫线的精准对齐,在有无遮挡下均达毫米级精度,适用于自动缝纫场景。

Comments 16 pages, 10 figures, https://bhattner143.github.io/rfas-glwicp.github.io/

Journal ref IEEE Transactions on Automation Science and Engineering, vol. 23, pp. 13391-13406, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08053 2026-08-11 cs.RO cs.CV 新提交 73%

PhysX-CoT: Structured Physical Reasoning from a Single Image to Simulation-Ready 3D Assets

PhysX-CoT:从单张图像生成可用于仿真的3D资产的结构化物理推理

Jie Huang, Xiaohe Li, Jiahao Li, Fangli Mou, Chen Qian, Yuqiang Fang, Junhao Fan, Kaixin Zhang, Zide Fan

机构 * Space Engineering University(航天工程大学)

专题命中 机器人数据与评测 :robotics(abstract);embodied AI(abstract);分类 cs.RO、cs.CV

AI总结 PhysX-CoT将单张图像生成仿真3D资产视为显式结构化物理推理过程,通过分解部件级状态轨迹优化相关指标,在多方面优于基线,生成资产在Unreal Engine 5中表现良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08016 2026-08-11 cs.CV 新提交 70%

EgoTrack3D: A Modular Framework for Egocentric 3D Object Tracking

EgoTrack3D:一种用于第一人称视角三维目标跟踪的模块化框架

Jan Kulik, Bjarni Dagur Thor Karason, Yung-Hsu Yang, Boyang Sun, Marc Pollefeys, Xi Wang

机构 * ETH Zürich(苏黎世联邦理工学院) Microsoft Research(微软研究院) TUM(慕尼黑工业大学) MCML(慕尼黑计算与机器学习中心)

专题命中 机器人数据与评测 :robotics(abstract);navigation(abstract);分类 cs.CV

AI总结 EgoTrack3D是一种模块化框架,可从第一人称视角RGB视频重建动态三维场景,在ADT数据集上较基线提升11% PCL,还能在退化观测下维持准确空间表示。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10168 2026-08-11 cs.CV cs.AI cs.RO 版本更新 67%

RAG-3DSG: Enhancing 3D Scene Graphs with Re-Shot Guided Retrieval-Augmented Generation

RAG-3DSG: 通过重拍引导的检索增强生成增强3D场景图

Yue Chang, Rufeng Chen, Zhaofan Zhang, Yi Chen, Yifan Tian, Sihong Xie

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 RAG-3DSG通过重拍引导的不确定性估计缓解3D场景图中的语义不一致问题,利用对象级检索增强生成方法提升机器人任务中的场景表示可靠性。

Comments Accepted by ECCV

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07905 2026-08-11 cs.AI cs.RO 新提交 62%

GraphThink: Graph-Enhanced LLM Thinking for Long-Horizon Embodied Task Planning

GraphThink:用于长视距具身任务规划的图增强大语言模型思维

Chen Li, Sijie Cheng, Yuelin Zhang, Junxi Li, Maozhi Huang, Yang Liu, Wenbing Huang

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学高瓴人工智能学院) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Tsinghua University(清华大学) The Hong Kong Polytechnic University(香港理工大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.RO、cs.AI

AI总结 GraphThink框架结合任务图与场景图,通过上下文提示、迭代优化、GRPO奖励设计及事件驱动重规划,在ALFRED基准上实现最优性能,具强泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23755 2026-08-11 cs.CV cs.RO 交叉投稿 62%

DAP-Pose: Deep Temporal Alignment and Physics-aware Cross-modal Sensor Fusion for Robust Pose Estimation

DAP-Pose:用于鲁棒姿态估计的深度时间对齐和物理感知跨模态传感器融合

Jianhan Lin, Yuchu Qin, Jiateng Yuan, Wenbo Zhang, Shuai Gao

机构 * Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院空天信息创新研究院) International Research Center of Big Data for Sustainable Development Goals(可持续发展大数据国际研究中心) University of Chinese Academy of Sciences(中国科学院大学) The University of Adelaide(阿德莱德大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对复杂环境下多模态传感器的姿态估计问题,提出DAP-Pose模型,通过双级跨模态融合模块捕捉线索,深度时间对齐模块处理异步流,结合物理感知约束,在KITTI数据集上达最优性能,平均平移误差1.31%,旋转误差0.46°,严重错位下也能准确估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19517 2026-08-11 cs.LG cs.AI 版本更新 62%

Automating Deception: Scalable Multi-Turn LLM Jailbreaks

自动化欺骗:可扩展的多轮LLM欺骗攻击

Adarsh Kumarappan, Ananya Mujoo

机构 * California Institute of Technology(加州理工学院) Evergreen Valley College(埃弗格林谷学院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 本文提出自动化生成多轮LLM欺骗数据集的方法,揭示GPT家族模型在对话历史中的脆弱性,而Gemini 2.5 Flash则表现出极强的抗性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09898 2026-08-11 cs.CL cs.LG 新提交 57%

Consilience for Verifier-Free Test-Time Scaling

无验证器的测试时扩展的一致性方法

Lecheng Kong, Like Hui, Haitao Mao, Jun Huan

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.LG

AI总结 本文针对现有基于置信度的无验证器测试时扩展(VF-TTS)方法在复杂任务上失效的问题,提出一致性(consilience)框架,通过评估置信度时间不对称性提升LLM推理性能,在数学和代码生成任务上优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09593 2026-08-11 cs.SD cs.AI 新提交 57%

MADBench: A Benchmark for Modality-Aware Audio Deepfake Detection

MADBench:面向模态感知音频深度伪造检测的基准

Yanqiu Li, Yang Xiao, Jisheng Bai, Bin Chen, Hong Jia, Ting Dang

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 MADBench是首个区分语音与环境音频的音频深度伪造检测基准,测试发现环境音频操纵更易检测,现有预训练检测器在两类声学成分上均失效,为相关研究提供严谨基础。

Comments 11 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09556 2026-08-11 cs.RO cs.SY eess.SY 新提交 57%

TDMA Based Communications Control Co-Design for Cooperative Carrying: Delay Calibration and Sampling-Rate Optimization

基于TDMA的协同搬运通信控制协同设计:时延校准与采样率优化

Zahra Seifaei, Maximilian Luebke, Torsten Reissland, Danial Dehghani, Norman Franchi

机构 * Institute for Smart Electronics and Systems, Friedrich-Alexander-Universität Erlangen-Nürnberg(弗里德里希-亚历山大-埃尔朗根-纽伦堡大学智能电子与系统研究所)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文针对多机器人协同搬运的通信挑战,在MuJoCo仿真中评估三种控制方法,发现动态采样降开销、轮换领导提公平性且不影响搬运能力,为通信受限场景部署协同机器人提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09388 2026-08-11 cs.CV 新提交 57%

Efficient Human-Contact Representation for Human-Scene Interaction

面向人-场景交互的高效人体接触表示

Nghia Vu, Tuong Do, Binh X. Nguyen, Erman Tjiputra, Anh Nguyen

机构 * AIOZ University of Liverpool(利物浦大学) NTHU(国立清华大学)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 针对人-场景交互中接触表示效率不足的问题,提出稀疏接触掩码与稀疏算子,在三个基准数据集的接触预测和场景合成任务上,实现至少12倍提速且精度优于现有最优模型。

Comments Accepted in ECCV 2026 Workshops

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08884 2026-08-11 cs.RO cs.HC 新提交 57%

SHRIMP: Iterative Refinement of Robot Task Plans

SHRIMP:机器人任务计划的迭代优化

Mya Schroder, Yuna Hwang, Callie Y. Kim, Leqian Cheng, Jeffrey Li-cheng Liu, Chenchen Zheng, Xinning He, Bilge Mutlu

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 针对协作机器人任务计划的语义歧义与透明度不足问题,提出SHRIMP系统,可通过自然语言生成分层机器人原语计划并迭代修正,经35人用户研究验证其能提升用户感知控制与机器人透明度。

Comments 11 pages, 8 figures, The 39th Annual ACM Symposium on User Interface Software and Technology (UIST '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08558 2026-08-11 cs.RO 新提交 57%

Vid2WAM: Distilling Video Diffusion Priors into World Action Models

Vid2WAM:将视频扩散先验蒸馏为世界动作模型

Chenhao Qiu, Ruixiang Wang, Runyi Zhao, Sixu Lin, Songen Gu, Shufeng Nan, Guiliang Liu, Kui Jia, Yanwei Fu, Simo Wu

专题命中 机器人数据与评测 :robot policy(abstract);分类 cs.RO

AI总结 Vid2WAM是将视频扩散先验蒸馏为WAM的离线框架,通过双监督通道与源感知残差动作适配,提升了机器人策略的新任务泛化性与数据效率,且推理高效。

Comments Project website: https://qch-fa.github.io/vid2wam-website/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08070 2026-08-11 cs.RO 新提交 57%

SurgWMBench: A Vision-Based Benchmark for World-Modeling Surgical Instrument Motion Planning

SurgWMBench:面向世界建模的手术器械运动规划视觉基准

Huanrong Liu, Weiliang Huang, Bob Zhang, Weichao Cai, Chunlin Tian, Qingbiao Li

机构 * University of Macau(澳门大学) National University of Singapore(新加坡国立大学) Xiamen University(厦门大学)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.RO

AI总结 本文提出SurgWMBench,一种面向短程手术运动规划的视觉基准,可评估手术世界模型的器械运动预测与连续回推稳定性,解决现有指标与器械规划需求不匹配的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07873 2026-08-11 cs.AI 新提交 57%

Back to the Future: A workbook time machine for spread sheet creation benchmarks

回到未来:用于电子表格创建基准测试的工作簿时光机

Mansi Uniyal, Agamdeep Singh, Ananya Singha, Priyanshu Gupta, Mukul Singh, Gust Verbruggen, Vu Le, Sumit Gulwani

机构 * Microsoft(微软公司)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 本研究提出workbook time machine流水线,构建了含150个任务的电子表格创建评估基准wtmbench,揭示了查询特异性等因素对大语言模型Excel任务性能的关键影响。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08860 2026-08-11 eess.SY cs.HC cs.RO cs.SY physics.med-ph 新提交 57%

Preview-Based Relative-Motion Control of an Insertion Tool for Neural-Thread Placement in Pulsating Tissue

搏动组织中神经线程放置的插入工具的基于预览的相对运动控制

Yongyan Cao

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 该研究针对搏动组织的神经线程放置,开发基于预览的相对运动控制器,经仿真验证可降低放置误差与接触剪切,提升QP求解可行性,在一定质量失配下保证稳定性,为后续硬件部署提供仿真基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19341 2026-08-11 cs.CV 版本更新 57%

ExpertVerse: A General-Purpose Benchmark for Expert-Level Reasoning in Knowledge-Intensive Visual Synthesis

ExpertVerse:知识密集型视觉合成中专家级推理的通用基准

Yuan Wang, Yongchao Du, Mengting Chen, Jinsong Lan, Jiaxuan Luo, Xuetao Feng, Xiaoyong Zhu

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 研究针对多模态生成模型在知识密集型生成的不足,开发ExpertVerse基准,涵盖多种认知能力和专家学科,生成相关数据集,训练KnowThinker并提出BPPO优化方法,揭示模型推理缺陷,强调知识密集型基准对下一代视觉生成的重要性。

Comments 14 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26519 2026-08-11 cs.CV 版本更新 57%

GIFGuard: Proactive Forensics against Deepfakes in Facial GIFs via Spatiotemporal Watermarking

GIFGuard:通过时空水印实现面向面部GIF的主动取证对抗深度伪造

Shupeng Che, Zhiqing Guo, Changtao Miao, Dan Ma, Gaobo Yang

机构 * School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院) College of Computer Science and Electronic Engineering, Hunan University(湖南大学计算机科学与电子工程学院)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 本文提出GIFGuard,首个针对GIF中深度伪造的时空水印框架,通过STARE和DIRD实现高鲁棒性取证,构建GIFfaces基准数据集以促进研究。

Comments Accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24084 2026-08-11 cs.AI 版本更新 57%

Bridging the Evaluation Gap: Standardized Benchmarks for Multi-Objective Search

弥合评估差距:多目标搜索的标准化基准

Hadar Peer, Carlos Hernandez, Sven Koenig, Ariel Felner, Oren Salzman

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.AI

AI总结 本文提出首个标准化多目标搜索基准,涵盖四个结构各异的领域,通过固定实例和标准查询确保评估的鲁棒性和全面性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.17504 2026-08-11 cs.CV q-bio.QM 版本更新 57%

BMDS-Net:Deployment-aware multi-modal brain tumor segmentation with adaptive fusion,decoder regularization,and Bayesian calibration

BMDS-Net:一种用于鲁棒脑肿瘤分割的贝叶斯多模态深度监督网络

Yan Zhou, Suncheng Xiang, Zhen Huang, Yue Ouyang, Yingqiu Li, Zehua Wang

机构 * School of Mathematics and Statistics, Changsha University of Science and Technology(数学与统计学学院,长沙理工大学) School of Biomedical Engineering, Shanghai Jiao Tong University(生物医学工程学院,上海交通大学) Shanghai Chest Hospital, Shanghai Jiao Tong University School of Medicine(上海胸科医院,上海交通大学医学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 BMDS-Net通过贝叶斯方法提升多模态脑肿瘤分割的鲁棒性和可信度,实现更稳定的临床应用。

Comments 21 pages, 6 figures. Manuscript prepared for submission to ACM HEALTH

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08971 2026-08-11 cs.HC 新提交 50%

Generative Proxy: Synthesizing Proxy-Based Interfaces for Real-World Interaction Across AR Glasses

生成式代理:为AR眼镜跨现实世界交互合成基于代理的界面

Xianhao Carton Liu, William Chastek, Eric J Gonzalez, Mar Gonzalez-Franco, Chen Zhu-Tian

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 该研究提出Generative Proxy方法,可从场景、意图和设备能力自动生成适配轻量化AR眼镜的基于代理的交互界面,经专家评估其生成的界面有用且可用,为AR交互提供新范式。

Comments 11 pages, 11 figures, published in UIST '26, Detroit, MI, USA, Nov 2 - 5, 2026; UIST '26: ACM Symposium on User Interface Software and Technology

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26424 2026-08-11 eess.SY cs.SY 版本更新 50%

Fully distributed singularity-free prescribed-time stabilization of the continuous-time generalized adaptive Bellman-Ford algorithm

连续时间广义自适应贝尔曼-福特算法的全分布式无奇点规定时间镇定

Yuanqiu Mo, Jian Qin, Soura Dasgupta

专题命中 机器人数据与评测 :robotic(abstract)

AI总结 本文针对分布式有偏最小共识协议衍生的GABF算法仅渐近稳定、收敛速度不明的问题,提出两种控制策略实现其规定时间镇定,并通过仿真验证了方法有效性。

Comments 12 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24676 2026-08-11 cs.GT 版本更新 50%

The Degree of Strategy-Proofness for Risk-Averse Committee Selection

风险规避委员会选择的防策略性程度

Dael Sinay, Rica Gonen

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 研究风险规避委员会选择的防策略性程度,将RAT程度框架扩展到基于批准的委员会选择,聚焦比例批准投票规则,通过建立界限表明其在不同选民选票知晓数量下对安全操纵的敏感性。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他机器人 15 篇

2608.07555 2026-08-11 cs.RO 新提交 80%

You Don't Need To Stay in The Loop: An Agentic Robotics Loop for Robot-Policy Improvement

你无需停留在循环中:用于机器人策略改进的智能体机器人循环

Hang Yu

专题命中 其他机器人 :robotics(title,comments);robotic(abstract);分类 cs.RO

AI总结 该研究将编码智能体的软件循环架构迁移至机器人策略改进领域,提出AgenticRobotics控制平面,解决机器人工具易失效问题,实现错误提升控制等性能提升。

Comments Agentic Robotics Preview Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09602 2026-08-11 cs.RO 新提交 79%

Nonlinear Model Predictive Control of a Robotic Soft Esophagus

机器人软食管的非线性模型预测控制

Dipankar Bhattacharya, Ryman Hashem, Leo K. Cheng, Weiliang Xu

机构 * University of Auckland(奥克兰大学) Auckland Bioengineering Institute(奥克兰生物工程研究所)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO

AI总结 该研究针对机器人软食管(RoSE)的闭环控制问题,设计了带传感器的RoSEv2.0,采用基于SINDYC的模型预测控制生成目标蠕动波,还完成了支架迁移测试,为食管相关体外研究提供支持。

Comments Accepted manuscript. 12 pages. Published in IEEE Transactions on Industrial Electronics. Project page: https://bhattner143.github.io/rosev2-dtsindyc.github.io/ Code: https://github.com/bhattner143/SINDYc_MPC_RoSE_symmetric_peristaltic

Journal ref IEEE Trans. Ind. Electron., vol. 69, no. 10, pp. 10363-10373, Oct. 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08157 2026-08-11 cs.RO 新提交 79%

Event-Time Hybrid Optimal Control for Robotic Table Tennis Serves

机器人乒乓球发球的事件时间混合最优控制

Thomas Gossard, Till Köpff, Andreas Ziegler

专题命中 其他机器人 :robotic(title,abstract);分类 cs.RO

AI总结 针对机器人乒乓球发球的非线性混合系统,提出事件时间最优控制方法,结合两个OCP生成符合约束的发球,求解时间缩短4.1倍,真实机器人实验实现可控落点与各类旋转发球。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07876 2026-08-11 cs.AI 新提交 79%

SurgLAT: Surgical Latent Attention Tracking for Depth-Aware Robotic Laparoscope Control

SurgLAT:面向深度感知的机器人腹腔镜控制的手术隐式注意力跟踪

Rulin Zhou, Qiujie Song, Yujie Ma, An Wang, Wanhao Liu, Guoheng Ma, Yidu Wang, Guankun Wang, Xingrong Diao, Jiankun Wang, Chaowei Zhu, Xianming Liu, Hongliang Ren

机构 * The Chinese University of Hong Kong(香港中文大学) Shenzhen Loop Area Institute(深圳河套学院) Shenzhen University(深圳大学) Southern University of Science and Technology(南方科技大学)

专题命中 其他机器人 :robotic(title,abstract);分类 cs.AI

AI总结 本研究提出SurgLAT框架,结合DINOv3编码器等技术实现隐式手术注意力建模,通过机器人部署框架验证,可在复杂手术场景下实现自主腹腔镜稳健跟踪与稳定调整。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07707 2026-08-11 cs.RO cs.CG 新提交 79%

Hölder Signed Distance: A Differentiable, Signed, Parallelizable Metric for Robotics

Hölder 符号距离:一种适用于机器人学的可微、带符号、可并行化的度量

Felipe Bartelt, Ali Umut Kaypak, Anthony Tzes, Farshad Khorrami, Luciano C. A. Pimenta, Vinicius M. Gonçalves

专题命中 其他机器人 :robotics(title);robotic(abstract);分类 cs.RO

AI总结 该研究提出一种适用于凸多面体的可微符号距离,通过引入 Hölder 最小/最大算子替换经典 SDF 的 min-max 算子,实现闭式计算且可 GPU 并行,经实验验证其在机器人控制领域的适用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09848 2026-08-11 cs.AI 新提交 74%

CEAA: A Cognitive Embodied Agents Architecture for Interactive Computing Systems

CEAA:面向交互式计算系统的认知具身智能体架构

Aimilios Hadjiliasi, Louis Nisiotis

专题命中 其他机器人 :embodied agent(title);分类 cs.AI

AI总结 该研究针对具身IVAs在实时交互式虚拟环境中实现认知能力的挑战,提出基于Sense-Think-Act等框架的模块化认知架构,弥合高级推理与实时执行的差距,用于部署可扩展的具身IVAs。

详情

展开后加载摘要…

URL PDF HTML 收藏