arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-29 至 2026-07-29 共收录 17 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 17 篇

2410.24035 2026-07-29 cs.RO cs.AI cs.LG 版本更新 89%

A context-adaptive policy framework for robust and reactive robotic manipulation via uncertainty-aware imitation learning

一种通过不确定性感知模仿学习实现鲁棒且反应式机器人操作的上下文自适应策略框架

Tim R. Winter, Leonard Klüpfel, Ashok M. Sundaram, Werner Friedl, Maximo A. Roa, Freek Stulp, João Silvério

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);robotics(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究如何生成适应变化的机器人操作策略,基于策略融合与不确定性量化提出上下文自适应框架,用LfD获取策略并结合MoE提升鲁棒性,在多种场景下评估该方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26047 2026-07-29 cs.RO 新提交 83%

S2A2: Audio-Visual Imitation Learning for Manipulation Tasks Using Acoustic Spatial Information

S2A2:利用声学空间信息进行操作任务的视听模仿学习

Kaneyoshi Hiratsuka, Benjamin Yen, Ryosuke Kojima

机构 * Kyoto University(京都大学) RIKEN(理化学研究所) Institute of Science Tokyo(东京理科大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究利用声学信息进行操作任务的模仿学习,提出多模态框架S2A2,集成视觉与声学信息,实现多种策略集成,模拟与真实机器人实验表明其对特定任务有效且适用于现实操作。

Comments Project page: https://azuma413.github.io/projects/s2a2

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25895 2026-07-29 cs.RO cs.CV cs.LG 新提交 82%

HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone

HiFi-UMI:仅从高保真UMI数据中学习可部署的操作策略

Simple AI, :, Yuteng Wei, Jinming Ma, Jiawei Wang, Weitao Zhou, Yushen Zuo, Ke Rui, Minglei Li, Jinhao Zhang, Zhikang Pan, Xiang Wang, Haoran Jia, Huan Du, Zicheng Zeng, Jun Ma, Guiyu Qin, Di Zhang, Xiaofei Li

机构 * Simple AI(简单人工智能公司)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 研究如何从高保真UMI数据学习可部署操作策略,提出HiFi-UMI系统,其无需外部跟踪达3毫米精度。利用该系统数据实现零机器人训练后策略,预训练还能降误差提成功率,且开源了相关高保真资源。

Comments 33 pages, 15 figures, 4 tables. Project page: https://cloud.simpleai.tech/simple-world-lab/hifi-umi/ Dataset: https://huggingface.co/datasets/simple-world-lab/HiFi-UMI-2K

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12109 2026-07-29 cs.RO cs.AI 版本更新 81%

InDex: Empowering VLA Models with Intent-Conditioned Arm-Hand Coordination for Dexterous Manipulation

弥合形态差距:通过意图条件微调使VLA模型适应灵巧操作

Chuanke Pang, Junyi Huang, Zhijun Zhao, Yaobing Wang, Kun Xu, Xilun Ding

机构 * Beihang University(北京航空航天大学) China Academy of Space Technology(中国空间技术研究院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出InDex框架,通过将预训练的1-DoF平行抓取输出重用作宏观虚拟抓取意图代理,结合两阶段解耦学习架构,实现VLA模型从低自由度夹爪到高自由度灵巧手的适应,有效缓解灾难性遗忘和动作流形坍缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24859 2026-07-29 cs.CR 新提交 78%

The Mirage of LLM Guardrails: A Case Study in AI-Assisted Medical Note Manipulation

大语言模型护栏的幻象:人工智能辅助医疗记录操纵的案例研究

Davis Yadav, Amulya Yadav

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究大语言模型在医疗记录操纵场景下内置护栏的可靠性,通过开发操纵流程、实证评估、利用多种指标评估及用户研究,揭示其弱点,为大语言模型在医疗领域的护栏设计、安全政策及伦理等方面提供参考。

Comments 10 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24888 2026-07-29 cs.CR cs.SE 新提交 71%

Trusting-Trust Attack against an Entire Linux Distribution through Binary Manipulation

通过二进制操作对整个Linux发行版进行信任-信任攻击

Julien Malka, Aman Sharma, Martin Monperrus, Stefano Zacchiroli, Théo Zimmermann

专题命中 机器人操作 :manipulation(title)

AI总结 研究针对Linux发行版的信任-信任攻击,利用对成品ELF文件的操作,围绕GNU strip构建攻击。在NixOS引导中植入有效载荷,在实际nixpkgs版本上成功构建安装程序并植入后门,证明该攻击不限于编译器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25397 2026-07-29 cs.RO 新提交 70%

Decompose and Reorganize: Planning with Primitives and Visuomotor Policies Learned from Demonstrations

分解与重组:利用从示范中学到的原语和视觉运动策略进行规划

Yizhou Chen, Hang Xu, Dongjie Yu, Yupu Lu, Tengye Xu, Zeqing Zhang, Wei Zhang, Yi Ren, Ben M. Chen, Jia Pan

机构 * The University of Hong Kong(香港大学) JD.com (JingDong)(京东) Nanyang Technological University (NTU)(南洋理工大学) Southern University of Science and Technology (SUSTech)(南方科技大学) Huawei Technologies(华为技术有限公司) The Chinese University of Hong Kong (CUHK)(香港中文大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究如何使机器人灵巧、长视野操作自动化,提出DR-LfD框架,将视觉运动策略集成到TAMP决策系统,基于接触关系分解示范为原子技能,经实验验证该框架在多类任务中性能强大。

Comments 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25798 2026-07-29 cs.RO 新提交 57%

Transformer Transformer: A Unified Model for Motion-Conditioned Robot Co-design

Transformer Transformer:一种用于运动条件机器人协同设计的统一模型

Huy Ha, C. Karen Liu, Shuran Song

机构 * Stanford University(斯坦福大学) Columbia University(哥伦比亚大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究运动条件机器人协同设计问题,提出基于RoboTokens训练的Transformer Transformer统一模型,能跨实体空间和用例,通过动力学自引导优化设计,实验显示其可零样本优化,制造的优化设计大幅降低跟踪误差。

Comments 26 pages, 12 figures, 20 tables. Project page: https://transformer-transformer.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25227 2026-07-29 cs.CR cs.LG 新提交 57%

Decision-Level Hijacking: Injecting Cognitive Bias into Large Language Models via Bit-Flip Attacks

决策级劫持:通过位翻转攻击向大语言模型注入认知偏差

Yu Yan, Jiahao Chen, Siqi Lu, Yongjuan Wang, Ziming Zhao, Zhaoxuan Li, Tianyu Du, Qingjun Yuan, Shouling Ji

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 研究大语言模型在高风险决策场景中的决策级劫持问题,提出CogBias框架,利用位翻转攻击,通过可微情感评估器等将主观偏好转化为优化信号,经实验验证该方法能在少量位翻转下诱导目标主题立场转变,破坏模型价值对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14914 2026-07-29 cs.CV 版本更新 57%

Beyond Prompts: Unconditional 3D Inversion for Out-of-Distribution Shapes

超越提示:无条件3D反演用于分布外形状

Victoria Yue Chen, Emery Pierson, Léopold Maillard, Maks Ovsjanikov

机构 * ETH Zürich(苏黎世联邦理工学院) École Polytechnique(巴黎高等理工学院) Dassault Systèmes(达索系统)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究揭示了文本驱动生成模型在3D形状生成中的局限性,提出通过解耦几何表示与语言敏感性来提升无条件生成的鲁棒性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11548 2026-07-29 cs.CY cs.AI cs.CL 版本更新 57%

Fairness Is Not Enough: Auditing Competence and Intersectional Bias in AI-powered Resume Screening

公平还不够:人工智能驱动的简历筛选中的能力审核与交叉性偏差

Kevin T Webster

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究对八个用于简历筛选的AI平台进行审核,通过实验发现其存在情境依赖和交叉性的种族及性别偏差,部分看似无偏差的模型无评估能力,仅公平评估不足,进而提出双重验证框架以确保AI负责任部署。

Comments 45 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18975 2026-07-29 cs.LG 版本更新 57%

Invariance Pair Guidance: Robustness to Spurious Correlations via Corrective Gradients

不变性对引导:通过校正梯度实现对抗虚假相关性的鲁棒性

Martin Surner, Abdelmajid Khelil, Ludwig Bothmann

机构 * Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 提出不变性对引导(IPG)方法,利用稀疏的反事实对和双更新机制动态校正优化轨迹,减少模型对虚假相关性的依赖,在多个数据集上验证了有效性。

Comments This version of the article has been accepted for publication, after peer review (when applicable) but is not the Version of Record and does not reflect post-acceptance improvements, or any corrections. The Version of Record is available online at: https://doi.org/10.1007/s10994-026-07092-0

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25846 2026-07-29 math.GR math.FA math.MG 新提交 50%

Ends of Uncountable Locally Finite Groups: An Analytic and Coarse Geometric Approach

不可数局部有限群的端点:一种分析与粗几何方法

Hussain AL-Rasheed

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究不可数局部有限群的端点问题,采用通过希格森冠拓扑结构的粗几何方法,借助子群不变性解释粗开闭集边界,利用相关技术实现几何刚性,得出此类群恰好有一个端点的结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25998 2026-07-29 quant-ph 新提交 50%

Observable Estimation in the Absence of Classical Verification

在没有经典验证的情况下的可观测量估计

Samantha V. Barron, Bradley Mitchell, Vinay Tripathi, Francesco Grieco, Ilan Rosen, Francesca Pietracaprina, Davide Materia, Alireza Seif, Darvin Wanisch, Ramón L. Panadés-Barrueta, Ewout van den Berg, Jay-U Chung, Andrew Eddins, Sam Ferracin, Guillermo García-Pérez, John Goold, Luke C. G. Govia, Holger Haas, Ian Hincks, Jesse C. Hoke, Zoë Holmes, Su-un Lee, Youngseok Kim, Swarnadeep Majumder, Sabrina Maniscalco, Simone Montangero, Daniel Puzzuoli, Tomaž Prosen, James Raftery, Ricardo Rivera Cardoso, Max Rossmannek, Manuel Rudolph, Brendan Saxberg, Liran Shirizly, Karthik Siva, Joshua Skanes-Norman, Ilaria Siloi, Kevin C Smith, Boris Sokolov, Maika Takita, Yanting Teng, Mao Tian Tan, Joseph Tindall, Zoltán Zimborás, Matteo A. C. Rossi, Minh C. Tran, Sergei N. Filippov, Abhinav Kandala

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究在无经典验证时如何信任量子结果,建立独立验证量子估计框架,应用于物理模型半混沌动力学,通过量子启发式实验测试假设并增强信心,还可通过操纵噪声设置精度界限,为可信量子计算提供途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25303 2026-07-29 physics.optics 新提交 50%

Resonance-Induced Sign Reversal of Optical Gradient Forces and Three-Dimensional Singularity Trapping

共振诱导的光学梯度力符号反转与三维奇点捕获

Jinsheng Lu, Soon Wei Daniel Lim, Federico Capasso

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究光频率通过共振时光学梯度力的变化,利用广义Fano线形模型定量分析,通过全波模拟验证,在此基础上实现硅纳米颗粒的三维奇点捕获,建立了控制共振系统光学力的设计原则。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17351 2026-07-29 cs.CL 版本更新 50%

Physics of Language Models: Part 4.1, Architecture Design and the Magic of Canon Layers

语言模型的物理:第4.1部分,架构设计与Canon层的魔力

Zeyuan Allen-Zhu

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出Canon层,通过轻量级架构组件提升语言模型的推理深度和广度,验证了其在不同架构中的有效性,并展示了其在学术预训练中的潜力。

Comments V1.1 appeared in NeurIPS 2025 main conference; V2 adds GDN experiments, tightens others for a stronger, fairer comparison, and reorganizes sections; V3 adds Result 2.1 and Section 5.2 on how Canon layers improve hierarchical feature learning, from our Jan 2026 talk

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05493 2026-07-29 physics.optics 版本更新 50%

Non-Hermitian Origin of Surface Peregrine Soliton and Its Topological Signatures

表面佩雷格林孤子的非厄米起源及其拓扑特征

Samit Kumar Gupta

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究基于标准非线性薛定谔方程的PT变体,展示复合光学介质PT对称状态下的非平凡复波现象,产生手性体孤子对和表面佩雷格林孤子,揭示其源于非厄米势与调制方案的相互作用及拓扑特征,为复杂介质中波操纵提供新思路。

Comments 7 Pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏