arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-15 至 2026-07-15 共收录 18 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 18 篇

2607.12105 2026-07-15 cs.RO cs.LG 新提交 84%

Robust In-Hand Manipulation via Priors in Reinforcement Learning and Mechanical Design

通过强化学习和机械设计中的先验知识实现稳健的手中操作

Yifei Chen, Shihan Lu, Ed Colgate, Kevin Lynch

机构 * Center for Robotics and Biosystems, Northwestern University(西北大学机器人与生物系统中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 研究无外部传感的手中操作难题,引入全局抓握质量先验和局部接触几何先验两种互补物理先验,用于多指机器人手操作物体的手中滚动操作学习,显著提升了旋转效率、抓握稳定性和抗干扰能力,增强任务稳健性与模拟到现实的转移。

Comments 25 pages, 15 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12593 2026-07-15 eess.IV cs.RO cs.SY eess.SY 新提交 70%

Improving Autonomous Nano-drones Performance via Automated End-to-End Optimization and Deployment of DNNs

通过深度神经网络的自动化端到端优化和部署提高自主纳米无人机性能

Vlad Niculescu, Lorenzo Lamberti, Francesco Conti, Luca Benini, Daniele Palossi

专题命中 机器人操作 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究如何通过自动化端到端优化和部署DNN提高自主纳米无人机性能,聚焦PULP-Dronet在Crazyflie 2.1纳米无人机上的部署,实现内存占用减少、推理时间加速,提升了无人机在避障、自由飞行和车道跟随等方面的性能,还开源了相关软件设计。

Comments 16 pages, 8 figures, 5 tables. This paper has been accepted for publication in the IEEE Journal on Emerging and Selected Topics in Circuits and Systems (JETCAS) copyright 2021 IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12702 2026-07-15 cs.RO 新提交 70%

Vision-Based Dribbling for Humanoid Soccer via Privileged Representation Learning

通过特权表示学习实现基于视觉的人形足球运球

Flavio Maiorana, Valerio Spagnoli, Eugenio Bugli, Flavio Volpi, Daniele Affinita, Vincenzo Suriani, Daniele Nardi, Luca Iocchi

机构 * Sapienza University of Rome(罗马第一大学) Institut de Robòtica i Informàtica Industrial (CSIC-UPC)(工业机器人与信息学研究所(西班牙科学与技术研究委员会 - 加泰罗尼亚理工大学)) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 研究人形机器人基于视觉的运球问题,提出将时间深度编码器嵌入强化学习策略的集成方法,应用于模拟机器人,该方法在不同场景下实现了一定成功率的运球,为处理复杂运球场景奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07491 2026-07-15 cs.RO 版本更新 70%

Smooth Operator: A Real-Time Sampling-Based Algorithm for Kinematic Hand Retargeting

平滑算子:一种基于实时采样的运动学手部重定向算法

Robert Jomar Malate, Erik Bauer, Norica Bacuieti, Stefanos Charalambous, Elvis Nava, Robert K. Katzschmann, Benedek Forrai

机构 * ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) mimic robotics(模仿机器人公司)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对基于梯度的手部重定向算法易收敛到不同局部最小值影响数据质量的问题,提出基于采样的无梯度重定向方法SBR,经模拟和真实用户研究评估,其总体任务成功率最高且显著降低操作员疲劳,为灵巧操作提供高效重定向器及基准测试方法。

Comments Minor cosmetic updates to figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12861 2026-07-15 cs.RO cs.AI cs.SY eess.SY 新提交 62%

Unveiling Complex Collective Behaviors from Simple Rewards

从简单奖励中揭示复杂的集体行为

Yize Mi, Jianan Li, Liang Li, Shiyu Zhao

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) WINDY Lab, School of Engineering, Westlake University(西湖大学工程学院风语实验室) Shanghai AI Laboratory(上海人工智能实验室) Max Planck Institute of Animal Behavior(马克斯·普朗克动物行为研究所) Department of Computer and Information Science, University of Konstanz(康斯坦茨大学计算机与信息科学系) Centre for the Advanced Study of Collective Behaviour, University of Konstanz(康斯坦茨大学集体行为高级研究中心) Department of Biology, University of Konstanz(康斯坦茨大学生物系)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究多智能体强化学习中简单奖励与复杂集体行为的关系,提出两阶段EEC解释框架及智能体响应图,通过合作与竞争两个任务验证,揭示了MARL策略背后隐藏的几何结构。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27947 2026-07-15 cs.RO 版本更新 61%

SANTS: A State-Adaptive Scheduler for World Action Models

SANTS:面向世界动作模型的状态自适应调度器

Yirui Sun, Guangyu Zhuge, Keliang Liu, Jie Gu, Xinyu Bing, Zhongxue Gan, Chunxu Tian

机构 * Fudan University(复旦大学) Harbin Institute of Technology(哈尔滨工业大学) Deep Computing Era Technology Co., Ltd(深计算时代科技有限公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 提出状态自适应噪声轨迹调度器(SANTS),通过根据视频状态动态选择去噪深度来优化视频到动作的扩散策略,在保持控制性能的同时大幅降低推理延迟。

Comments 17 pages, 5 figures, 8 tables. Project page: https://advanced-robotics-lab.github.io/SANTS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12800 2026-07-15 cs.CV 新提交 57%

UniVR: Thinking in Visual Space for Unified Visual Reasoning

UniVR:用于统一视觉推理的视觉空间思考

Zhongwei Ren, Yunchao Wei, Yao Zhao, Weibo Gong, Xiao Liu, Anran Wang, Xiangtai Li, Xiaojie Jin

机构 * Beijing Jiaotong University(北京交通大学) ByteDance(字节跳动)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 UniVR旨在从纯视觉演示中同时学习复杂推理、物理动力学和长期规划,核心是VR-GRPO强化学习范式。构建VR-X基准进行训练和评估,在VR-X上有25%的提升,还提高了多模态理解基准性能,相关资源已开源。

Comments Code and models are released at: https://maverickren.github.io/UniVR.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12130 2026-07-15 cs.RO 新提交 57%

More than a Manipulator: Planning Propellant-Free Attitude Maneuvers for Free-Floating Spacecraft

不仅仅是一个操纵器:为自由漂浮航天器规划无推进剂姿态机动

Harsh G. Bhundiya, Avi Soval, Keenan Albee

机构 * University of Southern California(南加州大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 研究利用机器人操纵器运动进行自由漂浮航天器无推进剂姿态控制,通过制定带约束的轨迹优化问题求解,展示多种系统轨迹,经与反作用轮阵列比较,证明其可作冗余或主要姿态控制系统,为空间应用提供框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11936 2026-07-15 cs.LG 新提交 57%

Qubit-Efficient Quantum Search for Hyperdimensional Decomposition via Logarithmic Encoding

通过对数编码实现用于超维分解的量子比特高效量子搜索

Sanggeon Yun, Hyunwoo Oh, Ryozo Masukawa, Raheeb Hassan, Mohsen Imani

机构 * University of California, Irvine(加利福尼亚大学欧文分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 针对超维计算中高成本的超向量分解问题,提出量子比特高效框架,引入对数超向量和绑定编码及可逆查找算子,结合改进搜索过程,保持搜索复杂度同时大幅减少量子比特使用,经实验验证效果显著。

Comments Accepted to ICCAD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06978 2026-07-15 cs.RO 版本更新 57%

SPECTRA: Context-Conditioned Spectral Movement Primitives for Robot Skill Generalization

SPECTRA:用于机器人技能泛化的上下文条件频谱运动基元

Boxuan Zhang, Sheng Liu, Chenlin Ming, Ahmed Abdelrahman

机构 * Technical University of Munich(慕尼黑工业大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究机器人操作模仿学习中如何保留任务几何形状与动态可允许运动,提出频谱运动基元框架,结合任务空间与关节空间调节,经实验验证该方法在多方面表现良好,能有效实现技能泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27443 2026-07-15 cs.AI cs.CL 版本更新 57%

When Does Personality Composition Matter for Multi-Agent LLM Teams?

人格构成何时对多智能体LLM团队重要?

Aryan Keluskar, Amrita Bhattacharjee, Huan Liu

机构 * School of Computing & AI(计算与人工智能学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究通过操纵前沿LLM的人格特质,发现人格对多智能体团队性能的影响取决于任务结构:在编码任务中影响小,在开放协作和谈判任务中显著降低性能。

Comments Accepted to COLM 2026 (20 pages, 6 figures)

Journal ref Conference on Language Modeling (COLM), San Francisco, USA, October 6-9, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03529 2026-07-15 cs.RO 版本更新 57%

LapSurgie: Humanoid Robots Performing Surgery via Teleoperated Handheld Laparoscopy

LapSurgie: 人形机器人通过远程操控手持腹腔镜进行手术

Zekai Liang, Xiao Liang, Soofiyan Atar, Sreyan Das, Zoe Chiu, Peihan Zhang, Calvin Joyce, Florian Richter, Shanglei Liu, Michael C. Yip

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系) School of Electrical and Computer Engineering, Cornell University(康奈尔大学电气与计算机工程学院) UC San Diego Health(加州大学圣地亚哥医学中心)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 LapSurgie是一种基于人形机器人的腹腔镜远程操控框架,通过逆映射策略实现精准手到工具控制,并通过用户研究验证了其在微创手术中的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12514 2026-07-15 eess.SP 新提交 50%

An Adaptive Transmission Protocol Enabled by The State Switching Strategy of Beyond-Diagonal RIS

基于非对角可重构智能表面状态切换策略的自适应传输协议

Xiyao Wang, Hongyu Li

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究针对BD-RIS在某些场景下性能增益与操作复杂性问题,提出一种自适应传输方案,定义其开启和关闭两种状态,设计波束训练协议并构建决策阈值,能依实时信道条件智能切换状态,确保成功传输。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12742 2026-07-15 cs.CR cs.GT cs.SY eess.SY 新提交 50%

Stability Buys Time: A Re-Keying Game for Encrypted Multi-Agent Control

稳定性赢得时间:加密多智能体控制的重新密钥生成博弈

Sai Sandeep Damera, John S. Baras

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究加密多智能体控制中CKKS方案密钥恢复漏洞问题,将循环安全性建模为两阶段博弈,通过重新密钥生成防御主动操纵,确定了FHE精度等三方张力范围及有效安全点,揭示反馈回路中密码系统安全性是动态博弈。

Comments 20 pages, 3 figures. Submitted to the 17th Conference on Game Theory and AI for Security (GameSec-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12754 2026-07-15 physics.optics physics.app-ph 新提交 50%

Twist Engineering for Reconfigurable Optical and Optoelectronic Devices

用于可重构光学和光电器件的扭转工程

Gang Huang, Annan Helian, Mengting Jiang, Chi Wang, Yu Xing, Mayank Joshi, Jae Yeong Lee, Jiang Wang, Syed M Assad, Ping Koy Lam, Qiushi Liu, Lin Wu, Young-Wook Cho, Yuan Ma, Xuezhi Ma

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究可重构光学和光电器件的扭转工程,回顾扭转角计量学现状及表征方法,探讨扭转角控制技术路线,包括多种方法的能力、局限与前景,还讨论其未来从单个结构制造向动态可重构系统发展及相关代表性技术与应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12339 2026-07-15 nlin.PS 新提交 50%

Eigenvalue-Based Approach to Manipulate and Reconstruct Nonlinear Pulses: Towards Soliton Tomography

基于特征值的非线性脉冲操纵与重构方法:迈向孤子层析成像

Sergey Dremov, Rustam Mullyadzhanov, Andrey Gelash

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究基于孤子特征值响应函数及逆问题,开发操纵和重构 sech 形非线性波场的理论框架,推导微扰表达式与传感概念,介绍逆问题积分方程,评估重构机制并证明噪声下可靠解,迈向孤子层析成像。

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10810 2026-07-15 quant-ph 50%

Complexity and multi-functional variants of the Quantum-to-Quantum Bernoulli Factories

量子到量子伯努利工厂的复杂性及多功能变体

Francesco Hoch, Taira Giordani, Gonzalo Carvacho, Nicolò Spagnolo, Fabio Sciarrino

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了量子到量子伯努利工厂的复杂性,提出了量子比特数量的下界和成功概率的上界,并分析了两种新的变体以增加输入偏置和函数数量。

Journal ref Phys. Rev. Research 8, 033003 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20867 2026-07-15 cs.IR 版本更新 50%

E-GEO: A Testbed for Generative Engine Optimization in E-Commerce

E-GEO:电子商务中生成引擎优化的测试平台

Puneet S. Bagga, Vivek F. Farias, Tamar Korkotashvili, Tianyi Peng, Yuhang Wu

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究电子商务中生成引擎优化问题,引入E-GEO数据集,对多种生成引擎、重写器和启发式方法进行大规模实证研究,将GEO公式化并开发优化算法,通过攻击验证其有效性,揭示存在通用有效GEO策略。

详情

展开后加载摘要…

URL PDF HTML 收藏