arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 955 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 955 篇

2606.11446 2026-06-11 cs.CV cs.GR 新提交 57%

3D-CBM: A Framework for Concept-Based Interpretability in Generative 3D Modeling

3D-CBM:生成式3D建模中基于概念可解释性的框架

Ahmad Al-Kabbany

机构 * Yubree Labs Multimedia Interaction and Communication Lab, Arab Academy for Science and Technology(阿拉伯科学技术学院多媒体交互与通信实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 提出将概念瓶颈模型(CBM)融入3D生成架构,通过多层级可解释原语和功能属性映射,实现语义可操控的3D生成,实验验证了高概念预测精度和交互式纠错能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10790 2026-06-10 cs.CV 新提交 57%

A Multimodal RGB and Events Dataset for Hand Detection in First-Person View

第一人称视角下用于手部检测的多模态RGB和事件数据集

Bharghav Kota, Yulia Sandamirskaya

机构 * Zurich University of Applied Sciences(苏黎世应用科技大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.CV

AI总结 针对移动机器人系统中传统相机在暗光下运动模糊的问题,提出利用事件相机与RGB相机结合的多模态手部检测方法,并通过合成事件数据集实现与现有方法相当的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10841 2026-06-10 cs.RO cs.SY eess.SY math.OC 新提交 57%

Gradient based Bilevel for Inverse Optimal Control, a Riemannian approach

基于梯度的双层逆最优控制:一种黎曼方法

Ahmed-Manaf Dahmani, Vincent Bonnet, David Daney, François Charpillet

机构 * INRIA Bordeaux, Université de Bordeaux(法国国家信息与自动化研究所波尔多中心,波尔多大学) INRIA Nancy, Université de Lorraine(法国国家信息与自动化研究所南锡中心,洛林大学) LAAS-CNRS, Université de Toulouse, CNRS(法国国家科学研究中心系统分析与架构实验室,图卢兹大学,法国国家科学研究中心)

专题命中 机器人操作 :robotics(abstract);分类 cs.RO

AI总结 提出一种黎曼逆最优控制方法,将最优轨迹集视为流形,通过流形上的优化避免标准约束违规,计算时间减少约四倍。

Comments 6 Pages, 4 Figures. To be published in a control journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09645 2026-06-09 cs.RO cs.PL cs.SE 新提交 57%

Modeling Components and Connections in Cyber-Physical Systems

信息物理系统中的组件与连接建模

Kate Sanborn, Tanuj Kenchannavar, Vakul Nath, Jonathan Sprinkle

机构 * Vanderbilt University(范德堡大学)

专题命中 机器人操作 :robotics(abstract);分类 cs.RO

AI总结 提出基于WebGME的模型集成工具ROSLaunchVisual,通过图形界面可视化ROS启动文件中的节点、发布者、订阅者和参数,提升开发效率和系统理解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08678 2026-06-09 cs.SD cs.LG 新提交 57%

Speaker-Invariant Representation Learning for Spoofing Detection via Gradient Reversal and A Variational Information Bottleneck

基于梯度反转和变分信息瓶颈的说话人不变表示学习用于欺骗检测

Anh-Tuan Dao, Driss Matrouf, Mickael Rouvier, Nicholas Evans

机构 * Avignon Universite(阿维尼翁大学) EURECOM

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 针对欺骗检测中说话人偏差导致泛化差的问题,提出教师-学生框架,利用梯度反转层和变分信息瓶颈解耦身份信息,在9个数据集上EER相对降低25.7%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08267 2026-06-09 cs.GT cs.AI 新提交 57%

Post-AGI Economies: Superposition and the Second Fundamental Theorem of Welfare Economics

后AGI经济:叠加性与福利经济学第二基本定理

Elija Perrier

机构 * Centre for Quantum Software & Information(量子软件与信息中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 针对后AGI经济中自治权、自我修改和叠加偏好对经典福利第二定理的挑战,提出自治限定第二福利定理,给出可分散化的条件。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07963 2026-06-09 cs.AI cs.CL 新提交 57%

Shared Latent Structures Enable Unified Backdoor Detection and Mitigation in LLMs

共享潜在结构实现大语言模型中的统一后门检测与缓解

Omar Mahmoud, Aly M. Kassem, Thommen George Karimpanal, Buddhika Laknath Semage, Negar Rostamzadeh, Golnoosh Farnadi, Santu Rana

机构 * Deakin University(迪肯大学) Mila, Quebec AI Institute(魁北克人工智能研究所Mila)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 发现大语言模型中多种后门攻击共享潜在机制,通过稀疏自编码器检测因果特征,并提出双向激活操控和概念消融微调实现统一检测与缓解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07857 2026-06-09 cs.CR cs.AI 新提交 57%

Model Multiplicity for Adversarial Detection in Small Language Model Training on Edge Devices

边缘设备上小语言模型训练中对抗检测的模型多重性

Stefan Behfar, Richard Mortier

机构 * Computer Lab, University of Cambridge(剑桥大学计算机实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 针对边缘设备上分布式微调语言模型易受投毒攻击的问题,提出基于模型多重性的系统级防御,通过旋转或并行训练多个小语言模型并量化其差异来检测异常,实验表明比经典单模型防御更早更可靠地检测投毒。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07089 2026-06-08 cs.RO 新提交 57%

Dreaming when Necessary: Advancing World Action Models with Adaptive Multi-Modal Reasoning

必要时做梦:通过自适应多模态推理推进世界行动模型

Yinzhou Tang, Jingbo Xu, Yu Shang, Zihao Song, Chen Gao, Wei Wu, Yong Li

机构 * Tsinghua University(清华大学) Manifold AI

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 提出AdaWAM,通过轻量动态路由器自适应触发文本或视觉推理,提升长时复杂任务中的推理效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15394 2026-08-18 cs.CL 新提交 50%

The Machine's Internal Clock: Do LLMs Share Human Temporal Illusions?

机器的内部时钟:大型语言模型(LLMs)是否会共享人类的时间错觉?

Catherine Bao, Vivek Srikumar

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究构建含5种错觉的6684个叙事对基准,发现人类仅在2种错觉中偏好预期场景,而14个LLMs在4种错觉中与文献预测一致,其一致性源于心理学研究检索而非类人时间偏差。

Comments 25 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14869 2026-08-18 cs.HC 新提交 50%

RaivenTracks: Branching Provenance for Conversational Visualization Workflows

RaivenTracks:面向对话式可视化工作流的分支溯源系统

Ella Hugie, Alexandra Irger, Grace Guo, Kenneth Moreland, David Pugmire, Scott Klasky, Hanspeter Pfister

专题命中 机器人操作 :navigation(abstract)

AI总结 RaivenTracks是Raiven可视化管道的工作流感知扩展,通过两级状态管理架构实现可分支的版本树与细粒度撤销/重做,试点研究显示其支持可视化工作流的分支与恢复,为AI驱动科学工作流的溯源监督提供了新方向。

Comments *Ella Hugie and Alexandra Irger are co-first authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16604 2026-08-18 physics.optics 新提交 50%

Sublime Transfer Printing of Three-Dimensional Nanostructure Ensembles

三维纳米结构集合体的升华转印技术

Lei Chen, Hao Wang, Wang Zhang, Fu Fan, Peng Liu, Xiaoxue Bi, John You En Chan, Cheng-Feng Pan, Bochang Wu, Zhengchao Liu, Rou Yun Teo, Hongtao Wang, Huigao Duan, Joel K. W. Yang

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究提出一种升华转印策略,利用萘作为临时印章,实现三维纳米结构集合体在多种衬底上的无损伤集成,可制备多种无机光子器件与结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16059 2026-08-18 physics.flu-dyn 新提交 50%

Measuring Mean Spanwise Flow with a Rotating Single Hot-Wire Probe over a Wide Yawed Riblet-Textured Surface

采用旋转单热线探针测量宽锯齿纹理表面上的平均展向流动

Yu Xia, Sandesh Parajuli, Hafiz Aliffrananda, Daniel Chung, Nicholas Hutchins

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究开发定制化旋转单热线探针,探究斜置小肋引发的近壁流动转向规律,发现直置转斜置小肋的展向速度分布符合SSL解,斜置转直置的流动恢复存在空间滞后且残余展向流动持续存在。

Comments 10 figures; 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16702 2026-08-18 quant-ph cond-mat.mes-hall 新提交 50%

Time-optimal quantum gates with bang-bang control in multilevel systems

多能级系统中基于开关控制的时间最优量子门

Valentín Reparaz, Santiago Ferreyra, María José Sánchez, Daniel Domínguez, Leandro Tosi

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究针对多能级系统,提出基于开关控制的时间最优量子门协议,以fluxonium电路为案例优化$X/2$和$Y/2$门,其性能优于标准谐振控制,可实现快速低误差量子操控。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13765 2026-08-17 eess.SP 新提交 50%

Energy Efficient Multi-User Beamforming and 3D Position Optimization for SIM-Assisted UAVs

面向智能超表面(SIM)辅助无人机的节能多用户波束成形与三维位置优化

Chandan Kumar Sheemar, Giovanni Iacovelli, Sourabh Solanki, Wali Ullah Khan, George C. Alexandropoulos, Symeon Chatzinotas

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对配备堆叠智能超表面的节能无人机多用户通信,提出联合优化数字预编码、SIM相移与无人机三维位置的算法,大幅提升能效并揭示关键设计权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13984 2026-08-17 physics.optics 新提交 50%

Multi-quantum-channel mediated tunable single-photon skyrmions from metasurfaces

超构表面介导的多量子通道可调谐单光子斯格明子

Yan Wang, Zhenyu Guo, Minggui Liang, Shuangchun Wen, Yijie Shen, Hailu Luo

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究利用超构表面实现偏振纠缠光子对的多通道量子态分布,通过多通道量子测量介导生成可调谐单光子斯格明子,为抗噪高维量子信息处理提供了可行路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13761 2026-08-17 cond-mat.soft 新提交 50%

From suspensions to porous multilayers: microstructure formation and particle packing in drying colloidal films

从悬浮液到多孔多层膜:胶体薄膜干燥过程中的微结构形成与颗粒堆积

Qingguang Xie, Jens Harting

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过数值模拟结合理论模型,揭示胶体薄膜干燥时颗粒间相互作用决定最终多孔结构,为定制功能层提供指导。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12868 2026-08-14 physics.flu-dyn 新提交 50%

Controlling the dynamics of an electric-field-driven droplet on a lubricant-infused micropillar surface

电场驱动下润滑剂浸润微柱表面液滴的动力学控制

Geng Wang, Junyu Yang, Timan Lei, Jin Chen, Halim Kusumaatmaja, Kai Li, Kai H. Luo

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文开发了能捕捉界面流与电动力学相互作用的格子玻尔兹曼方案,结合模拟与解析计算建立了微柱LIS上电场驱动液滴的力的定量模型,可准确捕捉液滴动力学,有望实现液滴的精确控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13055 2026-08-14 cond-mat.mes-hall 新提交 50%

Acoustic Tweezers for Magnetic Skyrmions

用于磁性斯格明子的声学镊子

Chongzhou Wang, Weichao Yu

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对现有磁性斯格明子驱动方法缺乏单粒子选择性的问题,本文提出声学镊子方案,利用空间扩展声学束实现单个斯格明子的确定性捕获与路由,为高精度拓扑自旋电子学提供非破坏性片上路径。

Comments 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12172 2026-08-13 cs.MA 新提交 50%

Rethinking Agent Security as a Networking Problem

将智能体安全重新思考为一个网络问题

Van Tran, Taveesh Sharma, Tajveer Singh Dhesi, Nick Feamster

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究针对现有以智能体为中心的安全防御无法可靠防范AI智能体风险的问题,借鉴网络领域原则,提出结合确定性执行与语义策略的AI智能体安全系统设计思路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11708 2026-08-13 cs.HC cs.GR 新提交 50%

A Browser-Based Gesture-Driven Avatar Interaction Framework for Metaverse Onboarding Environments

面向元宇宙入门环境的基于浏览器的手势驱动虚拟化身交互框架

Deepti Parachuri, Chhayank Sahu, Sameer Singh Choudhary

专题命中 机器人操作 :navigation(abstract)

AI总结 本文提出一种面向元宇宙入门环境的基于浏览器的手势驱动交互框架,结合Google MediaPipe手势识别与两种移动技术,经5人评估验证,实现无控制器的轻量交互。

Comments 6 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12135 2026-08-13 quant-ph 新提交 50%

The Min-Rains Relative Entropy Is Not Tight for Exact PPT Entanglement Distillation

最小-雷恩斯相对熵对于精确PPT纠缠蒸馏并不紧

Chengkai Zhu, Xin Wang

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究否定了最小-雷恩斯相对熵是精确PPT纠缠蒸馏紧界的猜想,通过引入新的单字母上界,揭示了PPT操作下精确纠缠操纵的微妙渐近结构。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11718 2026-08-13 quant-ph physics.optics 新提交 50%

Experimental quantum telecloning across silicon photonic chips

硅光子芯片间的实验量子远程克隆

Zicong Wen, Kai Wang, Bochi Wu, Leizhen Chen, Yan-Qing Lu, Shining Zhu, Xiao-Song Ma

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究人员利用硅光子平台,通过光纤连接的两个光子芯片实现1对2对称量子远程克隆,片间克隆保真度78.45±1.39%,为大规模量子网络奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11025 2026-08-12 cs.CL 新提交 50%

Data Attribution of Emergent Misalignment with Persona Features

基于角色特征的涌现失配数据归因

Clemens Vetter, David Kaczér, Lucie Flek, Florian Mai

机构 * Bonn-Aachen International Center for Information Technology, University of Bonn(波恩-亚琛信息技术中心,波恩大学) Lamarr Institute for Machine Learning and Artificial Intelligence(拉马尔机器学习与人工智能研究院)

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究基于SAE分析揭示EM源于角色特征,操控特征可双向控制EM,发现人类文本无法可靠诱导EM而合成指令响应对可以,明确响应结构或模型措辞的关键作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10645 2026-08-12 eess.SY cs.SY 新提交 50%

AIDC Microgrid Vulnerability Assessment Under Computing-Power Coordinated Attacks

算力-电力协同攻击下的AI数据中心(AIDC)微电网脆弱性评估

Ze Yu, Hongwei Zhen, Chao Shen, Mingyang Sun

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文针对低碳AI数据中心(AIDC)微电网的算力-电力协同攻击问题,提出不确定性感知脆弱性评估框架,经案例验证可识别脆弱时段,协同攻击危害大于单一攻击。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10942 2026-08-12 quant-ph 新提交 50%

Enhanced two-photon blockade without cascade channel by Stark nonlinear coupling

利用斯塔克非线性耦合实现无级联通道的增强型双光子阻塞

Zu-Jian Ying, Hang-Hang Han

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出用斯塔克非线性耦合增强无级联通道的非常规双光子阻塞,将其窗口拓宽至整个强耦合区、阻塞程度加深两个数量级,为双光子阻塞操控提供实用方案。

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10998 2026-08-12 physics.optics physics.acc-ph physics.comp-ph 新提交 50%

Non-resonant laser-driven narrowing of particle velocity distributions

非共振激光驱动的粒子速度分布窄化

Ashwini Vaishnav, Matthias Rupp, Olivier De Castro, Mikhail N. Shneider, Alexandros Gerakis

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文以中性铯原子为例,通过数值研究提出一种光学斯塔克减速的作用机制,可窄化粒子集合围绕平均速度的速度分布,相关发现对光学操控等领域有潜在意义。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10310 2026-08-12 cond-mat.mes-hall 新提交 50%

Nanoscale imaging of ferromagnetic vortex dynamics with scanning NV magnetometry

基于扫描NV磁力计的铁磁涡旋动力学的纳米级成像

Jeffrey Rable, Jyotirmay Dwivedi, Nitin Samarth, Paul Stevenson, Arun Bansil, Swastik Kar

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究利用扫描NV磁力计实现了约50 nm空间分辨率的铁磁涡旋静态场与微波场成像,揭示了无序对微波倏逝衰减的影响,其技术分辨率优于衍射极限技术,可用于磁子器件研发。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08168 2026-08-11 cs.CL 新提交 50%

Thinking vs. NoThinking: Towards Interpreting Reasoning Mechanisms of Large Language Models via Sparse Autoencoders

思考与非思考:基于稀疏自编码器的大语言模型推理机制可解释性研究

Bo Cheng, Qiaolin Lu, Yi Chang, Yuan Wu

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究基于稀疏自编码器分析DeepSeek-R1-Distill-Qwen-7B的推理机制,揭示思考与非思考模式的神经差异,为大语言模型推理可解释性提供新见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08129 2026-08-11 cs.HC 新提交 50%

Understanding Security and Privacy Perceptions of Content Creators Regarding AI Labels of AI-Generated Content

理解内容创作者对AI生成内容的AI标签的安全与隐私认知

Shuning Zhang, Hui Wang, Rongjun Ma, Xin Yi, Kanye Ye Wang, Robert Xiao, Hewu Li

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文通过对21位AIGC创作者访谈及多平台图像测试,揭示创作者对AI标签的认知偏差与规避行为,提出应开发适配创作者动机的隐式AI标签。

详情

展开后加载摘要…

URL PDF HTML 收藏