arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-18 至 2026-08-18 共收录 160 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 46 篇

2608.16159 2026-08-18 cs.CR cs.AI cs.LG 新提交 62%

Digital Twin Degradation: Detecting Cyber Physical Attacks via Temporal Inconsistencies

数字孪生退化:通过时间不一致性检测网络物理攻击

Konstantinos E. Kampourakis, Vasileios Gkioulos, Sokratis Katsikas

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 该研究提出一种基于多时间范围特征与无监督密度模型的检测框架,利用数字孪生与物理系统的时间不一致性,在无需攻击标签的情况下实现工业控制系统的可靠攻击检测,误报率低且对数字孪生退化场景有效。

Comments 18 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14944 2026-08-18 cs.RO cs.CL cs.LG 新提交 62%

SkillComposer: Learning Reusable Skills for Natural-Language Robot Programming

SkillComposer:学习可复用技能的自然语言机器人编程系统

John Woods, Hasti Seifi

机构 * School of Computing and Augmented Intelligence, Arizona State University(亚利桑那州立大学计算与增强智能学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.LG

AI总结 SkillComposer是一款仿真环境下的交互式自然语言机器人编程系统,采用生成-测试架构,通过在线库学习算法生成可复用宏技能,经实验验证可提升任务成功率与可用性并减少用户工作量。

Comments 8 pages, 6 figures. Submitted to IEEE Humanoids 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15541 2026-08-18 cs.RO 新提交 61%

Contact Modes Are Strata: What Geometric Structure Buys in Discrete-Continuous Planning

接触模式即层:几何结构在离散-连续规划中的优势

Phone Thiha Kyaw, Jonathan Kelly

机构 * University of Toronto Institute for Aerospace Studies (UTIAS)(多伦多大学航空航天研究所) Space and Terrestrial Autonomous Robotic Systems (STARS) Laboratory(空间与地面自主机器人系统实验室)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 该研究提出将接触模式视为构型空间的层,以此构建离散-连续规划方法,在两项仿真接触操纵任务中实现了无需预定义接触序列的快速规划。

Comments Submitted to IROS 2026 Workshop on Geometric Representations in Robotics

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16251 2026-08-18 cs.CV 新提交 57%

SCOUT: Semantic Concept Discovery for Open-Vocabulary Editing of face Recognition Templates

SCOUT:面向人脸识别模板开放词汇编辑的语义概念发现

Leon Todorov, Peter Rot, Peter Peer, Vitomir Štruc, Klemen Grm

机构 * University of Ljubljana(卢布尔雅那大学) Faculty of Electrical Engineering(电气工程学院) Faculty of Computer and Information Science(计算机与信息科学学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 SCOUT是一个端到端框架,可通过机械可解释性发现人脸识别模板中的语义概念,实现可控的身份感知模板编辑,且对身份匹配影响极小。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16196 2026-08-18 cs.AI cs.HC 新提交 57%

Beyond Asking: A Pipeline for Personalized Game Generation that Reads Players from Behavior

超越询问:一种从玩家行为读取数据的个性化游戏生成流水线

Yifan Lu, Xiaopeng Yuan, Haohan Wang

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究构建了带真实特质的合成玩家基准,提出机会感知决策时刻表示,对比了LLM等方法的推断效果,将推断画像用于游戏难度自适应并开展人类研究验证。

Comments 16 pages, 3 figures, 6 tables. Includes technical appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16153 2026-08-18 cs.RO 新提交 57%

Unified Condition-Action Modeling for Accurate One-Step Action Generation

用于精准单步动作生成的统一条件-动作建模

Xinyu Zhou, Zikun Cai, Kuangji Zuo, Gen Li, Boyu Ma, Yanshuo Lu, Yutong Song, Mingqi Yuan, Jiayu Chen, Jianfei Yang

机构 * NTU(南洋理工大学) HKU(香港大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 该研究提出UCA-Flow统一条件-动作建模框架,通过共享令牌空间与改进双路监督方案,提升机器人单步动作生成的成功率与推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16003 2026-08-18 cs.AI cs.CL 新提交 57%

Prior Audit-Repair Context Shifts LLM Verifier Thresholds Toward Leniency

先验审计-修复上下文调整大语言模型验证器阈值以趋向宽松

Parsa Mazaheri, Kasra Mazaheri

机构 * University of California, Santa Cruz(加州大学圣克鲁兹分校) Massachusetts Institute of Technology(麻省理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究发现,LLM检查器上下文中的审计→修复事件会降低误报率,调整了验证器阈值趋向宽松,且该效应与负性不对称性预测相反,不随推理启用而消失。

Comments 12 pages, 2 figures, 4 tables. Code and analysis artefacts: this https URL (https://github.com/parsa-mz/crtitxer)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15893 2026-08-18 cs.AI 新提交 57%

Breaking and Defending LLM-Powered Social Media Bot Detection Systems

突破与防御:基于大语言模型的社交媒体机器人检测系统

Nof Orenstein, Yoni Birman

机构 * Reichman University(莱希曼大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究针对基于大语言模型的社交媒体机器人检测系统,提出两种新型对抗攻击策略使其准确率降48%,并开发多LLM防御框架LSABRE,在强自适应对抗下仍维持86%准确率,相关方法可推广至其他LLM网络安全系统。

Comments Accepted at ACISP 2026 (Australasian Conference on Information Security and Privacy). Also accepted as a poster at IEEE Symposium on Security and Privacy (S&P) 2026. Published in Pragmatic Cybersecurity 2026, 1(2), 10, this https URL (https://doi.org/10.53941/pc.2026.100010). 19 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15888 2026-08-18 cs.AI cs.CR 新提交 57%

Bounded Agents: Delegation Security for Multi-Agent AI Systems

有界智能体:多智能体AI系统的委托安全

Xabier Muruaga

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究针对多智能体AI系统的委托安全问题,提出智能体委托链(APC)架构,经实验可有效阻止提示注入攻击,降低数据窃取、破坏及操纵风险,授权延迟低且效用损失可控。

Comments 14 pages, 4 figures, 18 tables. Code and data: this https URL (https://github.com/xmuruaga/bounded-agents)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15461 2026-08-18 cs.RO 新提交 57%

Detachable Wire Drive: Reconfigurable Robot Architecture with Shared Actuators

可分离钢丝驱动:采用共享执行器的可重构机器人架构

Takahiro Hattori, Kento Kawaharazuka, Kei Okada

机构 * The University of Tokyo(东京大学) AI Center, Graduate School of Information Science and Technology, The University of Tokyo(东京大学信息科学与技术研究院AI中心)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 该研究提出可分离钢丝驱动的可重构机器人架构,通过钢丝分离单元实现执行器共享,开发出多种可互换部件,经实验验证其机械可靠性与构型转换能力,为高效多功能机器人提供新方案。

Comments Accepted at IROS2026, website - this https URL (https://hatofly.github.io/detachable-wire-drive/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14825 2026-08-18 cs.MA cs.AI 新提交 57%

Emergent Misaligned Communication in Long-Horizon Multi-Agent LLM Commerce

长视野多智能体大语言模型商业环境中涌现的对齐失效通信

Zeyuan Li (Massachusetts Institute of Technology), Lukas Petersson (Andon Labs), Alessandro Acquisti (Massachusetts Institute of Technology), Michiel A. Bakker (Massachusetts Institute of Technology)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究在Vending-Bench Arena环境中发现,竞争多智能体LLM交易场景会涌现与操作稀缺性、对手行为相关的可测量对齐失效通信,且该现象不受模型能力排名直接影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14731 2026-08-18 cs.CV cs.DL 新提交 57%

Emergence of Transfer Learning towards Specific Identification of Alzheimer's Disease A Prospective Approach

面向阿尔茨海默病特定识别的迁移学习的涌现:一种前瞻性方法

Soumik Podder, Chandramouli Haldar

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 本综述探讨迁移学习在阿尔茨海默病诊断中的应用,评估其优势与局限,结合可解释人工智能,为该领域新研究者提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24496 2026-08-18 cs.CR cs.AI 版本更新 57%

Red-Teaming the Agentic Red-Team

红队测试代理型红队

Dario Pasquini, Michal Bazyli, Taras Fedynyshyn, Artem Sorokin

机构 * Cracken Information Protection Department, Lviv Polytechnic National University(利沃夫理工学院信息保护系)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文首次深入分析主流进攻性安全代理系统的安全漏洞,揭示其设计缺陷可导致API密钥泄露、持久化控制及宿主机失陷,并提出架构级缓解设计原则。

Comments v0.1

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03222 2026-08-18 cs.CY cs.AI cs.HC 版本更新 57%

The Fake Friend Dilemma: Relational Trust and the Political Economy of Conversational AI

虚假朋友困境:信任与对话AI的政治经济学

Jacob Erickson

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本文提出虚假朋友困境框架,探讨拟人化AI如何通过隐蔽手段影响用户自主权,分析其在信任与政治经济学中的作用。

Comments Manuscript under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15394 2026-08-18 cs.CL 新提交 50%

The Machine's Internal Clock: Do LLMs Share Human Temporal Illusions?

机器的内部时钟:大型语言模型(LLMs)是否会共享人类的时间错觉?

Catherine Bao, Vivek Srikumar

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究构建含5种错觉的6684个叙事对基准,发现人类仅在2种错觉中偏好预期场景,而14个LLMs在4种错觉中与文献预测一致,其一致性源于心理学研究检索而非类人时间偏差。

Comments 25 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14869 2026-08-18 cs.HC 新提交 50%

RaivenTracks: Branching Provenance for Conversational Visualization Workflows

RaivenTracks:面向对话式可视化工作流的分支溯源系统

Ella Hugie, Alexandra Irger, Grace Guo, Kenneth Moreland, David Pugmire, Scott Klasky, Hanspeter Pfister

专题命中 机器人操作 :navigation(abstract)

AI总结 RaivenTracks是Raiven可视化管道的工作流感知扩展,通过两级状态管理架构实现可分支的版本树与细粒度撤销/重做,试点研究显示其支持可视化工作流的分支与恢复,为AI驱动科学工作流的溯源监督提供了新方向。

Comments *Ella Hugie and Alexandra Irger are co-first authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16604 2026-08-18 physics.optics 新提交 50%

Sublime Transfer Printing of Three-Dimensional Nanostructure Ensembles

三维纳米结构集合体的升华转印技术

Lei Chen, Hao Wang, Wang Zhang, Fu Fan, Peng Liu, Xiaoxue Bi, John You En Chan, Cheng-Feng Pan, Bochang Wu, Zhengchao Liu, Rou Yun Teo, Hongtao Wang, Huigao Duan, Joel K.W. Yang

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究提出一种升华转印策略,利用萘作为临时印章,实现三维纳米结构集合体在多种衬底上的无损伤集成,可制备多种无机光子器件与结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16059 2026-08-18 physics.flu-dyn 新提交 50%

Measuring Mean Spanwise Flow with a Rotating Single Hot-Wire Probe over a Wide Yawed Riblet-Textured Surface

采用旋转单热线探针测量宽锯齿纹理表面上的平均展向流动

Yu Xia, Sandesh Parajuli, Hafiz Aliffrananda, Daniel Chung, Nicholas Hutchins

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究开发定制化旋转单热线探针,探究斜置小肋引发的近壁流动转向规律,发现直置转斜置小肋的展向速度分布符合SSL解,斜置转直置的流动恢复存在空间滞后且残余展向流动持续存在。

Comments 10 figures; 13 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16702 2026-08-18 quant-ph cond-mat.mes-hall 新提交 50%

Time-optimal quantum gates with bang-bang control in multilevel systems

多能级系统中基于开关控制的时间最优量子门

Valentín Reparaz, Santiago Ferreyra, María José Sánchez, Daniel Domínguez, Leandro Tosi

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究针对多能级系统,提出基于开关控制的时间最优量子门协议,以fluxonium电路为案例优化$X/2$和$Y/2$门,其性能优于标准谐振控制,可实现快速低误差量子操控。

Comments 18 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09434 2026-08-18 quant-ph 版本更新 50%

Biocompatible Vaterite Carriers Enable Multimodal Quantum Sensing with Nanodiamonds

双折射生物矿物微载体稳定液体中的多模态纳米金刚石量子传感

T.Amro, M.Attrash, A.Droby, A.Ushkov, R.Malkinson, P.Penshin, A.Hen, V.Bobrovs, P. Ginzburg, H.Barhum, N.Bar-Gill

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究利用双折射球文石微球作为载体,组装氮空位纳米金刚石,开发杂化平台实现液体中多模态量子传感,可用于磁场与质子浓度、pH值检测,性能优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08827 2026-08-18 cond-mat.mes-hall physics.app-ph physics.class-ph 交叉投稿 50%

Time-Reversal-Invariant Altermagnetic Acoustic Crystals

时间反演不变的交替磁声晶体

Tianzhi Xia, Han-Rong Xia, Jinglin Liu, Xiying Fan, Zebin Zhu, Zhen Gao

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出并实现首个时间反演不变的交替磁声晶体,其具有赝自旋依赖能带劈裂与亚晶格赝自旋锁定特性,为交替磁学研究及非磁性器件的类自旋波操控提供新平台。

Comments 12pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00446 2026-08-18 quant-ph 版本更新 50%

Identifying vulnerable nodes and detecting malicious entanglement patterns to handle st-connectivity attacks in quantum networks

识别脆弱节点并检测恶意纠缠模式以应对量子网络中的st连通性攻击

Iain Burge, Michel Barbeau, Joaquin Garcia-Alfaro

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出量子方法用于识别量子网络中维持目标连接的重要节点,并利用量子支持向量机检测恶意纠缠攻击,提升量子网络安全性。

Comments 13 pages, 6 figures, 8 sections, 50 references. Revised and extended version of a paper that appeared in the proceedings of the 40th IFIP International Conference on ICT Systems Security and Privacy Protection (IFIP SEC 2025), Maribor, Slovenia, May 21-23, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身导航 30 篇

2604.08780 2026-08-18 cs.RO cs.LG 版本更新 84%

Morphology-Conditioned World Model for Cross-Embodiment Quadrupedal Locomotion

迈向基于形态条件的四足世界模型

Mohamad H. Danesh, Chenhao Li, Amin Abyaneh, Anas Houssaini, Kirsty Ellis, Glen Berseth, Marco Hutter, Hsiu-Chin Lin

专题命中 具身导航 :world model(title,abstract);robotics(abstract);分类 cs.RO、cs.LG

AI总结 本文提出一种基于形态条件的四足世界模型,通过整合物理形态编码器和奖励归一化器,实现跨形态的零样本泛化,解决传统隐式系统识别的适应滞后问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15956 2026-08-18 cs.AI 新提交 83%

Navigation-Informed Embeddings: Dense-Retriever Adaptation from Agent Search Traces

导航启发式嵌入:基于智能体搜索轨迹的密集检索器适配

Shrey Shah, Levent Ozgur

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 该研究提出 NIE 方法,利用智能体检索轨迹无需额外标注即可适配密集检索器,在基准任务上提升了 Recall@20、长路径性能及 nDCG@10 指标,提供轻量适配通道。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15284 2026-08-18 cs.RO cs.AI cs.CL cs.CV cs.MM 新提交 82%

VTInstructor: Visual Trajectory Prompting for Navigation Instruction Generation in Continuous Environments

VTInstructor:面向连续环境中导航指令生成的视觉轨迹提示

Haolin Yang, Yuxing Long, Zihan Yang, Hao Dong

机构 * Peking University(北京大学) PrimeBot

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本研究提出首个面向连续环境的VLN指令生成框架VTInstructor,通过视觉轨迹提示技术生成导航指令,在基准测试中刷新最优性能,提升跟随器成功率并为下游任务带来数据增强增益。

Comments accepted by ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.20254 2026-08-18 cs.IR cs.AI cs.CV cs.LG 版本更新 82%

Efficient Table QA via TableGrid Navigation and Progressive Inference Prompting

通过表格网格导航和逐步推理提示实现高效的表格问答

Amritansh Maurya, Navjot Singh, Mohammed Javed, Omar Moured

机构 * Vision Intelligence Lab, IIIT Allahabad, Prayagraj, India(视觉智能实验室,印度拉贾斯坦邦阿拉哈巴德)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 本文提出了一种无需训练的表格问答方法,通过TableGrid导航和Progressive Inference Prompting框架,提升了表格问答的精度和效率,并在多个数据集上验证了其有效性。

Comments Accepted for Presentation in ICDAR 2026, Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.14749 2026-08-18 eess.IV cs.CV 新提交 79%

Incision trajectory tracing for electrosurgical navigation by CNN-based knife contacting frames extraction method

基于CNN的手术器械接触帧提取方法的电外科导航切口轨迹追踪

Yu Chun Wang, Kaixu Chen, Naoto Ienaga, Yoshihiro Kuroda

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本研究提出基于CNN的手术器械接触帧提取方法,用于电外科导航的切口轨迹追踪,可准确区分电刀、超声刀与组织的接触,误差较传统方法降低超2.5倍,且避免了轨迹缺失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16640 2026-08-18 cs.RO 新提交 79%

DPNet: Efficient Dead-End Prediction and Avoidance for Vision-Based UAV Navigation

DPNet:面向基于视觉的无人机导航的高效死胡同预测与规避

Ruibin Zhang, Lun Pan, Zelong Xia, Jialiang Hou, Fei Gao

机构 * Huzhou Institute of Zhejiang University(浙江大学湖州研究院) University of Electronic Science and Technology of China(电子科技大学) Institute of Cyber-Systems and Control, College of Control Science and Engineering, Zhejiang University(浙江大学控制科学与工程学院 cyber系统与控制研究所) Differential Robotics Technology Company(差分机器人技术公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 该研究针对基于视觉的无人机导航死胡同问题,提出轻量级神经网络DPNet,利用RGB-D输入预测死胡同并修剪轨迹库,实现50Hz高频重规划,跨场景无需标注微调,仿真与真实实验验证其优异性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16476 2026-08-18 cs.RO 新提交 79%

Exposing the Long-tail in Embodied Urban Navigation via Scalable Learning from In-the-Wild Videos

通过从野外视频进行可扩展学习揭示具身城市导航中的长尾分布

Bingyi Xia, Han Bao, Zhewei Chen, Hanjing Ye, Jingwen Yu, Yuhan Pang, Wenjun Xu, Jiankun Wang

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 该研究提出可扩展框架,从网络规模野外 egocentric 视频学习点目标城市导航策略,自动注释视频并训练视觉-语言-动作策略,表征并诊断导航长尾分布与失败模式,验证了知识迁移效果并揭示长尾结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16442 2026-08-18 cs.RO 新提交 79%

Observation-Constrained Joint-Space Viewpoint Optimization for Robotic Inspection of Cylindrical Cavities

面向圆柱腔体检修的观测约束关节空间视点优化

Yuezhong Wang, Rongshen Yin, Bichi Zhang, Sören Schwertfeger

机构 * ShanghaiTech University(上海科技大学) University of Pennsylvania(宾夕法尼亚大学)

专题命中 具身导航 :robotic(title);robotics(abstract);分类 cs.RO

AI总结 本文提出一种机器人关节空间中观测约束圆柱腔体检修的自主优化方法,通过多起点无导数搜索优化关节构型,在 Isaac Sim 实验中表现优于基准方法,完成 92%目标构型且平均底部可见度达 91.65%。

详情

展开后加载摘要…

URL PDF HTML 收藏