arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

共收录 2927 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人操作 928 篇

2607.28834 2026-08-03 cs.CV 新提交 57%

FocusGS: Spatial Delta Layers for Local Repair and Deterministic Editing of Trained 3D Gaussian Assets

FocusGS:用于训练后3D高斯资产的局部修复与确定性编辑的空间增量层

Yiqun Pan, Yukun Shi

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 FocusGS将局部修复与确定性编辑统一为复合空间增量,解决3D高斯资产的局部维护问题,提升目标区域PSNR,优于文本驱动基线,提供轻量可验证的3DGS维护算子。

Comments 8 pages, 6 figures, 5 tables. Ancillary demonstration video included

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28416 2026-07-31 cs.RO 新提交 57%

FasTac: A Curved Multispectral Vision-Based Tactile Sensor for High-Speed High-Precision 3D Shape and Force Perception

FasTac:一种用于高速高精度3D形状与力感知的曲面多光谱视觉触觉传感器

Xiaofan Lu, Kaiji Huang, Jiahui Chen, Yuankai Lin, Hua Yang, Zhouping Yin

机构 * State Key Laboratory of Intelligent Manufacturing Equipment and Technology, School of Mechanical Science and Engineering, Huazhong University of Science and Technology(华中科技大学机械科学与工程学院智能制造装备与技术国家重点实验室) National Innovation Institute of Digital Design and Manufacturing(国家数字化设计与制造创新中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 FasTac是一款集成多光谱光度立体、动态卷积力估计及FPGA加速的曲面多光谱视觉触觉传感器,可实现高精度3D形状与力感知,兼具高速处理能力,经实验验证其性能优于现有方案。

Comments 13 pages, 11 figures, including 2 pages of supplementary material. Submitted to IEEE/ASME Transactions on Mechatronics

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28391 2026-07-31 cs.RO 新提交 57%

TacWAM: Anchor-Guided World Action Model with Mechanics-Aware Tactile Prediction

TacWAM:锚点引导的力学感知触觉世界动作模型

Lei Jin, Yiding Ma, Xin Zhang, Chen Gao, Wei Wu, Yong Li

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 该研究提出TacWAM,通过空间对齐融合触觉编码器、触觉历史编码器及锚点引导三模态注意力,在四项真实接触操作任务上使平均成功率达75.0%,远超最强基线37.5个百分点。

Comments 8 pages, 4 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27250 2026-07-31 cs.SE cs.AI 新提交 57%

Do Context Files Help Coding Agents? A Two-Agent Ablation Study on Real Repositories

上下文文件对编码智能体有帮助吗?针对真实仓库的双智能体消融研究

Prakhar Khatri

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 本研究通过双智能体(Claude Code、Codex)的受控消融实验,发现上下文文件对编码智能体的正确性无显著提升,其失败源于实现技能而非知识缺失,还解释了过往研究矛盾的原因并公开了相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26935 2026-07-30 cs.AI cs.CR 新提交 57%

What Does It Take to Detect an AI Agent? Minimal Feature Sets for Behavioral Detection under Browser Automation

检测AI智能体需要什么?浏览器自动化下行为检测的最小特征集

Vishisht Choudhary, Lukas Schmidt, Anne Zoë Kenntner, Feras Skhab, Michel Osswald, Jens Ernstberger

机构 * Technical University of Munich(慕尼黑工业大学) Kontext

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 该研究提出三类检测框架区分人类、机器人与AI智能体,发现最小特征集可实现AI智能体的稳健检测,且基于浏览器自动化的缺失特征构建判别信号,抗规避能力优异。

Comments 17 pages (11 main + appendices), 7 figures. Accepted at the North East AI Agents Day 2026 workshop, Jane Street, New York City. Workshop: https://ne-agents-day.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26307 2026-07-30 cs.AI cs.SE 新提交 57%

TraceCoder: Explainable and Auditable Code Generation with Position-Key Snippet Versioning

TraceCoder:基于位置键代码片段版本控制的可解释可审计代码生成

Rwaida Alssadi, Muntaser Syed, Balaji Kasula, Lamine Deen, Majed Alotaibi, Mohammed Alghamdi, Tyler Ton, Ali Alqarni, Marius Silaghi

机构 * Florida Institute of Technology(佛罗里达理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 TraceCoder通过三种机制实现可解释可审计代码生成,在30项算法编程任务上Mean Chg%达30%,使自动代码生成的内部叙事可审计复现,保障生产部署的信任与问责。

Comments Submitted Version (version submitted on May deadline to AGENTICS 2026). Version of Record to appear in AGENTICS proceedings

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25798 2026-07-29 cs.RO 新提交 57%

Transformer Transformer: A Unified Model for Motion-Conditioned Robot Co-design

Transformer Transformer:一种用于运动条件机器人协同设计的统一模型

Huy Ha, C. Karen Liu, Shuran Song

机构 * Stanford University(斯坦福大学) Columbia University(哥伦比亚大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究运动条件机器人协同设计问题,提出基于RoboTokens训练的Transformer Transformer统一模型,能跨实体空间和用例,通过动力学自引导优化设计,实验显示其可零样本优化,制造的优化设计大幅降低跟踪误差。

Comments 26 pages, 12 figures, 20 tables. Project page: https://transformer-transformer.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25227 2026-07-29 cs.CR cs.LG 新提交 57%

Decision-Level Hijacking: Injecting Cognitive Bias into Large Language Models via Bit-Flip Attacks

决策级劫持:通过位翻转攻击向大语言模型注入认知偏差

Yu Yan, Jiahao Chen, Siqi Lu, Yongjuan Wang, Ziming Zhao, Zhaoxuan Li, Tianyu Du, Qingjun Yuan, Shouling Ji

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 研究大语言模型在高风险决策场景中的决策级劫持问题,提出CogBias框架,利用位翻转攻击,通过可微情感评估器等将主观偏好转化为优化信号,经实验验证该方法能在少量位翻转下诱导目标主题立场转变,破坏模型价值对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24591 2026-07-28 cs.CV 新提交 57%

CameraAnything: Refilming Videos with Arbitrary Camera Control

CameraAnything:使用任意相机控制重新拍摄视频

Yixuan Li, Yanhong Zeng, Ka Leong Cheng, Jiayi Zhu, Hanlin Wang, Wen Wang, Yihao Meng, Hao Ouyang, Qiuyu Wang, Yue Yu, ZiDong Wang, Yiyuan Zhang, Yujun Shen, Dahua Lin

机构 * The Chinese University of Hong Kong(香港中文大学) Ant Group(蚂蚁集团) Tsinghua University(清华大学) Zhejiang University(浙江大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 CameraAnything是用于相机控制视频编辑的统一框架,采用逐像素普吕克光线注入等方法联合控制相机参数,开发合成管道克服数据稀缺,能在单过程中实现多种视频编辑操作,为视频制作提供实用价值。

Comments Project page: https://yixuanli98.github.io/cameraanything/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24194 2026-07-28 cs.CV 新提交 57%

Face Age Verification Vulnerabilities Under Simple Appearance Manipulations

简单外观操纵下的面部年龄验证漏洞

Ioannis Sarridis, Ioannis Kompatsiaris, Symeon Papadopoulos

机构 * Information Technologies Institute, Centre for Research and Technology Hellas(信息技术研究所,希腊研究与技术中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究简单外观操纵下面部年龄验证的漏洞,评估七个模型在三个数据集及四种操纵类型下的情况,发现胡茬操纵影响大,不同人口统计特征受影响有差异,还探索了用偏差缓解方法减轻偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24126 2026-07-28 cs.HC cs.AI cs.ET 新提交 57%

EEGForceFusion: Joint Tokenised-Continuous Representation Learning for Subject-Independent Grasp Force Decoding

EEGForceFusion:用于独立于主体的抓握力解码的联合令牌化-连续表示学习

Sankalp Sunil Turankar, Yogesh Kumar Meena

专题命中 机器人操作 :robotics(abstract);分类 cs.AI

AI总结 研究针对连续抓握力解码难题,提出混合EEG解码框架,联合建模连续和令牌化表示,集成多种技术于统一架构,实验表明该方法在WAY-EEG-GAL数据集上跨主体泛化能力强,适用于实时力解码。

Comments 6 pages, 9 figures, 4 tables, accepted at Brain-Machine Interface (BMI) Systems Session, IEEE International Conference on Systems, Man, and Cybernetics (IEEE SMC 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23920 2026-07-28 cs.CV 新提交 57%

What Can I Edit? Open-Ended Strategy Discovery and the Emotion Editability Landscape

我能编辑什么?开放式策略发现与情感可编辑性景观

Qing Li, Zeyu Dong, Yin Cui, Chuan Yan, Xiaojiang Peng

机构 * School of Artificial Intelligence, Shenzhen Technology University(深圳技术大学人工智能学院) School of Innovation Design, Shenzhen Technology University(深圳技术大学创新设计学院) Stanford University(斯坦福大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究情感图像编辑,EmoScope多智能体框架将任务转变为‘能编辑什么’,先发现可编辑空间,再平衡内容与情感,通过情感条件作用的可供性推理选择策略,在大规模评估中受青睐,还指出相关指标盲点及优势变化情况。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23782 2026-07-28 cs.RO 新提交 57%

$N_0$-VTLA: Scaling Vision-Tactile-Language-Action Model with Latent Tactile Tokens

$N_0$-VTLA:使用潜在触觉令牌扩展视觉-触觉-语言-动作模型

NeoteAI Team, Fudan TEAI Team

机构 * NeoteAI Team(NeoteAI团队) Fudan TEAI Team(复旦大学TEAI团队)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究提出$N_0$-VTLA模型,基于视觉主干,通过视觉-触觉预训练、分阶段触觉路径集成和优势条件离线策略改进进行触觉集成训练。该模型在丰富接触基准测试中表现出色,为通用触觉驱动操作策略奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22483 2026-07-27 cs.RO 新提交 57%

Plug, Play, and Comply: A Modular Framework for Online Variable Impedance with Arbitrarily Oriented Compliance Axes

即插即用且合规:具有任意定向柔顺轴的在线可变阻抗模块化框架

Mihael Simonič, Xiaocong Li

机构 * College of Information Science and Technology, Eastern Institute of Technology(信息科学与技术学院,东方理工学院) Zhejiang Key Laboratory of Industrial Intelligence and Digital Twin, Eastern Institute of Technology(浙江省工业智能与数字孪生重点实验室,东方理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 该论文提出与机器人无关的柔顺控制框架,通过插件架构分离控制器与控制律,标准化接口支持多种控制公式。其参考笛卡尔阻抗控制器可在线更新柔顺方向,实验和仿真验证了在不同操纵器上的任务相关柔顺性及可移植性。

Comments 8 pages, 7 figures, 2 tables. Paper page: https://smihael.github.io/plug-play-comply/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22320 2026-07-27 cs.RO 新提交 57%

A Monolithic Hand with Asymmetric Origami Bending and Dual-chamber Actuators

一种具有非对称折纸弯曲和双腔致动器的一体式手

Nan Huang, Yuming Zhu, Zicong Zhang, Jianhui Liu, Xiaohuang Liu, Dihan Liu, Jiansheng Dai, Sicong Liu

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 研究提出非对称折纸弯曲模式和非对称双腔设计,构成OSOR手的手指和手掌致动器,在一体式结构中实现仿生运动与足够输出性能,简化制造,经实验验证,其弯曲范围和输出力达标,能完成多种抓握动作,为软机器人手发展带来新可能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22249 2026-07-27 cs.RO 新提交 57%

Design and Human Evaluation of Tactile Withdrawal Reflexes for a Skin-Covered Robot Arm

用于皮肤覆盖机器人手臂的触觉退缩反射的设计与人体评估

Laura Babayeva, Lukas Rustler, Matej Hoffmann

机构 * Department of Cybernetics, Faculty of Electrical Engineering, Czech Technical University in Prague(布拉格捷克技术大学电气工程学院控制论系)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 研究机器人手臂人工伤害感受,提出将压力变化映射到退缩动作的流程,比较三种反射。通过用户研究发现均匀反射在多项指标上获高评价,表明行为可预测性对用户接受很关键,笛卡尔反射被认为最适合触摸,生物启发反射表现不佳。

Comments Submitted to IEEE Humanoids 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21600 2026-07-27 cs.AI 新提交 57%

Securing Multimodal AI through Internal Information Decomposition

通过内部信息分解保护多模态人工智能

Jehyeok Yeon, Hyeonjeong Ha, Qiusi Zhan, Heng Ji

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究多模态大语言模型的攻击问题,提出FlowGuard框架,通过监测内部多模态一致性检测有害输入,受部分信息分解启发得出FlowVectors量化相关指标,有效降低攻击成功率且减少效用损失和延迟,为多模态推理提供有效防御。

Comments Accepted as Spotlight Paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21518 2026-07-24 cs.AI 新提交 57%

Same Dangerous Objective, Opposite Advice: Direct Exposure versus Multi-Agent Mediation

相同危险目标,相反建议:直接暴露与多智能体调解

Linjun Li

机构 * University of Pennsylvania(宾夕法尼亚大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究通过测试发现,语言模型直接面对危险目标和经智能体转换传递指令时表现不同,存在行为反向转变及组合安全漏洞,高性能模型可用于特定自动化工作流程的用户端组件,却未明确其内部机制。

Comments 21 pages; welcome comments

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21036 2026-07-24 cs.CV 新提交 57%

GeoThreat: Transferable Targeted Adversarial Attacks on Large Vision-Language Models for Remote Sensing Image Interpretation

GeoThreat:用于遥感图像解释的大型视觉语言模型的可转移目标对抗攻击

Yimin Fu, Yuefeng Bai, Baicheng Pan, Zhunga Liu, Michael K. Ng

机构 * Department of Mathematics, Hong Kong Baptist University(香港浸会大学数学系) School of Automation, Northwestern Polytechnical University(西北工业大学自动化学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究针对大型视觉语言模型在遥感图像解释中的对抗攻击问题,提出GeoThreat方法,通过在概念和感知层面调制对抗表示,结合对抗目标相似性梯度等技术,实现可转移目标对抗攻击,实验证明该方法在可转移性和可控性上具有优越性。

Comments The code will be released at https://github.com/fuyimin96/GeoThreat upon acceptance

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20293 2026-07-23 cs.CV 新提交 57%

Evolving Cache Schedules for Fast Diffusion Policy Inference

用于快速扩散策略推理的演进缓存调度

Siying Wang, Kangye Ji, Di Wang, Fei Cheng

机构 * School of Telecommunications Engineering, Xidian University(西安电子科技大学通信工程学院) School of Computer Science and Technology, Xidian University(西安电子科技大学计算机科学与技术学院) Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究针对扩散策略实时部署计算需求大的问题,提出演进缓存调度(EVO)框架,通过进化搜索全局调度缓存刷新,引入冗余感知初始化和目标条件早期停止,大幅减少计算量并保留性能,实现动作生成加速和FLOPs降低。

Comments 15 pages, 3 figures, supplementary material included. Accepted by PRCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20207 2026-07-23 cs.RO 新提交 57%

SeededGrasp: Language-Guided Grasping in Complex Scenes with Multiple Embodiments

SeededGrasp:复杂场景中多实体语言引导抓取

Yang Xu, Gurpreet Singh Mukker, Raymond Wang, Jasper Gerigk, Maria Attarian, Igor Gilitschenski

机构 * University of Toronto(多伦多大学) Vector Institute(向量研究所) University of British Columbia(英属哥伦比亚大学) Google Deepmind(谷歌DeepMind)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 针对复杂场景中机器人抓取问题,提出 SeededGrasp 框架,通过 VLM 预测种子点,结合轻量级抓取生成模型,解耦语义与几何执行,无需端到端训练,发布多实体数据集,实验证明该方法优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17803 2026-07-21 cs.CV 新提交 57%

FF-ProCams: Feed-Forward Gaussian Splatting for Projector-Camera System

FF-ProCams:用于投影仪-相机系统的前馈高斯点渲染

Ziyao Wang, Yuqi Li, Wenxing Zheng, Jiaying Chen, Chong Wang

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 针对投影仪-相机系统,提出FF-ProCams前馈3D高斯逆渲染框架,用混合编码器聚合线索,轻量级头预测高斯表示,设计可微渲染器,构建数据集实验,实现高保真渲染且速度大幅提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17646 2026-07-21 cs.RO 新提交 57%

Configuration-Induced Passive Self-Rotation for Perception-Enhanced Autonomous Flight

用于感知增强自主飞行的构型诱导被动自旋转

Xurui Liu, Miao Wang, Tianyu He, Linrui Yang, Xiaobin Zhou

机构 * School of Robotics and Automation, Nanjing University(南京大学机器人与自动化学院)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO

AI总结 研究受限杂乱环境中自主飞行因传感器视野受限的问题,提出构型诱导被动自旋转三旋翼飞行器,利用后臂构型参数调节工作点,开发分层自主框架,经大量实验验证该方法对感知增强自主飞行有效。

Comments 9 pages, 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17132 2026-07-21 cs.RO 新提交 57%

BoxTwin: Learning Elastoplastic Articulated Object Dynamics from Videos

BoxTwin:从视频中学习弹塑性铰接物体动力学

Heng Zhang, Gehan Zheng, Kaifeng Zhang, Jay Song, Shivansh Patel, Sonny Hu, Yunzhu Li, Changxi Zheng, Peter Yichen Chen

机构 * SceniX, Inc.(SceniX公司) University of British Columbia(英属哥伦比亚大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究针对现有模型处理弹塑性铰接物体的不足,提出BoxTwin框架,通过视频学习其动力学,经重建场景、识别本构模型等流程,实验证明该框架能准确跟踪轨迹并再现塑性行为,推动数字孪生用于可变形铰接物体的控制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.17097 2026-07-21 cs.CV 新提交 57%

HarmoHOI: Harmonizing Appearance and 3D Motion for Multi-view Hand-Object Interaction Synthesis

HarmoHOI:用于多视图手-物体交互合成的外观与3D运动协调

Lingwei Dang, Juntong Li, Zonghan Li, Hongwen Zhang, Liang An, Wei Min, Yebin Liu, Qingyao Wu

机构 * South China University of Technology(华南理工大学) Beijing Normal University(北京师范大学) Tsinghua University(清华大学) Shadow AI(影谱科技)

专题命中 机器人操作 :embodied AI(abstract);分类 cs.CV

AI总结 研究针对多视图手-物体交互合成难题,提出HarmoHOI统一扩散框架,用多视图扩散Transformer混合模型联合建模视频与点轨迹,结合全局运动对齐扩散确保一致性,采用混合数据学习策略,实现多视图HOI高质量合成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16873 2026-07-21 cs.CV 新提交 57%

InfoDense: Density-Aware Regional Decisive Replay for Memory-Efficient Incremental Face Forgery Detection

InfoDense:用于内存高效增量式人脸伪造检测的密度感知区域决定性重放

Jikang Cheng, Hao Shen, Xueyi Zhang, Guangcheng Wang, Zhongyuan Wang, Renye Yan, Baojin Huang

机构 * Huazhong Agricultural University(华中农业大学) Peking University(北京大学) National University of Singapore(新加坡国立大学) Nantong University(南通大学) Wuhan University(武汉大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 针对人脸伪造技术发展带来的检测挑战及传统方法的问题,提出密度感知区域决定性重放策略InfoDense,通过定位决定性补丁、排序候选片段、自适应合并样本等步骤,有效减轻灾难性遗忘,提升跨域泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16362 2026-07-21 cs.CV 新提交 57%

OmniStyle-INR: Universal and Multimodal Style Transfer for INRs

OmniStyle-INR:用于隐式神经表示的通用多模态风格迁移

Rafał Kajca, Michał Miziołek, Kornel Howil, Rafał Tobiasz, Przemysław Spurek

机构 * Jagiellonian University(雅盖隆大学) IDEAS Research Institute(IDEAS 研究所)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究针对不同数据模态的风格迁移问题,提出OmniStyle-INR框架,利用基于网络的连续表示作为通用域,实现了在文本提示和视觉示例引导下跨视觉模态的高质量风格迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16280 2026-07-21 cs.CV 新提交 57%

3D FaceShell: Attribute Transfer in 3D Face Avatars as a VLM Defense Mechanism

3D FaceShell:作为视觉语言模型防御机制的3D人脸头像属性转移

Weston Bondurant, Srijan Das, Hieu Le, Stephanie Schuckers

机构 * University of North Carolina at Charlotte(北卡罗来纳大学夏洛特分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 针对VLM可从3D人脸渲染图像提取敏感属性的隐私挑战,提出3D FaceShell框架,通过可学习高斯壳产生扰动,在保持面部外观的同时引导VLM语义解释,实验证明其能有效提高属性注入和不匹配率。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16095 2026-07-20 cs.RO 新提交 57%

Let the Body Follow: Coupled Egocentric Control for Whole-Body Robot Teleoperation

让身体跟随:用于全身机器人遥操作的耦合自我中心控制

Tsung-Chi Lin, Yichen Xie, Chien-Ming Huang

机构 * New Jersey Institute of Technology(新泽西理工学院) Johns Hopkins University(约翰霍普金斯大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究全身机器人遥操作协调难题,提出耦合自我中心控制方法,通过机器人躯干和基座自动响应操作员头部及手臂动作,在用户研究中评估该方法,相比基线混合界面有诸多优势。

Comments 8 pages, 11 figures, 1 table; submitted to the 2026 IEEE-RAS International Conference on Humanoid Robots (Humanoids 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15883 2026-07-20 cs.HC cs.AI 新提交 57%

Perceived AGI: Believability as Dimensional Completeness, Not Capability

感知通用人工智能:可信度取决于维度完整性,而非能力

Sebastian Cochinescu

机构 * University of Bucharest(布加勒斯特大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究探讨大语言模型在对话中缺乏思维存在感的问题,提出可信度取决于维度完整性的假设,定义了时间、真相、熵和爱四个维度及相关行为立场,识别出行为层,还陈述了可证伪预测,为感知通用人工智能提供概念框架。

Comments 12 pages, 1 figure, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏