arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-14 至 2026-07-14 共收录 27 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 27 篇

2607.11643 2026-07-14 cs.RO cs.AI 新提交 86%

Xiaomi-Robotics-U0: Unified Embodied Synthesis with World Foundation Model

小米机器人-U0:基于世界基础模型的统一具身合成

Xinghang Li, Jun Guo, Qiwei Li, Long Qian, Hang Lai, Yueze Wang, Hongyu Yan, Jiahang Cao, Xi Chen, Jingen Qu, Jiaxi Song, Nan Sun, Hanye Zhao, Futeng Liu, Wanli Peng, Heyun Wang, Yunhong Wang, Caoyu Xia, Jack Zhao, Diyun Xiang, Hangjun Ye, Heng Qu, Huaping Liu, Jason Li

机构 * Xiaomi Robotics(小米机器人)

专题命中 机器人数据与评测 :robotics(title,abstract);manipulation(abstract);world model(abstract);分类 cs.RO、cs.AI

AI总结 研究针对基础模型应用于具身场景受限问题,提出小米机器人-U0多模态自回归模型,将具身生成扩展为基础图像和视频生成的形式,联合优化多种生成任务,在多方面取得领先成果,证明基础世界模型可用于具身智能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03953 2026-07-14 cs.RO cs.AI cs.CV 版本更新 85%

RVN-Bench: A Benchmark for Reactive Visual Navigation

RVN-Bench: 一种用于反应式视觉导航的基准测试

Jaewon Lee, Jaeseok Heo, Gunmin Lee, Howoong Jun, Jeongwoo Oh, Songhwai Oh

机构 * Department of Electrical and Computer Engineering, Seoul National University (SNU) and Automation and Systems Research Institute (ASRI) and Sequor Robotics Inc.(电气与计算机工程系,首尔国立大学(SNU)和自动化与系统研究所(ASRI)以及Sequor机器人公司) Department of Electrical and Computer Engineering, Seoul National University (SNU) and Automation and Systems Research Institute (ASRI)(电气与计算机工程系,首尔国立大学(SNU)和自动化与系统研究所(ASRI)) Interdisciplinary Program in Artificial Intelligence, Seoul National University (SNU) and Automation and Systems Research Institute (ASRI) and Sequor Robotics Inc.(人工智能跨学科项目,首尔国立大学(SNU)和自动化与系统研究所(ASRI)以及Sequor机器人公司) Sequor Robotics Inc.(Sequor机器人公司)

专题命中 机器人数据与评测 :navigation(title,abstract);robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 RVN-Bench是一种针对室内移动机器人安全视觉导航的碰撞感知基准测试,通过高保真度场景和标准化工具,支持在线和离线学习,提升导航任务的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09792 2026-07-14 cs.RO cs.AI 新提交 84%

A Comprehensive Survey and Systematic Real-World Evaluation of Embodied Vision-and-Language Navigation

具身视觉与语言导航的全面综述与系统真实世界评估

Liuyi Wang, Kai Sheng, Zongtao He, Jinlong Li, Yongrui Qin, Haojie Dai, Xiangyi Wang, Jingwei Yang, Qingqing Yan, Chengju Liu, Qijun Chen

机构 * College of Electronic and Information Engineering, Tongji University(同济大学电子与信息工程学院)

专题命中 机器人数据与评测 :navigation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 综述具身视觉与语言导航研究,按动作和模型范式组织方法并分析优缺点,在物理机器人平台对代表性配置进行真实世界评估,揭示模拟与真实部署的性能差距,强调未来研究在感知、决策和控制方面的关键挑战。

Comments This paper has been accepted by IEEE TASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07459 2026-07-14 cs.RO cs.CV 版本更新 84%

EmbodiedGen V2: An Agentic, Simulation-Ready 3D World Engine for Embodied AI

EmbodiedGen V2:用于具身人工智能的具有智能体特性、可用于模拟的3D世界引擎

Xinjie Wang, Liu Liu, Taojun Ding, Andrew Choi, Chaodong Huang, Mengao Zhao, Ziang Li, Jackson Jiang, Chunlei Yu, Shengxiang Liu, Wei Xu, Zhizhong Su

机构 * Horizon Robotics(地平线机器人) WuwenAI(悟文智能)

专题命中 机器人数据与评测 :embodied AI(title);manipulation(abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究提出EmbodiedGen V2这个用于具身智能的3D世界引擎,通过统一表示解决资产组装问题。其生成环境支持多种任务,评估中资产管道表现良好,强化学习提升了模拟成功率,确立了它作为可扩展模拟基础设施的地位。

Comments Minor revisions to presentation; technical content and results remain unchanged. Project page: horizonrobotics.github.io/EmbodiedGen

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11004 2026-07-14 cs.RO cs.AI 新提交 81%

Affordance-Based Manipulation Planning with Text Goals and Sim-to-Real Generalisation via Real-to-Sim Image Conversion

基于文本目标和通过实到模拟图像转换实现从模拟到现实泛化的基于可供性的操纵规划

Solvi Arnold, Rin Karashima, Tadashi Adachi, Takafumi Mochizuki, Kimitoshi Yamazaki

专题命中 机器人数据与评测 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究提出基于可供性识别与动作效果预测的操纵规划系统,通过多模态目标匹配模块评估候选计划,能跟踪遮挡物体位置。还用图像转换模块辅助,分别评估模块性能并展示集成系统在模拟与硬件上的规划能力。

Comments 14 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21001 2026-07-14 cs.GT 版本更新 78%

Do Large Language Model Voters Strategize? An Oracle-Based Benchmark for Manipulation under Voting Rules

大语言模型选民会策略投票吗?一个基于预言机的投票规则操纵基准测试

Seyed Pouyan Mousavi Davoudi, Alireza Amiri-Margavi, Amin Gholami Davodi, Hamidreza Hasani Balyani, Arshia Gharagozlou

专题命中 机器人数据与评测 :manipulation(title,abstract)

AI总结 本文提出一个基于预言机的基准测试,通过枚举所有可行报告并计算真实结果,评估大语言模型选民能否发现并执行策略投票,覆盖多种投票规则和提示条件。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11779 2026-07-14 cs.RO 新提交 77%

A Compact Top-Loading Robot for Endovascular Interventions: Design, Control and Evaluation

一种用于血管内介入的紧凑型顶部加载机器人:设计、控制与评估

Jonas Fischer, Lennart Karstensen, Franziska Mathis-Ullrich

机构 * Laboratory for Surgical Planning and Robot Cognition (SPARC)(外科规划与机器人认知实验室)

专题命中 机器人数据与评测 :manipulation(abstract);navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对血管内介入现有系统问题,提出紧凑型顶部加载机器人系统,通过主从控制策略实现连续运动,经实验评估其运动轮廓平滑,在体外条件下具技术可行性,紧凑设计利于临床整合,未来将改进相关性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27537 2026-07-14 cs.CV 版本更新 74%

MemoBench: Benchmarking World Modeling in Dynamically Changing Environments

MemoBench: 动态变化环境中的世界建模基准测试

Haoyu Chen, Kaichen Zhou, Hang Hua, Kaile Zhang, Jingwen Qian, Wufei Ma, Haonan Chen, Chunjiang Liu, Yizhou Zhao, Xiaoyuan Wang, Weiyue Li, Alan Yuille, Paul Pu Liang, Yilun Du

机构 * Harvard University(哈佛大学) MIT(麻省理工学院) MIT-IBM Watson AI Lab(MIT-IBM沃森人工智能实验室) Boston University(波士顿大学) Google(谷歌) JHU(约翰霍普金斯大学) CMU(卡内基梅隆大学) Kempner Institute(肯普纳研究所)

专题命中 机器人数据与评测 :world model(title);分类 cs.CV

AI总结 提出MemoBench基准,通过目标消失-重现范式评估视频生成模型在动态环境中的记忆一致性,涵盖合成与真实场景,揭示现有模型的关键挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11397 2026-07-14 cs.RO 新提交 70%

WALA Learning Executable Latent Actions from Action-Labeled Demonstrations and Action-Free Videos

WALA:从带动作标签的演示和无动作视频中学习可执行的潜在动作

Jiahao Liu, Zhongpu Xia, Shuai Tian, Huangrui Li, Yuhang Zheng, Ning Ma, Xin Fu, Xiaotian Liu, Jing Li, Yixian Li, ShangQing Zhou, Zebin Xing, Linbo Wang, Chaoyue Li, Haoran Li, Dongbin Zhao

机构 * CASIA(中国科学院自动化所) Anyverse Dynamics(Anyverse动力学公司) UCAS(中国科学院大学) NUS(新加坡国立大学) XJYLU(西安交通大学利物浦大学)

专题命中 机器人数据与评测 :manipulation(abstract);world model(abstract);分类 cs.RO

AI总结 研究从带动作标签演示和无动作视频学习可执行潜在动作的问题,提出WALA框架,先预训练语义几何潜在动作模型,策略训练时编码器和解码器协同,由多方面联合监督潜在动作,实验证明其提升了机器人策略性能和泛化能力。

Comments Project page: https://liujiahao2077.github.io/WALA.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10892 2026-07-14 cs.RO 新提交 70%

A Single Diffusion-Policy Controller for Multi-Task Block Pushing with Zero-Shot Sim-to-Real Transfer

用于多任务块推的单扩散策略控制器,具有零样本模拟到现实转移

Haitong Ma, Haldun Balim, Yang Hu, Bo Dai, Na Li

机构 * Harvard University(哈佛大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究旨在用强化学习从零训练单扩散策略用于多任务块推,提出含简单策略损失函数的框架,结合反向课程生成等应对探索挑战,评估其在不同条件下零样本从模拟到现实的转移能力,证明该流程有效。

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02776 2026-07-14 cs.RO 版本更新 70%

XR-1: Towards Versatile Vision-Language-Action Models via Learning Unified Vision-Motion Representations

XR-1:通过学习统一的视觉-运动表示实现多功能的视觉-语言-动作模型

Shichao Fan, Kun Wu, Zhengping Che, Xinhua Wang, Di Wu, Fei Liao, Ning Liu, Yixue Zhang, Zhen Zhao, Zhiyuan Xu, Meng Li, Qingjie Liu, Shanghang Zhang, Min Wan, Jian Tang

机构 * Beijing Innovation Center of Humanoid Robotics, Beijing, China(北京人形机器人创新中心,北京,中国) School of Mechanical Engineering and Automation, Beihang University, Beijing, China(北京航空航天大学机械工程及自动化学院,北京,中国) State Key Laboratory of Virtual Reality Technology and Systems, SCSE, Beihang University, Beijing, China(虚拟现实技术与系统国家重点实验室,SCSE,北京航空航天大学,北京,中国) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University, Beijing, China(多媒体信息处理国家重点实验室,计算机科学学院,北京大学,北京,中国)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 XR-1通过学习统一的视觉-运动表示,解决视觉-语言-动作模型在低级动作生成和跨数据源领域差距的挑战,提出三阶段训练方法并验证了其在多种机器人和任务上的优越性能。

Comments Accepted to ICML2026 as Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.21649 2026-07-14 cs.CV 70%

Seeing Isn't Orienting: A Cognitively Informed Hierarchical Benchmark for Object Orientation in MLLMs

看到并不等于定向:一个认知基础的基准揭示了多模态大语言模型在定向任务中的系统性失败

Nazia Tasnim, Keanu Nichols, Yuting Yan, Nicholas Ikechukwu, Elva Zou, Deepti Ghadiyaram, Bryan A. Plummer

机构 * Boston University(波士顿大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 机器人数据与评测 :manipulation(abstract);robotic(abstract);分类 cs.CV

AI总结 本文提出DORI基准,揭示多模态大语言模型在定向理解上的不足,发现其在角度估计和方向跟踪方面存在系统性缺陷,对机器人控制和3D场景重建有重要启示。

Comments Paper accepted to ECCV 2026 (Main Track). Previously, this version appeared as arXiv:2603.11410 which was submitted as a new work by accident

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09785 2026-07-14 cs.CV cs.AI 新提交 62%

Lifelong Representations: A Survey on Continual Self-Supervised Learning for Vision Models

终身表示:视觉模型持续自监督学习综述

Sergi Masip, Alicja Dobrzeniecka, Jonathan Swinnen, Joachim Collin, Bartłomiej Twardowski, Szymon Łukasik, Tinne Tuytelaars

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 综述视觉领域持续自监督学习(CSSL),分析现有评估协议问题,探讨自监督目标抗灾难性遗忘原因,基于遗忘缓解策略对方法分类,识别如可扩展性等挑战,提出推进CSSL需转向大规模持续预训练范式。

Comments This work has been accepted for publication in IEEE EAIS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06279 2026-07-14 cs.CV cs.RO eess.IV 版本更新 62%

Can we Trust Unreliable Voxels? Exploring 3D Semantic Occupancy Prediction under Label Noise

我们能信任不可靠的体素吗?在标签噪声下的3D语义占用预测探索

Wenxin Li, Kunyu Peng, Di Wen, Junwei Zheng, Jiale Wei, Mengfei Duan, Yuheng Zhang, Rui Fan, Kailun Yang

机构 * School of Artificial Intelligence and Robotics(人工智能与机器人学院) National Engineering Research Center of Robot Visual Perception and Control Technology(机器人视觉感知与控制技术国家工程研究中心) Institute for Anthropomatics and Robotics(人机一体化与机器人研究所) Karlsruhe Institute of Technology(卡尔斯鲁厄技术大学) INSAIT College of Electronic and Information Engineering(电子与信息学院) Shanghai Institute of Intelligent Science and Technology(智能科学与技术上海研究院) Shanghai Research Institute for Intelligent Autonomous Systems(智能自主系统上海研究院) Shanghai Key Laboratory of Intelligent Autonomous Systems(智能自主系统上海重点实验室) State Key Laboratory of Autonomous Intelligent Unmanned Systems(自主智能无人系统国家重点实验室) Frontiers Science Center for Intelligent Autonomous Systems(智能自主系统前沿科学中心)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO、cs.CV

AI总结 本文提出DPR-Occ框架,通过双源部分标签推理解决3D语义占用预测中的标签噪声问题,实验表明其在高噪声环境下仍能保持性能。

Comments Accepted to IROS 2026. The benchmark and source code will be made publicly available at https://github.com/mylwx/OccNL

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11594 2026-07-14 cs.AI cs.GR 新提交 57%

MAGIC: Transition-Aware Generation of Navigable Multi-Scene Game Worlds with Large Language Models

MAGIC:利用大语言模型生成具有可导航多场景的游戏世界并感知过渡

Tsz Hei Fan, Choi Wing Fung, Yuxuan Wan, Shuqing Li, Michael R. Lyu

机构 * Department of Computer Science and Engineering(计算机科学与工程系)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.AI

AI总结 研究利用大语言模型生成多场景游戏世界时面临的问题,提出MAGIC系统,通过四阶段管道将自然语言提示转化为可运行项目,解决跨场景一致性等问题,在新基准测试中表现出色,生成可执行项目且过渡识别指标优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10999 2026-07-14 cs.RO 新提交 57%

Wearing A Coat: Dual-Arm Robot-Assisted Dressing with Differentiable Clothing Simulation

穿着外套:基于可微服装模拟的双臂机器人辅助穿衣

Yiming Liu, Lijun Han, Hesheng Wang

机构 * Department of Automation, Shanghai Jiao Tong University(上海交通大学自动化系)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 研究针对机器人辅助穿衣中衣物与人体四肢复杂接触交互的问题,提出集成实时可微服装模拟的控制算法,经模拟和实验验证,该算法能解决接触约束下服装状态问题,实现多阶段控制策略,证明了其可行性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10842 2026-07-14 cs.RO cs.SY eess.SY 新提交 57%

D-SafeMPC: Diffusion-Driven Safe Model Predictive Control with Discrete-Time Control Barrier Functions

D-SafeMPC:基于离散时间控制障碍函数的扩散驱动安全模型预测控制

Erdi Sayar, Ersin Daş, Joel W. Burdick, Alois Knoll, Erdal Kayacan

机构 * Paderborn University(帕德博恩大学) Illinois Institute of Technology(伊利诺伊理工学院) California Institute of Technology(加州理工学院) Technical University of Munich(慕尼黑工业大学)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 研究针对扩散模型用于机器人规划时无法保证安全和动态约束的问题,提出D-SafeMPC方法,通过控制障碍函数等引导扩散过程,结合迭代投影方案,经实验验证该方法能提升安全性、任务成功率和规划效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10437 2026-07-14 cs.RO 新提交 57%

Interleaved POMDP Planning for Multi-Object Search in Unknown Multi-Room Household Environments

未知多房间家庭环境中多目标搜索的交错部分可观测马尔可夫决策过程规划

Ruochu Yang, Ziyi Xia, Huibo Zhang, Yatong Han, Yiming Zhao, Yingke Li, Fumin Zhang, Yorai Wardi, Mengxue Hou

机构 * Georgia Institute of Technology(佐治亚理工学院) The Hong Kong University of Science and Technology(香港科技大学) Ising AI(伊辛人工智能公司) MIT(麻省理工学院) Notre Dame University(圣母大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究未知多房间家庭环境下多目标搜索问题,提出Inter-POMDP算法,通过高级POUCT规划器与低级运动规划器相互作用,平衡规划质量与效率,相比基线方法减少碰撞、导航步数及检测次数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10402 2026-07-14 cs.CR cs.AI cs.SI 新提交 57%

Large Language Models in Misinformation Ecosystems: Misuse, Defense, and Vulnerability

错误信息生态系统中的大语言模型:滥用、防御与脆弱性

Lingwei Wei, Dou Hu, Wei Zhou, Songlin Hu, Philip S. Yu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) University of Illinois Chicago(伊利诺伊大学香槟分校) State Key Laboratory of Media Convergence and Communication, Communication University of China(中国传媒大学媒体融合与传播国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.AI

AI总结 研究大语言模型在错误信息生态系统中的问题,引入角色层框架统一风险与防御,组织相关攻击、研究检测与验证方法、分析漏洞及讨论对策,指出从静态检测到风险评估、强化验证管道、部署可审计人工参与验证系统这三个关键挑战。

Comments 35 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09692 2026-07-14 cs.LG cs.CL 新提交 57%

Reference-Based Distillation Detection in LLMs

大语言模型中基于参考的蒸馏检测

Rajat Rawat, Sizhe Chen, Akshay Anand, Michael Duan, Bob Rotsted, Sewon Min

机构 * University of California, Berkeley(加利福尼亚大学伯克利分校) University of Southern California(南加利福尼亚大学) OpenAI

专题命中 机器人数据与评测 :world model(abstract);分类 cs.LG

AI总结 研究旨在检测大语言模型是否经蒸馏而来,提出基于参考的成员推理蒸馏检测方法,通过比较模型与不同候选教师输出的优先对齐程度识别教师及蒸馏证据,能处理未知管道,扩展到开放世界设置,应用于当代模型获潜在蒸馏关系新证据。

Comments 27 pages (14 main), 21 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05241 2026-07-14 cs.RO 版本更新 57%

GelNeuro: A Sensing-Computing Integrated Neuromorphic Tactile System for Texture Recognition

GelNeuro:面向纹理识别的感算融合神经形态触觉系统

Luoyang Bian, Xinpan Meng, Zhenghua Ma, Houcheng Li, Long Cheng

机构 * State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 针对现有神经形态触觉系统依赖主机预处理的问题,提出GelNeuro感算融合系统,搭配硬件感知权重钳位策略,实现低功耗高准确率的端侧纹理识别。

Comments The authors withdraw this preprint as the work requires substantial revision and additional validation. The current version is not suitable for public dissemination, and further development of the research is needed

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11637 2026-07-14 cs.AI 版本更新 57%

TouchThinker: Scaling Tactile Commonsense Reasoning to the Open World with Large-scale Data and Action-aware Representation

TouchThinker: 通过大规模数据和动作感知表示将触觉常识推理扩展到开放世界

Kailin Lyu, Di Wu, Pengwei Zhang, Yuhang Zheng, Yingxin Lai, Long Xiao, Kangyi Wu, Pengna Li, Chen Gao, Lianyu Hu, Xiaobin Hu, Jie Hao, Ce Hao, Weihao Yuan, Shuicheng Yan

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) National University of Singapore(新加坡国立大学) Zhongguancun Academy(中关村学院) Xiamen University(厦门大学) Xi’an Jiaotong University(西安交通大学) Nanyang Technological University(南洋理工大学) Nanjing University(南京大学)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.AI

AI总结 提出TouchThinker框架,通过构建百万级多源触觉数据集TouchThinker-1M和动作感知建模,将触觉常识推理扩展到开放世界,在多个数据集上取得竞争性表现。

Comments 18 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.28022 2026-07-14 cs.CV 版本更新 57%

Are DeepFakes Realistic Enough? Exploring Semantic Mismatch as a Novel Challenge

深度伪造是否足够逼真?探索语义不匹配作为新的挑战

Sharayu Nilesh Deshmukh, Kailash A. Hambarde, Joana C. Costa, Hugo Proença, Tiago Roxo

机构 * Instituto de Telecomunicações, Universidade da Beira Interior(电信研究所,贝拉内里大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 本文提出新的评估框架,通过引入语义不匹配类别,评估现有模型在面对语义不一致的深度伪造数据时的鲁棒性,并提出语义强化策略提升检测性能。

Comments Added missing FGI results in semantic reinforcement eval (Table 9), showing an architecture-dependent effect. Abstract, contributions, and conclusion revised accordingly. Clarified RARV-SMM/semantic mismatch definition. Corrected SOTA comparison claim (Sec. 4.7). Added code link

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15041 2026-07-14 cs.LG cs.SE 版本更新 57%

HyperNet-Adaptation for Diffusion-Based Test Case Generation

基于扩散的测试用例生成的超网络自适应

Oliver Weißl, Vincenzo Riccio, Severin Kacianka, Andrea Stocco

机构 * Technical University of Munich(慕尼黑技术大学) University of Udine(乌迪内大学) fortiss

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.LG

AI总结 针对深度学习系统可靠性评估问题,提出HyNeA生成式测试方法,通过超网络实现无数据集可控性,采用独特训练策略,能以较低计算成本有针对性地生成现实故障用例,提高可控性和测试多样性,还可推广到无故障标签数据领域。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10080 2026-07-14 cs.IR 新提交 50%

The Effect of Multi-Lingual and Keyword Adversarial Injection on LLM Relevance Judgment

多语言和关键词对抗性注入对大语言模型相关性判断的影响

Nguyen Khoi Vo, Duy Duong Tuong, Oleg Zendel, Mark Sanderson

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 研究跨语言提示注入攻击对基于大语言模型的相关性判断的影响,利用TREC数据集和开放权重模型在多语言环境下研究不同注入策略,发现多语言查询注入有效且能绕过现有防御,凸显当前防御差距,强调需更强大评估框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11038 2026-07-14 quant-ph physics.atom-ph 新提交 50%

Many-Body Physics with Rydberg Atoms: Quantum Simulation and Non-equilibrium Dynamics

里德堡原子的多体物理:量子模拟与非平衡动力学

Zhengyang Bai, Cheng Chen, Fan Yang, Weibin Li

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文聚焦里德堡原子多体物理,讨论其相互作用理论基础与多体物理,审视相关实验技术,还探讨利用集体效应探测新多体相和非平衡动力学的突破,综合理论与实验成果,展现该领域对未来量子技术的变革潜力。

Comments arXiv admin note: text overlap with arXiv:2402.13657 by other authors

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10458 2026-07-14 physics.ins-det hep-ex 新提交 50%

Quality control and quality assurance evaluation of ALFE2, a large-dynamic-range front-end ASIC de-veloped for the ATLAS Liquid Argon Calorimeter high-luminosity LHC upgrade

用于ATLAS液态氩量能器高亮度LHC升级的大动态范围前端ASIC ALFE2的质量控制与质量保证评估

E. Buschmann, G. Carini, G. Chatzianastasiou, H. Chen, Y. Chen, M. Dabrowski, G. Deptuch, L. Duflot, M. Feo, J. Kierstead, T. Liu, H. Ma, D. Matakias, N. Morange, M. Oliveira, S. Rescia, E. Rossi, S. Tang, M. Tamari, H. Xu

专题命中 机器人数据与评测 :robotic(abstract)

AI总结 针对ATLAS液态氩量能器升级的ALFE2前端ASIC,开发机器人系统进行质量控制测试并建立分级标准,评估测试良率超85%,应用于全面生产质量控制,辐照测试无显著性能下降,推断出HL-LHC运行时的单粒子翻转错误率。

Comments 16 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏