arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-05-19 至 2026-05-19 共收录 174 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人数据与评测 29 篇

2605.18423 2026-05-19 cs.RO cs.CY 61%

REBAR: Reference Ethical Benchmark for Autonomy Readiness

REBAR:自主性准备的参考伦理基准

Jonathan Diller, David Barnes, Rebekah Bogdanoff, Rhett Collier, Roddy Collins, Keith Fieldhouse, Yonatan Gefen, Cameron Johnson, Anuriha Kodali, Brad Kriel, Varun Murali, James Niehaus, Mish Sukharev, Joseph VanPelt, Anthony Hoogs, Vijay Kumar, Arslan Basharat

机构 * University of Pennsylvania(宾夕法尼亚大学) David Barnes, LLC(大卫·巴恩斯公司) Kitware, Inc.(Kitware公司) Duality Robotics, Inc.(Duality机器人公司) Texas A&M University(德克萨斯大学) Charles River Analytics(查尔斯河分析公司)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.RO;robotics(comments)

AI总结 本文提出REBAR框架,通过严谨测试提供可计算的自主性准备等级,以量化伦理性能并解决现有伦理AI框架的不足。

Comments To be presented at the 2026 Workshop on Robot Ethics - Ethical, Legal and User Perspectives in Robotics and Automation (WOROBET)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21787 2026-05-19 cs.CV 61%

Benchmarking Recurrent Event-Based Object Detection for Industrial Multi-Class Recognition on MTevent

在MTevent上评估用于工业多类识别的循环事件基目标检测基准

Lokeshwaran Manohar, Moritz Roidl

机构 * Chair of Material Handling and Warehousing, TU Dortmund University, Dortmund, Germany(物料搬运与仓储学系,杜伊斯堡-艾森大学,多特蒙德,德国)

专题命中 机器人数据与评测 :robotics(abstract,comments);分类 cs.CV

AI总结 本文研究了在MTevent数据集上使用循环ReYOLOv8s进行工业多类识别的性能,并通过非循环YOLOv8s作为基线分析时间记忆的影响,发现事件域预训练对性能提升更有效。

Comments Accepted at the Neuromorphic Field Robotics and Automation Workshop, ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18467 2026-05-19 cs.CV 57%

InstructAV2AV: Instruction-Guided Audio-Video Joint Editing

InstructAV2AV:基于指令的音频视频联合编辑

Haojie Zheng, Yixin Yang, Siqi Yang, Shuchen Weng, Boxin Shi

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院) Peking University(北京大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 本文提出InstructAV2AV,首个端到端的指令引导音频视频联合编辑框架,通过构建大规模音频视频编辑数据集InsAVE-80K和改进的生成模型,实现了更高质量的音频视频联合编辑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18451 2026-05-19 cs.CV cs.GR 57%

Code-as-Room: Generating 3D Rooms from Top-Down View Images via Agentic Code Synthesis

Code-as-Room: 通过代理代码合成从俯视图图像生成3D房间

Yixuan Yang, Zhen Luo, Wanshui Gan, Jinkun Hao, Junru Lu, Jinghao Yan, Zhaoyang Lyu, Xudong Xu

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Innovation Institute(上海创新研究院) Southern University of Science and Technology(南方科技大学) University of Warwick(沃里克大学)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 本文提出Code-as-Room框架,通过结构化执行 harness 生成3D房间,利用Blender代码表示房间,并引入专门的代码基3D房间合成基准进行评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05653 2026-05-19 cs.RO cs.MA 57%

EvoQRE: Modeling Bounded Rationality in Safety-Critical Traffic Simulation via Evolutionary Quantal Response Equilibrium

EvoQRE: 通过进化量化反应均衡建模安全关键交通仿真中的有限理性

Phu-Hoa Pham, Chi-Nguyen Tran, Duy-Minh Dao-Sy, Phu-Quy Nguyen-Lam, Trung-Kiet Huynh

专题命中 机器人数据与评测 :world model(abstract);分类 cs.RO

AI总结 本文提出EvoQRE框架,通过量化反应均衡和进化博弈动态建模安全关键交通交互,理论证明其在弱单调性假设下收敛到Logit-QRE,并在Waymo和nuPlan数据集上验证了其在真实性和安全指标上的优越性。

Comments This article is being withdrawn due to identified issues in the experimental evaluation and theoretical assumptions that may affect the validity of some reported conclusions. The authors plan to revise the methodology and provide a corrected version in future work.

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20857 2026-05-19 cs.CL cs.AI 57%

Evo-Memory: Benchmarking LLM Agent Test-time Learning with Self-Evolving Memory

Evo-Memory:通过自演化记忆基准测试LLM代理的测试时间学习

Tianxin Wei, Noveen Sachdeva, Benjamin Coleman, Zhankui He, Yuanchen Bei, Xuying Ning, Mengting Ai, Yunzhe Li, Jingrui He, Ed H. Chi, Chi Wang, Shuo Chen, Fernando Pereira, Wang-Cheng Kang, Derek Zhiyuan Cheng

机构 * Google DeepMind(谷歌DeepMind) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人数据与评测 :embodied agent(abstract);分类 cs.AI

AI总结 本文提出Evo-Memory,一个用于评估LLM代理自演化记忆能力的综合流基准和框架,通过构建序列任务流数据集,要求LLM在每次交互后搜索、适应和演化记忆,并在10个多样化的多轮目标导向和单轮推理与问答数据集上评估了超过十种代表性的记忆模块。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18058 2026-05-19 cs.CV 57%

Threats to Arabic Handwriting Recognition: Investigating Black-Box Adversarial Attacks on embedded ConvNet models

阿拉伯手写识别的威胁:调查嵌入式卷积网络模型上的黑盒对抗攻击

Mohsine EL Khayati, Abdelillah Semma, Abdelaziz Courr, Rachid Elouahbi

机构 * Systems theory and informatics laboratory(系统理论与信息学实验室) Moulay Ismail University of Meknes(穆莱·艾息姆大学) Department of Computer Science(计算机科学系) EST of Sidi Bennour(西迪·本努尔工程与技术学院) Chouaib Doukkali University(侯赛因·杜克利大学) Faculty of Education Sciences(教育科学学院) University Mohammed V(穆莱·维大学) Laboratory of Computer Science and Applications(计算机科学与应用实验室)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 本研究探讨了阿拉伯手写识别系统对黑盒对抗攻击的脆弱性,通过实验揭示了高精度模型在面对对抗攻击时的易受攻击性,强调了加强模型安全性和可靠性的必要性。

Comments Accepted in the IEEE 15th Image, Video, and Multidimensional Signal Processing Workshop 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18052 2026-05-19 cs.CV 57%

Efficient 3D Content Reconstruction and Generation

高效3D内容重建与生成

Jiahao Li

机构 * TOYOTA TECHNOLOGICAL INSTITUTE AT CHICAGO(丰田技术研究所芝加哥分校)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出了一种高效的3D内容生成和重建方法,通过结合多视图扩散和稀疏视图3D重建,实现了高质量的3D资产生成,并开发了FastMap算法以提高3D重建的速度和精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23994 2026-05-19 cs.SD cs.AI 57%

PhyAVBench: A Challenging Audio Physics-Sensitivity Benchmark for Physically Grounded Text-to-Audio-Video Generation

PhyAVBench: 一个具有挑战性的音频物理敏感性基准,用于物理基础的文本到音频视频生成

Tianxin Xie, Wentao Lei, Kai Jiang, Guanjie Huang, Pengfei Zhang, Chunhui Zhang, Fengji Ma, Haoyu He, Han Zhang, Jiangshan He, Jinting Wang, Linghan Fang, Lufei Gao, Orkesh Ablet, Peihua Zhang, Ruolin Hu, Shengyu Li, Weilin Lin, Xiaoyang Feng, Xinyue Yang, Yan Rong, Yanyun Wang, Zihang Shao, Zelin Zhao, Chenxing Li, Shan Yang, Wenfu Wang, Meng Yu, Dong Yu, Li Liu

机构 * HKUST(GZ)(香港科技大学(广州)) Tencent(腾讯)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 本文提出PhyAVBench,一个用于评估文本到音频视频生成、图像到音频视频生成和视频到音频生成模型中音频-物理基础能力的基准,通过引入新的数据集和评估方法,揭示了当前模型在物理合理音频生成方面的不足。

Comments 6 major physical dimensions, 41 fine-grained test points, 337 groups of variable-controlled test samples, 11,605 newly recorded videos

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16899 2026-05-19 cs.CV 57%

LASAR: Towards Spatio-temporal Reasoning with Latent Cognitive Map

LASAR:迈向基于潜在认知图的时空推理

Jinzhou Tang, Sidi Liu, Waikit Xiu, Weixing Chen, Keze Wang

机构 * Sun Yat-sen University(中山大学)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 本文提出LASAR架构,通过双记忆系统维护事件经历和语义认知图,并引入ST-CRL对比目标训练该架构,以提升长距离碎片化经验中对细粒度空间关系的编码能力,在标准VLN-CE和VSI-Bench基准上实现了零样本泛化能力的2%-3.5%提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10408 2026-05-19 cs.SE cs.RO 57%

VISOR: A Vision-Language Model-based Test Oracle for Testing Robots

VISOR:基于视觉-语言模型的机器人测试 oracle

Prasun Saurabh, Pablo Valle, Aitor Arrieta, Shaukat Ali, Paolo Arcaini

机构 * Simula Research Laboratory(Simula研究实验室) Oslo Metropolitan University(奥斯陆理工大学) Mondragon University(蒙dragon大学) National Institute of Informatics(国立信息研究所)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 VISOR 提出基于视觉-语言模型的自动化测试 oracle 方法,解决机器人测试中任务正确性评估难题,通过两个模型在多个任务上验证,展现高召回率和高精确度,但不确定性与正确性相关性低。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.08454 2026-05-19 cs.RO 57%

Real2Sim via Active Perception with Behavior Trees Automatically Generated by VLMs

通过主动感知与行为树自动生成功能的Real2Sim

Alessandro Adami, Sebastian Zudaire, Ruggero Carli, Pietro Falco

机构 * University of Padova, Dept. of Information Engineering(帕多瓦大学信息工程系) ABB Robotics(ABB机器人)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.RO

AI总结 本文提出一种基于视觉语言模型的自主Real2Sim框架,通过分解语义任务,自动生成行为树以高效获取物理参数,实验证明其在效率和安全性上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.07152 2026-05-19 cs.CV 57%

Intuitive Surgical SurgToolLoc and SurgVU Challenges Results: 2022-2025

直观外科SurgToolLoc和SurgVU挑战结果:2022-2025

Aneeq Zia, Max Berniker, Rogerio Garcia Nespolo, Xiaorui Zhang, Conor Perreault, Kiran Bhattacharyya, Xi Liu, Ziheng Wang, Satoshi Kondo, Satoshi Kasai, Kousuke Hirasawa, Bo Liu, David Austin, Yiheng Wang, Michal Futrega, Jean-Francois Puget, Zhenqiang Li, Yoichi Sato, Ryo Fujii, Ryo Hachiuma, Mana Masuda, Hideo Saito, An Wang, Mengya Xu, Mobarakol Islam, Long Bai, Winnie Pang, Hongliang Ren, Chinedu Nwoye, Luca Sestini, Nicolas Padoy, Maximilian Nielsen, Samuel Schüttler, Thilo Sentker, Hümeyra Husseini, Ivo Baltruschat, Rüdiger Schmitz, René Werner, Aleksandr Matsun, Mugariya Farooq, Numan Saaed, Jose Renato Restom Viera, Mohammad Yaqub, Neil Getty, Fangfang Xia, Zixuan Zhao, Xiaotian Duan, Xing Yao, Ange Lou, Hao Yang, Jintong Han, Jack Noble, Jie Ying Wu, Tamer Abdulbaki Alshirbaji, Nour Aldeen Jalal, Herag Arabian, Ning Ding, Knut Moeller, Weiliang Chen, Quan He, Muhammad Bilal, Taofeek Akinosho, Adnan Qayyum, Massimo Caputo, Hunaid Vohra, Michael Loizou, Anuoluwapo Ajayi, Ilhem Berrou, Faatihah Niyi-Odumosu, Charlie Budd, Oluwatosin Alabi, Tom Vercauteren, Ruoxi Zhao, Ayberk Acar, John Han, Jumanh Atoum, Yinhong Qin, Surong Hua, Lu Ping, Wenming Wu, Rongfeng Wei, Jinlin Wu, You Pang, Zhen Chen, Tim Jaspers, Amine Yamlahi, Piotr Kalinowski, Dominik Michael, Tim Rädsch, Marco Hübner, Danail Stoyanov, Stefanie Speidel, Lena Maier-Hein, Jie Tian, Ruxin Zhang, Khang Hoang Nguyen, Anh Quoc Nguyen, Tam Minh Nguyen, Khoi Dinh Tran, Minh Nguyen Dang Nhat, Trinh Thi Doan Pham, Linh Van Nguyen, Chunyang Jiang, Dewei Yang, Haitao Li, Yannick Prudent, Thibaut Boissin, Mahmood Alam, Shazad Ashraf, Andrew D. Beggs, Lukman Akanbi, Manuel D. Delgado, Narain Gupta, Amir M. Hajiyavand, Iqbal Qasim, Hafiz A. Alaka, Junaid Qadir, Shu Yang, Yihui Wang, Hao Chen, Shin Paul, Yosuke Yamagishi, Zhang Dong, Hongyun Li, Hongyu Gu, Xiaoliu Ding, Xiaoyao Liu, Xingyu Zhao, Mariana Ribeiro, Tiago Jesus, André Ferreira, Guilherme Barbosa, João Carvalho, Leonardo Barroso, Nuno Gomes, Rafael Peixoto, Rodrigo Ralha, Victor Alves, Stephanie, Nattapat Ittikosil, Achita Chitrapan, Quan Huu Cap, Jiayuan Huang, Shreyas C Dhake, Sergi Kavtaradze, Mobarak I Hoque, Ka Young Kim, Su Yong Yun, Young Tae Kim, Hyeon Bae Kim, Seong Tae Kim, Zuxing Deng, Ling Li, Jieyu Zheng, Xiaojian Li, Anthony Jarc

机构 * Intuitive Surgical, Inc.(Intuitive Surgical公司) Muroran Institute of Technology(Muroran理工学院) Niigata University of Health and Welfare Fujita Health University(Niigata大学健康与福利大学 Fujita健康大学) NVIDIA, Inc.(NVIDIA公司) University of Tokyo(东京大学) Keio University(Keio大学) Shun Hing Institute of Advanced Engineering(Shun Hing先进工程研究所) NUS NUSRI SZ(新加坡大学 NUSRI SZ) University of Strasbourg IHU Strasbourg(斯特拉斯堡大学 IHU斯特拉斯堡) University Medical Center Hambrug-Eppendorf(汉堡-埃彭多夫大学医学中心)

专题命中 机器人数据与评测 :robotic(abstract);分类 cs.CV

AI总结 本文总结了2022-2025年间在机器人辅助手术中解决手术工具定位和手术视觉理解的挑战成果,探讨了相关机器学习问题的解决方法与贡献。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17911 2026-05-19 cs.CL 50%

A Pilot Benchmark for NL-to-FOL Translation in Planetary Exploration

行星探测中自然语言到一阶逻辑翻译的试点基准

Hayden Moore, Suman Saha, Mahfuza Farooque

机构 * Department of Computer Science and Engineering, College of Engineering, The Pennsylvania State University(计算机科学与工程系,工程学院,宾夕法尼亚州立大学)

专题命中 机器人数据与评测 :robotic(abstract)

AI总结 本文提出一个试点基准,用于在行星探测领域将自然语言转换为一阶逻辑,通过NASA PDS的实测文档构建数据集,并手动标注FOL表示,以支持语言理解和形式推理的交叉研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17656 2026-05-19 cs.HC 50%

MUIAnno: An Expert-Annotated Dataset and Evaluation Benchmark for Mobile UI Understanding

MUIAnno: 一个专家标注的数据集和评估基准用于移动UI理解

Athar Parvez, Muhammad Jawad Mufti, Muqaddas Gull, Omar Hammad

专题命中 机器人数据与评测 :navigation(abstract)

AI总结 本文提出MUIAnno,一个公开的专家标注数据集,用于移动UI理解,通过收集多个类别的应用,提供高质量的UI标注,支持未来研究。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他机器人 9 篇

2605.18482 2026-05-19 cs.RO 70%

Bidirectional Optical sensors for Actuation Tracking (BOAT) in soft lattice systems

用于软格栅系统的双向光学传感器(BOAT)用于驱动跟踪

Petr Trunin, Carolina Gay, Anderson Brazil Nardin, Trevor Exley, Diana Cafiso, Lucia Beccai

机构 * Soft BioRobotics and Perception Lab(软生物机器人与感知实验室) Istituto Italiano di Tecnologia (IIT)(意大利技术研究院) Genoa, Italy(意大利热那亚)

专题命中 其他机器人 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于椭球几何排列的双波导光学传感器(BOAT),用于监测软格栅结构的全局变形,特别是压缩和伸展,并通过实验验证了其在压力循环中的高重复性和可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17991 2026-05-19 cs.DC cs.RO 70%

CFTel: A Practical Architecture for Robust and Scalable Telerobotics with Cloud-Fog Automation

CFTel: 一种用于鲁棒且可扩展的远程机器人系统的实用架构

Thien Tran, Jonathan Kua, Minh Tran, Honghao Lyu, Thuong Hoang, Jiong Jin

机构 * Deakin University(德金大学) RMIT University(皇家墨尔本理工大学) Zhejiang University(浙江大学) Swinburne University of Technology(斯威本科技大学) University of Tasmania(塔斯马尼亚大学)

专题命中 其他机器人 :robotics(abstract);embodied AI(abstract);分类 cs.RO

AI总结 本文提出了一种基于云雾自动化架构的远程机器人系统CFTel,旨在解决传统云基远程机器人系统的延迟、可靠性、可扩展性和容错问题,通过分布式云-边缘-机器人计算架构实现确定性连接、连接智能和网络化计算,从而提升实时控制、可扩展性和自主性。

Comments 6 pages, 1 figure, accepted paper on the 23rd IEEE International Conference on Industrial Informatics (INDIN), July 12-15, 2025, Kunming, China

Journal ref 2025 IEEE 23rd International Conference on Industrial Informatics (INDIN), Kunming, China, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18257 2026-05-19 cs.CV cs.AI cs.CL 62%

CodeBind: Decoupled Representation Learning for Multimodal Alignment with Unified Compositional Codebook

CodeBind: 一种用于多模态对齐的解耦表示学习框架

Zeyu Chen, Jie Li, Kai Han

机构 * Visual AI Lab, The University of Hong Kong(视觉人工智能实验室,香港大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI、cs.CV

AI总结 CodeBind通过统一的组合代码本设计优化多模态表示空间,解决了传统方法在跨模态信息差异和数据稀缺导致的对齐空间不足问题,实现了多模态分类和检索任务中的最佳性能。

Comments ACL 2026 Findings; Project page: https://visual-ai.github.io/codebind

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29868 2026-05-19 cs.AI cs.LO 57%

Spatiotemporal Robustness of Temporal Logic Tasks using Multi-Objective Reasoning

基于多目标推理的时序逻辑任务时空鲁棒性

Oliver Schön, Lars Lindemann

机构 * Automatic Control Laboratory, ETH Zürich(自动化控制实验室,苏黎世联邦理工学院)

专题命中 其他机器人 :robotics(abstract);分类 cs.AI

AI总结 本文研究了通过多目标推理处理时序逻辑任务的时空鲁棒性,提出了一种新的时空鲁棒性定义,能够同时考虑空间和时间扰动,并展示了其在多智能体机器人、智慧城市和空中交通管制等交互系统中的应用。

Comments 30 pages, 6 figures, to be published at the 38th International Conference on Computer Aided Verification 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17477 2026-05-19 cs.RO 57%

Rapid Vibration Suppression and Trajectory Tracking of a Serial Manipulator with Multi-Flexible Links

多柔性连杆串联 manipulator 的快速振动抑制与轨迹跟踪

Chengyi Wang, Yilong Huang, Ji Wang

机构 * School of Aerospace Engineering, Xiamen University(厦门大学航空航天工程学院)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出了一种基于 backstepping 的输出反馈框架,用于快速抑制多连杆串联柔性 manipulator 的振动并实现末端跟踪,通过 DeepONet 近似实现实时部署和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22667 2026-05-19 cs.CV 57%

Monocular Open Vocabulary Occupancy Prediction for Indoor Scenes

单目开放词汇占用预测用于室内场景

Changqing Zhou, Yueru Luo, Han Zhang, Zeyu Jiang, Changhao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

专题命中 其他机器人 :embodied agent(abstract);分类 cs.CV

AI总结 该研究提出了一种基于几何的监督方法,用于单目开放词汇室内场景的占用预测,通过引入一种基于Poisson的透明度感知方法和逐步温度衰减调度,提高了几何和语义对齐的稳定性与精度,实验结果显示在Occ-ScanNet数据集上取得了较高的IoU和mIoU指标。

Comments Accepted at CVPR2026 Oral

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22849 2026-05-19 cs.CC cs.DM cs.LG cs.NE 57%

Parameterized Hardness of Zonotope Containment and Neural Network Verification

参数化的Zonotope包含与神经网络验证的难度

Vincent Froese, Moritz Grillo, Christoph Hertrich, Moritz Stargalla

机构 * Technische Universität Berlin(柏林技术大学) Max Planck Institute for Mathematics in the Sciences(马克斯·普朗克数学研究所) University of Technology Nuremberg(纽伦堡技术大学)

专题命中 其他机器人 :robotics(abstract);分类 cs.LG

AI总结 研究探讨了2层ReLU网络函数的正性判定问题,证明其在参数d下属于W[1]-难问题,并展示了Zonotope包含、Lp-Lipschitz常数近似等任务的计算复杂性,揭示了这些基础问题的最优解法。

Comments 20 pages, 5 figures, paper accepted at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.16522 2026-05-19 cs.RO cs.MA 57%

A Mechanistic Model for Collective Motion from Sensorimotor Regularities

从传感器运动规律出发的集体运动机制模型

Vito Mengers, Bao Duc Cao, Oliver Brock

机构 * Robotics and Biology Laboratory, Technische Universität Berlin, Germany(技术大学柏林机器人与生物学实验室,德国) Science of Intelligence, Research Cluster of Excellence, Berlin, Germany(智能科学,卓越研究集群,柏林,德国) Robotics Institute Germany(德国机器人研究所)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文提出基于机器人建模框架的集体运动机制模型,通过感知和动作的梯度下降实现群体行为,揭示了传感器运动规律在集体行为中的作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21841 2026-05-19 cs.CL 50%

Embodied Task Planning via Graph-Informed Action Generation with Large Language Models

通过大型语言模型的图引导动作生成进行具身任务规划

Xiang Li, Ning Yan, Masood Mortazavi

机构 * Purdue University(普渡大学) Futurewei Technologies(未来科技)

专题命中 其他机器人 :embodied agent(abstract)

AI总结 本文提出GiG框架,通过图神经网络编码环境状态并构建动作连接执行轨迹图,结合有限前瞻性模块提升具身代理的规划能力,在三个具身规划基准测试中取得显著性能提升。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏