arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-04-09 至 2026-04-09 共收录 58 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 14 篇

2509.16183 2026-04-09 eess.SP 50%

Xona Pulsar Compatibility with GNSS

Xona Pulsar 与 GNSS 的兼容性

Tyler G. R. Reid, Matteo Gala, Mathieu Favreau, Argyris Kriezis, Michael O'Meara, Andre Pant, Paul Tarantino, Christina Youn

专题命中 具身导航 :navigation(abstract)

AI总结 研究评估Xona Pulsar与GPS和伽利略系统的兼容性,通过分析C/N0退化验证其信号对现有GNSS的干扰影响,证明其在保持高精度的同时实现与现有系统的共存。

Comments 15 pages, 12 figures

Journal ref ION GNSS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 5 篇

2512.21714 2026-04-09 cs.CV 85%

AstraNav-World: World Model for Foresight Control and Consistency

AstraNav-World:面向前瞻性控制与一致性的世界模型

Jintao Chen, Junjun Hu, Haochen Bai, Minghua Luo, Xinda Xue, Botao Ren, Chengyu Bai, Shichao Xie, Ziyi Chen, Fei Liu, Zedong Chu, Xiaolong Wu, Mu Xu, Shanghang Zhang

机构 * Amap Alibaba(高德阿里巴巴)

专题命中 具身推理 :world model(title,abstract);embodied agent(abstract);navigation(abstract);分类 cs.CV

AI总结 本文提出AstraNav-World,通过统一的概率框架联合推理未来视觉状态与动作序列,提升开放动态环境中的导航轨迹精度与成功率,实验表明其在真实场景中具备零样本适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12088 2026-04-09 cs.AI cs.CL cs.LG 81%

One Life to Learn: Inferring Symbolic World Models for Stochastic Environments from Unguided Exploration

一次生命学习:从无指导探索中推断随机环境的符号世界模型

Zaid Khan, Archiki Prasad, Elias Stengel-Eskin, Jaemin Cho, Mohit Bansal

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) Allen Institute for AI(艾伦人工智能研究所) Johns Hopkins University(约翰霍普金斯大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 本文提出OneLife框架,通过条件激活的程序法则在概率编程框架中推断随机环境的动态,实现从无指导探索中学习复杂环境的动力学,优于基线方法。

Comments Accepted to ICLR 2026. Project page: https://onelife-worldmodel.github.io/; 44 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06882 2026-04-09 cs.RO cs.SY eess.SP eess.SY 79%

Telecom World Models: Unifying Digital Twins, Foundation Models, and Predictive Planning for 6G

电信世界模型:统一数字孪生、基础模型和预测规划用于6G

Hang Zou, Yuzhi Yang, Lina Bariah, Yu Tian, Yuhuan Lu, Bohao Wang, Anis Bara, Brahim Mefgouda, Hao Liu, Yiwei Tao, Sergy Petrov, Salma Cheour, Nassim Sehad, Sumudu Samarakoon, Chongwen Huang, Samson Lasaulce, Mehdi Bennis, Mérouane Debbah

机构 * Research Institute for Digital Future, Khalifa University(哈利法大学数字未来研究所) College of Information Science and Electronic Engineering, Zhejiang University(浙江大学信息与电子工程学院) University of Oulu(奥卢大学) Aalto University(阿尔托大学) Université de Lorraine, CNRS, CRAN(洛林大学,法国国家科学研究中心,CRAN)

专题命中 具身推理 :world model(title,abstract);分类 cs.RO

AI总结 本文提出电信世界模型(TWM),结合数字孪生与基础模型,解决6G网络中动态建模、不确定性处理和多层控制规划问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.03604 2026-04-09 cs.CV cs.AI 74%

A Lightweight Library for Energy-Based Joint-Embedding Predictive Architectures

一种轻量级的用于基于能量的联合嵌入预测架构库

Basile Terver, Randall Balestriero, Megi Dervishi, David Fan, Quentin Garrido, Tushar Nagarajan, Koustuv Sinha, Wancong Zhang, Mike Rabbat, Yann LeCun, Amir Bar

机构 * Meta FAIR INRIA(法国国家信息与自动化研究所) New York University(纽约大学)

专题命中 具身推理 :world model(abstract,comments);navigation(abstract);分类 cs.AI、cs.CV

AI总结 本文提出EB-JEPA库,展示如何将图像级自监督学习的表示学习技术扩展到视频和动作条件世界模型,通过实验验证其在任务中的有效性。

Comments v2: clarify confusion in definition of JEPAs vs. regularization-based JEPAs v3: Camera-ready of ICLR world models workshop, fixed formatting and ViT config / results

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06339 2026-04-09 cs.CV 57%

Evolution of Video Generative Foundations

视频生成基础的演变

Teng Hu, Jiangning Zhang, Hongrui Huang, Ran Yi, Zihan Su, Jieyu Weng, Zhucun Xue, Lizhuang Ma, Ming-Hsuan Yang, Dacheng Tao

专题命中 具身推理 :world model(abstract);分类 cs.CV

AI总结 本文综述了视频生成技术的发展,从早期GAN到扩散模型,再到AR和多模态技术,探讨了核心原理、关键进展及未来趋势,旨在为视频生成及其应用提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 模仿学习与强化学习 3 篇

2604.06943 2026-04-09 cs.RO 61%

Sustainable Transfer Learning for Adaptive Robot Skills

可持续的迁移学习用于适应性机器人技能

Khalil Abuibaid, Vinit Hegiste, Nigora Gafur, Achim Wagner, Martin Ruskowski

机构 * Chair of Machine Tools and Control System, RPTU University Kaiserslautern-Landau(机床与控制系统教席,莱茵兰-普法尔茨凯泽斯劳滕-兰道大学) Innovative Factory Systems, German Institute of Artificial Intelligence(创新工厂系统,德国人工智能研究所)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO;robotics(journal_ref)

AI总结 本文研究了不同机器人平台间的策略迁移,通过强化学习完成peg-in-hole任务,探讨零样本迁移、微调和从头训练的效果,发现微调能显著提升性能,降低训练时间,支持可持续的机器人学习。

Comments Published in RAAD 2025 (Springer). 7 pages, 5 figures

Journal ref Advances in Service and Industrial Robotics, RAAD 2025, Springer, 2025, pp. 389-397

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06949 2026-04-09 cs.RO 57%

Learning-Based Strategy for Composite Robot Assembly Skill Adaptation

基于学习的复合机器人装配技能适应策略

Khalil Abuibaid, Aleksandr Sidorenko, Achim Wagner, Martin Ruskowski

机构 * Chair of Machine Tools and Control System, RPTU University Kaiserslautern-Landau(机床与控制系统系,凯撒斯劳滕-兰道大学) Innovative Factory Systems, German Institute of Artificial Intelligence(创新工厂系统,德国人工智能研究中心)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO

AI总结 本文提出一种基于残差强化学习的复合机器人装配技能适应方法,通过显式预置、后置和不变条件实现模块化和可重用性,提升工业机器人在接触密集任务中的安全性和样本效率。

Comments Accepted at RAAD 2026 (Springer). 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06268 2026-04-09 cs.LG 57%

RAGEN-2: Reasoning Collapse in Agentic RL

RAGEN-2:代理强化学习中的推理崩溃

Zihan Wang, Chi Gui, Xing Jin, Qineng Wang, Licheng Liu, Kangrui Wang, Shiqi Chen, Linjie Li, Zhengyuan Yang, Pingyue Zhang, Yiping Lu, Jiajun Wu, Li Fei-Fei, Lijuan Wang, Yejin Choi, Manling Li

机构 * Northwestern University(西北大学) UIUC(伊利诺伊大学厄巴纳-香槟分校) Independent(独立研究者) Imperial College London(伦敦帝国学院) Oxford University(牛津大学) University of Washington(华盛顿大学) Microsoft(微软) Stanford University(斯坦福大学)

专题命中 模仿学习与强化学习 :navigation(abstract);分类 cs.LG

AI总结 研究发现代理强化学习中推理稳定性受模板崩溃影响,通过引入互信息代理提升推理质量与任务表现。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 人机交互与遥操作 4 篇

2503.20237 2026-04-09 cs.RO cs.SY eess.SY 74%

A Virtual Fencing Framework for Safe and Efficient Collaborative Robotics

一种安全高效的协作机器人虚拟围栏框架

Vineela Reddy Pippera Badguna, Aliasghar Arab, Durga Avinash Kodavalla

机构 * New York University(纽约大学)

专题命中 人机交互与遥操作 :robotics(title);分类 cs.RO

AI总结 本文提出一种虚拟围栏框架,通过检测和预测人体运动来确保协作机器人安全运行,采用优化问题模型解决安全与性能的权衡,实验验证其在保持安全的同时减少操作暂停。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06932 2026-04-09 cs.RO 57%

Towards Multi-Object Nonprehensile Transportation via Shared Teleoperation: A Framework Based on Virtual Object Model Predictive Control

通过共享遥控实现多物体非抓取运输:基于虚拟物体模型预测控制的框架

Xinyang Fan, Zhaoyang Chen, Shu Xin, Yi Ren, Zainan Jiang, Fenglei Ni, Hong Liu

机构 * State Key Laboratory of Robotics and System, Harbin Institute of Technology(哈尔滨工业大学机器人技术与系统国家重点实验室) Advanced Manufacturing Laboratory, Huawei Technologies(华为技术有限公司先进制造实验室)

专题命中 人机交互与遥操作 :manipulation(abstract);分类 cs.RO

AI总结 本文提出一种基于虚拟物体模型预测控制的共享遥控框架,解决多物体非抓取运输中的轨迹跟踪和托盘姿态控制问题,通过动态约束分析和轨迹平滑算法实现稳定操作。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16548 2026-04-09 cs.HC cs.RO 57%

SemanticScanpath: Combining Gaze and Speech for Situated Human-Robot Interaction Using LLMs

语义扫描路径:利用语言模型结合目光和语音实现情境化的人机交互

Elisabeth Menendez, Michael Gienger, Santiago Martínez, Carlos Balaguer, Anna Belardinelli

机构 * Universidad Carlos III de Madrid (UC3M)(马德里卡洛斯三世大学) Honda Research Institute Europe(本田欧洲研究所)

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO

AI总结 本文提出结合语音和目光的语义扫描路径表示,使语言模型能更准确地理解情境,解决模糊请求。通过文本语义翻译用户扫描路径和语音请求,验证了系统在多个任务和场景中的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16055 2026-04-09 cs.RO cs.SY eess.SY 57%

Proactive Hierarchical Control Barrier Function-Based Safety Prioritization in Close Human-Robot Interaction Scenarios

主动式分层控制屏障函数基安全优先级在近距离人机交互场景中的应用

Patanjali Maithani, Aliasghar Arab, Farshad Khorrami, Prashanth Krishnamurthy

专题命中 人机交互与遥操作 :robotic(abstract);分类 cs.RO

AI总结 本文提出基于控制屏障函数的分层框架,用于在近距离人机交互中主动管理碰撞风险,通过实时安全约束优先级调整和深度感知实现安全协作。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人数据与评测 8 篇

2506.05171 2026-04-09 eess.SY cs.AI cs.SY 83%

Towards provable probabilistic safety for scalable embodied AI systems

迈向可证明的可扩展具身AI系统的概率安全

Linxuan He, Lingxiang Fan, Qing-Shan Jia, Ang Li, Hongyan Sang, Ling Wang, Guanghui Wen, Jiwen Lu, Tao Zhang, Jie Zhou, Yi Zhang, Yisen Wang, Peng Wei, Zhongyuan Wang, Henry X. Liu, Shuo Feng

机构 * Department of Automation, Tsinghua University(清华大学自动化系) Beijing Academy of Artificial Intelligence(北京人工智能研究院) School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) School of Computer, Liaocheng University(聊城大学计算机学院) Department of Automation, Southeast University(东南大学自动化学院) Department of Mechanical and Aerospace Engineering, George Washington University(乔治华盛顿大学机械与航空航天工程系) University of Michigan Transportation Research Institute(密歇根大学交通研究所) Department of Civil and Environmental Engineering, University of Michigan(密歇根大学土木与环境工程系)

专题命中 机器人数据与评测 :embodied AI(title,abstract);robotics(abstract);分类 cs.AI

AI总结 本文提出可证明的概率安全范式,旨在解决具身AI系统在复杂环境中安全验证的挑战,通过结合可证明保证与渐进式达成概率安全边界,提升系统可行性和可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16005 2026-04-09 cs.RO cs.AI 81%

ODYN: An All-Shifted Non-Interior-Point Method for Quadratic Programming in Robotics and AI

ODYN:一种用于机器人和人工智能中二次规划的全位移非内点法

Jose Rojas, Aristotelis Papatheodorou, Sergi Martinez, Andrea Patrizi, Ioannis Havoutis, Carlos Mastalli

机构 * Heriot-Watt University(赫瑞瓦特大学) University of Oxford(牛津大学) Italian Institute of Technology(意大利技术研究院)

专题命中 机器人数据与评测 :robotics(title,abstract);分类 cs.RO、cs.AI

AI总结 ODYN是一种全新的全位移对偶非内点二次规划求解器,能高效处理密集和稀疏二次规划问题,通过结合全位移非线性互补问题函数与近端乘子法,解决病态和退化问题,具备强大的热启动性能,适用于通用优化及机器人和人工智能应用。

Comments 20 pages, 12 figures, under-review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06228 2026-04-09 cs.LG cs.AI cs.CL cs.DS cs.IR cs.IT math.IT 73%

Probabilistic Language Tries: A Unified Framework for Compression, Decision Policies, and Execution Reuse

概率语言树:压缩、决策策略和执行重用的统一框架

Gregory Magarshak

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.AI、cs.LG

AI总结 本文提出概率语言树(PLTs),通过显式表示生成模型隐含定义的前缀结构,实现最优无损压缩、序列决策问题的策略表示以及记忆化索引。核心成果是指导缓存定理,证明PLT缓存在查询次数低于阈值时具有更低的预期推理成本。

Comments 24 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06505 2026-04-09 cs.CL cs.AI 57%

MedConclusion: A Benchmark for Biomedical Conclusion Generation from Structured Abstracts

MedConclusion:一个用于从结构化摘要中生成生物医学结论的基准数据集

Weiyue Li, Ruizhi Qian, Yi Li, Yongce Li, Yunfan Long, Jiahui Cai, Yan Luo, Mengyu Wang

机构 * Harvard AI and Robotics Lab, Harvard Medical School(哈佛大学医学院哈佛人工智能与机器人实验室) University of Southern California(南加州大学) Carnegie Mellon University(卡内基梅隆大学) Stanford University(斯坦福大学) Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University(哈佛大学肯普纳自然与人工智能研究所)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.AI

AI总结 本文提出MedConclusion数据集,包含570万篇PubMed结构化摘要,用于生物医学结论生成。通过配对摘要非结论部分与原始结论,提供证据到结论推理的自然监督。数据集还包含期刊级元数据,支持跨生物医学领域的子组分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04911 2026-04-09 cs.CV 57%

SpatialEdit: Benchmarking Fine-Grained Image Spatial Editing

SpatialEdit:细粒度图像空间编辑基准测试

Yicheng Xiao, Wenhu Zhang, Lin Song, Yukang Chen, Wenbo Li, Nan Jiang, Tianhe Ren, Haokun Lin, Wei Huang, Haoyang Huang, Xiu Li, Nan Duan, Xiaojuan Qi

机构 * The University of Hong Kong(香港大学) JD Explore Academy(京东探索研究院) Tsinghua University(清华大学) The Hong Kong University of Science and Technology(香港科技大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 机器人数据与评测 :manipulation(abstract);分类 cs.CV

AI总结 本文提出SpatialEdit-Bench基准测试,结合视角重建和框架分析评估空间编辑的感知合理性和几何精度,并构建了SpatialEdit-500k合成数据集和SpatialEdit-16B基线模型,实现细粒度空间编辑的高效训练与评估。

Comments Code: https://github.com/EasonXiao-888/SpatialEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18100 2026-04-09 cs.CV 57%

Spatial-Conditioned Reasoning in Long-Egocentric Videos

长时自体视频中的空间条件推理

James Tribble, Hao Wang, Si-En Hong, Chaoyi Zhou, Ashish Bastola, Siyu Huang, Abolfazl Razi

机构 * Clemson University(克莱姆森大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文研究了在不修改模型架构的情况下,显式空间信号如何影响基于VLM的视频理解,通过引入Sanpo-D数据集和评估多个VLM在导航导向的空间查询上的表现,发现深度感知和空间化表示能提升安全关键任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2008.01574 2026-04-09 cs.CV 57%

A Robust 3D Registration Method via Simultaneous Inlier Identification and Model Estimation

一种通过同时识别内点和模型估计的鲁棒3D配准方法

Xianyun Qian, Fei Wen, Peilin Liu

机构 * School of Information Science and Electronic Engineering / School of Integrated Circuits, Shanghai Jiao Tong University(上海交通大学电子信息与电气工程学院/集成电路学院)

专题命中 机器人数据与评测 :robotics(abstract);分类 cs.CV

AI总结 本文提出了一种基于截断损失的鲁棒3D配准方法,通过同时识别内点和模型估计,降低拟合残差,采用交替最小化算法和半正定松弛方法提升鲁棒性,实验显示在高噪声和多异常情况下性能优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01133 2026-04-09 eess.SY cs.SY 50%

A Neuromodulable Current-Mode Silicon Neuron for Robust and Adaptive Neuromorphic Systems

一种可调节的电流模式硅神经元用于鲁棒和自适应的神经形态系统

Loris Mendolia, Chenxi Wen, Elisabetta Chicca, Giacomo Indiveri, Rodolphe Sepulchre, Jean-Michel Redouté, Alessio Franci

专题命中 机器人数据与评测 :robotics(abstract)

AI总结 本文提出了一种新型电流模式神经元设计,通过最小化模型复杂度实现鲁棒的神经调节,适用于标准CMOS技术,实验验证其在多种参数下的生物合理调节能力。

Comments 23 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他机器人 7 篇

2604.07038 2026-04-09 cs.RO q-bio.NC 83%

Exploring the proprioceptive potential of joint receptors using a biomimetic robotic joint

利用仿生机器人关节探索关节受体的本体感觉潜力

Akihiro Miki, Shun Hasegawa, Sota Yuzaki, Yuta Sahara, Yoshimoto Ribayashi, Kento Kawaharazuka, Kei Okada

机构 * the University of Tokyo(东京大学)

专题命中 其他机器人 :robotic(title,abstract);robotics(abstract);分类 cs.RO

AI总结 研究通过仿生机器人关节量化了Type I类关节受体的本体感觉潜力,发现其在弯曲和扭转运动中误差小于2度,提示关节受体在本体感觉中可能比传统认知更为重要。

Comments 26 pages including supplementary materials (17 pages main text), 6 main figures and 7 supplementary figures. Published in Scientific Reports

Journal ref Scientific Reports, 16, Article number: 4724 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06722 2026-04-09 cs.CY cs.RO 83%

Infrastructure First: Enabling Embodied AI for Science in the Global South

基础设施优先:为全球南方科学赋能具身AI

Shaoshan Liu, Jie Tang, Marwa S. Hassan, Mohamed H. Sharkawy, Moustafa M. G. Fouda, Tiewei Shang, Zixin Wang

机构 * Shenzhen Institute of Artificial Intelligence and Robotics for Society (AIRS)(深圳市人工智能与机器人研究院(AIRS)) South China University of Technology(华南理工大学) National Research Centre (NRC)(国家研究中心(NRC)) British University in Egypt (BUE)(埃及英国大学(BUE)) National Institute of Clean-and-Low-Carbon Energy(国家清洁低碳能源研究所)

专题命中 其他机器人 :embodied AI(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文探讨了通过具身AI赋能科学的基础设施优先方法,强调在人力、电力和网络受限的全球南方地区,通过可靠边缘计算、能效硬件和开放标准等基础设施提升科学能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02996 2026-04-09 cs.CV 57%

Rendering Multi-Human and Multi-Object with 3D Gaussian Splatting

多人类和多物体的3D高斯散射渲染

Weiquan Wang, Jun Xiao, Feifei Shao, Yi Yang, Yueting Zhuang, Long Chen

机构 * State Key Lab of CAD&CG, College of Computer Science, Zhejiang University(浙江大学计算机科学与技术学院计算机辅助设计与图形学国家重点实验室) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology(香港科技大学计算机科学与工程系)

专题命中 其他机器人 :robotics(abstract);分类 cs.CV

AI总结 本文提出MM-GS框架,通过实例级多视图融合和场景级实例交互模块,解决多人类和多物体动态场景重建中的视图一致性与复杂依赖建模问题,实现高保真渲染。

Comments 8 pages, 4 figures, accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02387 2026-04-09 cs.RO 57%

A Dynamic Toolkit for Transmission Characteristics of Precision Reducers with Explicit Contact Geometry

一种具有显式接触几何的精密减速器传动特性动态工具包

Jiacheng Miao, Chao Liu, Qiliang Wang, Yunhui Guan, Weidong He

机构 * Intelligent Equipment Division, CRRC Qishuyan Institute Co., Ltd(中车戚墅堰机车车辆工艺研究所有限公司智能装备事业部) School of Mechanical Engineering, Dalian Jiaotong University(大连交通大学机械工程学院)

专题命中 其他机器人 :robotic(abstract);分类 cs.RO

AI总结 本文提出一种动态工具包,用于分析具有显式接触几何的精密减速器传动特性,通过统一框架解决接触行为建模、齿轮刚度评估和系统振动预测的挑战,提升精度和计算效率。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20886 2026-04-09 cs.CV 57%

V$^{2}$-SAM: Marrying SAM2 with Multi-Prompt Experts for Cross-View Object Correspondence

V$^{2}$-SAM:融合SAM2与多提示专家以实现跨视角物体对应

Jiancheng Pan, Runze Wang, Tianwen Qian, Mohammad Mahdi, Yanwei Fu, Xiangyang Xue, Xiaomeng Huang, Luc Van Gool, Danda Pani Paudel, Yuqian Fu

机构 * INSAIT, Sofia University “St. Kliment Ohridski”(INSAIT,索非亚大学) Tsinghua University(清华大学) Fudan University(复旦大学) East China Normal University(华东师范大学)

专题命中 其他机器人 :robotic(abstract);分类 cs.CV

AI总结 本文提出V2-SAM框架,通过两个互补的提示生成器将SAM2从单视角分割适应到跨视角对应,引入多专家设计和PCCS选择器,实现跨视角物体一致性的新方法。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08019 2026-04-09 cs.RO cs.SY eess.SY 57%

Model Predictive Control via Probabilistic Inference: A Tutorial and Survey

基于概率推断的模型预测控制:教程与综述

Kohei Honda

机构 * Nagoya University(名古屋大学) CyberAgent AI Lab(CyberAgent AI实验室)

专题命中 其他机器人 :robotics(abstract);分类 cs.RO

AI总结 本文综述了基于概率推断的模型预测控制(PI-MPC),介绍了其通过变分推断生成动作的方法,并探讨了该方法在机器人及其他控制应用中的理论与实践意义。

Comments 41 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06813 2026-04-09 cs.MA 50%

Event-Triggered Adaptive Consensus for Multi-Robot Task Allocation

基于事件触发的多机器人任务分配自适应一致性

Fidel Aznar, Mar Pujol, Álvaro Díez

专题命中 其他机器人 :robotic(abstract)

AI总结 本文提出一种基于事件触发的自适应一致性框架,用于在动态和通信受限环境中实现高效适应性任务分配。通过自适应一致性机制和行为树架构,减少通信开销并提升系统效率和鲁棒性。

Comments 40 pages, 18 figures. Published in Computer Communications under CC-BY license

Journal ref Computer Communications, Volume 251, 2026, 108499

详情

展开后加载摘要…

URL PDF HTML 收藏