arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-15 至 2026-07-15 共收录 66 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 具身导航 16 篇

2607.12801 2026-07-15 cs.RO cs.AI cs.SY eess.SY 新提交 62%

Autonomous Tracking and Terminal Guidance of Moving Targets for Fixed-Wing UAVs

固定翼无人机移动目标的自主跟踪与终端制导

Wei-Hao Liou, Teng-Hu Cheng

机构 * Department of Mechanical Engineering, National Yang Ming Chiao Tung University(国立阳明交通大学机械工程学系)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究为固定翼无人机引入统一控制框架,采用三相策略,利用UKF融合视觉检测与惯性测量,结合带约束感知的NMPC及BPNG律,实现从目标检测到终端拦截的任务,仿真验证其能稳定跟踪并精确拦截,同时遵守相关约束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.19186 2026-07-15 cs.RO cs.AI cs.FL 版本更新 62%

Real-Time Model Checking for Closed-Loop Robot Reactive Planning

闭环机器人反应式规划的实时模型检查

Christopher Chandler, Bernd Porr, Giulia Lafratta, Alice Miller

机构 * School of Computing Science University of Glasgow Glasgow Scotland UK(计算科学学院格拉斯哥大学格拉斯哥苏格兰英国) School of Biomedical Engineering University of Glasgow Glasgow Scotland UK(生物医学工程学院格拉斯哥大学格拉斯哥苏格兰英国) University of Glasgow(格拉斯哥大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究利用模型检查让自主机器人实现反应式多步规划与避障,特制算法基于生物知识实时原位生成规划,通过链式系统和临时快照减轻状态空间爆炸,实验证明方法有效且性能提升,为自动驾驶导航发展提供案例,适用于关键任务移动机器人。

Comments 41 pages excluding references, 21 figures, submitted to Formal Aspects of Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.21245 2026-07-15 cs.RO cs.LG 版本更新 62%

Diffusion Denoiser-Aided Gyrocompassing

扩散去噪器辅助的陀螺罗经法

Gershy Ben-Arie, Daniel Engelsman, Rotem Dror, Itzik Klein

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 针对低成本陀螺仪准确及时陀螺罗经法的挑战,提出扩散去噪器辅助的陀螺罗经法,集成扩散去噪框架与航向估计模型,处理原始传感器信号,实验证明相比其他方法显著提高了陀螺罗经精度,对自主平台导航意义重大。

Comments 8 pages, 8 figures

Journal ref Measurement, Measurement, Volume 287, 2026, Article 122370

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12110 2026-07-15 cs.CV 新提交 57%

ACZ-GSeg: Adaptive Concentric Zone-based Two-stage Ground Segmentation for LiDAR Point Clouds

ACZ-GSeg:基于自适应同心区域的激光雷达点云两阶段地面分割

Ge Zhang Chunyang Wang Bin Liu

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 针对复杂道路场景中地面分割难题,提出基于自适应同心区域模型的两阶段地面分割方法,构建模型确定扇区数量,粗、细分割阶段分别采用不同约束提取和细化地面点,实验证明该方法能适应点云分布特征,提高分割稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14181 2026-07-15 eess.SP 版本更新 50%

Magnetic-Field-Based Localization Using Spatial Field Variations: Signal Processing Principles, Models, and Challenges

基于磁场的空间变化的定位:信号处理原理、模型与挑战

Isaac Skog, Manon Kok, Christophe Prieur, Gustaf Hendeby

专题命中 具身导航 :navigation(abstract)

AI总结 本文探讨了利用地球磁场空间变化进行定位的研究问题,介绍了信号处理原理、模型及面临的挑战,旨在从统计信号处理的角度理解现有关键技术的异同。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17143 2026-07-15 eess.SP physics.ao-ph physics.space-ph 版本更新 50%

Assessing Ionospheric Scintillation Risk for Direct-to-Cellular Satellite Communications using Frequency-Scaled GNSS Observations

基于频率缩放的GNSS观测评估直连蜂窝通信的电离层闪烁风险

Abdollah Masoud Darya, Muhammad Mubasshir Shaikh

专题命中 具身导航 :navigation(abstract)

AI总结 本文通过频率缩放GNSS观测研究D2C通信的电离层闪烁风险,发现低频段闪烁更频繁,高D2C频段更具鲁棒性,为系统设计和缓解策略提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身推理 4 篇

2510.18315 2026-07-15 cs.LG cs.AI 版本更新 81%

Higher Embedding Dimension Creates a Stronger World Model for a Simple Sorting Task

更高的嵌入维度为简单排序任务创建更强的世界模型

Brady Bhalla, Honglu Fan, Nancy Chen, Tony Yue YU

机构 * California Institute of Technology(加利福尼亚理工学院) Google DeepMind(谷歌DeepMind) Cornell University(康奈尔大学)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 研究在强化学习训练的变压器中嵌入维度对内部“世界模型”的影响,发现更高维度能产生更好的内部表示,经数百实验观察到两种机制,结果证明变压器构建结构化内部世界模型且模型大小可提升表示质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11673 2026-07-15 cs.CV 版本更新 79%

ABot-3DWorld 0: A Universal World Model to Explore Any 3D Space

ABot-3DWorld 0:一个用于探索任意 3D 空间的通用世界模型

Mingchao Sun, Luyang Tang, Yu Liu, Xu Yan, Zhan Li, Yunwei Zhang, Fei Yu, Zengye Ge, Yumin Liu, Jiacheng Zhang, Yongchang Zhang, Jiawei Zhang, Zhicheng Liu, Zhongxu Sun, Tianjian Ouyang, Wenzheng Chen, Shixing Yang, Nianfei Fan, Guodong Sun, Huan Li, Zheng Zhou, Yongze Li, Yingliang Peng, Mengmeng Du, Yuan Liu, Haozhe Shi, Chunnuo Gong, Chengzhen Yu, Chunxue Jia, Yang Liu, Shiying Zeng, Junnan Lai, Hang Zhang, Ning Guo, Baoquan Chen, Mu Xu, Hongyu Pan

专题命中 具身推理 :world model(title,abstract);分类 cs.CV

AI总结 介绍 ABot-3DWorld 0 通用多模态 3D 世界模型,核心是 SGP,通过特定流程将多模态输入转换为 3D 世界,用于通用 3D 内容创建,在开源方法中领先,多模态输入下场景保真度更高。

Comments Official Page: https://abot-world.amap.com/plaza

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12894 2026-07-15 cs.CV 新提交 57%

Hy-Embodied-VLM-1.0: Efficient Physical-World Agents

Hy-Embodied-VLM-1.0:高效的物理世界智能体

Ziyi Wang, Xumin Yu, Yongming Rao, Yonggen Ling, Yunheng Li, Oran Wang, Mingqi Gao, Yuchen Zhou, Yves Liang, Zuyan Liu, Yani Zhang, Rui Huang, Xiaoran Xu, Bowen Yuan, Yifu Yuan, Xu Tan, He Zhang, Yufei Huang, Shenghao Zhang, Hongsheng Wu, Han Hu, Zhengyou Zhang

机构 * Tencent Robotics X(腾讯Robotics X团队) Hy Vision Team(腾讯混元视觉团队) Futian Laboratory(福田实验室)

专题命中 具身推理 :embodied agent(abstract);分类 cs.CV

AI总结 研究旨在构建物理世界具身智能体,介绍Hy-Embodied-VLM-1.0模型。定义以行动为中心的能力分类法,开发数据管道。基于特定主干和编码器构建模型,用专家混合架构提升效率。在多基准测试中性能出色,较上一代有显著提升,在具身智能任务中也表现强大。

Comments Tech Report. Code and models are open-sourced at https://github.com/Tencent-Hunyuan/HY-Embodied

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11964 2026-07-15 cs.LG 新提交 57%

LIDAR-AD: A Decoder-Free Latent-Interaction Dreamer with Action-Residual Chains for Autonomous Driving

LIDAR-AD:一种用于自动驾驶的无解码器潜在交互梦想家与动作残差链

Yongzhi Liu, Yang Xiao, Zhong Cao, Zeng Kang, Sunan Zhang, Zhaozhi Dong, Guojun Yu, Weichao Zhuang

机构 * School of Mechanical Engineering, Southeast University(东南大学机械工程学院) Department of Civil and Environmental Engineering, University of Michigan(密歇根大学土木与环境工程系) Xheart Technology Co., Ltd.(芯驰科技有限公司)

专题命中 具身推理 :world model(abstract);分类 cs.LG

AI总结 研究针对自动驾驶中多源观测冗余问题,提出LIDAR-AD,用减少冗余的潜在对齐取代观测重建,将车辆控制建模为残差动作更新,经实验验证其在模拟场景和现实布局下性能优异,能提升风险感知等能力。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 机器人基础模型 4 篇

2607.13017 2026-07-15 cs.RO cs.CV 新提交 73%

FlowWAM: Optical Flow as a Unified Action Representation for World Action Models

FlowWAM:光流作为世界动作模型的统一动作表示

Yixiang Chen, Peiyan Li, Yuan Xu, Qisen Ma, Jiabing Yang, Kai Wang, Jianhua Yang, Dong An, He Guan, Gaoteng Liu, Jianlou Si, Jun Huang, Jing Liu, Nianfeng Liu, Yan Huang, Liang Wang

机构 * New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) FiveAges(无) MBZUAI(无) Alibaba Group(阿里巴巴集团)

专题命中 机器人基础模型 :manipulation(abstract);world model(abstract);分类 cs.RO、cs.CV

AI总结 研究针对世界动作模型控制中动作表示难题,提出FlowWAM双流扩散框架,以光流为统一动作表示。该框架可实现WAMs两种模式,能利用无动作标签视频预训练,实验表明在操纵和世界建模任务中表现优于基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12931 2026-07-15 cs.RO 新提交 70%

ExToken: Structured Exploration for Efficient Vision-Language-Action Reinforcement Fine-tuning

ExToken:用于高效视觉-语言-动作强化微调的结构化探索

Yilun Kong, Yunpeng Qing, Guozheng Ma, Haoyu Wang, Li Shen, Zhi Hou, Dacheng Tao

机构 * Nanyang Technological University(南洋理工大学) ACE Robotics(ACE机器人公司) Zhejiang University(浙江大学)

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究VLA模型强化学习中探索停滞问题,提出ExToken框架,基于离线演示导出的离散行为先验调整VLA策略进行结构化探索,通过不同令牌鼓励多样行为模式,提升了探索效率与任务性能,在多任务实验中表现良好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12287 2026-07-15 cs.RO 新提交 70%

Reducing Temporal Redundancy for Efficient Vision-Language-Action Inference

减少时间冗余以实现高效视觉-语言-动作推理

Yuzhou Wu, Yuxin Zheng, Muchun Niu, Yishan Yang, Tianhao Liu, hanwen kang, Jiajian Jing, Linfeng Zhang, Chuan Wen

专题命中 机器人基础模型 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对VLA模型推理延迟高的问题,识别出时间冗余来源,提出系统级加速策略,在感知和动作生成上减少计算,经实验验证该策略能加速超2倍且保持高性能。

Comments 13pages, 7 figuers

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12571 2026-07-15 cs.RO 新提交 57%

TrustVLA: Mechanism-Guided Inference-Time Defense Against Vision-Language-Action Backdoors

TrustVLA:针对视觉-语言-动作后门的机制引导推理时防御

Pinhan Fu, Xianda Guo, Xuetao Li, Wenke Huang, Ruilin Wang, Weiheng Zhao, Wei Sui, Mang Ye

机构 * School of Computer Science, Wuhan University(武汉大学计算机科学学院) D-Robotics(D-机器人公司) HUST(华中科技大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

专题命中 机器人基础模型 :robot policy(abstract);分类 cs.RO

AI总结 研究视觉-语言-动作模型中毒后门问题,通过两种攻击识别出紧凑因果足迹机制,基于此提出TrustVLA防御,能检测异常证据演变、定位支持并恢复观测,在多评估中降低攻击成功率且保持干净任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 模仿学习与强化学习 3 篇

2607.13033 2026-07-15 cs.RO 新提交 89%

DenseReward: Dense Reward Learning via Failure Synthesis for Robotic Manipulation

DenseReward:通过失败合成进行密集奖励学习以实现机器人操作

Yu Fang, Wanxi Dong, Jiaqi Liu, Yue Yang, Mingxiao Huo, Yao Mu, Huaxiu Yao, Li Erran Li, Daniel Szafir, Mingyu Ding

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Carnegie Mellon University(卡内基梅隆大学) Shanghai Jiao Tong University(上海交通大学) Amazon AWS AI(亚马逊AWS人工智能)

专题命中 模仿学习与强化学习 :manipulation(title,abstract);robotic(title,abstract);robot learning(abstract);分类 cs.RO

AI总结 研究针对强化学习中缺乏可靠奖励模型的问题,提出DenseReward模型,通过自动生成失败数据合成逼真轨迹,从视觉和语言预测密集奖励分数,在模拟和现实操作中表现优异,还为下游任务提供指导并发布相关资源。

Comments Website: https://dense-reward.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12784 2026-07-15 cs.RO cs.LG 新提交 62%

Directional Constraints for Efficient Exploration in Safe Reinforcement Learning

安全强化学习中高效探索的方向约束

Paolo Magliano, Puze Liu, Jan Peters, Davide Tateo, Raffaello Camoriano

机构 * Dipartimento di Automatica e Informatica, Politecnico di Torino(自动控制与信息工程系,都灵理工大学) Tongji University, Shanghai Research Institute for Intelligent Autonomous Systems(同济大学,上海智能自主系统研究院) German Research Center for AI (DFKI)(德国人工智能研究中心(DFKI)) Intelligent Autonomous Systems Group, TU Darmstadt(智能自主系统组,达姆施塔特工业大学) Lund University(隆德大学) Istituto Italiano di Tecnologia(意大利技术研究院)

专题命中 模仿学习与强化学习 :robotic(abstract);分类 cs.RO、cs.LG

AI总结 针对安全强化学习中约束学习降低速度和性能的问题,提出扩展ATACOM框架的ATACOM-DC方法,通过引入方向约束区分动作,改善安全与性能权衡,在模拟机器人控制任务中评估,分析约束违反成本和任务性能。

Comments This paper has been accepted for publication at the IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Pittsburgh, USA, 2026. 8 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12963 2026-07-15 cs.AI 版本更新 57%

Calculating Mutual Information between a Reward Maximizer and its Environment

信息论视角下最优奖励最大化世界模型的分析

Alfred Harwood, Jose Faustino, Alex Altair

机构 * Dovetail Research(Dovetail研究公司) University of Sao Paulo(圣保罗大学)

专题命中 模仿学习与强化学习 :world model(abstract);分类 cs.AI

AI总结 本文从信息论角度分析了最优奖励最大化中世界模型的信息量,证明最优策略对环境的信息量为n log m比特,并适用于多种奖励最大化目标。

详情

展开后加载摘要…

URL PDF HTML 收藏

5. 机器人数据与评测 12 篇

2603.08862 2026-07-15 cs.RO cs.LG 版本更新 79%

APPLV: Adaptive Planner Parameter Learning from Vision-Language-Action Model

APPLV: 从视觉-语言-动作模型中自适应学习规划器参数

Yuanjie Lu, Beichen Wang, Zhengqi Wu, Yang Li, Xiaomin Lin, Chengzhi Mao, Xuesu Xiao

机构 * Department of Computer Science, George Mason University(计算机科学系,乔治·马歇尔大学) Department of Engineering Science, University of South Florida(工程科学系,佛罗里达州立大学) Department of Computer Science, Rutgers University(计算机科学系,罗格斯大学)

专题命中 机器人数据与评测 :navigation(abstract,abstract_cn);robot learning(abstract);分类 cs.RO、cs.LG

AI总结 本文提出APPLV,通过从视觉-语言-动作模型中自适应学习规划器参数,提升移动机器人在受限环境中的导航性能与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08503 2026-07-15 cs.CV cs.GR cs.RO eess.IV 版本更新 73%

Spherical-GOF: Geometry-Aware Panoramic Gaussian Opacity Fields for 3D Scene Reconstruction

球面-GOF:面向3D场景重建的几何感知全景高斯不透明场

Zhe Yang, Guoqiang Zhao, Sheng Wu, Kai Luo, Kailun Yang

机构 * School of Artificial Intelligence and Robotics, Hunan University(人工智能与机器人学院,湖南大学) National Engineering Research Center of Robot Visual Perception and Control Technology, Hunan University(机器人视觉感知与控制技术国家工程研究中心,湖南大学)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 Spherical-GOF通过球面高斯不透明场实现全景图像的高效渲染,提升3D场景重建的几何一致性和光度质量。

Comments Accepted to IEEE/RSJ IROS 2026. The source code and dataset will be released at https://github.com/1170632760/Spherical-GOF

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06796 2026-07-15 cs.RO 版本更新 70%

RoboDesign1M: A Large-scale Dataset for Robot Design Understanding

RoboDesign1M:用于机器人设计理解的大规模数据集

Tri Le, Toan Nguyen, Quang Tran, Quang Nguyen, Baoru Huang, Hoan Nguyen, Minh Nhat Vu, Tung D. Ta, Anh Nguyen

机构 * FPT Software AI Center(FPT软件人工智能中心) University of Liverpool(利物浦大学) University of Information Technology(信息技术大学) Automation & Control Institute(自动化与控制研究所) Department of Creative Informatics(创意信息系) Faculty of Environment and Information Studies(环境与信息科学系)

专题命中 机器人数据与评测 :robotics(abstract);robotic(abstract);分类 cs.RO

AI总结 针对机器人设计领域缺乏大规模数据集的问题,介绍了含100万个样本的RoboDesign1M数据集,提出半自动数据收集管道,经多项实验评估,该数据集可推动机器人设计理解研究及相关自动化发展。

Comments 8 pages, accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12965 2026-07-15 cs.RO 新提交 57%

MAMMOTH: A Multi-Modal End-to-End Policy for Off-Road Mobility Robust to Missing Modality

MAMMOTH:一种对缺失模态具有鲁棒性的越野移动多模态端到端策略

Ahaan Kotian, Shivani Subramanyan, Suresh Sundaram

机构 * Indian Institute of Science(印度科学研究所)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究针对非结构化越野环境自主导航难题,提出MAMMOTH多模态端到端策略。它融合多模态观测,用模态丢弃训练,还采用扩散策略学习联合概率分布,经实验验证性能优越,能提升避撞等能力及对缺失模态的泛化。

Comments Accepted to IROS 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12480 2026-07-15 cs.AI 新提交 57%

TRACE: An Operational Reasoning Schema for Auditable Agentic Commitments

TRACE:可审计的智能体承诺的操作推理模式

Edward Y. Chang, Emily J. Chang

机构 * Stanford University(斯坦福大学) Quadrivium AI(四元数人工智能)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.AI

AI总结 本文提出TRACE模式用于记录推理轨迹,通过字段和测试应对推理不在语言模型中的问题,给出参考程序和操作规范,借助记录-消费者契约形成操作接口,通过示例展示应用,贡献了模式及其契约。

Comments 46 pages, 18 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12370 2026-07-15 cs.RO 新提交 57%

StratMamba: Strategic and Reactive Stream Partitioning for Path-Efficient LiDAR-Based Obstacle Avoidance

StratMamba:用于基于路径高效的激光雷达避障的策略性和反应性流划分

Hung-Chieh Wu, Xiaopan Zhang, Kasra Sinaei, Ryan Abnavi, Kasun Weerakoon, Christopher Bradley, Seyed Fakoorian, Jiachen Li, Donald Ebeigbe

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) AlphaZ, Inc.(阿尔法兹公司) Georgia Institute of Technology(佐治亚理工学院) Massachusetts Institute of Technology(麻省理工学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.RO

AI总结 研究针对复杂环境中机器人导航问题,提出StratMamba双流时间建模架构,结合快慢衰减内存架构处理激光雷达数据。经多场景评估及与其他基线对比,其在时间推理效率、导航速度和路径最优性方面表现出色,在现实中性能更稳健。

Comments Accepted to IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS 2026). 8 pages, 6 figures. Video: https://www.youtube.com/watch?v=Z0FfO_AVaSw

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12297 2026-07-15 cs.CV 新提交 57%

MobileSAM2: Lightweight Segment Anything for Spatial Intelligence

MobileSAM2:用于空间智能的轻量级图像分割模型

Kai Jiang, Jiaxing Huang, Jingyi Zhang, Weiying Xie, Yunsong Li, Yufei Wang, Aoran Xiao, Dacheng Tao

机构 * Hong Kong Polytechnic University(香港理工大学) Nanyang Technological University(南洋理工大学) Xidian University(西安电子科技大学) SparcAI Inc.(SparcAI公司)

专题命中 机器人数据与评测 :embodied AI(abstract);分类 cs.CV

AI总结 研究旨在使SAM2更适用于移动设备,提出超图知识蒸馏方法HyperKD,由时间和粒度超图知识蒸馏构成,能有效建模转移知识。还推出MobileSAM2家族,经实验验证其在多基准测试及具身AI任务上有良好泛化性能。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12231 2026-07-15 cs.CV 新提交 57%

The GEST-Engine: From Event Graphs to Synthetic Video. A Full Technical Report

GEST引擎:从事件图到合成视频。完整技术报告

Nicolae Cudlenco, Mihai Masala, Marius Leordeanu

机构 * Institute of Mathematics of the Romanian Academy(罗马尼亚科学院数学研究所) National University of Science and Technology Politehnica Bucharest(布加勒斯特理工大学) Büchi Labortechnik AG(布赫实验室技术公司)

专题命中 机器人数据与评测 :world model(abstract);分类 cs.CV

AI总结 GEST引擎从自然语言文本生成多角色视频,核心是明确的世界模型,以GEST表示世界状态。通过程序或智能系统生成GEST,经四阶段管道执行,能输出多种视频相关数据,且保证相关特性,其输出可作视频理解多方面工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17183 2026-07-15 cs.CV cs.CY 版本更新 57%

Benchmarking Nighttime Traffic Sign Recognition with Illumination-Adaptive Detection and Semantic Attribute Reasoning

在低光照条件下学习:用于交通标志识别的数据集和算法

Aditya Mishra, Akshay Agarwal, Haroon Lone

机构 * IISER Bhopal(印度比哈尔州国际研究学院)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出INTSD数据集和LENS-Net算法,解决夜间交通标志识别中的低光照和干扰问题,通过大规模数据和先进模型验证了夜间识别的挑战与方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.12433 2026-07-15 cs.CV cs.SY eess.SY 57%

Traffic-Aware Pedestrian Intention Prediction

考虑交通的行人意图预测

Fahimeh Orvati Nia, Hai Lin

机构 * Department of Electrical Engineering, University of Notre Dame(电子工程系,圣约翰大学)

专题命中 机器人数据与评测 :navigation(abstract);分类 cs.CV

AI总结 本文提出TA-STGCN模型,通过整合动态交通信号和边界框大小,提升行人意图预测的准确性,在PIE数据集上实现了4.75%的提升。

Comments 6 pages, 4 figures. Accepted to the American Control Conference (ACC) 2025

Journal ref 2025 American Control Conference (ACC), Denver, CO, USA, 2025, pp. 3455-3460

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13015 2026-07-15 cs.DS cs.DC cs.MA 新提交 50%

Privacy Attacks on Stable Marriage

对稳定婚姻问题的隐私攻击

Stephan A. Fahrenkrog-Petersen, Aleksander Figiel, Darya Melnyk, Tijana Milentijević, Stefan Schmid

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 研究稳定婚姻算法的隐私攻击问题,假设攻击者可与算法反复交互,揭示非恶意方隐私偏好,发现恶意提议方的Gale-Shapley算法易受攻击,特定偏好分布下诚实方提议的该算法可保护隐私,实验表明真实数据易受攻击,凸显新隐私保护算法的必要性。

Comments Accepted and presented at the 2026 IEEE International Conference on Distributed Computing Systems (ICDCS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15916 2026-07-15 eess.SY cs.SY 50%

A Comprehensive Benchmark Platform for Process Control Research of Outdoor Microalgae Raceway Reactors

面向室外微藻跑道反应器过程控制研究的综合基准平台

Enrique Rodríguez-Miranda, Pablo Otálora, José González-Hernández, José Luis Guzmán, Manuel Berenguel

专题命中 机器人数据与评测 :manipulation(abstract)

AI总结 本文提出一个综合基准平台,用于评估室外微藻跑道反应器过程控制策略,整合四个关键控制任务并提供统一性能指标,支持多变量控制策略开发。

详情

展开后加载摘要…

URL PDF HTML 收藏

6. 其他机器人 7 篇

2607.12898 2026-07-15 astro-ph.IM astro-ph.EP 新提交 78%

Astra: an open-source fully autonomous robotic observatory control software

阿斯特拉:一种开源的全自主机器人天文台控制软件

Peter P. Pedersen, David Degen, Lionel Garcia, Urs Schroffenegger, Daniel Sebastian, Sebastián Zúñiga-Fernández, Brice-Olivier Demory, Elsa Ducrot, Michaël Gillon, Matthew J. Hooton, Clàudia Janó-Muñoz, James McCormac, Mathilde Timmermans, Amaury H. M. J. Triaud, Didier Queloz

专题命中 其他机器人 :robotic(title,abstract)

AI总结 研究针对机器人和自主天文台运行需求,介绍开源跨平台Python系统阿斯特拉,它通过特定协议控制硬件,执行多设备操作,提供网络服务,已在多设施运行,满足巡天天文学可靠性要求。

Comments 16 pages, 3 figures, proceedings of SPIE Astronomical Telescopes + Instrumentation 2026, 14155-116

详情

展开后加载摘要…

URL PDF HTML 收藏