arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-11 至 2026-08-11 共收录 65 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2606.05234 2026-08-11 cs.RO cs.LG 版本更新 62%

OLIVE: Online Low-Rank Incremental Learning for Efficient Adaptive Exoskeletons

OLIVE: 面向高效自适应外骨骼的在线低秩增量学习

Dong Liu, Yanxuan Yu, Ben Lengerich, Tong Geng, Ying Nian Wu

机构 * University of California, Los Angeles(加州大学洛杉矶分校) Columbia University(哥伦比亚大学) University of Wisconsin-Madison(威斯康星大学麦迪逊分校) Rice University(里奇大学)

专题命中 机器人学习 :navigation(abstract);分类 cs.RO、cs.LG

AI总结 提出OLIVE框架,通过低秩残差分解和奖励驱动策略梯度实现外骨骼控制的在线个性化自适应,在多种地形上提升步态平滑度、降低努力并增强稳定性。

Comments Accepted to UbiComp / ISWC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 15 篇

2503.22122 2026-08-11 cs.RO cs.AI cs.CL cs.CV 版本更新 87%

REMAC: Self-Reflective and Self-Evolving Multi-Agent Collaboration for Long-Horizon Robot Manipulation

REMAC:用于长时程机器人操作的自反思与自进化多智能体协作框架

Puzhen Yuan, Angyuan Ma, Yunchao Yao, Huaxiu Yao, Masayoshi Tomizuka, Mingyu Ding

专题命中 机器人操作 :manipulation(title,abstract);navigation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本研究提出REMAC自适应多智能体规划框架,通过自反思与自进化实现多机器人长时程任务规划,在RoboCasa基准测试中使任务平均成功率提升40%、执行效率提升52.7%。

Comments 24 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24744 2026-08-11 cs.RO cs.CV 版本更新 86%

Data Pyramid for Embodied Manipulation: A Survey

用于具身操纵的数据金字塔

Yifan Ye, Yankai Fu, Yaoxu Lv, Bohan Hou, Jun Cen, Lingdong Kong, Duo Zheng, Tianxing Chen, Jiaming Liu, Ziang Cao, Yunfan Lou, Wei Chow, Xian Sun, Yingshuo Wang, Kuangzhi Ge, Xiaowei Chi, Xidong Zhang, Zhibo Pang, Yiwu Zhong, Sirui Han, Zhihe Lu, Weihao Yuan, Qifeng Chen, Michael Yu Wang, Yao Mu, Ziwei Liu, Jianfei Yang, Ping Luo, Shanghang Zhang

机构 * PKU(北京大学) NTU(南洋理工大学) HKUST(香港科技大学) NUS(新加坡国立大学) CUHK(香港中文大学) HKU(香港大学) Duke(杜克大学) UCB(加州大学伯克利分校) GBU(未提及具体中文名的机构) NJU(南京大学) SJTU(上海交通大学)

专题命中 机器人操作 :manipulation(title,abstract);robot learning(abstract);embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 研究围绕具身操纵数据生态系统展开,构建跨越五个互补数据源的“数据金字塔”,通过数据配方分析具身基础模型,将数据组成与多种能力联系起来,并讨论了六个开放挑战,为下一代具身系统设计奠定基础。

Comments Awesome Embodied Data Pyramid; Project Page at https://jasper-aaa.github.io/embodied-data-pyramid/ GitHub Repo at https://github.com/worldbench/awesome-embodied-data-pyramid

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07230 2026-08-11 cs.CV 版本更新 83%

PhyEdit: Towards Real-World Object Manipulation via Physically-Grounded Image Editing

PhyEdit: 通过物理基础图像编辑实现真实世界物体操作

Ruihang Xu, Dewei Zhou, Xiaolong Shen, Fan Ma, Yi Yang

机构 * ReLER, CCAI, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室人工智能研究所ReLER实验室)

专题命中 机器人操作 :manipulation(title,abstract);world model(abstract);分类 cs.CV

AI总结 PhyEdit通过结合显式几何模拟与2D-3D监督,提升图像编辑中物理准确性和操作一致性,引入RealManip-10K数据集和ManipEval基准测试,优于现有方法。

Comments Code: https://github.com/nenhang/PhyEdit

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01414 2026-08-11 cs.RO 版本更新 83%

Learning When to See and When to Feel: Adaptive Vision-Torque Fusion for Contact-Aware Manipulation

学习何时视觉何时触觉:适应性视觉-扭矩融合用于接触感知操控

Jiuzhou Lei, Chang Liu, Yu She, Xiao Liang, Minghui Zheng

机构 * Edwardson School of Industrial Engineering, Purdue University(普渡大学爱德华森工业工程学院) Zachry Department of Civil and Environmental Engineering, Texas A&M University(德州农工大学扎克里土木与环境工程系)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出适应性视觉-扭矩融合策略,通过比较不同融合方法提升机器人操控性能,实验显示方法在成功率上优于基线14%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06375 2026-08-11 cs.RO 版本更新 79%

$ω$-0: A Latent Predictive World Action Model for Concurrent Humanoid Loco-Manipulation

ω-0:一种用于类人机器人协同移动操作的潜在预测世界动作模型

Zhe Li, Zhenzhe Zhang, Yangyang Wei, Wenjie Zhang, Xichen Yuan, Peiyuan Zhi, Gen Li, Xinying Guo, Fengjie Gao, Jianfei Yang, Shanghang Zhang

机构 * NTU(南洋理工大学) PKU(北京大学) BAAI(北京智源人工智能研究院) HKUST(GZ)(香港科技大学(广州))

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 本文提出 ω-0 模型,针对类人机器人协同移动操作问题,结合潜在视觉预见与扩散动作生成,在 11 项家庭任务上优于多个基线,还构建了 ω-HOME 数据集。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05868 2026-08-11 cs.RO 版本更新 70%

AnyCamVLA: Zero-Shot Camera Adaptation for Viewpoint Robust Vision-Language-Action Models

AnyCamVLA: 零样本相机适应用于视角鲁棒的视觉-语言-动作模型

Hyeongjun Heo, Seungyeon Woo, Sang Min Kim, Junho Kim, Junho Lee, Yonghyeon Lee, Young Min Kim

机构 * Department of Electrical and Computer Engineering, Seoul National University(电子与计算机工程系,首尔国立大学) Department of Mechanical Engineering, Massachusetts Institute of Technology(机械工程系,麻省理工学院)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 AnyCamVLA通过零样本相机适应提升视觉-语言-动作模型在视角变化下的鲁棒性,适用于任何RGB策略。

Comments Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07558 2026-08-11 cs.CV cs.LG cs.RO 版本更新 67%

Unsupervised Point Cloud Registration with Self-Distillation

基于自蒸馏的无监督点云配准

Christian Löwens, Thorben Funke, André Wagner, Alexandru Paul Condurache

专题命中 机器人操作 :robotics(abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 本文针对点云配准依赖真实位姿标注的问题,提出自蒸馏无监督方法,在3DMatch基准上优于现有方法,且可泛化至汽车雷达场景。

Comments Oral at BMVC 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18587 2026-08-11 cs.CV cs.AI 版本更新 62%

HyperFake: Hyperspectral Reconstruction and Attention-Guided Analysis for Advanced Deepfake Detection

HyperFake:用于高级深度伪造检测的高光谱重建与注意力引导分析

Pavan C Shekar, Pawan Soni, Vivek Kanhangad

机构 * Department of Electrical Engineering, Indian Institute of Technology Indore(印度理工学院印度尔分校电子工程系)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.CV

AI总结 HyperFake是首个利用高光谱成像重建的深度伪造检测方法,通过改进的MST++架构、光谱注意力机制与EfficientNet分类器,从RGB视频重建31通道高光谱数据,实现了更准确且泛化性更强的深度伪造检测。

Comments 6 pages, 3 figures, 1 table. Preliminary results on FaceForensics++ dataset. First approach to use hyperspectral reconstruction for deepfake detection

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18867 2026-08-11 cs.LG cs.CL 版本更新 57%

HindsightBench: A Black-Box Behavioral Audit Protocol for Parametric Hindsight in Time-Indexed LLM Decision Tasks

HindsightBench:用于时间索引语言模型决策任务中参数后见之明的黑盒行为审计协议

Haozhe Jia

机构 * University College Dublin(都柏林大学学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 研究针对大语言模型在金融决策任务中泄露参数知识的问题,提出HindsightBench黑盒行为审计协议,通过特定矩阵、探测及指标分析参数后见之明,应用于多模型获三个主要模式,揭示模型特性及审计结果与服务的关系,还发布相关数据。

Comments 17 pages, 3 figures. Code, panel, and per-model audit rows: https://github.com/Khaozhe/hindsightbench (v1.0 release archived at doi:10.5281/zenodo.21453191)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18171 2026-08-11 cs.LG 版本更新 57%

FlashRT: Agent Harness for Guiding Agents to Deploy Real-Time Multimodal Applications

FlashRT:用于引导智能体部署实时多模态应用的智能体框架

Krish Agarwal, Zhuoming Chen, Yanyuan Qin, Zhenyu Gu, Atri Rudra, Beidi Chen

机构 * Carnegie Mellon University(卡内基梅隆大学) AMD(超威半导体公司) University at Buffalo(纽约州立大学水牛城分校)

专题命中 机器人操作 :world model(abstract);分类 cs.LG

AI总结 研究实时多模态应用部署难题,提出FlashRT智能体框架。通过新范式引导编码智能体多阶段转换,将参考实现转为高效部署,在不同GPU上显著提升性能,尤其在专家优化不成熟平台更具扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22787 2026-08-11 cs.HC cs.RO 版本更新 57%

DiSCo: Diffusion Sequence Copilots for Shared Autonomy

DiSCo:用于共享自主的扩散序列助手

Andy Wang, Xu Yan, Brandon McMahan, Michael Zhou, Yuyang Yuan, Johannes Y. Lee, Ali Shreif, Matthew Li, Zhenghao Peng, Bolei Zhou, Yuchen Cui, Jonathan C. Kao

机构 * University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 DiSCo通过扩散策略规划与用户动作一致的动作序列,提升复杂系统控制性能,适用于模拟驾驶和机械臂任务。

Comments 10 pages, 5 figures, HRI '26: Proceedings of the 21st ACM/IEEE International Conference on Human-Robot Interaction

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.08813 2026-08-11 cs.RO 版本更新 57%

Calib3R: Hand-Eye Calibration and 3D Metric-Scaled Scene Reconstruction with 3D Foundation Models

Calib3R:基于三维基础模型的手眼标定与三维度量尺度场景重建

Davide Allegro, Matteo Terreran, Stefano Ghidoni

机构 * Department of Information Engineering (DEI) at the University of Padova(帕多瓦大学信息工程系)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 Calib3R是一种基于3D基础模型的无标定板方法,通过统一优化联合完成手眼标定与度量尺度三维重建,仅用不到10张图像即可实现精确标定,性能优于同类方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05010 2026-08-11 quant-ph 版本更新 50%

Neutral Atom Quantum Computing: Principles, Routes, Progress, and Challenges

中性原子量子计算:原理、路线、进展与挑战

Junchao Wang, Zeyuan Wang, Lei Li, Feng Wang, Shibo Liang, Keduo Yan

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文系统综述中性原子量子计算的原理、主流技术路线与2000至2026年的国内外进展,分析其核心瓶颈,为该领域研究与技术发展提供系统性参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.30065 2026-08-11 cond-mat.mtrl-sci 版本更新 50%

Phonon-driven Floquet engineering for electronic states

声子驱动的Floquet-Bloch态:量子拍频光谱探测

Yu-Chan Tai, Chih-Wei Luo, Noriaki Takagi, Hiroshi Ishida, Chun-Liang Lin, Ryuichi Arafune

专题命中 机器人操作 :manipulation(abstract)

AI总结 利用时间分辨多光子光发射结合量子拍频光谱,在石墨烯覆盖的Ir(111)上证实了激光激发的相干声子驱动Floquet-Bloch态的形成,其寿命比光驱动态长一到两个数量级。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09186 2026-08-11 physics.app-ph 版本更新 50%

Non-Hermitian-induced higher-order topological phases in acoustic fractal lattices

非厄米特诱导的声学分形晶格中更高阶拓扑相

Shuanghuizhi Li, Bowei Wu, Tingfeng Ma, Haixiao Wang, Jiaqi Zhang, Chenbowen Lou

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究通过非厄米特性在声学分形晶格中诱导更高阶拓扑相,揭示了拓扑相变的形成机制,并展示了通过调整损耗对比度操控拓扑态的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 17 篇

2608.06833 2026-08-11 cs.RO 版本更新 85%

Unordered Landmark Visual Navigation

无序地标视觉导航

Hao Ren, Junzhe Zhu, Yihan Li, Zetong Bi, Le Zheng, Zhi Li, Yiqing Yuan, Zhaoliang Wan, Dizhe Zhang, Lu Qi, Hui Cheng

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.RO

AI总结 针对无序图像导航的挑战,本文提出无需时间与里程计先验的ULVN框架,通过整合建图、定位与规划,在仿真和真实场景中性能优于现有最优方法。

Comments ECCV2026 Oral & Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06134 2026-08-11 cs.HC 版本更新 82%

MAESTRO: Adapting GUIs and Guiding Navigation with User Preferences in Conversational Agents with GUIs

MAESTRO:在具有GUI的对话代理中通过用户偏好适应GUI并引导导航

Sangwook Lee, Adnan Abbas, Sang Won Lee, Young-Ho Kim, Yan Chen

专题命中 具身导航 :navigation(title,abstract)

AI总结 MAESTRO通过提取用户偏好并指导工作流导航,提升对话代理中GUI的适应性和导航效率,通过实验验证其有效性。

Comments 19 pages, 6 figures, 2 tables. Published at UIST '26. This is the camera-ready version, posted under CC BY 4.0

Journal ref Proceedings of the 39th Annual ACM Symposium on User Interface Software and Technology (UIST '26), November 2-5, 2026, Detroit, MI, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14357 2026-08-11 cs.RO cs.AI 版本更新 81%

SUM-AgriVLN: Spatial Understanding Memory for Agricultural Vision-and-Language Navigation

SUM-AgriVLN:面向农业视觉语言导航的空间理解记忆

Xiaobei Zhao, Xingqi Lyu, Xin Chen, Xiang Li

机构 * China Agricultural University(中国农业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 针对现有农业视觉语言导航方法忽视重复指令的空间记忆潜力的局限,提出SUM模块并集成至AgriVLN构建SUM-AgriVLN,在A2A基准上将SR从0.47提至0.54,NE仅微增,达领域顶尖性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00854 2026-08-11 cs.RO 版本更新 79%

Minute-Scale Training for Microrobot Navigation

微型机器人导航的分钟级训练

Yinghan Sun, Aoji Zhu, Xiang Ji, Yamei Li, Jiachi Zhao, Yun Wang, Li Zhang, Huijun Gao, Lidong Yang

机构 * The Hong Kong Polytechnic University(香港理工大学) The Chinese University of Hong Kong(香港中文大学) Shenzhen Loop Area Institute(深圳河套学院) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本文针对微型机器人DRL导航训练耗时久的问题,提出含全向量化模拟器与TSR奖励框架的学习框架,将训练缩至10分钟内,支持零样本部署,可缩短设计周期、加速部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26041 2026-08-11 cs.CV 版本更新 79%

Where and How to Prune: An Empirical Study of Visual Token Pruning for GUI Agent Navigation

重新思考GUI视觉代理中历史截图的标记剪枝:语义、空间和时间视角

Daiqiang Li, Zihao Pan, Zeyu Zhang, Xuyang Liu, Shijia Xu, Ronghao Chen, Huacan Wang, Honggang Chen, Linfeng Zhang, Zhangquan Chen, Haiyun Jiang

机构 * Sichuan University(四川大学) Sun Yat-sen University(中山大学) Australian National University(澳大利亚国立大学) Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) Shanghai Jiao Tong University(上海交通大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 本文从语义、空间和时间角度研究GUI视觉代理中历史截图的标记剪枝,发现背景区域对界面状态转换有重要价值,随机剪枝在空间结构保留上更有效,且GUI代理具有近期效应,通过分配更多预算给近期截图可降低计算成本而不影响性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.19930 2026-08-11 cs.RO cs.MA 版本更新 79%

A Communication-Efficient Digital Twin Framework for PSO-Based Swarm Navigation and Obstacle Avoidance

面向基于粒子群优化(PSO)的集群导航与避障的通信高效数字孪生框架

Siyu Yuan, Khurshid Alam, Bin Han, Dennis Krummacker, Hans D. Schotten

机构 * University of Kaiserslautern (RPTU)(凯撒斯劳滕大学(RPTU)) German Research Center for Artificial Intelligence (DFKI)(德国人工智能研究中心(DFKI))

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对工业集群目标定位的避障与通信难题,提出部署于MEC服务器的DT辅助PSO框架,可减少通信负载、加快收敛,在复杂工业协同探索场景具有应用潜力。

Comments Accepted by IEEE Access

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10744 2026-08-11 cs.CV cs.RO 版本更新 73%

Traj-VLN: Learning Pixel-Space Interaction via Autoregressive Trajectory Generation

Traj-VLN:通过自回归轨迹生成学习像素空间交互

Changfei Fu, Guangcheng Chen, Aoxiang Gu, Haoxiang Liang, Wenjun Xu, Hong Zhang

机构 * Southern University of Science and Technology(南方科技大学) Peng Cheng National Laboratory(鹏城国家实验室) Guangdong University of Technology(广东工业大学)

专题命中 具身导航 :embodied agent(abstract);navigation(abstract);分类 cs.RO、cs.CV

AI总结 研究连续环境中视觉与语言导航问题,提出通过自回归轨迹生成在2D像素空间微调视觉语言模型来学习导航交互的方法,实验验证该方法能显著提升性能,旗舰模型在有限资源和数据下达最优水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26046 2026-08-11 cs.RO cs.CV 版本更新 62%

RoboAtlas: Contextual Active SLAM

RoboAtlas:上下文感知主动SLAM

Alexander Schperberg, Shivam K. Panda, Abraham P. Vinod, Rokaha Bhagawan, M. K. Jawed, Stefano Di Cairano

机构 * Mitsubishi Electric Research Laboratories(三菱电机研究实验室) University of California, Los Angeles(加州大学洛杉矶分校)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.CV

AI总结 提出RoboAtlas框架,通过上下文感知的多臂赌博机平衡几何探索与语义推理,结合3D语义地图OpenRoboVox,在真实环境中实现100%任务成功率,并在GOAT-Bench上以90.6%成功率达到SOTA。

Comments Alexander Schperberg and Shivam K. Panda made equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31119 2026-08-11 cs.LG 版本更新 57%

Visualizing High-Dimensional Graph Embeddings via Informed Multi-View Projections

通过信息多视图投影可视化高维图嵌入

Ya Ji, Xuefeng Li, Timo Brand, Jacob Miller, Peng Zhang, Stephen Kobourov, Yifan Hu

机构 * Khoury College of Computer Sciences, Northeastern University(东北大学库里计算机科学学院) School of Computation, Information and Technology, Technical University of Munich(慕尼黑工业大学计算、信息与技术学院)

专题命中 具身导航 :navigation(abstract);分类 cs.LG

AI总结 提出在高维空间中嵌入图,并通过可微分的边交叉代理搜索优化美学和可读性指标的二维视角,优于标准布局,并引入交互系统DataFly。

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.00637 2026-08-11 cs.RO 版本更新 57%

Global-Local Attention Decomposition for Terrain Encoding in Humanoid Perceptive Locomotion

全局-局部注意力分解用于人形感知运动中的地形编码

Shengcheng Fu, Yang Zhang, Zhanxiang Cao, Liyun Yan, Yizhi Chen, Yunpeng Yin, Yue Gao

机构 * Tongji University(同济大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Jiao Tong University(上海交通大学) Humanoid Robot (Shanghai) Co., Ltd.(人形机器人(上海)有限公司)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出全局-局部注意力分解(GLAD)方法,通过粗到细编码器分离全局地形感知和局部立足点选择,实现人形机器人在稀疏立足点和受限环境中的鲁棒运动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28272 2026-08-11 cs.RO 版本更新 57%

Point of View: How Perspective Affects Perceived Robot Sociability

视角:透视如何影响感知的机器人社交性

Subham Agrawal, Aftab Akhtar, Nils Dengler, Maren Bennewitz

机构 * Humanoid Robots Lab, University of Bonn, Germany(波恩大学人形机器人实验室,德国)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 本文通过VR用户研究,比较全知视角与第一人称视角对机器人轨迹社交性的感知差异,发现全知视角下社交性高的轨迹在近距离第一人称体验中可能更令人不安,而头部点头等社交信号可提升感知社交性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23290 2026-08-11 cs.CV 版本更新 57%

LineGraph2Road: Structural Graph Reasoning on Line Graphs for Road Network Extraction

LineGraph2Road:基于线路图的结构图推理用于道路网络提取

Zhengyang Wei, Renzhi Jing, Yiyi He, Jenny Suckale

机构 * Stanford University(斯坦福大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 具身导航 :navigation(abstract);分类 cs.CV

AI总结 LineGraph2Road通过构建全局稀疏欧几里得图并应用图变换器,提升道路网络提取的连通性预测,解决长距离依赖和复杂拓扑问题,实现高精度道路提取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.13361 2026-08-11 cs.RO 版本更新 57%

CLEAR: A Semantic-Geometric Terrain Abstraction for Large-Scale Unstructured Environments

CLEAR: 一种用于大规模无结构环境的语义-几何地形抽象

Pranay Meshram, Charuvahan Adhivarahan, Ehsan Tarkesh Esfahani, Souma Chowdhury, Chen Wang, Karthik Dantu

机构 * Department of Computer Science and Engineering, University at Buffalo(计算机科学与工程系,布法罗大学) Department of Mechanical and Aerospace Engineering, University at Buffalo(机械与航空航天工程系,布法罗大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 CLEAR通过结合边界感知的空间分解与递归平面拟合,实现了大规模无结构环境中的高效地形抽象,提高了路径规划的速度和可靠性。

Comments Accepted in IEEE RA-L August, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16544 2026-08-11 cond-mat.str-el cond-mat.mes-hall 版本更新 50%

AIMS: an AI experimentalist turns uncertainty into quantum matter discovery

AIMS:一种用于量子物质的不确定性感知人工智能实验者

Siyuan Qiu, Philip D. Suh, Nhat Huy Tran, Xirui Wang, Heonjoon Park, Kutay Akin, Kevin K. S. Multani, Seungwon Jung, Wenkai Cai, Xinyu Liu, León Garcia, Ziyan Zhu, Chunjing Jia, Zhantao Chen, Zhixun Shen, Zhurun Ji

专题命中 具身导航 :navigation(abstract)

AI总结 研究量子材料实验中的不确定性问题,提出AIMS这一不确定性感知人工智能实验者,通过连接三个嵌套循环实现感知恢复、测量选择和能量尺度分辨机制归因,展示了对量子物质的不确定性感知实验能动性。

详情

展开后加载摘要…

URL PDF HTML 收藏