arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-15 至 2026-07-15 共收录 66 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2507.15833 2026-07-15 cs.RO cs.AI cs.CV 版本更新 87%

Look, Focus, Act: Efficient and Robust Robot Learning via Human Gaze and Foveated Vision Transformers

看、聚焦、行动:通过人类注视和中央凹视觉变换器实现高效且稳健的机器人学习

Ian Chuang, Jinyu Zou, Andrew Lee, Dechen Gao, Iman Soltani

机构 * University of California, Berkeley(加州大学伯克利分校) Tongji University(同济大学) University of California, Davis(加州大学戴维斯分校)

专题命中 机器人学习 :robot learning(title,abstract);manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 研究如何将人类注视融入机器人策略以提升效率与稳健性,开发GIAVA系统,通过中央凹补丁令牌化将注视信息集成到视觉变换器,减少计算量,降低计算开销,增强稳健性,在高精度任务中提高成功率,凸显人类启发的中央凹视觉处理的潜力。

Comments Project page: https://soltanilara.github.io/giava/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12892 2026-07-15 cs.RO cs.AI 新提交 86%

UR-VC: Unsupervised Robotic Value Correction for Time-Derived Progress Proxies

UR-VC:用于时间衍生进度代理的无监督机器人价值校正

Lirui Zhao, Modi Shi, Li Chen, Qi Liu, Ping Luo, Hongyang Li

专题命中 机器人学习 :robotic(title,abstract);robot learning(abstract);manipulation(abstract);分类 cs.RO、cs.AI

AI总结 研究针对机器人学习中时间衍生进度标签不准确问题,提出无监督机器人价值校正方法UR-VC,利用演示数据中相似状态不同时出现的规律校正标签,在真实双手布料操作任务中取得积极效果,还能用于构建优势标签。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 18 篇

2607.12105 2026-07-15 cs.RO cs.LG 新提交 84%

Robust In-Hand Manipulation via Priors in Reinforcement Learning and Mechanical Design

通过强化学习和机械设计中的先验知识实现稳健的手中操作

Yifei Chen, Shihan Lu, Ed Colgate, Kevin Lynch

机构 * Center for Robotics and Biosystems, Northwestern University(西北大学机器人与生物系统中心)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.LG

AI总结 研究无外部传感的手中操作难题,引入全局抓握质量先验和局部接触几何先验两种互补物理先验,用于多指机器人手操作物体的手中滚动操作学习,显著提升了旋转效率、抓握稳定性和抗干扰能力,增强任务稳健性与模拟到现实的转移。

Comments 25 pages, 15 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12593 2026-07-15 eess.IV cs.RO cs.SY eess.SY 新提交 70%

Improving Autonomous Nano-drones Performance via Automated End-to-End Optimization and Deployment of DNNs

通过深度神经网络的自动化端到端优化和部署提高自主纳米无人机性能

Vlad Niculescu, Lorenzo Lamberti, Francesco Conti, Luca Benini, Daniele Palossi

专题命中 机器人操作 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究如何通过自动化端到端优化和部署DNN提高自主纳米无人机性能,聚焦PULP-Dronet在Crazyflie 2.1纳米无人机上的部署,实现内存占用减少、推理时间加速,提升了无人机在避障、自由飞行和车道跟随等方面的性能,还开源了相关软件设计。

Comments 16 pages, 8 figures, 5 tables. This paper has been accepted for publication in the IEEE Journal on Emerging and Selected Topics in Circuits and Systems (JETCAS) copyright 2021 IEEE

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12702 2026-07-15 cs.RO 新提交 70%

Vision-Based Dribbling for Humanoid Soccer via Privileged Representation Learning

通过特权表示学习实现基于视觉的人形足球运球

Flavio Maiorana, Valerio Spagnoli, Eugenio Bugli, Flavio Volpi, Daniele Affinita, Vincenzo Suriani, Daniele Nardi, Luca Iocchi

机构 * Sapienza University of Rome(罗马第一大学) Institut de Robòtica i Informàtica Industrial (CSIC-UPC)(工业机器人与信息学研究所(西班牙科学与技术研究委员会 - 加泰罗尼亚理工大学)) École Polytechnique Fédérale de Lausanne (EPFL)(洛桑联邦理工学院)

专题命中 机器人操作 :robotics(abstract);manipulation(abstract);分类 cs.RO

AI总结 研究人形机器人基于视觉的运球问题,提出将时间深度编码器嵌入强化学习策略的集成方法,应用于模拟机器人,该方法在不同场景下实现了一定成功率的运球,为处理复杂运球场景奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07491 2026-07-15 cs.RO 版本更新 70%

Smooth Operator: A Real-Time Sampling-Based Algorithm for Kinematic Hand Retargeting

平滑算子:一种基于实时采样的运动学手部重定向算法

Robert Jomar Malate, Erik Bauer, Norica Bacuieti, Stefanos Charalambous, Elvis Nava, Robert K. Katzschmann, Benedek Forrai

机构 * ETH Zurich(苏黎世联邦理工学院) Stanford University(斯坦福大学) mimic robotics(模仿机器人公司)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对基于梯度的手部重定向算法易收敛到不同局部最小值影响数据质量的问题,提出基于采样的无梯度重定向方法SBR,经模拟和真实用户研究评估,其总体任务成功率最高且显著降低操作员疲劳,为灵巧操作提供高效重定向器及基准测试方法。

Comments Minor cosmetic updates to figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12861 2026-07-15 cs.RO cs.AI cs.SY eess.SY 新提交 62%

Unveiling Complex Collective Behaviors from Simple Rewards

从简单奖励中揭示复杂的集体行为

Yize Mi, Jianan Li, Liang Li, Shiyu Zhao

机构 * College of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) WINDY Lab, School of Engineering, Westlake University(西湖大学工程学院风语实验室) Shanghai AI Laboratory(上海人工智能实验室) Max Planck Institute of Animal Behavior(马克斯·普朗克动物行为研究所) Department of Computer and Information Science, University of Konstanz(康斯坦茨大学计算机与信息科学系) Centre for the Advanced Study of Collective Behaviour, University of Konstanz(康斯坦茨大学集体行为高级研究中心) Department of Biology, University of Konstanz(康斯坦茨大学生物系)

专题命中 机器人操作 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究多智能体强化学习中简单奖励与复杂集体行为的关系,提出两阶段EEC解释框架及智能体响应图,通过合作与竞争两个任务验证,揭示了MARL策略背后隐藏的几何结构。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27947 2026-07-15 cs.RO 版本更新 61%

SANTS: A State-Adaptive Scheduler for World Action Models

SANTS:面向世界动作模型的状态自适应调度器

Yirui Sun, Guangyu Zhuge, Keliang Liu, Jie Gu, Xinyu Bing, Zhongxue Gan, Chunxu Tian

机构 * Fudan University(复旦大学) Harbin Institute of Technology(哈尔滨工业大学) Deep Computing Era Technology Co., Ltd(深计算时代科技有限公司)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO;robotics(comments)

AI总结 提出状态自适应噪声轨迹调度器(SANTS),通过根据视频状态动态选择去噪深度来优化视频到动作的扩散策略,在保持控制性能的同时大幅降低推理延迟。

Comments 17 pages, 5 figures, 8 tables. Project page: https://advanced-robotics-lab.github.io/SANTS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12800 2026-07-15 cs.CV 新提交 57%

UniVR: Thinking in Visual Space for Unified Visual Reasoning

UniVR:用于统一视觉推理的视觉空间思考

Zhongwei Ren, Yunchao Wei, Yao Zhao, Weibo Gong, Xiao Liu, Anran Wang, Xiangtai Li, Xiaojie Jin

机构 * Beijing Jiaotong University(北京交通大学) ByteDance(字节跳动)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 UniVR旨在从纯视觉演示中同时学习复杂推理、物理动力学和长期规划,核心是VR-GRPO强化学习范式。构建VR-X基准进行训练和评估,在VR-X上有25%的提升,还提高了多模态理解基准性能,相关资源已开源。

Comments Code and models are released at: https://maverickren.github.io/UniVR.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12130 2026-07-15 cs.RO 新提交 57%

More than a Manipulator: Planning Propellant-Free Attitude Maneuvers for Free-Floating Spacecraft

不仅仅是一个操纵器:为自由漂浮航天器规划无推进剂姿态机动

Harsh G. Bhundiya, Avi Soval, Keenan Albee

机构 * University of Southern California(南加州大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 研究利用机器人操纵器运动进行自由漂浮航天器无推进剂姿态控制,通过制定带约束的轨迹优化问题求解,展示多种系统轨迹,经与反作用轮阵列比较,证明其可作冗余或主要姿态控制系统,为空间应用提供框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11936 2026-07-15 cs.LG 新提交 57%

Qubit-Efficient Quantum Search for Hyperdimensional Decomposition via Logarithmic Encoding

通过对数编码实现用于超维分解的量子比特高效量子搜索

Sanggeon Yun, Hyunwoo Oh, Ryozo Masukawa, Raheeb Hassan, Mohsen Imani

机构 * University of California, Irvine(加利福尼亚大学欧文分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 针对超维计算中高成本的超向量分解问题,提出量子比特高效框架,引入对数超向量和绑定编码及可逆查找算子,结合改进搜索过程,保持搜索复杂度同时大幅减少量子比特使用,经实验验证效果显著。

Comments Accepted to ICCAD 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06978 2026-07-15 cs.RO 版本更新 57%

SPECTRA: Context-Conditioned Spectral Movement Primitives for Robot Skill Generalization

SPECTRA:用于机器人技能泛化的上下文条件频谱运动基元

Boxuan Zhang, Sheng Liu, Chenlin Ming, Ahmed Abdelrahman

机构 * Technical University of Munich(慕尼黑工业大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院) Shanghai Jiao Tong University(上海交通大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究机器人操作模仿学习中如何保留任务几何形状与动态可允许运动,提出频谱运动基元框架,结合任务空间与关节空间调节,经实验验证该方法在多方面表现良好,能有效实现技能泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27443 2026-07-15 cs.AI cs.CL 版本更新 57%

When Does Personality Composition Matter for Multi-Agent LLM Teams?

人格构成何时对多智能体LLM团队重要?

Aryan Keluskar, Amrita Bhattacharjee, Huan Liu

机构 * School of Computing & AI(计算与人工智能学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究通过操纵前沿LLM的人格特质,发现人格对多智能体团队性能的影响取决于任务结构:在编码任务中影响小,在开放协作和谈判任务中显著降低性能。

Comments Accepted to COLM 2026 (20 pages, 6 figures)

Journal ref Conference on Language Modeling (COLM), San Francisco, USA, October 6-9, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03529 2026-07-15 cs.RO 版本更新 57%

LapSurgie: Humanoid Robots Performing Surgery via Teleoperated Handheld Laparoscopy

LapSurgie: 人形机器人通过远程操控手持腹腔镜进行手术

Zekai Liang, Xiao Liang, Soofiyan Atar, Sreyan Das, Zoe Chiu, Peihan Zhang, Calvin Joyce, Florian Richter, Shanglei Liu, Michael C. Yip

机构 * Department of Electrical and Computer Engineering, University of California San Diego(加州大学圣地亚哥分校电气与计算机工程系) School of Electrical and Computer Engineering, Cornell University(康奈尔大学电气与计算机工程学院) UC San Diego Health(加州大学圣地亚哥医学中心)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 LapSurgie是一种基于人形机器人的腹腔镜远程操控框架,通过逆映射策略实现精准手到工具控制,并通过用户研究验证了其在微创手术中的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12514 2026-07-15 eess.SP 新提交 50%

An Adaptive Transmission Protocol Enabled by The State Switching Strategy of Beyond-Diagonal RIS

基于非对角可重构智能表面状态切换策略的自适应传输协议

Xiyao Wang, Hongyu Li

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究针对BD-RIS在某些场景下性能增益与操作复杂性问题,提出一种自适应传输方案,定义其开启和关闭两种状态,设计波束训练协议并构建决策阈值,能依实时信道条件智能切换状态,确保成功传输。

Comments 6 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12742 2026-07-15 cs.CR cs.GT cs.SY eess.SY 新提交 50%

Stability Buys Time: A Re-Keying Game for Encrypted Multi-Agent Control

稳定性赢得时间:加密多智能体控制的重新密钥生成博弈

Sai Sandeep Damera, John S. Baras

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究加密多智能体控制中CKKS方案密钥恢复漏洞问题,将循环安全性建模为两阶段博弈,通过重新密钥生成防御主动操纵,确定了FHE精度等三方张力范围及有效安全点,揭示反馈回路中密码系统安全性是动态博弈。

Comments 20 pages, 3 figures. Submitted to the 17th Conference on Game Theory and AI for Security (GameSec-26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12754 2026-07-15 physics.optics physics.app-ph 新提交 50%

Twist Engineering for Reconfigurable Optical and Optoelectronic Devices

用于可重构光学和光电器件的扭转工程

Gang Huang, Annan Helian, Mengting Jiang, Chi Wang, Yu Xing, Mayank Joshi, Jae Yeong Lee, Jiang Wang, Syed M Assad, Ping Koy Lam, Qiushi Liu, Lin Wu, Young-Wook Cho, Yuan Ma, Xuezhi Ma

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究可重构光学和光电器件的扭转工程,回顾扭转角计量学现状及表征方法,探讨扭转角控制技术路线,包括多种方法的能力、局限与前景,还讨论其未来从单个结构制造向动态可重构系统发展及相关代表性技术与应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12339 2026-07-15 nlin.PS 新提交 50%

Eigenvalue-Based Approach to Manipulate and Reconstruct Nonlinear Pulses: Towards Soliton Tomography

基于特征值的非线性脉冲操纵与重构方法:迈向孤子层析成像

Sergey Dremov, Rustam Mullyadzhanov, Andrey Gelash

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究基于孤子特征值响应函数及逆问题,开发操纵和重构 sech 形非线性波场的理论框架,推导微扰表达式与传感概念,介绍逆问题积分方程,评估重构机制并证明噪声下可靠解,迈向孤子层析成像。

Comments 10 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10810 2026-07-15 quant-ph 50%

Complexity and multi-functional variants of the Quantum-to-Quantum Bernoulli Factories

量子到量子伯努利工厂的复杂性及多功能变体

Francesco Hoch, Taira Giordani, Gonzalo Carvacho, Nicolò Spagnolo, Fabio Sciarrino

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文研究了量子到量子伯努利工厂的复杂性,提出了量子比特数量的下界和成功概率的上界,并分析了两种新的变体以增加输入偏置和函数数量。

Journal ref Phys. Rev. Research 8, 033003 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20867 2026-07-15 cs.IR 版本更新 50%

E-GEO: A Testbed for Generative Engine Optimization in E-Commerce

E-GEO:电子商务中生成引擎优化的测试平台

Puneet S. Bagga, Vivek F. Farias, Tamar Korkotashvili, Tianyi Peng, Yuhang Wu

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究电子商务中生成引擎优化问题,引入E-GEO数据集,对多种生成引擎、重写器和启发式方法进行大规模实证研究,将GEO公式化并开发优化算法,通过攻击验证其有效性,揭示存在通用有效GEO策略。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 16 篇

2607.12065 2026-07-15 cs.RO cs.AI cs.CV 新提交 89%

Enabling 24-hour Agricultural Robotics: Unsupervised Day-to-Night Cross-Modal Image Translation for Nighttime Visual Navigation

实现24小时农业机器人技术:用于夜间视觉导航的无监督日夜跨模态图像翻译

Robel Mamo, Rajitha de Silva, Grzegorz Cielniak, Taeyeong Choi

机构 * LaSER Lab, Kennesaw State University(激光实验室,肯尼索州立大学) Lincoln Institute for Agri-Food Technology, University of Lincoln(林肯农业食品技术研究所,林肯大学)

专题命中 具身导航 :robotics(title,abstract);navigation(title,abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 该研究针对农业机器人夜间视觉导航中大规模标注图像数据集难获取的问题,提出无监督图像翻译框架,整合CLIP模型并引入可见性掩码,复用白天语义标签训练模型,经实验验证提升了图像质量和下游语义分割性能。

Comments Accepted to IROS2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12811 2026-07-15 cs.RO cs.AI 新提交 81%

PixelLoop: Shortcut Topological Navigation with Pixel-Level Loops

PixelLoop:具有像素级环路的捷径拓扑导航

Sarthak Chittawar, Vansh Garg, Aditya Vadali, Krish Pandya, Rohit Jayanti, Sourav Garg, Madhava Krishna

机构 * Robotics Research Center, IIIT-Hyderabad(国际信息技术学院海得拉巴分校机器人研究中心)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 研究拓扑映射和导航中环路闭合作用,提出PixelLoop方法在像素空间引入环路闭合,充当密集拓扑捷径,经模拟实验和真实机器人部署验证,相比基线在成功率和SPL上有显著提升,为拓扑视觉导航提供基础。

Comments 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS); 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12680 2026-07-15 cs.CV 新提交 79%

ReflectVLN: Training Vision-Language Navigation Agents with Reflective Reasoning

ReflectVLN:通过反思推理训练视觉语言导航智能体

Jiahang Wang, Yirong Yang, Yanqing Zhu, Minghua Luo, Shichao Xie, Fei Liu, Mu Xu

机构 * Amap, Alibaba Group(高德软件有限公司,阿里巴巴集团) Beihang University(北京航空航天大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.CV

AI总结 研究针对现有视觉语言导航方法缺乏闭环机制问题,提出ReflectVLN框架,通过双向交互智能体决策,引入行动思维链训练方案,实验证明该框架在有限数据下提升成功率和路径效率,且具良好训练成本与可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12195 2026-07-15 cs.CL cs.AI 新提交 79%

Comparing Semantic Navigation in Humans and Large Language Models using Natural Language Processing

使用自然语言处理比较人类和大语言模型中的语义导航

Gabriel Paris-Colombo, Rodrigo M. Cabral-Carvalho, Felipe D. Toro-Hernández

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 该研究通过语言流畅性数据,运用基于轨迹的自然语言处理指标,比较人类与三个大语言模型的语义搜索动态,量化相关维度,发现人类语义搜索在局部利用和全局探索间有独特平衡,当前模型架构无法重现。

Comments Cogsci paper 2026

Journal ref Proceedings of the Annual Meeting of the Cognitive Science Society, 48(0), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12050 2026-07-15 cs.RO 新提交 79%

EFLUX: Elastic Multi-Robot Formation Navigation and Adaptation with Agentic LLMs

EFLUX:基于智能语言模型的弹性多机器人编队导航与自适应

Jinyuan Zhang, Yuwei Wu, Guangyao Shi, Jonathan Diller, Gaurav S. Sukhatme, Vijay Kumar

机构 * GRASP Lab, University of Pennsylvania(宾夕法尼亚大学GRASP实验室) Department of Computer Science, University of Southern California(南加州大学计算机科学系)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对多机器人在受限环境中编队导航问题,提出EFLUX框架,基于几何和大语言模型,对变形与重新配置动作联合推理,经闭环管道转化为航点,实验证明其能实现安全弹性导航,减少死锁与导航失败。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11638 2026-07-15 cs.RO 版本更新 79%

DA-Nav: Direction-Aware City-Scale Vision-Language Navigation

DA-Nav:方向感知的城市规模视觉语言导航

Ye Yuan, Kehan Chen, Xinqiang Yu, Wentao Xu, Heng Wang, Libo Huang, Chuanguang Yang, Yan Huang, Jiawei He, Zhulin An

机构 * School of Information Science and Technology, ShanghaiTech University(上海科技大学信息科学与技术学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室) National Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) XYZ Embodied AI(XYZ具身人工智能)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究城市规模户外导航难题,提出DA-Nav框架,利用商业导航工具方向指示,经思维链推理实现轨迹恢复,引入ReDA数据集。实验表明其在未见环境成功率高,优于现有方法,还能适应多种机器人实现稳定户外导航。

Comments 9 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12185 2026-07-15 cs.CL 新提交 78%

Entropy in Semantic Memory Navigation in Blind and Sighted Individuals: The Effect of Visual Experience

盲人与视力正常者语义记忆导航中的熵:视觉经验的影响

Felipe D. Toro-Hernández, Rodrigo Lagos, Sergio E. Chaigneau

专题命中 具身导航 :navigation(title,abstract)

AI总结 研究通过属性列举任务及语义熵指标,对比盲人与视力正常者语义记忆导航差异,发现视力正常者抽象概念熵高于具体概念,盲人在视觉突出具体概念上熵更高,强调视觉经验对语义记忆组织和导航的作用。

Comments Cogsci paper 2026

Journal ref Proceedings of the Annual Meeting of the Cognitive Science Society, 48(0), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.16144 2026-07-15 cs.CV cs.RO 版本更新 74%

LEGO-SLAM: Language-Embedded Gaussian Optimization SLAM

LEGO-SLAM:语言嵌入的高斯优化SLAM

Sibaek Lee, Seongbo Ha, Kyeongsu Kang, Joonyeol Choi, Seungjun Tak, Hyeonwoo Yu

机构 * Department of Intelligent Robotics, Sungkyunkwan University(智能机器人系,成均馆大学)

专题命中 具身导航 :robotics(abstract,comments);robotic(abstract);分类 cs.RO、cs.CV

AI总结 研究将语言特征集成到基于3DGS的SLAM系统的问题,提出LEGO-SLAM框架,利用场景自适应自动编码器压缩语言嵌入,实现语言引导剪枝和回环检测,提升映射质量和跟踪精度,具备开放词汇能力且达15FPS。

Comments Project page :https://lab-of-ai-and-robotics.github.io/LEGO-SLAM/ Submitted to IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.12466 2026-07-15 cs.RO 新提交 74%

Deployable Human Preference Alignment in Robotics: Learning Representative Rewards from Diverse Human Preferences

机器人中可部署的人类偏好对齐:从多样化人类偏好中学习代表性奖励

Taehyung Kim, Gwangmo Lee, Minjun Chang, Sunghyun Lim, Jongeun Choi

专题命中 具身导航 :robotics(title);分类 cs.RO

AI总结 研究如何使机器人策略与人类偏好对齐,提出基于偏好的奖励聚类(PREC)框架,通过聚合用户轨迹学习共享轨迹编码器,将用户聚类并为每个聚类学习奖励模型,实验表明该方法能更准确聚类用户,在多指标上优于现有方法。

Comments 23 pages, 20 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11834 2026-07-15 cs.CV cs.AI cs.RO cs.SY eess.IV eess.SY 67%

Recent Advances in Transformer and Large Language Models for UAV Applications

Transformer及大语言模型在无人机应用中的最新进展

Hamza Kheddar, Yassine Habchi, Mohamed Chahine Ghanem, Mustapha Hemis, Dusit Niyato

机构 * LSEA Laboratory, Department of Electrical Engineering, University of Medea, 26000, Algeria(里塞阿实验室,电气工程系,梅迪亚大学,阿尔及利亚) Institute of Technology, University Centre Salhi Ahmed, Naama, Algeria(技术研究所,萨利哈·阿赫迈德大学中心,纳马,阿尔及利亚) Cybersecurity Institute, Department of Computer Science, University of Liverpool, L69 3BX, Liverpool, UK(网络安全研究所,计算机科学系,利物浦大学,英国) LCPTS Laboratory, University of Sciences(LCPTS实验室,科学大学) College of Computing(计算学院) Data Science, Nanyang Technological University, Singapore.(数据科学,南洋理工大学,新加坡)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 本文综述了Transformer及大语言模型在无人机应用中的最新进展,包括分类、混合模型、强化学习和大语言模型的应用,以及精准农业和自主导航等新兴应用。

Journal ref ACM Computing Surveys, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏