Sample complexity of quantum resource testing via one-shot quantum blurring
通过一次性量子模糊进行量子资源测试的样本复杂度
专题命中 机器人操作 :manipulation(abstract)
AI总结 研究量子资源测试的样本复杂度,通过建立严格有限\(n\)界,给出达到规定性能所需副本数估计,解决了正则化Rényi相对熵收敛问题,得到非对称资源测试样本复杂度界。
Comments 9+26 pages
视觉与机器人
机器人、具身智能、机器人学习、操作、导航和具身世界模型。
通过一次性量子模糊进行量子资源测试的样本复杂度
专题命中 机器人操作 :manipulation(abstract)
AI总结 研究量子资源测试的样本复杂度,通过建立严格有限\(n\)界,给出达到规定性能所需副本数估计,解决了正则化Rényi相对熵收敛问题,得到非对称资源测试样本复杂度界。
Comments 9+26 pages
$^{229}$Th 同核异能态:核结构、时钟与基础物理检验
专题命中 机器人操作 :manipulation(abstract)
AI总结 综述$^{229}$Th同核异能态在实验光谱、核结构理论及基础物理检验方面的进展,重点介绍其异常低的跃迁能量及其在核时钟和暗物质探测中的应用。
Comments 23 pages, 6 figures
TenSIM:基于张量的堆叠智能超表面MIMO系统信道估计
专题命中 机器人操作 :manipulation(abstract)
AI总结 针对堆叠智能超表面辅助MIMO系统,提出基于张量分解的信道估计框架TenSIM,利用奇偶层分别建模PARAFAC和Tucker模型,实现信道解耦与估计。
由调节单元格引起的光子Lieb晶格中的拓扑相变
专题命中 机器人操作 :manipulation(abstract)
AI总结 本文通过调节单元格空间对称性,在光子Lieb晶格中实现多种拓扑相,包括边和角态,并揭示了高阶拓扑相的相变机制。
Journal ref 2026 New J. Phys. 28 055001
数据库的自然语言接口:对用户有何改变?
专题命中 机器人操作 :navigation(abstract)
AI总结 研究比较基于GPT-4o的NLIDB SQL-LLM与传统SQL平台Snowflake,发现接口改变工作类型非工作量,SQL-LLM用户查询速度快但准确性低,熟悉SQL的参与者转向自然语言后仍有验证负担。
Comments 26 pages, 4 figures, 5 tables
在验证威胁下的说服
专题命中 机器人操作 :manipulation(abstract)
AI总结 研究公共交流后私下事实调查中,发送者在异质接收者验证前进行公共实验的情况。核心方法是分析发送者公共信息成本对结果的影响,主要贡献是揭示了不同成本下公共信息性与私下验证的关系及阶段反转。
自由空间中光学Skyrmion晶格的加速
专题命中 机器人操作 :manipulation(abstract)
AI总结 本研究利用Airy结构光实现了自由空间中首个自加速的光学Skyrmion晶格,展示了其在拓扑稳定性和信息处理中的潜力。
用于集成感知与通信信道建模的室内统计与确定性雷达散射截面特性分析
专题命中 机器人操作 :robotic(abstract)
AI总结 研究在25 - 28GHz室内工厂对无人机等测试目标进行统计RCS分析,确定最佳拟合分布。基于特定双基地配置测量,用对数正态和伽马分布建模。还提供评估框架,评估新确定性RCS模型,部分模型能准确拟合数据,适用于NF双基地配置表征。
Comments Accepted for Publication in IEEE Transactions on Wireless Communications
Journal ref IEEE Transactions on Wireless Communications 2026
迈向视觉语言导航的双脑最小充分表示
机构 * Hangzhou Dianzi University(杭州电子科技大学) ; University of Zurich(苏黎世大学) ; University of Exeter(埃克塞特大学)
专题命中 具身导航 :navigation(title,abstract);world model(abstract);分类 cs.CV
AI总结 针对视觉语言导航中存在的问题,提出BrainNav框架,包含逻辑锚定模型等三个组件,通过将语义意图与空间感知对齐,提升智能体在复杂任务中的表现,在实验中相比之前最优方法有改进,为鲁棒的视觉语言导航提供有效基础。
GemNav:使用多模态大语言模型的离散令牌视觉机器人导航
机构 * CSIRO Technology(联邦科学与工业研究组织)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI
AI总结 研究探索基于大型预训练模型的视觉机器人导航策略新方法,提出GemNav,仅对语言塔用LoRA适配冻结的多模态大语言模型用于中短程航点导航,无辅助视觉编码器等,在小语料库上零样本转移到未见环境,提供了数据高效、可部署的导航替代方案。
HiMemVLN:通过分层记忆系统增强开源零样本视觉-语言导航的可靠性
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV
AI总结 本文提出HiMemVLN,通过分层记忆系统提升开源零样本视觉-语言导航的可靠性,解决导航遗忘问题,实现实验环境下的性能提升。
Comments 9 pages, 7 figures
UAV-ON:用于空中智能体的开放世界目标导航基准测试
机构 * Harbin Institute of Technology(哈尔滨工业大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV
AI总结 介绍用于空中智能体开放世界目标导航的UAV-ON基准测试,含14个环境及1270个目标对象,通过实例级指令编码。实现多种基线方法评估,结果凸显空中导航和语义目标基础的复合挑战,推动复杂环境下无人机可扩展自主性研究。
Comments Accepted to ACM MM 2025
非凸空中走廊中无人机导航的模型预测规划器
机构 * Universidade Federal de Minas Gerais(米纳斯吉拉斯联邦大学) ; University of Bergamo(贝加莫大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 研究无人机在非凸空中走廊的导航规划,核心方法是基于混合整数跟踪模型预测控制公式,嵌入特定成本与约束,主要贡献是生成满足约束且收敛目标的动态有效轨迹,无需外部全局规划。
Comments Accepted for publication at the 23rd IFAC World Congress (Busan, Korea)
通过超网络学习自适应多任务制导、导航与控制
机构 * JAXA(日本宇宙航空研究开发机构)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 研究轨道环境中自主自由飞行机器人多任务控制问题,提出HYPER - GNC框架,通过超网络映射任务嵌入到共享策略权重,使单个控制器掌握多种任务,实验证明其样本效率高且能保持稳定,还弥合了模拟到现实的差距。
基于视觉语言模型的自动驾驶车辆导航GNSS欺骗检测技术发展
专题命中 具身导航 :navigation(title,abstract);分类 cs.CV
AI总结 研究自动驾驶车辆GNSS欺骗检测问题,提出基于视觉语言模型的框架,融合多源数据,经三阶段微调及自适应推理策略,大幅提升检测准确率与效率,并生成数据集验证跨区域泛化能力,为自动驾驶提供实用道路防御层。
学习用于长距离越野导航的可通行性感知全局规划器
机构 * J. Mike Walker ’66 Department of Mechanical Engineering, Texas A&M University(德克萨斯农工大学J. Mike Walker '66机械工程系) ; DEVCOM Army Research laboratory(陆军研究实验室)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 针对大型越野环境自主导航难题,提出从高空数据学习连续可通行性地图的方法,由人类驾驶轨迹监督、激光雷达先验塑造,发布相关数据集,实地试验显示该方法能减少操作员干预,轨迹接近人类路径长度。
MemVLN:用于视觉与语言导航的情景记忆和程序记忆
机构 * The Chinese University of Hong Kong(香港中文大学) ; LIGHTSPEED(光速) ; The University of Hong Kong(香港大学) ; The Hong Kong University of Science and Technology(香港科技大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.CV
AI总结 研究连续环境中视觉与语言导航问题,提出MemVLN框架,利用视觉编码器、大语言模型,通过情景记忆管理和程序记忆,实现实时推理,提升导航成功率并降低推理延迟。
AgenticNav:零样本视觉与语言导航作为工具调用框架
机构 * Shanghai Jiao Tong University(上海交通大学) ; Huawei Technologies Ltd(华为技术有限公司)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 提出AgenticNav,通过将动作、深度和记忆作为可调用工具暴露给VLM,实现零样本连续环境导航,在R2R-CE基准上达到SOTA性能。
VL-LN基准:通过主动对话实现长视界目标导向导航
机构 * University of Science and Technology of China(中国科学技术大学) ; Shanghai AI Laboratory(上海人工智能实验室) ; Zhejiang University(浙江大学) ; The University of Hong Kong(香港大学)
专题命中 具身导航 :navigation(title,abstract);分类 cs.RO
AI总结 VL-LN基准通过引入主动对话机制,提升长视界目标导向导航任务的性能和可靠性。
PINA:针对导航代理的提示注入攻击
专题命中 具身导航 :navigation(title,abstract)
AI总结 PINA提出了一种针对导航代理的提示注入攻击检测框架,通过实验展示了其高攻击成功率和稳健性,揭示了导航代理在安全方面的关键漏洞。
Comments Accepted at ICASSP 2026
Journal ref 2026 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 2026
利用高端街景图像进行视觉定位的精度潜力
机构 * FHNW(西北应用科技大学)
专题命中 具身导航 :robotics(abstract);navigation(abstract);分类 cs.RO、cs.CV
AI总结 研究视觉定位精度潜力,引入结合多种技术的可扩展管道,利用FHNW Muttenz数据集评估,实验表明其平移和旋转精度可观,能补充GNSS定位,为3D地理空间数据采集等铺平道路。
Comments 26 pages, 6 figures
用于肌腱驱动的机器人操纵导丝的手持式驱动机构的开发
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO;robotics(journal_ref)
AI总结 针对血管内介入中手动导丝导航难题,开发用于肌腱驱动机器人导丝的手持式驱动机构,集成紧凑卷轴机制,可电动与手动结合操作,能执行多种动作,在模拟主动脉模型中得到验证。
Journal ref Hamlyn Symposium on Medical Robotics 2026
高斯种子:用于高分辨率3D占用预测的分层高斯播种
专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.CV
AI总结 针对现有3D占用预测方法难以扩展到高体素分辨率的问题,提出高斯种子框架,通过分层设计规避内存瓶颈,构建TJScenes数据集,实验表明该方法在保持高精度的同时具有最低延迟,推动了高分辨率3D占用预测的效率-质量前沿。
从运动模仿中学习可重复使用的类人运动混合先验
专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.LG
AI总结 研究提出三阶段流程,将运动模仿技能转化为可重复使用的类人运动混合先验(HMP)。先训练专家策略模仿人类运动,再提炼为冻结架构,最后训练任务级策略。经模拟评估和机器人验证,HMP可重复使用,还揭示可解释码本结构,训练码本技巧能减少下游跌倒。
基于稀疏工作负载重新分配的质量自适应多无人机三维重建
机构 * Inria, INSA Lyon, CITI(法国国家信息与自动化研究所、里昂国立应用科学学院、CITI)
专题命中 具身导航 :robotics(abstract);分类 cs.RO
AI总结 针对无人机三维重建中计算和能量受限及协调难问题,提出质量自适应分散决策策略,集成质量导向准则,采用两级协调,仿真显示该方法提高路径效率且实现更高保真度重建,代码公开。
肢体形态
专题命中 具身导航 :navigation(abstract);分类 cs.AI
AI总结 研究人工生命系统中Gifbreeder的肢体形态,通过用户审美选择进化时空场产生类似生物的形态,用输入空间扰动评估其行为,探讨其反应是否反映目标导向行为及类似智能体动力学如何在无明确规则系统中出现。
Comments 3 pages, 3 figures. Extended abstract accepted as a Late Breaking Abstract at the Artificial Life Conference (ALIFE 2026)
注意力的记忆:通过视觉-语言-运动地图进行语言条件下的重新感知
专题命中 具身导航 :navigation(abstract);分类 cs.RO
AI总结 研究携带行为注释地图的机器人的规划问题,通过将重新感知视为注意力决策,利用持久地图的记忆实现资源分配优化,在语言条件任务中表现出色,证明地图能指导机器人关注重点,而非空间导航。
一试即优:用于跨情节探索摊销的去冗余过程记忆
机构 * Tsinghua University(清华大学) ; DISCOVER Robotics(DISCOVER机器人公司) ; Northeast Agricultural University(东北农业大学)
专题命中 具身导航 :manipulation(abstract);分类 cs.RO
AI总结 研究如何让机器人避免重复探测隐藏状态物体,提出面向实例的记忆框架IOM,用视觉语言模型实例化,在多任务中减少操纵操作,提升效率且不降低成功率,即使过程错误也能成功。
Comments 8 pages, 3 figures, 3 tables
PRISM:用于交互结构运动控制的多项式表示
机构 * University of Michigan(密歇根大学)
专题命中 具身导航 :manipulation(abstract);分类 cs.RO
AI总结 研究针对机器人观察中物理变量交互作用问题,提出PRISM策略表示,通过因式分解多项式模块展现高阶交互特征,在强化和模仿学习中应用,提升了人形机器人运动等性能,还能产生无传感器柔顺行为,表明多项式表示应成运动控制标准选择。
通过自我协商合同实现合作承诺
机构 * University of Washington(华盛顿大学)
专题命中 具身导航 :navigation(abstract);分类 cs.AI
AI总结 研究人工智能代理在多智能体世界中的合作问题,借鉴法律制度和契约,通过在时空博弈\CT中研究基于大型语言模型的代理使用不同合同表示,发现自我协商合同可改善合作结果。