arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-29 至 2026-07-29 共收录 60 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 3 篇

2607.25593 2026-07-29 cs.RO 新提交 83%

When Does Legacy Data Start to Help? Emergent Transfer in Cross-Configuration Robot Learning

遗留数据何时开始发挥作用?跨配置机器人学习中的涌现转移

Tao Wang, Hudson Hou, Yingdong Hu, Yufeng Liu, Qinghai Li, Yingjie Jiang, Yingzhi Wang, Cheng Ma, Richard Wang, Yang Gao

专题命中 机器人学习 :robot learning(title);manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究跨配置机器人学习中遗留数据何时有益,发现存在类似顿悟的三阶段转变,即低能力时遗留数据无效,超阈值后收益剧增,高能力时收益递减,基于梯度对齐等给出理论解释和阶段感知规则并验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11665 2026-07-29 cs.RO 版本更新 83%

Nautilus: From One Prompt to Plug-and-Play Robot Learning

Nautilus:从一个提示到即插即用的机器人学习

Yufeng Jin, Jianfei Guo, Xiaogang Jia, Yu Deng, Zechu Li, Han Liu, Weiran Liao, Vignesh Prasad, Mathias Franzius, Gerhard Neumann, Georgia Chalvatzaki

机构 * TU Darmstadt(图宾根大学) KIT(卡尔斯鲁厄理工学院) FZI(弗劳恩霍夫研究所) Robotics Institute Germany(德国机器人研究所) Honda Research Institute Europe(本田欧洲研究院)

专题命中 机器人学习 :robot learning(title,abstract);robotics(abstract);分类 cs.RO

AI总结 Nautilus通过单个提示生成可复现、评估、微调和部署的机器人学习工作流程,提供即插即用的代理技能集和统一接口,减少跨家族验证的工程负担。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25541 2026-07-29 cs.RO 新提交 79%

P3: Probabilistic Policy Propagation for Stable VAE-Based Robot Learning

P3:基于稳定变分自编码器的机器人学习的概率策略传播

Liyun Yan, Jianming Ma, Yang Zhang, Shengcheng Fu, Zhanxiang Cao, Keqi Zhu, Yizhi Chen, Yue Gao

专题命中 机器人学习 :robot learning(title);robotics(abstract);分类 cs.RO

AI总结 研究基于变分自编码器的机器人学习中随机潜变量与近端策略优化不匹配问题,提出P³框架,它结合概率方法与采样校准,实验表明可提高数据效率、减少收敛步数,为人形跑酷任务的基于变分自编码器的PPO奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 17 篇

2410.24035 2026-07-29 cs.RO cs.AI cs.LG 版本更新 89%

A context-adaptive policy framework for robust and reactive robotic manipulation via uncertainty-aware imitation learning

一种通过不确定性感知模仿学习实现鲁棒且反应式机器人操作的上下文自适应策略框架

Tim R. Winter, Leonard Klüpfel, Ashok M. Sundaram, Werner Friedl, Maximo A. Roa, Freek Stulp, João Silvério

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);robotics(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究如何生成适应变化的机器人操作策略,基于策略融合与不确定性量化提出上下文自适应框架,用LfD获取策略并结合MoE提升鲁棒性,在多种场景下评估该方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26047 2026-07-29 cs.RO 新提交 83%

S2A2: Audio-Visual Imitation Learning for Manipulation Tasks Using Acoustic Spatial Information

S2A2:利用声学空间信息进行操作任务的视听模仿学习

Kaneyoshi Hiratsuka, Benjamin Yen, Ryosuke Kojima

机构 * Kyoto University(京都大学) RIKEN(理化学研究所) Institute of Science Tokyo(东京理科大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究利用声学信息进行操作任务的模仿学习,提出多模态框架S2A2,集成视觉与声学信息,实现多种策略集成,模拟与真实机器人实验表明其对特定任务有效且适用于现实操作。

Comments Project page: https://azuma413.github.io/projects/s2a2

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25895 2026-07-29 cs.RO cs.CV cs.LG 新提交 82%

HiFi-UMI: Learning Deployable Manipulation Policies from High-Fidelity UMI Data Alone

HiFi-UMI:仅从高保真UMI数据中学习可部署的操作策略

Simple AI, :, Yuteng Wei, Jinming Ma, Jiawei Wang, Weitao Zhou, Yushen Zuo, Ke Rui, Minglei Li, Jinhao Zhang, Zhikang Pan, Xiang Wang, Haoran Jia, Huan Du, Zicheng Zeng, Jun Ma, Guiyu Qin, Di Zhang, Xiaofei Li

机构 * Simple AI(简单人工智能公司)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.CV、cs.LG

AI总结 研究如何从高保真UMI数据学习可部署操作策略,提出HiFi-UMI系统,其无需外部跟踪达3毫米精度。利用该系统数据实现零机器人训练后策略,预训练还能降误差提成功率,且开源了相关高保真资源。

Comments 33 pages, 15 figures, 4 tables. Project page: https://cloud.simpleai.tech/simple-world-lab/hifi-umi/ Dataset: https://huggingface.co/datasets/simple-world-lab/HiFi-UMI-2K

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12109 2026-07-29 cs.RO cs.AI 版本更新 81%

InDex: Empowering VLA Models with Intent-Conditioned Arm-Hand Coordination for Dexterous Manipulation

弥合形态差距:通过意图条件微调使VLA模型适应灵巧操作

Chuanke Pang, Junyi Huang, Zhijun Zhao, Yaobing Wang, Kun Xu, Xilun Ding

机构 * Beihang University(北京航空航天大学) China Academy of Space Technology(中国空间技术研究院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI

AI总结 提出InDex框架,通过将预训练的1-DoF平行抓取输出重用作宏观虚拟抓取意图代理,结合两阶段解耦学习架构,实现VLA模型从低自由度夹爪到高自由度灵巧手的适应,有效缓解灾难性遗忘和动作流形坍缩。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24859 2026-07-29 cs.CR 新提交 78%

The Mirage of LLM Guardrails: A Case Study in AI-Assisted Medical Note Manipulation

大语言模型护栏的幻象:人工智能辅助医疗记录操纵的案例研究

Davis Yadav, Amulya Yadav

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究大语言模型在医疗记录操纵场景下内置护栏的可靠性,通过开发操纵流程、实证评估、利用多种指标评估及用户研究,揭示其弱点,为大语言模型在医疗领域的护栏设计、安全政策及伦理等方面提供参考。

Comments 10 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24888 2026-07-29 cs.CR cs.SE 新提交 71%

Trusting-Trust Attack against an Entire Linux Distribution through Binary Manipulation

通过二进制操作对整个Linux发行版进行信任-信任攻击

Julien Malka, Aman Sharma, Martin Monperrus, Stefano Zacchiroli, Théo Zimmermann

专题命中 机器人操作 :manipulation(title)

AI总结 研究针对Linux发行版的信任-信任攻击,利用对成品ELF文件的操作,围绕GNU strip构建攻击。在NixOS引导中植入有效载荷,在实际nixpkgs版本上成功构建安装程序并植入后门,证明该攻击不限于编译器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25397 2026-07-29 cs.RO 新提交 70%

Decompose and Reorganize: Planning with Primitives and Visuomotor Policies Learned from Demonstrations

分解与重组:利用从示范中学到的原语和视觉运动策略进行规划

Yizhou Chen, Hang Xu, Dongjie Yu, Yupu Lu, Tengye Xu, Zeqing Zhang, Wei Zhang, Yi Ren, Ben M. Chen, Jia Pan

机构 * The University of Hong Kong(香港大学) JD.com (JingDong)(京东) Nanyang Technological University (NTU)(南洋理工大学) Southern University of Science and Technology (SUSTech)(南方科技大学) Huawei Technologies(华为技术有限公司) The Chinese University of Hong Kong (CUHK)(香港中文大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究如何使机器人灵巧、长视野操作自动化,提出DR-LfD框架,将视觉运动策略集成到TAMP决策系统,基于接触关系分解示范为原子技能,经实验验证该框架在多类任务中性能强大。

Comments 21 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25798 2026-07-29 cs.RO 新提交 57%

Transformer Transformer: A Unified Model for Motion-Conditioned Robot Co-design

Transformer Transformer:一种用于运动条件机器人协同设计的统一模型

Huy Ha, C. Karen Liu, Shuran Song

机构 * Stanford University(斯坦福大学) Columbia University(哥伦比亚大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 研究运动条件机器人协同设计问题,提出基于RoboTokens训练的Transformer Transformer统一模型,能跨实体空间和用例,通过动力学自引导优化设计,实验显示其可零样本优化,制造的优化设计大幅降低跟踪误差。

Comments 26 pages, 12 figures, 20 tables. Project page: https://transformer-transformer.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25227 2026-07-29 cs.CR cs.LG 新提交 57%

Decision-Level Hijacking: Injecting Cognitive Bias into Large Language Models via Bit-Flip Attacks

决策级劫持:通过位翻转攻击向大语言模型注入认知偏差

Yu Yan, Jiahao Chen, Siqi Lu, Yongjuan Wang, Ziming Zhao, Zhaoxuan Li, Tianyu Du, Qingjun Yuan, Shouling Ji

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 研究大语言模型在高风险决策场景中的决策级劫持问题,提出CogBias框架,利用位翻转攻击,通过可微情感评估器等将主观偏好转化为优化信号,经实验验证该方法能在少量位翻转下诱导目标主题立场转变,破坏模型价值对齐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14914 2026-07-29 cs.CV 版本更新 57%

Beyond Prompts: Unconditional 3D Inversion for Out-of-Distribution Shapes

超越提示:无条件3D反演用于分布外形状

Victoria Yue Chen, Emery Pierson, Léopold Maillard, Maks Ovsjanikov

机构 * ETH Zürich(苏黎世联邦理工学院) École Polytechnique(巴黎高等理工学院) Dassault Systèmes(达索系统)

专题命中 机器人操作 :manipulation(abstract);分类 cs.CV

AI总结 研究揭示了文本驱动生成模型在3D形状生成中的局限性,提出通过解耦几何表示与语言敏感性来提升无条件生成的鲁棒性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.11548 2026-07-29 cs.CY cs.AI cs.CL 版本更新 57%

Fairness Is Not Enough: Auditing Competence and Intersectional Bias in AI-powered Resume Screening

公平还不够:人工智能驱动的简历筛选中的能力审核与交叉性偏差

Kevin T Webster

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究对八个用于简历筛选的AI平台进行审核,通过实验发现其存在情境依赖和交叉性的种族及性别偏差,部分看似无偏差的模型无评估能力,仅公平评估不足,进而提出双重验证框架以确保AI负责任部署。

Comments 45 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18975 2026-07-29 cs.LG 版本更新 57%

Invariance Pair Guidance: Robustness to Spurious Correlations via Corrective Gradients

不变性对引导:通过校正梯度实现对抗虚假相关性的鲁棒性

Martin Surner, Abdelmajid Khelil, Ludwig Bothmann

机构 * Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.LG

AI总结 提出不变性对引导(IPG)方法,利用稀疏的反事实对和双更新机制动态校正优化轨迹,减少模型对虚假相关性的依赖,在多个数据集上验证了有效性。

Comments This version of the article has been accepted for publication, after peer review (when applicable) but is not the Version of Record and does not reflect post-acceptance improvements, or any corrections. The Version of Record is available online at: https://doi.org/10.1007/s10994-026-07092-0

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25846 2026-07-29 math.GR math.FA math.MG 新提交 50%

Ends of Uncountable Locally Finite Groups: An Analytic and Coarse Geometric Approach

不可数局部有限群的端点:一种分析与粗几何方法

Hussain AL-Rasheed

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究不可数局部有限群的端点问题,采用通过希格森冠拓扑结构的粗几何方法,借助子群不变性解释粗开闭集边界,利用相关技术实现几何刚性,得出此类群恰好有一个端点的结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25998 2026-07-29 quant-ph 新提交 50%

Observable Estimation in the Absence of Classical Verification

在没有经典验证的情况下的可观测量估计

Samantha V. Barron, Bradley Mitchell, Vinay Tripathi, Francesco Grieco, Ilan Rosen, Francesca Pietracaprina, Davide Materia, Alireza Seif, Darvin Wanisch, Ramón L. Panadés-Barrueta, Ewout van den Berg, Jay-U Chung, Andrew Eddins, Sam Ferracin, Guillermo García-Pérez, John Goold, Luke C. G. Govia, Holger Haas, Ian Hincks, Jesse C. Hoke, Zoë Holmes, Su-un Lee, Youngseok Kim, Swarnadeep Majumder, Sabrina Maniscalco, Simone Montangero, Daniel Puzzuoli, Tomaž Prosen, James Raftery, Ricardo Rivera Cardoso, Max Rossmannek, Manuel Rudolph, Brendan Saxberg, Liran Shirizly, Karthik Siva, Joshua Skanes-Norman, Ilaria Siloi, Kevin C Smith, Boris Sokolov, Maika Takita, Yanting Teng, Mao Tian Tan, Joseph Tindall, Zoltán Zimborás, Matteo A. C. Rossi, Minh C. Tran, Sergei N. Filippov, Abhinav Kandala

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究在无经典验证时如何信任量子结果,建立独立验证量子估计框架,应用于物理模型半混沌动力学,通过量子启发式实验测试假设并增强信心,还可通过操纵噪声设置精度界限,为可信量子计算提供途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25303 2026-07-29 physics.optics 新提交 50%

Resonance-Induced Sign Reversal of Optical Gradient Forces and Three-Dimensional Singularity Trapping

共振诱导的光学梯度力符号反转与三维奇点捕获

Jinsheng Lu, Soon Wei Daniel Lim, Federico Capasso

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究光频率通过共振时光学梯度力的变化,利用广义Fano线形模型定量分析,通过全波模拟验证,在此基础上实现硅纳米颗粒的三维奇点捕获,建立了控制共振系统光学力的设计原则。

Comments 6 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17351 2026-07-29 cs.CL 版本更新 50%

Physics of Language Models: Part 4.1, Architecture Design and the Magic of Canon Layers

语言模型的物理:第4.1部分,架构设计与Canon层的魔力

Zeyuan Allen-Zhu

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究提出Canon层,通过轻量级架构组件提升语言模型的推理深度和广度,验证了其在不同架构中的有效性,并展示了其在学术预训练中的潜力。

Comments V1.1 appeared in NeurIPS 2025 main conference; V2 adds GDN experiments, tightens others for a stronger, fairer comparison, and reorganizes sections; V3 adds Result 2.1 and Section 5.2 on how Canon layers improve hierarchical feature learning, from our Jan 2026 talk

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.05493 2026-07-29 physics.optics 版本更新 50%

Non-Hermitian Origin of Surface Peregrine Soliton and Its Topological Signatures

表面佩雷格林孤子的非厄米起源及其拓扑特征

Samit Kumar Gupta

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究基于标准非线性薛定谔方程的PT变体,展示复合光学介质PT对称状态下的非平凡复波现象,产生手性体孤子对和表面佩雷格林孤子,揭示其源于非厄米势与调制方案的相互作用及拓扑特征,为复杂介质中波操纵提供新思路。

Comments 7 Pages, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 16 篇

2607.25106 2026-07-29 cs.CV 新提交 83%

IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation

IMPRINT:用于长尾目标导航的图像条件查询增强

Jelin Raphael Akkara, Filippo Ziliotto, Luciano Serafini, Lamberto Ballan, Tommaso Campari

机构 * University of Padova(帕多瓦大学) Fondazione Bruno Kessler (FBK)(布鲁诺·凯斯勒基金会)

专题命中 具身导航 :navigation(title,abstract);embodied AI(abstract);分类 cs.CV

AI总结 研究针对具身人工智能中ObjectNav依赖纯文本查询可靠性低的问题,提出IMPRINT框架,用网络图像丰富文本查询改善定位,无需训练导航策略。通过新基准HSSD-rare评估,显示图像条件查询可提升导航增益,还指出下游检测质量是关键瓶颈。

Comments Accepted at the 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS). Project page: https://github.com/JelinR/IMPRINT

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25754 2026-07-29 cs.RO 新提交 79%

Cooperative Multi-UAV Navigation in Complex Environments via Systematic Multi-Agent Deep Reinforcement Learning

通过系统多智能体深度强化学习实现复杂环境下的多无人机协同导航

Yu Su, Nabil Aouf

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 针对复杂环境下多无人机协同导航面临的问题,提出多智能体深度强化学习框架,通过协同探索等方法解决,含感知、示范缓冲区和课程调度机制,能抽象特征实现跨场景转移,经仿真验证有良好性能。

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25448 2026-07-29 cs.RO 新提交 79%

Room-Mediated Co-occurrence for Zero-Shot Object-Centric Semantic Navigation via Frontier Scoring

通过前沿评分实现基于零样本目标中心语义导航的房间介导共现

Adam Scicluna, Gavin Paul, Alen Alempijevic

机构 * Robotics Institute, Faculty of Engineering and Information Technology, University of Technology Sydney (UTS)(悉尼科技大学工程与信息技术学院机器人研究所)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 研究零样本目标中心语义导航,提出通过房间词汇表介导对象关系的无需训练的管道,利用CLIP-derived的RPV计算共现,经洪水填充传播投影到值图排序前沿,相比基线提升了SR和SPL,保留可解释性与灵活性。

Comments 8 pages. Accepted to IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.21409 2026-07-29 cs.RO 版本更新 79%

DSCD-Nav: Dual-Stance Cooperative Debate for Object Navigation

DSCD-Nav: 双视角协作辩论用于物体导航

Weitao An, Qi Liu, Chenghao Xu, Jiayi Chai, Xu Yang, Kun Wei, Cheng Deng

机构 * School of Electronic Engineering, Xidian University, Xi' an 710071, China.(西安电子科技大学电子工程学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 DSCD-Nav通过双视角协作辩论机制提升机器人在部分可观测环境中的导航可靠性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25235 2026-07-29 eess.SY cs.SY 新提交 78%

Progressive Replacement Sequence Planning for Laser-Enhanced BeiDou Navigation Constellations

激光增强北斗导航星座的渐进式替换序列规划

Huan Yan, Juan A. Fraire, Ziqi Yang, Kanglian Zhao, Wenfeng Li, Jinjun Zheng, Ziyu Wang, Changgang Zheng

专题命中 具身导航 :navigation(title,abstract)

AI总结 研究北斗卫星系统早期卫星接近寿命末期,用激光卫星替换微波卫星的序列规划问题,通过建立整数线性规划模型和优先级感知搜索启发式算法,实现更优混合网络演变,为北斗替换规划提供决策支持和工程指导。

Comments 18 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25389 2026-07-29 cs.CV cs.RO 新提交 73%

HOME: Robust Hough-space Matching Method for Structured and Textureless Videos

HOME:用于结构化和无纹理视频的鲁棒霍夫空间匹配方法

Masaki Satoh

专题命中 具身导航 :robotics(abstract);robotic(abstract);分类 cs.RO、cs.CV

AI总结 针对机器人定位中基于点的特征在结构化或无纹理环境中失效的问题,提出HOME框架,将图像转换到霍夫空间,通过一维点匹配实现高效线匹配,经单应性估计验证,其匹配精度高、速度快,扩展到3D姿态估计前景广阔。

Comments 7 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18060 2026-07-29 cs.RO 版本更新 70%

RoboHarness: Memory-Driven Orchestration of Heterogeneous Robot Policies for Long-Horizon Planning

RoboHarness:用于长期规划的异构机器人策略的内存驱动编排

Jinbang Huang, Yuanzhao Hu, Zhiyuan Li, Ran Qi, Yixin Xiao, Zhanguang Zhang, Mark Coates, Tongtong Cao, Yingxue Zhang

机构 * Huawei Noah’s Ark Lab(华为诺亚方舟实验室) University of British Columbia(英属哥伦比亚大学) University of Toronto(多伦多大学) McGill University(麦吉尔大学) Labs(2012实验室)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 针对长期机器人任务需多种能力、异构策略编排难的问题,提出RoboHarness框架,通过多模态执行内存等表征策略能力边界,经内存桥接稳定策略交接,实验验证其在长期规划和分布外鲁棒性上有显著提升。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.24983 2026-07-29 cs.LG cs.AI math.OC stat.ML 新提交 62%

Generative Distributionally Robust Optimization

生成式分布鲁棒优化

Ziwei Zhang, Jonathan Yu-Meng Li, Zhihao Jin

机构 * Telfer School of Management, University of Ottawa(渥太华大学泰尔弗管理学院) Department of Electrical and Computer Engineering, Western University(西安大略大学电气与计算机工程系)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 研究提出生成式分布鲁棒优化(GDRO)框架,接受可采样条件生成器为名义模型,通过采样器-辛科恩配对限制最坏情况法则,可直接有限样本近似和可微实现,相比名义决策降低了罕见上下文库存遗憾和SocialGAN导航碰撞。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10571 2026-07-29 cs.LG cs.AI stat.ML 版本更新 62%

Learning from Local Walks on Dynamic Graphs with Bandit Feedback

从具有强盗反馈的动态图上的局部游走中学习

Sourav Chakraborty, Amit Kiran Rege, Claire Monteleoni, Lijun Chen

机构 * Department of Computer Science, University of Colorado, Boulder(科罗拉多大学博尔德分校计算机科学系) INRIA, Paris(法国国家信息与自动化研究所巴黎分部)

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 研究动态图上随机多臂强盗问题,基于滑动窗口混合识别结构条件,分析局部探索然后提交算法,建立次线性期望遗憾,还包括奖励感知策略及相关定理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22142 2026-07-29 cs.LG cs.AI 版本更新 62%

Short-Term-to-Long-Term Memory Transfer for Knowledge Graphs under Partial Observability

知识图谱下的短期到长期记忆转移:在部分可观测性下的短期到长期记忆转移

Taewoon Kim, Vincent François-Lavet, Michael Cochez

专题命中 具身导航 :navigation(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了在部分可观测性下知识图谱中的短期到长期记忆转移问题,提出了一种基于神经符号价值决策的方法,通过在长期插入前决定保留或丢弃观察到的三元组,从而提升记忆效率,并在RoomKG基准测试中优于符号和神经基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏