arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-27 至 2026-07-27 共收录 40 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 3 篇

2607.22225 2026-07-27 cs.RO 新提交 83%

Safe Learning Predictive Control for Ego-World Robotic Systems

自我世界机器人系统的安全学习预测控制

Davide Valenti, Giuseppe Notarstefano

机构 * University of Bologna(博洛尼亚大学)

专题命中 机器人学习 :robotic(title,abstract);navigation(abstract);分类 cs.RO

AI总结 针对自我世界机器人框架,提出SOWL-MPC策略,结合基于稀疏变分高斯过程的在线学习机制与滚动时域控制方案,依靠噪声测量推断潜在世界策略后验分布,经实验验证该策略可实现自我机器人安全机动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22434 2026-07-27 cs.RO cs.AI 新提交 81%

Robot Learning to Communicate through Projected Visual Abstractions

机器人通过投影视觉抽象进行通信学习

Danyang Yan, Boyuan Wang, Jiaxun Liu, Boyuan Chen

机构 * Duke University(杜克大学)

专题命中 机器人学习 :robot learning(title);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究让机器人通过投影视觉抽象通信,提出含21自由度灵巧手和影子自我模型的系统,能动态表达影子。通过自我探索学习映射,依目标优化配置,经模拟获可行运动,还引入多种优化,在多场景展示影子表达,建立相关框架。

Comments Our project website is at:https://generalroboticslab.com/shadow

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21655 2026-07-27 cs.RO cs.CL 新提交 79%

Progress Reward Modeling for Robotic Learning: A Comprehensive Survey

机器人学习中的进度奖励建模:全面综述

Jianshu Zhang, Keliang Wu, Haoran Lu, Anbang Liu, Ce Zhang, Weijie Yin, Chengxuan Qian, Xiyuan Yang, Zhenyu Pan, Guo Ye, Han Liu

机构 * Northwestern University(西北大学) Carnegie Mellon University(卡内基梅隆大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) University of California, Santa Barbara(加利福尼亚大学圣塔芭芭拉分校) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 机器人学习 :robotic(title,abstract);分类 cs.RO

AI总结 该综述针对机器人学习中进度奖励建模缺乏共享框架的问题,分三步组织领域研究,包括研究进度模型接口、构建信号方法及支持数据基准,将模型相关要点联系起来,还总结了局限并探讨未来方向。

Comments Project page: https://github.com/sterzhang/Awesome-Progress-Models

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 16 篇

2607.22530 2026-07-27 cs.RO 新提交 89%

ViTacWorld: Scaling Visuo-Tactile World Models for Contact-Rich Robot Manipulation

ViTacWorld:用于丰富接触式机器人操作的视觉-触觉世界模型扩展

Yunao Huang, Shiyu Sang, Haotao Lu, Suting Ni, Shijie Wu, Ziyang Guo, Ye Shi, Jingya Wang

机构 * ShanghaiTech University(上海科技大学) InstAdapt

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robot learning(abstract);分类 cs.RO

AI总结 研究针对丰富接触式机器人操作中视觉-触觉学习扩展难的问题,提出ViTacWorld模型,利用真实和模拟数据预训练并微调,能根据机器人动作预测视觉与触觉反馈,实现动作条件策略评估,提升策略性能。

Comments 18 pages, 6 figures, 5 tables. Project page: https://vitacworld.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22535 2026-07-27 cs.RO cs.CV 新提交 86%

Robot-Factored World Models via Robot Rendering

通过机器人渲染实现机器人因素分解的世界模型

Byungjun Kim, Taeksoo Kim, Hyunsoo Cha, Hanbyul Joo

机构 * Seoul National University(首尔国立大学)

专题命中 机器人操作 :world model(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.RO、cs.CV

AI总结 研究动作条件视频世界模型,提出机器人因素分解的世界模型,通过动作实现和机器人渲染将特定机器人因素移出模型,解决深度模糊问题,实验表明其优于基线且能推广,还能从人类演示生成机器人操作视频。

Comments Project Page: https://bjkim95.github.io/rofacto/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22119 2026-07-27 cs.RO cs.AI cs.LG 新提交 82%

One Hand Watches The Other: Dynamic Multi-Agent Cooperation for Sample-Efficient Bimanual Manipulation in Dynamic Environments

一只手注视着另一只手:动态环境中用于高效样本双机器人操作的动态多智能体协作

Jan Ole von Hartz, Abhinav Valada, Joschka Boedecker

机构 * University of Freiburg(弗莱堡大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 研究动态环境中双机器人操作问题,提出轻量级DynaMAC框架,将相对手臂视为动态任务参数,解决因果限制,保留多流策略优势。通过DynaBench基准测试,性能远超基线,能零样本泛化,简化数据收集,为人机协作助力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22020 2026-07-27 cs.RO 新提交 79%

Embodying Multi-Hand Manipulation Policies by Searching the Assignment and Null Spaces

通过搜索分配空间和零空间来体现多手操作策略

Yorai Shaoul, Jiaoyang Li, Maxim Likhachev

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究多臂机器人执行操作策略的问题,基于冲突搜索构建框架,通过搜索轨迹分配空间和零空间,统一处理分配与零空间运动,有效解决多手操作策略执行难题,实现多臂机器人协调操作。

Comments Published in SoCS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21951 2026-07-27 cs.IR cs.CR 新提交 78%

SIREN (Luring LLMs onto the Rocks): PAIR-Driven Preference Manipulation in Web-RAG Recommenders

SIREN(诱使大语言模型陷入困境):网页增强型大语言模型推荐系统中基于配对驱动的偏好操纵

Evan Caville, Siamak Layeghy, Billy Sung, Sara Dolnicar, Marius Portmann

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 研究网页增强型大语言模型推荐系统中排序推荐的对抗操纵问题,提出SIREN方法,利用23种内容中毒技术迭代编辑检索到的网页,在两个Claude模型上实验,使选定实体多次达排名第1,验证了声明性排名等方式的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22355 2026-07-27 cs.CV cs.AI 新提交 62%

SiPhy: Single-Image Physical Property Reasoning

SiPhy:单图像物理属性推理

Hoang Le, Joonwoo Kwon, Elkhan Ismayilzada, Yufei Zhang, Zijun Cui

机构 * Michigan State University(密歇根州立大学)

专题命中 机器人操作 :embodied AI(abstract);分类 cs.AI、cs.CV

AI总结 研究从单图像推断物理属性,核心方法是引入SiPhy框架,将视觉线索与材料知识对齐,通过采样、提取特征等操作及对比聚合器、重量感知细化来实现。在多个数据集上取得领先性能,还验证了其在真实交互数据集上作为数据标注引擎的潜力。

Comments Accepted to ECCV 2026 (main track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21820 2026-07-27 cs.SD cs.AI cs.CR cs.LG 新提交 62%

Probing Speaker Identity Sensitivity in Audio Deepfake Detectors

探究音频深度伪造检测器中的说话者身份敏感性

Daniyal Kabir Dar, Arun Ross

机构 * Michigan State University(密歇根州立大学)

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI、cs.LG

AI总结 研究音频深度伪造检测器对说话者身份的敏感性问题,提出身份敏感性分数(ISS),该方法无需真实标签,通过计算检测器分数变化量化身份敏感程度,能有效预测错误分类,为基于说话者的故障分析提供实用诊断。

Comments Accepted at IEEE/IAPR International Joint Conference on Biometrics (IJCB) 2026. 8 pages, 3 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22483 2026-07-27 cs.RO 新提交 57%

Plug, Play, and Comply: A Modular Framework for Online Variable Impedance with Arbitrarily Oriented Compliance Axes

即插即用且合规:具有任意定向柔顺轴的在线可变阻抗模块化框架

Mihael Simonič, Xiaocong Li

机构 * College of Information Science and Technology, Eastern Institute of Technology(信息科学与技术学院,东方理工学院) Zhejiang Key Laboratory of Industrial Intelligence and Digital Twin, Eastern Institute of Technology(浙江省工业智能与数字孪生重点实验室,东方理工学院)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 该论文提出与机器人无关的柔顺控制框架,通过插件架构分离控制器与控制律,标准化接口支持多种控制公式。其参考笛卡尔阻抗控制器可在线更新柔顺方向,实验和仿真验证了在不同操纵器上的任务相关柔顺性及可移植性。

Comments 8 pages, 7 figures, 2 tables. Paper page: https://smihael.github.io/plug-play-comply/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22320 2026-07-27 cs.RO 新提交 57%

A Monolithic Hand with Asymmetric Origami Bending and Dual-chamber Actuators

一种具有非对称折纸弯曲和双腔致动器的一体式手

Nan Huang, Yuming Zhu, Zicong Zhang, Jianhui Liu, Xiaohuang Liu, Dihan Liu, Jiansheng Dai, Sicong Liu

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 研究提出非对称折纸弯曲模式和非对称双腔设计,构成OSOR手的手指和手掌致动器,在一体式结构中实现仿生运动与足够输出性能,简化制造,经实验验证,其弯曲范围和输出力达标,能完成多种抓握动作,为软机器人手发展带来新可能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22249 2026-07-27 cs.RO 新提交 57%

Design and Human Evaluation of Tactile Withdrawal Reflexes for a Skin-Covered Robot Arm

用于皮肤覆盖机器人手臂的触觉退缩反射的设计与人体评估

Laura Babayeva, Lukas Rustler, Matej Hoffmann

机构 * Department of Cybernetics, Faculty of Electrical Engineering, Czech Technical University in Prague(布拉格捷克技术大学电气工程学院控制论系)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 研究机器人手臂人工伤害感受,提出将压力变化映射到退缩动作的流程,比较三种反射。通过用户研究发现均匀反射在多项指标上获高评价,表明行为可预测性对用户接受很关键,笛卡尔反射被认为最适合触摸,生物启发反射表现不佳。

Comments Submitted to IEEE Humanoids 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21600 2026-07-27 cs.AI 新提交 57%

Securing Multimodal AI through Internal Information Decomposition

通过内部信息分解保护多模态人工智能

Jehyeok Yeon, Hyeonjeong Ha, Qiusi Zhan, Heng Ji

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 研究多模态大语言模型的攻击问题,提出FlowGuard框架,通过监测内部多模态一致性检测有害输入,受部分信息分解启发得出FlowVectors量化相关指标,有效降低攻击成功率且减少效用损失和延迟,为多模态推理提供有效防御。

Comments Accepted as Spotlight Paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22466 2026-07-27 quant-ph physics.atom-ph physics.optics 新提交 50%

Multiplexed storage and interaction of Rydberg spinwaves via the gradient echo memory protocol

通过梯度回波记忆协议实现里德堡自旋波的复用存储和相互作用

Bartosz Niewelt, Stanisław Kurzyna, Bartosz Kasza, Wojciech Wasilewski, Michał Parniak

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究里德堡激发与GEM协议集成受运动去相阻碍的问题,提出新型多光子寻址和接口方案,通过特定驱动场延长里德堡自旋波寿命,实现多模量子存储器中长寿命自旋波的存储、操纵及相互作用控制,为相关应用提供途径。

Comments 12 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22296 2026-07-27 cond-mat.str-el quant-ph 新提交 50%

Unconventional $\mathbb{Z}_2\times\mathbb{Z}_2\times\mathbb{Z}_2$ topological order in the kagome XY toric code

非传统 $\mathbb{Z}_2\times\mathbb{Z}_2\times\mathbb{Z}_2$ 拓扑序在 kagome XY 顶点码中

C. Kölbl, M. Vieweg, K. P. Schmidt

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究揭示了kagome XY顶点码在特定条件下实现非传统的$\mathbb{Z}_2\times\mathbb{Z}_2\times\mathbb{Z}_2$拓扑序,并提出CSS拓扑稳定符码用于拓扑量子信息的编码和操控。

Comments 11 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21891 2026-07-27 cond-mat.mtrl-sci 新提交 50%

Enhanced Curie temperature and room-temperature 50-nm skyrmions achieved in hexagonal ferromagnet Mn5Ge3+x synthesized via a high-pressure method

通过高压法合成的六方铁磁体Mn5Ge3+x实现居里温度的提高和室温下50nm斯格明子的形成

Yongsen Zhang, Wei Liu, Meng Shi, Shuisen Zhang, Sheng Qiu, Yaodong Wu, Jialiang Jiang, Huanhuan Zhang, Hui Han, Kang Wang, Dingfu Shao, Zhenfa Zi, Chao Ma, Haifeng Du, Mingliang Tian, Shouguo Wang, Jin Tang

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究通过高压合成技术提高Mn5Ge3+x晶体居里温度,实现室温下50nm斯格明子的稳定性,利用微磁模拟和磁输运测量等方法,展现其在自旋电子器件应用中的潜力,包括对单个斯格明子的电学操纵和检测。

Journal ref Sci. China Phys. Mech. Astron. 69, 247511 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21889 2026-07-27 cond-mat.mes-hall cond-mat.mtrl-sci 新提交 50%

Current-induced creation and dynamics of embedded magnetic skyrmion bags

电流诱导的嵌入式磁斯格明子袋的产生与动力学

Yaodong Wu, Jialiang Jiang, Lingyao Kong, Meng Shi, Shouguo Wang, Mingliang Tian, Haifeng Du, Jin Tang

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究在零磁场下通过直流电流在FeGe纳米板中诱导形成和操纵嵌入式斯格明子袋,利用原位洛伦兹透射电子显微镜观察转变过程,经理论分析确定驱动机制,还展示不同Q值斯格明子袋间电诱导转变,为全电控制拓扑自旋纹理和缺陷奠定基础。

Journal ref Nature Communications 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22229 2026-07-27 astro-ph.IM 新提交 50%

HARMONI at ELT: LPOU calibrations for a micron-level pointing accuracy

甚大望远镜上的HARMONI:用于微米级指向精度的LPOU校准

Gonzalo José Carracedo Carballal, Irene Ferro Rodríguez, David L King, Iago Funes Vecino, Guillermo Mercant Rubio, Alonso Álvarez Urueña, Laura García Moreno, Heribert Argelaguet Vilaseca, Javier Piqueras López, Chiara Cerruti

专题命中 机器人操作 :robotic(abstract)

AI总结 研究HARMONI在甚大望远镜上为达微米级指向精度的校准问题,核心方法是探讨靠近引导探头插入校准掩膜及添加重新聚焦光学元件的可能性,主要贡献是分析其不同变体对图像质量及定位误差分辨能力的影响并经模拟验证。

Comments 7 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 9 篇

2607.22226 2026-07-27 cs.RO 新提交 83%

Offline Vision-Language Navigation with Geometric Goal Localization for Outdoor Environments

用于户外环境的基于几何目标定位的离线视觉语言导航

Ali Salmasi, Xianjia Yu, Tomi Westerlund

专题命中 具身导航 :navigation(title,abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对户外环境下的离线视觉语言导航,通过对17个可边缘部署的SLM与4个在线API进行基准测试,提出轻量级混合语义几何目标定位框架并集成到Edge-BehAV中,提升了性能,降低目标距离误差,实现无网络连接下的有效导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21964 2026-07-27 cs.RO cs.AI 新提交 81%

ACME: A Multi-Cultural, Multi-Embodiment Social-Navigation Dataset

ACME:一个多文化、多实体的社会导航数据集

Shashank Rao Marpally, Allan Wang, Atharva Ghotavadekar, Renato Alexandre Ribeiro, Nhat Le, Pilar Bachiller-Burgos, Pranav Goyal, Subham Agrawal, Yasuhiro Nitta, Howard Ziyu Han, Daeun Song, Masaki Kuribayashi, Kohei Uehara, Xiyue Wang, Yangzhe Kong, Duc M. Nguyen, Amirreza Payandeh, Gerardo Pérez-González, Alejandro Torrejón-Harto, Jeeho Ahn, Tisha Jain, Andrew Stratton, Elvin Yang, Jorge de Heuvel, Nico Ostermann-Myrau, Sai Anudeep Sajja, Mithilya Raj, Daisuke Sato, Gaston Rouquette, Nikolas Martelaro, Maki Sugimoto, Hironobu Takagi, Chieko Asakawa, Maren Bennewitz, Aaron Steinfeld, Xuesu Xiao, Christoforos Mavrogiannis, Harold Soh

机构 * School of Computing, National University of Singapore(新加坡国立大学计算学院)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 该研究针对现有社会导航数据集缺乏文化等多样性的问题,引入ACME数据集,通过多国多地多机器人实体大规模收集数据,提供多种数据便于学习与预测,经分析其能捕捉更具挑战场景及更广泛行人行为。

Comments 24 Pages, 19 Figures, Submitted to IJRR on June 29th 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21944 2026-07-27 cs.HC 新提交 78%

VisionPulse: A Virtual Reality System Enabling Accessible Discovery and Navigation for Blind and Low Vision Users

VisionPulse:一个为盲人和低视力用户实现无障碍发现与导航的虚拟现实系统

Samuel Martin, Pooyan Fazli, Hasti Seifi

专题命中 具身导航 :navigation(title,abstract)

AI总结 研究针对盲人和低视力用户在VR中自由探索受限的问题,提出VisionPulse系统,让用户通过自然动作和多模态反馈探索虚拟环境,经实验验证该系统受用户青睐,为包容性VR设计提供了参考。

Comments accepted to ACM ASSETS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21945 2026-07-27 math.OC 新提交 78%

Strategic Inference of Adversarial Navigation Objectives for Unmanned Underwater Vehicles

无人水下航行器对抗导航目标的策略推理

Ruimeng Hu, Xu Yang

专题命中 具身导航 :navigation(title,abstract)

AI总结 研究无人水下航行器对抗导航目标推理,推导连续时间似然模型及相关估计器,分析费希尔信息敏感性,建立流场几何与目标可识别性联系,扩展框架到依赖扫描观测模型并进行数值实验验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22166 2026-07-27 cs.RO cs.AI 新提交 62%

Learning Spatiotemporal Decision Priors for Efficient Path Planning under Partial Observability

学习时空决策先验以实现部分可观测性下的高效路径规划

Yi Liu, Hongda Zhang, Leyao Zou, Chunlei Meng, Ziqing Zhou, Yuning Chen, Zhuo Zou, Lida Xu, Zhongxue Gan, Chun Ouyang

机构 * College of Intelligent Robotics and Advanced Manufacturing, Fudan University(智能机器人与先进制造学院,复旦大学) School of Information Science and Technology, Fudan University(信息科学与技术学院,复旦大学) Department of Information Technology, Old Dominion University(信息技术系,老 Dominion 大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO、cs.AI

AI总结 研究部分可观测性下的路径规划问题,提出ImiPath框架,从示范轨迹提炼时空决策先验,经局部时空观测表示和时空注意力策略网络转换为决策先验并纳入异构规划器,提升路径质量与搜索效率,验证了框架的适应性和实际部署潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22123 2026-07-27 cs.RO 新提交 57%

DB-VIO: Dual-Branch Visual Inertial Odometry with Enhanced Visual-Inertial Representation

DB-VIO:具有增强视觉惯性表示的双分支视觉惯性里程计

Ziyu Wan, Lin Zhao

机构 * National University of Singapore(新加坡国立大学)

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 研究针对视觉惯性里程计问题,提出DB-VIO双分支框架,通过融入深度线索、姿态先验和解耦姿态估计进行运动特定时间建模,实验表明该方法在自动驾驶和空中机器人基准测试中性能优异,提升了旋转和平移估计精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21611 2026-07-27 cs.HC cs.AI 新提交 57%

A Systematic Survey on Image Description Techniques for STEM Domains

关于STEM领域图像描述技术的系统综述

Marco Cardia, Letizia Angileri, Marina Buzzi, Giulio Galesi, Barbara Leporini

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 综述20项关于AI描述STEM视觉的研究,关注可及性和人机交互。分析目标视觉类型等多方面内容,指出从静态转向交互式多模态系统,同时存在事实不准确等挑战,最后概述人机交互关键研究方向。

Comments This is the Author's Original Manuscript of an article accepted for publication in International Journal of Human-Computer Interaction, published by Taylor and Francis. The Version of Record is available at DOI 10.1080/10447318.2026.2668031

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22357 2026-07-27 eess.SP 新提交 50%

Uncertainty-Aware Fusion for Resilient Distributed Radar Sensing

用于弹性分布式雷达传感的不确定性感知融合

Christian Eckrich, Maik Pfefferkorn, Rolf Findeisen, Abdelhak M. Zoubir, Vahid Jamali

专题命中 具身导航 :robotic(abstract)

AI总结 研究移动智能体中FMCW雷达与静态雷达传感器融合以降目标状态估计不确定性问题,通过坐标变换等推导出CRLB,揭示更新率与量化保真度权衡,数值模拟表明选参数对降不确定性很关键。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21679 2026-07-27 astro-ph.SR astro-ph.GA astro-ph.IM physics.hist-ph 新提交 50%

Echoes of Star Stories: Integrating Indigenous narratives into modern stellar astrophysics

星际故事的回响:将本土叙事融入现代恒星天体物理学

Dionysios Gakis

专题命中 具身导航 :navigation(abstract)

AI总结 研究探讨将澳大利亚原住民、普韦布洛人等不同本土社区的叙事融入现代恒星天体物理学,强调其与现代模型的关联,通过跨文化合作整合传统,以丰富教育、公众参与并激发科学假设,架起文化与科学的桥梁。

Comments 7 pages, accepted for publication in Proceedings of Oxford XIII / IAU Symposium 399

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 3 篇

2607.21686 2026-07-27 cs.AI 新提交 79%

Persistent Computational State: A Session-Centric Runtime for Generative World Models

持久计算状态:用于生成式世界模型的以会话为中心的运行时

Zhen Lin

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究发现当前视频世界模型用作模拟器失败的归因不完整,定义了持久计算状态(PCS),构建以会话为中心的运行时,通过测量发现PCS,实现低检查点和恢复成本以及新的内存管理方式。

Comments 29 pages, 8 figures, 10 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22000 2026-07-27 cs.SD 新提交 78%

Music-JEPA: Learning a World Model of Sound from Action

Music-JEPA:从动作中学习声音的世界模型

Ziyu Wang, Kun Fang, Yann LeCun

专题命中 具身推理 :world model(title,abstract)

AI总结 研究提出Music-JEPA,将音乐构建为动作条件系统,用JEPA学习钢琴声音世界模型,在离线状态下用配对数据训练。实验表明模型能捕捉音乐动作与声音关系,其表示支持下游任务并能通过规划实现钢琴转录。

详情

展开后加载摘要…

URL PDF HTML 收藏