arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-07-08 至 2026-07-08 共收录 59 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 1 篇

2607.02205 2026-07-08 cs.RO 新提交 83%

Actuator Reality Shaping for Zero-Shot Sim-to-Real Robot Learning

执行器现实塑造:面向零样本仿真到现实机器人学习

Satoshi Yamamori, Koji Ishihara, Kenjiro Minamikawa, Ryosei Ohmori, Taiyo Yasaki, Norikazu Sugimoto, Jun Morimoto

机构 * Graduate School of Informatics, Kyoto University(京都大学信息学研究科) Dept. of Brain Robot Interface, Computational Neuroscience Labs, ATR(脑机器人接口部门,计算神经科学实验室,ATR)

专题命中 机器人学习 :robot learning(title,abstract);robotic(abstract);分类 cs.RO

AI总结 提出执行器现实塑造范式,通过物理执行器的闭环行为匹配仿真中的理想二阶参考动力学,实现零样本仿真到现实迁移,无需任务级微调或学习执行器模型。

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 17 篇

2607.06559 2026-07-08 cs.RO 新提交 92%

RynnWorld-4D: 4D Embodied World Models for Robotic Manipulation

RynnWorld-4D:用于机器人操作的4D具身世界模型

Haoyu Zhao, Xingyue Zhao, Siteng Huang, Xin Li, Deli Zhao, Zhongyu Li

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团) Hong Kong Embodied AI Lab(香港具身人工智能实验室) CUHK(香港中文大学) Hupan Lab(湖畔实验室)

专题命中 机器人操作 :manipulation(title,abstract);world model(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 研究针对开放世界机器人操作,提出RynnWorld-4D生成模型,通过RGB-DF捕捉4D动态,其具三分支架构,还整理数据集并提出RynnWorld-4D-Policy,实验证明该模型在时空预测及实际操作任务中表现出色。

Comments Project Page: https://alibaba-damo-academy.github.io/RynnWorld-4D.github.io, Github: https://github.com/alibaba-damo-academy/RynnWorld-4D

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06323 2026-07-08 cs.RO 新提交 79%

LAMP: Latent Motion Prior-Guided Real-World Learning for Dexterous Hand Manipulation

LAMP:用于灵巧手部操作的潜在运动先验引导的现实世界学习

Xinye Yang, Zhiyuan Ma, Hongze Yu, Yuanpei Chen, Yaodong Yang, Xiaojie Chai, Xinlei Chen, Chao Yu

机构 * Fudan University(复旦大学) Tsinghua University(清华大学) Peking University(北京大学) PsiBot

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 研究针对灵巧手部现实世界学习易出错的问题,提出含潜在运动先验模块的三阶段学习框架LAMP,先预训练模块,再训练视觉运动策略并通过在线残差RL改进,在真实机器人任务中取得高成功率,提升了学习效果。

Comments 17 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27239 2026-07-08 cs.RO 新提交 79%

HumanoidUMI: Bridging Robot-Free Demonstrations and Humanoid Whole-Body Manipulation

HumanoidUMI:连接无机器人示范与人形全身操作

Hongwu Wang, Chenhao Yu, Youhao Hu, Jiachen Zhang, Yuanyuan Li, Shaqi Luo

机构 * Beijing Academy of Artificial Intelligence(北京人工智能研究院)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 提出HumanoidUMI,一种便携无机器人的框架,利用VR设备和UMI夹爪收集人类关键点轨迹、腕部观察和夹爪动作,训练高层策略预测未来关键点并映射到机器人全身参考,实现人形全身技能学习。

Comments This work was intended as a replacement of arXiv:2605.03452 and any subsequent updates will appear there

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05468 2026-07-08 cs.RO cs.AI 新提交 73%

Learning 4D Geometric Priors for Inference-Efficient World Action Models

学习用于高效推理世界行动模型的4D几何先验

Jianjun Zhang, Jian Zhu, Taiyi Su, Chong Ma, Zitai Huang, Yi Xu, Hanli Wang

机构 * Midea AI Research Centers(美的人工智能研究中心)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 研究针对世界行动模型在捕捉操作所需几何信息不足的问题,提出MECo-WAM模型,通过注入4D几何先验、采用多专家协同训练等方法,在不增加推理成本的情况下提升了机器人操作性能。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06134 2026-07-08 cs.CR 新提交 67%

Poster: Mind the Gap -- Characterizing the Temporal Blind Spot Between GSB and DNS Resolution

海报:注意差距——刻画谷歌安全浏览(GSB)与域名系统(DNS)解析之间的时间盲点

Tomer Gal, Fujiao Ji, Doowon Kim, Harel Israel Berger

专题命中 机器人操作 :manipulation(abstract);navigation(abstract)

AI总结 研究刻画谷歌安全浏览与DNS解析间时间差距,通过数据包捕获分析发现约79%测量有正时间差距,DNS响应滞后,复杂解析中或有安全隐患,为研究浏览器安全机制中基于时间的风险及缓解措施奠定基础。

Comments To appear in the proceedings of the 23rd Conference on Detection of Intrusions and Malware & Vulnerability Assessment (DIMVA '26)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14048 2026-07-08 cs.CV cs.RO 新提交 62%

WAM4D: Fast 4D World Action Model via Spatial Register Tokens

WAM4D:通过空间注册令牌实现快速4D世界动作模型

Ying Li, Xiaobao Wei, Jiajun Cao, Hao Wang, Xiaowei Chi, Chengyu Bai, Qianpu Sun, Jiajun Li, Xiaojie Zhang, Peidong Jia, Jian Tang, Sirui Han, Shanghang Zhang

机构 * Peking University(北京大学) The Hong Kong University of Science and Technology(香港科技大学) Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO、cs.CV

AI总结 提出WAM4D,利用轻量级空间注册令牌将预训练几何先验迁移至因果视频-动作变换器,实现高效4D世界动作建模,在RoboTwin 2.0和真实操作任务中提升空间一致性并保持快速推理。

Comments 15 pages, 7figures, 9tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06018 2026-07-08 cs.RO 新提交 57%

RoboTALES: Learning Reasoning-Guided Robot Policies via Task-Aligned Simulated Futures

RoboTALES:通过任务对齐的模拟未来学习推理引导的机器人策略

Hanan Gani, Tejal Kulkarni, Madhoolika Chodavarapu, Nicklas Hansen, Manmohan Chandraker

机构 * University of California, San Diego(加利福尼亚大学圣地亚哥分校)

专题命中 机器人操作 :manipulation(abstract);分类 cs.RO

AI总结 针对预训练视频生成模型用于机器人策略规划的局限,提出RoboTALES框架,通过基于分层语言模型的规划器和基于视觉语言模型的评论家两大创新,学习任务对齐的模拟未来以训练机器人策略,在多样操纵任务中表现优于现有方法。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05883 2026-07-08 cs.RO 新提交 57%

DexTele: A Dual-Arm Dexterous Teleoperation System Based on Motion Retargeting and Adaptive Force Control

DexTele:一种基于运动重定向和自适应力控制的双臂灵巧遥操作系统

Yuanchuan Lai, Qing Gao, Ziyan Liang, Xianfeng Cheng, Junjie Hu, Zhaojie Ju

机构 * School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(人工智能学院,香港中文大学(深圳)) School of Computing, University of Portsmouth(计算学院,朴茨茅斯大学)

专题命中 机器人操作 :robotic(abstract);分类 cs.RO

AI总结 研究针对双臂灵巧遥操作中运动重定向和抓取的挑战,提出DexTele系统,通过视觉运动重定向模块和自适应抓取模块,结合运动图编码器、视觉语言模型等技术,实现多平台精确运动重定向与柔顺抓取。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24245 2026-07-08 cs.SE cs.AI cs.CR 新提交 57%

AutoSpec: Safety Rule Evolution for LLM Agents via Inductive Logic Programming

AutoSpec: 通过归纳逻辑编程实现LLM智能体的安全规则演化

Pingchuan Ma, Zhaoyu Wang, Zimo Ji, Yuguang Zhou, Zhantong Xue, Zongjie Li, Shuai Wang, Xiaoqin Zhang

机构 * Zhejiang University of Technology(浙江工业大学)

专题命中 机器人操作 :embodied agent(abstract);分类 cs.AI

AI总结 提出AutoSpec框架,利用归纳逻辑编程引导的CEGIS自动演化专家定义的安全规则,平衡精确率和召回率,在代码执行和具身智能体领域将F1提升至0.98和0.93,减少高达94%的误报。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13757 2026-07-08 cs.CR cs.AI 新提交 57%

SEVRA-BENCH: Social Engineering of Vulnerabilities in Review Agents

SEVRA-BENCH:审查智能体中的社会工程漏洞

Rui Melo, Riccardo Fogliato, Sean Zhou, Pratiksha Thaker, Zhiwei Steven Wu

机构 * Carnegie Mellon University(卡内基梅隆大学) Microsoft Core AI(微软核心人工智能) Amazon AWS(亚马逊AWS) Databricks

专题命中 机器人操作 :manipulation(abstract);分类 cs.AI

AI总结 提出SEVRA-BENCH基准,通过社会工程攻击框架评估LLM代码审查智能体拒绝恶意PR的能力,发现闭源与开源模型间存在显著安全差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05989 2026-07-08 cs.CR 新提交 50%

ProvICS: A Provenance-based Intrusion Detection for Industrial Control Systems

ProvICS:一种基于溯源的工业控制系统入侵检测方法

Md Neyamul Islam Shibbir, Deepak K Tosh

专题命中 机器人操作 :manipulation(abstract)

AI总结 针对工业控制系统因信息技术与运营技术融合面临多阶段网络攻击,且基于溯源的入侵检测系统在工业网络物理系统中适用性待探索的问题,提出ProvICS多模态溯源数据集,经实验验证其能有效检测攻击事件,填补现有基准空白。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05907 2026-07-08 cs.LO cs.FL 新提交 50%

Teaching LTL and ω-automata with Spot

使用Spot教授线性时态逻辑和ω自动机

Alexandre Duret-Lutz

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究如何利用Spot库教授线性时态逻辑和ω自动机,核心方法是借助其可视化能力与Python接口,主要贡献是为相关教学提供了有吸引力的平台。

Comments Demonstration for TEAL'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05776 2026-07-08 cs.DC 新提交 50%

Layer 2 Coordinated Trusted Setup for Continuous CRS Generation

用于连续CRS生成的第2层协调可信设置

Khalid Hassan, Sara Rouhani

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究零知识证明系统中连续CRS生成问题,提出L2协调框架,设计并实现基于PBFT协调的ZK-rollup架构的两个协议变体,通过实验证明该架构能可靠完成连续设置并保持L2交易吞吐量稳定。

Comments This paper has been accepted in "The 2nd IEEE 2026 International Conference on Cybersecurity and AI-Based Systems (Cyber-AI 2026)"

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05423 2026-07-08 cs.GT 新提交 50%

Optimism as a Vulnerability: Deceptive Stackelberg Control of UCB Bandit Followers

作为一种脆弱性的乐观主义:UCB 策略跟随者的欺骗性斯塔克尔伯格控制

Şuayp Talha Kocabay, Kerem Yalçın, Talha Rüzgar Akkuş

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究有限 horizon 重复斯塔克尔伯格博弈中 UCB 策略跟随者面对领导者的情况,提出欺骗性领导者机制,通过蜜罐和陷阱阶段操控,使领导者累积效用超经典 SSE 上限,且操纵成本有界,揭示静态与动态激励的不兼容性。

Comments Accepted to the NExT-Game Workshop (New Frontiers in Game-Theoretic Learning) at ICML 2026. To be presented July 11, 2026, Seoul, South Korea

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06040 2026-07-08 quant-ph cs.ET 新提交 50%

Hybrid quantum floating-point method for sharp arithmetic

用于精确算术的混合量子浮点方法

Gabriele Agliardi, Enrico Prati

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究如何在量子态中编码随机变量,提出混合量子 - 经典的量子浮点表示方法,结合量子与经典寄存器,定义运算确保无溢出,利用经典信息减少精度下降,在相关算法和算术电路设计上取得进展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05867 2026-07-08 physics.app-ph 新提交 50%

Shape Ultrasound with Dynamic Microfluidic Lenses

利用动态微流体透镜实现超声形状控制

Dajun Zhang, Hyunji Shim, Michael Ferolito, Feng Ye, Hongrui Jiang, Chu Ma

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究利用微流体超声透镜系统实现超声场可重构空间调制,通过FPGA控制微泵填充不同液体生成相位模式,集成微流体透镜与单元素换能器展示多种功能,确立了微流体相位调制用于动态超声场控制的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05684 2026-07-08 physics.optics 新提交 50%

Funneling and Sculpting of Optical Waves Through Non-Magnetic Metasurfaces

通过非磁性超表面对光波进行漏斗效应和塑形

Nasim Mohammadi Estakhri, Nooshin M. Estakhri

专题命中 机器人操作 :manipulation(abstract)

AI总结 研究如何通过非磁性超表面实现光波的漏斗效应和塑形,采用基于电磁厚自对偶超表面的非共振方法,满足自对偶条件实现阻抗匹配传播与无反射能量转移,为电磁能量路由和限制提供策略,有广泛潜在应用。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 8 篇

2607.05765 2026-07-08 cs.CV cs.RO 新提交 81%

Image2Sim: Scaling Embodied Navigation via Generative Neural Simulator

Image2Sim:通过生成神经模拟器扩展具身导航

Zihan Wang, Seungjun Lee, Yinghao Xu, Gim Hee Lee

机构 * National University of Singapore(新加坡国立大学) HKUST(香港科技大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.CV

AI总结 研究针对具身导航缺乏优质交互环境的问题,提出Image2Sim实时神经模拟框架,通过解耦3D空间锚定与观察合成构建环境,能大规模生成相关数据,训练的导航模型在基准测试中有提升且可迁移,为具身导航提供实用训练基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05794 2026-07-08 cs.AI 新提交 79%

From Passive Retrieval to Active Memory Navigation: Learning to Use Memory as a Structured Action Space

从被动检索到主动记忆导航:学习将记忆用作结构化动作空间

Yue Xu, Yutao Sun, Yihao Liu, Mengyu Zhou, Jiayi Qiao, Lu Ma, Kai Tang, Wenjie Wang, Xiaoxi Jiang, Guanjun Jiang

机构 * Alibaba(阿里巴巴) ShanghaiTech University(上海科技大学) Zhejiang University(浙江大学) Peking University(北京大学) National University of Singapore(新加坡国立大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 研究针对个性化对话代理中记忆系统的被动性问题,提出NapMem框架,将用户记忆组织成多粒度金字塔并通过工具暴露层次,经记忆工具强化学习训练智能体,在多任务实验中具竞争力,还进行了多方面分析,证明结构化存储与策略结合对长期用户记忆有益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06248 2026-07-08 cs.RO 新提交 70%

RoboVAST: Automated Scenario-Based Validation of Robots at Scale

RoboVAST:大规模基于场景的机器人自动验证

Frederik Pasch, Samuel Wiest, Argentina Ortega, Nico Hochgeschwender

机构 * Karlsruhe University of Applied Sciences(卡尔斯鲁厄应用技术大学) University of Bremen(不来梅大学)

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 研究针对机器人系统验证中场景选择和变化的问题,提出基于场景的方法并引入RoboVAST框架,通过导航数据集演示,可实现声明式规范、插件式场景生成及可扩展执行,能区分系统故障与随机异常。

Comments 8 pages, 4 figures, submitted to CASE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06123 2026-07-08 cs.RO 新提交 57%

MP-MPPI: A Motion Primitive Guided Sampling-Based Optimizer for Model Predictive Control

MP-MPPI:一种用于模型预测控制的基于运动原语引导采样的优化器

Marlon Mathisen, Aksel Vaaler, Olav Egeland, Eleni Kelasidi

机构 * Norwegian University of Science and Technology(挪威科技大学)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 提出MP-MPPI方法,通过运动原语扩展MPPI进行结构化采样,增强收敛。在实时采样优化循环中评估相关序列,解决路径规划局限。在四旋翼模拟器及导航任务中测试,增强控制空间探索且保持实时控制特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05451 2026-07-08 cs.RO cs.HC 新提交 57%

Quaternion-Averaging-Based Adaptive Complementary Filter for Pedestrian Dead Reckoning With a Foot-Mounted AHRS

基于四元数平均的自适应互补滤波器用于带足部安装AHRS的行人航位推算

Shunsei Yamagishi, Lei Jing

机构 * Graduate School of Computer Science and Engineering, The University of Aizu(日本会津大学计算机科学与工程研究生院)

专题命中 具身导航 :navigation(abstract);分类 cs.RO

AI总结 针对基于足部安装AHRS的行人航位推算,提出基于四元数平均的自适应互补滤波器QAACF,通过融合多源四元数并自适应调整权重,在降低计算成本的同时提高估算精度,相比现有滤波器有更低均方根误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05764 2026-07-08 cs.CL cs.IR 新提交 50%

Inject or Navigate? Token-Efficient Retrieval for LLM Analysis of Transactional Legal Documents

注入还是导航?用于交易法律文件大语言模型分析的令牌高效检索

Mahmoud Hany, Mourad ElSheraey, Mahmoud Said, Peter Naoum

机构 * Syntheia Pty Ltd(合成有限公司)

专题命中 具身导航 :navigation(abstract)

AI总结 研究如何在交易法律文件分析中高效检索,对比全语料库注入与两种结构化检索模式(NAVEMBED和NAVINDEX),发现NAVINDEX在令牌占用、上下文及成本方面优势明显,还得出缓存交叉规则。

Comments 17 pages, 2 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05415 2026-07-08 cs.CR stat.AP 新提交 50%

How Stable Is a PNT Resilience Score? Decision-Instability of Single-Number Resilience Ratings under Framework-Aligned Weighting

PNT 弹性评分有多稳定?框架对齐加权下单数弹性评级的决策不稳定性

Chakshu Baweja

专题命中 具身导航 :navigation(abstract)

AI总结 研究 PNT 弹性评分稳定性,构建评分引擎生成子分数,探讨综合分数或成熟度等级能否作为决策稳定基础。发现综合获胜者在特定条件下稳定,重新加权会使其翻转,类别性存在问题,还指出 GNSS 冗余等情况,结论在一定扰动下成立并报告子分数。

Comments 6 pages, 5 figures, 1 table. Open-source scoring engine, study artifact, and figure pipeline (AGPL-3.0); deterministic (fixed seed). Aligned to DHS RPCF v2.0; a simulation-derived self-assessment, not a certification

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06212 2026-07-08 astro-ph.EP astro-ph.IM cs.SY eess.SP eess.SY 新提交 50%

The Cost of Lunar South-Polar Geometry, and Surface Beacons as the Efficient Fix: A Dilution-of-Precision Analysis

月球南极几何结构的代价以及作为有效定位方法的地面信标:精度稀释分析

Chakshu Baweja

专题命中 具身导航 :navigation(abstract)

AI总结 研究月球南极PNT架构,发现仅靠卫星达到良好几何结构所需数量远超计划,而少量地面测距信标可低成本实现,通过提供近地平线多样性大幅降低GDOP,是该区域PNT成本最低、影响力最大的改进。

Comments 8 pages, 1 figure, 2 tables. Part of the kshana open PNT program

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 6 篇

2607.06401 2026-07-08 cs.AI 新提交 83%

A Definition and Roadmap for World Models

世界模型的定义与路线图

Xinyuan Chen, Haoyu Guo, Shi Guo, Bingqi Jiang, Chunhua Shen, Xing Shen, Tianfan Xue, Yufei Xue, Mulin Yu, Weinan Zhang, Bin Zhao, Bowen Zhou, Ming Zhou

机构 * Shanghai AI Laboratory(上海人工智能实验室)

专题命中 具身推理 :world model(title,abstract);robotics(abstract);分类 cs.AI

AI总结 本文针对人工智能领域对世界模型定义、预测内容及构建方式缺乏共识的问题,给出科学定义,讨论关键技术,提供分阶段路线图,以助力有效世界模型的开发。

Comments Technical report, 58 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05352 2026-07-08 cs.CV cs.AI cs.LG 新提交 82%

Multiplayer Interactive World Models with Representation Autoencoders

基于表示自编码器的多智能体交互世界模型

Anthony Hu, Václav Volhejn, Adrien Ramanana Rahary, Chris Mulder, Aditya Makkar, Alyx Liao, Amélie Royer, Manu Orsini, Adam Jelley, Eloi Alonso, Florian Laurent, Fredrik Norén, James Swingos, Jan Hünermann, Kent Rollins, Lucas Hosseini, Matthieu Le Cauchois, Maxim Peter, Pim de Witte, Tim Brown, Vincent Micheli, Moritz Böhle, Gabriel de Marmiesse, Viktoriia Sharmanska, Lucia Specia, Michael Black, Patrick Pérez

机构 * Epic Games École nationale des ponts et chaussées(法国国家桥梁与道路学院)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.CV、cs.LG

AI总结 针对复杂物理交互的高动态环境,该研究提出首个多智能体世界模型,以多智能体动作流为条件训练隐扩散模型,可实时生成稳定长时四智能体对局,开源相关资源。

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.05577 2026-07-08 cs.AI cs.CL cs.IR 新提交 79%

Narrative World Model: Narratology-Grounded Writer Memory for Long-Form Fiction

叙事世界模型:基于叙事学的长篇小说作者记忆

Mohammad Saifullah, Thomas Kornmaier, Taaha Kazi, Vasu Sharma, Aditya Sanjiv Kanade, Aanand Kumar Yadav

机构 * PocketFM(口袋FM)

专题命中 具身推理 :world model(title,abstract);分类 cs.AI

AI总结 研究针对长篇小说作者记忆问题,提出叙事世界模型(NWM),结合叙事学时间状态图与查询条件混合检索,在多跳叙事学问答上显著优于基线,优势源于其独特表征,非提取方式。

Comments 23 pages, 4 figures; 9-page main text plus appendix. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06165 2026-07-08 cs.RO 新提交 70%

EAGOR: Embodied Reasoning in Omni-direction

EAGOR:全方位的具身推理

Shriram Damodaran, Soumyaratna Debnath, Yan Wu, Wei-Yun Yau, Addison Lin Wang

机构 * EmPACT Lab, NTU Singapore Institute for Infocomm Research, A*STAR Singapore(EmPACT实验室,南洋理工大学信息与通信研究所,A*STAR新加坡)

专题命中 具身推理 :embodied agent(abstract);navigation(abstract);分类 cs.RO

AI总结 研究针对现有视觉语言模型在处理360°观测时方向估计不一致的问题,提出无需训练的几何感知框架EAGOR,将方向推理表述为球面上的递归贝叶斯估计,引入球谐信念场,实验证明其性能优于现有方法。

Comments 12 Pages, 7 Figures, 4 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏