arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

视觉与机器人

世界模型

面向环境建模、时序预测、仿真规划、具身智能和自动驾驶的世界模型方法与应用。

2026-07-17 至 2026-07-17 共收录 6 信号源:cs.AI, cs.LG, cs.CV, cs.RO, cs.MA

1. 通用世界模型 4 篇

2607.14180 2026-07-17 cs.LG cs.AI 新提交 94%

RENEW: Towards Learning World Models and Repairing Model Exploitation from Preferences

RENEW:迈向从偏好中学习世界模型并修复模型利用问题

Logan Mondal Bhamidipaty, Mykel Kochenderfer, Subramanian Ramamoorthy

专题命中 通用世界模型 :world model(title,abstract);world models(title,abstract);world model(title,abstract);world models(title,abstract)

AI总结 研究针对世界模型在数据覆盖薄弱时易受模型利用问题,提出从人类反馈中学习动力学(DLHF),但朴素DLHF样本效率低,于是引入RENEW利用认知不确定性聚焦微调,经实验评估,RENEW提高样本效率等,为解决离线模型强化学习利用问题提供新途径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14550 2026-07-17 cs.MA 新提交 90%

World-Model-Aware Responsibility Allocation in Heterogeneous Logistics Systems

异构物流系统中世界模型感知责任分配

Artan Markaj, Niklas Jobs, Felix Gehlhoff

专题命中 通用世界模型 :world-model(title,abstract);world-model(title,abstract);world model(abstract);world model(abstract)

AI总结 研究异构物流系统中自主与非自主设备混合时的责任分配问题,提出世界模型感知责任框架WMARF,依模型质量和自动化水平动态分权限并分类死锁,通过模拟验证其有效性及随自主性提高仍有效的特性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14103 2026-07-17 cs.CL cs.MA 新提交 69%

Latent Communication Between Language Model Agents: Channels, Alignment, and the Limits of Text

语言模型智能体之间的潜在通信:通道、对齐方式及文本的局限性

Markus Wenzel

机构 * Constructor University(康斯坦丁大学)

专题命中 通用世界模型 :world model(abstract);world model(abstract);分类 cs.MA

AI总结 研究大语言模型智能体间潜在通信,构建三个通信通道,通过稀疏自编码器分析信息损失,经实验发现文本通信会丢失信息,潜在通道在跨语言概念任务上与文本通道匹配但未超,得出丢失特征多编码表面形式的结论,还指出明确潜在通信优势需更深入任务及分析框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14152 2026-07-17 cs.HC cs.AI 新提交 67%

"Trust Junk" Leads to Unjustified Support for Highly Discriminatory Predictive Models

“信任垃圾”导致对高度歧视性预测模型的不合理支持

Michael Correll, Lucy Havens, Mahsan Nourani

机构 * Northeastern University(东北大学)

专题命中 通用世界模型 :predictive model(title,abstract);predictive models(title,abstract);分类 cs.AI

AI总结 研究发现在可解释人工智能中,模型解释里提供的准确但多余或无关的数据会使人们对明显歧视性和不公平的模型产生不合理信任,提示XAI设计者和开发者要注意工作中的修辞及可视化带来的潜在问题。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 具身与机器人 2 篇

2607.14187 2026-07-17 cs.AI cs.RO 新提交 82%

RxBrain: Embodied Cognition Foundation Model with Joint Language-Visual Reasoning and Imagination

RxBrain:具有联合语言-视觉推理与想象的具身认知基础模型

Haotian Liang, Mingkang Chen, Yufei Huang, Yuchun Guo, Xiaomeng Zhu, Xiangli Shi, Kaixuan Wang, Yunxuan Mao, Weijie Zhou, Ling Chen, Shirong Zeng, Yueyu Long, Yuchen Si, Yajuan Zhu, Xingyu Zhou, Minghui Wang, Wanjia He, Xin Yang, Lingzhu Xiang, Zhiqing Liu, Bohan Ma, Xiran Huang, Tianshuo Yang, Zhiheng Liu, Xuantang Xiong, Zisheng Lu, Ping Luo, Yao Mu, Han Hu, Zhengyou Zhang

专题命中 具身与机器人 :world model(abstract);world models(abstract);world model(abstract);world models(abstract)

AI总结 研究提出具身认知基础模型RxBrain,采用统一多模态架构,通过构建自动管道训练,引入RxBrain-Bench评估,能保持具身理解和生成能力,扩展到连续机器人动作生成,为具身认知基础模型发展奠定基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.15278 2026-07-17 cs.CV 新提交 69%

Hierarchical Denoising For Multi-Step Visual Reasoning

用于多步视觉推理的分层去噪

Zezhong Qian, Xiaowei Chi, Chak-Wing Mak, Tianze Zhou, Ruibin Yuan, Yuhan Rui, Hengzhe Sun, Zhuoqun Wu, Yuming Li, Siyuan Qian, Sirui Han, Shanghang Zhang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机科学学院多媒体信息处理技术国家重点实验室) The Hong Kong University of Science and Technology(香港科技大学) Beihang University(北京航空航天大学) Fuzhou University(福州大学) Muka Robotics(木卡机器人)

专题命中 具身与机器人 :world model(abstract);world model(abstract);分类 cs.CV

AI总结 研究针对视频模型多步推理不足的问题,提出HDR框架,通过树形层次结构和稀疏分层注意力模式进行多步推理,在新基准测试中提升了成功率和进度,推理更快,数据效率更高,在机器人实验中展现潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏