arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

机器人 / 具身智能

机器人、具身智能、机器人学习、操作、导航和具身世界模型。

2026-08-19 至 2026-08-19 共收录 47 信号源:cs.RO, cs.AI, cs.CV, cs.LG

1. 机器人学习 2 篇

2608.17209 2026-08-19 cs.RO cs.AI cs.CV cs.LG 新提交 85%

Teach and Grow: An Agent-Centered Architecture for General Robot Learning

教学与成长:面向通用机器人学习的智能体中心架构

Chang Nie, Zhe Liu, Hesheng Wang

机构 * School of Automation and Intelligent Sensing, Shanghai Jiao Tong University(上海交通大学自动化与智能感知学院)

专题命中 机器人学习 :robot learning(title,abstract);robotics(abstract);分类 cs.RO、cs.AI、cs.CV

AI总结 该研究提出TGL智能体中心架构,通过将演示转化为可复用技能块,无需特定任务再训练即可实现通用机器人学习,在LIBERO评估中达SOTA性能,还提出相关缩放定律假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16978 2026-08-19 cs.RO cs.LG 新提交 81%

VLCP: Vision Language Control Policy Closed-Loop Code Replanning for Robot Manipulation

VLCP:用于机器人操纵的视觉语言控制策略闭环代码重规划

Dhia Naouali, Minghan Wu, Claudia Wong, Abhinav Puthran, Omar G. Younis

机构 * University of Monastir(莫纳斯提尔大学) St. Mildred’s-Lightbourn School(圣米尔德雷德-莱特本学校) Cornell University(康奈尔大学) Carnegie Mellon University(卡内基梅隆大学) Silverstream AI(银流人工智能公司) Mila -- Quebec AI Institute(米拉-魁北克人工智能研究所)

专题命中 机器人学习 :manipulation(title);robot policy(abstract);分类 cs.RO、cs.LG

AI总结 VLCP是一种无需训练的机器人操纵策略,通过在单回合内每K步由VLM重写控制代码闭合循环,在57项任务的评估中综合成功率达35.1%,较开环策略提升十倍。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 机器人操作 14 篇

2608.17386 2026-08-19 cs.RO 新提交 88%

MANIGUARD: A Benchmark and Data Suite for Specification-Grounded Safety Evaluation and Improvement of Robotic Manipulation

MANIGUARD:用于基于规范的机器人操作安全评估与改进的基准及数据集套件

Yiyan Peng, Philip Wang, Simon Sinong Zhan, Yiqi Lyu, Zhenyang Ni, Jixin Yan, Fiorelli Wong, Ruochen Jiao, Hang Yin, Xinyu Cao, Huajie Shao, Manling Li, Ruohan Zhang, Qi Zhu

机构 * Northwestern University(西北大学) Stanford University(斯坦福大学) William & Mary(威廉玛丽学院)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title,abstract);分类 cs.RO

AI总结 本研究提出ManiGuard基准与数据集套件,针对机器人操作基础模型策略,通过含23000余次滚动的实验证实安全需独立于任务成功评估,微调可提升安全表现但仍存差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17146 2026-08-19 cs.RO 新提交 86%

PDDL-ART: Autonomous Symbolic Abstraction From Demonstration For Long-Horizon Robotic Manipulation Using Vision-Language Models

PDDL-ART:基于演示的自主符号抽象方法,用于使用视觉语言模型的长时程机器人操纵

Disha Kamale, Dmitry Berenson

机构 * University of Michigan(密歇根大学)

专题命中 机器人操作 :manipulation(title,abstract);robotic(title);分类 cs.RO

AI总结 PDDL-ART是一种基于VLM的框架,可自主从演示生成PDDL描述,经多阶段校正确保语义对齐,在发动机维护和家庭操纵任务上平均成功率达93.3%,优于基线规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17323 2026-08-19 cs.RO cs.AI 新提交 84%

ORPA: Online Residual Policy Adaptation for Robot Manipulation Control with Human Feedback

ORPA:基于人类反馈的机器人操控控制在线残差策略适配

Muhammad A. Muttaqien, Tomohiro Motoda, Ryo Hanai, Yukiyasu Domae

机构 * National Institute of AIST(日本国立AIST研究所) Embodied AI Research Team(具身人工智能研究团队)

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO、cs.AI

AI总结 本研究提出ORPA框架,通过添加轻量反馈条件化模块实现机器人操控策略的在线残差适配,无需重训练即可纠正执行误差,在ALOHA平台的精度敏感操控任务上提升了成功率与扰动恢复能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17819 2026-08-19 cs.RO 新提交 84%

Effector-Centric NMPC of Tiltable-Multirotors for Offset-Free Omnidirectional Aerial Manipulation

面向可倾转多旋翼飞行器的以 effector 为中心的非线性模型预测控制(NMPC),用于无偏移全向空中操作

Jinjie Li, Yicheng Chen, Johannes Kübel, Haokun Liu, Junichiro Sugihara, Moju Zhao

专题命中 机器人操作 :manipulation(title,abstract);robotic(abstract);分类 cs.RO;robotics(comments)

AI总结 本研究针对可倾转多旋翼飞行器,设计并提出以 effector 为中心的 NMPC 框架,整合构型优化、奇异处理与扰动补偿,通过真实实验验证其可实现无偏移全向空中操作的可行性。

Comments 22 pages, 26 figures. Accepted to IEEE Transactions on Robotics (T-RO). This arXiv version includes a two-page appendix with additional implementation details

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17129 2026-08-19 cs.CV cs.RO 新提交 81%

PROBE: Manipulation-Grounded Visual Question Answering with VLM Agents

PROBE:基于操作的视觉问答(使用VLM智能体)

Vineet Bhat, Siyi Chen, Alex Zook, Xuning Yang, Stan Birchfield, Valts Blukis, Jonathan Tremblay

机构 * NVIDIA(英伟达)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO、cs.CV

AI总结 针对现实杂乱环境中需操作遮挡物体的视觉问答问题,提出PROBE框架,含模拟器、基准测试集及微调方案,提升VLM智能体性能并验证模拟到现实的迁移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17717 2026-08-19 cs.RO 新提交 79%

CompCPZ: Preserving Multi-Modal Intent in Language-Guided Robot Manipulation

CompCPZ:在语言引导的机器人操作中保留多模态意图

Zhen Zhang, Ahmad Hafez, Peng Xie, Yanliang Huang, Wenyuan Wu, Amr Alanwar

机构 * School of Computation, Information and Technology(计算、信息与技术学院) Technical University of Munich(慕尼黑工业大学)

专题命中 机器人操作 :manipulation(title,abstract);分类 cs.RO

AI总结 CompCPZ是一种用于语言引导机器人操作的代数层,可恢复多模态析取表示,在ManiSkill3基准测试中性能优于多种基线,且能迁移至真实机器人实验,凸显组合语言接地需评估意图连通分量结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17082 2026-08-19 cs.CR 新提交 78%

SentryBus: A Multi-Vantage Observability Model and Validated Instrument for I2C Sensor-Interface Manipulation

SentryBus:一种用于I2C传感器接口操作的多视角可观测性模型与验证工具

Sandesh More, Elton Batista, Karla Daley, Sneha Sudhakaran

专题命中 机器人操作 :manipulation(title,abstract)

AI总结 SentryBus为I2C传感器接口操作构建多视角可观测性模型,通过主机侧总线检测操作,经测试可在特定边界内区分操作与合法采集,暂未开展受控攻击试验以确定检测率。

Comments 8 pages, 2 figures, 3 tables. Submitted to the IEEE International Conference on Physical Assurance and Inspection of Electronics (PAINE) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17628 2026-08-19 cs.RO cs.AI cs.LG eess.IV 新提交 75%

Iterative Grasp Pose Refinement: A Deep Reinforcement Learning Approach for 2D Vision

迭代抓取位姿优化:一种面向二维视觉的深度强化学习方法

Amir Arsalan Nematollahi, Shayan Ahmadi, Mehdi Tale Masouleh, Ahmad Kalhor

机构 * University of Tehran(德黑兰大学)

专题命中 机器人操作 :manipulation(abstract);robotic(abstract);分类 cs.RO、cs.AI、cs.LG

AI总结 本研究提出结合关键点表征与DQN的强化学习框架,通过迭代优化抓取位姿,在Dex-Net数据集300个物体上对几何判定不可抓取物体实现100%成功率,且可实现仿真到真实的迁移,为接触丰富的操作任务提供解决方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17481 2026-08-19 q-fin.RM 新提交 50%

A generic nonparametric value-at-risk estimator for high dimensions

适用于高维场景的通用非参数风险价值估计器

Siyuan Sun

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文提出一种适用于高维场景的非参数VaR+CVaR算法,解决高维VaR估计的固有问题,经500个含49类期货的投资组合测试,其99%置信度VaR估计的损失率符合预设精度要求。

Comments Published in the Journal of Risk (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17112 2026-08-19 math.HO 新提交 50%

Group Theory in School Mathematics? Teaching Permutation Cycles Through the 15-Puzzle

学校数学中的群论?通过15拼图教授置换循环

Bence Torma, Tamás Waldhauser

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究探究5至11年级学生能否通过15拼图学习置换循环,经简短指导后多数学生可构建循环表示并用于分类,发现构建表示与用其得出结论为独立要求。

Comments 26 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17506 2026-08-19 quant-ph physics.optics 新提交 50%

Engineering of Dual Wavelength, Polarization Selective Metalenses in Silicon Carbide

碳化硅中双波长偏振选择性超透镜的制备

Xiaoying Huang, Ziwei Yang, Konosuke Shimazaki, Kritsana Saego, Otto Cranwell Schaeper, Evan Williams, Dragomir Neshev, Hark Hoe Tan, Igor Aharonovicha, Mehran Kianinia

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究制备了可同时工作于860 nm和1240 nm的SiC单片超透镜,实现了光收集与偏振操控,可用于两种缺陷的同时光探测磁共振,为集成SiC光子器件提供紧凑光学接口。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16895 2026-08-19 cs.CY physics.soc-ph 新提交 50%

Orphan risks at the frontier of artificial intelligence: What diverging safety and compliance frameworks reveal about how AI companies choose the risks they prioritize

人工智能前沿的孤儿风险:不同的安全与合规框架揭示了AI公司如何选择其优先处理的风险

Andrew D. Maynard

专题命中 机器人操作 :manipulation(abstract)

AI总结 本文对比四家前沿AI公司2023-2026年的安全合规文件,识别出其风险选择的四个筛选标准,提出“安全差异”概念,揭示了孤儿风险的成因及轻量应对工具。

Comments 21 pages, 40 references

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17816 2026-08-19 physics.optics 新提交 50%

Robust Orbital Angular Momentum Transfer Using low-cost Diffractive Optics

利用低成本衍射光学元件实现稳健的轨道角动量传递

Beatriz Morales-Cruzado, Benjamin Perez-Garcia, Francisco G. Peérez Gutiérrez, Carmelo G. Rosales-Guzmán

专题命中 机器人操作 :manipulation(abstract)

AI总结 该研究利用印刷在醋酸基底上的低成本静态二元全息图,实现了光镊中稳健的轨道角动量传递,构建了适用于多领域的结构化光操控平台。

Comments 4 pages, 5 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17772 2026-08-19 physics.plasm-ph 新提交 50%

Tunable high-charge relativistic electron beams via direct laser acceleration in hohlraum-preheated foam targets

通过腔靶预热泡沫靶中的直接激光加速产生可调谐高电荷相对论电子束

Ziyao Wang, Jieru Ren, Zhigang Deng, Wenqing Wei, Wei Qi, Olga N. Rosmej, Nikolay E. Andreev, Sergey Yu. Gus'kov, Rafael Yakhin, Yifang Gao, Bubo Ma, Mingzhe Yang, Shizheng Zhang, Xuyang Luo, Dieter H. H. Hoffmann, Peng Zhou, Ke Jiang, Taiwu Huang, Bo Cui, Weiwu Wang, Shaoyi Wang, Quanping Fan, Zhurong Cao, Sixin Wu, Yue Yang, Leifeng Cao, Yuqiu Gu, Yuchi Wu, Weimin Zhou, Zongqing Zhao, Yongtao Zhao

专题命中 机器人操作 :manipulation(abstract)

AI总结 本研究利用腔靶预热泡沫靶产生近临界密度等离子体,通过调节激光延迟,实现了高电荷相对论电子束的调谐,其性能优于固体箔靶和冷泡沫靶,为相关应用提供了可行方案。

详情

展开后加载摘要…

URL PDF HTML 收藏

3. 具身导航 11 篇

2608.17318 2026-08-19 cs.CV cs.RO 新提交 84%

If, Then, Otherwise: Diagnosing Conditional Branching in Vision-Language Navigation

如果、那么、否则:诊断视觉-语言导航中的条件分支

Seoyoung Lee, Neel P. Bhatt, Pranay Samineni, Cong Liu, S P Sharan, Timothy Barclay, Gregory M. Wagner, Daniel Milan, Sandeep Chinchali, Ufuk Topcu, Atlas Wang

机构 * The University of Texas at Austin(德克萨斯大学奥斯汀分校) Collins Aerospace(柯林斯航空航天公司)

专题命中 具身导航 :navigation(title,abstract);embodied agent(abstract);分类 cs.RO、cs.CV

AI总结 针对视觉-语言导航智能体的条件分支诊断需求,提出基于场景图的基准CondVLN及轻量级神经符号分支选择模型,可暴露智能体的逻辑决策失败并提升性能2倍。

Comments 11 pages, 1 figure, 3 tables. Project page: this https URL (https://condvln.github.io/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17703 2026-08-19 cs.RO cs.AI math.OC 新提交 81%

Dijkstra as an Oracle for Online Stochastic Shortest Path Navigation with Provable Guarantees

作为具有可证保证的在线随机最短路径导航的神谕的Dijkstra算法

Mansur M. Arief, Ali Akarma, Ahmad Alfan Alfian Irfan

机构 * King Fahd University of Petroleum and Minerals (KFUPM)(法赫德国王石油与矿产大学) Islamic University of Madinah(麦地那伊斯兰大学) Universitas Muhammadiyah Yogyakarta(日惹穆罕默迪亚大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO、cs.AI

AI总结 本研究提出DORA算法,基于Dijkstra算法的可证保证特性,实现高效安全的在线随机最短路径导航,性能与最优值迭代相当且规划工作量显著减少,接触率满足预算要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17512 2026-08-19 cs.RO 新提交 79%

Embodied-Navigator: Point, Think, Memorize, and Align for Efficient Navigation

具身导航器:指向、思考、记忆与对齐以实现高效导航

Hongyan Feng, Sunlai Chen, Xuanyu Liu, Miao Pan, Yangfan Xie, Yuxiang Cui, Zhongxiang Zhou, Rong Xiong, Wenqi Zhang, Jianwei Yin, Yueting Zhuang, Xuhong Zhang

机构 * ZJU(浙江大学)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本研究提出具身导航框架TAMP-Nav,通过像素转3D动作、选择性推理记忆与GRPO两级对齐,在R2R-CE数据集上实现66.2% SR,仅需90k训练轨迹,达成高效具身导航的最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17282 2026-08-19 cs.AI 新提交 79%

DeAR: Decentralized Agentic Reasoning via Capability Grounding and Collaborative Thought Navigation

DeAR:基于能力锚定与协作思维导航的去中心化智能体推理

Xing Wei, Changmeng Zheng, XiaoYong Wei, Xiufen Ye, Qing Li

专题命中 具身导航 :navigation(title,abstract);分类 cs.AI

AI总结 针对现有智能体推理系统的路由瓶颈与静态角色分配问题,提出DeAR框架,通过三种机制实现去中心化协作,在9类基准测试中性能优于基线方法,提升了知识密集型推理任务的准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17038 2026-08-19 cs.RO 新提交 79%

Terrain-Aware Local Path Planning with Global DEM Data Integration for Autonomous UGV Navigation

面向自主无人地面车辆(UGV)导航的融合全球数字高程模型(DEM)数据的地形感知局部路径规划

Devender Singh, Issah Nazif Suleiman, Paul Mitten, Glenn Cutler, Vinicius Prado da Fonseca, Matthew Hamilton

机构 * Memorial University of Newfoundland(纽芬兰纪念大学) Compusult Ltd.(康普萨尔特有限公司)

专题命中 具身导航 :navigation(title,abstract);分类 cs.RO

AI总结 本研究针对UGV户外导航中全局地图与实时传感器反馈脱节的问题,提出融合DEM与LiDAR的混合路径规划框架,经仿真验证可提升障碍物规避率、降低平均坡度,为可靠自主导航提供支撑。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17633 2026-08-19 cs.RO 新提交 70%

OVIP-SG: Open-Vocabulary Instance-Preserving Scene Graphs for Mapping and Retrieval of Small, Fine-Grained Objects

OVIP-SG:用于小型细粒度物体映射与检索的开放词汇实例保留场景图

Tianjing Hao, Haiyu Lan, Angsong Li, Cheng Chen, Enyu Li, Jiarui Yang, Yuning Su, Peiwen Lin, Wang Chuang

专题命中 具身导航 :navigation(abstract);robotic(abstract);分类 cs.RO

AI总结 本文提出OVIP-SG框架,通过VLM等技术实现小型细粒度物体的实例保留映射与语言引导检索,在Replica数据集上的多项指标优于现有方法,且经实际机器人实验验证有效。

Comments 15 pages, 6 figures, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17774 2026-08-19 eess.SY eess.SP 新提交 67%

Edge-Native Embodied Intelligence for Action-Aware Wireless Edge Networks

面向动作感知无线边缘网络的边缘原生具身智能

Yiru Wang, Chuanao Jiang, Jiahui Cui, Zide Fan, Lei Wang, Zehui Xiong, Dong In Kim

专题命中 具身导航 :embodied agent(abstract);navigation(abstract)

AI总结 该研究提出边缘原生具身智能(ENEI)框架,整合6G技术与具身智能,通过双向循环解决具身智能部署的资源与延迟问题,经案例验证可支撑自适应具身无线系统。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17553 2026-08-19 cs.RO 新提交 57%

Scalix: Uncertainty-Aware Scale-Consistent Monocular SLAM

Scalix:感知不确定性的尺度一致单目SLAM

Sebastian Barbas Laina, Tianyi Zhang, Panagiotis Petropoulakis, Simon Schaefer, Simon Boche, Jaehyung Jung, Cedric Le Gentil, Stefan Leutenegger

机构 * University of Technology, Sydney(悉尼科技大学) Centre for Autonomous Systems(自主系统中心)

专题命中 具身导航 :robotics(abstract);分类 cs.RO

AI总结 本文提出实时单目SLAM框架Scalix,通过整合带不确定性的学习深度线索到概率因子图,实现度量尺度估计,在多环境基准上性能领先且实时泛化。

Comments 8 pages, 5 figures and 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17092 2026-08-19 cs.CR cs.AI 新提交 57%

Structured Driving-State Narratives for Small Language Model-Based GNSS Spoofing Detection

面向基于小型语言模型(SLM)的GNSS欺骗检测的结构化驾驶状态叙事

Abyad Enan, Sagar Dasgupta, Mizanur Rahman, Mashrur Chowdhury

专题命中 具身导航 :navigation(abstract);分类 cs.AI

AI总结 本研究提出基于小型语言模型(SLM)的GNSS欺骗检测框架,通过对比多源驾驶状态的结构化叙事检测攻击,性能接近大模型且资源消耗更低,适用于车载平台。

Comments This work has been submitted to the Transportation Research Record: Journal of the Transportation Research Board for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17455 2026-08-19 physics.flu-dyn cs.RO math.OC 新提交 57%

Optimal control of a swimming robot based on Purcell's microswimmer model

基于珀塞尔微泳者模型的游泳机器人最优控制

Noam Berkovich Lahav, Oren Wiezel, Yizhar Or

专题命中 具身导航 :robotic(abstract);分类 cs.RO

AI总结 本研究基于珀塞尔微泳者模型,构建高粘性流体中三连杆游泳机器人变体,应用庞特里亚金最大值原理结合数值方法,求解位移与能量效率最优步态,为机器人最优控制提供方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17742 2026-08-19 cond-mat.mtrl-sci 新提交 50%

Active learning molecular beam epitaxy of complex quantum materials

复杂量子材料的主动学习分子束外延

Raghutheja Bollampally, Soumya Sankar, Yuqi Qin, Berthold Jäck

专题命中 具身导航 :navigation(abstract)

AI总结 该研究针对二元量子材料MBE的相边界与窄生长窗口问题,提出结合随机森林代理模型与期望改进函数的SMBO主动学习框架,在Fe₃Sn外延中4次迭代使预测误差减半至约10%,为量子材料自主合成提供了数据高效方案。

详情

展开后加载摘要…

URL PDF HTML 收藏

4. 具身推理 8 篇

2608.17163 2026-08-19 cs.LG cs.AI 新提交 86%

Q-Learning With World Models

结合世界模型的Q学习

Perry Dong, Yueru Jia, Chelsea Finn, Dorsa Sadigh

机构 * Stanford University(斯坦福大学) Peking University(北京大学)

专题命中 具身推理 :world model(title,abstract);robotics(abstract);manipulation(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出QWM框架,将世界模型与标准Q学习结合,在真实环境训练中避免复合模型偏差,在Robomimic和LIBERO基准上的样本效率与性能均优于现有SOTA方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17959 2026-08-19 cs.AI cs.LG 新提交 81%

Towards Zero-Shot Task Transfer with Neurosymbolic World Models

面向基于神经符号世界模型的零样本任务迁移

Isidoro Tamassia, Lennert De Smet, Giuseppe Marra

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 本研究提出一种神经符号世界模型,通过解耦观测重构与奖励预测,实现无需额外环境交互的零样本任务迁移,其泛化能力优于纯神经方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.17956 2026-08-19 cs.LG cs.AI eess.SY 新提交 81%

An Omitted Mode Is a Rare Rule: The Sampling-Verification Danger Law in Continuous Code World Models

被遗漏的模式即罕见规则:连续代码世界模型中的采样-验证危险定律

Javier Aguilar Martín

机构 * AGILabs

专题命中 具身推理 :world model(title,abstract);分类 cs.AI、cs.LG

AI总结 该研究揭示连续代码世界模型中采样-验证机制的危险,通过理论分析与实验发现,LLM合成的模式盲模型易被利用,接受仅能证明样本一致性,无法保证连续控制任务的性能。

Comments 92 pages, 5 figures. Code, data and result artifacts: this https URL (https://github.com/JaviMaligno/code-world-models)

详情

展开后加载摘要…

URL PDF HTML 收藏