arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harvard University(哈佛大学)

2026-07-08 至 2026-07-08 共收录 3
2606.28757 2026-07-08 cs.CV cs.RO 版本更新

A Physics-Grounded Benchmark for Multi-Agent Dynamics in World Models

基于物理的多智能体动力学世界模型基准

Nuo Chen, Lulin Liu, Zihao Li, Ziyao Zeng, Zihao Zhu, Wenyan Cong, Junyuan Hong, Yunhao Yang, Zhengzhong Tu, Yan Wang, Boris Ivanovic, Marco Pavone, Zhangyang Wang, Yang Zhou, Zhiwen Fan

机构 * Texas A&M University(德克萨斯大学) University of Minnesota(明尼苏达大学) Marquette University(马奎特大学) Yale University(耶鲁大学) University of Texas at Austin(德克萨斯大学奥斯汀分校) Massachusetts General Hospital(麻省总医院) Harvard Medical School(哈佛医学院) NVIDIA(英伟达) Stanford University(斯坦福大学)

AI总结 提出CrashTwin框架,通过多智能体碰撞场景数据集和校准无关重建流程,从时空一致性、动量与动能守恒、世界动力学完整性三个维度评估世界模型的物理可信度。

Comments 34 pages, 9 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.23931 2026-07-08 quant-ph cs.AI 版本更新

Do Quantum Transformers Help? A Systematic VQC Architecture Comparison on Tabular Benchmarks

量子变换器有帮助吗?在表格基准上的系统VQC架构比较

Chi-Sheng Chen, En-Jui Kuo

机构 * Beth Israel Deaconess Medical Center \& Harvard Medical School Boston, MA, USA Department of Electrophysics National Yang Ming Chiao Tung University Hsinchu, Taiwan

AI总结 本文系统比较了四种VQC架构在回归和分类任务中的表现,发现FC-VQC在参数更少的情况下性能更优,且量子自注意力作用有限,同时指出表达能力在电路深度约3时饱和。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.15631 2026-07-08 cs.LG cs.AI 版本更新

The relationship between reasoning and performance in large language models--o3 (mini) thinks harder, not longer

大语言模型中推理与性能的关系——o3(mini)思考更深入,而非更久

Marthe Ballon, Andres Algaba, Vincent Ginis

机构 * Data Analytics Lab, Vrije Universiteit Brussel(布鲁塞尔自由大学数据分析实验室) School of Engineering and Applied Sciences, Harvard University(哈佛大学工程与应用科学学院)

AI总结 研究大语言模型推理与性能的关系,在Omni - MATH基准上分析o1 - mini和o3 - mini变体推理链长度,发现o3 - mini(m)无需更长推理链就能实现更高准确率,还表明推理链增长时准确率通常下降,为模型能力与推理长度关系提供新见解。

Comments 19 pages, 14 figures. Sci Rep (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏