Mitigating Compounding Error via Video Representation Regularization
通过视频表示正则化缓解复合误差
机构 * Peking University(北京大学)
AI总结 针对视频扩散世界模型自回归生成的复合误差问题,研究发现其与表示维度崩溃相关,提出视频表示正则化方法,在VBench指标上显著优于Diffusion Forcing,提升了长视频生成的鲁棒性。
高校专区
通过视频表示正则化缓解复合误差
机构 * Peking University(北京大学)
AI总结 针对视频扩散世界模型自回归生成的复合误差问题,研究发现其与表示维度崩溃相关,提出视频表示正则化方法,在VBench指标上显著优于Diffusion Forcing,提升了长视频生成的鲁棒性。
SpatialQ:基于视觉的多模态大语言模型(MLLM)理解3D Gaussian Splatting场景质量
机构 * Peking University(北京大学) ; Peng Cheng Laboratory(鹏城实验室) ; Fuzhou University(福州大学)
AI总结 针对3DGS场景质量评估的局限,本文提出SpatialQ框架,通过VGGT编码器与Qwen-MLLM实现结构感知的多模态质量评估,解决传统IQA仅依赖2D线索的问题。
GoGoTB:基于规范驱动覆盖闭合的智能体式RTL验证
机构 * Tencent(腾讯) ; School of Integrated Circuits, Peking University(北京大学集成电路学院) ; Southwest Jiaotong University(西南交通大学) ; Institute of Electronic Design Automation, Peking University(北京大学电子设计自动化研究所) ; Beijing Advanced Innovation Center for Integrated Circuits(北京集成电路高精尖创新中心)
AI总结 GoGoTB是实现端到端验证闭合的智能体式RTL验证框架,在8个RTL设计上无需人工干预,实现100%环境生成成功率及多维度高覆盖率,优于现有方法。
Comments 9 pages, 7 figures, 3 tables. Xin Xin and Jincheng Lou contributed equally to this work and share first authorship
Ouroboros-Spatial:闭环数据-模型循环的空间推理
机构 * Peking University(北京大学) ; Ant International(蚂蚁国际) ; The University of Hong Kong(香港大学)
AI总结 提出Ouroboros-Spatial自演化框架,通过提议器与求解器闭环交互,动态生成与模型能力匹配的训练样本,在六个空间推理基准上以十分之一数据量显著提升Qwen3-VL性能。
RedKnot: 基于头部感知的KV重用和SegPagedAttention的高效长上下文LLM服务
机构 * Xiaohongshu Inc., China(小红书公司,中国) ; Peking University(北京大学) ; Huawei Cloud(华为云)
AI总结 提出RedKnot系统,通过按KV头分解缓存并采用SegPagedAttention,实现位置无关的KV重用、前缀压缩、冷热分离和分布式放置,在不重训练模型的情况下提升资源效率。
PACE: 面向动作分块策略的相位感知分块执行方法
机构 * Peking University(北京大学) ; JD Explore Academy(京东探索研究院)
AI总结 提出PACE方法,通过在线预测动作分块中的低速过渡点作为重规划边界,自适应选择执行步长,无需重新训练即可提升机器人策略成功率。
Comments 21 pages, 7 figures, 6 tables. Preprint
DP-MGTD:通过自适应差分隐私实体净化实现隐私保护的机器生成文本检测
机构 * Nanyang Technological University(南洋理工大学) ; The Hong Kong Polytechnic University(香港理工大学) ; University of Science and Technology of China(中国科学技术大学) ; Peking University(北京大学) ; Hengxin Tech(恒心科技)
AI总结 DP-MGTD通过自适应差分隐私实体净化技术,在保障隐私的前提下实现对机器生成文本的高精度检测。
Comments This article is unable to reproduce the experimental results, and we no longer have confidence in the main conclusion of this article