arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Peking University(北京大学)

2026-03-16 至 2026-03-16 共收录 8
2603.13028 2026-03-16 cs.CR cs.AI

Purify Once, Edit Freely: Breaking Image Protections under Model Mismatch

一次净化,自由编辑:在模型不匹配下突破图像保护

Qichen Zhao, Shengfang Zhai, Xinjian Bai, Qingni Shen, Qiqi Lin, Yansong Gao, Zhonghai Wu

机构 * Peking University(北京大学) National University of Singapore(国立新加坡大学) The University of Western Australia(西澳大学)

AI总结 研究提出统一的后期净化框架,评估模型不匹配下的保护有效性,提出VAE-Trans和EditorClean两种实用净化器,显著提升图像编辑质量,揭示一次净化后保护信号失效的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13019 2026-03-16 cs.DC cs.AI cs.LG

ARL-Tangram: Unleash the Resource Efficiency in Agentic Reinforcement Learning

ARL-Tangram:释放代理强化学习中的资源效率

Bangjun Xiao, Yihao Zhao, Xiangwei Deng, Shihua Yu, Yuxing Xiang, Huaqiu Liu, Qiying Wang, Liang Zhao, Hailin Zhang, Xuanzhe Liu, Xin Jin, Fuli Luo

机构 * School of Computer Science, Peking University(北京大学计算机科学系) LLM-Core Xiaomi(小智LLM核心)

AI总结 ARL-Tangram通过动作级 orchestration 实现细粒度外部资源共享与弹性调度,提升代理强化学习的资源利用效率,实验表明其在平均动作完成时间、训练步长速度和外部资源节约方面均有显著提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12811 2026-03-16 cs.CV

OARS: Process-Aware Online Alignment for Generative Real-World Image Super-Resolution

OARS:面向生成真实世界图像超分辨率的在线对齐

Shijie Zhao, Xuanyu Zhang, Bin Chen, Weiqi Li, Qunliang Xing, Kexin Zhang, Yan Wang, Junlin Li, Li Zhang, Jian Zhang, Tianfan Xue

机构 * ByteDance Inc.(字节跳动公司) Peking University(北京大学) The Chinese University of Hong Kong(香港中文大学)

AI总结 OARS通过过程感知的在线对齐框架,结合COMPASS奖励模型,在线优化图像超分辨率模型,实现感知与保真度的平衡,提升真实世界图像超分辨率性能。

Comments Super-Resolution, Reinforcement Learning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12730 2026-03-16 cs.RO

AnchorVLA4D: an Anchor-Based Spatial-Temporal Vision-Language-Action Model for Robotic Manipulation

AnchorVLA4D: 一种基于锚点的时空视觉-语言-动作模型用于机器人操作

Juan Zhu, Zhanying Shao, Xiaoqi Li, Ethan Morgan, Jiadong Xu, Hongwei Fan, Hao Dong

机构 * PrimeBot School of Computer Science, Peking University(北京大学计算机学院)

AI总结 本文提出AnchorVLA4D,通过引入锚点图像和轻量级空间编码器,提升机器人操作中的时空推理能力,实现在Simpler WidowX基准测试中提升13.6%,并在真实任务中达到80%的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12686 2026-03-16 cs.RO

Learning Athletic Humanoid Tennis Skills from Imperfect Human Motion Data

从不完美的人类运动数据中学习竞技型人形网球技能

Zhikai Zhang, Haofei Lu, Yunrui Lian, Ziqing Chen, Yun Liu, Chenghuai Lin, Han Xue, Zicheng Zeng, Zekun Qi, Shaolin Zheng, Qing Luan, Jingbo Wang, Junliang Xing, He Wang, Li Yi

机构 * Tsinghua University(清华大学) Peking University(北京大学) Galbot Inc.(Galbot公司) Shanghai Qi Zhi Institute(上海启智研究所) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 本文提出LATENT系统,通过不完美的网球运动数据学习人形机器人网球技能,提升真实场景中的网球表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11647 2026-03-16 cs.MM cs.CV cs.SD

OmniForcing: Unleashing Real-time Joint Audio-Visual Generation

OmniForcing:释放实时联合音频视觉生成

Yaofeng Su, Yuming Li, Zeyue Xue, Jie Huang, Siming Fu, Haoran Li, Ying Li, Zezhong Qian, Haoyang Huang, Nan Duan

机构 * JD Explore Academy(京东探索学院) Fudan University(复旦大学) Peking University(北京大学) The University of Hong Kong(香港大学)

AI总结 本文提出OmniForcing框架,通过因果蒸馏将双向扩散模型转化为高保真流式自回归生成器,解决双流架构中的训练不稳定问题,实现25FPS的实时生成性能。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06688 2026-03-16 cs.CV cs.AI

Narrative Weaver: Towards Controllable Long-Range Visual Consistency with Multi-Modal Conditioning

叙事编织者:迈向多模态可控的长程视觉一致性

Zhengjian Yao, Yongzhi Li, Xinyuan Gao, Quan Chen, Peng Jiang, Yanye Lu

机构 * Peking University(北京大学) Kuaishou Technology(快手科技)

AI总结 Narrative Weaver通过整合精细控制、自动叙事规划和长程一致性,解决生成AI中多模态可控、长程且一致的视觉内容生成问题,提出首个综合解决方案并构建首个电商广告视频脚本数据集。

Comments Accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15418 2026-03-16 cs.LG cs.AI cs.RO

Guided Policy Optimization under Partial Observability

部分可观察环境下指导策略优化

Yueheng Li, Guangming Xie, Zongqing Lu

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) School of Computer Science, Peking University(北京大学计算机科学学院)

AI总结 本文提出GPO框架,通过联合训练指导器和学习器,在部分可观察环境中实现与直接RL相当的最优性能,有效解决现有方法的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏