arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Peking University(北京大学)

2026-03-02 至 2026-03-02 共收录 10
2602.24233 2026-03-02 cs.CV

Enhancing Spatial Understanding in Image Generation via Reward Modeling

通过奖励建模增强图像生成中的空间理解

Zhenyu Tang, Chaoran Feng, Yufan Deng, Jie Wu, Xiaojie Li, Rui Wang, Yunpeng Chen, Daquan Zhou

机构 * Peking University(北京大学) ByteDance Seed(字节跳动种子)

AI总结 本文提出SpatialScore奖励模型,通过增强空间理解能力提升图像生成的质量和效果。

Comments Accepted at CVPR 2026. Github: https://github.com/DAGroup-PKU/SpatialT2I Project website: https://dagroup-pku.github.io/SpatialT2I/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24134 2026-03-02 cs.CV cs.CL

AgenticOCR: Parsing Only What You Need for Efficient Retrieval-Augmented Generation

AgenticOCR: 为高效检索增强生成解析所需内容

Zhengren Wang, Dongsheng Ma, Huaping Zhong, Jiayu Li, Wentao Zhang, Bin Wang, Conghui He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Peking University(北京大学)

AI总结 AgenticOCR通过动态解析范式提升视觉文档检索增强生成系统的效率和准确性,实现按需提取和解耦检索粒度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24020 2026-03-02 cs.CV

SR3R: Rethinking Super-Resolution 3D Reconstruction With Feed-Forward Gaussian Splatting

SR3R: 重新思考超分辨率3D重建与前馈高斯点散射

Xiang Feng, Xiangbo Wang, Tieshi Zhong, Chengkai Wang, Yiting Zhao, Tianxiang Xu, Zhenzhong Kuang, Feiwei Qin, Xuefei Yin, Yanming Zhu

机构 * Hangzhou Dianzi University(杭州电子科技大学) ShanghaiTech University(上海科技大学) Griffith University(格里菲斯大学) Peking University(北京大学)

AI总结 SR3R通过前馈高斯点散射框架,直接从稀疏低分辨率视角生成高分辨率3D重建,提升跨场景泛化能力和实时性能。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23996 2026-03-02 cs.CV

Accelerating Masked Image Generation by Learning Latent Controlled Dynamics

通过学习潜在控制动力学加速掩码图像生成

Kaiwen Zhu, Quansheng Zeng, Yuandong Pu, Shuo Cao, Xiaohui Li, Yi Xin, Qi Qin, Jiayang Li, Yu Qiao, Jinjin Gu, Yihao Liu

机构 * Shanghai Jiao Tong University, Shanghai, China(上海交通大学) Shanghai Artificial Intelligence Laboratory, Shanghai, China(上海人工智能实验室) Shanghai Innovation Institute, Shanghai, China(上海创新研究院) Nankai University, Tianjin, China(南开大学) University of Science(科学技术大学) Nanjing University, Nanjing, China(南京大学) The University of Sydney, Sydney, Australia(悉尼大学) Peking University, Beijing, China(北京大学)

AI总结 本文提出MIGM-Shortcut模型,通过学习潜在控制动力学加速掩码图像生成,在保持质量的同时实现文本到图像生成的四倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23981 2026-03-02 cs.LG cs.AI

Intrinsic Lorentz Neural Network

内禀洛伦兹神经网络

Xianglong Shi, Ziheng Chen, Yunhan Jiang, Nicu Sebe

机构 * University of Science and Technology of China(中国科学技术大学) University of Trento(特伦托大学) Peking University(北京大学)

AI总结 内禀洛伦兹神经网络通过全内禀双曲架构提升几何决策性能,结合陀螺归一化和双曲距离计算,实现优于现有方法的性能和效率。

Comments Published in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23980 2026-03-02 cs.CV

Venus: Benchmarking and Empowering Multimodal Large Language Models for Aesthetic Guidance and Cropping

Venus: 多模态大语言模型在审美指导与裁剪中的基准测试与赋能

Tianxiang Du, Hulingxiao He, Yuxin Peng

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机技术研究所)

AI总结 Venus通过两阶段框架提升多模态大语言模型的审美指导与裁剪能力,实现可解释的审美优化。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23960 2026-03-02 cs.SD cs.AI

SHINE: Sequential Hierarchical Integration Network for EEG and MEG

SHINE:用于EEG和MEG的顺序分层集成网络

Xiran Xu, Yujie Yan, Xihong Wu, Jing Chen

机构 * Speech and Hearing Research Center, School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院语音与听觉研究中心) Center for BioMed-X Research, Academy for Advanced Interdisciplinary Studies, Peking University(北京大学先进跨学科研究 academy 生物医学-X 研究中心) National Key Laboratory of General Artificial Intelligence, China(中国通用人工智能国家重点实验室)

AI总结 SHINE网络通过整合EEG和MEG信号,实现了高精度的语音检测,其集成方法在LibriBrain竞赛中取得优异成绩。

Comments ranked second at LibriBrain Competition 2025 https://neural-processing-lab.github.io/2025-libribrain-competition/prizes/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18679 2026-03-02 cs.CV

Efficient Degradation-agnostic Image Restoration via Channel-Wise Functional Decomposition and Manifold Regularization

通过通道级功能分解和流形正则化实现高效的退化无关图像恢复

Bin Ren, Yawei Li, Xu Zheng, Yuqian Fu, Danda Pani Paudel, Hong Liu, Ming-Hsuan Yang, Luc Van Gool, Nicu Sebe

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德·本·泽德人工智能大学) University of Trento(特伦托大学) ETH Zürich(苏黎世联邦理工学院) HKUST (GZ)(香港科技大学(广州)) Peking University(北京大学) University of California, Merced(加州大学默塞德分校)

AI总结 MIRAGE通过通道级功能分解和流形正则化,在高效性与性能之间取得平衡,实现退化无关图像恢复的先进性能。

Comments Accepted by ICLR'2026, All-in-One Image Restoration, low-level vision, Transformer

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23407 2026-03-02 cs.CR cs.AI cs.SE

Learning to Generate Secure Code via Token-Level Rewards

通过令牌级奖励学习生成安全代码

Jiazheng Quan, Xiaodong Li, Bin Wang, Guo An, Like Liu, Degen Huang, Lin Liu, Chengbin Hou

机构 * Fuyao University of Science and Technology(福耀科技大学) Xiamen University(厦门大学) Peking University(北京大学) Huawei(华为)

AI总结 本文提出Vul2Safe和SRCode框架,通过令牌级奖励提升代码安全性,有效减少生成代码中的安全漏洞并提高代码质量。

Comments 18 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23375 2026-03-02 physics.optics cs.CV

Analytical Expression for Spherically Symmetric Photoacoustic Sources: A Unified General Solution (Theoretical Analysis and Derivation)

球对称光声源的解析表达式:统一的通用解(理论分析与推导)

Shuang Li, Yibing Wang, Yu Zhang, Changhui Li

机构 * Department of Biomedical Engineering, College of Future Technology, Peking University, Beijing, China(北京大学未来技术学院生物医学工程系) National Biomedical Imaging Center, Peking University, Beijing, China(北京大学国家生物医学成像中心)

AI总结 本文提出了一种适用于任意球对称初始分布的光声源解析解,提供了多种常见分布的表达式,并为光声成像系统设计提供了工具。

详情

展开后加载摘要…

URL PDF HTML 收藏