arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2026-04-13 至 2026-04-13 共收录 10
2604.09480 2026-04-13 cs.CV

Online3R: Online Learning for Consistent Sequential Reconstruction Based on Geometry Foundation Model

Online3R: 基于几何基础模型的在线学习一致序列重建

Shunkai Zhou, Zike Yan, Fei Xue, Dong Wu, Yuchen Deng, Hongbin Zha

机构 * School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) T-Stone Robotics Institute, The Chinese University of Hong Kong(香港中文大学天石机器人研究所) NVIDIA(英伟达) College of Computer and Information Science, Southwest University(西南大学计算机与信息科学学院) School of Artificial Intelligence and Computer Science, Anqing Normal University(安庆师范大学人工智能与计算机科学学院)

AI总结 Online3R通过在线学习适应新场景,解决不一致问题,利用可学习的轻量视觉提示和自监督学习策略提升几何预测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09442 2026-04-13 cs.CL

UIPress: Bringing Optical Token Compression to UI-to-Code Generation

UIPress:将光学令牌压缩引入UI到代码生成

Dasen Dai, Shuoqi Li, Ronghao Chen, Huacan Wang, Biao Wu, Qizhen Lan

机构 * The Chinese University of Hong Kong(香港中文大学) Peking University(北京大学) University of Chinese Academy of Sciences(中国科学院大学) University of Technology Sydney(悉尼科技大学)

AI总结 本文提出UIPress,一种轻量级学习压缩模块,通过结合深度可分离卷积、元素引导的空间重加权和Transformer细化,将UI截图的视觉令牌从约6700压缩到256,结合LoRA实现表示差距桥接,提升效率并优于现有方法。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09330 2026-04-13 cs.RO cs.CV

VAG: Dual-Stream Video-Action Generation for Embodied Data Synthesis

VAG:用于具身数据合成的双流视频-动作生成

Xiaolei Lang, Yang Wang, Yukun Zhou, Chaojun Ni, Kerui Li, Jiagang Zhu, Tianze Liu, Jiajun Lv, Xingxing Zuo, Yun Ye, Guan Huang, Xiaofeng Wang, Zheng Zhu

机构 * GigaAI Zhejiang University(浙江大学) Peking University(北京大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

AI总结 本文提出VAG模型,通过双流框架联合生成视频和动作,提升跨模态一致性,实现高效且准确的视频-动作配对生成,支持轨迹回放并提升下游策略泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09195 2026-04-13 cs.AI

Camera Artist: A Multi-Agent Framework for Cinematic Language Storytelling Video Generation

Camera Artist: 一种多智能体框架用于电影语言叙事视频生成

Haobo Hu, Qi Mao, Yuanhang Li, Libiao Jin

机构 * School of Information and Communication Engineering, Communication University of China(中国传媒大学信息与通信工程学院) State Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室)

AI总结 Camera Artist通过引入专门的 cinematography shot agent,增强了镜头间叙事连贯性和电影语言表达,提升了视频叙事的连贯性和表现力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09089 2026-04-13 cs.SE cs.AI cs.CR

DeepGuard: Secure Code Generation via Multi-Layer Semantic Aggregation

DeepGuard:通过多层语义聚合实现安全代码生成

Li Huang, Zhongxin Liu, Yifan Wu, Tao Yin, Dong Li, Jichao Bi, Nankun Mu, Hongyu Zhang, Meng Yan

机构 * Chongqing University(重庆大学) The State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全全国重点实验室,浙江大学) Peking University(北京大学)

AI总结 DeepGuard通过多层语义聚合提升代码生成的安全性,实验表明其在安全性和功能性上均优于基线模型,有效检测并减少不安全模式。

Comments ACL 2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09008 2026-04-13 cs.CL cs.AI

Towards Linguistically-informed Representations for English as a Second or Foreign Language: Review, Construction and Application

迈向英语作为第二或外语的语义表示:综述、构建与应用

Wenxi Li, Xihao Wang, Weiwei Sun

机构 * School of the Chinese Nation Studies(中华民族学院) School of Liberal Arts, Minzu University of China(中央民族大学文学院) Department of Chinese Language and Literature, Peking University(北京大学中国语言文学系) Department of Computer Science and Technology, University of Cambridge(剑桥大学计算机科学与技术系)

AI总结 本文综述现有ESFL资源,提出基于建构主义理论的新型表示方法,构建包含1643个注释句子的高质资源,并验证其在第二语言习得研究中的应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08858 2026-04-13 cs.CV

BIAS: A Biologically Inspired Algorithm for Video Saliency Detection

BIAS:一种生物启发的视频显著性检测算法

Zhao-ji Zhang, Ya-tang Li

机构 * Academy for Advanced Interdisciplinary Studies, Peking University(北京大学前沿交叉学科研究院) Chinese Institute for Brain Research, Beijing (CIBR)(北京脑科学与类脑研究中心)

AI总结 BIAS算法基于生物启发模型,结合动态视觉显著性检测,通过生物视网膜运动检测器提取时间特征,实现高效率显著性图生成,优于传统方法和深度学习模型,应用于交通事故分析效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08592 2026-04-13 cs.LG nlin.CD

Reservoir observer enhanced with residual calibration and attention mechanism

增强残差校准与注意力机制的共振观测器

Yichen Liu, Wei Xiao, Tianguang Chu

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院)

AI总结 本文提出结合残差校准和注意力机制的共振观测器,提升非线性动力系统中未测量变量推断的准确性,尤其改善传统方法在最坏情况下的表现。

Journal ref Physical Review E 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08544 2026-04-13 cs.RO cs.AI cs.CV

SIM1: Physics-Aligned Simulator as Zero-Shot Data Scaler in Deformable Worlds

SIM1:物理对齐的模拟器作为零样本数据放大器在变形世界中

Yunsong Zhou, Hangxu Liu, Xuekun Jiang, Xing Shen, Yuanzhen Zhou, Hui Wang, Baole Fang, Yang Tian, Mulin Yu, Qiaojun Yu, Li Ma, Hengjie Li, Hanqing Wang, Jia Zeng, Jiangmiao Pang

机构 * Shanghai AI Lab(上海人工智能实验室) Fudan University(复旦大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学)

AI总结 SIM1通过物理对齐的仿真方法,将稀疏观测转化为高保真的合成监督,实现变形物体 manipulation 的高效训练,取得与真实数据相当的性能。

Comments Website: https://internrobotics.github.io/sim1.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12509 2026-04-13 cs.LG cs.AI

Revitalizing Black-Box Interpretability: Actionable Interpretability for LLMs via Proxy Models

重振黑盒可解释性:通过代理模型实现LLM的可操作可解释性

Junhao Liu, Haonan Yu, Zhenyu Yan, Xin Zhang

机构 * Key Lab of High Confidence Software Technologies (Peking University), Ministry of Education(高可信软件技术教育部重点实验室(北京大学)) School of Computer Science, Peking University(北京大学计算机学院)

AI总结 本文提出一种低成本代理框架,利用高效模型近似昂贵LLM的决策边界,通过统计验证局部对齐,实现可操作的可解释性,提升LLM优化效率。

Comments Accepted to ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏