arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

2026-04-16 至 2026-04-16 共收录 17
2604.14010 2026-04-16 cs.LG cs.CL

Parameter Importance is Not Static: Evolving Parameter Isolation for Supervised Fine-Tuning

参数重要性并非静态:为监督微调设计的演进参数隔离

Zekai Lin, Chao Xue, Di Liang, Xingsheng Han, Peiyang Liu, Xianjie Wu, Lei Jiang, Yu Lu, Haibo Shi, Shuang Liang, Minlong Peng

机构 * Tencent Hunyuan(腾讯文言) Tencent Yuanbao(腾讯元宝) Peking University(北京大学) UESTC University of New South Wales(新南威尔士大学)

AI总结 本文提出EPI框架,通过动态调整参数隔离策略,减少训练中的任务干扰和遗忘,提升模型泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13824 2026-04-16 cs.LG

Beyond State Consistency: Behavior Consistency in Text-Based World Models

超越状态一致性:文本基础世界模型中的行为一致性

Youling Huang, Guanqiao Chen, Junchi Yao, Lu Wang, Fangkai Yang, Chao Du, ChenZhuo Zhao, Pu Zhao, Qingwei Lin, Saravan Rajmohan, Dongmei Zhang

机构 * Dalian University of Technology(大连理工大学) MBZUAI Peking University(北京大学) Microsoft(微软)

AI总结 本文提出行为一致性训练方法,通过改进世界模型与真实环境的功能一致性,提升长期对齐效果,实验显示在WebShop和TextWorld中表现优异,同时保持单步预测质量。

Comments 20 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13791 2026-04-16 cs.CV

PBE-UNet: A light weight Progressive Boundary-Enhanced U-Net with Scale-Aware Aggregation for Ultrasound Image Segmentation

PBE-UNet:一种轻量级的渐进边界增强U-Net,具有尺度感知聚合,用于超声图像分割

Chen Wang, Yixin Zhu, Yongbin Zhu, Fengyuan Shi, Qi Li, Jun Wang, Zuozhu Liu, Keli Hu

机构 * Department of Computer Science, Shaoxing University(绍兴大学计算机科学系) National Frontiers Science Center for Industrial Intelligence and Systems Optimization, Northeastern University(工业智能化与系统优化国家级前沿科学中心,东北大学) College of Computer Science, Chongqing University(重庆大学计算机学院) School of Computer and Computing Science, Hangzhou City University(杭州市大学计算机与计算科学学院) ZJU-UIUC Institute, Zhejiang University(浙江大学ZJU-UIUC研究院) Information Technology R&D Innovation Center of Peking University(北京大学信息技术研发创新中心)

AI总结 本文提出PBE-UNet,通过引入尺度感知聚合模块和边界引导特征增强模块,解决超声图像分割中边界模糊和尺度变化的问题,实验表明其在四个数据集上优于现有方法。

Comments 14 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05991 2026-04-16 cs.AI

3D Instruction Ambiguity Detection

三维指令歧义检测

Jiayu Ding, Haoran Tang, Hongbo Jin, Wei Gao, Ge Li

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学)

AI总结 本文提出三维指令歧义检测任务,构建了大规模基准Ambi3D,发现现有3D大语言模型难以判断指令歧义,提出AmbiVer框架解决该问题,提升具身AI的安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13786 2026-04-16 cs.CL

QuantileMark: A Message-Symmetric Multi-bit Watermark for LLMs

QuantileMark:一种消息对称的多比特水印用于大语言模型

Junlin Zhu, Baizhou Huang, Xiaojun Wan

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学计算机科学技术研究院)

AI总结 QuantileMark通过在连续累积概率区间[0,1)内嵌入信息,实现消息对称的多比特水印,提升水印检测的鲁棒性和生成质量的稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13746 2026-04-16 cs.CV

ClipGStream: Clip-Stream Gaussian Splatting for Any Length and Any Motion Multi-View Dynamic Scene Reconstruction

ClipGStream: 用于任意长度和任意运动多视角动态场景重建的Clip-Stream高斯点云法

Jie Liang, Jiahao Wu, Chao Wang, Jiayu Yang, Xiaoyun Zheng, Kaiqiang Xiong, Zhanke Wang, Jinbo Yan, Feng Gao, Ronggang Wang

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology(广东超高清沉浸式媒体技术省重点实验室) Shenzhen Graduate School, Peking University(北京大学深圳研究生院) Pengcheng Laboratory(鹏城实验室) Peking University(北京大学) MIGU Video Co., Ltd.(MIGU视频有限公司)

AI总结 本文提出ClipGStream框架,通过clip级流优化实现长动态视频的高斯点云重建,兼顾可扩展性和时间一致性。

Comments CVPR 2026, Project pages: https://liangjie1999.github.io/ClipGStreamWeb/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13688 2026-04-16 cs.CV cs.AI

Beyond Voxel 3D Editing: Learning from 3D Masks and Self-Constructed Data

超越体素3D编辑:从3D掩码和自构造数据中学习

Yizhao Xu, Hongyuan Zhu, Caiyun Liu, Tianfu Wang, Keyu Chen, Sicheng Xu, Jiaolong Yang, Nicholas Jing Yuan, Qi Zhang

机构 * The Peking University(北京大学) HKUST(GZ)(香港科技大学(广州)) Microsoft AI(微软人工智能) Microsoft Research(微软研究院)

AI总结 本文提出BVE框架,通过自构造的大规模3D编辑数据集,结合轻量可训练模块,实现高效的文本语义注入,保留局部不变性,生成高质量的文本对齐3D资产。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13654 2026-04-16 cs.RO

Vision-and-Language Navigation for UAVs: Progress, Challenges, and a Research Roadmap

面向无人机的视觉与语言导航:进展、挑战与研究路线图

Hanxuan Chen, Jie Zheng, Siqi Yang, Tianle Zeng, Siwei Feng, Songsheng Cheng, Ruilong Ren, Hanzhong Guo, Shuai Yuan, Xiangyue Wang, Kangli Wang, Ji Pei

机构 * Autel Robotics, Shenzhen, China(大疆创新,深圳,中国) School of Intelligent Software and Engineering, Nanjing University, Nanjing, China(南京大学智能软件与工程学院,南京,中国) School of Computer, Data & Information Sciences, University of Wisconsin-Madison, Madison, WI, USA(威斯康星大学麦迪逊分校计算机、数据与信息科学学院,麦迪逊,WI,美国) Southern University of Science and Technology, Shenzhen, China(南方科技大学,深圳,中国) The University of Hong Kong, Hong Kong SAR, China(香港大学,香港特别行政区,中国) School of Software and Microelectronics, Peking University, Beijing, China(北京大学软件与微电子学院,北京,中国)

AI总结 本文综述了无人机视觉与语言导航领域,分析了从早期模块化方法到基于大模型的智能系统的发展,探讨了现实部署中的挑战,并提出了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13425 2026-04-16 cs.CV

VibeFlow: Versatile Video Chroma-Lux Editing through Self-Supervised Learning

VibeFlow:通过自监督学习实现多功能视频色光编辑

Yifan Li, Pei Cheng, Bin Fu, Shuai Yang, Jiaying Liu

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所)

AI总结 本文提出VibeFlow框架,通过自监督学习实现视频色光编辑,解决光照和颜色修改的同时保持结构和时间保真的问题,无需昂贵训练资源,支持零样本应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02709 2026-04-16 cs.CL cs.AI cs.LG cs.SE

Evaluating the Formal Reasoning Capabilities of Large Language Models through Chomsky Hierarchy

通过乔姆斯基层级评估大语言模型的正式推理能力

Yihong Dong, Jianha Xiao, Xue Jiang, Xuyuan Guo, Zhiyuan Fan, Jiaru Qian, Kechi Zhang, Jia Li, Zhi Jin, Ge Li

机构 * Peking University(北京大学) Wuhan University(武汉大学)

AI总结 本文提出ChomskyBench基准,通过乔姆斯基层级系统评估大语言模型的正式推理能力,揭示其在结构化语言处理中的性能分层及效率瓶颈。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05957 2026-04-16 cs.DC cs.AI

Domain-Adaptive Model Merging Across Disconnected Modes

跨断开模式的领域适应性模型合并

Junming Liu, Yusen Zhang, Rongchao Zhang, Wenkai Zhu, Tian Wu

机构 * Tongji University(同济大学) Peking University(北京大学) Southeast University(东南大学) Nanchang University(南昌大学)

AI总结 本文提出DMM框架,通过独立训练领域模型、合并相似模型及生成伪数据精炼知识,实现无需数据的模型合并,提升性能。

Comments 5 pages, 1 figure, 3 tables; Accepted by ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07422 2026-04-16 cs.CL cs.AI

Two Pathways to Truthfulness: On the Intrinsic Encoding of LLM Hallucinations

通往真实性的两条路径:关于LLM幻觉内在编码的研究

Wen Luo, Guangyue Peng, Wei Li, Shaohang Wei, Feifan Song, Liang Wang, Nan Yang, Xingxing Zhang, Jing Jin, Furu Wei, Houfeng Wang

机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(信息处理国家重点实验室,计算机科学学院,北京大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 本文探讨LLM幻觉的内在编码机制,通过两种信息路径揭示真实性信号的来源,发现其与知识边界和内部表示密切相关,并提出改进幻觉检测的应用。

Comments Accepted to the ACL 2026 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.11334 2026-04-16 cs.CL

LaoBench: A Large-Scale Multidimensional Lao Benchmark for Large Language Models

LaoBench:一种大规模多维老挝语基准测试用于大语言模型

Jian Gao, Richeng Xuan, Zhaolu Kang, Dingshi Liao, Wenxin Huang, Zongmou Huang, Yangdi Xu, Bowen Qin, Zheqi He, Xi Yang, Changjin Li, Yonghua Lin

机构 * China-ASEAN Information Harbor Co., Ltd.(中国-东盟信息港有限公司) Beijing Academy of Artificial Intelligence(北京人工智能研究院) School of Software & Microelectronics, Peking University(北京大学软件与微电子学院)

AI总结 本文提出LaoBench,首个大规模多维老挝语基准测试,包含17000+样本,涵盖文化知识应用、K12教育和双语翻译,评估LLM在老挝语的理解与推理能力,发现多语言模型在文化推理和翻译准确性上仍落后于人类专家。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.06477 2026-04-16 cs.AI

MAS-Bench: A Unified Benchmark for Shortcut-Augmented Hybrid Mobile GUI Agents

MAS-Bench:一种统一的快捷键增强混合移动GUI代理基准测试

Pengxiang Zhao, Guangyi Liu, YaoZhen Liang, Weiqing He, Zhengxi Lu, WenHao Wang, Yuehao Huang, Yuxiang Chai, Zhaolu Kang, Yaxuan Guo, Hao Wang, Kexin Zhang, Liang Liu, Yong Liu

机构 * Zhejiang University(浙江大学) vivo AI Lab(vivo AI实验室) Peking University(北京大学)

AI总结 本文提出MAS-Bench,用于评估结合GUI和快捷键的混合移动自动化代理,包含139个任务和9个评估指标,实验显示混合代理在效率上优于纯GUI代理。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00222 2026-04-16 cs.AI cs.CL cs.LG

RL-PLUS: Countering Capability Boundary Collapse of LLMs in Reinforcement Learning with Hybrid-policy Optimization

RL-PLUS: 通过混合策略优化对抗LLMs在强化学习中的能力边界崩溃

Yihong Dong, Xue Jiang, Yongding Tao, Huanyu Liu, Kechi Zhang, Lili Mou, Rongyu Cao, Yingwei Ma, Jue Chen, Binhua Li, Zhi Jin, Fei Huang, Yongbin Li, Ge Li

机构 * School of Computer Science, Peking University(北京大学计算机科学系) Tongyi Lab, Alibaba Group(阿里集团通义实验室) Department of Computing Science, University of Alberta(阿尔伯塔大学计算机科学系) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席)

AI总结 RL-PLUS通过混合策略优化解决LLMs在强化学习中的能力边界崩溃问题,结合内部利用与外部数据提升推理能力,实验表明其在数学推理和分布外任务中表现优异。

Comments Accepted to ACL 2026 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.21751 2026-04-16 cs.SE cs.CL

CodeFlowBench: A Multi-turn, Iterative Benchmark for Complex Code Generation

CodeFlowBench: 一个用于复杂代码生成的多轮迭代基准

Sizhe Wang, Zhengren Wang, Dongsheng Ma, Yongan Yu, Rui Ling, Zhiyu Li, Feiyu Xiong, Wentao Zhang

机构 * Peking University(北京大学) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所) Shanghai University of Finance and Economics(上海财经大学) McGill University(麦吉尔大学) Zhongguancun Academy(中关村学院) Beijing Key Laboratory of Data Intelligence and Security (Peking University)(北京数据智能与安全重点实验室(北京大学))

AI总结 CodeFlowBench通过多轮迭代重用现有代码评估LLM在复杂代码生成中的能力,包含5000+编程问题和真实GitHub仓库,揭示多轮代码流程中模型性能下降与依赖复杂度负相关的现象。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.00601 2026-04-16 cs.LG

AutoPV: Automatically Design Your Photovoltaic Power Forecasting Model

AutoPV:自动设计你的光伏功率预测模型

Dayin Chen, Xiaodan Shi, Mingkun Jiang, Haoran Zhang, Dongxiao Zhang, Yuntian Chen, Jinyue Yan

机构 * Department of Building Environment and Energy Engineering, The Hong Kong Polytechnic University(香港理工大学建筑环境与能源工程系) International Centre of Urban Energy Nexus, The Hong Kong Polytechnic University(香港理工大学城市能源 nexus 中心) Research Institute for Smart Energy, The Hong Kong Polytechnic University(香港理工大学智能能源研究院) Eastern Institute for Advanced Study, Eastern Institute of Technology(东院高级研究机构) School of Business, Society and Technology, Mälardalens University(马尔默大学商学院、社会与技术学院) Center for Spatial Information Science, the University of Tokyo(东京大学空间信息科学中心) PV Industry Innovation Center, State Power Investment Corporation(国家电力投资集团光伏产业创新中心) School of Urban Planning and Design, Peking University, Shenzhen(北京大学深圳校区城市规划与设计学院) Ningbo Institute of Digital Twin, Eastern Institute of Technology(宁波数字孪生研究所)

AI总结 本文提出AutoPV框架,利用神经架构搜索技术自动设计光伏功率预测模型,通过新颖的搜索空间提升预测性能,实验表明其在短时间內构建出优于现有模型的架构。

详情

展开后加载摘要…

URL PDF HTML 收藏