arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 3038
2509.07704 2026-03-31 cs.CV

SEEC: Segmentation-Assisted Multi-Entropy Models for Learned Lossless Image Compression

SEEC:基于分割的多熵模型用于学习无损图像压缩

Chunhang Zheng, Zichang Ren, Dou Li

机构 * School of Electronics, Peking University(北京大学电子学院)

AI总结 SEEC通过分割指导多熵模型选择,提升不同语义区域的概率分布估计精度,实现更优的无损图像压缩性能。

Comments Accpeted by ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26831 2026-03-31 cs.CV cs.AI

Envisioning global urban development with satellite imagery and generative AI

用卫星影像和生成式AI展望全球城市发展

Kailai Sun, Yuebing Liang, Mingyi He, Yunhan Zheng, Alok Prakash, Shenhao Wang, Jinhua Zhao, Alex "Sandy'' Pentland

机构 * Singapore–MIT Alliance for Research and Technology Centre (SMART)(新加坡-麻省理工学院研究与技术联盟中心) Department of Urban Planning, Tsinghua University(清华大学城市规划系) Department of Urban Studies and Planning, Massachusetts Institute of Technology(麻省理工学院城市研究与规划系) College of Urban and Environmental Sciences, Peking University(北京大学城市与环境学院) Department of Urban and Regional Planning, University of Florida(佛罗里达大学城市与区域规划系) Stanford Institute for Human-Centered Artificial Intelligence, Stanford University(斯坦福大学以人为本人工智能研究所)

AI总结 本文提出一种多模态生成式AI框架,通过整合提示和地理空间控制,生成全球500个最大都会区的高保真城市卫星影像,支持可持续城市发展和场景规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26787 2026-03-31 cs.CV

Brain-Inspired Multimodal Spiking Neural Network for Image-Text Retrieval

脑启发式多模态脉冲神经网络用于图像-文本检索

Xintao Zong, Xian Zhong, Wenxuan Liu, Jianhao Ding, Zhaofei Yu, Tiejun Huang

机构 * Hubei Key Laboratory of Transportation Internet of Things, Wuhan University of Technology(武汉理工大学交通物联网湖北省重点实验室) State Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理全国重点实验室)

AI总结 本文提出脑启发式跨模态脉冲融合网络(CMSF),用于图像-文本检索,通过融合单模态特征提升多模态表示,实现高效检索与低能耗。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26403 2026-03-30 cs.RO

T-800: An 800 Hz Data Glove for Precise Hand Gesture Tracking

T-800:一种用于精确手部姿态追踪的800Hz数据手套

Haoyang Luo, Zihang Zhao, Leiyao Cui, Saiyao Zhang, Liu Yang, Zhi Han, Xiyuan Tang, Yixin Zhu

机构 * Peking University(北京大学) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Integrated Circuits, Peking University(北京大学集成电路学院) School of Psychological and Cognitive Sciences, Peking University(北京大学心理与认知科学学院) Beijing Key Laboratory of Behavior and Mental Health, Peking University(北京大学行为与心理健康北京市重点实验室) LeapZenith AI Research(跃升人工智能研究院) State Key Laboratory of Robotics and Intelligent Systems, Shenyang Institute of Automation, Chinese Academy of Sciences(中国科学院沈阳自动化研究所机器人学国家重点实验室)

AI总结 T-800通过800Hz高带宽数据手套实现同步全手运动追踪,解决高频率动态捕捉难题,恢复细粒度操作细节,为机器人控制提供丰富行为数据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26164 2026-03-30 cs.LG cs.CL

DataFlex: A Unified Framework for Data-Centric Dynamic Training of Large Language Models

DataFlex: 一种统一的以数据为中心的大型语言模型动态训练框架

Hao Liang, Zhengyang Zhao, Meiyi Qiang, Mingrui Chen, Lu Ma, Rongyi Yu, Hengyi Feng, Shixuan Sun, Zimo Meng, Xiaochen Ma, Xuanlin Yang, Qifeng Cai, Ruichuan An, Bohan Zeng, Zhen Hao Wong, Chengyu Shen, Runming He, Zhaoyang Han, Yaowei Zheng, Fangcheng Fu, Conghui He, Bin Cui, Zhiyu Li, Weinan E, Wentao Zhang

机构 * Peking University(北京大学) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所) OriginHub Technology LLaMA-Factory Team(LLaMA-Factory团队) Zhongguancun Academy(中关村学院) OpenDataLab, Shanghai Artificial Intelligence Laboratory(上海人工智能实验室OpenDataLab) Shanghai Jiao Tong University(上海交通大学)

AI总结 DataFlex 提供了一种统一的以数据为中心的动态训练框架,支持样本选择、领域混合调整和样本再加权,提升了大型语言模型的训练效率和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26134 2026-03-30 cs.CV

InstaVSR: Taming Diffusion for Efficient and Temporally Consistent Video Super-Resolution

InstaVSR:通过高效且时间一致的视频超分辨率扩散模型进行优化

Jintong Hu, Bin Chen, Zhenyu Hu, Jiayue Liu, Guo Wang, Lu Qi

机构 * Insta360 Research(Insta360 研究院) Peking University(北京大学) Wuhan University(武汉大学)

AI总结 InstaVSR提出了一种轻量级扩散框架,通过剪枝、递归训练和双空间对抗学习,实现高效且时间一致的视频超分辨率,减少计算成本并保持高质量。

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21723 2026-03-30 cs.RO cs.MA

Can a Robot Walk the Robotic Dog: Triple-Zero Collaborative Navigation for Heterogeneous Multi-Agent Systems

机器人能否行走:异构多智能体系统的三零协同导航

Yaxuan Wang, Yifan Xiang, Ke Li, Xun Zhang, BoWen Ye, Zhuochen Fan, Fei Wei, Tong Yang

机构 * Yuanpei College, Peking University(北京大学元培学院) School of Computer Science, Peking University(北京大学计算机学院) School of Computer Science, Beijing University of Posts and Telecommunications(北京邮电大学计算机学院) Pengcheng Laboratory(鹏城实验室) Beijing Jinruyi Large Model Technology Co., Ltd.(北京金如意大模型科技有限公司)

AI总结 本文提出三零路径规划框架,通过协调者-探索者架构实现无需训练、无需先验知识和无需模拟的异构多机器人系统协作导航,实验显示其在复杂环境中具有鲁棒性和适应性。

Comments 8 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.22225 2026-03-30 cs.CV cs.AI

ExtrinSplat: Decoupling Geometry and Semantics for Open-Vocabulary Understanding in 3D Gaussian Splatting

ExtrinSplat:解耦几何与语义以实现3D高斯散射中的开放词汇理解

Jiayu Ding, Xinpeng Liu, Zhiyi Pan, Shiqiang Long, Ge Li

机构 * Guangdong Provincial Key Laboratory of Ultra High Definition Immersive Media Technology, Shenzhen Graduate School, Peking University(广东省超高清沉浸式媒体技术重点实验室,北京大学深圳研究生院) School of Computer Science and Technology, Tianjin University(天津大学计算机科学与技术学院) Guangdong Bohua UHD Innovation Center Co., Ltd.(广东博华超高清创新中心有限公司)

AI总结 ExtrinSplat通过解耦几何与语义,利用视觉语言模型生成轻量文本假设,提升3D高斯散射中开放词汇物体选择和语义分割的性能和效率。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25737 2026-03-27 cs.AI cs.CL cs.IR

Training the Knowledge Base through Evidence Distillation and Write-Back Enrichment

通过证据蒸馏和写回丰富训练知识库

Yuxing Lu, Xukai Zhao, Wei Wu, Jinzhuo Wang

机构 * Peking University(北京大学) Georgia Institute of Technology(佐治亚理工学院) Tsinghua University(清华大学)

AI总结 本文提出WriteBack-RAG框架,通过标注示例识别检索成功区域,提取相关文档并蒸馏为紧凑知识单元,提升RAG系统性能,平均提升2.14%。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25607 2026-03-27 cs.CV cs.AI

DeepFAN, a transformer-based deep learning model for human-artificial intelligence collaborative assessment of incidental pulmonary nodules in CT scans: a multi-reader, multi-case trial

DeepFAN,一种基于transformer的深度学习模型,用于人类-人工智能协作评估CT扫描中的偶发性肺结节:多读者、多病例试验

Zhenchen Zhu, Ge Hu, Weixiong Tan, Kai Gao, Chao Sun, Zhen Zhou, Kepei Xu, Wei Han, Meixia Shang, Xiaoming Qiu, Yiqing Tan, Jinhua Wang, Zhoumeng Ying, Li Peng, Wei Song, Lan Song, Zhengyu Jin, Nan Hong, Yizhou Yu

机构 * Department of Radiology, State Key Laboratory of Complex Severe and Rare Diseases, Peking Union Medical College Hospital, Chinese Academy of Medical Sciences and Peking Union Medical College(中国医学科学院北京协和医学院北京协和医院放射科,疑难重症及罕见病国家重点实验室) Theranostics and Translational Research Center, National Infrastructures for Translational Medicine, Institute of Clinical Medicine, State Key Laboratory of Complex Severe and Rare Diseases, Peking Union Medical College Hospital, Chinese Academy of Medical Sciences and Peking Union Medical College(中国医学科学院北京协和医学院北京协和医院临床医学研究所,国家转化医学基础设施,诊疗与转化研究中心,疑难重症及罕见病国家重点实验室) Artificial Intelligence Lab, Deepwise Healthcare(深睿医疗人工智能实验室) Department of Epidemiology and Health Statistics, Institute of Basic Medicine Sciences, Chinese Academy of Medical Sciences & Peking Union Medical College(中国医学科学院北京协和医学院基础医学研究所流行病学与卫生统计学系) Department of Biostatistics, Peking University First Hospital(北京大学第一医院生物统计室) Department of Radiology, Huangshi Central Hospital, Affiliated Hospital of Hubei Polytechnic University(湖北理工学院附属医院黄石市中心医院放射科) Department of Radiology, Wuhan Third Hospital, Tongren Hospital of Wuhan University(武汉大学同仁医院武汉市第三医院放射科) +4 Medical Doctor Program, Chinese Academy of Medical Sciences & Peking Union Medical College(中国医学科学院北京协和医学院4+4医学博士项目) Department of Medicine Imaging, School of Clinical Medicine, Southwest Medical University(西南医科大学临床医学院医学影像系) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院)

AI总结 本文提出DeepFAN模型,通过多读者多病例试验验证其在辅助初级放射科医生评估肺结节方面的有效性,提升了诊断准确率和一致性。

Comments 28 pages for main text and 37 pages for supplementary information, 7 figures in main text and 9 figures in supplementary information

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25405 2026-03-27 cs.RO cs.AI

System Design for Maintaining Internal State Consistency in Long-Horizon Robotic Tabletop Games

长周期机器人桌面游戏中维持内部状态一致性的系统设计

Guangyu Zhao, Ceyao Zhang, Chengdong Ma, Tao Wu, Yiyang Song, Haoxuan Ru, Yifan Zhong, Ruilin Yan, Lingfeng Li, Ruochong Li, Yu Li, Xuyuan Han, Yun Ding, Ruizhang Jiang, Xiaochuan Zhang, Yichao Li, Yuanpei Chen, Yaodong Yang, Yitao Liang

机构 * Peking University(北京大学) PKU-PsiBot Joint Lab(北大-PsiBot联合实验室) Nanyang Technological University(南洋理工大学) PsiBot

AI总结 本文通过系统设计而非孤立组件改进,研究如何在回合制多人类机器人桌面游戏中维持内部状态一致性。以Mahjong为例,提出整合架构,明确维护感知、执行和交互状态,分离高层语义推理与时间敏感的感知控制,并结合验证的动作原语和触觉触发恢复机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25395 2026-03-27 cs.RO cs.MA

UMBRELLA: Uncertainty-aware Multi-robot Reactive Coordination under Dynamic Temporal Logic Tasks

UMBRELLA:基于动态时间逻辑任务的不确定性感知多机器人反应协调

Qisheng Zhao, Meng Guo, Hengxuan Du, Lars Lindemann, Zhongkui Li

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Automatic Control Laboratory, ETH Zürich(苏黎世联邦理工学院自动控制实验室)

AI总结 本文提出UMBRELLA框架,结合MCTS与不确定性感知路径规划,通过置信度预测降低任务完成时间和方差,适用于动态移动目标的多机器人协作任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25373 2026-03-27 cs.LG

Hessian-informed machine learning interatomic potential towards bridging theory and experiments

基于Hessian的机器学习互作用势:连接理论与实验的桥梁

Bangchen Yin, Jian Ouyang, Zhen Fan, Kailai Lin, Hanshi Hu, Dingshun Lv, Weiluo Ren, Hai Xiao, Ji Chen, Changsu Cao

机构 * Peking University(北京大学) Tsinghua University(清华大学) Department of Chemistry, Tsinghua University(清华大学化学系) School of Physics, Peking University(北京大学物理学院) Interdisciplinary Institute of Light-Element Quantum Materials, Frontiers Science Center for Nano-Optoelectronics, State Key Laboratory of Artificial Microstructure and Mesoscopic Physics, Peking University(北京大学轻元素量子材料交叉研究所、纳米光电子前沿科学中心、人工微结构与介观物理国家重点实验室)

AI总结 本文提出一种基于Hessian的机器学习互作用势,通过高效训练协议HINT显著提升过渡态搜索并实现化学精度的吉布斯自由能预测,同时准确处理强非谐氢化物。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25196 2026-03-27 cs.CL cs.AI

A Decade-Scale Benchmark Evaluating LLMs' Clinical Practice Guidelines Detection and Adherence in Multi-turn Conversations

一个十年级基准评估LLM在多轮对话中检测和遵守临床实践指南的能力

Andong Tan, Shuyu Dai, Jinglu Wang, Fengtao Zhou, Yan Lu, Xi Wang, Yingcong Chen, Can Yang, Shujie Liu, Hao Chen

机构 * Microsoft Research Asia(微软亚洲研究院) Hong Kong University of Science and Technology(香港科技大学) Peking University(北京大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出CPGBench基准,评估LLM在多轮对话中检测和遵循临床实践指南的能力,发现多数模型在识别和遵循指南方面存在显著差距,通过人类评估验证了这一发现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24295 2026-03-27 cs.CV

RS-SSM: Refining Forgotten Specifics in State Space Model for Video Semantic Segmentation

RS-SSM:通过状态空间模型细化遗忘的特定信息以实现视频语义分割

Kai Zhu, Zhenyu Cui, Zehua Zang, Jiahuan Zhou

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机技术研究所) Tsinghua University(清华大学) Institute of Software Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出RS-SSM模型,通过互补细化遗忘的时空细节,提升视频语义分割的像素级处理能力,在四个基准上取得最佳性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05878 2026-03-27 cs.LG cs.SE

FusionLog: Cross-System Log-based Anomaly Detection via Fusion of General and Proprietary Knowledge

FusionLog:通过通用知识和专有知识融合实现跨系统日志基异常检测

Xinlong Zhao, Tong Jia, Minghua He, Xixuan Yang, Ying Li

机构 * School of Software & Microelectronics, Peking University(北京大学软件与微电子学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

AI总结 FusionLog通过融合通用和专有知识实现跨系统日志基异常检测,无需目标系统标注数据,实验显示在零标注设置下F1分数超过90%。

Comments 12 pages, 5 figures, and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24296 2026-03-27 cs.CL cs.AI

DiffuGuard: How Intrinsic Safety is Lost and Found in Diffusion Large Language Models

DiffuGuard: 差分扩散语言模型中内在安全的丧失与恢复

Zherui Li, Zheng Nie, Zhenhong Zhou, Yue Liu, Yitong Zhang, Yu Cheng, Qingsong Wen, Kun Wang, Yufei Guo, Jiaheng Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Squirrel Ai Learning(松鼠AI) Peking University(北京大学)

AI总结 本文分析了差分扩散语言模型在对抗攻击中的脆弱性,提出DiffuGuard框架通过随机退火重标记和块级审计修复提升模型安全性,有效降低攻击成功率。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25077 2026-03-27 cs.CV

Bridging Perception and Reasoning: Token Reweighting for RLVR in Multimodal LLMs

弥合感知与推理:用于多模态大语言模型中RLVR的标记重加权

Jinda Lu, Junkang Wu, Jinghan Li, Kexin Huang, Shuo Yang, Guoyin Wang, Jiancan Wu, Xiang Wang, Xiangnan He

机构 * University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) Independent Researcher(独立研究员)

AI总结 本文提出Token-Reweighting策略,通过动态重加权多模态大语言模型中的感知与推理标记,提升RLVR性能,实现视觉 grounding 和推理的协同优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.25072 2026-03-27 cs.CV

GIFT: Global Irreplaceability Frame Targeting for Efficient Video Understanding

GIFT:全局不可替代性帧目标用于高效视频理解

Junpeng Ma, Sashuai Zhou, Guanghao Li, Xin Gao, Yue Cao, Hengyu Zeng, Yuxiang Yan, Zhibin Wang, Jun Song, Bo Zheng, Shanghang Zhang, Jian Pu

机构 * Institute of Science and Technology for Brain-inspired Intelligence, Fudan University(复旦大学类脑智能科学与技术研究院) State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机学院多媒体信息处理国家重点实验室) Zhejiang University(浙江大学) Alibaba Group Holding Limited(阿里巴巴集团控股有限公司) Future Living Lab of Alibaba(阿里巴巴未来生活实验室)

AI总结 GIFT通过评估帧的内在不可替代性选择关键帧,解决视频理解中处理密集帧的高计算成本问题,提升视频分析效率。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24947 2026-03-27 cs.AI econ.GN q-fin.EC

Shopping with a Platform AI Assistant: Who Adopts, When in the Journey, and What For

通过平台AI助手购物:谁采用、何时在旅程中、为何采用

Se Yan, Han Zhong, Zemin, Zhong, Wenyu Zhou

机构 * Guanghua School of Management, Peking University(北京大学光华管理学院) Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院) International Business School, Zhejiang University(浙江大学国际联合商学院)

AI总结 本文研究消费者在电子商务中采用平台嵌入式购物AI的行为特征,发现AI助手在探索性产品发现中起补充作用,而非替代传统搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24721 2026-03-27 cs.CV cs.AI cs.LG cs.MM

Scalable Object Relation Encoding for Better 3D Spatial Reasoning in Large Language Models

可扩展的对象关系编码以提升大语言模型中的3D空间推理

Shengli Zhou, Minghang Zheng, Feng Zheng, Yang Liu

机构 * Department of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系) Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室)

AI总结 本文提出QuatRoPE,通过线性增长的对象数量输入长度和注意力层中的点积计算配对空间关系,提升大语言模型在3D空间推理中的性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24595 2026-03-27 cs.PL cs.AI

Model2Kernel: Model-Aware Symbolic Execution For Safe CUDA Kernels

Model2Kernel: 用于安全CUDA内核的模型感知符号执行

Mengting He, Shihao Xia, Haomin Jia, Wenfei Wu, Linhai Song

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) State Key Lab of Processors, Institute of Computing Technology, CAS(中国科学院计算技术研究所处理器实验室) Peking University(北京大学)

AI总结 本文提出Model2Kernel,通过模型感知动态分析验证LLM推理中CUDA内核的内存安全,利用专门的符号执行技术发现353个未知bug,仅产生9个误报。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19083 2026-03-26 cs.CV

ChordEdit: One-Step Low-Energy Transport for Image Editing

ChordEdit: 图像编辑中的一步低能耗传输

Liangsi Lu, Xuhang Chen, Minzhe Guo, Shichu Li, Jingchao Wang, Yang Shi

机构 * Guangdong University of Technology(广东工业大学) Huizhou University(惠州大学) Shenzhen University(深圳大学) Peking University(北京大学)

AI总结 本文提出ChordEdit,一种无需训练和反向传播的图像编辑方法,通过动态最优传输理论实现低能耗、高精度的一步编辑,解决传统方法在图像编辑中出现的失真和不一致性问题。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08720 2026-03-26 cs.CL

How Many Code and Test Cases Are Enough? Evaluating Test Cases Generation from a Binary-Matrix Perspective

生成多少代码和测试用例足够?从二进制矩阵视角评估测试用例生成

Xianzhen Luo, Jinyang Huang, Wenzhen Zheng, Qingfu Zhu, Mingzheng Xu, Yiheng Xu, Yuantao Fan, Wanxiang Che

机构 * Harbin Institute of Technology(哈尔滨工业大学) Central South University(中南大学) Chinese Academy of Sciences(中国科学院) Peking University(北京大学) Beijing University of Posts and Telecommunications(北京邮电大学)

AI总结 本文从二进制矩阵视角评估测试用例生成,提出TC-Bench基准,通过寻找最优诊断基来确定最小错误代码和测试用例集,揭示现有方法在诊断能力上的不足。

Comments Accepted by ICLR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24018 2026-03-26 cs.AI

ELITE: Experiential Learning and Intent-Aware Transfer for Self-improving Embodied Agents

ELITE:经验学习与意图感知迁移用于自我改进的具身智能体

Bingqing Wei, Zhongyu Xia, Dingai Liu, Xiaoyu Zhou, Zhiwei Lin, Yongtao Wang

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(清华大学王轩计算机技术研究所,北京,中国)

AI总结 ELITE通过经验学习与意图感知迁移机制,使具身智能体能持续学习环境交互经验并迁移至相似任务,实现在EB-ALFRED和EB-Habitat基准上的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23626 2026-03-26 cs.LG cond-mat.stat-mech cs.AI cs.CL nlin.AO

A Theory of LLM Information Susceptibility

大语言模型信息易感性理论

Zhuo-Yang Song, Hua Xing Zhu

机构 * School of Physics, Peking University(北京大学物理学院) Center for High Energy Physics, Peking University(北京大学高能物理中心)

AI总结 本文提出大语言模型信息易感性理论,探讨计算资源充足时固定LLM对策略集预算敏感性的影响,通过多变量效用函数框架分析多预算通道架构,并验证了共缩放架构在提升性能方面的有效性。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23512 2026-03-26 cs.CL cs.AI cs.IR

S-Path-RAG: Semantic-Aware Shortest-Path Retrieval Augmented Generation for Multi-Hop Knowledge Graph Question Answering

S-Path-RAG:基于语义的最短路径检索增强生成用于多跳知识图谱问答

Rong Fu, Yemin Wang, Tianxiang Xu, Yongtai Liu, Weizhi Tang, Wangyu Wu, Xiaowen Ma, Simon Fong

机构 * University of Macau(澳门大学) Xiamen University(厦门大学) Peking University(北京大学) Hanyang University(翰阳大学) University of Liverpool(利物浦大学) Zhejiang University(浙江大学)

AI总结 S-Path-RAG通过混合加权k最短路径、束搜索和约束随机游走策略,实现语义感知的多跳知识图谱问答,提升检索效率与生成准确性。

Journal ref WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23506 2026-03-26 cs.CL cs.AI

Leveraging Computerized Adaptive Testing for Cost-effective Evaluation of Large Language Models in Medical Benchmarking

利用计算自适应测试对大型语言模型进行成本效益的医学基准评估

Tianpeng Zheng, Zhehan Jiang, Jiayi Liu, Shicong Feng

机构 * Institute of Medical Education, Health Science Center, Peking University(北京大学医学教育研究院、健康科学中心) School of Public Health, Peking University(北京大学公共卫生学院) Peking University Health Science Center-Chaoxing Joint Laboratory for Digital and Smart Medical(北京大学健康科学中心-超星数字与智能医疗联合实验室) Graduate School of Education, Peking University(北京大学教育学院)

AI总结 本文提出基于项目反应理论的计算自适应测试框架,用于高效评估大型语言模型在标准化医学知识中的表现,通过模拟和实证研究验证了其在成本效益和评估效率上的优势。

Comments 37 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04601 2026-03-26 cs.CL

FedSRD: Sparsify-Reconstruct-Decompose for Communication-Efficient Federated Large Language Models Fine-Tuning

FedSRD:用于通信高效联邦大语言模型微调的稀疏化-重建-分解

Guochen Yan, Luyuan Xie, Qingni Shen, Yuejian Fang, Zhonghai Wu

机构 * Beijing Key Laboratory of Data Intelligence and Security, National Engineering Research Center for Software Engineering, School of Computer Science, Peking University(北京数据智能与安全重点实验室、软件工程国家工程研究中心、计算机科学学院、北京大学) Beijing Key Laboratory of Data Intelligence and Security, School of Software and Microelectronics, Peking University(北京数据智能与安全重点实验室、软件与微电子学院、北京大学) Beijing Key Laboratory of Data Intelligence and Security, National Engineering Research Center for Software Engineering, Peking University(北京数据智能与安全重点实验室、软件工程国家工程研究中心、北京大学)

AI总结 FedSRD通过稀疏化重建分解框架降低联邦学习中大语言模型微调的通信开销,提升异构客户端数据性能,实验显示通信成本降低达90%。

Comments Accepted by WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.20072 2026-03-26 cs.CL

From Text to Talk: Audio-Language Model Needs Non-Autoregressive Joint Training

从文本到谈话:音频-语言模型需要非自回归联合训练

Tianqiao Liu, Xueyi Li, Hao Wang, Haoxuan Li, Zhichao Chen, Weiqi Luo, Zitao Liu

机构 * Guangdong Institute of Smart Education(广东智能教育研究院) TAL Education Group(TAL教育集团) Peking University(北京大学)

AI总结 本文提出Text-to-Talk模型,通过整合自回归文本生成与非自回归音频扩散,统一训练目标,提升多模态语音交互系统性能。

详情

展开后加载摘要…

URL PDF HTML 收藏