arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 3042
2512.13043 2026-03-12 cs.CV cs.AI

GTR-Turbo: Merged Checkpoint is Secretly a Free Teacher for Agentic VLM Training

GTR-Turbo:合并的检查点实际上是为代理VLM训练提供免费的教师

Tong Wei, Yijun Yang, Changhao Zhang, Junliang Xing, Yuanchun Shi, Zongqing Lu, Deheng Ye

机构 * Tsinghua University(清华大学) Tencent Hunyuan(腾讯文生) Peking University(北京大学)

AI总结 GTR-Turbo通过合并检查点作为免费教师,提升了多模态代理训练的效率和效果。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20034 2026-03-12 cs.CV

Clair Obscur: an Illumination-Aware Method for Real-World Image Vectorization

Clair Obscur: 一种面向现实图像矢量化的照明感知方法

Xingyue Lin, Shuai Peng, Xiangyu Xie, Jianhua Zhu, Yuxuan Zhou, Liangcai Gao

机构 * Wangxuan Institute of Computer Technology, Peking University, Beijing, China(王轩计算机技术研究所,北京大学,北京,中国)

AI总结 COVec通过引入内在图像分解和光照感知,提升现实图像矢量化在视觉保真度和编辑性上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19498 2026-03-12 cs.LG cs.AI cs.CR

Hierarchical Dual-Strategy Unlearning for Biomedical and Healthcare Intelligence Using Imperfect and Privacy-Sensitive Medical Data

层次化双策略去学习用于生物医学与医疗智能的不完美和隐私敏感医疗数据

Yi Zhang, Chao Zhang, Zijian Li, Tianxiang Xu, Kunyu Zhang, Zhan Gao, Meinuo Li, Xiaohan Zhang, Qichao Qi, Bing Chen

机构 * Department of Neurosurgery, Qilu Hospital of Shandong University and Institute of Brain and Brain-Inspired Science(齐鲁医院山东大学神经外科和脑科学与脑启发科学研究院) Department of Neurosurgery, The Affiliated Hospital of Qingdao University(青岛大学附属医院神经外科) Department of Neurosurgery, Peking Union Medical College Hospital(北京地坛医院神经外科) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院) College of Artificial Intelligence, Dalian Maritime University(大连海事大学人工智能学院) University of Colorado Boulder(科罗拉多大学波尔德分校) Zhengzhou University(郑州大学) The University of Hong Kong(香港大学) Georgia Institute of Technology(佐治亚理工学院)

AI总结 本文提出层次化双策略去学习框架,用于在医疗数据中精确移除专业性知识并保留基本医疗能力,同时保障隐私并满足合规要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16410 2026-03-12 cs.CV

REALM: An MLLM-Agent Framework for Open World 3D Reasoning Segmentation and Editing on Gaussian Splatting

REALM:一种用于高斯点划法上开放世界3D推理分割和编辑的MLLM-代理框架

Changyue Shi, Minghao Chen, Yiping Mao, Chuxiao Yang, Xinyuan Hu, Jiajun Ding, Zhou Yu

机构 * Hangzhou Dianzi University(杭州电子科技大学) Peking University(北京大学)

AI总结 REALM通过MLLM-代理框架实现开放世界3D推理分割和编辑,支持多种3D交互任务。

Comments CVPR 2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08245 2026-03-12 cs.CL cs.AI cs.HC

Large Language Model Psychometrics: A Systematic Review of Evaluation, Validation, and Enhancement

大语言模型心理测量学:评估、验证与增强的系统综述

Haoran Ye, Jing Jin, Yuhang Xie, Xin Zhang, Guojie Song

机构 * State Key Laboratory of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(一般人工智能国家重点实验室,智能科学与技术学院,北京大学) School of Psychological and Cognitive Sciences, Peking University(心理学与认知科学学院,北京大学) Key Laboratory of Machine Perception (Ministry of Education), Peking University(机器感知重点实验室(教育部),北京大学)

AI总结 本文系统综述了大语言模型的心理测量学,通过整合心理测量工具和理论,提升LLM的评估、理解和增强能力,推动以人类为中心的AI发展。

Comments 400+ references

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12918 2026-03-12 cs.CL

ThinkPatterns-21k: A Systematic Study on the Impact of Thinking Patterns in LLMs

ThinkPatterns-21k: 对LLMs中思维模式影响的系统研究

Pengcheng Wen, Jiaming Ji, Chi-Min Chan, Juntao Dai, Donghai Hong, Yaodong Yang, Sirui Han, Yike Guo

机构 * Hong Kong University of Science and Technology(香港科技大学) Peking University(北京大学) Zhejiang University(浙江大学)

AI总结 ThinkPatterns-21k研究了LLMs中思维模式的影响,通过系统分析发现结构化思维对小模型有益,而大模型使用结构化思维会降低性能,独白思维在各类模型中均有效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09821 2026-03-11 cs.CL

One-Eval: An Agentic System for Automated and Traceable LLM Evaluation

One-Eval: 一个用于自动化和可追溯的LLM评估代理系统

Chengyu Shen, Yanheng Hou, Minghui Pan, Runming He, Zhen Hao Wong, Meiyi Qiang, Zhou Liu, Hao Liang, Peichao Lai, Zeang Sheng, Wentao Zhang

机构 * Peking University(北京大学) Beijing Institute of Technology(北京理工大学) Beijing University of Posts and Telecommunications(北京邮电大学) Zhongguancun Academy(中关村学院)

AI总结 One-Eval通过自动化和可追溯的评估流程,提升大语言模型评估的效率和可重复性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09517 2026-03-11 cs.CL cs.LG

You Didn't Have to Say It like That: Subliminal Learning from Faithful Paraphrases

你无需那样说:从忠实的同义词中学习的潜意识学习

Isaia Gisler, Zhonghao He, Tianyi Qiu

机构 * ETH Zürich(苏黎世联邦理工学院) University of Cambridge(剑桥大学) Peking University(北京大学)

AI总结 研究通过自然语言同义词的潜意识学习,发现即使内容与教师偏好矛盾,学生模型仍能继承偏好,揭示了训练数据中潜在影响的隐蔽性。

Comments Accepted for Spotlight presentation at EACL 2026 SRW. 5 pages, 2 figures, plus appendix. Equal supervision by Zhonghao He and Tianyi Qiu

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09163 2026-03-11 cs.RO

SPAN-Nav: Generalized Spatial Awareness for Versatile Vision-Language Navigation

SPAN-Nav: 通用空间感知用于多功能视觉-语言导航

Jiahang Liu, Tianyu Xu, Jiawei Chen, Lu Yue, Jiazhao Zhang, Zhiyong Wang, Minghan Li, Qisheng Zhao, Anqi Li, Qi Su, Zhizheng Zhang, He Wang

机构 * Peking University(北京大学) Galbot BAAI(北京人工智能研究院)

AI总结 SPAN-Nav通过端到端模型和空间感知机制,在复杂环境中实现高效的视觉-语言导航。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06748 2026-03-11 cs.LG cs.AI

Property-driven Protein Inverse Folding With Multi-Objective Preference Alignment

基于属性的蛋白质逆折叠与多目标偏好对齐

Xiaoyang Hou, Junqi Liu, Chence Shi, Xin Liu, Zhi Yang, Jian Tang

机构 * School of Computer Science, Peking University(北京大学计算机科学系) BioGeometry Mila - Québec AI Institute(魁北克人工智能研究所) Université de Montréal(蒙特利尔大学) HEC Montréal(蒙特利尔HEC商学院) CIFAR AI Research Chair(CIFAR人工智能研究主席)

AI总结 本文提出ProtAlign框架,通过多目标偏好对齐提升蛋白质序列设计的开发性与结构保真度,适用于多种蛋白质设计任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13095 2026-03-11 cs.CV cs.LG

ADHint: Adaptive Hints with Difficulty Priors for Reinforcement Learning

ADHint: 基于难度先验的自适应提示用于强化学习

Feng Zhang, Zezhong Tan, Xinhong Ma, Ziqiang Dong, Xi Leng, Jianfei Zhao, Xin Sun, Yang Yang

机构 * Alibaba Group(阿里巴巴集团) Beijing Institute of Technology(北京理工大学) Peking University(北京大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Zhongguancun Academy(中关村学院)

AI总结 ADHint通过整合难度先验,改进强化学习中的探索与模仿平衡,提升推理能力和分布外泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06702 2026-03-11 cs.CV

SPAN: Spatial-Projection Alignment for Monocular 3D Object Detection

SPAN: 用于单目3D目标检测的空间-投影对齐

Yifan Wang, Yian Zhao, Fanqi Pu, Xiaochen Yang, Yang Tang, Xi Chen, Wenming Yang

机构 * Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院) School of Electronic and Computer Engineering, Peking University(北京大学电子与计算机工程学院) School of Mathematics and Statistics, University of Glasgow(格拉斯哥大学数学与统计学学院) Basic Algorithm Center, PCG, Tencent(腾讯计算机系统有限公司基础算法中心)

AI总结 SPAN通过空间点对齐和3D-2D投影对齐解决单目3D目标检测中几何一致性不足的问题,提升检测性能。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16368 2026-03-11 cs.LG cs.AI

SATURN: SAT-based Reinforcement Learning to Unleash LLMs Reasoning

SATURN: 基于求解的强化学习以释放大语言模型的推理能力

Huanyu Liu, Ge Li, Jia Li, Hao Zhu, Kechi Zhang, Yihong Dong

机构 * Peking University(北京大学) Tsinghua University(清华大学)

AI总结 Saturn通过基于SAT问题的强化学习框架,提升大语言模型的推理能力,实现可扩展的任务构建、规则验证和难度控制,取得显著效果。

Comments Camera-ready version for Neural Information Processing Systems (NeurIPS) 2025, Spotlight Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08173 2026-03-11 cs.RO cs.AI cs.CL cs.CV

NavSpace: How Navigation Agents Follow Spatial Intelligence Instructions

NavSpace: 导航代理如何遵循空间智能指令

Haolin Yang, Yuxing Long, Zhuoyuan Yu, Zihan Yang, Minghan Wang, Jiapeng Xu, Yihan Wang, Ziyan Yu, Wenzhe Cai, Lei Kang, Hao Dong

机构 * CFCS, School of Computer Science, Peking University(计算机学院,北京大学)

AI总结 NavSpace基准测试通过评估导航代理的空间感知与推理能力,提出SNav模型在指令遵循任务中表现优异,为具身智能研究提供新基准。

Comments ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08526 2026-03-10 cs.LG cs.AI

Towards Effective and Efficient Graph Alignment without Supervision

迈向无监督图对齐的有效和高效方法

Songyang Chen, Youfang Lin, Yu Liu, Shuai Zheng, Lei Zou

机构 * Beijing Jiaotong University(北京交通大学) Peking University(北京大学)

AI总结 本文提出GlobAlign和其变体GlobAlign-E,通过全局表示和最优传输方法实现高效且准确的无监督图对齐,显著提升精度和效率。

Comments World Wide Web Journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22555 2026-03-10 cs.LG cs.AI

Autoregressive Visual Decoding from EEG Signals

从EEG信号进行自回归视觉解码

Sicheng Dai, Hongwang Xiao, Shan Yu, Qiwei Ye

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artifcial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology(脑认知与脑启智技术国家重点实验室) Beijing Academy of Artificial Intelligence(北京人工智能研究院) National Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室)

AI总结 AVDE通过自回归生成框架和对比学习提升EEG信号的视觉解码效率,实现高效且可解释的脑机接口应用。

Journal ref ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.23014 2026-03-10 cs.LG cs.CL

Mem-T: Densifying Rewards for Long-Horizon Memory Agents

Mem-T: 长时间 horizon 记忆代理的奖励密集化

Yanwei Yue, Boci Peng, Xuanbo Fan, Jiaxin Guo, Qiankun Li, Yan Zhang

机构 * Peking University(北京大学) Nanyang Technological University(南洋理工大学)

AI总结 Mem-T通过引入树引导的强化学习框架,实现长时间 horizon 记忆管理的高效训练,显著提升性能并优化效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19719 2026-03-10 cs.LG cs.AI

OCN: Effectively Utilizing Higher-Order Common Neighbors for Better Link Prediction

OCN:有效利用高阶共同邻居以实现更好的链接预测

Juntong Wang, Xiyuan Wang, Muhan Zhang

机构 * Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学) School of Intelligence Science and Technology, Peking University(智能科学与技术学院,北京大学)

AI总结 OCN通过正交化和归一化技术有效利用高阶共同邻居,显著提升链接预测性能。

Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

Journal ref 39th Conference on Neural Information Processing Systems (NeurIPS 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.07547 2026-03-10 cs.NE cs.AI

Rethinking SNN Online Training and Deployment: Gradient-Coherent Learning via Hybrid-Driven LIF Model

重新思考SNN在线训练与部署:通过混合驱动LIF模型实现梯度一致学习

Zecheng Hao, Yifan Huang, Zijie Xu, Wenxuan Liu, Yuanhong Tang, Zhaofei Yu, Tiejun Huang

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) State Key Laboratory for Multimedia Information Processing, Peking University(北京大学多媒体信息处理国家重点实验室) Beijing Key Laboratory of Brain-inspired Spiking Large Models, Peking University(北京脑启发式脉冲大规模模型重点实验室) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院)

AI总结 本文提出混合驱动LIF模型,通过分离时间梯度和优化资源,突破传统SNN在线训练与部署的局限,实现性能和效率的提升。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08137 2026-03-10 cs.LG

Mitigating Homophily Disparity in Graph Anomaly Detection: A Scalable and Adaptive Approach

缓解图异常检测中的同质性差异:一种可扩展和自适应的方法

Yunhui Liu, Qizhuo Xie, Yinfeng Chen, Xudong Jin, Tao Zheng, Bin Chong, Tieke He

机构 * State Key Laboratory for Novel Software Technology(新型软件技术国家重点实验室) Nanjing University(南京大学) National Engineering Laboratory for Big Data Analysis and Applications(大数据分析与应用国家工程实验室) Peking University(北京大学)

AI总结 SAGAD通过自适应融合和频率偏好指导损失,有效缓解图异常检测中的同质性差异,实现高效且可扩展的异常检测

Comments Accepted by WWW 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08035 2026-03-10 cs.AI cs.LG

CDRRM: Contrast-Driven Rubric Generation for Reliable and Interpretable Reward Modeling

CDRRM:基于对比的评分标准生成用于可靠和可解释的奖励建模

Dengcan Liu, Fengkai Yang, Xiaohan Wang, Shurui Yan, Jiajun Chai, Jiahao Li, Yikun Ban, Zhendong Mao, Wei Lin, Guojun Yin

机构 * University of Science and Technology of China(科学技术大学) Peking University(北京大学) BeiHang University(北航大学)

AI总结 CDRRM通过对比驱动的评分标准生成方法,实现可靠且可解释的奖励建模,有效缓解评估偏见并提升数据效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07799 2026-03-10 cs.CV cs.RO

MWM: Mobile World Models for Action-Conditioned Consistent Prediction

MWM: 移动世界模型用于动作条件一致预测

Han Yan, Zishang Xiang, Zeyu Zhang, Hao Tang

机构 * School of Computer Science, Peking University(北京大学计算机科学系)

AI总结 MWM提出了一种移动世界模型,通过两阶段训练框架和推理一致状态蒸馏提升动作条件一致性的图像目标导航性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07660 2026-03-10 cs.CV

Holi-Spatial: Evolving Video Streams into Holistic 3D Spatial Intelligence

Holi-Spatial: 将视频流转化为整体3D空间智能

Yuanyuan Gao, Hao Li, Yifei Liu, Xinhao Ji, Yuning Gong, Yuanjun Liao, Fangfu Liu, Manyuan Zhang, Yuchen Yang, Dan Xu, Xue Yang, Huaxi Huang, Hongjie Zhang, Ziwei Liu, Xiao Sun, Dingwen Zhang, Zhihang Zhong

机构 * Shanghai AI Lab(上海人工智能实验室) Northwestern Polytechnical University(西北工业大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学) Nanyang Technological University(南洋理工大学) Beihang University(北京航空航天大学) Sichuan University(四川大学) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) Fudan University(复旦大学) Hong Kong University of Science and Technology(香港科技大学)

AI总结 Holi-Spatial通过自动化方法构建大规模多模态3D空间数据集,提升空间推理任务的模型性能。

Comments project page: https://visionary-laboratory.github.io/holi-spatial/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07492 2026-03-10 cs.IT cs.ET cs.HC cs.LG math.IT

Pushing Bistatic Wireless Sensing toward High Accuracy at the Sub-Wavelength Scale

推动双工信无线传感在亚波长尺度上的高精度

Wenwei Li, Jiarun Zhou, Qinxiao Quan, Fusang Zhang, Daqing Zhang

机构 * School of Computer Science, Peking University, Beijing, China(北京大学计算机科学学院) School of Cyber Science and Technology, Beihang University, Beijing, China(北航信息科学与技术学院) Telecom SudParis, Institut Polytechnique de Paris, Paris, France(巴黎理工电信学院)

AI总结 本文提出了一种基于信道响应幅度恢复理想信道特征的方法,有效提升了亚波长尺度的无线传感精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02872 2026-03-10 cs.LG cs.AI cs.FL cs.LO

FATE: A Formal Benchmark Series for Frontier Algebra of Multiple Difficulty Levels

FATE:面向多难度层级的前沿代数形式化基准系列

Jiedong Jiang, Wanyi He, Yuefeng Wang, Guoxiong Gao, Yongle Hu, Jingting Wang, Nailin Guan, Peihao Wu, Chunbo Dai, Liang Xiao, Bin Dong

机构 * Westlake Institute for Advanced Study, Westlake University(西拉丘学院先进研究院,西拉丘大学) Peking University(北京大学) New Cornerstone Science Laboratory, School of Mathematical Sciences, Peking University(新基石科学实验室,北京大学数学科学学院) Center for Machine Learning Research, Peking University(机器学习研究中心,北京大学) Center for Intelligent Computing, Great Bay Institute for Advanced Study, Great Bay University(智能计算中心,大湾先进研究院,大湾大学)

AI总结 FATE是一个面向多难度层级的前沿代数形式化基准系列,旨在评估和推动高级数学推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24118 2026-03-10 cs.RO cs.AI

LagMemo: Language 3D Gaussian Splatting Memory for Multi-modal Open-vocabulary Multi-goal Visual Navigation

LagMemo: 语言3D高斯点云记忆用于多模态开放词汇多目标视觉导航

Haotian Zhou, Xiaole Wang, He Li, Zhuo Qi, Jinrun Yin, Haiyu Kong, Jianghuan Xu, Huijing Zhao

机构 * Key Laboratory of Machine Perceptions (MOE), School of Intelligence Science and Technology, Peking University(机器感知重点实验室(教委)、智能科学与技术学院、北京大学)

AI总结 LagMemo通过语言3D高斯点云记忆实现多模态开放词汇多目标视觉导航,有效提升多目标定位性能

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20331 2026-03-10 cs.CV

AnyPcc: Compressing Any Point Cloud with a Single Universal Model

AnyPcc: 用单一通用模型压缩任意点云

Kangli Wang, Qianxi Yi, Yuqi Ye, Shihao Li, Wei Gao

机构 * SECE, Peking University(北京大学SECE学院) Peng Cheng Laboratory(鹏城实验室)

AI总结 AnyPcc通过通用上下文模型和实例自适应微调策略,实现高效且鲁棒的点云压缩,适用于各种密度数据。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17635 2026-03-10 cs.CV

LangSurf: Language-Embedded Surface Gaussians for 3D Scene Understanding

LangSurf: 语言嵌入的表面高斯用于3D场景理解

Hao Li, Minghan Qin, Zhengyu Zou, Diqi He, Xinhao Ji, Bohan Li, Bingquan Dai, Dingewn Zhang, Junwei Han

机构 * Brain and Artificial Intelligence Lab, Northwestern Polytechnical University(脑科学与人工智能实验室,西北工业大学) Tsinghua University(清华大学) Shanghai Jiaotong University(上海交通大学) Peking University(北京大学) School of Artifical Intelligence, Chongqing University of Posts and Telecommunications(人工智能学院,重庆邮电大学)

AI总结 LangSurf通过语言嵌入的表面高斯实现3D场景理解,提升2D和3D分割精度,扩展了下游任务如去除和编辑。

Comments \url{https://langsurf.github.io}

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07040 2026-03-10 cs.RO

TacDexGrasp: Compliant and Robust Dexterous Grasping with Tactile Feedback

TacDexGrasp: 基于触觉反馈的灵活且稳健的灵巧抓取

Yubin Ke, Jiayi Chen, Hang Lv, Xiao Zhou, He Wang

机构 * Peking University(北京大学) Galbot Beijing Academy of Artificial Intelligence(北京人工智能研究院)

AI总结 TacDexGrasp通过触觉反馈和SOCP控制器实现灵活且稳健的灵巧抓取,有效解决多指抓取中的力分配和滑动问题。

Comments 8pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06595 2026-03-10 cs.CL

Rethinking Personalization in Large Language Models at the Token Level

重新思考在词级别上的大语言模型个性化

Chenheng Zhang, Yijun Lu, Lizhe Fang, Chunyuan Zheng, Jiajun Chai, Xiaohan Wang, Guojun Yin, Wei Lin, Yisen Wang, Zhouchen Lin

机构 * Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学) State Key Lab of General Artificial Intelligence, School of Intelligence Science and Technology, Peking University(通用人工智能国家重点实验室,北京大学智能科学与技术学院) School of Mathematical Sciences, Peking University(数学科学学院,北京大学)

AI总结 PerContrast通过自对比方法和PerCE损失提升大语言模型在词级别上的个性化性能,实现平均收益超10%并具有良好的迁移能力。

详情

展开后加载摘要…

URL PDF HTML 收藏