arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 3042
2601.06002 2026-01-14 cs.CL cs.AI

The Molecular Structure of Thought: Mapping the Topology of Long Chain-of-Thought Reasoning

思维的分子结构:映射长链推理的拓扑结构

Qiguang Chen, Yantao Du, Ziniu Li, Jinhao Liu, Songyao Duan, Jiarui Guo, Minghao Liu, Jiaheng Liu, Tong Yang, Ge Zhang, Libo Qin, Wanxiang Che, Wenhao Huang

机构 * LARG, SCIR, Harbin Institute of Technology(LARG、SCIR、哈尔滨工业大学) Peking University(北京大学) Nanjing University(南京大学) Central South University(中南大学)

AI总结 本文提出通过分子结构类比理解长链推理的拓扑特性,引入有效语义异构体概念,并提出Mole-Syn方法提升长链推理性能和稳定性。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.04954 2026-01-14 cs.LG cs.AI

Precision over Diversity: High-Precision Reward Generalizes to Robust Instruction Following

精确性胜过多样性:高精度奖励能泛化到稳健的指令跟随

Yirong Zeng, Yufei Liu, Xiao Ding, Yutai Hou, Yuxian Wang, Haonan Song, Wu Ning, Dandan Tu, Qixun Zhang, Bibo Cai, Yuxiang He, Ting Liu

机构 * Harbin Institute of Technology, SCIR(哈尔滨工业大学,SCIR) Peking University(北京大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 本研究发现高精度奖励优于多样化的约束混合,提出数据导向的优化策略,提升指令跟随性能并减少训练时间。

Comments Under review, 13 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13564 2026-01-14 cs.CL cs.AI

Memory in the Age of AI Agents

人工智能代理时代的记忆

Yuyang Hu, Shichun Liu, Yanwei Yue, Guibin Zhang, Boyang Liu, Fangyi Zhu, Jiahang Lin, Honglin Guo, Shihan Dou, Zhiheng Xi, Senjie Jin, Jiejun Tan, Yanbin Yin, Jiongnan Liu, Zeyu Zhang, Zhongxiang Sun, Yutao Zhu, Hao Sun, Boci Peng, Zhenrong Cheng, Xuanbo Fan, Jiaxin Guo, Xinlei Yu, Zhenhong Zhou, Zewen Hu, Jiahao Huo, Junhao Wang, Yuwei Niu, Yu Wang, Zhenfei Yin, Xiaobin Hu, Yue Liao, Qiankun Li, Kun Wang, Wangchunshu Zhou, Yixin Liu, Dawei Cheng, Qi Zhang, Tao Gui, Shirui Pan, Yan Zhang, Philip Torr, Zhicheng Dou, Ji-Rong Wen, Xuanjing Huang, Yu-Gang Jiang, Shuicheng Yan

机构 * Core Supervisors. 0.5em Affiliations: National University of Singapore, Renmin University of China, Fudan University, Peking University, Nanyang Technological University, Tongji University, University of California San Diego, Hong Kong University of Science Technology (Guangzhou), Griffith University, Georgia Institute of Technology, OPPO, Oxford University

AI总结 本文系统梳理了人工智能代理记忆的现状与分类,提出了记忆的三种形式、功能分类及动态分析,为未来智能设计提供理论基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02004 2026-01-14 cs.LG cs.CL

AlignSAE: Concept-Aligned Sparse Autoencoders

AlignSAE:概念对齐的稀疏自编码器

Minglai Yang, Xinyu Guo, Zhengliang Shi, Jinhe Bi, Steven Bethard, Mihai Surdeanu, Liangming Pan

机构 * University of Arizona(亚利桑那大学) Peking University(北京大学) Shandong University(山东大学) LMU Munich(慕尼黑大学)

AI总结 AlignSAE通过预训练和后训练课程方法,实现稀疏自编码器特征与概念的对齐,提升模型对特定概念的可控性和可解释性。

Comments 23 pages, 16 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07553 2026-01-14 cs.AI q-bio.QM

GTR-CoT: Graph Traversal as Visual Chain of Thought for Molecular Structure Recognition

GTR-CoT:图遍历作为视觉推理链用于分子结构识别

Jingchao Wang, Yifan He, Haote Yang, Jiang Wu, Lingli Ge, Xingjian Wei, Yinfan Wang, Linye Li, Huijie Ao, Chengjin Liu, Bin Wang, Lijun Wu, Conghui He

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) East China Normal University(华东师范大学) Peking University(北京大学) Shanghai Jiaotong University(上海交通大学) Tongji University(同济大学) Fudan University(复旦大学) Northwestern Polytechnical University(西北工业大学)

AI总结 GTR-CoT通过图遍历机制和强化学习提升手绘分子结构识别性能,构建首个细粒度评估基准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08120 2026-01-14 cs.CV cs.AI cs.LG cs.MM

UniF$^2$ace: A Unified Fine-grained Face Understanding and Generation Model

UniF$^2$ace: 一个统一的细粒度人脸理解和生成模型

Junzhe Li, Sifan Zhou, Liya Guo, Xuerui Qiu, Linrui Xu, Delin Qu, Tingting Long, Chun Fan, Ming Li, Hehe Fan, Jun Liu, Shuicheng Yan

机构 * Peking University(北京大学) Carnegie Mellon University(卡内基梅隆大学) Tsinghua University(清华大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Central South University(中南大学) Fudan University(复旦大学) Guangming Lab(光明实验室) Zhejiang University(浙江大学) Lancaster University(兰卡斯特大学) National University of Singapore(新加坡国立大学)

AI总结 UniF$^2$ace是一个专门针对细粒度人脸理解和生成的统一多模态模型,通过双离散扩散损失和多级分组专家混合架构,提升高质量面部细节生成和细粒度属性处理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09838 2026-01-14 cs.CV cs.AI

ClimateIQA: A New Dataset and Benchmark to Advance Vision-Language Models in Meteorology Anomalies Analysis

ClimateIQA: 一种新的数据集和基准,以推进气象异常分析中的视觉-语言模型

Jian Chen, Peilin Zhou, Yining Hua, Dading Chong, Meng Cao, Yaowei Li, Wei Chen, Bing Zhu, Junwei Liang, Zixuan Yuan

机构 * Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou)(人工智能研究所,香港科学与技术大学(广州)) Thrust of Data Science and Analytics, The Hong Kong University of Science and Technology (Guangzhou)(数据科学与分析研究所,香港科学与技术大学(广州)) Harvard University(哈佛大学) Peking University(北京大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

AI总结 ClimateIQA通过引入SPOT算法和新型数据集,提升视觉-语言模型在气象异常分析中的准确性和表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07261 2026-01-13 cs.LG cs.AI q-bio.QM

Pseudodata-guided Invariant Representation Learning Boosts the Out-of-Distribution Generalization in Enzymatic Kinetic Parameter Prediction

伪数据引导的不变表示学习提升酶动力学参数预测的分布外泛化能力

Haomin Wu, Zhiwei Nie, Hongyu Zhang, Zhixiang Ren

机构 * Pengcheng Laboratory, Shenzhen, China(鹏城实验室,深圳,中国) Southern University of Science and Technology, Shenzhen, China(南方科技大学,深圳,中国) School of Electronic and Computer Engineering, Peking University, Shenzhen, China(北京大学电子与计算机工程学院,深圳,中国)

AI总结 O$^2$DENet通过生物化学引导的扰动增强和不变表示学习,提升酶动力学参数预测在分布外情况下的泛化能力,实现对k_cat和K_m的高准确性和鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07238 2026-01-13 cs.AI

Group Pattern Selection Optimization: Let LRMs Pick the Right Pattern for Reasoning

分组模式选择优化:让大推理模型选择正确的推理模式

Hanbin Wang, Jingwei Song, Jinpeng Li, Fei Mi, Lifeng Shang

机构 * Peking University(北京大学) The University of Hong Kong(香港大学) Huawei Noah’s Ark Lab(华为诺亚实验室)

AI总结 GPSO通过强化学习框架优化大推理模型的推理模式选择,提升其在不同问题上的推理性能。

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.07023 2026-01-13 cs.AI

CloneMem: Benchmarking Long-Term Memory for AI Clones

CloneMem:用于AI克隆的长期记忆基准测试

Sen Hu, Zhiyu Zhang, Yuxiang Wei, Xueran Han, Zhenheng Tang, Huacan Wang, Ronghao Chen

机构 * Peking University(北京大学) UC Davis(加州大学戴维斯分校) Georgia Tech(佐治亚理工学院) MBZUAI(穆桑人工智能研究所) HKUST(香港科技大学) UCAS(中国科学技术大学)

AI总结 CloneMem是一个用于评估AI克隆长期记忆能力的基准,通过非对话数字痕迹数据,评估代理对个人状态演变的跟踪能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06966 2026-01-13 cs.CL cs.AI

RealMem: Benchmarking LLMs in Real-World Memory-Driven Interaction

RealMem: 在真实世界中评估大语言模型的内存驱动交互

Haonan Bian, Zhiyuan Yao, Sen Hu, Zishan Xu, Shaolei Zhang, Yifu Guo, Ziliang Yang, Xueran Han, Huacan Wang, Ronghao Chen

机构 * Xidian University(西安电子科技大学) Zhejiang University(浙江大学) Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Renmin University of China(中国人民大学) Sun Yat-sen University(中山大学) University of the Chinese Academy of Sciences(中国科学院大学)

AI总结 RealMem是一个基于真实项目场景的基准,评估大语言模型在长期项目导向交互中的记忆管理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03769 2026-01-13 cs.AI

EntroCoT: Enhancing Chain-of-Thought via Adaptive Entropy-Guided Segmentation

EntroCoT:通过自适应熵引导分割增强链式思考

Zihang Li, Yuhang Wang, Yikun Zong, Wenhan Yu, Xiaokun Yuan, Runhan Jiang, Zirui Liu, Tong Yang, Arthur Jiang

机构 * Peking University(北京大学) IQuest Research(IQuest研究)

AI总结 EntroCoT通过自适应熵引导分割提升链式思考的推理质量,构建高质量数据集以提高大语言模型的数学推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23027 2026-01-13 cs.LG cs.CL

Towards Stable and Effective Reinforcement Learning for Mixture-of-Experts

面向混合专家架构的稳定且有效的强化学习

Di Zhang, Xun Wu, Shaohan Huang, Lingjie Jiang, Yaru Hao, Li Dong, Zewen Chi, Zhifang Sui, Furu Wei

机构 * Microsoft Research(微软研究院) Peking University(北京大学)

AI总结 本文提出一种路由感知方法,通过优化重要性采样权重提升混合专家架构的强化学习稳定性与性能。

Comments Added additional experiments, improved analysis, and fixed minor issues

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.23013 2026-01-13 cs.LG cs.AI

MoEMeta: Mixture-of-Experts Meta Learning for Few-Shot Relational Learning

MoEMeta:基于少量样本关系学习的专家混合元学习

Han Wu, Jie Yin

机构 * The University of Sydney, Australia(悉尼大学) Peking University, China(北京大学)

AI总结 MoEMeta通过混合专家模型和任务定制适应机制,提升少样本关系学习的泛化与适应能力。

Comments Appear in NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09681 2026-01-13 cs.IR cs.AI cs.CL cs.LG

DB3 Team's Solution For Meta KDD Cup' 25

DB3团队的Meta KDD杯'25解决方案

Yikuan Xia, Jiazun Chen, Yirui Zhan, Suifeng Zhao, Weipeng Jiang, Chaorui Zhang, Wei Han, Bo Bai, Jun Gao

机构 * Key Laboratory of High Confidence Software Technologies, CS, Peking University, China(高可信软件技术重点实验室,中国科学院,北京大学) Theory Lab, Central Research Institute, 2012 Labs, Huawei Technologies Co., Ltd, Shenzhen, China(理论实验室,中央研究院,2012实验室,华为技术有限公司,深圳)

AI总结 DB3团队通过多模态检索框架和拒绝训练方法,在KDD杯'25的CRAG-MM挑战中取得优异成绩,尤其在处理第一人称视角问题上表现突出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06566 2026-01-13 q-fin.ST cs.LG q-fin.MF

Diffusion Factor Models: Generating High-Dimensional Returns with Factor Structure

扩散因子模型:利用因子结构生成高维收益率

Minshuo Chen, Renyuan Xu, Yumin Xu, Ruixun Zhang

机构 * Department of Industrial Engineering and Management Sciences, Northwestern University(西北大学工业工程与管理科学系) Department of Management Science & Engineering, Stanford University(斯坦福大学管理科学与工程系) School of Mathematical Sciences, Peking University(北京大学数学科学学院) School of Mathematical Sciences, Center for Statistical Science, Laboratory for Mathematical Economics and Quantitative Finance, and National Engineering Laboratory for Big Data Analysis and Applications, Peking University(北京大学数学科学学院)

AI总结 本文提出扩散因子模型,通过整合因子结构与生成扩散过程,解决高维金融模拟中的维度诅咒和数据稀缺问题,提供了一种在有限数据下生成高维收益率的系统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.02283 2026-01-13 cs.CV cs.AI

GP-GS: Gaussian Processes Densification for 3D Gaussian Splatting

GP-GS:基于高斯过程的3D高斯点云密集化

Zhihao Guo, Jingxuan Su, Chenghao Qian, Shenglin Wang, Jinlong Fan, Jing Zhang, Wei Zhou, Hadi Amirpour, Yunlong Zhao, Liangxiu Han, Peng Wang

机构 * Manchester Metropolitan University(曼彻斯特 Metropolitan 大学) SECE, Peking University(SECE,北京大学) University of Leeds(利兹大学) Pengcheng Laboratory(鹏城实验室) Hangzhou Dianzi University(杭州电子科技大学) Wuhan University(武汉大学) Cardiff University(卡迪夫大学) University of Klagenfurt(克雷夫大学) Imperial College London(伦敦帝国学院)

AI总结 GP-GS通过高斯过程实现3D高斯点云的密集化优化,提升重建质量和渲染保真度,达到1.12 dB PSNR的改进。

Comments 11 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06496 2026-01-13 cs.CV

3D CoCa v2: Contrastive Learners with Test-Time Search for Generalizable Spatial Intelligence

3D CoCa v2:基于测试时间搜索的对比学习用于通用空间智能

Hao Tang, Ting Huang, Zeyu Zhang

机构 * School of Computer Science, Peking University(北京大学计算机学院)

AI总结 3D CoCa v2通过测试时间搜索提升3D场景描述的泛化能力,实现对比学习与描述生成的统一,提高鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06193 2026-01-13 cs.LG cs.AI cs.CL

MLB: A Scenario-Driven Benchmark for Evaluating Large Language Models in Clinical Applications

MLB:面向临床应用的大型语言模型评估场景驱动基准

Qing He, Dongsheng Bi, Jianrong Lu, Minghui Yang, Zixiao Chen, Jiacheng Lu, Jing Chen, Nannan Du, Xiao Cu, Sijing Wu, Peng Xiang, Yinyin Hu, Yi Guo, Chunpu Li, Shaoyang Li, Zhuo Dong, Ming Jiang, Shuai Guo, Liyun Feng, Jin Peng, Jian Wang, Jinjie Gu, Junwei Liu

机构 * Ant Group(蚂蚁集团) Zhejiang University(浙江大学) Health Information Center of Zhejiang Province(浙江省健康信息中心) Peking University(北京大学)

AI总结 MLB基准通过场景驱动的评估方法,评估大型语言模型在临床应用中的表现,揭示模型在结构化任务与患者交互场景间的性能差异。

Comments 11 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06176 2026-01-13 cs.CV

TIR-Flow: Active Video Search and Reasoning with Frozen VLMs

TIR-Flow:基于冻结视频语言模型的主动视频搜索与推理

Hongbo Jin, Siyi Xie, Jiayu Ding, Kuanwei Lin, Ge Li

机构 * School of Electronic and Computer Engineering, Peking University(电子与计算机工程学院,北京大学)

AI总结 TIR-Flow通过三个协同模块实现冻结视频语言模型的主动视频搜索与推理,显著提升性能并拓展长视界视频推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06064 2026-01-13 cs.CY cs.AI cs.MA

Socio-technical aspects of Agentic AI

群体技术视角下的代理AI

Praveen Kumar Donta, Alaa Saleh, Ying Li, Shubham Vaishnav, Kai Fang, Hailin Feng, Yuchao Xia, Thippa Reddy Gadekallu, Qiyang Zhang, Xiaodan Shi, Ali Beikmohammadi, Sindri Magnússon, Ilir Murturi, Chinmaya Kumar Dehury, Marcin Paprzycki, Lauri Loven, Sasu Tarkoma, Schahram Dustdar

机构 * Department of Computer and Systems Sciences, Stockholm University(斯德哥尔摩大学计算机与系统科学系) Center for Ubiquitous Computing, University of Oulu(奥卢大学无处不在计算中心) College of Computer Science and Engineering, Northeastern University(东北大学计算机科学与工程学院) Zhejiang A\&F University, Hangzhou(浙江工业大学之江学院) School of Computer Science, Peking University(北京大学计算机科学学院) Department of Mechatronics, University of Prishtina(普里什蒂纳大学机电系) Department of Computer Science, IISER Berhampur(伯尔哈普尔IISER计算机科学系) Systems Research Institute Polish Academy of Sciences(波兰科学院系统研究所) Department of Computer Science, University of Helsinki(赫尔辛基大学计算机科学系)

AI总结 本文从社会技术视角探讨代理AI,分析其技术组件与社会背景的关联,揭示伦理挑战及未来研究方向。

Comments Dear Reviewer, please note that this is not survey/review or position paper. This paper introduced new framework (MAD-BAD-SAD Framework) for Socio-technical aspects of Agentic AI, Ethical considerations, which is very important to consider beside technical development

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14817 2026-01-13 cs.CV cs.NA math.NA

Fracture interactive geodesic active contours for bone segmentation

骨折交互测地主动轮廓用于骨分割

Liheng Wang, Licheng Zhang, Hailin Xu, Jingxin Zhao, Xiuyun Su, Jiantao Li, Miutian Tang, Weilu Gao, Chong Chen

机构 * State Key Laboratory of Mathematical Sciences, Academy of Mathematics and Systems Science, Chinese Academy of Sciences, Beijing 100190, China(数学科学国家重点实验室,数学与系统科学研究院,中国科学院,北京) University of Chinese Academy of Sciences, Beijing 100190, China(中国科学院大学,北京) Department of Orthopedics, The Fourth Medical Center of Chinese PLA General Hospital, Beijing 100048, China(中国人民解放军总医院第四医学中心骨科,北京) National Clinical Research Center for Orthopedics, Sports Medicine and Rehabilitation, Beijing 100048, China(骨科、运动医学与康复国家临床医学研究中心,北京) Department of Trauma and Orthopedics, People’s Hospital Peking University, Beijing 100044, China(北京大学人民医院创伤与骨科,北京)

AI总结 本文提出一种针对骨骨折分割的改进测地主动轮廓算法,通过结合强度和梯度范数的边缘检测函数,提升骨分割的鲁棒性和准确性。

Comments 27 pages, 10 figures, 1 table

Journal ref Pattern Recognition 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08211 2026-01-13 cs.CL cs.AI cs.LG

SAEMark: Steering Personalized Multilingual LLM Watermarks with Sparse Autoencoders

SAEMark: 通过稀疏自编码器引导个性化多语言大语言模型水印

Zhuohao Yu, Xingru Jiang, Weizheng Gu, Yidong Wang, Qingsong Wen, Shikun Zhang, Wei Ye

机构 * Peking University(北京大学)

AI总结 SAEMark通过稀疏自编码器实现多语言大语言模型的高效水印标记,无需修改模型参数,保持文本质量,适用于多种语言和领域。

Comments 24 pages, 12 figures, NeurIPS 2025, code available: https://zhuohaoyu.github.io/SAEMark

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06472 2026-01-13 cs.CL cs.AI cs.CE cs.DL

KARMA: Leveraging Multi-Agent LLMs for Automated Knowledge Graph Enrichment

KARMA:利用多智能体大语言模型实现知识图谱的自动化丰富

Yuxing Lu, Wei Wu, Xukai Zhao, Rui Peng, Jinzhuo Wang

机构 * Department of Big Data and Biomedical AI, Peking University(北京大学大数据与生物医学人工智能系) Wallace H. Coulter Department of Biomedical Engineering, Georgia Institute of Technology(佐治亚理工学院生物医学工程系) School of Architecture, Tsinghua University(清华大学建筑学院)

AI总结 KARMA通过多智能体大语言模型自动丰富知识图谱,有效识别新实体并提高正确性与一致性

Comments 24 pages, 3 figures, 2 tables

Journal ref Spotlight paper of NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05785 2026-01-12 cs.CV cs.AI

Adaptive Disentangled Representation Learning for Incomplete Multi-View Multi-Label Classification

自适应解耦表征学习用于不完整多视图多标签分类

Quanjiang Li, Zhiming Liu, Tianxiang Xu, Tingjin Luo, Chenping Hou

机构 * College of Science, National University of Defense Technology(国防科技大学科学学院) College of Artificial Intelligence, Harbin Institute of Technology(哈尔滨工业大学人工智能学院) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院)

AI总结 ADRL通过自适应解耦表征学习方法解决多视图多标签分类中的特征缺失和标注不完整问题,提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05593 2026-01-12 cs.LG

PaCoRe: Learning to Scale Test-Time Compute with Parallel Coordinated Reasoning

PaCoRe: 通过并行协调推理学习扩展测试时间计算

Jingcheng Hu, Yinmin Zhang, Shijie Shang, Xiaobo Yang, Yue Peng, Zhewei Huang, Hebin Zhou, Xin Wu, Jie Cheng, Fanqi Wan, Xiangwen Kong, Chengyuan Yao, Kaiwen Yan, Ailin Huang, Hongyu Zhou, Qi Han, Zheng Ge, Daxin Jiang, Xiangyu Zhang, Heung-Yeung Shum

机构 * StepFun Tsinghua University(清华大学) Peking University(北京大学)

AI总结 PaCoRe通过并行协调推理框架,实现大规模测试时间计算扩展,提升数学推理能力至94.5%

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05501 2026-01-12 cs.LG cs.CL

Hi-ZFO: Hierarchical Zeroth- and First-Order LLM Fine-Tuning via Importance-Guided Tensor Selection

Hi-ZFO:通过重要性引导的张量选择实现层次化零阶和一阶LLM微调

Feihu Jin, Ying Tan

机构 * School of Intelligence Science and Technology, Peking University(智能科学与技术学院,北京大学) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室)

AI总结 Hi-ZFO通过结合一阶和零阶优化,提升LLM微调的精度与探索能力,有效解决训练中的局部极小值问题。

Comments 13 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21541 2026-01-12 cs.CV

Video Generation Models Are Good Latent Reward Models

视频生成模型是良好的潜在奖励模型

Xiaoyue Mi, Wenqing Yu, Jiesong Lian, Shibo Jie, Ruizhe Zhong, Zijun Liu, Guozhen Zhang, Zixiang Zhou, Zhiyong Xu, Yuan Zhou, Qinglin Lu, Fan Tang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Tencent Hunyuan(腾讯文元) Huazhong University of Science and Technology(华中科技大学) Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Nanjing University(南京大学)

AI总结 本文提出PRFL框架,利用预训练视频生成模型在噪声潜在空间中进行奖励建模,实现高效去噪和降低训练成本。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21135 2026-01-12 cs.LG

DynaMo: Runtime Switchable Quantization for MoE with Cross-Dataset Adaptation

DynaMo: 用于MoE的运行时可切换量化与跨数据集适应

Zihao Zheng, Xiuping Cui, Size Zheng, Maoliang Li, Jiayu Chen, Yun Liang, Xiang Chen

机构 * School of Computer Science Peking University Beijing, China(计算机科学学院 首都大学 中国北京) School of Integrated Circuits Peking University Beijing, China(集成电路学院 首都大学 中国北京)

AI总结 DynaMo通过多级分析揭示MoE动态,提出可切换量化框架,实现跨数据集适应并提升模型性能与效率。

Comments This paper has been accepted by DATE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.15986 2026-01-12 cs.NE cs.CV

SpiLiFormer: Enhancing Spiking Transformers with Lateral Inhibition

SpiLiFormer:通过横向抑制增强脉冲变换器

Zeqi Zheng, Yanchen Huang, Yingchao Yu, Zizheng Zhu, Junfeng Tang, Zhaofei Yu, Yaochu Jin

机构 * Zhejiang University(浙江大学) Westlake University(西湖大学) Nanjing University(南京大学) Donghua University(东华大学) University of Electronic Science and Technology of China(电子科技大学) Peking University(北京大学)

AI总结 SpiLiFormer通过引入横向抑制机制,提升脉冲变换器对相关上下文的注意力,从而在多个数据集上取得更优性能。

Comments Accepted by ICCV 2025. The first two authors contributed equally

Journal ref Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), 2025, pp. 24539-24548

详情

展开后加载摘要…

URL PDF HTML 收藏