arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Peking University(北京大学)

共收录 3042
2506.02019 2026-02-10 cs.CL

ChatCFD: An LLM-Driven Agent for End-to-End CFD Automation with Structured Knowledge and Reasoning

ChatCFD: 一种基于大语言模型的端到端CFD自动化代理

E Fan, Kang Hu, Zhuowen Wu, Jiangyang Ge, Jiawei Miao, Yuzhi Zhang, He Sun, Weizong Wang, Tianhan Zhang

机构 * Department of Mechanics and Aerospace Engineering, Southern University of Science and Technology(南方科技大学机械与航空航天工程系) School of Astronautics, Beihang University(北航航天学院) DP Technology, Beijing(北京DP技术) College of Future Technology, Peking University(北京大学未来技术学院) National Biomedical Imaging Center, Peking University(北京大学国家生物医学成像中心) State Key Laboratory of High-Efficiency Reusable Aerospace Transportation Technology(高性能可重复使用航天运输技术国家重点实验室) Key Laboratory of Spacecraft Design Optimization and Dynamic Simulation Technology, Ministry of Education(航天器设计优化与动态仿真技术重点实验室)

AI总结 ChatCFD通过结构化知识和推理,实现端到端CFD自动化,显著提升执行成功率和物理保真度,具备高灵活性和模块化设计。

Comments 19 pages, 8 figures

Journal ref Adv. Intell. Discov. 2025, 2500174

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10989 2026-02-10 cs.AI

DRAGON: Domain-specific Robust Automatic Data Generation for RAG Optimization

DRAGON: 领域特定的鲁棒自动数据生成用于RAG优化

Haiyang Shen, Hang Yan, Zhongshi Xing, Mugeng Liu, Yue Li, Zhiyang Chen, Yuxiang Wang, Jiuzheng Wang, Yun Ma

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) School of Computer Science, Peking University(北京大学计算机学院) The Chinese University of Hong Kong(香港中文大学) School of Computer Science, Sun Yat-sen University(中山大学计算机学院) School of Software & Microelectronics, Peking University(北京大学软件与微电子学院)

AI总结 DRAGON通过领域特定的自动数据生成优化RAG检索性能,提升跨领域检索鲁棒性和系统准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06825 2026-02-09 cs.LG cs.AI cs.CV

AEGPO: Adaptive Entropy-Guided Policy Optimization for Diffusion Models

AEGPO:适应性熵引导策略优化用于扩散模型

Yuming Li, Qingyu Li, Chengyu Bai, Xiangyang Luo, Zeyue Xue, Wenyu Qin, Meng Wang, Yikai Wang, Shanghang Zhang

机构 * Peking University(北京大学) Kling Team, Kuaishou Technology(快手科技 Kling 团队) The University of Hong Kong(香港大学) Beijing Normal University(北京师范大学)

AI总结 AEGPO通过双信号双层自适应优化提升扩散模型策略优化效率,实现更高效的收敛和更好的对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06459 2026-02-09 cs.RO

User-Centric Object Navigation: A Benchmark with Integrated User Habits for Personalized Embodied Object Search

以用户为中心的对象导航:一个整合用户习惯的基准,用于个性化身体对象搜索

Hongcheng Wang, Jinyu Zhu, Hao Dong

机构 * School of Computer Science, Peking University(北京大学计算机学院) School of Electronics Engineering and Computer Science, Peking University(北京大学电子工程与计算机科学学院)

AI总结 本文提出User-Centric Object Navigation基准,通过整合用户习惯提升个性化物体导航性能。

Comments Accepted by ICRA 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06453 2026-02-09 cs.LG

On the Plasticity and Stability for Post-Training Large Language Models

关于后训练大语言模型的可塑性与稳定性

Wenwen Qiang, Ziyin Gu, Jiahuan Zhou, Jie Hu, Jingyao Wang, Changwen Zheng, Hui Xiong

机构 * Institute of Software Chinese Academy of Sciences, Beijing, China(中国科学院软件研究所) University of the Chinese Academy of Sciences, Beijing, China(中国科学院大学) Wangxuan Institute of Computer Technology, Peking University, Beijing, China(北京大学王轩计算机技术研究所) Thrust of Artificial Intelligence, The Hong Kong University of Science and Technology (Guangzhou), China(香港科技大学(广州)人工智能研究所) Department of Computer Science and Engineering, The Hong Kong University of Science and Technology Hong Kong SAR, China(香港科技大学(香港特别行政区)计算机科学与工程系)

AI总结 本文提出PCR框架,通过概率方法解决GRPO中可塑性与稳定性之间的几何冲突,提升训练稳定性与推理性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06452 2026-02-09 cs.CV

Exploring Specular Reflection Inconsistency for Generalizable Face Forgery Detection

探索可泛化的人脸伪造检测中的镜面反射不一致

Hongyan Fei, Zexi Jia, Chuanwei Huang, Jinchao Zhang, Jie Zhou

机构 * School of Intelligence Science and Technology, Peking University(北京大学智能科学与技术学院) State Key Laboratory of General Artificial Intelligence, Peking University(北京大学通用人工智能国家重点实验室) WeChat AI, Tencent Inc(腾讯公司微信AI)

AI总结 本文提出了一种基于镜面反射不一致性的新型人脸伪造检测方法,通过两阶段交叉注意力机制提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06449 2026-02-09 cs.CL

Evaluating an evidence-guided reinforcement learning framework in aligning light-parameter large language models with decision-making cognition in psychiatric clinical reasoning

评估一种证据引导的强化学习框架在对齐光参数大语言模型与精神科临床推理决策认知中的作用

Xinxin Lin, Guangxin Dai, Yi Zhong, Xiang Li, Xue Xiao, Yixin Zhang, Zhengdong Wu, Yongbo Zheng, Runchuan Zhu, Ming Zhao, Huizi Yu, Shuo Wu, Jun Zhao, Lingming Hu, Yumei Wang, Ping Yin, Joey W. Y. Chan, Ngan Yin Chan, Sijing Chen, Yun Kwok Wing, Lin Lu, Xin Ma, Lizhou Fan

机构 * The Chinese University of Hong Kong, Shatin, N.T., Hong Kong SAR, China(香港中文大学) Shandong University, Jinan, China(山东大学) Peking University Sixth Hospital, Beijing, China(北京大学第六医院) Inspur Cloud Information Technology Co., Ltd., Jinan, China(Inspur 云技术有限公司) Fudan University, Shanghai, China(复旦大学) Shandong Provincial Hospital Affiliated to Shandong First Medical University, Jinan, China(山东第一医科大学附属山东省人民医院) Jilin University, Changchun, China(吉林大学) Hong Kong ICI Cloud Service Limited, Hong Kong SAR, China(香港ICI云服务有限公司) Shandong First Medical University, Jinan, China(山东第一医科大学)

AI总结 本研究提出ClinMPO框架,通过证据引导的强化学习使轻量LLM在复杂精神病学推理任务中达到超越人类的准确率。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06445 2026-02-09 cs.RO

ECO: Energy-Constrained Optimization with Reinforcement Learning for Humanoid Walking

ECO:基于强化学习的人形机器人能量受限优化

Weidong Huang, Jingwen Zhang, Jiongye Li, Shibowen Zhang, Jiayang Wu, Jiayi Wang, Hangxin Liu, Yaodong Yang, Yao Su

机构 * State Key Laboratory of General Artificial Intelligence, Beijing Institute for General Artificial Intelligence (BIGAI)(通用人工智能国家重点实验室,北京通用人工智能研究院(BIGAI)) Department of Automation, Tsinghua University(自动化系,清华大学) Department of Automation, University of Science and Technology of China(自动化系,中国科学技术大学) Department of Computer Science, Harbin Institute of Technology(计算机科学系,哈尔滨工业大学) Institute for Artificial Intelligence and School of Artificial Intelligence, Peking University(人工智能研究院和人工智能学院,北京大学)

AI总结 ECO通过将能量指标作为约束而非奖励,提升人形机器人行走的能效与稳定性。

Comments IEEE TRANSACTIONS ON AUTOMATION SCIENCE AND ENGINEERING. PREPRINT VERSION. ACCEPTED FEB, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18642 2026-02-09 cs.AI cs.CL

FadeMem: Biologically-Inspired Forgetting for Efficient Agent Memory

FadeMem: 基于生物机制的高效代理记忆遗忘

Lei Wei, Xiao Peng, Xu Dong, Niantao Xie, Bin Wang

机构 * Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团) School of Software and Microelectronics(软件与微电子学院) Peking University(北京大学)

AI总结 FadeMem通过生物启发的主动遗忘机制,提升代理记忆的效率与存储容量,实现更有效的信息管理与多跳推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.18282 2026-02-09 cs.AI cs.CL cs.LG

Think-Augmented Function Calling: Improving LLM Parameter Accuracy Through Embedded Reasoning

思考增强的功能调用:通过嵌入式推理提高LLM参数准确性

Lei Wei, Xiao Peng, Jinpeng Ou, Bin Wang

机构 * Alibaba International Digital Commerce Group(阿里巴巴国际数字商业集团) School of Software and Microelectronics(软件与微电子学院) Peking University(北京大学)

AI总结 TAFC通过嵌入式推理提升LLM参数准确性,实现函数调用的显式推理和细粒度优化,增强多参数函数的生成准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10116 2026-02-09 cs.RO

CoCoPlan: Adaptive Coordination and Communication for Multi-robot Systems in Dynamic and Unknown Environments

CoCoPlan:动态和未知环境中的多机器人系统自适应协调与通信

Xintong Zhang, Junfeng Chen, Yuxiao Zhu, Bing Luo, Meng Guo

机构 * School of Advanced Manufacturing and Robotics, Peking University(北京大学先进制造与机器人学院) Division of Natural and Applied Sciences, Duke Kunshan University(杜克昆山大学自然与应用科学系)

AI总结 CoCoPlan通过自适应协调与通信框架,提升多机器人系统在动态未知环境中的任务完成效率与通信效率。

Comments 8 pages, 8 figures, published to RA-L

Journal ref IEEE Robotics and Automation Letters, vol. 11, issue 3, pp. 3270-3277, March 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02075 2026-02-09 cs.CE cs.LG

MDAgent2: Large Language Model for Code Generation and Knowledge Q&A in Molecular Dynamics

MDAgent2:用于分子动力学中代码生成和知识问答的大型语言模型

Zhuofan Shi, Hubao A, Yufei Shao, Dongliang Huang, Hongxu An, Chunxiao Xin, Haiyang Shen, Zhenyu Wang, Yunshan Na, Gang Huang, Xiang Jing

机构 * Peking University(北京大学) National Key Laboratory of Data Space Technology and System(国家数据空间技术与系统重点实验室) The Hong Kong University of Science and Technology(香港科学与技术大学) Liaoning Technical University(辽宁技术大学) Wenjing Future Lab (Beijing) Technology Co., Ltd(文景未来实验室(北京)科技有限公司)

AI总结 MDAgent2是首个能同时进行分子动力学知识问答和代码生成的端到端框架,通过领域特定数据集和强化学习方法提升性能。

Comments 24 pages,4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10216 2026-02-09 cs.PL cs.AI cs.SE

Learning to Guarantee Type Correctness in Code Generation through Type-Guided Program Synthesis

通过类型引导的程序合成学习保证类型正确性

Zhechong Huang, Zhao Zhang, Ruyi Ji, Tingxuan Xia, Qihao Zhu, Qinxiang Cao, Zeyu Sun, Wiggin Zhou, Yingfei Xiong

机构 * Peking University(北京大学) University of Michigan(密歇根大学) Shanghai Jiao Tong University(上海交通大学) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) Tencent(腾讯)

AI总结 TyFlow 通过内部化类型推理,提升代码生成的类型正确性与功能正确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23071 2026-02-09 cs.LG

Rethinking Multi-Modal Learning from Gradient Uncertainty

重新思考从梯度不确定性出发的多模态学习

Peizheng Guo, Jingyao Wang, Wenwen Qiang, Jiahuan Zhou, Changwen Zheng, Gang Hua

机构 * Institute of Software Chinese Academy of Sciences, Beijing, China(中国科学院软件研究所) University of the Chinese Academy of Sciences, Beijing, China(中国科学院大学) Wangxuan Institute of Computer Technology, Peking University, Beijing, China(北京大学王轩计算机技术研究所) Amazon.com, Inc., Bellevue, WA, 98004, USA(亚马逊公司)

AI总结 本文提出BOGC-MML方法,通过建模梯度不确定性提升多模态学习的优化效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06079 2026-02-09 cs.DC cs.LG

Canzona: A Unified, Asynchronous, and Load-Balanced Framework for Distributed Matrix-based Optimizers

Canzona: 一个统一的、异步的、负载平衡的分布式矩阵优化器框架

Liangyu Wang, Siqi Zhang, Junjie Wang, Yiming Dong, Bo Zheng, Zihan Qiu, Shengkun Tang, Di Wang, Rui Men, Dayiheng Liu

机构 * Alibaba Group(阿里巴巴集团) Peking University(北京大学)

AI总结 Canzona提出一个统一的异步负载平衡框架,解决分布式矩阵优化器中张量碎片化与整体更新需求的冲突,通过alpha-平衡静态划分和异步计算流水线实现高效并行计算。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.06039 2026-02-06 cs.AI

DyTopo: Dynamic Topology Routing for Multi-Agent Reasoning via Semantic Matching

DyTopo:通过语义匹配实现多智能体推理的动态拓扑路由

Yuxing Lu, Yucheng Hu, Xukai Zhao, Jiuxin Cao

机构 * Peking University, Beijing, China(北京大学) Georgia Institute of Technology, Atlanta, United States(佐治亚理工学院) Southeast University, Location, Country(东南大学) Tsinghua University(清华大学)

AI总结 DyTopo通过语义匹配实现多智能体推理的动态拓扑路由,提升多轮推理性能并提供可解释的协调轨迹。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05857 2026-02-06 cs.AI

BABE: Biology Arena BEnchmark

BABE:生物学竞技场基准

Junting Zhou, Jin Chen, Linfeng Hao, Denghui Cao, Zheyu Wang, Qiguang Chen, Chaoyou Fu, Jiaze Chen, Yuchen Wu, Ge Zhang, Mingxuan Wang, Wenhao Huang, Tong Yang

机构 * Peking University(北京大学)

AI总结 BABE基准通过评估生物AI系统的实验推理能力,解决现有生物学基准未能评估实验结果与上下文知识整合能力的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05853 2026-02-06 cs.CL

RRAttention: Dynamic Block Sparse Attention via Per-Head Round-Robin Shifts for Long-Context Inference

RRAttention: 通过每头轮换位移实现动态块稀疏注意力以支持长上下文推理

Siran Liu, Guoxia Wang, Sa Wang, Jinle Zeng, HaoYang Xie, Siyu Lou, JiaBin Yang, DianHai Yu, Haifeng Wang, Chao Yang

机构 * Baidu Inc.(百度公司) Peking University(北京大学)

AI总结 RRAttention通过轮换位移策略实现动态块稀疏注意力,提升长上下文推理效率,实现99%的完整注意力性能和2.4倍加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05758 2026-02-06 cs.CL

LongR: Unleashing Long-Context Reasoning via Reinforcement Learning with Dense Utility Rewards

LongR: 通过密集效用奖励的强化学习解锁长上下文推理

Bowen Ping, Zijun Chen, Yiyao Yu, Tingfeng Hui, Junchi Yan, Baobao Chang

机构 * Peking University(北京大学) Shanghai Jiao Tong University(上海交通大学) Tsinghua University(清华大学) Beijing University of Posts and Telecommunications(北京邮电大学)

AI总结 LongR通过整合动态'思考与阅读'机制和上下文密度奖励,提升长上下文推理性能,在多个基准测试中取得显著成效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05729 2026-02-06 cs.CV cs.LG

Adaptive Global and Fine-Grained Perceptual Fusion for MLLM Embeddings Compatible with Hard Negative Amplification

自适应全局与细粒度感知融合用于兼容硬负样本放大的人脸嵌入

Lexiang Hu, Youze Xue, Dian Li, Gang Liu, Zhouchen Lin

机构 * State Key Lab of General AI, School of Intelligence Science and Technology, Peking University(人工智能国家重点实验室,智能科学与技术学院,北京大学) Institute for Artificial Intelligence, Peking University(人工智能研究院,北京大学)

AI总结 本文提出AGFF-Embed方法,通过自适应融合全局和细粒度语义信息,提升多模态嵌入在一般和细粒度理解上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05577 2026-02-06 cs.CV

LocateEdit-Bench: A Benchmark for Instruction-Based Editing Localization

LocateEdit-Bench:基于指令的编辑本地化基准测试

Shiyu Wu, Shuyan Li, Jing Li, Jing Liu, Yequan Wang

机构 * Institute of Automation, Chinese Academy of Sciences, Beijing, China(中国科学院自动化研究所) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院) University of Chinese Academy of Sciences, Beijing, China(中国科学院大学) School of EEECS, Queen's University Belfast, Northern Ireland, UK(女王大学 Belfast 电子工程与计算机科学学院) Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Peking University, Beijing, China(北京大学)

AI总结 LocateEdit-Bench是一个针对基于指令的编辑本地化问题设计的大规模数据集,整合了四种先进编辑模型,用于评估和推动伪造本地化方法的发展。

Comments 11 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15678 2026-02-06 cs.CR cs.AI cs.IR cs.LG

Connect the Dots: Knowledge Graph-Guided Crawler Attack on Retrieval-Augmented Generation Systems

连点成线:知识图谱引导的爬虫攻击对抗检索增强生成系统

Mengyu Yao, Ziqi Zhang, Ning Luo, Shaofei Li, Yifeng Cai, Xiangqun Chen, Yao Guo, Ding Li

机构 * MOE Key Lab of HCST (PKU), School of Computer Science, Peking University(信息与电子技术教育部重点实验室(北京大学)、计算机科学学院、北京大学) Department of Computer Science, University of Illinois Urbana-Champaign(计算机科学系、伊利诺伊大学厄巴纳-香槟分校) Department of Electrical and Computer Engineering, University of Illinois Urbana-Champaign(电气与计算机工程系、伊利诺伊大学厄巴纳-香槟分校)

AI总结 RAGCrawler通过知识图谱引导的攻击方法,有效提升RAG系统知识库的覆盖能力,实现70%覆盖率的查询效率提升达4.03倍,并达到0.699的代理重建相似度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01151 2026-02-06 cs.CV cs.AI

Personalized Safety Alignment for Text-to-Image Diffusion Models

面向文本到图像扩散模型的个性化安全对齐

Yu Lei, Jinbin Bai, Qingyu Shi, Aosong Feng, Hongcheng Gao, Xiao Zhang, Rex Ying

机构 * National University of Singapore(新加坡国立大学) Peking University(北京大学) Yale University(耶鲁大学) Collov Labs(Collov实验室)

AI总结 本文提出个性化安全对齐框架PSA,通过用户条件适应提升文本到图像扩散模型的安全性与生成质量,实现安全与质量的动态平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22186 2026-02-06 cs.LG

Thompson Sampling-Based Learning and Control for Unknown Dynamic Systems

基于汤普森采样的学习与控制:未知动态系统

Kaikai Zheng, Dawei Shi, Yang Shi, Long Wang

机构 * MIIT Key Laboratory of Servo Motion System Drive and Control, School of Automation, Beijing Institute of Technology(信息产业部伺服驱动与控制重点实验室,自动化学院,北京理工大学) Department of Mechanical Engineering, Faculty of Engineering, University of Victoria(机械工程系,工程学院,维多利亚大学) Center for Systems and Control, College of Engineering, Peking University(系统与控制中心,工程学院,北京大学)

AI总结 本文提出基于再生核希尔伯特空间的参数化方法,结合汤普森采样框架,实现未知动态系统的主动学习控制,提升控制效率与稳定性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05249 2026-02-06 cs.AI

Automatic Cognitive Task Generation for In-Situ Evaluation of Embodied Agents

为在场评估具身智能体而自动产生认知任务

Xinyi He, Ying Yang, Chuanjian Fu, Sihan Guo, Songchun Zhu, Lifeng Fan, Zhenliang Zhang, Yujia Peng

机构 * Peking University(北京大学) State Key Laboratory of General Artificial Intelligence(通用人工智能国家重点实验室) BIGAI

AI总结 本文提出TEA系统,通过动态在场任务生成方法评估具身智能体在未见环境中的能力,揭示模型在基本感知和3D交互方面的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12666 2026-02-06 cs.CV

Near-Light Color Photometric Stereo for Mono-Chromatic Non-Lambertian Surfaces

近光色光度立体摄影用于单色非兰伯特表面

Zonglin Li, Jieji Ren, Shuangfan Zhou, Heng Guo, Jinnuo Zhang, Jiang Zhou, Boxin Shi, Zhanyu Ma, Guoying Gu

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Shanghai Jiao Tong University(上海交通大学) Peking University(北京大学)

AI总结 本文提出了一种基于神经隐式表示的单色非兰伯特表面单次图像重建方法,并通过实验验证了其有效性。

Comments 5 pages 7figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15120 2026-02-06 stat.ML cs.AI cs.IT cs.LG math.IT math.ST stat.TH

Neural Networks Learn Generic Multi-Index Models Near Information-Theoretic Limit

神经网络在信息论极限附近学习通用多索引模型

Bohan Zhang, Zihao Wang, Hengyu Fu, Jason D. Lee

机构 * Peking University(北京大学) Stanford University(斯坦福大学) UC Berkeley(加州大学伯克利分校)

AI总结 神经网络通过梯度下降在信息论极限内高效学习多索引模型,证明两层网络在特定条件下能以最优样本和时间复杂度实现目标学习。

Comments 85 pages, 2 figures. The order of the first two authors was determined by a coin flip. Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04706 2026-02-05 cs.CL

LiteToken: Removing Intermediate Merge Residues From BPE Tokenizers

LiteToken: 从BPE分词器中移除中间合并残余

Yike Sun, Haotong Yang, Zhouchen Lin, Muhan Zhang

机构 * Peking University, Beijing, China(北京大学)

AI总结 LiteToken通过移除BPE分词器中的低频残余标记,减少标记碎片化和参数,提升对噪声输入的鲁棒性,同时保持模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04607 2026-02-05 cs.CL cs.LG

Focus-LIME: Surgical Interpretation of Long-Context Large Language Models via Proxy-Based Neighborhood Selection

Focus-LIME: 通过基于代理的邻域选择实现长上下文大语言模型的手术解释

Junhao Liu, Haonan Yu, Zhenyu Yan, Xin Zhang

机构 * Key Lab of High Confidence Software Technologies (Peking University)(高可信软件技术重点实验室(北京大学)) School of Computer Science, Peking University(计算机学院(北京大学))

AI总结 Focus-LIME通过基于代理的邻域选择方法,实现长上下文大语言模型的手术级解释,解决了高维特征空间下的归因稀释问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.20322 2026-02-05 cs.CV

Dynamic Pyramid Network for Efficient Multimodal Large Language Model

动态金字塔网络用于高效多模态大语言模型

Hao Ai, Kunyi Wang, Zezhou Wang, Hao Lu, Jin Tian, Yaxin Luo, Peng Xing, Jen-Yuan Huang, Huaxia Li, Gen luo

机构 * Beihang University(北航大学) Shanghai AI Laboratory(上海人工智能实验室) KAUST(卡塔尔大学) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Technical University Of Denmark(丹麦技术大学) Nanjing University of Science and Technology(南京理工大学) Peking University(北京大学) Xiaohongshu Inc(小红书公司)

AI总结 动态金字塔网络通过分层结构和动态池化专家提升多模态大语言模型的效率与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏