arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-20 至 2026-03-20 共收录 41 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 41 篇

2502.00340 2026-03-20 cs.LG cs.CL cs.DC 90%

Unlocking Full Efficiency of Token Filtering in Large Language Model Training

解锁大语言模型训练中令牌过滤的全面效率

Di Chai, Pengbo Li, Feiyuan Zhang, Yilun Jin, Han Tian, Kaiqiang Xu, Binhang Yuan, Dian Shen, Junxue Zhang, Kai Chen

机构 * Shanghai University of Finance and Economics(上海财经大学) Hong Kong University of Science and Technology(香港科技大学) University of Science and Technology of China(中国科学技术大学) Southeast University(东南大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

AI总结 本文提出Centrifuge系统,通过算法与系统协同设计提升令牌过滤效率,减少反向传播时间达49.9%,端到端训练时间达34.7%,并提升模型性能26.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18793 2026-03-20 cs.CR cs.AI 89%

Functional Subspace Watermarking for Large Language Models

用于大型语言模型的功能子空间水印

Zikang Ding, Junhao Li, Suling Wu, Junchi Yao, Hongbo Liu, Lijie Hu

机构 * University of Electronic Science(电子科学与技术大学) Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi, United Arab Emirates(阿布扎赫德人工智能 Mohamed bin Zayed 大学) South China University of Technology, Guangzhou, China(华南理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出功能子空间水印方法,通过稳定子空间和自适应谱截断策略提升水印鲁棒性,实验显示其在多种攻击下检测准确性和统计可验证性优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09749 2026-03-20 cs.CL cs.IR 89%

Enhancing Lexicon-Based Text Embeddings with Large Language Models

通过大语言模型增强基于词典的文本嵌入

Yibin Lei, Tao Shen, Yu Cao, Andrew Yates

机构 * University of Amsterdam(阿姆斯特丹大学) University of Technology Sydney(技术悉尼大学) Tencent IEG(腾讯IEG) Johns Hopkins University, HLTCOE(约翰霍普金斯大学,HLTCOE)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出基于词典的嵌入方法LENS,利用大语言模型处理词冗余问题,通过词嵌入聚类和双向注意力机制,在MTEB基准测试中优于密集嵌入,且支持高效维度剪枝。

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11149 2026-03-20 cs.LG cs.CR 89%

Systematic Scaling Analysis of Jailbreak Attacks in Large Language Models

大语言模型中越狱攻击的系统缩放分析

Xiangwen Wang, Ananth Balashankar, Varun Chandrasekaran

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Google DeepMind(谷歌DeepMind)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.LG

AI总结 本文系统分析了大语言模型中越狱攻击的缩放规律,通过计算限制优化过程评估不同方法、模型家族和危害类型的攻击成功率,发现提示基方法在计算效率上更具优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14763 2026-03-20 cs.IR cs.AI 89%

Membership Inference Attack against Large Language Model-based Recommendation Systems: A New Distillation-based Paradigm

针对基于大语言模型的推荐系统Membership推理攻击:一种新的知识蒸馏范式

Li Cuihong, Huang Xiaowen, Yin Chuanhuan, Sang Jitao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出一种基于知识蒸馏的新型Membership推理攻击方法,针对大语言模型推荐系统,通过构建参考模型并提取融合特征来提升攻击效果,实验表明其在隐私攻击中具有实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21800 2026-03-20 cs.CL cs.AI cs.LG 87%

ELM: A Hybrid Ensemble of Language Models for Automated Tumor Group Classification in Population-Based Cancer Registries

ELM:一种语言模型的混合集成,用于人口基于癌症登记处的肿瘤分组自动分类

Lovedeep Gondara, Jonathan Simkin, Shebnum Devji, Gregory Arbour, Raymond Ng

机构 * British Columbia Cancer Registry, Provincial Health Services Authority(不列颠哥伦比亚省癌症登记处、省级卫生服务局) The Data Science Institute, University of British Columbia(数据科学研究院、不列颠哥伦比亚大学)

专题命中 效率与部署 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 ELM结合小型编码器-only模型和大型语言模型,通过集成六个微调模型提高肿瘤分组分类的准确性和效率,显著优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08905 2026-03-20 cs.CR cs.AI 85%

iSeal: Encrypted Fingerprinting for Reliable LLM Ownership Verification

iSeal:用于可靠LLM所有权验证的加密指纹法

Zixun Xiong, Gaoyi Wu, Qingyang Yu, Mingyu Derek Ma, Lingfeng Yao, Miao Pan, Xiaojiang Du, Hao Wang

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 iSeal通过在模型和外部模块中注入独特特征,结合纠错机制和相似性验证策略,实现对模型窃贼全程控制下的可靠LLM所有权验证,有效抵御指纹反学习和响应操控等攻击。

Comments Accepted by AAAI 2026

Journal ref Proc. AAAI Conf. Artif. Intell. 40(42): 23984-23992, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22689 2026-03-20 cs.CL 85%

Rule-Based Explanations for Retrieval-Augmented LLM Systems

基于规则的检索增强型大语言模型解释

Joel Rorseth, Parke Godfrey, Lukasz Golab, Divesh Srivastava, Jarek Szlichta

机构 * University of Waterloo(滑铁卢大学) York University(约克大学) AT&T Chief Data Office(AT&T首席数据办公室)

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出用规则解释检索增强型大语言模型,通过优化方法提高规则生成效率,通过实验验证其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18734 2026-03-20 cs.SE 85%

Green Architectural Tactics in ML-enabled Systems: An LLM-based Repository Mining Study

在ML系统中采用绿色建筑策略:基于LLM的代码库研究

Vincenzo De Martino, Silverio Martínez-Fernández, Fabio Palomba

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文通过分析205个开源ML项目,发现现有绿色实践在实际应用中存在差异,并识别出九种未记录的可持续实践,为减少ML系统的环境影响提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12671 2026-03-20 cs.NI 85%

HyGra: Accelerating Network-State Simulation for LLM Training in DCNs via Adaptive Packet-Flow Granularity

HyGra: 通过自适应数据包流粒度加速LLM训练在DCN中的网络状态模拟

Wenyi Wang, Zheng Wu, Yanmeng Wang, Haolin Mao, Lei Han, Gaogang Xie, Fu Xiao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 HyGra通过自适应调整网络模拟粒度,结合数据包级和流级模拟,提升LLM训练在DCN中的网络状态模拟效率,同时保持高精度。

Comments 14 pages, 7 figures and 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11468 2026-03-20 cs.SE 85%

TRACE: Evaluating Execution Efficiency of LLM-Based Code Translation

TRACE: 评估基于LLM的代码翻译的执行效率

Zhihao Gong, Zeyu Sun, Dong Huang, Qingyuan Liang, Jie M. Zhang, Dan Hao

专题命中 效率与部署 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出TRACE基准,评估LLM翻译代码的执行效率,发现正确性不等于效率,23.5%的正确翻译存在显著低效,提示需更关注效率评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18604 2026-03-20 cs.NI cs.AI 79%

AutORAN: LLM-driven Natural Language Programming for Agile xApp Development

AutORAN:基于大语言模型的自然语言编程用于敏捷xApp开发

Xin Li, Shiming Yu, Leming Shen, Jianing Zhang, Yuanqing Zheng, Yaxiong Xie

机构 * Department of Computing, The Hong Kong Polytechnic University(计算机系,香港理工大学) Department of Computer Science and Engineering, University at Buffalo(计算机科学与工程系,布法罗大学)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

AI总结 AutORAN通过大语言模型实现自然语言编程,自动化xApp开发流程,显著提升开发效率,使xApp开发更加敏捷和高效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11132 2026-03-20 cs.CR cs.AI 79%

WebWeaver: Breaking Topology Confidentiality in LLM Multi-Agent Systems with Stealthy Context-Based Inference

WebWeaver: 在LLM多智能体系统中通过隐蔽的基于上下文推断打破拓扑保密性

Zixun Xiong, Gaoyi Wu, Lingfeng Yao, Miao Pan, Xiaojiang Du, Hao Wang

机构 * Department of Electrical and Computer Engineering, Stevens Institute of Technology(斯蒂文斯理工学院电气与计算机工程系) Genentech(基因泰克) Department of Electrical and Computer Engineering, University of Houston(休斯顿大学电气与计算机工程系)

专题命中 效率与部署 :LLM(title,abstract);分类 cs.AI

AI总结 WebWeaver通过仅 compromise 一个任意智能体推断LLM多智能体系统的完整拓扑,采用隐蔽的基于上下文推断方法,提出新的隐蔽 jailbreak 机制和无 jailbreak 扩散设计,提升推断准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16952 2026-03-20 cs.RO cs.AI 79%

Embodied Foundation Models at the Edge: A Survey of Deployment Constraints and Mitigation Strategies

边缘端具身基础模型:部署约束及缓解策略综述

Utkarsh Grover, Ravi Ranjan, Mingyang Mao, Trung Tien Dong, Satvik Praveen, Zhenqi Wu, J. Morris Chang, Tinoosh Mohsenin, Yi Sheng, Agoritsa Polyzou, Eiman Kanjo, Xiaomin Lin

机构 * University of South Florida(佛罗里达州立大学) Florida International University(佛罗里达国际大学) Johns Hopkins University(约翰霍普金斯大学) Nottingham Trent University(诺丁汉特伦特大学) Imperial College London(伦敦帝国理工学院)

专题命中 效率与部署 :foundation model(title,abstract);分类 cs.AI

AI总结 本文综述了在边缘端部署具身基础模型时面临的系统性约束及缓解策略,重点探讨了内存带宽、计算延迟和执行成本等关键因素对自动回归视觉-语言-动作策略和扩散控制器的影响,强调了内存、调度、通信和模型架构的协同设计的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18079 2026-03-20 cs.LG cs.AI 79%

SLEA-RL: Step-Level Experience Augmented Reinforcement Learning for Multi-Turn Agentic Training

SLEA-RL:基于步骤级经验增强的多轮代理训练强化学习

Prince Zizhuang Wang, Shuli Jiang

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SLEA-RL框架,通过步骤级经验增强提升多轮代理训练性能,采用动态经验库和策略优化方法,在长周期任务中优于传统强化学习基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18383 2026-03-20 cs.DC 78%

From Servers to Sites: Compositional Power Trace Generation of LLM Inference for Infrastructure Planning

从服务器到站点:LLM推理的组合功率轨迹生成用于基础设施规划

Grant Wilkins, Fiodar Kazhamiaka, Ram Rajagopal

专题命中 效率与部署 :LLM(title,abstract)

AI总结 本文提出通过组合功率轨迹生成方法,准确建模LLM推理的能耗,支持更精确的基础设施规划。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.16426 2026-03-20 cs.CV 78%

DynamicVis: Dynamic Visual Perception for Efficient Remote Sensing Foundation Models

DynamicVis: 面向高效遥感基础模型的动态视觉感知

Keyan Chen, Chenyang Liu, Bowen Chen, Wenyuan Li, Zhengxia Zou, Shijian Lu, Zhenwei Shi

机构 * Beihang University(北航大学) Nanyang Technological University(南洋理工大学) University of Hong Kong(香港大学)

专题命中 效率与部署 :foundation model(title,abstract)

AI总结 本文提出DynamicVis,针对遥感图像稀疏性设计,通过动态区域感知SSM和元嵌入MIL预训练,提升稀疏目标感知性能,尤其在小目标检测和变化检测中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16137 2026-03-20 cs.CL 77%

SIA: A Synthesize-Inject-Align Framework for Knowledge-Grounded and Secure E-commerce Search LLMs with Industrial Deployment

SIA:一种用于知识引导和安全的电子商务搜索LLM的合成-注入-对齐框架

Zhouwei Zhai, Mengxiang Chen, Anmeng Zhang

机构 * Beijing China(中国北京)

专题命中 效率与部署 :large language model(abstract);language model(abstract);instruction tuning(abstract);分类 cs.CL

AI总结 本文提出SIA框架,通过合成高质量语料库、参数高效预训练和双路径对齐方法,解决电子商务搜索LLM的知识幻觉和安全漏洞问题,并在京东实现工业部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18329 2026-03-20 cs.AI 77%

FaithSteer-BENCH: A Deployment-Aligned Stress-Testing Benchmark for Inference-Time Steering

FaithSteer-BENCH:一种面向部署的应力测试基准,用于推理时的操控

Zikang Ding, Qiying Hu, Yi Zhang, Hongji Li, Junchi Yao, Hongbo Liu, Lijie Hu

机构 * University of Electronic Science and Technology of China(电子科技大学) Mohamed bin Zayed University of Artificial Intelligence(马尔代夫人工智能大学) South China University of Technology(华南理工大学)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出FaithSteer-BENCH基准,通过可控性、效用保持和鲁棒性三个指标评估推理时操控方法,揭示现有方法在部署场景下的可靠性问题及机制层面的对齐问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.07884 2026-03-20 cs.DB cs.AI 77%

LLMIA: An Out-of-the-Box Index Advisor via In-Context Learning with LLMs

LLMIA: 一种通过大语言模型进行上下文学习的即开型索引顾问

Xinxin Zhao, Xinmei Huang, Haoyang Li, Jing Zhang, Shuai Wang, Tieying Zhang, Jianjun Chen, Rui Shi, Cuiping Li, Hong Chen

机构 * School of Information, Renmin University of China, Beijing, China(中国人民大学信息学院,北京,中国) ByteDance Inc., China(字节跳动公司,中国)

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 LLMIA利用大语言模型进行上下文学习,通过高质量演示池和全面的工作负载特征提取,高效推荐和优化索引,无需调优,在多个基准测试中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.21782 2026-03-20 cs.CV 75%

Mobile-VideoGPT: Fast and Accurate Model for Mobile Video Understanding

Mobile-VideoGPT:用于移动视频理解的高效模型

Abdelrahman Shaker, Muhammad Maaz, Chenhui Gou, Hamid Rezatofighi, Salman Khan, Fahad Shahbaz Khan

机构 * Mohamed Bin Zayed University of Artificial Intelligence(莫扎德人工智能大学) Monash University(莫纳什大学) Linköping University(利尔贝里大学)

专题命中 效率与部署 :language model(abstract);small language model(abstract);SLM(abstract)

AI总结 本文提出Mobile-VideoGPT,一种轻量级多模态框架,通过高效编码器、投影器和小语言模型实现快速推理,提升移动视频理解效率。

Comments Technical Report. Project: https://amshaker.github.io/Mobile-VideoGPT

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18567 2026-03-20 cs.LG cs.AI cs.CL 75%

SpecForge: A Flexible and Efficient Open-Source Training Framework for Speculative Decoding

SpecForge:一种灵活且高效的开源训练框架用于推测解码

Shenggui Li, Chao Wang, Yikai Zhu, Yubo Wang, Fan Yin, Shuai Shi, Yefei Chen, Xiaomin Dong, Qiaoling Chen, Jin Pan, Ji Li, Laixin Xie, Yineng Zhang, Lei Yu, Yonggang Wen, Ivor Tsang, Tianwei Zhang

机构 * Nanyang Technological University(南洋理工大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出SpecForge,一种支持EAGLE-3的开源框架,通过解耦目标与草案模型、混合并行等技术,显著提升Qwen3-235B-A22B的训练速度,并发布SpecBundle草案模型以解决高质量草案稀缺问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18449 2026-03-20 cs.CR cs.SE 75%

CNT: Safety-oriented Function Reuse across LLMs via Cross-Model Neuron Transfer

CNT:通过跨模型神经转移实现面向安全的功能重用

Yue Zhao, Yujia Gong, Ruigang Liang, Shenchen Zhu, Kai Chen, Xuejing Yuan, Wangjun Zhang

专题命中 效率与部署 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出CNT方法,通过转移少量神经元实现LLM间安全功能重用,有效提升安全对齐和偏见消除效果,性能损失低于1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19022 2026-03-20 cs.AI 74%

Behavioral Fingerprints for LLM Endpoint Stability and Identity

面向LLM端点稳定性和身份的行为指纹

Jonah Leshin, Manish Shah, Ian Timmis, Daniel Kang

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 效率与部署 :LLM(title);分类 cs.AI

AI总结 本文提出Stability Monitor系统,通过固定提示集采样输出并比较输出分布,检测端点行为变化,揭示模型家族、版本等变化。

Comments 4 pages, 1 figure, submitted to CAIS 2026 System Demonstrations

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07842 2026-03-20 cs.CL cs.AI 73%

AdaSwitch: Balancing Exploration and Guidance in Knowledge Distillation via Adaptive Switching

AdaSwitch: 通过自适应切换平衡探索与引导在知识蒸馏中的应用

Jingyu Peng, Maolin Wang, Hengyi Cai, Yuchen Li, Kai Zhang, Shuaiqiang Wang, Dawei Yin, Xiangyu Zhao

机构 * University of Science and Technology of China(中国科学技术大学) City University of Hong Kong(香港城市大学) Baidu Inc(百度公司)

专题命中 效率与部署 :language model(abstract);small language model(abstract);分类 cs.CL、cs.AI

AI总结 AdaSwitch通过自适应切换机制动态结合在线和离线生成,解决知识蒸馏中探索与引导的平衡问题,提升模型准确性和推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01643 2026-03-20 cs.LG 70%

Support Basis: Fast Attention Beyond Bounded Entries

支持基:超越有限条目的快速注意力

Maryam Aliakbarpour, Vladimir Braverman, Junze Yin, Haochen Zhang

机构 * Rice University(里士满大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 效率与部署 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出支持基分解技术,无需有限条目假设实现高效注意力推理与训练,理论证明其亚二次运行时间并验证其计算效率与任务性能。

Comments AISTATS 2026 (Spotlight). Our code can be found at: https://github.com/yinj66/support_basis

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08316 2026-03-20 cs.CV 67%

Unlocking 3D Affordance Segmentation with 2D Semantic Knowledge

通过2D语义知识解锁3D affordance分割

Yu Huang, Zelin Peng, Changsong Wen, Xiaokang Yang, Wei Shen

机构 * MoE Key Lab of Artificial Intelligence, School of Computer Science, Shanghai Jiaotong University(人工智能大模型实验室,计算机科学学院,上海交通大学)

专题命中 效率与部署 :foundation model(abstract);pretraining(abstract)

AI总结 本文提出CMAT预训练策略,利用2D视觉基础模型的语义知识引导3D表征学习,提升3D affordance分割的准确性和效率。

Comments Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.19159 2026-03-20 cs.CV 67%

Sliding-Window Merging for Compacting Patch-Redundant Layers in LLMs

滑动窗口合并用于压缩LLMs中的补丁冗余层

Xuan Ding, Rui Sun, Yunjian Zhang, Xiu Yan, Yueqi Zhou, Kaihao Huang, Suzhong Fu, Angelica I Aviles-Rivero, Chuanlong Xie, Yao Zhu

专题命中 效率与部署 :LLM(abstract);SLM(abstract)

AI总结 本文提出滑动窗口合并方法,通过动态压缩冗余层提升LLM性能,实验显示在35%剪枝下零样本任务性能提升1.654%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19223 2026-03-20 cs.CL cs.AI 62%

F2LLM-v2: Inclusive, Performant, and Efficient Embeddings for a Multilingual World

F2LLM-v2:面向多语言世界的包容性、高性能和高效嵌入模型

Ziyin Zhang, Zihan Liao, Hang Yu, Peng Di, Rui Wang

机构 * Ant Group(蚂蚁集团) Shanghai Jiao Tong University(上海交通大学)

专题命中 效率与部署 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 F2LLM-v2通过两阶段LLM嵌入训练流程、matryoshka学习等技术,实现了更高效的多语言嵌入模型,在11个MTEB基准测试中表现优异,同时为资源受限应用提供了新状态的前沿成果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17380 2026-03-20 cs.LG cs.AI q-bio.QM 62%

SCALE:Scalable Conditional Atlas-Level Endpoint transport for virtual cell perturbation prediction

SCALE:可扩展的条件图谱级端点传输用于虚拟细胞扰动预测

Shuizhou Chen, Lang Yu, Kedu Jin, Songming Zhang, Hao Wu, Wenxuan Huang, Sheng Xu, Quan Qian, Qin Chen, Lei Bai, Siqi Sun, Zhangyang Gao

机构 * Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) School of Life Science and Technology, China Pharmaceutical University(中国药科大学生命科学与技术学院) Faculty of Computer Science and Control Engineering, Shenzhen University of Advanced Technology, Shenzhen(深圳先进技术大学计算机科学与控制工程学院)

专题命中 效率与部署 :foundation model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出SCALE模型,通过改进训练框架、条件传输方法和评估协议,提升虚拟细胞扰动预测的效率和生物合理性。

详情

展开后加载摘要…

URL PDF HTML 收藏