When Does Disaggregation Pay? Simulating Prefill--Decode--Attention--FFN Specialization for Agentic LLM Inference
拆分何时划算?智能体大语言模型推理的预填-解码-注意力-前馈网络专业化模拟
Przemyslaw Forys, Haoran Wu, Can Xiao, Jiayi Nie, Tony Liu, Rika Antonova, Timothy Jones, Robert Mullins, Wayne Luk, Aaron Zhao, George A. Constantinides
Resolution Meets Reduction: Efficient Visual Context for 3D Radiology Report Generation
分辨率与压缩结合:面向3D放射报告生成的高效视觉上下文
Jonathan Suprijadi, Raphael Stock, Moritz Langenberg, David Zimmerer, Kim-Celine Kahl, Stefan Denner, Yannick Kirchhoff, Karol Gotkowski, Maximilian Rokuss, Jeremias Traub, Tassilo Wald, Constantin Ulrich, Klaus Maier-Hein
机构
*
German Cancer Research Center (DKFZ)(德国癌症研究中心)
专题命中
效率与部署
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI
GGC: Selective Query Correction for Reliable Text-to-SPARQL Generation
GGC:面向可靠Text-to-SPARQL生成的选择性查询修正
Ziyi Yang, Thanh-Son Nguyen, Tuan Anh Nguyen, Lihui Chen
机构
*
Nanyang Technological University(南洋理工大学)
;
Institute of High Performance Computing, Agency for Science, Technology and Research (A*STAR)(新加坡科技研究局高性能计算研究所)
专题命中
效率与部署
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL
机构
*
Artificial Intelligence Graduate School, Ulsan National Institute of Science and Engineering(人工智能研究生院,乌山科学与工程研究院)
;
Department of Computer Science and Engineering, Ulsan National Institute of Science and Engineering(计算机科学与工程系,乌山科学与工程研究院)
专题命中
效率与部署
:LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI