arXivDaily arXiv每日学术速递 周一至周五更新

大厂专区

共收录 135
2512.19849 2026-01-23 cs.DC cs.AI cs.LG cs.NI

UCCL-EP: Portable Expert-Parallel Communication

UCCL-EP:便携式专家并行通信

Ziming Mao, Yihan Zhang, Chihan Cui, Zhen Huang, Kaichao You, Zhongjie Chen, Zhiying Xu, Zhenyu Gu, Scott Shenker, Costin Raiciu, Yang Zhou, Ion Stoica

机构 * UC Berkeley(加州大学伯克利分校) UC Davis(加州大学戴维斯分校) UW–Madison(威斯康星大学麦迪逊分校) AMD(超威半导体) Tsinghua University(清华大学) Amazon Web Services(亚马逊网络服务) ICSI(信息与计算机科学研究所) Broadcom & University Politehnica of Bucharest(博通与布加勒斯特理工大学)

AI总结 UCCL-EP通过高吞吐量GPU-CPU控制通道和RDMA立即数据模拟,实现了在异构GPU和NIC平台上的高性能专家并行通信,提升了多个模型的训练和推理效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17272 2026-01-21 cs.LG cs.CL

Zebra-Llama: Towards Extremely Efficient Hybrid Models

Zebra-Llama:迈向极高效混合模型

Mingyu Yang, Mehdi Rezagholizadeh, Guihong Li, Vikram Appia, Emad Barsoum

机构 * Advanced Micro Devices, Inc. (AMD)(先进微器件公司(AMD))

AI总结 Zebra-Llama通过结合状态空间模型和多头潜在注意力层,构建高效混合模型,以极低成本实现接近Transformer的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.11822 2026-01-21 cs.DC cs.LG

RAPID-Serve: Resource-efficient and Accelerated P/D Intra-GPU Disaggregation

RAPID-Serve: 一种资源高效且加速的GPU内 disaggregation技术

Amna Masood, Pratishtha Gaur, Nuwan Jayasena

机构 * Advanced Micro Devices(先进微器件)

AI总结 RAPID-Serve通过在GPU上同时执行prefill和decode,实现资源高效和低延迟的LLM推理服务,提升吞吐量和资源利用率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.02236 2026-01-06 cs.CL

CD4LM: Consistency Distillation and aDaptive Decoding for Diffusion Language Models

CD4LM:一致性蒸馏与自适应解码用于扩散语言模型

Yihao Liang, Ze Wang, Hao Chen, Ximeng Sun, Jialian Wu, Xiaodong Yu, Jiang Liu, Emad Barsoum, Zicheng Liu, Niraj K. Jha

机构 * Princeton University(普林斯顿大学) Advanced Micro Devices, Inc(先进微器件公司)

AI总结 CD4LM通过一致性蒸馏和自适应解码提升扩散语言模型的并行解码效率与生成质量。

Comments 33 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03402 2026-01-05 cs.CL

Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates

Dual LoRA: 通过幅度和方向更新增强LoRA

Yixing Xu, Chao Li, Xuanwu Yin, Spandan Tiwari, Dong Li, Ashish Sirasao, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司)

AI总结 Dual LoRA通过引入幅度和方向更新机制,改进LoRA在参数高效微调中的性能,实验表明其在多个NLP任务上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15885 2025-12-19 cs.CV cs.AI cs.CL cs.MM

Seeing Beyond Words: Self-Supervised Visual Learning for Multimodal Large Language Models

超越文字:面向多模态大语言模型的自监督视觉学习

Davide Caffagni, Sara Sarto, Marcella Cornia, Lorenzo Baraldi, Pier Luigi Dovesi, Shaghayegh Roohi, Mark Granroth-Wilding, Rita Cucchiara

机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) AMD Silo AI

AI总结 JARVIS通过自监督视觉学习提升多模态大语言模型的视觉推理能力,无需依赖语言监督。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16713 2025-12-15 cs.CV

Conditional Text-to-Image Generation with Reference Guidance

基于参考引导的条件文本到图像生成

Taewook Kim, Ze Wang, Zhengyuan Yang, Jiang Wang, Lijuan Wang, Zicheng Liu, Qiang Qiu

机构 * Purdue University(普渡大学) AMD Microsoft(微软)

AI总结 本文提出基于参考引导的条件文本到图像生成方法,通过专家插件提升模型在文本拼写和多语言生成等任务上的表现。

Comments WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09617 2025-12-11 cs.CV

FROMAT: Multiview Material Appearance Transfer via Few-Shot Self-Attention Adaptation

FROMAT: 通过少样本自注意力适应实现多视图材料外观迁移

Hubert Kompanowski, Varun Jampani, Aaryaman Vasishta, Binh-Son Hua

机构 * Trinity College Dublin(都柏林三一学院) Arcade AI AMD

AI总结 FROMAT通过少样本自注意力适应实现多视图材料外观迁移,提供了一种简单有效的生成方法,提升多视图内容创作的外观多样性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04284 2025-12-05 cs.CV cs.AI

Learning Single-Image Super-Resolution in the JPEG Compressed Domain

在JPEG压缩域中学习单图像超分辨率

Sruthi Srinivasan, Elham Shakibapour, Rajy Rawther, Mehdi Saeedi

机构 * Advanced Micro Devices, Inc.(先进微器件公司)

AI总结 本研究提出在JPEG压缩域中直接训练单图像超分辨率模型,通过操作DCT系数提升数据加载和训练效率,同时保持视觉质量。

Comments 7 pages, 4 figures, 2 tables, SEEDS Workshop, ICIP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01953 2025-12-02 cs.LG

KV Pareto: Systems-Level Optimization of KV Cache and Model Compression for Long Context Inference

KV Pareto: 系统层面优化KV缓存与模型压缩以实现长上下文推理

Sai Gokhale, Devleena Das, Rajeev Patwari, Ashish Sirasao, Elliott Delaye

机构 * Georgia Institute of Technology(佐治亚理工学院) Advanced Micro Devices (AMD)(先进微器件(AMD))

AI总结 KV Pareto通过系统层面优化KV缓存与模型压缩,实现长上下文推理中的内存效率与准确率的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18583 2025-12-02 cs.LG cs.PF

PARD: Accelerating LLM Inference with Low-Cost PARallel Draft Model Adaptation

PARD:通过低成本并行草稿模型适应加速大语言模型推理

Zihao An, Huajun Bai, Ziqiong Liu, Dong Li, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司) Tsinghua University(清华大学)

AI总结 PARD通过低成本并行草稿模型适应技术,显著提升大语言模型推理速度,实现3.67倍加速。

Comments Submitted for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14808 2025-11-20 cs.LG cs.AI

Transformer Injectivity & Geometric Robustness - Analytic Margins and Bi-Lipschitz Uniformity of Sequence-Level Hidden States

Mikael von Strauss

机构 * AMD Silo AI

Comments 22 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12500 2025-11-18 cs.DC cs.LG

Iris: First-Class Multi-GPU Programming Experience in Triton

Muhammad Awad, Muhammad Osama, Brandon Potter

机构 * Advanced Micro Devices, Inc.

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10628 2025-11-17 cs.CL cs.AI cs.LG

Instella: Fully Open Language Models with Stellar Performance

Jiang Liu, Jialian Wu, Xiaodong Yu, Yusheng Su, Prakamya Mishra, Gowtham Ramesh, Sudhanshu Ranjan, Chaitanya Manem, Ximeng Sun, Ze Wang, Pratik Prabhanjan Brahma, Zicheng Liu, Emad Barsoum

机构 * AMD

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08083 2025-11-12 cs.LG

HipKittens: Fast and Furious AMD Kernels

William Hu, Drew Wadsworth, Sean Siddens, Stanley Winata, Daniel Y. Fu, Ryann Swann, Muhammad Osama, Christopher Ré, Simran Arora

机构 * AMD

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.04137 2025-11-07 cs.CV cs.AI

Learning from Online Videos at Inference Time for Computer-Use Agents

Yujian Liu, Ze Wang, Hao Chen, Ximeng Sun, Xiaodong Yu, Jialian Wu, Jiang Liu, Emad Barsoum, Zicheng Liu, Shiyu Chang

机构 * UC Santa Barbara(UC圣芭芭拉大学) Advanced Micro Devices, Inc.(先进微器件公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02132 2025-11-05 cs.AR cs.DC cs.LG cs.PF

Optimizing Attention on GPUs by Exploiting GPU Architectural NUMA Effects

Mansi Choudhary, Karthik Sangaiah, Sonali Singh, Muhammad Osama, Lisa Wu Wills, Ganesh Dasika

机构 * Department of ECE, Duke University(电子工程系,杜克大学) Advanced Micro Devices Inc.(先进微器件公司) Department of Computer Science, Duke University(计算机科学系,杜克大学)

Comments 11 pages, 14 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20527 2025-11-05 cs.CL

SAND-Math: Using LLMs to Generate Novel, Difficult and Useful Mathematics Questions and Answers

Chaitanya Manem, Pratik Prabhanjan Brahma, Prakamya Mishra, Zicheng Liu, Emad Barsoum

机构 * Advanced Micro Devices, Inc. (AMD)(先进微器件公司(AMD))

Comments Accepted at MATH-AI workshop, NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27135 2025-11-03 cs.CV

E-MMDiT: Revisiting Multimodal Diffusion Transformer Design for Fast Image Synthesis under Limited Resources

Tong Shen, Jingai Yu, Dong Zhou, Dong Li, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(Advanced Micro Devices公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27065 2025-11-03 cs.LG cs.PF

MLPerf Automotive

Radoyeh Shojaei, Predrag Djurdjevic, Mostafa El-Khamy, James Goel, Kasper Mecklenburg, John Owens, Pınar Muyan-Özçelik, Tom St. John, Jinho Suh, Arjun Suresh

机构 * University of California, Davis(加州大学戴维斯分校) Arm(ARM公司) Samsung(三星) Qualcomm(高通) California State University, Sacramento(加州州立大学萨克拉门托分校) Gilmet Labs(Gilmet实验室) NVIDIA(英伟达) AMD(超微半导体)

Comments 16 pages, 5 figures, 6 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.17477 2025-10-27 cs.CL cs.AI cs.LG

Do Robot Snakes Dream like Electric Sheep? Investigating the Effects of Architectural Inductive Biases on Hallucination

Jerry Huang, Prasanna Parthasarathi, Mehdi Rezagholizadeh, Boxing Chen, Sarath Chandar

机构 * Mila & Université de Montréal(Mila与蒙特利尔大学) Noah’s Ark Lab(Noah’s Ark实验室) Advanced Micro Devices Chandar Research Lab(Chandar研究实验室) Polytechnique Montréal(蒙特利尔理工学院) CIFAR AI Chair(CIFAR人工智能主席)

Comments Accepted to Findings of The 63rd Annual Meeting of the Association for Computational Linguistics (ACL) 2025. Official proceedings version available at https://aclanthology.org/2025.findings-acl.60/

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09657 2025-10-22 cs.LG

Týr-the-Pruner: Structural Pruning LLMs via Global Sparsity Distribution Optimization

Guanchen Li, Yixing Xu, Zeping Li, Ji Liu, Xuanwu Yin, Dong Li, Emad Barsoum

机构 * Advanced Micro Devices, Inc.(先进微器件公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22467 2025-10-20 cs.MA cs.AI cs.LG

Topological Structure Learning Should Be A Research Priority for LLM-Based Multi-Agent Systems

Jiaxi Yang, Mengqi Zhang, Yiqiao Jin, Hao Chen, Qingsong Wen, Lu Lin, Yi He, Srijan Kumar, Weijie Xu, James Evans, Jindong Wang

机构 * The Pennsylvania State University(宾夕法尼亚州立大学) William & Mary(威廉与玛丽学院) Georgia Institute of Technology(佐治亚理工学院) AMD(AMD公司) Squirrel AI Amazon(亚马逊公司) University of Chicago(芝加哥大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14154 2025-10-17 cs.AI cs.LG

Combining Reinforcement Learning and Behavior Trees for NPCs in Video Games with AMD Schola

Tian Liu, Alex Cann, Ian Colbert, Mehdi Saeedi

机构 * Advanced Micro Devices (AMD)(先进微器件(AMD))

Comments 8 pages, 4 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10406 2025-10-14 cs.CV cs.AI cs.LG

Mesh-Gait: A Unified Framework for Gait Recognition Through Multi-Modal Representation Learning from 2D Silhouettes

Zhao-Yang Wang, Jieneng Chen, Jiang Liu, Yuxiang Guo, Rama Chellappa

机构 * Johns Hopkins University(约翰霍普金斯大学) Advanced Micro Devices, Inc.(先进微器件公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08600 2025-10-13 cs.CL cs.AI cs.LG

Recover-LoRA: Data-Free Accuracy Recovery of Degraded Language Models via Low-Rank Adaptation

Devleena Das, Rajeev Patwari, Ashish Sirasao

机构 * Advanced Micro Devices, Inc. (AMD)(先进微器件公司(AMD))

Comments Accepted to EMNLP 2025 Industry Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24251 2025-10-07 cs.CV cs.CL

Latent Visual Reasoning

Bangzheng Li, Ximeng Sun, Jiang Liu, Ze Wang, Jialian Wu, Xiaodong Yu, Hao Chen, Emad Barsoum, Muhao Chen, Zicheng Liu

机构 * University of California, Davis(加州大学戴维斯分校) Advanced Micro Devices, Inc.(先进微器件公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01010 2025-10-02 cs.CV

ImageDoctor: Diagnosing Text-to-Image Generation via Grounded Image Reasoning

Yuxiang Guo, Jiang Liu, Ze Wang, Hao Chen, Ximeng Sun, Yang Zhao, Jialian Wu, Xiaodong Yu, Zicheng Liu, Emad Barsoum

机构 * Johns Hopkins University(约翰霍普金斯大学) AMD(AMD公司)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15225 2025-09-30 cs.CV

Lost in Translation? Vocabulary Alignment for Source-Free Adaptation in Open-Vocabulary Semantic Segmentation

Silvio Mazzucco, Carl Persson, Mattia Segu, Pier Luigi Dovesi, Federico Tombari, Luc Van Gool, Matteo Poggi

机构 * The Good AI Lab(好AI实验室) ETH Zurich(苏黎世联邦理工学院) AMD Silo AI Google(谷歌) Technical University of Munich(慕尼黑技术大学) INSAIT, Sofia University, St. Kliment Ohridski(INSAIT,索菲亚大学,圣克莱孟·奥赫里茨基) University of Bologna(博洛尼亚大学)

Comments BMVC 2025 - Project Page: https://thegoodailab.org/blog/vocalign - Code: https://github.com/Sisso16/VocAlign

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18521 2025-09-30 cs.LG cs.AI

APRIL: Active Partial Rollouts in Reinforcement Learning to Tame Long-tail Generation

Yuzhen Zhou, Jiajun Li, Yusheng Su, Gowtham Ramesh, Zilin Zhu, Xiang Long, Chenyang Zhao, Jin Pan, Xiaodong Yu, Ze Wang, Kangrui Du, Jialian Wu, Ximeng Sun, Jiang Liu, Qiaolin Yu, Hao Chen, Zicheng Liu, Emad Barsoum

机构 * Advanced Micro Devices, Inc. (AMD)(先进微器件公司) Carnegie Mellon University (CMU)(卡内基梅隆大学) LMSYS Org(LMSYS组织) University of California, Los Angeles (UCLA)(加州大学洛杉矶分校)

详情

展开后加载摘要…

URL PDF HTML 收藏