arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 22210 信号源:cs.CL, cs.AI, cs.LG

1. 效率与部署 22210 篇

2604.19342 2026-04-22 cs.CL 89%

Are Large Language Models Economically Viable for Industry Deployment?

大语言模型在工业部署中经济上可行吗?

Abdullah Mohammad, Sushant Kumar Ray, Pushkar Arora, Rafiq Ali, Ebad Shabbir, Gautam Siddharth Kashyap, Jiechao Gao, Usman Naseem

机构 * DSEU-Okhla University of Delhi(德里大学) Macquarie University(麦考瑞大学) Center for SDGC(SDGC研究中心) Stanford University(斯坦福大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);分类 cs.CL

AI总结 本文提出EDGE-EVAL框架,评估大语言模型在工业场景中的全生命周期性能,引入五个部署指标,揭示模型在经济性和能效上的效率前沿及异常现象。

Comments Accepted at ACL 2026 (Industry Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13243 2026-04-16 cs.HC cs.AI 89%

Lazy or Efficient? Towards Accessible Eye-Tracking Event Detection Using LLMs

懒惰还是高效?基于LLM的可访问性眼动事件检测

Dongyang Guo, Yasmeen Abdrabou, Enkelejda Kasneci

机构 * Technical University of Munich(慕尼黑技术大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心)

专题命中 效率与部署 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种无需代码的LLM驱动流程,通过自然语言指令实现眼动事件检测,降低技术门槛,提升研究可及性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12459 2026-04-15 cs.AI 89%

Operationalising the Right to be Forgotten in LLMs: A Lightweight Sequential Unlearning Framework for Privacy-Aligned Deployment in Politically Sensitive Environments

在LLM中实现‘被遗忘权’:一种轻量级顺序反学习框架,用于在政治敏感环境中对齐隐私的部署

Esen Kurt, Haithem Afli

机构 * Department of Mathematics(数学系) Munster Technological University(穆恩斯特技术大学) Department of Computer Science(计算机科学系)

专题命中 效率与部署 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出一种轻量级顺序反学习框架,用于在政治敏感环境中实现隐私对齐的LLM部署,通过正向微调稳定良性能力,再通过层受限负向微调抑制敏感模式,实验显示其在保持事实准确性和流畅性的同时有效抑制行为。

Comments 10 pages

Journal ref PoliticalNLP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11512 2026-04-14 cs.AR cs.AI 89%

EdgeCIM: A Hardware-Software Co-Design for CIM-Based Acceleration of Small Language Models

EdgeCIM: 一种基于CIM的边缘设备小型语言模型加速的软硬件协同设计

Jinane Bazzi, Mariam Rakka, Fadi Kurdahi, Mohammed E. Fouda, Ahmed Eltawil

机构 * King Abdullah University of Science and Technology(阿卜杜拉国王科技大学) University of California Irvine(加利福尼亚大学尔湾分校) Rain Neuromorphics Inc.(Rain Neuromorphics公司)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);SLM(abstract);分类 cs.AI

AI总结 本文提出EdgeCIM,一种针对边缘设备小型语言模型加速的软硬件协同设计框架,通过CIM宏和基于瓷砖的映射策略提升并行性并缓解DRAM带宽瓶颈,实现更高的吞吐量和能效。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10893 2026-04-14 cs.CR cs.AI 89%

Beyond A Fixed Seal: Adaptive Stealing Watermark in Large Language Models

超越固定水印:大语言模型中的自适应窃取水印

Shuhao Zhang, Yuli Chen, Jiale Han, Bo Cheng, Jiabao Ma

机构 * Hong Kong University of Science and Technology(香港科技大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出自适应窃取算法,通过位置基水印构建和自适应选择模块提升水印窃取效率,增强对抗攻击的灵活性和有效性。

Comments 18 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09611 2026-04-14 cs.DC cs.AI 89%

Characterizing Performance-Energy Trade-offs of Large Language Models in Multi-Request Workflows

刻画大规模语言模型在多请求工作流中的性能-能耗权衡

Md. Monzurul Amin Ifath, Israat Haque

机构 * Dalhousie University(达尔豪斯大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文研究了多请求工作流中大规模语言模型的性能与能耗权衡,通过四个代表性工作负载分析关键能耗参数对延迟、吞吐量和组件能耗的影响,揭示了批处理大小、GPU供电限制和引擎优化对能耗的差异影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22599 2026-04-09 cs.DC cs.DB cs.LG 89%

DisCEdge: Distributed Context Management for Large Language Models at the Edge

DisCEdge:边缘侧大规模语言模型的分布式上下文管理

Mohammadreza Malekabbasi, Minghe Wang, David Bermbach

机构 * TU Berlin(柏林工业大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出DisCEdge,一种在边缘节点存储和复制用户上下文的系统,通过token化形式避免冗余计算,提升响应速度并降低同步开销。

Comments Accepted for publication in EuroMLSys '26

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00870 2026-04-09 cs.CR cs.AI 89%

ConfusionPrompt: Practical Private Inference for Online Large Language Models

ConfusionPrompt:在线大型语言模型的实用隐私推断

Peihua Mai, Youjia Yang, Ran Yan, Rui Ye, Yan Pang

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 ConfusionPrompt通过分解提示和生成伪提示,提升在线LLM的隐私保护,实现隐私与效用的平衡。

Comments 15 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03286 2026-04-07 cs.AI cond-mat.mtrl-sci cs.HC 89%

Toward Full Autonomous Laboratory Instrumentation Control with Large Language Models

迈向完全自主实验室仪器控制的大型语言模型

Yong Xie, Kexin He, Andres Castellanos-Gomez

机构 * Key Laboratory of Wide Band-Gap Semiconductor Technology, School of Advanced Materials and Nanotechnology, Xidian University(西安电子科技大学先进材料与纳米技术学院宽禁带半导体技术重点实验室)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文探讨了大型语言模型在实验室仪器自动化中的应用,展示如何通过ChatGPT生成定制脚本,降低技术门槛,并展示LLM辅助工具如何发展为自主AI代理,实现仪器的自主操作与策略优化。

Comments 16 pages, 5 figures. Accepted manuscript published in Small Structures. Supporting data and code available at https://doi.org/10.5281/zenodo.15065601

Journal ref Small Structures, 2025, 6(8), 2500173

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02816 2026-04-06 cs.CV cs.AI 89%

QAPruner: Quantization-Aware Vision Token Pruning for Multimodal Large Language Models

QAPruner: 量化感知的多模态大语言模型视觉标记剪枝

Xinhao Wang, Zhonyu Xia, Zhiwei Lin, Zhe Li, Yongtao Wang

机构 * Wangxuan Institute of Computer Technology, Peking University(北京大学王选计算机技术研究所)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);post-training(abstract);分类 cs.AI

AI总结 本文提出QAPruner框架,通过结合量化误差模拟与异常强度指标,实现多模态大语言模型的视觉标记剪枝与后训练量化联合优化,提升低比特下的推理精度。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01881 2026-04-03 cs.CV cs.CL 89%

HieraVid: Hierarchical Token Pruning for Fast Video Large Language Models

HieraVid:用于快速视频大语言模型的分层令牌修剪

Yansong Guo, Chaoyang Zhu, Jiayi Ji, Jianghang Lin, Liujuan Cao

机构 * Xiamen University(厦门大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 HieraVid通过分层修剪框架减少视频令牌冗余,提升视频大语言模型的效率,在保留性能的同时实现30%的令牌保留率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00474 2026-04-03 cs.IT cs.LG eess.SP math.IT 89%

Wireless Power Control Based on Large Language Models

基于大语言模型的无线功率控制

Jiacheng Wang, Yucheng Sheng, Le Liang, Hao Ye, Shi Jin

机构 * School of Information Science and Engineering, Southeast University(东南大学信息科学与工程学院) Department of Electrical and Computer Engineering, University of California, Santa Cruz(加州大学圣克鲁兹分校电气与计算机工程系)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出PC-LLM框架,通过引入干扰感知注意力偏差,有效融合无线拓扑与预训练关系先验,实现高效无线网络功率控制,且在零样本环境下表现出色。

Comments 13 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.00323 2026-04-02 cs.CL cs.CY 89%

Large Language Models in the Abuse Detection Pipeline

大语言模型在滥用检测流水线中的应用

Suraj Kath, Sanket Badhe, Preet Shah, Ashwin Sampathkumar, Shivani Gupta

机构 * Google LLC(谷歌有限责任公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文探讨大语言模型在滥用检测生命周期中的应用,分析其在标签生成、检测、审核及审计等阶段的作用,并讨论其面临的挑战与未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29193 2026-04-01 cs.CV cs.AI 89%

Developing Adaptive Context Compression Techniques for Large Language Models (LLMs) in Long-Running Interactions

开发用于长持续交互的大型语言模型(LLMs)的自适应上下文压缩技术

Payal Fofadiya, Sunil Tiwari

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出一种自适应上下文压缩框架,通过重要性感知内存选择、相干敏感过滤和动态预算分配,提升长对话中的稳定性与检索性能,同时减少token使用和推理延迟。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26735 2026-03-31 cs.CV cs.AI 89%

Distilled Large Language Model-Driven Dynamic Sparse Expert Activation Mechanism

distilled 大语言模型驱动的动态稀疏专家激活机制

Qinghui Chen, Zekai Zhang, Zaigui Zhang, Kai Zhang, Dagang Li, Wenmin Wang, Jinglin Zhang, Cong Liu

机构 * Laoshan Laboratory(崂山实验室) Jinan Inspur Data Technology Co., Ltd(济南浪潮数据技术有限公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出 DS-MoE 框架,通过文本引导的动态路由和轻量多尺度理解,解决跨类模糊问题,实验证明其在 PCB 等数据集上优于现有纯视觉模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26498 2026-03-30 cs.DC cs.AI 89%

Rocks, Pebbles and Sand: Modality-aware Scheduling for Multimodal Large Language Model Inference

岩石、鹅卵石和沙子:面向多模态大语言模型推理的模态感知调度

Konstantinos Papaioannou, Thaleia Dimitra Doudali

机构 * IMDEA Software Institute(IMDEA软件研究所) Universidad Politécnica de Madrid(马德里理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 针对多模态大语言模型推理中资源需求差异大导致的延迟和内存问题,提出RPS-Serve调度器,通过动态优先级和老化机制实现高效资源利用,降低TTFT并提升响应性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03370 2026-03-27 cs.CL 89%

EQ-Negotiator: Dynamic Emotional Personas Empower Small Language Models for Edge-Deployable Credit Negotiation

EQ-Negotiator:动态情感人格赋能小型语言模型进行边缘部署的信用谈判

Yunbo Long, Yuhan Liu, Alexandra Brintrup

机构 * Rotman School of Management, University of Toronto(多伦多大学罗特曼管理学院) Department of Engineering, University of Cambridge(剑桥大学工程系) The Alan Turing Institute, London, UK(伦敦阿尔法顿研究所)

专题命中 效率与部署 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本文提出EQ-Negotiator框架,通过整合博弈论与隐马尔可夫模型,使小型语言模型具备动态情感人格,提升边缘设备上的信用谈判效率与道德标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23668 2026-03-26 cs.AR cs.LG 89%

Energy Efficient Software Hardware CoDesign for Machine Learning: From TinyML to Large Language Models

面向机器学习的能效软件硬件协同设计:从TinyML到大语言模型

Mohammad Saleh Vahdatpour, Yanqing Zhang

机构 * Department of Computer Science(计算机科学系)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文探讨了从TinyML到大语言模型的能效协同设计方法,涵盖边缘推理、训练和数据中心规模的LLM服务,分析了加速器架构和系统级技术,并提出分层分解视角以指导构建能效和碳感知的机器学习系统。

Comments Accepted as a poster presentation at the EMC2 Workshop, ASPLOS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21237 2026-03-24 cs.AI 89%

ConsRoute:Consistency-Aware Adaptive Query Routing for Cloud-Edge-Device Large Language Models

ConsRoute:面向云-边-设备大语言模型的一致性感知自适应查询路由

Haoyu Qiao, Hao Zhang, Shanwen Mao, Siyao Cheng, Jie Liu

机构 * Department of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术系) National Key Laboratory of Smart Farm Technologies and Systems(国家智能农业技术与系统重点实验室) Department of Computer Science and Technology, Harbin Institute of Technology (ShenZhen)(哈尔滨工业大学(深圳)计算机科学与技术系)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出ConsRoute框架,通过语义一致性评估和高效路由策略提升大语言模型推理效率,减少延迟和成本,实验表明其性能接近云端且优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18793 2026-03-20 cs.CR cs.AI 89%

Functional Subspace Watermarking for Large Language Models

用于大型语言模型的功能子空间水印

Zikang Ding, Junhao Li, Suling Wu, Junchi Yao, Hongbo Liu, Lijie Hu

机构 * University of Electronic Science(电子科学与技术大学) Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi, United Arab Emirates(阿布扎赫德人工智能 Mohamed bin Zayed 大学) South China University of Technology, Guangzhou, China(华南理工大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出功能子空间水印方法,通过稳定子空间和自适应谱截断策略提升水印鲁棒性,实验显示其在多种攻击下检测准确性和统计可验证性优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.09749 2026-03-20 cs.CL cs.IR 89%

Enhancing Lexicon-Based Text Embeddings with Large Language Models

通过大语言模型增强基于词典的文本嵌入

Yibin Lei, Tao Shen, Yu Cao, Andrew Yates

机构 * University of Amsterdam(阿姆斯特丹大学) University of Technology Sydney(技术悉尼大学) Tencent IEG(腾讯IEG) Johns Hopkins University, HLTCOE(约翰霍普金斯大学,HLTCOE)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出基于词典的嵌入方法LENS,利用大语言模型处理词冗余问题,通过词嵌入聚类和双向注意力机制,在MTEB基准测试中优于密集嵌入,且支持高效维度剪枝。

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.11149 2026-03-20 cs.LG cs.CR 89%

Systematic Scaling Analysis of Jailbreak Attacks in Large Language Models

大语言模型中越狱攻击的系统缩放分析

Xiangwen Wang, Ananth Balashankar, Varun Chandrasekaran

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Google DeepMind(谷歌DeepMind)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.LG

AI总结 本文系统分析了大语言模型中越狱攻击的缩放规律,通过计算限制优化过程评估不同方法、模型家族和危害类型的攻击成功率,发现提示基方法在计算效率上更具优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14763 2026-03-20 cs.IR cs.AI 89%

Membership Inference Attack against Large Language Model-based Recommendation Systems: A New Distillation-based Paradigm

针对基于大语言模型的推荐系统Membership推理攻击:一种新的知识蒸馏范式

Li Cuihong, Huang Xiaowen, Yin Chuanhuan, Sang Jitao

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出一种基于知识蒸馏的新型Membership推理攻击方法,针对大语言模型推荐系统,通过构建参考模型并提取融合特征来提升攻击效果,实验表明其在隐私攻击中具有实用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22272 2026-03-19 cs.CL 89%

From Slides to Chatbots: Enhancing Large Language Models with University Course Materials

从幻灯片到聊天机器人:利用大学课程材料增强大语言模型

Tu Anh Dinh, Philipp Nicolas Schumacher, Jan Niehues

机构 * Karlsruhe Institute of Technology, Germany(卡尔斯鲁厄理工学院,德国)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文研究如何通过整合大学课程材料提升大语言模型在计算机科学课程中的表现,比较了RAG和CPT两种策略,并发现多模态RAG在处理包含图像和公式的幻灯片时更有效。

Comments Accepted to NSLP @ LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.23404 2026-03-17 cs.CL 89%

AJF: Adaptive Jailbreak Framework Based on the Comprehension Ability of Black-Box Large Language Models

AJF:基于黑盒大语言模型理解能力的自适应突破框架

Mingyu Yu, Wei Wang, Yanjie Wei, Sujuan Qin, Fei Gao, Wenmin Li

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出AJF框架,通过分析目标LLM的理解能力,针对不同类型的LLM采用不同的突破策略,实验显示在GPT-4o和GPT-4.1上攻击成功率分别达到98.9%和99.8%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13562 2026-03-17 cs.LG 89%

Scalable Classification of Course Information Sheets Using Large Language Models: A Reusable Institutional Method for Academic Quality Assurance

利用大语言模型实现课程信息表的可扩展分类:一种用于学术质量保证的可重用机构方法

Brecht Verbeken, Joke Van den Broeck, Inge De Cleyn, Steven Van Luchene, Nadine Engels, Andres Algaba, Vincent Ginis

机构 * Vrije Universiteit Brussel(布鲁塞尔自由大学) Harvard University(哈佛大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文提出一种利用大语言模型对课程信息表进行大规模分类的方法,通过迭代优化和多模型比较,实现了对课程评估风险的识别与验证,为学术质量保证提供了可重用的机构方法。

Comments 23 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.16439 2026-03-13 cs.CL 89%

FrugalPrompt: Reducing Contextual Overhead in Large Language Models via Token Attribution

FrugalPrompt:通过令牌归因减少大型语言模型中的上下文开销

Syed Rifat Raiyan, Md Farhan Ishmam, Abdullah Al Imran, Mohammad Ali Moni

机构 * Islamic University of Technology(伊斯兰科技大学) University of Utah(犹他大学) University of Liverpool(利物浦大学) University of Queensland(昆士兰大学)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 FrugalPrompt通过令牌归因方法减少大型语言模型的上下文开销,保留最语义重要的令牌以提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10775 2026-03-12 cs.CL 89%

Large Language Models as Annotators for Machine Translation Quality Estimation

大语言模型作为机器翻译质量估计的标注器

Sidi Wang, Sophie Arnoult, Amir Kamran

机构 * Maastricht university(马斯特里赫特大学) Vrije Universiteit Amsterdam(阿姆斯特丹自由大学) Taus

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出利用大语言模型生成MQM标注以训练COMET模型,通过简化标注方案提升中文-英文和英文-德语的段级机器翻译质量估计性能。

Comments 11 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08801 2026-03-11 quant-ph cs.AI 89%

Large Language Model-Assisted Superconducting Qubit Experiments

大语言模型辅助的超导量子比特实验

Shiheng Li, Jacob M. Miller, Phoebe J. Lee, Gustav Andersson, Christopher R. Conner, Yash J. Joshi, Bayan Karimi, Amber M. King, Howard L. Malc, Harsh Mishra, Hong Qiao, Minseok Ryu, Xuntao Wu, Siyuan Xing, Haoxiong Yan, Jian Shi, Andrew N. Cleland

机构 * University of Chicago(芝加哥大学) Pritzker School of Molecular Engineering(普ritz克分子工程学院) Aalto University School of Science(阿alto大学科学学院) Pico group(Pico组) QTF Centre of Excellence(QTF卓越中心) Department of Applied Physics(应用物理系) Department of Mathematics(数学系) Applied Materials, Inc(应用材料公司)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出利用大语言模型自动化超导量子比特实验,实现快速部署标准协议和新型实验程序,提升复杂量子硬件控制的灵活性和易用性。

Comments 10 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01711 2026-03-09 cs.CL 89%

Towards Resource Efficient and Interpretable Bias Mitigation in Large Language Models

迈向大型语言模型中资源高效且可解释的偏见缓解

Schrasing Tong, Eliott Zemour, Jessica Lu, Rawisara Lohanimit, Lalana Kagal

机构 * Department of Electrical Engineering and Computer Science(电气工程与计算机科学系) Massachusetts Institute of Technology(麻省理工学院)

专题命中 效率与部署 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文提出了一种通过小型专家模型高效缓解大型语言模型偏见的方法,通过解码时添加去偏信号,减少性别、种族和宗教偏见,同时保持语言模型性能。

Comments 38th Conference on Neural Information Processing Systems (NeurIPS 2024) Safe Generative AI Workshop. Updated results in V2

详情

展开后加载摘要…

URL PDF HTML 收藏