arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12565 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12565 篇

2407.17115 2025-02-04 cs.IR 86%

Reinforced Prompt Personalization for Recommendation with Large Language Models

Wenyu Mao, Jiancan Wu, Weijian Chen, Chongming Gao, Xiang Wang, Xiangnan He

专题命中 领域大模型 :large language model(title);language model(title);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.00568 2025-01-03 math.OC 86%

Robust and Adaptive Optimization under a Large Language Model Lens

Dimitris Bertsimas, Georgios Margaritis

专题命中 领域大模型 :large language model(title);language model(title);prompting(abstract)

Comments Submitted to the INFORMS Journal on Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.10542 2024-10-15 cs.CL cs.AI cs.IR cs.LG 86%

Rethinking Legal Judgement Prediction in a Realistic Scenario in the Era of Large Language Models

Shubham Kumar Nigam, Aniket Deroy, Subhankar Maity, Arnab Bhattacharya

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

Comments Accepted on NLLP at EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.19684 2024-10-01 cs.CV 86%

MedViLaM: A multimodal large language model with advanced generalizability and explainability for medical data understanding and generation

Lijian Xu, Hao Sun, Ziyu Ni, Hongsheng Li, Shaoting Zhang

专题命中 领域大模型 :language model(title,abstract);large language model(title)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.14030 2024-07-22 cs.CL cs.AI cs.IR cs.LG 86%

HeCiX: Integrating Knowledge Graphs and Large Language Models for Biomedical Research

Prerana Sanjay Kulkarni, Muskaan Jain, Disha Sheshanarayana, Srinivasan Parthiban

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages, 3 figures, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.04795 2024-03-11 cs.CL cs.AI cs.LG 86%

Large Language Models in Fire Engineering: An Examination of Technical Questions Against Domain Knowledge

Haley Hostetter, M. Z. Naser, Xinyan Huang, John Gales

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.14120 2024-02-22 cs.LG cs.AI cs.CL 86%

Large Language Models Streamline Automated Machine Learning for Clinical Studies

Soroosh Tayebi Arasteh, Tianyu Han, Mahshad Lotfinia, Christiane Kuhl, Jakob Nikolas Kather, Daniel Truhn, Sven Nebelung

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

Comments Published in Nature Communications

Journal ref Nat Commun 15, 1603 (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06088 2024-01-12 cs.CL cs.AI cs.LG 86%

Autocompletion of Chief Complaints in the Electronic Health Records using Large Language Models

K M Sajjadul Islam, Ayesha Siddika Nipu, Praveen Madiraju, Priya Deshpande

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

Comments IEEE BigData 2023 - Sorrento, Italy. 10 Pages, 4 Figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.05982 2023-05-11 cs.CL cs.AI cs.LG 86%

Generating medically-accurate summaries of patient-provider dialogue: A multi-stage approach using large language models

Varun Nair, Elliot Schumacher, Anitha Kannan

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.15436 2026-08-18 cs.AI cs.NI 新提交 85%

OTel: Building Domain-Specialized Telecom LLM Foundations for Intelligent Networks

OTel:构建面向智能网络的领域专用电信大语言模型基础

Farbod Tavakkoli, Roderic Paulk, Jorden Terrazas, Kenneth Church, Mark Austin, Louis Powell, Gregory Diamos, Lina Bariah, Syed Ali Raza Zaidi, Maryam Hafeez, Ali Maatouk, Imtiaz Karim

机构 * AT&T Chief Data Office(AT&T首席数据办公室) GSMA(全球移动通信系统协会) RelationalAI(RelationalAI公司) Khalifa University(哈利法大学) University of Leeds(利兹大学) Yale University(耶鲁大学) The University of Texas at Dallas(德克萨斯大学达拉斯分校)

专题命中 领域大模型 :LLM(title);language model(abstract);instruction tuning(abstract);post-training(abstract)

AI总结 本研究推出开源电信AI资源OTel,含多类任务数据集与30个模型基线,后训练提升三类模型性能,获大量下载与媒体报道,邀请社区共建更强电信大语言模型。

Comments Accepted at the ACM AI Leadership Summit, Breakthrough Impact Highlights Track, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05033 2026-08-14 cs.DC cs.LG 版本更新 85%

SparseDitto: Customizing GPU Kernels for Different Sparsity Patterns with LLM-Based Agentic System

SparseDitto:基于大语言模型的智能体系统,为不同稀疏性模式定制GPU内核

Shiyang Li, Guangyan Sun, Jinwei Tang, Yanzhi Wang, Mingyi Hong, Caiwen Ding

专题命中 领域大模型 :LLM(title,summary_cn);分类 cs.LG

AI总结 SparseDitto是基于LLM的系统,可为不同矩阵、算子和GPU定制稀疏矩阵GPU内核,在多类算子与GPU上较cuSPARSE实现显著加速,还可提升GCN训练速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10635 2026-08-12 cs.CV cs.AI 新提交 85%

MedUP: Awakening Unified Understanding and Perception in Medical Vision-Language Models

MedUP:唤醒医学视觉-语言模型中的统一理解与感知能力

Yuan Wang, Hualiang Wang, Yixin Chen, Songtao Jiang, Shujian Gao, Jiaming Lin, Siming Fu, Jian Wu, Zuozhu Liu

机构 * Zhejiang University(浙江大学) Fudan University(复旦大学)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI

AI总结 该研究提出MedUP模型,通过UniMedTok分词器在共享token空间统一医学视觉-语言模型的感知与理解,构建相关训练语料库和评估基准,在多医学任务上性能优于现有模型。

Comments 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19592 2026-08-10 cs.AI cs.RO 85%

Adaptive Domain Modeling with Language Models: A Multi-Agent Approach to Task Planning

Harisankar Babu, Philipp Schillinger, Tamim Asfour

机构 * Bosch Center for Artificial Intelligence(博世人工智能中心) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI

Comments Accepted at IEEE CASE 2025, 8 pages, 8 figures

Journal ref 2025 IEEE 21st International Conference on Automation Science and Engineering (CASE), 2025, pp. 1701-1708

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01663 2026-08-04 cs.CV cs.AI 新提交 85%

Few-Shot Concept Prompt Learning for Segmentation Foundation Models via Visual Grounding

基于视觉定位的分割基础模型少样本概念提示学习

Rahul Venkataramani, Rachana Sathish

机构 * Advanced Technology Group(先进技术集团) GE HealthCare(GE医疗)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract);prompting(abstract);分类 cs.AI

AI总结 该研究针对分割基础模型在临床任务中表现不足的问题,提出FS-CPL方法,通过视觉定位学习概念提示,在四个医学影像基准上取得显著性能提升,且与骨干网络无关。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28050 2026-07-31 cs.AI 新提交 85%

IndustryForge-27B: A Domain-Enhanced Multimodal Foundation Model for Industrial CAD

IndustryForge-27B:面向工业CAD的领域增强多模态基础模型

Nianchen Deng, Jiaxin Ai, Tao Hu, Shu Zou, Yurui Dong, Siqi Li, Xinyu Cai, Xuemeng Yang, Licheng Wen, Hongbin Zhou, Hairong Zhang, Pinlong Cai, Botian Shi

专题命中 领域大模型 :foundation model(title,abstract);SFT(abstract,abstract_cn);分类 cs.AI

AI总结 该研究构建基于Qwen3.5-VL-27B的IndustryForge-27B多模态基础模型,整合6个工业CAD子语料库训练,在CAD基准测试中性能远超基础模型与GPT-5.4,可作为工业智能体的通用基础。

Comments 14 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21340 2026-07-28 cs.CL 版本更新 85%

Capital Markets LLM Reliability Score (CM-LRS): From Plausible to Bankable

资本市场大语言模型可靠性评分(CM-LRS):从似是而非到可信赖

Prerit Ahuja

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究资本市场大语言模型输出的可信赖问题,提出CM-LRS从七个维度评估工作流程输出,通过五个工作流程对四个模型与四位评判者评分,发现前沿闭源模型聚类近,差距集中在检索合成,决策有用性离散度大且评判者一致性高。

Comments 23 pages. Rubrics, prompts, and demonstration tasks are publicly available

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21530 2026-07-24 cs.SE cs.AI 新提交 85%

From Resource Flow to Executable Tests: Petri-Net-Guided LLM Test Generation for Concurrent Stateful Rust APIs

从资源流到可执行测试:用于并发有状态 Rust API 的 Petri 网引导的大语言模型测试生成

Kaiwen Zhang, Guanjun Liu

机构 * Tongji University(同济大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对并发有状态 Rust API 测试生成问题,提出 Petri 网引导方法,将 API 相关要素表示为有色令牌和转换来导出场景,用作基于大语言模型代码合成的中间表示,经一系列机制确保测试生成的有效性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21327 2026-07-24 cs.DL cs.AI 新提交 85%

From Static Bibliometrics to Dynamic Knowledge Graphs: An LLM-Powered Framework for Modernizing Science, Technology, and Innovation (STI) Analytics

从静态文献计量学到动态知识图谱:一个由大语言模型驱动的框架,用于实现科学、技术与创新(STI)分析的现代化

Muhsen Hammoud

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对文献计量指标的问题,提出由大语言模型驱动、整合多种传统的混合框架,经五层架构实现,将LLMs作为候选生成器,通过多阶段验证,支持多种分析,贡献了验证中介原则并讨论治理考量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09988 2026-07-23 cs.IR cs.AI 版本更新 85%

An LLM-powered Agentic Recommendation System for Connected TV Content Discovery

一种用于智能电视内容发现的由大语言模型驱动的智能推荐系统

Lei Shi, Di Wang, Harry Tran, Helsing Xu, Yuchen Lu, Dhara Ghodasara, Wilson Chaney, Xueting Liao, Jerry Yu, Huayu Ding, Reza Mirghaderi, David Fan, Qi Guo, Chongguang He, Warren Wang, Warren Deng, Mingze Gao, Shike Mei, Shuo Tang, Zhe Zhang, Jianming He, Abhishek Kumar, Haotian Wu, Hamed Firooz, Li Li

机构 * Meta

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对推荐系统整合上下文信号的挑战,提出用于智能电视内容发现的大语言模型驱动的智能推荐系统,利用其推理能力处理多样信号,采用智能架构协调组件,克服大语言模型用于推荐的实际限制。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.22324 2026-07-22 cs.LG cs.MA 版本更新 85%

Automatic Construction of Clinical Scoring Systems with LLM Agents

基于LLM代理的临床评分系统自动构建

Silas Ruhrberg Estévez, Christopher Chiu, Mihaela van der Schaar

机构 * DAMTP, University of Cambridge, Cambridge, UK(剑桥大学 DAMTP 实验室,剑桥,英国)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.LG

AI总结 提出AgentScore方法,利用大语言模型进行语义引导的规则搜索与验证,自动构建符合临床部署约束的加权评分系统,在多个任务上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.18029 2026-07-21 cs.DB cs.AI 新提交 85%

Natural Language Access to Domain-Specific Metadata: A Reusable Framework for LLM Query Generation

自然语言访问特定领域元数据:用于大语言模型查询生成的可重用框架

Blake G. Fitch, Cato Elia Kurtz

机构 * Max Planck Institute for Biological Cybernetics(马克斯·普朗克生物信息学研究所)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对特定领域档案元数据查询难题,提出NLKGQ系统,借助OWL本体和LLMs,能零样本生成准确结构化查询。经神经影像档案元数据实验,最佳配置准确率达100%,明确影响准确率关键因素,还对比SPARQL与SQL,凸显OWL优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16870 2026-07-21 cs.SD cs.AI cs.CR 新提交 85%

Do Speech Tokens Leak Voiceprints? Speaker Inversion Attacks Against End-to-End Speech Language Models

语音令牌会泄露声纹吗?针对端到端语音语言模型的说话人反转攻击

Ye Lu, Yihan Yan, Zhaoyang Zhang, Zhitao Ou, Runze Liu, Li Liu, Shen Wang

专题命中 领域大模型 :language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI

AI总结 研究端到端语音语言模型中语音令牌是否泄露声纹,提出用Audio BERT构建令牌嵌入及SpInv两阶段反转方法,在VoxCeleb数据集实验显示,仅三秒前端输出,SpInv在指定空间能达高于0.70的余弦相似度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.14510 2026-07-17 cs.AI 新提交 85%

VLT: A Vision-Language-Time Series Multimodal Foundation Model for Industrial Intelligence

VLT:用于工业智能的视觉-语言-时间序列多模态基础模型

Haiteng Wang, Jingheng Yan, Xiaokang Wang, Lei Ren

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) State Key Laboratory of Intelligent Manufacturing System Technology(智能制造系统技术国家重点实验室) School of Computer Science and Artificial Intelligence, Zhengzhou University(郑州大学计算机科学与人工智能学院)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对工业时间序列单模态建模局限及连接时间序列与文本语义的挑战,提出VLT多模态基础模型,通过设计Time-MoE等机制联合建模多种模态,经实验验证其在多种复杂设置下优于现有方法,提升了鲁棒性和泛化能力。

Comments 18 pages, 13 figures, and 13 tables, including supplementary material. Haiteng Wang and Jingheng Yan contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10358 2026-07-14 cs.CV cs.AI 新提交 85%

Benchmarking the Robustness of Foundation Models for Mammography under Domain Shift

在域转移下对用于乳腺钼靶成像的基础模型的稳健性进行基准测试

Giang Nguyen, Raghav Mehta, Emma A. M. Stanley, Tian Xia, Thi Hao Nguyen, Hieu Pham, Ben Glocker

机构 * College of Engineering and Computer Science, VinUniversity(工程与计算机科学学院,文大大学) Imperial College London(伦敦帝国理工学院) Radiology Department, Vietnam National Cancer Hospital(越南国家癌症医院放射科) VinUni-Illinois Smart Health Center, VinUniversity(文大大学 - 伊利诺伊智能健康中心,文大大学) The Computer Vision and Medical AI Lab, VinUniversity(计算机视觉与医学人工智能实验室,文大大学)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);pretraining(abstract);分类 cs.AI

AI总结 研究在域转移下乳腺钼靶成像基础模型的稳健性,用统一协议在多数据集上训练评估15种模型主干,发现特定视觉语言模型性能强,DINOv3是有竞争力基线,适应预训练未持续提升泛化,强调数据集级OOD评估是核心标准。

Comments Under Review. Giang Nguyen and Raghav Mehta contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07673 2026-07-09 cs.CV cs.LG 新提交 85%

MedPMC: A Systematic Framework for Scaling High-Fidelity Medical Multimodal Data for Foundation Models

MedPMC:一种用于为基础模型扩展高保真医学多模态数据的系统框架

Hyunjae Kim, Dain Kim, Pan Xiao, Serina S. Applebaum, Younjoon Chung, Xuguang Ai, Yu Yin, Roy Jiang, Yuexi Du, Yawen Wei, Yiming Kong, Tuo Guo, Zhiyuan Cao, Mengmeng Du, Yuelei Fu, Yan Hu, Rui Shi, Gui Yang, Kevin W. Jin, Yuntian Liu, Yuxuan Tian, Jonathan Marquez, Zhen Chen, Sheng Zhang, Hoifung Poon, Hua Xu, Jaewoo Kang, Qingyu Chen

机构 * Yale University(耶鲁大学) Korea University(韩国大学) Washington University in St. Louis(圣路易斯华盛顿大学) The University of Queensland(昆士兰大学) The University of Texas Health Science Center at Houston(德克萨斯大学休斯顿健康科学中心) University of Washington(华盛顿大学) Microsoft Research(微软研究院)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对医学多模态基础模型受高质量临床数据限制问题,提出MedPMC框架,将文献转化为高保真基础设施。经实验,该框架整理大量图像-文本对,在多方面评估表现出色,训练模型在多基准测试和临床场景中效果显著,还公开相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04108 2026-07-07 cs.LG 新提交 85%

Dictionaries, Not Darwin: Set-Level Selection Beats LLM Evolution in Scientific Equation Discovery

字典,而非达尔文:在科学方程发现中,集合级选择优于大语言模型进化

Pan Li

机构 * Independent Researcher(独立研究者)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究大语言模型用于科学方程发现的进化循环是否有效,发现其效果不佳。提出PTB-Search方法,通过提取可重用术语并进行集合级稀疏选择,在科学发现中表现优于单术语约简,用更少调用预算取得更好结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10808 2026-06-29 cs.CL cs.IR 85%

ColBERT Retrieval and Ensemble Response Scoring for Language Model Question Answering

基于ColBERT检索和集成响应评分的语言模型问答系统

Alex Gichamba, Tewodros Kederalah Idris, Brian Ebiyau, Eric Nyberg, Teruko Mitamura

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);small language model(abstract);分类 cs.CL

AI总结 本文提出基于ColBERT检索和集成响应评分的方法,提升小语言模型在电信领域问答任务中的性能,Phi-2模型达到81.9%准确率,Falcon-7B模型达到57.3%准确率。

Comments 7 pages, 2 figures, and 8 tables. This paper has been accepted at the 2024 IEEE Global Communications (GLOBECOM) Workshops

Journal ref 2024 IEEE Globecom Workshops (GC Wkshps), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.17657 2026-06-17 cs.AI 新提交 85%

Using Cognitive Models to Improve Language Model Simulation of Human Persuasion Games

使用认知模型改进语言模型对人类说服博弈的模拟

Zirui Cheng, Zeyu Shen, Thomas L. Griffiths, Peter Henderson

机构 * Princeton University(普林斯顿大学)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.AI

AI总结 提出方程到行为提示和强化学习方法,使语言模型匹配认知模型(如贝叶斯更新、动机推理),在说服博弈中提升模拟人类决策多样性的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.01157 2026-06-11 cs.CL cs.CR cs.SD 版本更新 85%

Where Do Backdoors Live? A Component-Level Analysis of Backdoor Propagation in Speech Language Models

后门藏身何处?语音语言模型中后门传播的组件级分析

Alexandrine Fortier, Thomas Thebaud, Jesús Villalba, Najim Dehak, Patrick Cardinal, Peter West

机构 * University of British Columbia(不列颠哥伦比亚大学) École de technologie supérieure(高等技术学院) Johns Hopkins University(约翰霍普金斯大学)

专题命中 领域大模型 :language model(title,abstract);SLM(abstract,abstract_cn);分类 cs.CL

AI总结 本文通过后门攻击视角,对语音语言模型进行组件级分析,揭示后门在不同组件中的传播机制,发现后门持久性高度依赖目标组件,且中毒样本与良性样本在共享嵌入中不可直接分离。

Comments Interspeech 2026 (long paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10581 2026-06-10 cs.CL cs.SD eess.AS 新提交 85%

ParaBridge: Bridging Paralinguistic Perception and Dialogue Behavior in Speech Language Models

ParaBridge: 弥合语音语言模型中的副语言感知与对话行为

Yuxiang Wang, Qinke Ni, Shengbo Cai, Wan Lin, Liqiang Zhang, Zhizheng Wu

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Tencent Hunyuan(腾讯混元) Shenzhen Loop Area Institute(深圳河套学院) Amphion Technology Co., Ltd.(Amphion科技有限公司) Tsinghua University(清华大学)

专题命中 领域大模型 :language model(title,abstract);SLM(abstract,abstract_cn);分类 cs.CL

AI总结 提出ParaBridge,一种在线自我蒸馏方法,将推理阶段的副语言指令支架转化为稳定的模型行为,无需人工标注或外部奖励,显著提升语音语言模型对副语言线索的响应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏