arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-12 至 2026-03-12 共收录 24 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 24 篇

2603.09109 2026-03-12 cs.CV cs.AI 91%

VIVID-Med: LLM-Supervised Structured Pretraining for Deployable Medical ViTs

VIVID-Med: 基于LLM监督的结构化预训练用于可部署的医学ViT

Xiyao Wang, Xiaoyu Tan, Yang Dai, Yuxuan Fu, Shuo Li, Xihe Qiu

机构 * Shanghai University of Engineering Science(上海工程技术大学) National University of Singapore(新加坡国立大学) Case Western Reserve University(凯斯西储大学)

专题命中 领域大模型 :LLM(title,abstract);pretraining(title,abstract);large language model(abstract);language model(abstract)

AI总结 VIVID-Med通过LLM监督的结构化预训练方法,实现轻量级可部署的医学ViT模型,在医学图像分析中表现出高效和强泛化能力。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09992 2026-03-12 cs.CL cs.AI cs.LG 91%

TAMUSA-Chat: A Domain-Adapted Large Language Model Conversational System for Research and Responsible Deployment

TAMUSA-Chat: 一个面向研究和负责任部署的领域适应大型语言模型对话系统

Izzat Alsmadi, Anas Alsobeh

机构 * Texas A&M University–San Antonio(德克萨斯A&M大学-圣安东尼奥分校) Utah Valley University(犹他谷大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);foundation model(abstract)

AI总结 TAMUSA-Chat是一个面向研究和负责任部署的领域适应大型语言模型对话系统,通过监督微调、检索增强生成和系统化评估方法,解决机构环境中的关键挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20859 2026-03-12 cs.CL 89%

Leveraging Open-Source Large Language Models for Clinical Information Extraction in Resource-Constrained Settings

利用开源大语言模型在资源受限环境下进行临床信息抽取

Luc Builtjes, Joeran Bosma, Mathias Prokop, Bram van Ginneken, Alessa Hering

机构 * Diagnostic Image Analysis Group, Department of Medical Imaging(医学影像诊断分析组,医学影像系)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本研究利用开源大语言模型开发了信息抽取框架,展示了其在低资源环境下有效进行临床信息抽取的潜力。

Comments 34 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12566 2026-03-12 cs.AI 88%

To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models

混合还是合并:为大语言模型的多领域强化学习而努力

Haoqing Wang, Xiang Long, Ziheng Li, Yilong Xu, Tingguang Li, Yehui Tang

机构 * Samsung Research(三星研究院) Peking University(北京大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 本研究提出M2RL框架,通过混合多任务训练或模型合并策略,提升大语言模型在多领域任务中的推理能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08935 2026-03-12 cs.CV cs.AI cs.CL cs.DL cs.IR 86%

PathoScribe: Transforming Pathology Data into a Living Library with a Unified LLM-Driven Framework for Semantic Retrieval and Clinical Integration

PathoScribe: 将病理数据转化为一个活的图书馆:一种统一的LLM驱动框架,用于语义检索和临床整合

Abdul Rehman Akbar, Samuel Wales-McGrath, Alejadro Levya, Lina Gokhale, Rajendra Singh, Wei Chen, Anil Parwani, Muhammad Khalid Khan Niazi

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 PathoScribe通过统一的LLM框架实现病理数据的语义检索与临床整合,提升病理档案的活用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10004 2026-03-12 cs.CL 85%

Fine-Tune, Don't Prompt, Your Language Model to Identify Biased Language in Clinical Notes

微调,而非提示:让你的语言模型识别临床笔记中的偏见语言

Isotta Landi, Eugenia Alleva, Nicole Bussola, Rebecca M. Cohen, Sarah Nowlin, Leslee J. Shaw, Alexander W. Charney, Kimberly B. Glazer

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL

AI总结 通过微调而非提示,提高语言模型识别临床笔记中偏见语言的能力,展示在不同专科和医疗系统中的情感价值分类效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10828 2026-03-12 cs.CV cs.AI 83%

BALD-SAM: Disagreement-based Active Prompting in Interactive Segmentation

BALD-SAM:基于分歧的交互分割主动提示

Prithwijit Chowdhury, Mohit Prabhushankar, Ghassan AlRegib

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 领域大模型 :prompting(title,abstract);foundation model(abstract);分类 cs.AI

AI总结 BALD-SAM通过引入贝叶斯主动学习与分歧方法,提升交互分割的自动化和准确性,实现跨领域高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20744 2026-03-12 cs.SE 82%

From Law to Gherkin: A Human-Centred Quasi-Experiment on the Quality of LLM-Generated Behavioural Specifications from Food-Safety Regulations

从法律到Gherkin:一项以人类为中心的准实验,探讨LLM生成的行为规范质量

Shabnam Hassani, Mehrdad Sabetzadeh, Daniel Amyot

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract)

AI总结 本文通过准实验评估LLMs从法律文本生成Gherkin规范的能力,发现其在相关性和清晰性方面表现良好,但需人类监督以纠正遗漏和幻觉。

Comments This article has been accepted for publication in Information and Software Technology (IST)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10891 2026-03-12 cs.AI cs.IR 77%

A Hybrid Knowledge-Grounded Framework for Safety and Traceability in Prescription Verification

一种混合知识引导的框架用于处方验证中的安全性和可追溯性

Yichi Zhu, Kan Ling, Xu Liu, Hengrun Zhang, Huiqun Yu, Guisheng Fan

机构 * School of Information Science and Engineering, East China University of Science and Technology(信息科学与工程学院,东华大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出PharmGraph-Auditor框架,通过混合制药知识库和知识引导的验证链,提升处方验证的安全性和可追溯性。

Comments 11 pages, 7 figures.Framework for safe prescription auditing and hybrid knowledge-grounded reasoning

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10808 2026-03-12 cs.AI cs.HC cs.SE 77%

Nurture-First Agent Development: Building Domain-Expert AI Agents Through Conversational Knowledge Crystallization

先培养型代理开发:通过对话知识结晶构建领域专家AI代理

Linghao Zhang

机构 * Jiangsu Key Laboratory of Wireless Communications(江苏无线通信重点实验室)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出先培养开发范式,通过结构化对话与领域专家交互逐步构建领域专家AI代理,强调知识结晶循环和三层认知架构。

Comments 24 pages, 8 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19498 2026-03-12 cs.LG cs.AI cs.CR 73%

Hierarchical Dual-Strategy Unlearning for Biomedical and Healthcare Intelligence Using Imperfect and Privacy-Sensitive Medical Data

层次化双策略去学习用于生物医学与医疗智能的不完美和隐私敏感医疗数据

Yi Zhang, Chao Zhang, Zijian Li, Tianxiang Xu, Kunyu Zhang, Zhan Gao, Meinuo Li, Xiaohan Zhang, Qichao Qi, Bing Chen

机构 * Department of Neurosurgery, Qilu Hospital of Shandong University and Institute of Brain and Brain-Inspired Science(齐鲁医院山东大学神经外科和脑科学与脑启发科学研究院) Department of Neurosurgery, The Affiliated Hospital of Qingdao University(青岛大学附属医院神经外科) Department of Neurosurgery, Peking Union Medical College Hospital(北京地坛医院神经外科) School of Software and Microelectronics, Peking University(北京大学软件与微电子学院) College of Artificial Intelligence, Dalian Maritime University(大连海事大学人工智能学院) University of Colorado Boulder(科罗拉多大学波尔德分校) Zhengzhou University(郑州大学) The University of Hong Kong(香港大学) Georgia Institute of Technology(佐治亚理工学院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出层次化双策略去学习框架,用于在医疗数据中精确移除专业性知识并保留基本医疗能力,同时保障隐私并满足合规要求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10285 2026-03-12 cs.HC cs.AI cs.CY cs.DL cs.ET 70%

Conversational AI-Enhanced Exploration System to Query Large-Scale Digitised Collections of Natural History Museums

对话式AI增强的探索系统用于查询自然历史博物馆大规模数字化收藏

Yiyuan Wang, Andrew Johnston, Zoë Sadokierski, Rhiannon Stephens, Shane T. Ahyong

机构 * School of Computer Science, University of Technology Sydney(技术科技大学计算机科学学院) School of Design, University of Technology Sydney(技术科技大学设计学院) Australian Museum Research Institute, Australian Museum(澳大利亚博物馆研究 institute, 澳大利亚博物馆) Australian Museum(澳大利亚博物馆)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出利用对话式AI查询自然历史博物馆大规模数字化收藏的系统,通过交互式地图和自然语言代理实现高效的数据检索与探索。

Comments 25 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10148 2026-03-12 cs.SI cs.AI 70%

Social Knowledge for Cross-Domain User Preference Modeling

社交知识用于跨领域用户偏好建模

Nir Lotan, Adir Solomon, Ido Guy, Einat Minkov

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出利用大规模社交建模方法,通过用户偏好和流行实体的联合嵌入空间,实现跨领域用户偏好预测与个性化,提升零样本场景下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22427 2026-03-12 cs.CR cs.AI 70%

Adversarial Hubness Detector: Detecting Hubness Poisoning in Retrieval-Augmented Generation Systems

对抗性中心性检测器:在检索增强生成系统中检测中心性污染

Idan Habler, Vineeth Sai Narajala, Stav Koren, Amy Chang, Tiffany Saade

机构 * Idan Habler Vineeth Sai Narajala Stav Koren Amy Chang Tiffany Saade

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 Hubscan通过多检测器架构检测RAG系统中的对抗性中心性问题,利用统计分析、聚类扩展、稳定性测试和领域感知方法,有效识别并隔离潜在的安全威胁。

Comments 11 pages, 5 figures, 2 tables, Github: https://github.com/cisco-ai-defense/adversarial-hubness-detector, Updated with minor changes to naming

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.09394 2026-03-12 cs.HC 67%

EyeAgent: An Agentic AI System for Multimodal Clinical Decision Support in Ophthalmology

EyeAgent:一种用于眼科多模态临床决策支持的智能AI系统

Danli Shi, Xiaolan Chen, Bingjie Yan, Weiyi Zhang, Pusheng Xu, Jiancheng Yang, Ruoyu Chen, Siyu Huang, Bowen Liu, Xinyuan Wu, Meng Xie, Ziyu Gao, Yue Wu, Senlin Lin, Kai Jin, Xia Gong, Yih Chung Tham, Xiujuan Zhang, Li Dong, Yuzhou Zhang, Jason Yam, Guangming Jin, Xiaohu Ding, Haidong Zou, Yalin Zheng, Zongyuan Ge, Mingguang He

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 EyeAgent通过整合53种眼科工具提升诊断准确率,实现多模态临床决策支持,为眼科AI系统提供新范式。

Comments 28 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.11270 2026-03-12 cond-mat.stat-mech 67%

Site-decorated model for unconventional frustrated magnets: Ultranarrow phase crossover and two-dimensional spin reversal transition

带有位点修饰的模型用于非常规反铁磁体:超窄相变和二维自旋反转转变

Weiguo Yin

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 本文提出位点修饰的伊辛模型,用于研究一维反铁磁体的超窄相变和二维自旋反转转变,通过精确映射和解析解,揭示了其物理机制及在材料设计和AI应用中的潜力。

Comments The version accepted for publication. 12 pages, 8 figures. This article is a prequel to arXiv:2503.23758, arXiv:2505.02303, and arXiv:2511.06442

Journal ref Phys. Rev. B 113, 104418 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09991 2026-03-12 cs.CL cs.AI 62%

PoultryLeX-Net: Domain-Adaptive Dual-Stream Transformer Architecture for Large-Scale Poultry Stakeholder Modeling

PoultryLeX-Net: 领域自适应双流Transformer架构用于大规模家禽利益相关者建模

Stephen Afrifa, Biswash Khatiwada, Kapalik Khanal, Sanjay Shah, Lingjuan Wang-Li, Ramesh Bahadur Bist

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI

AI总结 PoultryLeX-Net通过双流Transformer架构实现领域自适应,提升家禽文本情感分析的准确性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01607 2026-03-12 cs.AI cs.LG 62%

CARE: Towards Clinical Accountability in Multi-Modal Medical Reasoning with an Evidence-Grounded Agentic Framework

CARE:迈向多模态医学推理中的临床问责的证据基础代理框架

Yuexi Du, Jinglu Wang, Shujie Liu, Nicha C. Dvornek, Yan Lu

机构 * Microsoft Research Asia(微软亚洲研究院) Department of Biomedical Engineering, Yale University(耶鲁大学生物医学工程系) Department of Radiology & Biomedical Imaging, Yale University(耶鲁大学放射学与生物医学成像系)

专题命中 领域大模型 :language model(abstract);分类 cs.AI、cs.LG

AI总结 CARE通过证据基础的代理框架提升多模态医学推理的准确性与问责性,结合解耦的专业模型和明确证据,实现更可靠的医学AI。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17929 2026-03-12 cs.CV cs.LG eess.IV 57%

ZACH-ViT: Regime-Dependent Inductive Bias in Compact Vision Transformers for Medical Imaging

ZACH-ViT:用于医学影像的紧凑视觉变换器中的领域依赖归纳偏置

Athanasios Angelakis

机构 * BioML Lab, RI CODE, UniBw, Munich, Germany(生物机器学习实验室,RI CODE,UniBw,慕尼黑,德国) EDS, Amsterdam UMC, Amsterdam, Netherlands(EDS,阿姆斯特丹大学医学中心,阿姆斯特丹,荷兰)

专题命中 领域大模型 :pretraining(abstract);分类 cs.LG

AI总结 ZACH-ViT通过去除位置嵌入和[CLS]标记,利用全局平均池化实现排列不变的片段处理,在医学影像领域表现出领域依赖的归纳偏置优势。

Comments 24 pages, 15 figures, 5 tables. Code and models available at https://github.com/Bluesman79/ZACH-ViT

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10549 2026-03-12 cs.CV cs.AI eess.SP 57%

Towards Cognitive Defect Analysis in Active Infrared Thermography with Vision-Text Cues

面向主动红外热成像的认知缺陷分析:结合视觉-文本线索

Mohammed Salah, Eman Ouda, Giuseppe Dell'Avvocato, Fabrizio Sarasini, Ester D'Accardi, Jorge Dias, Davor Svetinovic, Stefano Sfarra, Yusra Abdulrahman

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 本文提出一种结合视觉-文本线索的主动红外热成像认知缺陷分析框架,利用预训练多模态模型实现零样本缺陷检测,实验显示其信噪比提升超过10dB,交并比达70%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.10420 2026-03-12 eess.AS cs.SD 50%

FireRedASR2S: A State-of-the-Art Industrial-Grade All-in-One Automatic Speech Recognition System

FireRedASR2S: 一种最先进的工业级一体化自动语音识别系统

Kaituo Xu, Yan Jia, Kai Huang, Junjie Chen, Wenpeng Li, Kun Liu, Feng-Long Xie, Xu Tang, Yao Hu

专题命中 领域大模型 :LLM(abstract)

AI总结 FireRedASR2S是一种集成ASR、VAD、LID和Punc的工业级语音识别系统,通过多模块协同提升识别准确性和多语言支持能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07304 2026-03-12 cs.DB 50%

Tursio for Credit Unions: Structured Data Search with Automated Context Graphs

Tursio 用于信用社:基于自动上下文图的结构化数据搜索

Shivani Tripathi, Ravi Shetye, Shi Qiao, Alekh Jindal

专题命中 领域大模型 :LLM(abstract)

AI总结 Tursio 通过自动上下文图技术,实现信用社等受监管行业结构化数据的自然语言查询与高效搜索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.18867 2026-03-12 cs.CV 50%

Similarity-as-Evidence: Calibrating Overconfident VLMs for Interpretable and Label-Efficient Medical Active Learning

相似性作为证据:校准过度自信的视觉语言模型以实现可解释且标注高效的医学主动学习

Zhuofan Xie, Zishan Lin, Jinliang Lin, Jie Qi, Shaohua Hong, Shuo Li

机构 * School of Electronic Technology and Engineering, Xiamen University, Xiamen, China(厦门大学电子技术与工程学院,厦门,中国) School of Informatics, Xiamen University, Xiamen, China(厦门大学信息学院,厦门,中国) School of Engineering, Case Western Reserve University, Cleveland, USA(凯斯西储大学工程学院,克利夫兰,美国)

专题命中 领域大模型 :language model(abstract)

AI总结 SaE框架通过引入相似性证据头校准视觉语言模型,以提高医学主动学习的可解释性和标注效率。

Comments Accepted to CVPR 2026 (to appear)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14918 2026-03-12 cs.CV 50%

X-WIN: Building Chest Radiograph World Model via Predictive Sensing

X-WIN:通过预测感知构建胸片世界模型

Zefan Yang, Ge Wang, James Hendler, Mannudeep K. Kalra, Pingkun Yan

专题命中 领域大模型 :foundation model(abstract)

AI总结 X-WIN通过预测感知构建胸片世界模型,利用体积数据提炼3D解剖知识,提升CXR的表示学习和诊断能力。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏