arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12581 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12581 篇

2506.19552 2025-06-25 cs.CV cs.AI cs.LG 84%

General Methods Make Great Domain-specific Foundation Models: A Case-study on Fetal Ultrasound

Jakob Ambsdorf, Asbjørn Munk, Sebastian Llambias, Anders Nymark Christensen, Kamil Mikolaj, Randall Balestriero, Martin Tolsgaard, Aasa Feragen, Mads Nielsen

机构 * University of Copenhagen(哥本哈根大学) Technical University of Denmark(丹麦技术大学) Copenhagen Academy of Medical Education and Simulation (CAMES)(哥本哈根医学教育与模拟学院) Copenhagen University Hospital Rigshospitalet(哥本哈根大学医院拉格比医院) Brown University(布朗大学) Pioneer Centre for AI(先锋人工智能中心)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

Comments Submitted version of paper accepted at MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16628 2025-06-23 cs.CL cs.LG 84%

Initial Investigation of LLM-Assisted Development of Rule-Based Clinical NLP System

Jianlin Shi, Brian T. Bucher

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.07527 2025-06-23 cs.AI cs.LG 84%

Nature Language Model: Deciphering the Language of Nature for Scientific Discovery

Yingce Xia, Peiran Jin, Shufang Xie, Liang He, Chuan Cao, Renqian Luo, Guoqing Liu, Yue Wang, Zequn Liu, Yuan-Jyue Chen, Zekun Guo, Yeqi Bai, Pan Deng, Yaosen Min, Ziheng Lu, Hongxia Hao, Han Yang, Jielan Li, Chang Liu, Jia Zhang, Jianwei Zhu, Ran Bi, Kehan Wu, Wei Zhang, Kaiyuan Gao, Qizhi Pei, Qian Wang, Xixian Liu, Yanting Li, Houtian Zhu, Yeqing Lu, Mingqian Ma, Zun Wang, Tian Xie, Krzysztof Maziarz, Marwin Segler, Zhao Yang, Zilong Chen, Yu Shi, Shuxin Zheng, Lijun Wu, Chen Hu, Peggy Dai, Tie-Yan Liu, Haiguang Liu, Tao Qin

机构 * Microsoft Research AI for Science(微软研究院人工智能与科学)

专题命中 领域大模型 :language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments 95 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07044 2025-06-16 cs.CL cs.AI cs.CV 84%

Lingshu: A Generalist Foundation Model for Unified Multimodal Medical Understanding and Reasoning

LASA Team, Weiwen Xu, Hou Pong Chan, Long Li, Mahani Aljunied, Ruifeng Yuan, Jianyu Wang, Chenghao Xiao, Guizhen Chen, Chaoqun Liu, Zhaodonghui Li, Yu Sun, Junao Shen, Chaojun Wang, Jie Tan, Deli Zhao, Tingyang Xu, Hao Zhang, Yu Rong

机构 * DAMO Academy, Alibaba Group(达摩院,阿里巴巴集团)

专题命中 领域大模型 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Technical Report, 53 pages, 25 tables, and 16 figures. Our webpage is https://alibaba-damo-academy.github.io/lingshu/

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.09173 2025-06-12 cs.LG cs.CL 84%

The Curious Language Model: Strategic Test-Time Information Acquisition

Michael Cooper, Rohan Wadhawan, John Michael Giorgi, Chenhao Tan, Davis Liang

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 39 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00975 2025-06-12 cs.CL cs.AI cs.SD eess.AS 84%

NTPP: Generative Speech Language Modeling for Dual-Channel Spoken Dialogue via Next-Token-Pair Prediction

Qichao Wang, Ziqiao Meng, Wenqian Cui, Yifei Zhang, Pengcheng Wu, Bingzhe Wu, Irwin King, Liang Chen, Peilin Zhao

机构 * Tencent(腾讯) National University of Singapore(新加坡国立大学) The Chinese University of Hong Kong(香港中文大学) Nanyang Technological University(南洋理工大学) Shenzhen University(深圳大学)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.08328 2025-06-06 cs.AI cs.LG stat.AP 84%

Unleashing The Power of Pre-Trained Language Models for Irregularly Sampled Time Series

Weijia Zhang, Chenlong Yin, Hao Liu, Hui Xiong

机构 * HKUST(GZ)(香港科技大学(广州))

专题命中 领域大模型 :language model(title,abstract);foundation model(abstract);分类 cs.AI、cs.LG

Comments Accepted by KDD'25

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.04293 2025-06-06 cs.LG cs.AI 84%

AUTOCT: Automating Interpretable Clinical Trial Prediction with LLM Agents

Fengze Liu, Haoyu Wang, Joonhyuk Cho, Dan Roth, Andrew W. Lo

机构 * University of Pennsylvania(宾夕法尼亚大学) Massachusetts Institute of Technology(麻省理工学院)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.01891 2025-06-03 cs.LG cs.CL 84%

MMSciBench: Benchmarking Language Models on Chinese Multimodal Scientific Problems

Xinwu Ye, Chengfan Li, Siming Chen, Wei Wei, Xiangru Tang

机构 * Department of Computer Science, Yale University(耶鲁大学计算机科学系) Department of Computer Science, Brown University(布朗大学计算机科学系) School of Data Science, Fudan University(复旦大学数据科学学院) Shanghai Key Laboratory of Data Science(上海数据科学关键实验室) Datawiz LLC

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments Accepted to the Findings of the Association for Computational Linguistics (ACL 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01617 2025-06-03 cs.CL cs.AI cs.CY cs.HC 84%

If Eleanor Rigby Had Met ChatGPT: A Study on Loneliness in a Post-LLM World

Adrian de Wynter

机构 * Microsoft(微软公司) University of York(约克大学)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to ACL 2025 (main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.16014 2025-05-30 cs.LG cs.AI 84%

OmniArch: Building Foundation Model For Scientific Computing

Tianyu Chen, Haoyi Zhou, Ying Li, Hao Wang, Chonghan Gao, Rongye Shi, Shanghang Zhang, Jianxin Li

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.AI、cs.LG

Comments ICML 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08704 2025-05-27 cs.AI cs.CL 84%

LLM-based Prompt Ensemble for Reliable Medical Entity Recognition from EHRs

K M Sajjadul Islam, Ayesha Siddika Nipu, Jiawei Wu, Praveen Madiraju

机构 * Marquette University(马歇尔大学) University of Wisconsin-Milwaukee(威斯康星大学密尔沃基分校) Medical College of Wisconsin(威斯康星医学学院)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments IEEE 26th International Conference on Information Reuse and Integration for Data Science (IRI 2025), San Jose, CA, USA

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05424 2025-04-15 cs.CL cs.AI 84%

SAMGPT: Text-free Graph Foundation Model for Multi-domain Pre-training and Cross-domain Adaptation

Xingtong Yu, Zechuan Gong, Chang Zhou, Yuan Fang, Hui Zhang

专题命中 领域大模型 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by WWW2025 Main Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16833 2025-04-01 cs.AI cs.LG 84%

KG4Diagnosis: A Hierarchical Multi-Agent LLM Framework with Knowledge Graph Enhancement for Medical Diagnosis

Kaiwen Zuo, Yirui Jiang, Fan Mo, Pietro Lio

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 10 pages,5 figures,published to AAAI-25 Bridge Program

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.17421 2025-03-25 cs.CY cs.AI cs.CL 84%

Understanding Social Support Needs in Questions: A Hybrid Approach Integrating Semi-Supervised Learning and LLM-based Data Augmentation

Junwei Kuang, Liang Yang, Shaoze Cui, Weiguo Fan

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 55 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11664 2025-03-18 cs.AI cs.CL cs.DB 84%

An LLM-Based Approach for Insight Generation in Data Analysis

Alberto Sánchez Pérez, Alaa Boukhary, Paolo Papotti, Luis Castejón Lozano, Adam Elwood

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication at NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.01530 2025-03-17 cs.CV cs.CL cs.LG 84%

The in-context inductive biases of vision-language models differ across modalities

Kelsey Allen, Ishita Dasgupta, Eliza Kosoy, Andrew K. Lampinen

专题命中 领域大模型 :language model(title,abstract);foundation model(abstract);分类 cs.CL、cs.LG

Comments 11 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07486 2025-03-14 q-fin.CP cs.AI cs.CE cs.LG q-fin.TR 84%

MarS: a Financial Market Simulation Engine Powered by Generative Foundation Model

Junjie Li, Yang Liu, Weiqing Liu, Shikai Fang, Lewen Wang, Chang Xu, Jiang Bian

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 35 pages, 26 figures, ICLR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.09358 2025-03-13 cs.CL cs.AI 84%

RetSTA: An LLM-Based Approach for Standardizing Clinical Fundus Image Reports

Jiushen Cai, Weihang Zhang, Hanruo Liu, Ningli Wang, Huiqi Li

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18274 2025-02-27 cs.AI cs.CL 84%

Citrus: Leveraging Expert Cognitive Pathways in a Medical Language Model for Advanced Medical Decision Support

Guoxin Wang, Minyu Gao, Shuai Yang, Ya Zhang, Lizhi He, Liang Huang, Hanlin Xiao, Yexuan Zhang, Wanyue Li, Lu Chen, Jintao Fei, Xin Li

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.10807 2025-02-19 cs.LG cs.AI q-bio.GN 84%

HybriDNA: A Hybrid Transformer-Mamba2 Long-Range DNA Language Model

Mingqian Ma, Guoqing Liu, Chuan Cao, Pan Deng, Tri Dao, Albert Gu, Peiran Jin, Zhao Yang, Yingce Xia, Renqian Luo, Pipi Hu, Zun Wang, Yuan-Jyue Chen, Haiguang Liu, Tao Qin

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.AI、cs.LG

Comments Project page: https://hybridna-project.github.io/HybriDNA-Project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.07546 2025-02-18 cs.CV cs.AI cs.CL 84%

Contrastive Language Prompting to Ease False Positives in Medical Anomaly Detection

YeongHyeon Park, Myung Jin Kim, Hyeong Seok Kim

专题命中 领域大模型 :prompting(title,abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 4 pages, 3 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09670 2025-02-17 cs.CL cs.AI 84%

The Science of Evaluating Foundation Models

Jiayi Yuan, Jiamu Zhang, Andrew Wen, Xia Hu

专题命中 领域大模型 :foundation model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.06882 2025-02-12 cs.CL cs.AI 84%

Multi-Agent Simulator Drives Language Models for Legal Intensive Interaction

Shengbin Yue, Ting Huang, Zheng Jia, Siyuan Wang, Shujun Liu, Yun Song, Xuanjing Huang, Zhongyu Wei

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NAACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03685 2025-02-07 cs.CL cs.LG stat.ML 84%

Controlled LLM Decoding via Discrete Auto-regressive Biasing

Patrick Pynadath, Ruqi Zhang

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.16533 2025-01-29 cs.CL cs.LG 84%

A comparison of data filtering techniques for English-Polish LLM-based machine translation in the biomedical domain

Jorge del Pozo Lérida, Kamil Kojs, János Máté, Mikołaj Antoni Barański, Christian Hardmeier

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.14418 2025-01-09 cs.CL cs.AI 84%

MEDSAGE: Enhancing Robustness of Medical Dialogue Summarization to ASR Errors with LLM-generated Synthetic Dialogues

Kuluhan Binici, Abhinav Ramesh Kashyap, Viktor Schlegel, Andy T. Liu, Vijay Prakash Dwivedi, Thanh-Tung Nguyen, Xiaoxue Gao, Nancy F. Chen, Stefan Winkler

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by the Thirty-Ninth AAAI Conference on Artificial Intelligence (AAAI-25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.17548 2024-12-24 cs.CL cs.AI 84%

Resource-Aware Arabic LLM Creation: Model Adaptation, Integration, and Multi-Domain Testing

Prakash Aryan

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15891 2024-12-23 cs.CL cs.AI 84%

TelcoLM: collecting data, adapting, and benchmarking language models for the telecommunication domain

Camille Barboule, Viet-Phi Huynh, Adrien Bufort, Yoan Chabot, Géraldine Damnati, Gwénolé Lecorvé

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments 30 pages (main: 13 pages, appendices: 17 pages), 1 figure, 22 tables, achieved March 2024, released December 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.00978 2024-12-10 cs.AI cs.LG 84%

Hybrid RAG-empowered Multi-modal LLM for Secure Data Management in Internet of Medical Things: A Diffusion-based Contract Approach

Cheng Su, Jinbo Wen, Jiawen Kang, Yonghua Wang, Yuanjia Su, Hudan Pan, Zishao Zhong, M. Shamim Hossain

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 13 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏