arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12581 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12581 篇

2601.19588 2026-01-28 cs.LG cs.AI 84%

From Atoms to Chains: Divergence-Guided Reasoning Curriculum for Unlabeled LLM Domain Adaptation

从原子到链:基于分歧引导的推理课程用于无标签LLM领域适应

Yongqi Wang, Xiaofeng Ji, Jie Wang, Qingbin Li, Xiao Xiong, Zheming Yang, Jian Xu, Minghui Qiu, Xinxiao Wu

机构 * Beijing Key Laboratory of Intelligent Information Technology, School of Computer Science and Technology, Beijing Institute of Technology(北京智能信息科技重点实验室,计算机科学与技术学院,北京理工大学) ByteDance China(字节跳动中国)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出DGRC方法,通过分歧引导构建从原子知识到推理链的学习课程,提升无标签LLM在医疗和法律领域适应性能。

Comments Code: https://github.com/bytedance/DGRC

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02599 2026-01-27 cs.CL cs.AI 84%

Next Token Knowledge Tracing: Exploiting Pretrained LLM Representations to Decode Student Behaviour

下一个标记知识追踪:利用预训练大语言模型表示来解码学生行为

Max Norris, Kobi Gal, Sahan Bulathwela

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出NTKT方法,利用预训练大语言模型预测学生行为,提升知识追踪任务的性能和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22232 2025-12-01 cs.CV cs.AI cs.CL 84%

From Compound Figures to Composite Understanding: Developing a Multi-Modal LLM from Biomedical Literature with Medical Multiple-Image Benchmarking and Validation

从复合图形到综合理解:开发一种从生物医学文献中基于医疗多图像基准测试和验证的多模态大语言模型

Zhen Chen, Yihang Fu, Gabriel Madera, Mauro Giuffre, Serina Applebaum, Hyunjae Kim, Hua Xu, Qingyu Chen

机构 * Department of Biomedical Informatics and Data Science, Yale School of Medicine, Yale University, New Haven, CT 06510, USA(耶鲁医学院生物医学信息学与数据科学系,耶鲁大学,新 Haven,CT 06510,USA) School of Medicine, University of Puerto Rico, San Juan, PR 00921, USA(波多黎各大学医学院,波多黎各,San Juan,PR 00921,USA)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出M3LLM,一种基于生物医学文献中复合图像的多模态大语言模型,通过分而治之策略提升多图像理解能力,实验证明其在多图像、单图像等场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05171 2025-11-20 cs.LG cs.AI cs.SD 84%

Model Merging Improves Zero-Shot Generalization in Bioacoustic Foundation Models

Davide Marincione, Donato Crisostomi, Roberto Dessi, Emanuele Rodolà, Emanuele Rossi

机构 * Department of Computer Science, Sapienza University of Rome(计算机科学系,罗马大学)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14936 2025-11-20 cs.LG cs.CL 84%

How to Train Private Clinical Language Models: A Comparative Study of Privacy-Preserving Pipelines for ICD-9 Coding

Mathieu Dufour, Andrew Duncan

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 10 pages, 5 figures. Accepted to the Privacy-Preserving Machine Learning Workshop at EurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12851 2025-11-18 cs.CL cs.AI 84%

NeuroLex: A Lightweight Domain Language Model for EEG Report Understanding and Generation

Kang Yin, Hye-Bin Shin

机构 * Dept. of Artificial Intelligence Korea University Seoul, Republic of Korea(人工智能系韩国大学首尔共和国韩国)

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01110 2025-11-18 econ.GN cs.AI cs.LG q-fin.EC q-fin.GN 84%

NoLBERT: A No Lookahead(back) Foundational Language Model

Ali Kakhbod, Peiyao Li

机构 * Haas School of Business University of California, Berkeley(哈斯商学院 加州大学伯克利分校)

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

Journal ref NeurIPS 2025 (GenAI in Finance)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16000 2025-11-18 cs.CL cs.AI 84%

Leveraging Online Data to Enhance Medical Knowledge in a Small Persian Language Model

Mehrdad Ghassabi, Pedram Rostami, Hamidreza Baradaran Kashani, Amirhossein Poursina, Zahra Kazemi, Milad Tavakoli

机构 * Faculty of Computer Engineering University of Isfahan(计算机工程系 岛岛大学) School of Medicine Isfahan University of Medical Sciences(医学院 岛岛医学科学大学)

专题命中 领域大模型 :language model(title,abstract);small language model(abstract);分类 cs.CL、cs.AI

Comments 8 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10583 2025-11-14 cs.CL cs.AI 84%

Evaluating Prompting Strategies with MedGemma for Medical Order Extraction

Abhinand Balachandran, Bavana Durgapraveen, Gowsikkan Sikkan Sudhagar, Vidhya Varshany J S, Sriram Rajkumar

机构 * EXL Health AI Lab at MEDIQA-OE 2025(EXL健康AI实验室)

专题命中 领域大模型 :prompting(title,abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 2 figures 7 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.04498 2025-11-13 cs.CL cs.AI 84%

Where Should I Study? Biased Language Models Decide! Evaluating Fairness in LMs for Academic Recommendations

Krithi Shailya, Akhilesh Kumar Mishra, Gokul S Krishnan, Balaraman Ravindran

机构 * Centre for Responsible AI (CeRAI), Wadhwani School of Data Science and AI (WSAI)(负责任人工智能中心(CeRAI)、Wadhwani数据科学与人工智能学校(WSAI)) Indian Institute of Technology Madras(印度理工学院马德拉斯学院)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Accepted at IJCNLP-AACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02374 2025-11-05 cs.CL cs.AI 84%

AyurParam: A State-of-the-Art Bilingual Language Model for Ayurveda

Mohd Nauman, Sravan Gvm, Vijay Devane, Shyam Pawar, Viraj Thakur, Kundeshwar Pundalik, Piyush Sawarkar, Rohit Saluja, Maunendra Desarkar, Ganesh Ramakrishnan

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.05777 2025-11-04 cs.CL cs.AI cs.CY 84%

Medical Hallucinations in Foundation Models and Their Impact on Healthcare

Yubin Kim, Hyewon Jeong, Shan Chen, Shuyue Stella Li, Chanwoo Park, Mingyu Lu, Kumail Alhamoud, Jimin Mun, Cristina Grau, Minseok Jung, Rodrigo Gameiro, Lizhou Fan, Eugene Park, Tristan Lin, Joonsik Yoon, Wonjin Yoon, Maarten Sap, Yulia Tsvetkov, Paul Liang, Xuhai Xu, Xin Liu, Chunjong Park, Hyeonhoon Lee, Hae Won Park, Daniel McDuff, Samir Tulebaev, Cynthia Breazeal

机构 * Massachusetts Institute of Technology(麻省理工学院) Harvard Medical School(哈佛医学院) University of Washington(华盛顿大学) Carnegie Mellon University(卡内基梅隆大学) Seoul National University Hospital(首尔国立大学医院) Google Research(谷歌研究) Google DeepMind(谷歌DeepMind) Columbia University(哥伦比亚大学) Johns Hopkins University(约翰霍普金斯大学)

专题命中 领域大模型 :foundation model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25460 2025-10-30 cs.CL cs.AI 84%

Fine-Tuned Language Models for Domain-Specific Summarization and Tagging

Jun Wang, Fuming Lin, Yuyu Chen

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24010 2025-10-29 cs.CV cs.AI cs.LG 84%

Mars-Bench: A Benchmark for Evaluating Foundation Models for Mars Science Tasks

Mirali Purohit, Bimal Gajera, Vatsal Malaviya, Irish Mehta, Kunal Kasodekar, Jacob Adler, Steven Lu, Umaa Rebbapragada, Hannah Kerner

机构 * School of Computing and Augmented Intelligence, Arizona State University(计算与增强智能学院,亚利桑那州立大学) School of Earth and Space Exploration, Arizona State University(地球与空间探索学院,亚利桑那州立大学) Jet Propulsion Laboratory, California Institute of Technology(喷气推进实验室,加州理工学院)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05177 2025-10-28 cs.CL cs.AI cs.SD eess.AS 84%

OpenS2S: Advancing Fully Open-Source End-to-End Empathetic Large Speech Language Model

Chen Wang, Tianyu Peng, Wen Yang, Yinan Bai, Guangfu Wang, Jun Lin, Lanpeng Jia, Lingxiang Wu, Jinqiao Wang, Chengqing Zong, Jiajun Zhang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Wuhan AI Research(武汉人工智能研究) GWM AI Lab(GWM人工智能实验室)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Technical Report, Update on OpenS2S_v1.5

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.06260 2025-10-09 cs.CV cs.AI cs.LG 84%

Ensemble Deep Learning and LLM-Assisted Reporting for Automated Skin Lesion Diagnosis

Sher Khan, Raz Muhammad, Adil Hussain, Muhammad Sajjad, Muhammad Rashid

机构 * Institute of Computer Science The University of Agriculture Peshawar, Pakistan(计算机科学研究所 伊斯兰农业大学 薩瓦爾,巴基斯坦) Department of Computer Science Islamia College Peshawar Pakistan(计算机科学系 伊斯兰学院 薩瓦爾,巴基斯坦) Department of Software Engineering Islamia College Peshawar Pakistan(软件工程系 伊斯兰学院 薩瓦爾,巴基斯坦)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.02359 2025-10-06 cs.CL cs.AI 84%

Emission-GPT: A domain-specific language model agent for knowledge retrieval, emission inventory and data analysis

Jiashu Ye, Tong Wu, Weiwen Chen, Hao Zhang, Zeteng Lin, Xingxing Li, Shujuan Weng, Manni Zhu, Xin Yuan, Xinlong Hong, Jingjie Li, Junyu Zheng, Zhijiong Huang, Jing Tang

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25591 2025-10-01 cs.AI cs.CL q-bio.OT 84%

Building the EHR Foundation Model via Next Event Prediction

Zekai Chen, Arda Pekis, Kevin Brown

机构 * Standard Model Biomedicine(标准模型生物医学)

专题命中 领域大模型 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19825 2025-09-30 cs.AI cs.CL 84%

Evaluating Compliance with Visualization Guidelines in Diagrams for Scientific Publications Using Large Vision Language Models

Johannes Rückert, Louise Bloch, Christoph M. Friedrich

机构 * Department of Computer Science, University of Applied Sciences and Arts Dortmund(应用科学与艺术大学多特蒙德计算机科学系) Institute for Medical Informatics, Biometry and Epidemiology (IMIBE)(医学信息学、生物统计与流行病学研究所) Institute for Artificial Intelligence in Medicine (IKIM), University Hospital Essen(医学人工智能研究所,埃森大学医院)

专题命中 领域大模型 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Accepted at ICDAR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07835 2025-09-30 cs.CL cs.AI 84%

SciRIFF: A Resource to Enhance Language Model Instruction-Following over Scientific Literature

David Wadden, Kejian Shi, Jacob Morrison, Alan Li, Aakanksha Naik, Shruti Singh, Nitzan Barzilay, Kyle Lo, Tom Hope, Luca Soldaini, Shannon Zejiang Shen, Doug Downey, Hannaneh Hajishirzi, Arman Cohan

机构 * Allen Institute for AI(艾伦人工智能研究所) Yale University(耶鲁大学) University of Washington(华盛顿大学) Hebrew University(希伯来大学) MIT(麻省理工学院) Northwestern University(西北大学)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Presented at EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01824 2025-08-28 cs.CV cs.AI cs.LG cs.MM 84%

X-Prompt: Towards Universal In-Context Image Generation in Auto-Regressive Vision Language Foundation Models

Zeyi Sun, Ziyang Chu, Pan Zhang, Tong Wu, Xiaoyi Dong, Yuhang Zang, Yuanjun Xiong, Dahua Lin, Jiaqi Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) Tsinghua University(清华大学) The Chinese University of Hong Kong(香港中文大学) CPII under InnoHK(创新香港科技促进会) MThreads AI

专题命中 领域大模型 :foundation model(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments code: https://github.com/SunzeY/X-Prompt

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15763 2025-08-26 cs.LG cs.CL cs.CV 84%

Intern-S1: A Scientific Multimodal Foundation Model

Lei Bai, Zhongrui Cai, Yuhang Cao, Maosong Cao, Weihan Cao, Chiyu Chen, Haojiong Chen, Kai Chen, Pengcheng Chen, Ying Chen, Yongkang Chen, Yu Cheng, Pei Chu, Tao Chu, Erfei Cui, Ganqu Cui, Long Cui, Ziyun Cui, Nianchen Deng, Ning Ding, Nanqing Dong, Peijie Dong, Shihan Dou, Sinan Du, Haodong Duan, Caihua Fan, Ben Gao, Changjiang Gao, Jianfei Gao, Songyang Gao, Yang Gao, Zhangwei Gao, Jiaye Ge, Qiming Ge, Lixin Gu, Yuzhe Gu, Aijia Guo, Qipeng Guo, Xu Guo, Conghui He, Junjun He, Yili Hong, Siyuan Hou, Caiyu Hu, Hanglei Hu, Jucheng Hu, Ming Hu, Zhouqi Hua, Haian Huang, Junhao Huang, Xu Huang, Zixian Huang, Zhe Jiang, Lingkai Kong, Linyang Li, Peiji Li, Pengze Li, Shuaibin Li, Tianbin Li, Wei Li, Yuqiang Li, Dahua Lin, Junyao Lin, Tianyi Lin, Zhishan Lin, Hongwei Liu, Jiangning Liu, Jiyao Liu, Junnan Liu, Kai Liu, Kaiwen Liu, Kuikun Liu, Shichun Liu, Shudong Liu, Wei Liu, Xinyao Liu, Yuhong Liu, Zhan Liu, Yinquan Lu, Haijun Lv, Hongxia Lv, Huijie Lv, Qitan Lv, Ying Lv, Chengqi Lyu, Chenglong Ma, Jianpeng Ma, Ren Ma, Runmin Ma, Runyuan Ma, Xinzhu Ma, Yichuan Ma, Zihan Ma, Sixuan Mi, Junzhi Ning, Wenchang Ning, Xinle Pang, Jiahui Peng, Runyu Peng, Yu Qiao, Jiantao Qiu, Xiaoye Qu, Yuan Qu, Yuchen Ren, Fukai Shang, Wenqi Shao, Junhao Shen, Shuaike Shen, Chunfeng Song, Demin Song, Diping Song, Chenlin Su, Weijie Su, Weigao Sun, Yu Sun, Qian Tan, Cheng Tang, Huanze Tang, Kexian Tang, Shixiang Tang, Jian Tong, Aoran Wang, Bin Wang, Dong Wang, Lintao Wang, Rui Wang, Weiyun Wang, Wenhai Wang, Jiaqi Wang, Yi Wang, Ziyi Wang, Ling-I Wu, Wen Wu, Yue Wu, Zijian Wu, Linchen Xiao, Shuhao Xing, Chao Xu, Huihui Xu, Jun Xu, Ruiliang Xu, Wanghan Xu, GanLin Yang, Yuming Yang, Haochen Ye, Jin Ye, Shenglong Ye, Jia Yu, Jiashuo Yu, Jing Yu, Fei Yuan, Yuhang Zang, Bo Zhang, Chao Zhang, Chen Zhang, Hongjie Zhang, Jin Zhang, Qiaosheng Zhang, Qiuyinzhe Zhang, Songyang Zhang, Taolin Zhang, Wenlong Zhang, Wenwei Zhang, Yechen Zhang, Ziyang Zhang, Haiteng Zhao, Qian Zhao, Xiangyu Zhao, Xiangyu Zhao, Bowen Zhou, Dongzhan Zhou, Peiheng Zhou, Yuhao Zhou, Yunhua Zhou, Dongsheng Zhu, Lin Zhu, Yicheng Zou

机构 * Intern-S1 Team(Intern-S1团队)

专题命中 领域大模型 :foundation model(title,abstract);post-training(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.11671 2025-08-19 cs.IR cs.AI cs.LG cs.MA 84%

LLM-Based Intelligent Agents for Music Recommendation: A Comparison with Classical Content-Based Filtering

Ronald Carvalho Boadana, Ademir Guimarães da Costa Junior, Ricardo Rios, Fábio Santos da Silva

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 12 pages, in Portuguese language, 2 figures, 5 tables, 3 formulas. To be published in the Proceedings of the Encontro Nacional de Inteligência Artificial e Computacional (ENIAC 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10450 2025-08-18 cs.IR cs.AI cs.CL 84%

TokenRec: Learning to Tokenize ID for LLM-based Generative Recommendation

Haohao Qu, Wenqi Fan, Zihuai Zhao, Qing Li

机构 * Department of Computing, The Hong Kong Polytechnic University(计算机系,香港理工大学)

专题命中 领域大模型 :LLM(title,abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by IEEE TKDE. Codes and data are available at https://github.com/Quhaoh233/TokenRec

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08591 2025-08-13 cs.CL cs.AI 84%

DepressLLM: Interpretable domain-adapted language model for depression detection from real-world narratives

Sehwan Moon, Aram Lee, Jeong Eun Kim, Hee-Ju Kang, Il-Seon Shin, Sung-Wan Kim, Jae-Min Kim, Min Jhon, Ju-Wan Kim

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08095 2025-08-12 cs.CL cs.AI cs.SD eess.AS 84%

Dual Information Speech Language Models for Emotional Conversations

Chun Wang, Chenyang Liu, Wenze Xu, Weihong Deng

机构 * Mashang Consumer Finance Co., Ltd.(玛莎消费金融有限公司) The University of Sydney(悉尼大学)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

Comments Presented at IEEE ICME 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00614 2025-08-04 cs.CL cs.AI 84%

Prompting Science Report 3: I'll pay you or I'll kill you -- but will you care?

Lennart Meincke, Ethan Mollick, Lilach Mollick, Dan Shapiro

专题命中 领域大模型 :prompting(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.22116 2025-07-23 cs.CL cs.AI 84%

Multimodal Forecasting of Sparse Intraoperative Hypotension Events Powered by Language Model

Jintao Zhang, Zirui Liu, Mingyue Cheng, Shilong Zhang, Tingyue Pan, Yitong zhou, Qi Liu, Yanhu Xie

机构 * University of Science and Technology of China(中国科学技术大学) The First Affiliated Hospital of University of Science and Technology of China(中国科学技术大学第一附属医院)

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.14590 2025-07-22 cs.CL cs.AI 84%

Backtranslation and paraphrasing in the LLM era? Comparing data augmentation methods for emotion classification

Łukasz Radliński, Mateusz Guściora, Jan Kocoń

机构 * Department of Artificial Intelligence, Wrocław University of Science and Technology(人工智能系,波兹南理工大学)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments International Conference on Computational Science 2025

Journal ref Computational Science - ICCS 2025, Lecture Notes in Computer Science, vol. 14730, Springer, 2025, pp. 3-17

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.19217 2025-07-09 cs.SE cs.AI cs.LG 84%

LLM Benchmarking with LLaMA2: Evaluating Code Development Performance Across Multiple Programming Languages

Patrick Diehl, Nojoud Nader, Maxim Moraru, Steven R. Brandt

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏