arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12581 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12581 篇

2401.17163 2024-02-02 cs.HC 85%

Learning Agent-based Modeling with LLM Companions: Experiences of Novices and Experts Using ChatGPT & NetLogo Chat

John Chen, Xi Lu, Michael Rejtig, David Du, Ruth Bagley, Michael S. Horn, Uri J. Wilensky

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Conditionally accepted (with minor revisions) by Proceedings of the CHI Conference on Human Factors in Computing Systems (CHI '24)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13245 2024-01-25 cs.HC 85%

GraphiMind: LLM-centric Interface for Information Graphics Design

Qirui Huang, Min Lu, Joel Lanir, Dani Lischinski, Daniel Cohen-Or, Hui Huang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04858 2024-01-11 cs.CL cs.AI cs.IR cs.LG 85%

User Embedding Model for Personalized Language Prompting

Sumanth Doddapaneni, Krishna Sayana, Ambarish Jash, Sukhdeep Sodhi, Dima Kuzmin

专题命中 领域大模型 :prompting(title,abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09469 2023-12-18 cs.CL cs.AI cs.LG 85%

Clinical Text Deduplication Practices for Efficient Pretraining and Improved Clinical Tasks

Isotta Landi, Eugenia Alleva, Alissa A. Valentine, Lauren A. Lepow, Alexander W. Charney

专题命中 领域大模型 :pretraining(title,abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.03778 2023-11-08 cs.IR 85%

Bridging the Information Gap Between Domain-Specific Model and General LLM for Personalized Recommendation

Wenxuan Zhang, Hongzhi Liu, Yingpeng Du, Chen Zhu, Yang Song, Hengshu Zhu, Zhonghai Wu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11202 2023-10-20 cs.HC cs.SE cs.SY eess.SY 85%

LLM-based Frameworks for Power Engineering from Routine to Novel Tasks

Ran Li, Chuanqing Pu, Junyi Tao, Canbing Li, Feilong Fan, Yue Xiang, Sijie Chen

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07321 2023-10-16 cs.CL cs.AI cs.LG 85%

On the Impact of Cross-Domain Data on German Language Models

Amin Dada, Aokun Chen, Cheng Peng, Kaleb E Smith, Ahmad Idrissi-Yaghir, Constantin Marc Seibold, Jianning Li, Lars Heiliger, Xi Yang, Christoph M. Friedrich, Daniel Truhn, Jan Egger, Jiang Bian, Jens Kleesiek, Yonghui Wu

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 13 pages, 1 figure, accepted at Findings of the Association for Computational Linguistics: EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.02207 2023-08-28 eess.AS cs.AI cs.CL cs.LG 85%

SpeechGen: Unlocking the Generative Power of Speech Language Models with Prompts

Haibin Wu, Kai-Wei Chang, Yuan-Kuei Wu, Hung-yi Lee

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Work in progress. The first three authors contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.10747 2023-07-21 cs.IR 85%

Enhancing Job Recommendation through LLM-based Generative Adversarial Networks

Yingpeng Du, Di Luo, Rui Yan, Hongzhi Liu, Yang Song, Hengshu Zhu, Jie Zhang

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 13 pages, 6 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.02443 2023-07-06 cs.SE cs.AI cs.CL cs.LG cs.NE 85%

An Exploratory Literature Study on Sharing and Energy Use of Language Models for Source Code

Max Hort, Anastasiia Grishina, Leon Moonen

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted for publication in the 17th ACM/IEEE International Symposium on Empirical Software Engineering and Measurement (ESEM 2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08871 2023-06-16 cs.SI cs.CY 85%

Med-MMHL: A Multi-Modal Dataset for Detecting Human- and LLM-Generated Misinformation in the Medical Domain

Yanshen Sun, Jianfeng He, Shuo Lei, Limeng Cui, Chang-Tien Lu

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.12692 2023-05-08 cs.CL cs.AI cs.LG q-bio.QM 85%

Language Models are Few-shot Learners for Prognostic Prediction

Zekai Chen, Mariann Micsinai Balan, Kevin Brown

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 7 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.17135 2022-12-01 cs.CL cs.AI cs.LG 85%

BudgetLongformer: Can we Cheaply Pretrain a SotA Legal Language Model From Scratch?

Joel Niklaus, Daniele Giofré

专题命中 领域大模型 :language model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ENLSP @ NeurIPS 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2210.15424 2022-11-09 cs.CL cs.AI cs.LG 85%

What Language Model to Train if You Have One Million GPU Hours?

Teven Le Scao, Thomas Wang, Daniel Hesslow, Lucile Saulnier, Stas Bekman, M Saiful Bari, Stella Biderman, Hady Elsahar, Niklas Muennighoff, Jason Phang, Ofir Press, Colin Raffel, Victor Sanh, Sheng Shen, Lintang Sutawika, Jaesung Tae, Zheng Xin Yong, Julien Launay, Iz Beltagy

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Findings of EMNLP 2022

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.26475 2026-04-21 cs.LG cs.AI eess.SP math.RT 84%

Foundation Model for Cardiac Time Series via Masked Latent Attention

通过掩码潜在注意力的心脏时间序列基础模型

Moritz Vandenhirtz, Samuel Ruipérez-Campillo, Simon Böhi, Sonia Laguna, Irene Cannistraci, Andrea Agostini, Ece Ozkan, Thomas M. Sutter, Julia E. Vogt

机构 * Department of Computer Science, ETH Zurich, Switzerland(苏黎世联邦理工学院计算机科学系,瑞士) Department of Biomedical Engineering, University of Basel, Switzerland(巴塞尔大学生物医学工程系,瑞士)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract);分类 cs.AI、cs.LG

AI总结 本文提出LAMAE基础模型,通过自监督预训练学习跨导联连接机制,提升ECG表示质量和迁移能力,在预测ICD-10编码上优于独立导联掩码模型和对齐基线。

Comments First two authors are co-first. Last two authors are co-senior

Journal ref ICLR 2026: Workshop on Foundation Models for Science

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.16795 2026-08-18 cs.CE cs.AI 新提交 84%

Historical Backtesting for Scientific Question Discovery: A Protocol and Astronomy Pilot

用于科学问题发现的历史回溯测试:协议与天文学试点

Hui Mao

专题命中 领域大模型 :LLM(summary_cn,abstract);prompting(abstract);分类 cs.AI

AI总结 该研究提出可证伪的历史回溯测试协议评估科学问题生成系统,发布天文学实例验证发现,优先证据结构生成优于仅LLM提示,还指出结果分类问题,发布前瞻性无干扰测试实例。

Comments 27 pages, 10 tables. Benchmark, code, frozen instances, and the prospective 2026 submission: https://github.com/nonameisready/scientific-question-discovery-benchmark

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12326 2026-08-14 cs.CL 新提交 84%

On Measuring Semantic Preservation in Legal Ontology Learning

论法律本体学习中的语义保留度量

Albert Sadowski, Jarosław A. Chudziak

机构 * Warsaw University of Technology(华沙理工大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);language model(abstract);分类 cs.CL

AI总结 本文针对法律本体学习的语义保留评估问题,提出通过对比LLM在源文档与转换后表示上的任务性能量化语义损失,经多模型多方法实验发现语义损失随模型-方法配对显著变化,为法律知识系统配置选择提供指导。

Comments Accepted for publication at the 30th International Conference on Knowledge-Based and Intelligent Information & Engineering Systems (KES 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09964 2026-08-12 cs.DL cs.AI 新提交 84%

Eleven Years of BRACIS: A Meta-Scientific Study of the Brazilian Conference on Intelligent Systems

BRACIS 十一年:巴西智能系统会议的元科学研究

Thales Sales Almeida, Giovana Kerche Bonás, Thiago Laitz, João Guilherme Alves Santos, Hugo Abonizio, Roseval Malaquias Junior, Marcos Piau, Celio Larcher, Ramon Pires, Rodrigo Nogueira

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究对2015-2025年BRACIS的1066篇录用论文进行元科学分析,揭示其研究领域变化、作者与机构分布、引用特征及开放实践情况,发现LLM研究占比提升、引用集中、预印本与高引用相关等结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09123 2026-08-11 cs.AI 新提交 84%

RISE-RL: Rubric-Informed Selective Exploration for Open-Ended Reinforcement Learning

RISE-RL:基于评分规则的开放式强化学习选择性探索

Jinkun Hou, Zhuo Liu, Huimin Ren, Hongsheng Xin, Pan Zhou, Kun Zhan

机构 * Li Auto Inc.(理想汽车)

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 该研究针对开放式任务中LLM的强化学习探索难题,提出RISE-RL方法,通过奖励过滤与策略支持塑造实现选择性内化,在多领域基准评测中显著优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.08251 2026-08-11 cs.CY cs.AI 版本更新 84%

Contemporary AI lacks the imagination to diverge or negate in science

当代人工智能缺乏在科学中发散或否定的想象力

Honglin Bao, Siyang Wu, Xiao Liu, Sida Li, Shiyun Cao, James A. Evans

机构 * Data Science Institute, University of Chicago(芝加哥大学数据科学研究所) Knowledge Lab, University of Chicago(芝加哥大学知识实验室)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 通过大规模科学家评估,发现当前AI在科学假设生成中缺乏多样性,无法自发提出零假设,且自动评估与专家判断一致性低,但微调奖励模型可缩小差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25420 2026-07-29 cs.IR cs.AI 新提交 84%

MARS: Multi-Agent Re-ranking for Repeat-Order Food Delivery Recommendation

MARS:用于重复订单食品配送推荐的多智能体重排

Jiahao Tian, Zhenkai Wang

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究针对重复订单食品配送推荐,提出MARS模块化多智能体重排框架,分两阶段推荐,结合多种信号与推理。通过实验评估,贡献包括给出集成框架、证明预训练主干结合轻量级检索有竞争力、建立可重现评估设置。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.16201 2026-07-21 cs.AI 新提交 84%

Generative Ontology Induction: Domain-Agnostic Schema Discovery from Document Corpora Using Large Language Models

生成式本体归纳:使用大语言模型从文档语料库中进行领域无关的模式发现

Sergei Sergienko

机构 * Pivots Global(Pivots全球公司)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

AI总结 研究针对本体工程瓶颈,提出领域无关的生成式本体归纳框架GOI,从文档语料库归纳生成蓝图并输出类型化图,引入节点覆盖分数评估,实验表明该方法能高比例覆盖结构主干,且覆盖率不受文档类型熟悉度影响。

Comments 10 pages, 2 figures, 1 table. LNCS format

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07706 2026-07-03 cs.AI 84%

FHIR-RAG-MEDS: Integrating HL7 FHIR with Retrieval-Augmented Large Language Models for Enhanced Medical Decision Support

FHIR-RAG-MEDS:整合HL7 FHIR与检索增强型大语言模型以提升医疗决策支持

Yildiray Kabak, Gokce B. Laleci Erturkmen, Mert Gencturk, Tuncay Namli, A. Anil Sinaci, Ruben Alcantud Corcoles, Cristina Gomez Ballesteros, Pedro Abizanda, Asuman Dogac

机构 * SRDC Software Research & Development and Consultancy Corporation(SRDC软件研究与开发及咨询公司) Geriatrics Department, Complejo Hospitalario Universitario de Albacete(阿尔巴塞特大学医院老年科) CIBER de Fragilidad y Envejecimiento Saludable (CIBERFES), Instituto de Salud Carlos III(健康与衰老促进CIBERFES,卡洛斯三世卫生研究所) Facultad de Medicina de Albacete, Universidad de Castilla-La Mancha(阿尔巴塞特大学医学学院,卡斯蒂利亚-拉曼查大学)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

AI总结 本文提出FHIR-RAG-MEDS系统,旨在整合HL7 FHIR与基于RAG的系统,提升基于循证临床指南的个性化医疗决策支持,强调实际应用中的研究需求。

Comments 23 pages, submitted to Journal AI specifically to the special issue "LLMs and AI Agents in Biomedical and Health Sciences", under review

Journal ref AI as part of the Special Issue LLMs and AI Agents in Biomedical and Health Sciences, 2 July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31825 2026-07-01 cs.CV cs.AI 新提交 84%

Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning

打破失败级联:面向医学多模态推理的步骤感知强化学习

Junha Jung, Minbyul Jeong, Suhyeon Lim, Sungwook Jung, Jaehoon Yun, Taeyun Roh, Mujeen Sung, Jaewoo Kang

机构 * Korea University(高丽大学) Upstage AI Kyung Hee University(庆熙大学) KAIST(韩国科学技术院) Hanyang University College of Medicine(汉阳大学医学院) AIGEN Sciences

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 提出步骤感知强化学习算法MRPO,通过为早期错误推理步骤分配指数级惩罚,打破失败级联,显著提升医学视觉问答准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28544 2026-06-30 cs.CY cs.CL 84%

Who Plays Which Role When? Communication Role Dynamics for Peer Recognition and Team Performance Prediction

谁在何时扮演何种角色?用于同伴认可和团队绩效预测的沟通角色动态

Yifan Song, Wenxuan Wendy Shi, Brian P Bailey, Tal August

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) California Polytechnic State University, Pomona(加州州立大学波莫纳分校)

专题命中 领域大模型 :LLM(summary_cn,abstract);prompting(abstract);分类 cs.CL

AI总结 基于教育理论定义八种沟通角色,通过LLM自动标注Slack消息,分析团队生命周期中的角色动态,并利用角色特征预测同伴认可和团队绩效,优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23336 2026-06-23 cs.CL 新提交 84%

WaveDetect: Robust Framework for Machine-Generated Text Detection via Wavelet Transform

WaveDetect: 基于小波变换的机器生成文本检测鲁棒框架

Zhichen Liu, Kaitong Qin, Linhan He, Yang Xu

机构 * Dept. of Computer Science and Engineering, Southern University of Science and Technology(南方科技大学计算机科学与工程系)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 提出WaveDetect框架,将文本检测转化为时频域信号处理任务,利用连续小波变换提取机器文本的谱指纹,在三个数据集上达到新最优,对对抗扰动、跨域偏移和模型演化具有鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13020 2026-06-23 cs.AI 新提交 84%

SciR: A Controllable Benchmark for Scientific Reasoning in LLMs

SciR: 面向LLM科学推理的可控基准

Pierre Beckmann, Marco Valentino, Andre Freitas

机构 * Idiap Research Institute(Idiap研究 institute) EPFL(瑞士联邦理工学院) School of Computer Science, University of Sheffield(谢菲尔德大学计算机科学学院) University of Manchester(曼彻斯特大学) National Biomarker Centre, CRUK Manchester Institute(国家生物标志物中心,CRUK曼彻斯特研究所)

专题命中 领域大模型 :LLM(title_cn,summary_cn);分类 cs.AI

AI总结 提出SciR基准,通过形式对象生成可验证的多范式科学推理任务,并控制信息提取和推理难度两个维度,揭示LLM在科学推理中的弱点。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20869 2026-06-18 cs.SE cs.AI cs.IR 84%

Engineering RAG Systems for Real-World Applications: Design, Development, and Evaluation

为现实应用工程化RAG系统:设计、开发与评估

Md Toufique Hasan, Muhammad Waseem, Kai-Kristian Kemell, Ayman Asad Khan, Mika Saari, Pekka Abrahamsson

机构 * Faculty of Information Technology and Communication Sciences, Tampere University(信息科技与通讯科学学院,塔尔皮耶大学)

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文介绍了五个领域特定的RAG应用,涵盖治理、网络安全、农业、工业研究和医疗诊断,通过多语言OCR、语义向量检索和领域适应LLM,评估六个维度并总结十二项关键经验教训。

Comments Published in the Proceedings of the 51st Euromicro Conference on Software Engineering and Advanced Applications, SEAA 2025. Lecture Notes in Computer Science, volume 16082, pages 143-158. Springer, 2026

Journal ref LNCS 16082, 143-158, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02288 2026-06-16 cs.CV cs.LG 版本更新 84%

Prompt Disentanglement via Language Guidance and Representation Alignment for Domain Generalization

基于语言引导与表示对齐的提示解缠用于域泛化

De Cheng, Zhipeng Xu, Xinyang Jiang, Dongsheng Li, Nannan Wang, Xinbo Gao

机构 * School of Telecommunications Engineering, the State Key Laboratory of Integrated Services Networks (ISN), Xidian University, Xi’an, China(电信工程学院、集成服务网络国家重点实验室(ISN)、西安电子科技大学) Microsoft Research Asia, Shanghai, China(微软亚洲研究院,上海,中国)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 提出利用大语言模型自动解缠文本提示,并引入最差显式表示对齐,结合抽象提示增强源域多样性,实现域不变视觉表示学习,在多个基准上超越现有方法。

Journal ref IEEE Transactions on Pattern Analysis and Machine Intelligence, vol. 48, no. 6, pp. 6799-6816, June 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12250 2026-06-11 cs.CL 新提交 84%

Reassessing High-Performing LLMs on Polish Medical Exams: True Competence or Bias-Driven Performance?

重新评估高性能大语言模型在波兰医学考试中的表现:真实能力还是偏差驱动?

Antoni Lasik, Jakub Pokrywka, Łukasz Grzybowski, Jeremi Ignacy Kaczmarek, Gabriela Korzańska, Janusz Świeczkowski-Feiz, Oskar Pastuszek, Paulina Hoffman, Jakub Tomasz Dąbrowski, Wojciech Kusa

机构 * NASK National Research Institute(NASK国家研究所) Adam Mickiewicz University(亚当·密茨凯维奇大学) ARAAI Poland(ARAAI波兰) Poznań University of Medical Sciences(波兹南医科大学) Centre of Postgraduate Medical Education, Poland(波兰研究生医学教育中心) T. Marciniak Lower Silesian Specialist Hospital(T. 马尔奇尼亚克下西里西亚专科医院) Medical University of Warsaw(华沙医科大学)

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 通过引入扩展和更具挑战性的波兰医学考试基准,减少MCQA伪影,发现标准MCQA分数高估了LLM的真实临床能力,最佳模型在更难的设置下分数下降28.4和31个百分点。

Comments 26 pages total with references and appendix, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏