arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12482 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12482 篇

2604.23837 2026-04-28 cs.CL cs.LG 92%

One Size Fits None: Heuristic Collapse in LLM Investment Advice

一个尺寸无法适配:在LLM投资建议中的启发式崩溃

Jillian Ross, Andrew W. Lo

机构 * Computer Science and Artificial Intelligence Laboratory(计算机科学与人工智能实验室) Massachusetts Institute of Technology(麻省理工学院) Sloan School of Management(斯隆管理学院)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 研究发现前沿LLM在投资建议中存在启发式崩溃,决策主要依赖自我报告的风险承受能力而非全面考虑,网络搜索部分缓解但未解决此问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00933 2026-04-28 cs.LG cs.AI 92%

OKG-LLM: Aligning Ocean Knowledge Graph with Observation Data via LLMs for Global Sea Surface Temperature Prediction

OKG-LLM:通过LLMs对齐海洋知识图谱与观测数据以实现全球海表温度预测

Hanchen Yang, Jiaqi Wang, Jiannong Cao, Wengen Li, Jialun Zheng, Yangning Li, Chunyu Miao, Jihong Guan, Shuigeng Zhou, Philip S. Yu

机构 * Department of Computer Science and Technology, Tongji University(同济大学计算机科学与技术系) Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算系) Department of Computing, University of Illinois Chicago(伊利诺伊大学芝加哥分校计算系) School of Computer Science, Fudan University(复旦大学计算机科学学院)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出OKG-LLM框架,通过构建海洋知识图谱并融合数值数据,利用预训练LLM提升全球海表温度预测的准确性与鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19774 2026-04-23 cs.CL cs.AI 92%

Phase 1 Implementation of LLM-generated Discharge Summaries showing high Adoption in a Dutch Academic Hospital

LLM生成的出院小结在荷兰学术医院中的阶段1实施显示高采用率

Nettuno Nadalini, Tarannom Mehri, Anne H Hoekman, Katerina Kagialari, Job N Doornberg, Tom P van der Laan, Jacobien H F Oosterhoff, Rosanne C Schoonbeek, Charlotte M H H T Bootsma-Robroeks

机构 * Department of Health Information Office, Data & Digitalization, University Medical Center(健康信息办公室、数据与数字化化大学医院) Department of Trauma Surgery / Orthopedics, University Medical Center(创伤外科/骨科大学医院) Department of Orthopaedic Surgery, Massachusetts General Hospital(骨科手术科马萨诸塞总医院) Harvard Medical School Orthopaedic Trauma Initiative(哈佛医学院骨创伤倡议) Department of Orthopaedic Surgery and Sports Medicine, Amsterdam UMC location University of Amsterdam(骨科手术与运动医学部门,阿姆斯特丹UMC地点大学) Department of Orthopaedic Trauma, Flinders University Medical Centre(骨创伤部门,弗林德斯大学医疗中心) Department of Otolaryngology – Head and Neck Surgery, University Medical Center(耳鼻喉科-头颈外科大学医院) Department of Pediatrics, Pediatrics Nephrology, Beatrix Children’s Hospital, University Medical Center(儿科、儿科肾病学,比西特儿童医院,大学医院)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究评估了集成到电子健康记录中的LLM生成出院小结草案的效果,结果显示高采用率和文档时间减少,支持进一步实施。

Comments The methods section is located after the discussion in this manuscript

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.09958 2026-04-23 cs.CL cs.LG 92%

Neural Bandit Based Optimal LLM Selection for a Pipeline of Subtasks

基于神经带宽的最优LLM选择用于子任务流水线

Baran Atalar, Eddie Zhang, Carlee Joe-Wong

机构 * Carnegie Mellon University(卡内基梅隆大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出一种神经上下文带宽算法,用于在无需历史LLM性能数据的情况下,指导不同子任务的LLM选择,通过子任务输出影响后续任务,实现子任务间复杂依赖关系的学习。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.14961 2026-04-17 cs.LG cs.AI 92%

Calibration-Gated LLM Pseudo-Observations for Online Contextual Bandits

校准门控LLM伪观测用于在线上下文老虎机

Maksim Pershin, Ivan Golovanov, Pavel Baltabaev, Natalia Trankova

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出在Disjoint LinUCB中引入LLM伪观测,通过校准门控衰减计划控制LLM预测准确性,减少冷启动阶段的累积遗憾。实验表明,特定任务提示可使MIND环境的遗憾减少19%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.03585 2026-01-19 cs.CV cs.AI cs.CL 92%

Causal-SAM-LLM: Large Language Models as Causal Reasoners for Robust Medical Segmentation

Causal-SAM-LLM:大型语言模型作为因果推理器用于稳健的医学分割

Tao Tang, Shijie Xu, Jionglong Su, Zhixiang Lu

机构 * City University of Hong Kong, Hong Kong, China(香港城市大学) Xi’an Jiaotong-liverpool University, Suzhou, China(西安交通大学利物浦大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 Causal-SAM-LLM利用大型语言模型作为因果推理器,提升医学图像分割的鲁棒性和泛化能力。

Comments Accepted by IEEE ICASSP 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.11142 2025-10-13 cs.CL cs.AI 92%

AD-LLM: Benchmarking Large Language Models for Anomaly Detection

Tiankai Yang, Yi Nian, Shawn Li, Ruiyao Xu, Yuangang Li, Jiaqi Li, Zhuo Xiao, Xiyang Hu, Ryan Rossi, Kaize Ding, Xia Hu, Yue Zhao

机构 * University of Southern California(南加州大学) Northwestern University(西北大学) Arizona State University(亚利桑那州立大学) Adobe Research(Adobe研究) Rice University(里士满大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments Accepted to Findings of the Association for Computational Linguistics (ACL 2025), Vienna, Austria

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19930 2025-08-28 cs.CL cs.CV cs.LG 92%

On Domain-Adaptive Post-Training for Multimodal Large Language Models

Daixuan Cheng, Shaohan Huang, Ziyu Zhu, Xintong Zhang, Wayne Xin Zhao, Zhongzhi Luan, Bo Dai, Zhenliang Zhang

机构 * BIGAI BUAA(北京航空航天大学) THU(清华大学) BIT(北京理工大学) RUC(中国人民大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);post-training(title,abstract);分类 cs.CL、cs.LG

Comments EMNLP 2025 Findings, Project Page: https://huggingface.co/AdaptLLM/Adapt-MLLM-to-Domains

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08588 2025-05-14 cs.CL cs.AI cs.CY cs.HC 92%

Small but Significant: On the Promise of Small Language Models for Accessible AIED

Yumou Wei, Paulo Carvalho, John Stamper

机构 * Human-Computer Interaction Institute, Carnegie Mellon University, USA(人机交互研究所,卡内基梅隆大学,美国)

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

Comments This vision paper advocates using small language models (e.g., Phi-2) in AI for education (AIED)

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.05464 2025-01-22 cs.CL cs.AI cs.IR 92%

LLM-MedQA: Enhancing Medical Question Answering through Case Studies in Large Language Models

Hang Yang, Hao Chen, Hui Guo, Yineng Chen, Ching-Sheng Lin, Shu Hu, Jinrong Hu, Xi Wu, Xin Wang

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06864 2024-12-11 cs.CL cs.AI 92%

Political-LLM: Large Language Models in Political Science

Lincan Li, Jiaqi Li, Catherine Chen, Fred Gui, Hongjia Yang, Chenxiao Yu, Zhengguang Wang, Jianing Cai, Junlong Aaron Zhou, Bolin Shen, Alex Qian, Weixin Chen, Zhongkai Xue, Lichao Sun, Lifang He, Hanjie Chen, Kaize Ding, Zijian Du, Fangzhou Mu, Jiaxin Pei, Jieyu Zhao, Swabha Swayamdipta, Willie Neiswanger, Hua Wei, Xiyang Hu, Shixiang Zhu, Tianlong Chen, Yingzhou Lu, Yang Shi, Lianhui Qin, Tianfan Fu, Zhengzhong Tu, Yuzhe Yang, Jaemin Yoo, Jiaheng Zhang, Ryan Rossi, Liang Zhan, Liang Zhao, Emilio Ferrara, Yan Liu, Furong Huang, Xiangliang Zhang, Lawrence Rothenberg, Shuiwang Ji, Philip S. Yu, Yue Zhao, Yushun Dong

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

Comments 54 Pages, 9 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10077 2024-09-17 cs.CL cs.AI 92%

LLM-DER:A Named Entity Recognition Method Based on Large Language Models for Chinese Coal Chemical Domain

Le Xiao, Yunfei Xu, Jing Zhao

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.18540 2024-07-29 cs.CL cs.AI 92%

A Universal Prompting Strategy for Extracting Process Model Information from Natural Language Text using Large Language Models

Julian Neuberger, Lars Ackermann, Han van der Aa, Stefan Jablonski

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18460 2024-07-02 cs.CL cs.AI cs.HC 92%

Role-Play Zero-Shot Prompting with Large Language Models for Open-Domain Human-Machine Conversation

Ahmed Njifenjou, Virgile Sucal, Bassam Jabaian, Fabrice Lefèvre

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

Comments Updated version of a paper originally submitted at SIGDIAL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2212.08635 2024-03-29 cs.CL cs.AI 92%

Self-Prompting Large Language Models for Zero-Shot Open-Domain QA

Junlong Li, Jinyuan Wang, Zhuosheng Zhang, Hai Zhao

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

Comments NAACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10049 2023-10-17 cs.LG cs.AI 92%

FATE-LLM: A Industrial Grade Federated Learning Framework for Large Language Models

Tao Fan, Yan Kang, Guoqiang Ma, Weijing Chen, Wenbin Wei, Lixin Fan, Qiang Yang

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08008 2023-09-18 cs.CL cs.AI 92%

An Empirical Evaluation of Prompting Strategies for Large Language Models in Zero-Shot Clinical Natural Language Processing

Sonish Sivarajkumar, Mark Kelley, Alyssa Samolyk-Mazzanti, Shyam Visweswaran, Yanshan Wang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11648 2023-06-21 astro-ph.IM astro-ph.GA cs.AI cs.CL 92%

Harnessing the Power of Adversarial Prompting and Large Language Models for Robust Hypothesis Generation in Astronomy

Ioana Ciucă, Yuan-Sen Ting, Sandor Kruk, Kartheik Iyer

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(title,abstract);分类 cs.CL、cs.AI

Comments 8 pages, 3 figures, accepted to ICML ML4Astro Workshop. Comments and suggestions are welcome

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17403 2026-08-11 cs.LG cs.AI cs.CL 92%

Large Language Models are Powerful Electronic Health Record Encoders

大型语言模型是强大的电子健康记录编码器

Stefan Hegselmann, Georg von Arnim, Tillmann Rheude, Noel Kronenberg, David Sontag, Gerhard Hindricks, Roland Eils, Benjamin Wild

机构 * Berlin Institute of Health at Charité – Universitätsmedizin Berlin(柏林夏里特医学院健康研究所) BIH Biomedical Innovation Academy, BIH Charité Digital Clinician Scientist Program(BIH生物医学创新学院,BIH夏里特数字临床科学家计划) Deutsches Herzzentrum der Charité – Medical Heart Center of Charité and German Heart Institute Berlin(夏里特德国心脏中心 – 夏里特医学院和德国心脏研究所柏林) Layer Health, Inc.(Layer Health公司)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);foundation model(abstract)

AI总结 本文提出利用大型语言模型对电子健康记录进行编码,通过将医疗代码转换为自然语言描述,提升模型在临床预测任务中的表现,同时展示其在不同任务中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05808 2026-08-07 cs.CV 新提交 92%

STAIL: Semantic Text-Anchored Incremental Learning for Medical Imaging via Large Language Models

STAIL:基于大语言模型的医学影像语义文本锚定增量学习

Songpan Gao, Yajie Zhang, Guanxing Chen, Jiayu Qian, Zhenzhen Liu, Shijun Li, Xiaowei Zhu, Yao Hu, Kay Chen Tan, Yu-An Huang, Shiqi Wang, Zhi-An Huang

机构 * City University of Hong Kong (Dongguan)(香港城市大学(东莞)) The Hong Kong Polytechnic University(香港理工大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 针对医学影像分析深度学习模型的灾难性遗忘问题,提出STAIL框架,通过SCB和LSAM方法,在三个异构医学数据集上提升基线性能,即插即用且效果显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00669 2026-08-04 cs.IR 新提交 92%

GARDRec: Decision-Level Graph Grounding for Large Language Model Recommendation

GARDRec:面向大语言模型推荐的决策级图接地方法

Yong Wang, Hongliang Sun, Jinlan Liu, Hua Zhang, Dianbo Sui, Dianhui Chu, Zhiying Tu

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 本文针对现有图增强型LLM推荐器排序决策受用户-物品关系约束弱的问题,提出GARDRec框架,通过图接地技术提升下一项推荐的候选排序性能,经实验验证其优于代表性基线。

Comments 18 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11356 2026-06-11 physics.ao-ph cs.DC cs.SE physics.comp-ph 新提交 92%

An Ocean Model Ported by a Large Language Model: Experience and Lessons from FESOM2 (Fortran to C to C++/Kokkos)

大型语言模型移植海洋模型:FESOM2(Fortran到C再到C++/Kokkos)的经验与教训

Nikolay V. Koldunov, Suvarchal K. Cheedela, Sergey Danilov, Dmitry Sidorenko, Sebastian Beyer, Thomas Jung

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 本文展示利用LLM将FESOM2海洋模型从Fortran移植到C再到C++/Kokkos,通过两阶段翻译、严格字面转换和逐级验证,在数周内保持物理准确性并实现GPU加速。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10177 2026-06-10 cs.HC 新提交 92%

VArify: A Visual Analytics System for Verifying Knowledge Enhanced Large Language Model Responses in Food Science

VArify:一个用于验证食品科学中知识增强型大语言模型响应的可视化分析系统

Sam Yu-Te Lee, Yan To Linus Lam, Manami Nakagawa, Kwan-Liu Ma

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 针对GraphRAG系统检索数据复杂、难以验证的问题,提出VArify可视化分析系统,通过文件目录式树状可视化支持证据的组间关系与组内层次探索,用户研究证明其有效区分LLM内部知识与外部证据,并帮助识别知识图谱错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20519 2026-06-10 cs.CY cs.HC 版本更新 92%

Large Language Model Chatbot Conversations vs Public Health Materials and Parental HPV Vaccination Intentions: A Randomized Clinical Trial

大型语言模型聊天机器人对话与公共卫生材料及父母HPV疫苗接种意愿:一项随机临床试验

Neil K. R. Sehgal, Sunny Rai, Manuel Tonneau, Anish K. Agarwal, Joseph Cappella, Melanie Kornides, Lyle Ungar, Alison Buttenheim, Sharath Chandra Guntuku

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 该随机临床试验比较了LLM聊天机器人对话、公共卫生材料和无干预对父母HPV疫苗接种意愿的影响,发现公共卫生材料在即时和45天后均有效,而聊天机器人效果短暂。

Journal ref JAMA Network Open 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07237 2026-06-08 cs.CL cs.AI cs.LG 新提交 92%

When Large Language Models Fail in Healthcare: Evaluating Sensitivity to Prompt Variations

当大型语言模型在医疗保健中失败:评估对提示变化的敏感性

Mahdi Alkaeed

机构 * Department of Computer Science and Engineering, Doha, Qatar(计算机科学与工程系,多哈,卡塔尔)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 本研究系统分析了通用和医学专用LLM对提示扰动的敏感性,发现即使是微小的措辞变化也可能改变临床建议,对抗性提示可能引发有害输出,表明这些模型在临床应用中不可靠。

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22636 2026-05-22 cs.SI 92%

A Multi-Source Framework for Relational Validation of Large Language Models Using Expert-Curated Encyclopedic Sources

一种用于大型语言模型关系验证的多源框架,使用专家整理的百科全书源

Moses Boudourides

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 本文提出了一种多源框架,用于验证大型语言模型的关系结构,通过比较生成的知识图谱与专家整理的百科全书,揭示了LLM在关系结构上的不足,强调了需要更复杂的评估指标来评估知识的完整性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17979 2026-05-19 econ.EM 92%

Comment on Scientific production in the era of large language models

对大语言模型时代科研产出的评论

Thomas Renault, Antonin Bergeaud, Clément Bosquet

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 该研究探讨了在采用大语言模型(LLMs)后研究人员预印本产出是否增加,指出采用时间判定规则与产出存在机械关联,并通过模拟展示了即使没有真实LLM采用信息,事件研究仍可能显示积极的后事件动态。

Comments Comment on arXiv:2601.13187 [10.1126/science.adw3000]

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.10995 2026-05-11 cs.CY 92%

A Human-Centric Framework for Data Attribution in Large Language Models

面向大型语言模型的数据归因的人本框架

Amelie Wührl, Mattes Ruckdeschel, Kyle Lo, Anna Rogers

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 本文提出一个以人类为中心的数据归因框架,旨在解决LLM数据使用中的归因问题,通过参数设定和多方协商实现可持续的数据经济平衡。

Comments Accepted at Facct 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.16423 2024-12-24 cs.CL cs.AI cs.LG 92%

Technical Report: Small Language Model for Japanese Clinical and Medicine

Shogo Watanabe

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.18062 2026-08-10 cs.NI cs.AI 92%

LLM-hRIC: LLM-empowered Hierarchical RAN Intelligent Control for O-RAN

LLM-hRIC: 基于大语言模型的分层RAN智能控制用于O-RAN

Lingyan Bao, Sinwoong Yun, Jemin Lee, Tony Q. S. Quek

机构 * School of Electrical and Electronic Engineering, Yonsei University(延世大学电气与电子工程学院) Information System Technology and Design, Singapore University of Technology and Design(新加坡科技与设计大学信息系统技术与设计)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出LLM-hRIC框架,通过LLM与强化学习结合,提升O-RAN中RICs的协作效率与实时决策能力。

Comments To appear in IEEE Communications Magazine

Journal ref IEEE Communications Magazine, pp. 1-7, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏