arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12496 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12496 篇

2605.05933 2026-05-08 cs.CV 91%

Whole-body CT attenuation and volume charts from routine clinical scans via evidence-grounded LLM report filtering

通过证据引导的LLM报告过滤从常规临床扫描中获得全身CT衰减和体积图表

Christian Wachinger, Bernhard Renger, Christopher Späth, Jan Kirschke, Marcus Makowski

机构 * Institute of Radiology, School of Medicine and Health, Technical University of Munich(医学与健康学院放射学研究所,慕尼黑技术大学) Institute of Neuroradiology, School of Medicine and Health, Technical University of Munich(医学与健康学院神经放射学研究所,慕尼黑技术大学) Munich Data Science Institute (MDSI), Technical University of Munich(慕尼黑数据科学研究所(MDSI),慕尼黑技术大学) Munich Center for Machine Learning (MCML), Munich, Germany(慕尼黑机器学习中心(MCML),德国慕尼黑)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出证据引导的LLM集成方法,通过过滤病理发现,构建病理减少的队列,建立106个解剖结构的全身参考图表,支持标准化定量表型分析和多中心影像研究。

Comments Supplement available at: https://github.com/ai-med/body-charts/blob/main/body_charts_supp.pdf

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09298 2026-05-08 cs.CV 91%

Multi-Modal LLM based Image Captioning in ICT: Bridging the Gap Between General and Industry Domain

基于多模态LLM的ICT图像描述:弥合通用与行业领域之间的差距

Lianying Chao, Kai Zhang, Haoran Cai, Sijie Wu, Xubin Li, Xin Chen

机构 * GTS, Huawei Technologies Co., Ltd.(华为技术有限公司GTS部门)

专题命中 领域大模型 :LLM(title,title_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出多阶段训练策略,构建ICT领域图像描述模型DICModel,通过合成图像文本对提升模型性能,实验表明其在BLEU指标和准确率上均优于现有模型。

Journal ref 2025 CCF BigData

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.20065 2026-04-23 cs.IR 91%

From Hidden Profiles to Governable Personalization: Recommender Systems in the Age of LLM Agents

从隐藏档案到可控个性化:在LLM代理时代推荐系统

Jiahao Liu, Mingzhe Han, Guanming Liu, Weihang Wang, Dongsheng Li, Hansu Gu, Peng Zhang, Tun Lu, Ning Gu

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文探讨LLM代理时代推荐系统从隐藏平台档案转向可控个性化,提出五个研究方向,强调用户模型的透明性、隐私保护及跨领域设计。

Comments 6 pages, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.18200 2026-04-21 cs.IR 91%

Multi-LLM Token Filtering and Routing for Sequential Recommendation

多LLM令牌过滤与路由用于序列推荐

Wuhan Chen, Min Gao, Xin Xia, Zongwei Wang, Wentao Li, Shane Culpepper

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出MLTFR框架,通过多LLM令牌空间整合提升序列推荐性能,无需文本输入或模型修改,实验显示优于现有方法。

Comments 11 pages,3 figs

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17234 2026-04-21 cs.SE 91%

From Language to Action: Enhancing LLM Task Efficiency with Task-Aware MCP Server Recommendation

从语言到行动:通过任务感知的MCP服务器推荐提升LLM任务效率

Shiyu He, Zhiman Chen, Yuqi Zhao, Neng Zhang, Ran Mo, Yutao Ma

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出任务感知的MCP服务器推荐框架,通过构建任务-工具关联数据集和改进的推荐模型,提升LLM在实际开发任务中的效率和准确性。

Comments 44 pages, 12 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19693 2026-04-15 cs.IR 91%

Beyong Tokens: Item-aware Attention for LLM-based Recommendation

超越标记:面向LLM推荐的项感知注意力

Xiaokun Zhang, Bowei He, Jiamin Chen, Ziqiang Cui, Chen Ma

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 本文提出项感知注意力机制,通过区分项内和项间标记关系,提升LLM在推荐中的表现,实验证明其有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08083 2025-12-10 cs.IR 91%

Exploiting the Randomness of Large Language Models (LLM) in Text Classification Tasks: Locating Privileged Documents in Legal Matters

利用大型语言模型(LLM)在文本分类任务中的随机性:在法律事务中定位特权文件

Keith Huffman, Jianping Zhang, Nathaniel Huber-Fliflet, Fusheng Wei, Peter Gronvall

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

AI总结 本文研究了在法律事务中利用LLM随机性提高特权文件识别准确性的方法,并探讨了其在合规流程中的应用价值。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.11556 2025-10-14 cs.CY 91%

Personalized and Constructive Feedback for Computer Science Students Using the Large Language Model (LLM)

Javed Ali Khan, Muhammad Yaqoob, Mamoona Tasadduq, Hafsa Shareef Dar, Aitezaz Ahsan

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.17063 2025-08-26 cs.HC 91%

Measuring Large Language Models Dependency: Validating the Arabic Version of the LLM-D12 Scale

Sameha AlShakhsi, Ala Yankouskaya, Magnus Liebherr, Raian Ali

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06512 2025-07-28 cond-mat.mtrl-sci 91%

LLM-Feynman: Leveraging Large Language Models for Universal Scientific Formula and Theory Discovery

Zhilong Song, Qionghua Zhou, Chunjin Ren, Chongyi Ling, Minggang Ju, Jinlan Wang

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.07871 2025-03-24 cs.HC cs.CY 91%

Objection Overruled! Lay People can Distinguish Large Language Models from Lawyers, but still Favour Advice from an LLM

Eike Schneiders, Tina Seabrooke, Joshua Krook, Richard Hyde, Natalie Leesakul, Jeremie Clos, Joel Fischer

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

Comments ACMConference on Human Factors in Computing Systems (CHI'25)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.09385 2025-02-14 cs.CR 91%

APT-LLM: Embedding-Based Anomaly Detection of Cyber Advanced Persistent Threats Using Large Language Models

Sidahmed Benabderrahmane, Petko Valtchev, James Cheney, Talal Rahwan

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21479 2024-10-30 cs.CL cs.AI cs.LG 91%

TransformLLM: Adapting Large Language Models via LLM-Transformed Reading Comprehension Text

Iftach Arbel, Yehonathan Refael, Ofir Lindenbaum

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(title);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11858 2024-06-19 cs.CY 91%

Student Perspectives on Using a Large Language Model (LLM) for an Assignment on Professional Ethics

Virginia Grande, Natalie Kiesler, Maria Andreina Francisco R

专题命中 领域大模型 :LLM(title,abstract);large language model(title,abstract);language model(title,abstract)

Comments accepted at ITiCSE 2024, Milan, Italy

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11839 2026-08-13 cs.LG 版本更新 91%

Grounding Large Language Models as Generalizable Policies in Network Control

大语言模型作为网络优化的通用策略

Duo Wu, Linjia Kang, Zhimin Wang, Fangxin Wang, Wei Zhang, Chongbo Sun, Xuefeng Tao, Wei Yang, Le Zhang, Wenwu Zhu, Peng Cui, Zhi Wang

机构 * Bytedance(字节跳动) Shenzhen International Graduate School(深圳国际研究生院) Tsinghua University(清华大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Department of Computer Science and Technology(计算机科学与技术系)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);foundation model(abstract)

AI总结 本文提出Trailblazer框架,利用大语言模型实现跨任务和环境的通用网络策略,通过网络对齐和策略协作机制提升效率与泛化能力。

Comments Arxiv version. Official version has been submitted to IEEE Transactions on Mobile Computing

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22966 2026-08-11 cs.CL 版本更新 91%

Prompt engineering does not universally improve Large Language Model performance across clinical decision-making tasks

提示工程并不能普遍提升大型语言模型在临床决策任务中的性能

Mengdi Chai, Ali R. Zomorrodi

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);prompting(abstract)

AI总结 本研究发现提示工程对LLMs在临床决策任务中的性能提升具有高度依赖模型和任务的特性,强调了定制化策略的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05630 2026-08-07 cs.CL 新提交 91%

Human-Like Anaphor Resolution in Large Language Models

大型语言模型中类人指代消解

Keane Zhang, Varshini Chinta, Raj Sanjay Shah, Sashank Varma

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL

AI总结 本研究探究话语结构等认知科学确定的指代消解影响因素对GPT-2-XL等五个开源权重LLM的作用,发现部分LLM对部分因素具类人敏感性,明确了LLM近似人类指代消解的条件。

Comments 7 pages, 6 figures, 1 table. Presented at CogSci 2026 and the 2026 Annual Meeting of the Society for Text & Discourse. Code: https://github.com/wristy/anaphor

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26577 2026-07-27 cs.AI cs.CY cs.RO 版本更新 91%

Benchmarking the Safety of Large Language Models for Robotic Health Attendant Control

对大型语言模型在机器人健康护理员控制中的安全性的基准测试

Mahiro Nakao, Kazuhiro Takemoto

机构 * Kyushu Institute of Technology(九州工业技术大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.AI

AI总结 本文通过270条有害指令评估72个LLM,在模拟环境中测试其安全性,发现模型大小和发布日期影响安全性能,专有模型更安全,但医疗领域微调和提示防御策略效果有限,需将安全性作为首要考量。

Comments 20 pages, 9 figures, 3 tables, 8 pages supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.16197 2026-07-21 cs.LG 版本更新 91%

Sketching the Readout of Large Language Models for Scalable Data Attribution and Valuation

为大规模语言模型的可扩展数据归因与估值绘制读出

Yide Ran, Jianwen Xie, Minghui Wang, Wenjin Zheng, Denghui Zhang, Chuan Li, Zhaozhuo Xu

机构 * Stevens Institute of Technology(史蒂文斯理工学院) Lambda Inc.(Lambda公司) Columbia University(哥伦比亚大学) Mailman School of Public Health(马利曼公共卫生学院) University of Texas Health Science Center at Houston(德克萨斯大学健康科学中心休斯顿分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);pretraining(abstract)

AI总结 本文提出RISE方法,通过聚焦输出层影响热点,利用分解的外积形式实现高效归因与估值,减少存储并扩展至32B参数模型,验证了其在数据检测、领域分离和高质量数据选择中的有效性。

Comments 54 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12317 2026-07-03 cs.CL 版本更新 91%

Large language models reshape the language of science

大型语言模型重塑科学语言

Dingkang Lin, Naixuan Zhao, Dan Tian, Jiang Li

机构 * School of Information Management, Nanjing University(南京大学信息管理学院) School of Economics and Management, Shanxi University(山西大学经济管理学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL

AI总结 通过分析2020-2024年间2136万篇摘要,发现LLM导致科学写作词汇复杂度上升、句法复杂度下降,且对非英语母语学者影响更大,可能扩大科学话语与公众语言的差距。

Comments 72 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14117 2026-06-15 stat.ME cs.AI 新提交 91%

A Two-Stage Statistical Framework for Evaluating Associative Interference in Large Language Models

评估大语言模型中联想干扰的两阶段统计框架

Achraf Cohen, Andrew Kincaid

机构 * Department of Mathematics and Statistics, University of West Florida(数学与统计学系,西弗吉尼亚大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.AI

AI总结 提出两阶段统计框架,分离响应遵从性与任务一致性,评估三个LLM在性别-职业等领域的联想干扰,发现效应因模型而异。

Comments 11 pages; 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00250 2026-05-27 cs.CL cs.IT math.IT 91%

PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark

PersianMedQA: 在波斯语-英语双语医学问答基准上评估大型语言模型

Mohammad Javad Ranjbar Kalahroodi, Amirhossein Sheikholselami, Sepehr Karimi, Sepideh Ranjbar Kalahroodi, Heshaam Faili, Azadeh Shakery

机构 * School of Electrical and Computer Engineering, University of Tehran(德黑兰大学电气与计算机工程学院) Shahid Beheshti University of Medical Sciences(沙希德·贝赫什提医学科学大学) Institute for Research in Fundamental Sciences (IPM)(基础科学研究所(IPM))

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL

AI总结 本文提出PersianMedQA数据集,包含20,785道波斯语医学多选题,用于评估41个LLM在零样本和思维链设置下的双语医学推理能力,发现闭源通用模型表现最佳,而波斯语模型性能较差,且翻译会丢失文化临床线索。

Comments Accepted at LREC 2026 (The Fifteenth Language Resources and Evaluation Conference), Palma, Mallorca, Spain, May 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.14044 2026-05-12 cs.AI cs.CR 91%

Multi-Stage Retrieval for Operational Technology Cybersecurity Compliance Using Large Language Models: A Railway Casestudy

基于大语言模型的多阶段检索在运营技术网络安全合规中的应用:铁路案例研究

Regan Bolton, Mohammadreza Sheikhfathollahi, Simon Parkinson, Dan Basher, Howard Parkinson

机构 * Digital Transit Limited, 3M Buckley Innovation Centre(数字交通有限公司,3M Buckley创新中心) Department of Computer Science at University of Huddersfield(赫德瑟尔大学计算机科学系)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.AI

AI总结 本文提出利用大语言模型和多阶段检索提升铁路网络安全合规性验证,通过对比不同模型展示PCA在合规性验证中的有效性,建立评估指标并指出LLM在合规性验证中的优势与局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.17543 2026-04-21 cs.CL 91%

PoliLegalLM: A Technical Report on a Large Language Model for Political and Legal Affairs

PoliLegalLM:政治与法律领域大型语言模型的技术报告

Yuting Huang, Yinghao Hu, Qian Xiao, Wenlin Zhong, Yiquan Wu, Taishi Zhou, Moke Chen, Changlong Sun, Kun Kuang, Fei Wu

机构 * Tongyi Lab, Alibaba Group(通义实验室,阿里巴巴集团) Zhejiang University(浙江大学) Zhejiang Zhengfa Xinxi Guanli Zhongxin(浙江正法信息警务中心)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);pretraining(abstract)

AI总结 本文提出PoliLegalLM,通过统一训练框架提升法律知识和推理能力,针对法律领域挑战实现高性能表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.09109 2026-03-12 cs.CV cs.AI 91%

VIVID-Med: LLM-Supervised Structured Pretraining for Deployable Medical ViTs

VIVID-Med: 基于LLM监督的结构化预训练用于可部署的医学ViT

Xiyao Wang, Xiaoyu Tan, Yang Dai, Yuxuan Fu, Shuo Li, Xihe Qiu

机构 * Shanghai University of Engineering Science(上海工程技术大学) National University of Singapore(新加坡国立大学) Case Western Reserve University(凯斯西储大学)

专题命中 领域大模型 :LLM(title,abstract);pretraining(title,abstract);large language model(abstract);language model(abstract)

AI总结 VIVID-Med通过LLM监督的结构化预训练方法,实现轻量级可部署的医学ViT模型,在医学图像分析中表现出高效和强泛化能力。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16640 2026-02-19 cs.CL 91%

Quecto-V1: Empirical Analysis of 8-bit Quantized Small Language Models for On-Device Legal Retrieval

Quecto-V1: 8位量化小型语言模型的实证分析用于设备端法律检索

Subrit Dikshit

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);large language model(abstract);SLM(abstract)

AI总结 Quecto-V1通过8位量化和专门训练,在设备端实现高效法律检索,优于通用小型模型。

Comments 5 pages, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.24289 2026-01-30 cs.IR cs.CL 91%

Rec-R1: Bridging Generative Large Language Models and User-Centric Recommendation Systems via Reinforcement Learning

Rec-R1: 通过强化学习连接生成式大语言模型与以用户为中心的推荐系统

Jiacheng Lin, Tian Wang, Kun Qian

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

AI总结 Rec-R1通过强化学习连接生成式大语言模型与用户导向推荐系统,有效提升推荐性能并保留LLM通用能力。

Comments Published in the TMLR journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00601 2025-12-04 cs.AI 91%

Clinical-R1: Empowering Large Language Models for Faithful and Comprehensive Reasoning with Clinical Objective Relative Policy Optimization

Clinical-R1: 通过临床目标相对策略优化赋能大语言模型进行忠实且全面的推理

Boyang Gu, Hongjian Zhou, Bradley Max Segal, Jinge Wu, Zeyu Cao, Hantao Zhong, Lei Clifton, Fenglin Liu, David A. Clifton

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

AI总结 Clinical-R1通过CRPO方法提升大语言模型在医学领域的推理忠实性和全面性,实现多目标强化学习优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.20743 2025-06-27 cs.LG cs.CE 91%

A Survey of AI for Materials Science: Foundation Models, LLM Agents, Datasets, and Tools

Minh-Hao Van, Prateek Verma, Chen Zhao, Xintao Wu

机构 * Department of EECS University of Arkansas Fayetteville(电子工程与计算机科学系美国阿肯色大学弗莱维尔分校) Department of CS Baylor University Waco(计算机科学系贝勒大学沃斯堡)

专题命中 领域大模型 :LLM(title,abstract);foundation model(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09089 2024-04-18 cs.CL 91%

Qilin-Med: Multi-stage Knowledge Injection Advanced Medical Large Language Model

Qichen Ye, Junling Liu, Dading Chong, Peilin Zhou, Yining Hua, Fenglin Liu, Meng Cao, Ziming Wang, Xuxin Cheng, Zhu Lei, Zhenhua Guo

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏