arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12534 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12534 篇

2505.07167 2026-01-05 cs.CR cs.CL 89%

One Trigger Token Is Enough: A Defense Strategy for Balancing Safety and Usability in Large Language Models

一个触发标记就足够:一种在大型语言模型中平衡安全性和可用性的防御策略

Haoran Gu, Handing Wang, Yi Mei, Mengjie Zhang, Yaochu Jin

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本研究提出D-STT算法,通过识别和解码安全触发标记,有效提升大型语言模型的安全性,同时保持其可用性与响应效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24113 2026-01-01 cs.AI cs.IR 89%

CogRec: A Cognitive Recommender Agent Fusing Large Language Models and Soar for Explainable Recommendation

CogRec: 一种融合大型语言模型和Soar的可解释推荐代理

Jiaxin Hu, Tao Wang, Bingsan Yang, Hongrun Wang

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 CogRec融合大型语言模型和Soar认知架构,通过符号推理与在线学习提升推荐系统的可解释性和准确性。

Comments 9 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23173 2025-12-30 cs.CR cs.AI 89%

EquaCode: A Multi-Strategy Jailbreak Approach for Large Language Models via Equation Solving and Code Completion

EquaCode:通过方程求解和代码补全的多策略对抗大语言模型

Zhen Liang, Hai Huang, Zhengkui Chen

机构 * School of Computer Science and Technology, Zhejiang Sci-Tech University, Hangzhou, China(计算机科学与技术学院,浙江科技学院,杭州,中国)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 EquaCode通过方程求解和代码补全提出多策略对抗方法,有效提升大语言模型的鲁棒性。

Comments This is a preprint. A revised version will appear in the Proceedings of AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23036 2025-12-30 cs.AI 89%

Problems With Large Language Models for Learner Modelling: Why LLMs Alone Fall Short for Responsible Tutoring in K--12 Education

大语言模型在学习者建模中的问题:为什么仅依赖LLM无法满足K-12教育中的负责任教学

Danial Hooshyar, Yeongwook Yang, Gustav Šíř, Tommi Kärkkäinen, Raija Hämäläinen, Mutlu Cukurova, Roger Azevedo

机构 * School of Digital Technologies(数字技术学院) Tallinn University(塔林大学) Faculty of Information Technology(信息技术学院) University of Jyväskylä(耶夫斯凯利亚大学) Department of Computer Science and Engineering(计算机科学与工程系) Gangneung-Wonju National University(江原-Wonju国立大学) Czech Technical University(捷克技术大学) University College London(伦敦大学学院) School of Modeling Simulation and Training(建模模拟与培训学院) University of Central Florida(中央佛罗里达大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本研究发现基于LLM的学习者建模在准确性、可靠性和时间一致性方面存在不足,DKT模型在预测学习者知识掌握方面表现更优,强调需要混合框架以实现负责任的教学。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16097 2025-12-17 cs.AI 89%

Developing Large Language Models for Clinical Research Using One Million Clinical Trials

利用一百万项临床试验开发大型语言模型用于临床研究

Zifeng Wang, Jiacheng Lin, Qiao Jin, Junyi Gao, Jathurshan Pradeepkumar, Pengcheng Jiang, Zhiyong Lu, Jimeng Sun

机构 * Usher Institute, Edinburgh Medical School, University of Edinburgh(埃丁堡大学埃丁堡医学院usher研究所) Health Data Research UK(英国健康数据研究) School of Computing and Data Science, University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校计算与数据科学学院) Division of Intramural Research, National Library of Medicine, National Institutes of Health(国家卫生研究院国家医学图书馆内部研究部) Keiji AI

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出TrialPanorama,通过整合一百万项临床试验数据,训练出在八个关键临床研究任务中表现优于通用大语言模型的8B LLM。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.10852 2025-12-17 cond-mat.mtrl-sci cs.CL cs.DB 89%

MatTools: Benchmarking Large Language Models for Materials Science Tools

MatTools: 评估大型语言模型在材料科学工具中的基准测试

Siyu Liu, Bo Hu, Beilin Ye, Jiamin Xu, David J. Srolovitz, Tongqi Wen

机构 * Center for Structural Materials, Department of Mechanical Engineering, The University of Hong Kong(香港大学机械工程系结构材料中心) Materials Innovation Institute for Life Sciences(生命科学创新研究所)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 MatTools通过代码生成和执行评估LLM在材料科学工具中的能力,揭示通用模型优于专业模型,AI理解AI,及简单方法更优的结论。

Comments 27 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08946 2025-12-11 cs.CY cs.CL 89%

Large Language Models as Search Engines: Societal Challenges

大语言模型作为搜索引擎:社会挑战

Zacchary Sadeddine, Winston Maxwell, Gaël Varoquaux, Fabian M. Suchanek

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本文探讨大语言模型取代搜索引擎带来的社会挑战,分析了提供者、创作者和用户的角色,并提出缓解策略与未来研究方向。

Journal ref SIGIR Forum 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07917 2025-12-10 cs.SE cs.AI physics.flu-dyn 89%

CFD-copilot: leveraging domain-adapted large language model and model context protocol to enhance simulation automation

CFD-copilot: 利用领域适应的大语言模型和模型上下文协议增强仿真自动化

Zhehao Dong, Shanghai Du, Zhen Lu, Yue Yang

机构 * State Key Laboratory for Turbulence and Complex Systems(湍流与复杂系统国家重点实验室) School of Mechanics and Engineering Science(力学与工程科学学院) Peking University(北京大学) HEDPS-CAPT

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 CFD-copilot通过领域适应的大语言模型和模型上下文协议提升CFD仿真的自动化水平。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06812 2025-12-09 cs.CL 89%

Large Language Model-Based Generation of Discharge Summaries

基于大型语言模型的出院小结生成

Tiago Rodrigues, Carla Teixeira Lopes

机构 * INESC TEC

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

AI总结 本文研究了大型语言模型在生成出院小结中的应用,发现专有模型在性能上优于开源模型,尽管存在幻觉和信息缺失的问题,但专有模型在生成准确的出院小结方面表现出色。

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06001 2025-12-09 physics.ed-ph cs.CL 89%

Small Language Models Reshape Higher Education: Courses, Textbooks, and Teaching

小型语言模型重塑高等教育:课程、教材和教学

Jian Zhang, Jia Shao

专题命中 领域大模型 :language model(title,abstract);small language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 本研究利用小型语言模型重新设计大气物理课程,通过构建高维向量库实现教学资源的动态化与智能化,推动教育模式的变革。

Comments in Chinese language

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05167 2025-12-08 cs.AI 89%

Bridging Traditional Machine Learning and Large Language Models: A Two-Part Course Design for Modern AI Education

连接传统机器学习与大语言模型:一种面向现代人工智能教育的双阶段课程设计

Fang Li

机构 * Computer Science Department(计算机科学系) Oklahoma Christian University(俄克拉荷马基督教大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出一种双阶段课程设计,旨在连接传统机器学习与大语言模型,帮助学生全面理解人工智能发展并提升实践能力。

Comments Accepted by the 39th annual Consortium for Computing Sciences in Colleges (CCSC:SE)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04273 2025-12-05 cs.SE cs.AI 89%

Quantitative Analysis of Technical Debt and Pattern Violation in Large Language Model Architectures

大语言模型架构中技术债务与模式违规的定量分析

Tyler Slater

机构 * Georgia Institute of Technology(佐治亚理工学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI

AI总结 本研究通过对比分析三种大语言模型在实现标准化微服务时的架构一致性与技术债务积累情况,揭示了开源模型在架构合规性方面的不足及潜在的技术债务风险。

Comments Under review at the Journal of Systems and Software (Special Issue on Impactful Software Architecture)

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03672 2025-12-04 cs.CL 89%

Evaluating Hydro-Science and Engineering Knowledge of Large Language Models

评估大语言模型的水科学与工程知识

Shiruo Hu, Wenbo Shan, Yingjia Li, Zhiqi Wan, Xinpeng Yu, Yunjia Qi, Haotian Xia, Yang Xiao, Dingxiao Liu, Jiaru Wang, Chenxu Gong, Ruixi Zhang, Shuyue Wu, Shibo Cui, Chee Hui Lai, Wei Luo, Yubin He, Bin Xu, Jianshi Zhao

机构 * State Key Laboratory of Hydro-Science and Engineering, Department of Hydraulic Engineering(水利科学与工程国家重点实验室、水利学院) Department of Computer Science and Technology(计算机科学与技术系) Zhipu AI(智谱AI) CHN Energy Dadu River Big Data Services Co., Ltd.(中国能源大渡河大数据服务有限公司)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 本研究提出Hydro-SE LLM评估基准,评估大语言模型在水科学与工程领域的知识和应用能力,揭示其优势与不足。

Comments Hydro-SE Bench sets a new benchmark for the evaluation of LLMs in the Hydro-Science and Engineering domain, with its code and data available at \url{https://github.com/sheishijun/Hydro-SE-Bench}

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00651 2025-12-02 cs.SE cs.LG 89%

Large Language Models for Software Engineering: A Reproducibility Crisis

大型语言模型在软件工程中的应用:可重复性危机

Mohammed Latif Siddiq, Arvin Islam-Gomes, Natalie Sekerak, Joanna C. S. Santos

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

AI总结 本文探讨了基于大型语言模型的软件工程研究中可重复性问题,揭示了制品可用性、环境规范和文档清晰度等方面的不足,并提出了可重复性成熟度模型以提升评估的全面性。

Comments Submitted to Empirical Software Engineering (EMSE) journal; 112 pages (81 pages of references)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02961 2025-12-01 cs.CL 89%

FlowerTune: A Cross-Domain Benchmark for Federated Fine-Tuning of Large Language Models

FlowerTune: 一个跨领域用于联邦微调大型语言模型的基准测试

Yan Gao, Massimo Roberto Scamarcia, Javier Fernandez-Marques, Mohammad Naseri, Chong Shen Ng, Dimitris Stripelis, Zexi Li, Tao Shen, Jiamu Bai, Daoyuan Chen, Zikai Zhang, Rui Hu, InSeo Song, Lee KangYoon, Hong Jia, Ting Dang, Junyan Wang, Zheyuan Liu, Daniel Janes Beutel, Lingjuan Lyu, Nicholas D. Lane

机构 * Flower Labs(Flower实验室) University of Cambridge(剑桥大学) Zhejiang University(浙江大学) Penn State University(宾夕法尼亚州立大学) Alibaba Group(阿里巴巴集团) University of Nevada, Reno(内华达大学拉斯维加斯分校) Gachon University(加荣大学) The University of Auckland(奥克兰大学) The University of Melbourne(墨尔本大学) The University of Adelaide(阿德莱德大学) Sony AI(索尼人工智能)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 FlowerTune提出一个跨领域联邦微调LLM的基准测试,评估26种模型在四个领域中的性能,提供隐私保护和领域适应的见解。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15752 2025-11-21 cs.AI cs.MA 89%

Build AI Assistants using Large Language Models and Agents to Enhance the Engineering Education of Biomechanics

利用大型语言模型和智能体构建AI助教以增强生物力学工程教育

Hanzhi Yan, Qin Lu, Xianqiao Wang, Xiaoming Zhai, Tianming Liu, He Li

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 本文提出利用RAG和MAS提升LLM在生物力学教育中的表现,通过双模块框架增强教学效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14770 2025-11-20 cs.IR cs.AI 89%

ExplainRec: Towards Explainable Multi-Modal Zero-Shot Recommendation with Preference Attribution and Large Language Models

Bo Ma, LuYao Liu, ZeHua Hu, Simon Lau

机构 * Department of Software \& Microelectronics Peking University Beijing, China Department of Software \& Microelectronics Peking University Beijing, China hangli\ Department of Software \& Microelectronics Peking University Beijing, China zehua\ Department of Software \& Microelectronics Peking University Beijing, China xiaofan\ Economic Law School China University of Political Science School of Computer Science Peking University Beijing, China

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14638 2025-11-19 cs.CL 89%

A Specialized Large Language Model for Clinical Reasoning and Diagnosis in Rare Diseases

Tao Yang, Dandan Huang, Yunting Lin, Pengfei Wu, Zhikun Wu, Gangyuan Ma, Yulan Lu, Xinran Dong, Dingpeng Li, Junshuang Ge, Zhiyan Zhang, Xuanzhao Huang, Wenyan Nong, Yao Zhou, Hui Tang, Hongxi Yang, Shijie Zhang, Juan Li, Xiaojun Cao, Lin Yang, Xia Gao, Kaishou Xu, Xiaoqiong Gu, Wen Zhang, Huimin Xia, Li Liu, Wenhao Zhou, Mulin Jun Li

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.CL

Comments 50 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10673 2025-11-17 cs.CL cond-mat.mtrl-sci 89%

Large language models in materials science and the need for open-source approaches

Fengxu Yang, Weitong Chen, Jack D. Evans

机构 * School of Physics, Chemistry and Earth Sciences, The University of Adelaide(物理、化学和地球科学学院,阿德莱德大学) School of Computer and Mathematical Sciences, The University of Adelaide(计算机与数学科学学院,阿德莱德大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 16 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05406 2025-11-10 cs.CL 89%

Large Language Models for Explainable Threat Intelligence

Tiago Dinis, Miguel Correia, Roger Tavares

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.00879 2025-11-10 cs.LG 89%

Generating Computational Cognitive Models using Large Language Models

Milena Rmus, Akshay K. Jagadish, Marvin Mathony, Tobias Ludwig, Eric Schulz

机构 * Helmholtz Munich(海德堡-慕尼黑研究中心) Princeton University(普林斯顿大学) Tübingen University(图宾根大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18112 2025-11-07 cs.LG 89%

Large language models surpass domain-specific architectures for antepartum electronic fetal monitoring analysis

Sheng Wong, Ravi Shankar, Beth Albert, Gabriel Davis Jones

机构 * Nuffield Department of Women’s & Reproductive Health University of Oxford(妇女与生殖健康奈菲尔德部门牛津大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);foundation model(abstract);分类 cs.LG

Comments Preparing for journal

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.03675 2025-11-06 cs.CR cs.AI 89%

Whisper Leak: a side-channel attack on Large Language Models

Geoff McDonald, Jonathan Bar Or

机构 * Microsoft(微软)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21972 2025-11-04 cs.CY cs.AI 89%

From Superficial Outputs to Superficial Learning: Risks of Large Language Models in Education

Iris Delikoura, Yi. R Fung, Pan Hui

机构 * The Hong Kong University of Science and Technology(香港科技大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27080 2025-11-03 cs.CR cs.AI 89%

Adapting Large Language Models to Emerging Cybersecurity using Retrieval Augmented Generation

Arnabh Borah, Md Tanvirul Alam, Nidhi Rastogi

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) Georgia Institute of Technology(佐治亚理工学院) Department of Computer Science(计算机科学系) Rochester Institute of Technology(罗切斯特理工学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25908 2025-10-31 cs.AI 89%

SciTrust 2.0: A Comprehensive Framework for Evaluating Trustworthiness of Large Language Models in Scientific Applications

Emily Herron, Junqi Yin, Feiyi Wang

机构 * Oak Ridge National Laboratory(橡树岭国家实验室)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Preprint Submitted to ACM Transactions on AI for Science (TAIS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26080 2025-10-29 cs.AI stat.AP 89%

Evaluating the Use of Large Language Models as Synthetic Social Agents in Social Science Research

Emma Rose Madden

机构 * University of Oxford, Department of Politics and International Relations(牛津大学政治与国际关系系)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24031 2025-10-29 cs.AI cs.CR 89%

LLMLogAnalyzer: A Clustering-Based Log Analysis Chatbot using Large Language Models

Peng Cai, Reza Ryan, Nickson M. Karie

机构 * School of EECMS, Curtin University(Curtin大学电子工程与计算机科学学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 33 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.22318 2025-10-28 cs.SE cs.AI 89%

Harnessing the Power of Large Language Models for Software Testing Education: A Focus on ISTQB Syllabus

Tuan-Phong Ngo, Bao-Ngoc Duong, Tuan-Anh Hoang, Joshua Dwight, Ushik Shrestha Khwakhali

机构 * RMIT University Vietnam(皇家墨尔本理工大学越南分校)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 7 pages, 3 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24877 2025-10-28 cs.AI 89%

The Emergence of Social Science of Large Language Models

Xiao Jia, Zhanzhan Zhao

机构 * School of Humanities and Social Science, The Chinese University of Hong Kong, Shenzhen, Guangdong(人文与社会科学学院,香港中文大学(深圳))

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏