arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12565 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12565 篇

2512.23214 2025-12-30 cs.CL cs.LG cs.PL cs.SE 86%

Anka: A Domain-Specific Language for Reliable LLM Code Generation

Anka:一种用于可靠LLM代码生成的领域特定语言

Saif Khalfan Saif Al Mazrouei

机构 * University of Wisconsin-Madison(威斯康星大学麦迪逊分校)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 Anka是一种专为复杂代码生成设计的领域特定语言,通过约束语法显著减少错误,使LLM在多步骤任务中表现优于Python。

Comments 11 pages, 1 figure, 4 tables. Code and benchmarks available at https://github.com/BleBlo/Anka

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23206 2025-12-30 cs.CL cs.AI 86%

Not too long do read: Evaluating LLM-generated extreme scientific summaries

不要太长了读一读:评估LLM生成的极端科学摘要

Zhuoqi Lyu, Qing Ke

机构 * Department of Data Science(数据科学系) City University of Hong Kong(香港城市大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出BiomedTLDR数据集,评估LLM生成科学摘要的性能,发现LLM更倾向于提取而非抽象,且在词汇和修辞结构上更接近原文。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01956 2025-12-30 cs.AI cs.LG cs.MA 86%

Scaling Clinician-Grade Feature Generation from Clinical Notes with Multi-Agent Language Models

通过多智能体语言模型实现临床笔记中临床级特征生成的扩展

Jiayi Wang, Jacqueline Jil Vallon, Nikhil V. Kotha, Neil Panjwani, Xi Ling, Margaret Redfield, Sushmita Vij, Sandy Srinivas, John Leppert, Mark K. Buyyounouski, Mohsen Bayati

机构 * Department of Management Science and Engineering, Stanford University School of Engineering(管理科学与工程系,斯坦福大学工程学院) Department of Radiation Oncology, Stanford University School of Medicine(放射肿瘤学系,斯坦福大学医学院) Operations, Information and Technology, Stanford University Graduate Business School(运营、信息与技术,斯坦福大学商学院) Graduate Business School Research Hub, Stanford University Graduate Business School(商学院研究中心,斯坦福大学商学院) Department of Medicine (Oncology), Stanford University School of Medicine(医学系(肿瘤学),斯坦福大学医学院) Department of Medicine, Stanford University School of Medicine(医学系,斯坦福大学医学院) Department of Urology, Stanford University School of Medicine(泌尿学系,斯坦福大学医学院) Veterans Affairs Palo Alto Health Care System(退伍军人事务帕洛阿尔托医疗系统) Department of Electrical Engineering, Stanford University School of Engineering(电气工程系,斯坦福大学工程学院)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究提出了一种多智能体语言模型系统,通过自动化临床笔记特征生成,实现了与人工方法相当的预测性能,并在不同医疗场景中展示了良好的可扩展性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15312 2025-12-18 cs.CL cs.AI 86%

Evaluating LLMs for Zeolite Synthesis Event Extraction (ZSEE): A Systematic Analysis of Prompting Strategies

评估用于沸石合成事件提取(ZSEE)的LLM:对提示策略的系统分析

Charan Prakash Rathore, Saumi Ray, Dhruv Kumar

机构 * Birla Institute of Technology and Science, Pilani, India(巴尔·印度技术科学学院,比兰利,印度)

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文评估了不同提示策略在沸石合成事件提取中的效果,发现零样本方法在事件分类上表现优异,但细粒度提取任务需领域适应模型。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11573 2025-12-15 cs.CL cs.LG 86%

Visualizing token importance for black-box language models

对黑盒语言模型的令牌重要性可视化

Paulius Rauba, Qiyao Wei, Mihaela van der Schaar

机构 * University of Cambridge(剑桥大学)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 本文提出DBSA方法,用于可视化黑盒语言模型中各输入令牌的重要性,以评估模型输出对输入的依赖性。

Journal ref Proceedings of the 28th International Conference on Artifi- cial Intelligence and Statistics (AISTATS) 2025, Mai Khao, Thailand. PMLR: Volume 258

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15378 2025-12-10 cs.CL cs.AI 86%

Improving LLM Reliability with RAG in Religious Question-Answering: MufassirQAS

用RAG提升LLM可靠性:宗教问答中的MufassirQAS

Ahmet Yusuf Alan, Enis Karaarslan, Omer Aydin

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 MufassirQAS通过RAG方法提升LLM在宗教问答中的可靠性,提供透明和准确的回应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.23235 2025-12-01 cs.CL cs.AI 86%

Tourism Question Answer System in Indian Language using Domain-Adapted Foundation Models

使用领域适应基础模型的印度语言旅游问答系统

Praveen Gatla, Anushka, Nikita Kanwar, Gouri Sahoo, Rajesh Kumar Mundotiya

机构 * Department of Linguistics Banaras Hindu University(语言学系班加罗尔 Hindu 大学) Department of Humanistic Studies Indian Institute of Technology (BHU)(人文科学系印度理工学院(BHU)) Department of Computer Science and Engineering Indian Institute of Technology Bhilai(计算机科学与工程系印度理工学院 Bhilai)

专题命中 领域大模型 :foundation model(title,abstract);SFT(abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 本文提出使用领域适应基础模型构建印地语旅游问答系统,通过LoRA微调提升效率与准确性,验证RoBERTa在捕捉文化术语上的优势。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20798 2025-12-01 cs.LG cs.AI physics.comp-ph 86%

Physics Steering: Causal Control of Cross-Domain Concepts in a Physics Foundation Model

物理引导:在物理基础模型中实现跨领域概念的因果控制

Rio Alexa Fear, Payel Mukhopadhyay, Michael McCabe, Alberto Bietti, Miles Cranmer

机构 * University of Cambridge(剑桥大学) NYU(纽约大学) Simons Foundation(Simons基金会) Flatiron Institute(Flatiron研究所)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本研究通过物理基础模型的激活空间分析,揭示了因果控制物理行为的机制,展示了对物理概念的跨领域操控能力。

Comments 16 Pages, 9 Figures. Code available soon at https://github.com/DJ-Fear/walrus_steering

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18585 2025-12-01 cs.AI cs.CL cs.LO 86%

RvLLM: LLM Runtime Verification with Domain Knowledge

RvLLM: 基于领域知识的LLM运行时验证

Yedi Zhang, Sun Yi Emma, Annabelle Lee Jia En, Jin Song Dong

机构 * National University of Singapore(新加坡国立大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 RvLLM通过整合领域知识,提供了一种轻量且灵活的LLM运行时验证框架,有效检测各类LLM的错误输出。

Comments 24 pages, 11 tables, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20729 2025-11-27 cs.LG cs.AI 86%

Spatio-Temporal Trajectory Foundation Model - Recent Advances and Future Directions

时空轨迹基础模型——近期进展与未来方向

Sean Bin Yang, Ying Sun, Yunyao Cheng, Yan Lin, Kristian Torp, Jilin Hu

机构 * Aalborg University(奥尔堡大学) Chongqing University of Posts and Telecomunications(重庆邮电大学) East China Normal University(华东师范大学)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文探讨了时空轨迹基础模型的最新进展与未来方向,分析了现有方法的优缺点,并提出了提升时空通用智能的研究路径。

Comments This paper has been accepted by CIKM 2025 STIntelligence Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20679 2025-11-27 cs.AI cs.LG 86%

Minimizing Hyperbolic Embedding Distortion with LLM-Guided Hierarchy Restructuring

最小化双曲嵌入扭曲与LLM引导的层次重构

Melika Ayoughi, Pascal Mettes, Paul Groth

机构 * University of Amsterdam(阿姆斯特丹大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文利用LLM引导重构层次结构,以优化双曲嵌入质量,提升嵌入效果和可解释性。

Journal ref K-CAP2025 Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18578 2025-11-25 q-fin.CP cs.AI cs.LG q-fin.PM q-fin.PR 86%

Re(Visiting) Time Series Foundation Models in Finance

重新审视金融领域的时序基础模型

Eghbal Rahimikia, Hao Ni, Weiguan Wang

机构 * Alliance Manchester Business School University of Manchester(曼彻斯特大学阿利安斯商学院) Department of Mathematics University College London (UCL)(伦敦大学学院数学系) School of Economics Shanghai University(上海大学经济学院)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文研究了金融领域时序基础模型的性能,发现从头预训练模型在预测和经济改进上优于现成预训练模型,强调了领域特定适应的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.22006 2025-11-25 cs.CL cs.LG 86%

Enhancing Domain-Specific Encoder Models with LLM-Generated Data: How to Leverage Ontologies, and How to Do Without Them

通过LLM生成数据增强领域特定编码器模型:如何利用本体论,以及如何不依赖本体论

Marc Brinner, Tarek Al Mustafa, Sina Zarrieß

机构 * Computational Linguistics Department of Linguistics(计算语言学系) Institute of Computer Science(计算机科学研究所) Bielefeld University(比勒菲尔德大学)

专题命中 领域大模型 :LLM(title,abstract);language model(abstract);pretraining(abstract);分类 cs.CL、cs.LG

AI总结 通过LLM生成数据增强领域特定编码器模型,利用本体论或自动提取概念,实现低资源环境下的高效预训练。

Comments Published in the Findings of the Association for Computational Linguistics: EMNLP 2025

Journal ref Findings of the Association for Computational Linguistics: EMNLP 2025 (pp. 22740-22754). Association for Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10900 2025-11-20 cs.CL cs.AI 86%

Expert-Guided Prompting and Retrieval-Augmented Generation for Emergency Medical Service Question Answering

Xueren Ge, Sahil Murtaza, Anthony Cortez, Homa Alemzadeh

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12922 2025-11-18 cs.IR cs.AI cs.LG cs.NE cs.SI 86%

Tokenize Once, Recommend Anywhere: Unified Item Tokenization for Multi-domain LLM-based Recommendation

Yu Hou, Won-Yong Shin

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments 20 pages, 8 figures, 9 tables; Annual AAAI Conference on Artificial Intelligence (AAAI-26) (to appear) (Please cite our conference version.)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.02104 2025-11-18 cs.LG cs.AI 86%

Foundation Model in Biomedicine

Xiangrui Liu, Yuanyuan Zhang, Qianyu Shang, Yingzhou Lu, Changchang Yin, Xiaoling Hu, Xiaoou Liu, Lulu Chen, Alexander Rodríguez, Yezhou Yang, Ping Zhang, Jintai Chen, Shan Du, Huaxiu Yao, Sheng Wang, Tianfan Fu, Xiao Wang

机构 * Arizona State University(亚利桑那州立大学) Purdue University(普渡大学) University of British Columbia(不列颠哥伦比亚大学) Stanford University(斯坦福大学) The Ohio State University(俄亥俄州立大学) Massachusetts General Hospital(麻省总医院) Harvard Medical School(哈佛医学院) Virginia Polytechnic Institute(弗吉尼亚多项技术学院) University of Michigan(密歇根大学) University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) Nanjing University(南京大学)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17506 2025-11-17 cs.LG cs.AI 86%

RAG-Enhanced Collaborative LLM Agents for Drug Discovery

Namkyeong Lee, Edward De Brouwer, Ehsan Hajiramezanali, Tommaso Biancalani, Chanyoung Park, Gabriele Scalia

机构 * Genentech(基因泰克)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

Comments Machine Learning, Drug Discovery

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06645 2025-11-11 stat.ML cs.CL cs.LG 86%

Adaptive Testing for Segmenting Watermarked Texts From Language Models

Xingchi Li, Xiaochi Liu, Guanxun Li

机构 * Department of Statistics Texas A&M University(统计学系德克萨斯A&M大学) Department of Statistics Beijing Normal University at Zhuhai(统计学系北京师范大学珠海分校)

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.LG

Comments 13 pages, 3 figures, accepted for publication in STAT, October 28, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.05527 2025-11-11 cs.CL cs.AI 86%

Bridging Industrial Expertise and XR with LLM-Powered Conversational Agents

Despina Tomkou, George Fatouros, Andreas Andreou, Georgios Makridis, Fotis Liarokapis, Dimitrios Dardanis, Athanasios Kiourtis, John Soldatos, Dimosthenis Kyriazis

机构 * Innov-Acts Ltd.(Innov-Acts有限公司) CYENS Centre of Excellence(CYENS卓越中心) University of Piraeus(比雷埃克斯大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 7 pages, 7 figures

Journal ref 2025 21st International Conference on Distributed Computing in Smart Systems and the Internet of Things (DCOSS-IoT)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16335 2025-11-11 cs.AI cs.CL 86%

Explainable Rule Application via Structured Prompting: A Neural-Symbolic Approach

Albert Sadowski, Jarosław A. Chudziak

机构 * Faculty of Electronics and Information Technology(电子与信息技术学院) Warsaw University of Technology(华沙技术大学)

专题命中 领域大模型 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted for publication at the 29th International Conference on Knowledge-Based and Intelligent Information \& Engineering Systems (KES 2025)

Journal ref Procedia Computer Science 270 (2025) 2166-2175

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05311 2025-11-10 cs.AI cs.LG cs.RO cs.SE 86%

Cleaning Maintenance Logs with LLM Agents for Improved Predictive Maintenance

Valeriu Dimidov, Faisal Hawlader, Sasan Jafarnejad, Raphaël Frank

机构 * Interdisciplinary Centre for Security, Reliability Trust (SnT) University of Luxembourg 29 Avenue J.F. Kennedy L-1855, Luxembourg

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.14846 2025-11-04 cs.AI cs.CL cs.LO 86%

Where to Search: Measure the Prior-Structured Search Space of LLM Agents

Zhuo-Yang Song

机构 * School of Physics, Peking University(物理学院,北京大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 4 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24442 2025-10-29 cs.AI cs.CL cs.CY cs.MA 86%

Law in Silico: Simulating Legal Society with LLM-Based Agents

Yiding Wang, Yuxuan Chen, Fanxu Meng, Xifan Chen, Xiaolei Yang, Muhan Zhang

机构 * Institute for Artificial Intelligence, Peking University(北京大学人工智能研究所) Yuanpei College, Peking University(北京大学元培学院) School of Computing and Data Science, The University of Hong Kong(香港大学计算与数据科学学院) Law School, Peking University(北京大学法学院) State Key Laboratory of General Artificial Intelligence, BIGAI(通用人工智能国家重点实验室)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19209 2025-10-28 cs.CL cs.AI cs.CE stat.ML 86%

MOOSE-Chem2: Exploring LLM Limits in Fine-Grained Scientific Hypothesis Discovery via Hierarchical Search

Zonglin Yang, Wanhao Liu, Ben Gao, Yujie Liu, Wei Li, Tong Xie, Lidong Bing, Wanli Ouyang, Erik Cambria, Dongzhan Zhou

机构 * Nanyang Technological University(南洋理工大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) University of Science and Technology of China(中国科学技术大学) Wuhan University(武汉大学) National University of Singapore(新加坡国立大学) University of New South Wales(新南威尔士大学) MiroMind The Chinese University of Hong Kong(香港中文大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00711 2025-10-23 cs.LG cs.AI cs.CV 86%

QoQ-Med: Building Multimodal Clinical Foundation Models with Domain-Aware GRPO Training

Wei Dai, Peilin Chen, Chanakya Ekbote, Paul Pu Liang

机构 * MIT Media Lab(MIT媒体实验室) MIT EECS(MIT电子工程与计算机科学系)

专题命中 领域大模型 :foundation model(title,abstract);language model(abstract);instruction tuning(abstract);分类 cs.AI、cs.LG

Comments Accepted as Oral at NeurIPS 2025. Revision after camera ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.12217 2025-10-17 cs.CL cs.AI 86%

HALF: Harm-Aware LLM Fairness Evaluation Aligned with Deployment

Ali Mekky, Omar El Herraoui, Preslav Nakov, Yuxia Wang

机构 * Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18630 2025-10-13 cs.CL cs.AI cs.MA 86%

DDO: Dual-Decision Optimization for LLM-Based Medical Consultation via Multi-Agent Collaboration

Zhihao Jia, Mingyi Jia, Junwen Duan, Jianxin Wang

机构 * Hunan Provincial Key Lab on Bioinformatics, School of Computer Science and Engineering, Central South University(湖南生物信息省级重点实验室,计算机科学与工程学院,中南大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted to EMNLP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.01605 2025-10-13 cs.CL cs.AI 86%

Medchain: Bridging the Gap Between LLM Agents and Clinical Practice with Interactive Sequence

Jie Liu, Wenxuan Wang, Zizhan Ma, Guolin Huang, Yihang SU, Kao-Jung Chang, Wenting Chen, Haoliang Li, Linlin Shen, Michael Lyu

机构 * The City University of Hong Kong(香港城市大学) Renmin University of China(中国人民大学) The Chinese University of Hong Kong(香港中文大学) Shenzhen University(深圳大学) National Yang Ming Chiao Tung University(阳明交通大学) Taipei Veterans General Hospital(台北荣民总医院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

Comments Accepted by NeurIPS25 Spotlight

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.05393 2025-10-10 cs.LG cs.AI cs.AR 86%

HiVeGen -- Hierarchical LLM-based Verilog Generation for Scalable Chip Design

Jinwei Tang, Jiayin Qin, Kiran Thorat, Chen Zhu-Tian, Yu Cao, Yang, Zhao, Caiwen Ding

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05087 2025-10-07 cs.CL cs.AI 86%

TeachLM: Post-Training LLMs for Education Using Authentic Learning Data

Janos Perczel, Jin Chow, Dorottya Demszky

机构 * Polygence Stanford University(斯坦福大学)

专题命中 领域大模型 :post-training(title);LLM(abstract);large language model(abstract);language model(abstract)

Comments 28 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏