arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-03 至 2026-07-03 共收录 23 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 23 篇

2607.01242 2026-07-03 cs.HC cs.AI cs.CL cs.IR 新提交 92%

ExPerT: Personalizing LLM Responses to Users' Domain Expertise via Query-Wise Semantic and Keystroke Behavioral Cues

ExPerT: 通过查询级语义和击键行为线索个性化LLM对用户领域专业知识的响应

Yeji Park, Jiwon Tark, Taesik Gong

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 提出ExPerT框架,结合语义和击键行为线索推断用户查询级专业知识,动态调整LLM响应细节和复杂度,实验表明专业知识推断误差降低65.7%,响应满意度提升17.52%。

Comments Accepted to ACL 2026 (Main, Long)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02118 2026-07-03 cs.AI 新提交 92%

Enhancing Fitness Intelligence through Domain-Specific LLM Post-Training

通过领域特定的大语言模型后训练增强健身智能

Xingtao Zhao, Tian Yang, Han Jiang

机构 * School of Cyber Science and Technology(网络科学与技术学院) Beihang University(北京航空航天大学) School of Information(信息学院) Renmin University of China(中国人民大学)

专题命中 领域大模型 :LLM(title,abstract);post-training(title,abstract);large language model(abstract);language model(abstract)

AI总结 针对通用大语言模型在科学健身教练中领域知识不足的问题,提出FitOne系列模型,通过三阶段后训练(持续预训练、监督微调、强化学习)提升专业能力,在ACSM-EP和NSCA-CSCS考试中平均提升最高12.73%。

Comments 8 pages, 6 tables, 2 figures. Accepted by the 12th International Conference on Big Data Computing and Communications (BigCom 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.05953 2026-07-03 cs.CY 版本更新 91%

SCALEFeedback: A Large-Scale Dataset of Synthetic Computer Science Assignments for LLM-generated Educational Feedback Research

SCALEFeedback:用于LLM生成教育反馈研究的大规模合成计算机科学作业数据集

Keyang Qian, Kaixun Yang, Wei Dai, Flora Jin, Yixin Cheng, Rui Guan, Sadia Nawaz, Zachari Swiecki, Guanliang Chen, Lixiang Yan, Dragan Gašević

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出SCALEFeedback数据集,包含10,000份合成学生作业,覆盖59门大学计算机科学课程,用于开发基于LLM的可泛化自动教育反馈方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12317 2026-07-03 cs.CL 版本更新 91%

Large language models reshape the language of science

大型语言模型重塑科学语言

Dingkang Lin, Naixuan Zhao, Dan Tian, Jiang Li

机构 * School of Information Management, Nanjing University(南京大学信息管理学院) School of Economics and Management, Shanxi University(山西大学经济管理学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.CL

AI总结 通过分析2020-2024年间2136万篇摘要,发现LLM导致科学写作词汇复杂度上升、句法复杂度下降,且对非英语母语学者影响更大,可能扩大科学话语与公众语言的差距。

Comments 72 pages, 24 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01585 2026-07-03 cs.LO cs.AI cs.CL 新提交 90%

ADVENT: LLM-Driven Automatic Predicate Invention for ILP

ADVENT: 基于LLM的归纳逻辑编程自动谓词发明

Tingting Yu, Pei-Cing Huang, Chan Hsu, Chan-Tung Ku, Yihuang Kang

机构 * Department of Information Management(信息管理系) National Sun Yat-Sen University(国立成功大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出ADVENT机制,利用大语言模型生成候选谓词并通过Prolog验证迭代优化,实现自动谓词发明,在扑克牌数据集上显著提升ILP成功率并支持跨任务知识复用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.02964 2026-07-03 cs.CL cs.AI cs.CR cs.LG 版本更新 90%

Less Data, More Security: Advancing Cybersecurity LLMs Specialization via Resource-Efficient Domain-Adaptive Continuous Pre-training with Minimal Tokens

更少数据,更多安全:通过最小令牌的资源高效领域自适应持续预训练推进网络安全LLM专业化

Salahuddin Salahuddin, Ahmed Hussain, Jussi Löppönen, Toni Jutila

机构 * SSH Communications Security(SSH通讯安全公司) KTH Royal Institute of Technology(皇家理工学院) Aalto University(阿尔托大学)

专题命中 领域大模型 :LLM(title_cn,summary_cn);large language model(abstract);language model(abstract);pretraining(abstract)

AI总结 提出资源高效的领域自适应持续预训练方法,利用分布式FSDP流水线在126M词网络安全语料上微调LLM,以最少118.8M令牌实现超越大规模预训练模型的最新性能。

Comments 19 Pages; Updated content and authors list

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12865 2026-07-03 cs.HC 版本更新 89%

DashChat: Interactive Authoring of Performance Dashboard Design Prototypes through Conversation with LLM-Powered Agent

DashChat: 通过与LLM驱动的智能体对话交互式创作性能仪表盘设计原型

Z. Lin, S. Shen, W. Liu, C. Xin, W. Dai, S. Chen, X. Wen, X. Lan

专题命中 领域大模型 :LLM(title,title_cn)

AI总结 提出DashChat系统,通过LLM驱动的多智能体管道将文本需求转化为性能仪表盘原型,加速迭代并保证设计质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01951 2026-07-03 physics.soc-ph cs.AI cs.CL 新提交 89%

Robust for the Wrong Reasons: The Representational Geometry of LLM Robustness to Science Skepticism

鲁棒性源于错误原因:LLM对科学怀疑论鲁棒性的表征几何

Minjong Cheon

机构 * Department of Computer Science and Engineering, Sejong University(信息科学与工程系,世宗大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 通过行为测量、线性探针和激活修补,研究三个指令调优模型在气候、疫苗和进化三个科学共识领域对怀疑论的反应,发现模型表现出三种不同策略而非谄媚退缩,且鲁棒性不跨领域转移。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.07706 2026-07-03 cs.AI 84%

FHIR-RAG-MEDS: Integrating HL7 FHIR with Retrieval-Augmented Large Language Models for Enhanced Medical Decision Support

FHIR-RAG-MEDS:整合HL7 FHIR与检索增强型大语言模型以提升医疗决策支持

Yildiray Kabak, Gokce B. Laleci Erturkmen, Mert Gencturk, Tuncay Namli, A. Anil Sinaci, Ruben Alcantud Corcoles, Cristina Gomez Ballesteros, Pedro Abizanda, Asuman Dogac

机构 * SRDC Software Research & Development and Consultancy Corporation(SRDC软件研究与开发及咨询公司) Geriatrics Department, Complejo Hospitalario Universitario de Albacete(阿尔巴塞特大学医院老年科) CIBER de Fragilidad y Envejecimiento Saludable (CIBERFES), Instituto de Salud Carlos III(健康与衰老促进CIBERFES,卡洛斯三世卫生研究所) Facultad de Medicina de Albacete, Universidad de Castilla-La Mancha(阿尔巴塞特大学医学学院,卡斯蒂利亚-拉曼查大学)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.AI

AI总结 本文提出FHIR-RAG-MEDS系统,旨在整合HL7 FHIR与基于RAG的系统,提升基于循证临床指南的个性化医疗决策支持,强调实际应用中的研究需求。

Comments 23 pages, submitted to Journal AI specifically to the special issue "LLMs and AI Agents in Biomedical and Health Sciences", under review

Journal ref AI as part of the Special Issue LLMs and AI Agents in Biomedical and Health Sciences, 2 July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02175 2026-07-03 cs.AI cs.LG 新提交 84%

A rubric-based controlled comparison of frontier language models on expert-authored clinical reasoning tasks

基于评分量表的专家级临床推理任务中前沿语言模型的受控比较

Samiha A. Ismail, Fan X. Chen, Ali Merali

机构 * Prime Analytics Consulting Limited(普林特分析咨询有限公司) Talbert House(塔尔伯特大楼;托马斯·莫尔大学) Thomas More University(MAKZ) MAKZ

专题命中 领域大模型 :language model(title);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 通过5个专家编写的临床场景和加权评分量表,评估GPT、Claude和Gemini三个前沿模型,发现关键标准通过率低(32-42%),而低权重标准通过率高(80-90%),52%的关键标准无模型通过。

Comments 13 pages, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01431 2026-07-03 cs.CL cs.AI 新提交 82%

IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning versus Knowledge Retrieval in LLMs

IsoSci: 用于评估LLM中推理与知识检索的同构跨域科学问题基准

Samir Abdaljalil, Erchin Serpedin, Hasan Kurban

机构 * Texas A&M University(德克萨斯农工大学) Hamad Bin Khalifa University(哈马德·本·哈利法大学)

专题命中 领域大模型 :LLM(title_cn,abstract);分类 cs.CL、cs.AI

AI总结 提出IsoSci基准,通过逻辑结构相同但领域知识不同的科学问题对,分离推理能力与领域知识检索,发现91.3%的推理增益依赖于知识而非结构,挑战了思维链推理提升科学问题解决的假设。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01960 2026-07-03 cs.CL 新提交 77%

NAVER LABS Europe Submission to the Instruction-following 2026 Short Track

NAVER LABS Europe 对指令遵循 2026 短轨道的提交

Marcely Zanon Boito, Hemant Yadav, Jean-Luc Meunier, Ioan Calapodescu

机构 * NAVER LABS Europe IIIT Delhi(印度德里国际信息技术学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.CL

AI总结 提出SpeechMapper语音投影器和合成SQA数据集fakACL,在更紧凑模型上实现ASR、ST和SQA联合处理,获得IWSLT 2026短轨道并列第一。

Comments IWSLT 2026 system paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01440 2026-07-03 cs.CL 新提交 77%

FaithMed: Training LLMs For Faithful Evidence-Based Medical Reasoning

FaithMed: 训练大语言模型进行忠实于证据的医学推理

Zhiyun Zhang, Liwen Sun, Xiang Qian, Chenyan Xiong

机构 * Carnegie Mellon University(卡内基梅隆大学) Stanford University School of Medicine(斯坦福大学医学院) Xlue

专题命中 领域大模型 :LLM(summary_cn,abstract_cn);分类 cs.CL

AI总结 提出FaithMed框架,通过过程级奖励和优势分组强化学习,监督LLM在医学推理中忠实评估和应用检索证据,在7个基准上平均提升9%。

Comments 15 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26957 2026-07-03 cs.CY cs.AI 77%

Simulating Validity: Modal Decoupling in MLLM Generated Feedback on Science Drawings

模拟有效性:在MLLM生成的科学图表反馈中的模态解耦

Arne Bewersdorff, Nejla Yuruk, Xiaoming Zhai

机构 * University of Georgia, AI4STEM Education Center(佐治亚大学AI4STEM教育中心) Gazi University, Department of Mathematics and Science Education(加齐大学数学与科学教育系)

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI

AI总结 研究探讨了多模态大语言模型生成的科学图表反馈中模态解耦问题,发现反馈常存在 grounding 失败,表明需超越常规提示策略的 grounding 机制。

Comments Accepted as AIED Short Paper 2026, Seoul, South Korea. Submission #1147. This is the long paper version

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01800 2026-07-03 cs.LG cs.CL 新提交 73%

Do LLMs Truly Generalize in the Molecular Domain? A Perturbation-Based Analysis

LLMs 在分子领域真的能泛化吗?基于扰动的分析

Jiatong Li, Weida Wang, Changmeng Zheng, Shufei Zhang, Yatao Bian, Xiao-yong Wei, Qing Li

机构 * The Hong Kong Polytechnic University(香港理工大学) National University of Singapore(新加坡国立大学) Shanghai AI Lab(上海人工智能实验室) Fudan University(复旦大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 提出分子扰动框架,通过控制图编辑距离生成结构变体,揭示分子LLMs对微小结构变化敏感,局部信任区域狭窄;上下文调优可部分缓解脆弱性。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17949 2026-07-03 cs.CL cs.AI 73%

CUICurate: A GraphRAG-based Framework for Automated Clinical Concept Curation for NLP applications

CUICurate:一种基于图RAG的框架,用于自然语言处理应用中的临床概念整理

Victoria Blake, Jamie Novak, Mathew Miller, Sze-yuan Ooi, Blanca Gallego

机构 * Centre for Big Data Research in Health, University of New South Wales(健康大数据研究中心,新南威尔士大学) Eastern Heart Clinic, Prince of Wales Hospital(东部心脏诊所,王室医院) NSW Ambulance Aeromedical Operations, Bankstown Helicopter Base(新南威尔士州急救航空医疗运作,班克stown直升机基地) Department of Anaesthesia, Saint George Hospital(麻醉科,圣乔治医院) Department of Cardiology, Prince of Wales Hospital(心内科,王室医院) School of Clinical Medicine, University of New South Wales(临床医学学院,新南威尔士大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文提出CUICurate框架,利用图RAG技术自动整理UMLS概念集,通过知识图谱和大语言模型实现高效准确的概念分类与过滤,提升临床NLP任务的实用性。

Comments 6 figures, 4 tables

Journal ref Journal of the American Medical Informatics Association, 2026;, ocag110

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13191 2026-07-03 physics.comp-ph cond-mat.mtrl-sci cs.AI 版本更新 70%

From Experiments to Expertise: Scientific Knowledge Consolidation for AI-Driven Computational Physics

从实验到专长:面向AI驱动计算物理的科学知识巩固

Haonan Huang

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出QMatSuite平台,通过记录、检索和反思机制巩固计算材料科学中的知识,减少推理开销并提高模拟准确性。

Comments v2: camera-ready version, accepted at the ICML 2026 Workshop on AI for Physics (AI4Physics@ICML 2026). 20 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01659 2026-07-03 astro-ph.IM 67%

Development of a Retrieval-Augmented Generation Virtual Assistant for Enhanced Information Discovery at Rubin Observatory

开发用于鲁宾天文台增强信息发现的检索增强生成虚拟助手

Leanne P. Guy, Connor Yablonski, Aaron M. Meisner, Guillem Megias Homar, Merlin Fisher-Levine, Eman E. Ali, Tiger J. Hu, Christopher W. Stubbs

专题命中 领域大模型 :LLM(abstract);language model(abstract)

AI总结 针对鲁宾天文台数据及文档分散、信息难定位问题,探索用检索增强生成(RAG)改进信息发现,构建基于RAG的虚拟助手,整合多源材料,经多工具实现语义搜索,提升信息获取准确性等。

Comments 15 pages, 2 figures, SPIE AS113: Observatory Operations, Copenhagen 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01456 2026-07-03 cs.SE 新提交 67%

From Anatomy to Smells: An Empirical Study of SKILL.md in Agent Skills

从解剖到气味:Agent技能中SKILL.md的实证研究

David Boram Hong, Aaron Imani, Iftekhar Ahmed

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 对238个真实Agent技能的SKILL.md文件进行定性分析,构建语义组件分类法,通过多源文献综述识别最佳实践并定义技能气味,开发自动检测器发现超过99%的文件存在气味且难以消除。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01244 2026-07-03 cs.IR cs.CY 新提交 67%

Retrieval-Augmented Generation to Support Railways Engineering Tasks: A Case Study

检索增强生成支持铁路工程任务:案例研究

Andrea Gerardo Russo, Federico Ruggeri, Ivan Tomarchio, Davide Bombini, Nicolò Donati, Gianmarco Pappacoda, Paolo Torroni, Giuseppe-Emiliano La Cara

专题命中 领域大模型 :LLM(abstract,abstract_cn)

AI总结 本文通过案例研究,展示了从设计到部署构建检索增强生成系统,用于铁路领域复杂技术法规的咨询,平衡技术能力与领域专业知识。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.15427 2026-07-03 cs.SE 版本更新 67%

TVR: Automotive System Requirement Traceability Validation and Recovery Through Retrieval-Augmented Generation

TVR:通过检索增强生成实现汽车系统需求可追溯性验证与恢复

Feifei Niu, Rongqi Pan, Lionel C. Briand, Hanyang Hu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 提出TVR方法,利用大语言模型和检索增强生成技术,验证和恢复汽车系统中利益相关者需求与系统需求之间的可追溯性链接,实验证明其在工业环境中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01657 2026-07-03 cs.CV 新提交 50%

Domain Generalization via Text-Anchored Information Bottleneck

基于文本锚定信息瓶颈的域泛化

Eunyi Lyou, Yunjeong Choi, Junho Lee, Joonseok Lee

机构 * Seoul National University(首尔大学)

专题命中 领域大模型 :language model(abstract)

AI总结 提出通过语言嵌入空间作为信息瓶颈来抑制视觉表征中的虚假线索,从而提升域泛化性能,实验表明该方法达到最新最优水平。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.04101 2026-07-03 cs.CV 版本更新 50%

NEARL: Interacted Query Adaptation with Orthogonal Regularization for Medical Vision-Language Understanding

NEARL: 基于正交正则化的交互式查询自适应用于医学视觉-语言理解

Zelin Peng, Yichen Zhao, Yu Huang, Piao Yang, Feilong Tang, Zhengqin Xu, Xiaokang Yang, Wei Shen

机构 * MoE Key Lab of Artificial Intelligence(人工智能MOE实验室) AI Institute(人工智能研究院) School of Computer Science(计算机科学学院) Shanghai Jiao Tong University(上海交通大学) Department of Radiology(放射科) The First Affiliated Hospital(第一附属医院) School of Medicine(医学院) Zhejiang University(浙江大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) State Key Laboratory of Infrared Physics(红外物理国家重点实验室) Shanghai Institute of Technical Physics(上海技术物理研究所) Chinese Academy of Science(中国科学院)

专题命中 领域大模型 :language model(abstract)

AI总结 提出NEARL框架,通过统一协同嵌入变换器(USEformer)和正交交叉注意力适配器(OCA)实现双向跨模态交互,仅引入1.46M参数,在三个医学影像数据集上取得最先进性能。

详情

展开后加载摘要…

URL PDF HTML 收藏