arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-04 至 2026-06-04 共收录 25 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 25 篇

2606.04846 2026-06-04 cs.CL 92%

Large Language Models in K-12 Education: Alignment with State Curriculum Standards and Student Personas

K-12教育中的大语言模型:与州课程标准和学生角色的对齐

Lisa Korver, Tomo Lazovich, Sherief Reda

机构 * Department of Computer Engineering(计算机工程系) Brown University(布朗大学) Data Science Institute(数据科学研究院)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本研究开发基于LLM的流程评估不同LLM与美国各州历史课程标准的对齐程度,并通过控制用户角色实验分析模型对地理、年级、性别和种族的敏感性,发现模型能调整历史主题呈现但可能源于州政治倾向,且对年级适应良好而对种族性别敏感性低,揭示了LLM与课程标准错位对学生学习的潜在风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04387 2026-06-04 cs.IR cs.AI 92%

Rethinking Sales Lead Scoring with LLM-based Hierarchical Preference Ranking

重新思考基于LLM的分层偏好排名的销售线索评分

Chenyu Zhang, Yiwen Liu, Yin Sun, Xinyuan Zhang, Yuji Cao, Junming Jiao, Juyi Qiao

机构 * Intelligent Business Team, Li Auto Inc.(李自动公司智能商务团队)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对高价值领域销售线索转化问题,提出基于LLM的判别式框架HPRO,通过分层偏好排名优化联合建模结构化与非结构化数据,实现评分与排名性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04727 2026-06-04 cs.IR 91%

EviRank: Evidence-Based Confidence Estimation for LLM-Based Ranking

EviRank: 基于证据的LLM排序置信度估计

Meng Yan, Cai Xv, Xujing Wang, Ziyu Guan, Wei Zhao

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出EviRank方法,通过单次前向传播提取三种互补证据并聚合,结合位置感知校准,实现LLM排序的置信度估计与优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04514 2026-06-04 cs.IR 90%

SAILRec: Steering LLM Attention to Dual-Side Semantically Aligned Collaborative Embeddings for Recommendation

SAILRec: 引导LLM注意力到双端语义对齐的协同嵌入用于推荐

Xi Wu, Jiale Wang, Zihan Wang, Yichen Gao, Xiaocui Yang, Shi Feng, Daling Wang, Yifei Zhang

专题命中 领域大模型 :LLM(title,title_cn);language model(abstract)

AI总结 针对LLM推荐系统中协同嵌入利用不足的问题,提出SAILRec模型,通过双端语义对齐和层次注意力引导,平衡内部语义知识与外部协同知识,在MovieLens-1M和Amazon-Book上优于基线。

Comments 17 pages, including appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05112 2026-06-04 cs.CL 90%

Evaluating Large Language Models in Dynamic Clinical Decision-Making with Standardized Patient Cases

评估大型语言模型在标准化病人案例中的动态临床决策能力

Cheng Liang, Pengcheng Qiu, Ya Zhang, Yanfeng Wang, Chaoyi Wu, Weidi Xie

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn);分类 cs.CL

AI总结 本文提出MedSP1000基准,通过标准化病人案例模拟动态临床交互,评估LLM在信息收集、治疗计划和长期管理中的表现,发现当前模型在过程级评估中远未达到临床安全标准。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29456 2026-06-04 cs.SE cs.HC 88%

Usability Analysis of Configurator User Interfaces with Multimodal Large Language Models

配置器用户界面的可用性分析:基于多模态大语言模型

Sebastian Lubos, Alexander Felfernig, Damian Garber, Adnan Kraljić, Tarik Kraljić, Viet-Man Le, Thi Ngoc Trang Tran, Gerhard Leitner, Julian Schwazer, Doris Suppan, Reinhard Willfort, Ivan Dukic, Jeremias Fuchs, Manuel Henrich

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 本文通过合成18个配置器特定可用性标准,利用多模态大语言模型对16个实际配置器进行半自动化可用性分析,验证了MLLMs能可靠识别问题并提供领域感知改进建议。

Comments Accepted for publication at the International Conference on Software and Systems Reuse, Product Lines, and Configuration (VARIABILITY 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04903 2026-06-04 cs.LO cs.AI cs.MA cs.PL 87%

Provably Auditable and Safe LLM Agents from Human-Authored Ontologies

基于人类编写本体的可审计且安全的LLM智能体

Aaron Sterling

机构 * Thistleseeds

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 提出Agentic Redux架构,通过类型化λ演算证明其在适当领域上的执行语义正确且决策可审计,并引入本体优先的智能体设计方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04118 2026-06-04 cs.CL 87%

Computational conceptual history of scientific concepts: From early digital methods to LLMs

科学概念的计算概念史:从早期数字方法到大语言模型

Michael Zichert, Arno Simons

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract,comments);language model(abstract,comments);分类 cs.CL

AI总结 本文回顾了从早期数字方法到大语言模型的计算概念史方法,分析LLM如何继承旧问题并带来新机遇,重点讨论语料构建、模型选择、操作化及评估解释等挑战。

Comments 19 pages, chapter in the book Understanding Science with Large Language Models? (pp. 383-412). transcript. Edited by Arno Simons, Adrian Wüthrich, Michael Zichert, Gerd Graßhoff (eds.)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04911 2026-06-04 cs.CV cs.CL 84%

BreastGPT: A Multimodal Large Language Model for the Full Spectrum of Breast Cancer Clinical Routine

BreastGPT: 面向乳腺癌临床全流程的多模态大语言模型

Yang Liu, Jiajin Zhang, Danyang Tu, Yaojun Hu, Jiao Qu, Jiuyu Zhang, Yu Shi, Wei Fang, Shi Gu, Ling Zhang, Yingda Xia

机构 * DAMO Academy, Alibaba Group(阿里巴巴集团 DAMO 院) Zhejiang University(浙江大学) Hupan Lab(华潘实验室) West China Hospital(西京医院) China Medical University(中国医科大学)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL

AI总结 提出BreastGPT多模态大语言模型,通过构建工作流对齐的指令语料库BreastStage和双分支视觉编码器,实现乳腺癌筛查、诊断和治疗规划全流程的多模态推理,在BreastStage-Bench上取得75.66%封闭式准确率和89.92%开放式得分。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02914 2026-06-04 cs.AI cs.CL 84%

Large AI Models in Dental Healthcare: From General-Purpose Systems to Domain-Specific Foundation Models

牙科医疗中的大型AI模型:从通用系统到领域特定基础模型

Sema Helali, Lina Abu Nada, Sausan Al Kawas, Alaa Abd-Alrazaq, Faleh Tamimi, Rafat Damseh

机构 * University of Al Ain, UAE(阿联酋阿恩大学) Sharjah University, UAE(阿联酋谢尔杰大学) Cornell University, Qatar(卡塔尔康奈尔大学) McGill University(麦吉尔大学)

专题命中 领域大模型 :foundation model(title,abstract);pretraining(abstract);分类 cs.CL、cs.AI

AI总结 本文通过系统综述,提出二维分类框架,比较语言生成模型、判别视觉基础模型和牙科特定基础模型在牙科任务中的表现,发现集成管道优于单一模型,并指出数据不对称、幻觉和缺乏标准化基准等障碍。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04177 2026-06-04 cs.CL cs.AI 82%

A Systematic Analysis of Linguistic Features in AI-Generated Text Detection Across Domains and Models

跨领域与模型的人工智能生成文本检测中语言特征的系统分析

Yassir El Attar, Esra Dönmez, Maximilian Maurer, Agnieszka Falenska

机构 * Institute for Natural Language Processing, University of Stuttgart(斯图加特大学自然语言处理研究所) Interchange Forum for Reflecting on Intelligent Systems, University of Stuttgart(智能系统反思交流论坛,斯图加特大学) GESIS Leibniz Institute for the Social Sciences(莱比锡社会科学院) Heinrich-Heine University Düsseldorf(杜塞尔多夫海因里希-海涅大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 通过大规模实证研究,系统评估284个可解释语言特征在27个LLM和10个文本领域中的鲁棒性,发现词汇丰富度是跨模型和领域的最可靠信号。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01421 2026-06-04 cs.AI cs.CL 82%

SciDER: Scientific Data-centric End-to-end Researcher

SciDER: 以科学数据为中心的端到端研究者

Ke Lin, Owais Aijaz, Yilin Lu, Yiyang Luo, Xuehang Guo, Preslav Nakov

专题命中 领域大模型 :SFT(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出SciDER多智能体系统,通过数据驱动方法和动态多模态技能系统,自动化科学研究的全生命周期,并在六个基准测试中取得领先结果。

Comments 10 pages, 8 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05002 2026-06-04 cs.CL 81%

GARL: Game-Theoretic Reinforcement Learning for Multi-Agent Strategic Prioritisation

GARL:面向多智能体战略优先级排序的博弈论强化学习

Yuxiao Ye, Yiwen Zhang, Huiyuan Xie, Yuqin Huang, Zhiyuan Liu

机构 * Tsinghua University(清华大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 提出GARL框架,将多智能体战略优先级排序形式化为两阶段博弈,通过博弈论效用转化为角色特定强化信号,优化交互策略,在争议问题排序任务中提升性能并使小型开源LLM与强闭源LLM竞争。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04952 2026-06-04 cs.HC cs.CL 81%

Clinical Assistant for Remote Engagement Link (CARE-link): A Web-Based Electronic Health Records Software for Managing Diabetes

临床远程参与助手(CARE-link):一种用于管理糖尿病的基于网络的电子健康记录软件

Prince Ebenezer Adjei, Joshua Teye Tettey, Toufiq Musah, Audrey Agbeve, John Amuasi

机构 * Global One Health Research Group, Bernhard Nocht Institute of Tropical Medicine(全球健康研究组,伯恩哈德-诺克特热带医学研究所) Global Health and Infectious Diseases Research Group, Kumasi Centre for Collaborative Research in Tropical Medicine(全球健康与传染病研究组,库马西协作热带医学研究中心) Department of Computer Engineering, Kwame Nkrumah University of Science and Technology(计算机工程系,库马西大学科学与技术学院) Department of Global Health, School of Public Health, Kwame Nkrumah University of Science and Technology(全球健康系,公共卫生学院,库马西大学科学与技术学院)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 CARE-link是一个开源、基于网络的临床支持平台,通过LLM介导的工作流程连接临床医生和患者,用于改善妊娠期糖尿病管理,系统汇总院外患者生成数据、提供临床决策支持,并通过WhatsApp界面为患者提供管理计划解释和生活方式指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04909 2026-06-04 cs.IR cs.CL 81%

BEATS: Bootstrapping E-commerce Attribute Taxonomies for Search through Iterative Human-AI Collaboration

BEATS: 通过迭代人机协作引导电商搜索属性分类

Yung-Yu Shih, Shang-Yu Su, Tzu-I Ho, Dongzhe Wang, Yun-Nung Chen

机构 * National Taiwan University(国立台湾大学) Rakuten Group, Inc.(拉肯集团) Taiwan Rakuten Ichiba, Inc.(台湾拉肯Ichiba公司) Rakuten Asia Pte. Ltd.(拉肯亚洲有限公司)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL

AI总结 针对新兴市场电商平台缺乏结构化属性模式的问题,提出BEATS框架,利用人机协作的LLM流水线从零构建产品属性分类,并通过属性标注提升搜索系统性能。

Comments 6 pages, 1 figure, 5 tables. Accepted to SIGIR 2026 Industry Track. Official version: https://doi.org/10.1145/3805712.3808520

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29280 2026-06-04 cs.LG cs.AI cs.IR 81%

LoopFM: Learning frOm HistOrical RePresentations of Foundation Model for Recommendation

LoopFM:从基础模型的历史表示中学习用于推荐

Shali Jiang, Hua Zheng, Boyang Liu, Laming Chen, Kenny Lov, Chuanqi Xu, Lisang Ding, Qinghai Zhou, Can Cui, Xiaolong Liu, Xiaoyi Liu, Yasmine Badr, Xin Xu, Jiyan Yang, Ellie Dingqiao Wen, Gerard Jonathan Mugisha Akkerhuis, Chenxiao Guan, Rong Jin, Ruichao Qiu, Xian Chen, Shifu Xu, Zhehui Zhou, Ping Chen, Rui Yang, Haicheng Chen, Xiangge Meng, Song Zhou, Dharak Kharod, Shuyu Xu, Qiang Jin, Qiao Yang, Wankun Zhu, Qin Huang, Yuzhen Huang, Darren Liu, Parish Aggarwal, Hui Zhou, Erzhuo Wang, Shuo Chang, Xiaorui Gan, Wenlin Chen, Santanu Kolay, Huayu Li

机构 * Meta

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI、cs.LG

AI总结 针对知识蒸馏中传递标量导致转移率下降的问题,提出LoopFM框架,通过将基础模型的中间嵌入作为输入特征传递给下游垂直模型,实现高带宽知识转移,并在理论和实验中证明其有效性。

Comments Shali Jiang, Hua Zheng, Boyang Liu contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.05107 2026-06-04 cs.CV cs.AI 79%

Who Needs Labels? Adapting Vision Foundation Models With the Metadata You Already Have

谁需要标签?利用已有的元数据适应视觉基础模型

Elouan Gardès, Seung Eun Yi, Kartik Ahuja, Théo Moutakanni, Huy V. Vo, Piotr Bojanowski, Wolfgang M. Pernice, Loïc Landrieu, Camille Couprie

机构 * Meta FAIR, Paris(Meta FAIR,巴黎) LIGM, CNRS, Gustave Eiffel, ENPC, IP Paris(LIGM,CNRS,居斯塔夫·艾菲尔,ENPC,IP巴黎) Columbia University, New York(哥伦比亚大学,纽约)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.AI

AI总结 提出一种无标签方法FINO,利用元数据通过自监督学习将通用视觉基础模型适应到专业科学领域,无需任务标签且仅用轻量探针进行监督,在多个领域超越标准无监督和全监督适应方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04613 2026-06-04 cs.CV cs.LG 79%

Beyond Symmetric Alignment: Spectral Diagnostics of Modality Imbalance in Vision-Language Models in the Medical Domain

超越对称对齐:医学领域视觉-语言模型中模态不平衡的光谱诊断

Alessandro Gambetti, Qiwei Han, Cláudia Soares, Hong Shen

机构 * NOVA School of Science and Technology(诺瓦科学与技术学校) Nova School of Business and Economics(诺瓦商业与经济学校) Carnegie Mellon University(卡内基梅隆大学)

专题命中 领域大模型 :language model(title,abstract);分类 cs.LG

AI总结 提出非对称光谱对齐分数(SAS),通过特征值加权的特征模态相关性量化模态信息不平衡,并在医学图像-文本数据集上评估15个VLM,发现医学图像比临床报告保留更丰富的结构信息,且SAS与检索性能的相关性最强。

Comments 10 pages, 3 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19005 2026-06-04 cs.LG cs.AI stat.ME 79%

AgentDS Technical Report: Benchmarking the Future of Human-AI Collaboration in Domain-Specific Data Science

AgentDS技术报告:领域特定数据科学中人机协作的未来基准测试

An Luo, Jin Du, Xun Xian, Robert Specht, Fangqiao Tian, Ganghua Wang, Xuan Bi, Charles Fleming, Ashish Kundu, Jayanth Srinivasa, Mingyi Hong, Rui Zhang, Tianxi Li, Galin Jones, Jie Ding

机构 * School of Statistics, University of Minnesota(明尼苏达大学统计学系) AIScientists, Inc.(AIScientists公司) Data Science Institute, University of Chicago(芝加哥大学数据科学研究所) Carlson School of Management, University of Minnesota(明尼苏达大学卡尔森管理学院) Cisco Research(思科研究) Department of Electrical and Computer Engineering, University of Minnesota(明尼苏达大学电气与计算机工程系) Division of Computational Health Sciences, University of Minnesota(明尼苏达大学计算健康科学 division)

专题命中 领域大模型 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出AgentDS基准测试和竞赛,通过17个跨行业挑战评估AI代理及人机协作在领域特定数据科学中的表现,发现AI代理在领域推理上存在不足,人机协作优于纯AI方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04228 2026-06-04 cs.CE 78%

When Does Structure Help? The Information Bonus of AlphaFold2 Representations over Protein Language Models

结构何时有帮助?AlphaFold2表示相对于蛋白质语言模型的信息增益

Kargi Chauhan

专题命中 领域大模型 :language model(title);foundation model(abstract)

AI总结 提出信息增益(IB)指标,通过对比冻结的AlphaFold2 Evoformer表示和ESM-2嵌入在结合亲和力、构象灵活性和别构位点分类任务上的表现,发现IB强烈依赖于机制,并揭示了残基级别的泄露伪影。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.02403 2026-06-04 cs.CL cs.AI 73%

AutoForest: Automatically Generating Forest Plots from Biomedical Studies with End-to-End Evidence Extraction and Synthesis

AutoForest: 从生物医学研究中自动生成森林图,实现端到端的证据提取与综合

Massimiliano Pronesti, Angelo Miculescu, Mohsin Kapdi, Paul Flanagan, Oisín Redmond, Joao Bettencourt-Silva, Gurdeep Mannu, Spiros Denaxas, Rui Bebiano Da Providencia E Costa, Anya Belz, Yufang Hou

机构 * IBM Research(IBM研究院) Dublin City University(都柏林城市大学) UCL(伦敦大学学院) University of Oxford(牛津大学) IT:U Interdisciplinary Transformation University Austria(奥地利 interdisciplinary Transformation 大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 提出AutoForest系统,通过端到端的证据提取与统计综合,直接从生物医学论文自动生成可发表的森林图,加速证据综合并降低元分析门槛。

Comments Accepted to ACL2026 (System Demonstrations Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12784 2026-06-04 cs.CL cs.LO 70%

Evaluating Autoformalization Robustness via Semantically Similar Paraphrasing

通过语义相似改写评估自动形式化鲁棒性

Hayden Moore, Asfahan Shah

机构 * Department of Computer Science and Engineering, The Pennsylvania State University(宾夕法尼亚州立大学计算机科学与工程系)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文通过语义相似改写生成自然语言变体,评估大语言模型在自动形式化中生成形式证明的鲁棒性,发现自然语言表述的微小变化会显著影响模型输出。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06525 2026-06-04 cs.CY cs.AI 70%

From Motion Signals to Insights: A Unified Framework for Student Behavior Analysis and Feedback in Physical Education Classes

从运动信号到洞察:体育课堂学生行为分析与反馈的统一框架

Xian Gao, Jiacheng Ruan, Jingsheng Gao, Mingye Xie, Zongyun Zhang, Ting Liu, Yuzhuo Fu

机构 * Shanghai Jiao Tong University(上海交通大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一个基于运动信号和大型语言模型的端到端统一框架,用于体育课堂学生行为分析,自动生成教学洞察和改进建议。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04448 2026-06-04 cs.IR 67%

Bridging Short Videos and Live Streams: Reasoning-Guided Multimodal LLMs for Cross-Domain Representation Learning

连接短视频与直播:推理引导的多模态大语言模型用于跨域表示学习

Le Zhang, Xiaolan Zhu, Yuchen Wang, Shilong Kang, Jiaqi Xue, Xiaoyu Zhang, Xiang Chen, Yalong Guan, Xiangyu Wu, Shijun Wang, Lantao Hu, Kun Gai

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 针对短视频到直播的跨域推荐冷启动问题,提出推理引导的跨域表示学习框架RGCD-Rep,利用多模态大语言模型生成结构化推理知识并蒸馏到轻量模型,通过两阶段训练学习可迁移的物品表示,在快手部署后显著提升核心业务指标。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04365 2026-06-04 cs.CV cs.AI 57%

Multi-Granularity 3D Kidney Lesion Characterization from CT Volumes

多粒度3D肾脏病变特征提取来自CT体积

Renjie Liang, Zhengkang Fan, Jinqian Pan, Chenkun Sun, Jiang Bian, Russell Terry, Jie Xu

机构 * Department of Health Outcomes and Biomedical Informatics, University of Florida(健康结果与生物医学信息学系,佛罗里达大学) Department of Urology, University of Florida(泌尿外科,佛罗里达大学) Department of Biostatistics and Health Data Science, Indiana University School of Medicine(生物统计学与健康数据科学系,印第安纳大学医学院) Center of Biomedical Informatics(生物医学信息学中心)

专题命中 领域大模型 :pretraining(abstract);分类 cs.AI

AI总结 提出LesionDETR,一种基于DETR的架构,通过大小距离匈牙利匹配和分层损失,实现从CT体积中按病变预测四个临床属性,在双侧异常检测上达到AUC 0.799。

详情

展开后加载摘要…

URL PDF HTML 收藏