arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-09 至 2026-07-09 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 18 篇

2603.15245 2026-07-09 cs.CL cs.HC 版本更新 90%

Practicing with Language Models Cultivates Human Empathic Communication

与语言模型练习培养人类共情沟通

Aakriti Kumar, Nalin Poungpeth, Diyi Yang, Bruce Lambert, Matthew Groh

机构 * Kellogg School of Management, Northwestern University(西北大学凯洛格管理学院) Northwestern Institute for Complex Systems, Northwestern University(西北大学复杂系统研究所) Ryan Institute on Complexity, Northwestern University(西北大学复杂性研究院) Department of Computer Science, Stanford University(斯坦福大学计算机科学系) Department of Communication Studies, Northwestern University(西北大学传播学系) Department of Computer Science, Northwestern University(西北大学计算机科学系)

专题命中 领域大模型 :LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 研究通过实验平台探讨共情沟通技能的提升,发现简短的LLM指导干预能有效提升参与者与规范共情沟通模式的匹配度,并发现沉默共情效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06748 2026-07-09 cs.SE cs.AI 新提交 88%

SmartHomeSecure: Automated Detection and Repair of Smart Home Configuration Errors Using Large Language Models

智能家居安全:使用大语言模型自动检测和修复智能家居配置错误

Yizhi Wang, Xinghua Gao, Reachsak Ly, Alireza Shojaei

机构 * Myers-Lawson School of Construction, Virginia Polytechnic Institute and State University(Myers-Lawson工程学院,弗吉尼亚理工学院和州立大学) School of Technology, Eastern Illinois University(技术学院,东伊利诺伊大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 研究智能家居配置文件错误问题,提出SmartHomeSecure原型,结合轻量级程序分析与约束引导大语言模型生成,实现自动检测与修复,经实验评估,四个模型测试结果显示该方法能有效提高智能家居配置修复的可靠性和可用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12015 2026-07-09 cs.CL 88%

Disentangling Ambiguity from Instability in Large Language Models: A Clinical Text-to-SQL Case Study

解构大型语言模型中的歧义与不稳定性:一项临床文本到SQL的案例研究

Angelo Ziletti, Leonardo D'Ambrosi

机构 * Bayer AG(勃林格殷曼集团)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出CLUES框架,通过将文本到SQL分解为两个阶段(解释->答案)来区分输出多样性两种不同原因:输入歧义和模型不稳定性,并在临床文本到SQL基准测试中提高了故障预测性能。

Journal ref In Proceedings of the 8th Workshop on Clinical Natural Language Processing (Clinical NLP) @ LREC 2026 (pp. 369-380). European Language Resources Association (ELRA)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07673 2026-07-09 cs.CV cs.LG 新提交 85%

MedPMC: A Systematic Framework for Scaling High-Fidelity Medical Multimodal Data for Foundation Models

MedPMC:一种用于为基础模型扩展高保真医学多模态数据的系统框架

Hyunjae Kim, Dain Kim, Pan Xiao, Serina S. Applebaum, Younjoon Chung, Xuguang Ai, Yu Yin, Roy Jiang, Yuexi Du, Yawen Wei, Yiming Kong, Tuo Guo, Zhiyuan Cao, Mengmeng Du, Yuelei Fu, Yan Hu, Rui Shi, Gui Yang, Kevin W. Jin, Yuntian Liu, Yuxuan Tian, Jonathan Marquez, Zhen Chen, Sheng Zhang, Hoifung Poon, Hua Xu, Jaewoo Kang, Qingyu Chen

机构 * Yale University(耶鲁大学) Korea University(韩国大学) Washington University in St. Louis(圣路易斯华盛顿大学) The University of Queensland(昆士兰大学) The University of Texas Health Science Center at Houston(德克萨斯大学休斯顿健康科学中心) University of Washington(华盛顿大学) Microsoft Research(微软研究院)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对医学多模态基础模型受高质量临床数据限制问题,提出MedPMC框架,将文献转化为高保真基础设施。经实验,该框架整理大量图像-文本对,在多方面评估表现出色,训练模型在多基准测试和临床场景中效果显著,还公开相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07504 2026-07-09 cs.AI 新提交 83%

Do LLM-Generated Skills Make Better AI Data Scientists? A Component Ablation Across Data-Science Workflows

大语言模型生成的技能能否造就更好的人工智能数据科学家?跨数据科学工作流程的组件消融

Wei-Jung Huang

机构 * Independent Researcher(独立研究者)

专题命中 领域大模型 :LLM(title,abstract);prompting(abstract);分类 cs.AI

AI总结 研究大语言模型生成的技能在数据科学工作流程中的作用,通过在四个阶段测试及组件消融实验发现,完整生成技能及消融后的技能变体与任务单独提示相比,均未显著提升性能,提醒勿将其作为默认单次提示策略。

Comments KDD 2026 Workshop on AI Data Scientist

Journal ref KDD 2026 Workshop on AI Data Scientist

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.25370 2026-07-09 cs.CL 版本更新 83%

Monitoring Transformative Technological Convergence Through LLM-Extracted Semantic Entity Triple Graphs

通过大语言模型提取的语义实体三元组图监测变革性技术融合

Alexander Sternfeld, Andrei Kucharavy, Dimitri Percia David, Alain Mermoud, Julian Jang-Jaccard, Nathan Monnet

机构 * Institute of Entrepeneurship and Management, HES-SO(企业家精神与管理研究所) Cyber-Defence Campus, armasuisse, Science and Technology(网络安全校园,armasuisse,科学技术)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究如何监测变革性技术融合,利用大语言模型从非结构化文本提取语义三元组构建图,通过新方法和指标检测融合信号,经多阶段处理,在两个数据集验证,能识别融合模式,提供技术预测框架。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07379 2026-07-09 cs.AI cs.LG 新提交 82%

Physics-Audited Agentic Discovery in Scientific Machine Learning

科学机器学习中的物理审核智能发现

Diab W. Abueidda, Bilal Ahmed, Panos Pantidis, Mostafa E. Mobasher

机构 * New York University Abu Dhabi(纽约大学阿布扎比分校) National Center for Supercomputing Applications, University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校国家超级计算应用中心)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究针对智能科学机器学习中替代模型选择问题,提出物理审核智能SciML工作流程,先确定评分评估器,推导物理要求并检查候选者输出,搜索违规情况。通过数值示例验证,该方法能选到满足物理条件的替代模型,区别于仅靠综合分数的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06913 2026-07-09 cs.CY 新提交 82%

Evaluating LLM Robustness Under Domain-Specific Prompt Perturbations in Public Health Applications

在公共卫生应用中评估特定领域提示扰动下的大语言模型稳健性

Chuqing Zhao, Haochen Yang

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract)

AI总结 研究公共卫生应用中LLMs对特定领域提示扰动的稳健性,提出特定领域稳健性基准,通过错误信息框架和外行重写两种扰动类型评估,揭示两种部署风险,强调需超越干净基线基准进行扰动感知稳健性评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06626 2026-07-09 cs.LG q-bio.NC 新提交 79%

Reward Valuation in Vision Language Models: Causal Mechanisms Underlying Anhedonia

视觉语言模型中的奖励估值:快感缺乏背后的因果机制

Melika Honarmand, Samin Mahdipour Aghabagher, Martin Schrimpf

机构 * EPFL(苏黎世联邦理工学院)

专题命中 领域大模型 :language model(title,abstract);分类 cs.LG

AI总结 研究探讨视觉语言模型中奖励估值情况,基于神经科学观点,通过有针对性扰动识别奖励预期单元,测试其因果作用,发现模型存在奖励估值和预期缺陷,结果反映了人工智能模型与人类平行的奖励估值回路。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24978 2026-07-09 cs.AI cond-mat.quant-gas quant-ph 70%

Agentic Exploration of Physics Models

物理模型的智能体探索

Maximilian Nägele, Florian Marquardt

机构 * Max Planck Institute for the Science of Light(马克斯·普朗克光科学研究所)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出 SciExplorer 智能体,利用大语言模型工具使用能力,无需领域特定蓝图即可探索未知物理系统,通过实验和观测恢复运动方程和哈密顿量。

Journal ref Maximilian Nägele and Florian Marquardt, 2026 Phys. Rev. X 16, 031002

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.25605 2026-07-09 cs.IR cs.AI cs.DB 版本更新 70%

Health System Scale Semantic Search Across Unstructured Clinical Notes

跨无结构临床笔记的健康系统规模语义搜索

Faith Wavinya Mutinda, Spandana Makeneni, Anna Lin, Shivaji Dutta, Irit R. Rasooly, Patrick Dibussolo, Shivani Kamath Belman, Hessam Shahriari, Kevin Murphy, Alex B. Ruan, Barbara H. Chaiyachati, Sanjay Chainani, Robert W. Grundmeier, Scott M. Haag, Jeffrey M. Miller, Heather M. Griffis, Ian M. Campbell

机构 * Department of Biomedical and Health Informatics, Children’s Hospital of Philadelphia(儿童医院哲学学院生物医学与健康信息学系) Google Cloud(谷歌云) Department of Pediatrics, University of Pennsylvania(宾夕法尼亚大学儿科系) Division of Neonatology, Children’s Hospital of Philadelphia(儿童医院哲学学院新生儿科) Division of Human Genetics, Children’s Hospital of Philadelphia(儿童医院哲学学院人类遗传学部)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出了一种在大规模健康系统中实现语义搜索的解决方案,通过优化嵌入模型和分块策略,实现了亚秒级查询延迟和高准确率的临床问答任务,同时展示了在临床实用性评估中减少任务完成时间的效果。

Comments For associated code, see https://github.com/Ian-Campbell-Lab/clinical-semantic-search

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20995 2026-07-09 cs.CY 新提交 67%

From inference to prediction: how machine learning is reconfiguring science

从推理到预测:机器学习如何重构科学(1990-2025)

Malena Mendez Isla, Vincent Lariviere, Diego Kozlowski

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 通过分析490万篇论文,揭示机器学习从物理科学向健康科学扩散,预测技术取代推理方法,引发两波认知不透明性浪潮。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07401 2026-07-09 cs.CV cs.AI cs.LG 新提交 62%

Heterogeneity-Adaptive Diffusion Schrodinger Bridge for PET-Guided Whole-Body MRI Translation

用于PET引导的全身MRI转换的异质性自适应扩散薛定谔桥

Chengbo Wang, Jiacheng Yu, Linjie Bian, Ming Qi, Xiaosheng Liu, Tongtong Che, Jichang Zhang, Shuyu Li, Shaoli Song, Xiuying Wang

机构 * The University of Sydney(悉尼大学) Fudan University Shanghai Cancer Center(复旦大学附属上海肿瘤医院) Beijing Normal University(北京师范大学)

专题命中 领域大模型 :language model(abstract);分类 cs.AI、cs.LG

AI总结 针对PET-MR扫描时间长的问题,提出异质性自适应扩散薛定谔桥(HA-DSB)框架,通过整合视觉语言模型嵌入及PET先验,利用双阶段引导机制,实现全身MRI转换,提升不同区域尤其是病变区域的转换质量。

Comments Accepted at MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07676 2026-07-09 cs.AI 新提交 57%

SkillCenter: A Large-Scale Source-Grounded Skill Library for Autonomous AI Agents

SkillCenter:用于自主人工智能代理的大规模源基础技能库

Tianming Sha, Yue Zhao, Lichao Sun, Yushun Dong

机构 * Stony Brook University(纽约州立大学石溪分校) University of Southern California(南加州大学) Lehigh University(里海大学) Florida State University(佛罗里达州立大学)

专题命中 领域大模型 :LLM(abstract);分类 cs.AI

AI总结 研究针对自主AI代理缺乏扎实操作知识的问题,构建SkillCenter技能库,通过多源获取等端到端框架,集成大量源基础和社区技能,实现技能可追溯,以保障代理输出的正确性、安全性和可维护性。

Comments 44 pages, 5 figures. Code: https://github.com/LabRAI/SkillCenter ; Data: https://huggingface.co/datasets/Tommysha/skillcenter-bundles

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07179 2026-07-09 cs.CV cs.LG 新提交 57%

Comparative Study of Domain-adapted VLMs for General Document Visual Question Answering

用于通用文档视觉问答的领域适应视觉语言模型的比较研究

Miguel Lopez-Duran, Elena Marrero, Julian Fierrez, Marta Robledo-Moreno, Ruben Vera-Rodriguez, Daniel DeAlcala, Aythami Morales, Ruben Tolosana, Oscar Delgado, Alvaro Ortigosa, Javier Ortega-Garcia

机构 * Universidad Autónoma de Madrid (UAM)(马德里自治大学) BiometricsAI(生物识别人工智能)

专题命中 领域大模型 :language model(abstract);分类 cs.LG

AI总结 研究对8个开源预训练VLMs在三种文档领域的DocVQA进行全面评估,通过多种评估方式发现其在不同布局性能有差异,参数缩放影响性能,视觉理解是瓶颈,还表明少样本微调能让模型快速适应目标域文档。

Comments 17 pages, 4 figures, accepted at the Automatically Domain-Adapted and Personalized Document Analysis workshop of the ICDAR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07073 2026-07-09 cs.HC 新提交 50%

ShapeTalk: Combining Natural Language and Sketch for Time-Series Pattern Querying

ShapeTalk:结合自然语言和草图进行时间序列模式查询

Guoruizhe Sun, Yueqiao Chen, Emily Guo, Yutong Yao, Dongyu Liu

专题命中 领域大模型 :LLM(abstract)

AI总结 研究针对时间序列模式查询中现有工具不足的问题,提出ShapeTalk系统,结合自然语言与草图,通过基于大语言模型的语义解析管道实现查询,经多种评估表明该系统能有效支持时间序列模式搜索,自然语言与草图互补。

Comments 10 pages of main text, 2 pages of references, and 20 pages of appendices

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06613 2026-07-09 cs.SE 新提交 50%

Pre-Training on Software Engineering Texts: Effects on Domain Adaptation and General-Language Understanding

软件工程文本的预训练:对领域适应和通用语言理解的影响

Fabian C. Peña, Steffen Herbold

专题命中 领域大模型 :language model(abstract)

AI总结 研究如何让语言模型适应软件工程文本,比较持续预训练和从头预训练,评估领域适应和通用语言理解。发现重用现有模型占优,CPT领域收益小,PTS代价大,还给出实用指南并发布相关资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12315 2026-07-09 econ.GN q-fin.EC 版本更新 50%

Deciphering the global production network from cross-border firm transactions

从跨境公司交易中解读全球生产网络

Neave O'Clery, Ben Radcliffe-Brown, Thomas Spencer, Daniel Tarling-Hunter

专题命中 领域大模型 :LLM(abstract)

AI总结 该研究利用国际公司层面交易数据,通过转化为有向网络,分析全球生产网络,发现产品分类、主导国家,揭示工业复杂性与供应链关系及前后向联系的预测作用,还找到与AIPNET的相似性及特定供应链的强联系。

详情

展开后加载摘要…

URL PDF HTML 收藏