arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-23 至 2026-07-23 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 14 篇

2604.19598 2026-07-23 cs.CL cs.AI 91%

Cross-Model Consistency of AI-Generated Exercise Prescriptions: A Repeated Generation Study Across Three Large Language Models

跨模型一致性分析:AI生成运动处方的重复生成研究:在三个大型语言模型间

Kihyuk Lee

机构 * Data Convergence Team, Office of Hospital Information, Seoul National University Bundang Hospital(数据融合团队,医院信息办公室,首尔国立大学医院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 研究比较了三种大型语言模型在重复生成运动处方时的一致性,发现GPT-4.1在语义相似度上最高,而Gemini 2.5 Flash表现出重复性,揭示了生成行为的差异,强调模型选择应作为临床决策。

Comments 24 Pages, 2 Figures, 6 Tables and 2 Supplementary Materials. v2: Removed personal contact information

Journal ref International Journal of Medical Informatics, 220 (2026) 106594

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19739 2026-07-23 cs.IR cs.AI 新提交 90%

Personalized Recommendation Tool Learning via Autonomous Language Agents

通过自主语言智能体进行个性化推荐工具学习

Mingdai Yang, Zhiwei Liu, Weizhi Zhang, Yibo Wang, Hao Peng, Philip Yu

机构 * Microsoft(微软公司)

专题命中 领域大模型 :LLM(summary_cn,abstract);language agent(title);large language model(abstract);language model(abstract)

AI总结 研究针对基于大语言模型的智能体在推荐系统中的局限性,提出PRTA框架,让LLM作中央规划器与多推荐模型交互,负责高级推理和个性化工具选择,传统模型进行全排序评分,设计反射机制,实验表明该框架提升了全排序推荐性能。

Comments 6 pages. Accepted by RecSys'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.16022 2026-07-23 cs.CL 版本更新 88%

Enhancing LLMs for Identifying and Prioritizing Important Medical Jargons from Electronic Health Record Notes Utilizing Data Augmentation: A Comparative Study

通过数据增强提升LLM识别和优先级排序电子健康记录笔记中的重要医学术语

Won Seok Jang, Sharmin Sultana, Zonghai Yao, Hieu Tran, Zhichao Yang, Sunjae Kwon, Hong Yu

机构 * Miner School of Computer and Information Sciences, UMass Lowell, MA, USA(UMass Lowell 计算机与信息科学学院) Manning College of Information and Computer Sciences, UMass Amherst, MA, USA(UMass Amherst 信息与计算机科学学院) Center for Healthcare Organization and Implementation Research, VA Bedford Health Care, MA, USA(VA Bedford医疗中心医疗组织与实施研究中心)

专题命中 领域大模型 :LLM(title_cn,summary_cn);prompting(abstract);分类 cs.CL

AI总结 本文通过数据增强提升LLM在低资源环境下识别和优先级排序电子健康记录中的医学术语,评估了闭源和开源模型的性能,发现微调和数据增强能提升模型表现。

Comments 28pages, 5 figures, 6 tables

Journal ref JMIR AI. 17.Jul.2026 in Vol 5 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20284 2026-07-23 cs.CV 新提交 88%

Multimodal Large Language Models for Remote Sensing Image Understanding: Domain-Specific or General-Purpose?

用于遥感图像理解的多模态大语言模型:领域特定还是通用?

Qiwei Ma, Chunping Qiu, Xinjun Cheng, Xiaoyu Zhang, Puhong Duan, Ke Yang, Xudong Kang, Shutao Li

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) Intelligent Game and Decision Lab (IGDL)(智能游戏与决策实验室) Yuelushan Center for Industrial Innovation(岳麓山工业创新中心)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract)

AI总结 本文针对遥感图像理解的多模态大语言模型展开研究,通过系统调查和评估,比较其与通用模型在不同任务上的表现,发现当前模型存在局限,进而给出未来方向,为开发相关模型提供系统参考。

Comments 27 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.09988 2026-07-23 cs.IR cs.AI 版本更新 85%

An LLM-powered Agentic Recommendation System for Connected TV Content Discovery

一种用于智能电视内容发现的由大语言模型驱动的智能推荐系统

Lei Shi, Di Wang, Harry Tran, Helsing Xu, Yuchen Lu, Dhara Ghodasara, Wilson Chaney, Xueting Liao, Jerry Yu, Huayu Ding, Reza Mirghaderi, David Fan, Qi Guo, Chongguang He, Warren Wang, Warren Deng, Mingze Gao, Shike Mei, Shuo Tang, Zhe Zhang, Jianming He, Abhishek Kumar, Haotian Wu, Hamed Firooz, Li Li

机构 * Meta

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对推荐系统整合上下文信号的挑战,提出用于智能电视内容发现的大语言模型驱动的智能推荐系统,利用其推理能力处理多样信号,采用智能架构协调组件,克服大语言模型用于推荐的实际限制。

Comments 13 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20058 2026-07-23 cs.AI cond-mat.mes-hall cond-mat.mtrl-sci cs.CL 新提交 84%

Reading and Steering Representations of Materials-Science Mechanisms in an Open-Weight Language Model

在开放权重语言模型中读取和引导材料科学机制的表示

Markus J. Buehler

机构 * Massachusetts Institute of Technology(麻省理工学院)

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型中材料科学机制信息的表示形式,结合多种方法,包括匹配读数、状态几何等,通过实验验证其三种形式,如概念可读、取向由状态变换承载等,还通过比较提示等发现物理关系在受控状态变化中更易显现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20274 2026-07-23 cs.CV cs.AI cs.CL cs.LG 新提交 82%

Self-supervision drives representational convergence in medical foundation models more than clinical supervision

自我监督比临床监督更能推动医学基础模型中的表征趋同

Soroosh Tayebi Arasteh, Sebastian Ziegelmayer, Mahshad Lotfinia, Lisa Adams, Sven Nebelung, Jakob Nikolas Kather, Daniel Truhn

机构 * RWTH Aachen University(亚琛工业大学) University Hospital RWTH Aachen(亚琛工业大学附属医院) Technical University of Munich(慕尼黑工业大学) Friedrich-Alexander-Universität Erlangen-Nürnberg(埃尔朗根-纽伦堡弗里德里希-亚历山大大学) Technical University Dresden(德累斯顿工业大学) University Hospital Dresden(德累斯顿大学附属医院) University Hospital Heidelberg(海德堡大学附属医院)

专题命中 领域大模型 :foundation model(title);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究探讨医学基础模型中表征趋同问题,通过对多个编码器剖析发现自我监督比临床监督更能驱动收敛,虽收敛有限但线性分类器可跨编码器转移,表明医学成像收敛由预训练目标决定,为互操作性设计与验证提供依据。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20027 2026-07-23 cs.LG 新提交 79%

Zero-Shot Heart Rate Variability Forecasting from Consumer Wearables Using Time Series Foundation Models

使用时间序列基础模型从消费级可穿戴设备进行零样本心率变异性预测

Luukas Peräkylä, Fahad Sohrab, Ville Hautamäki, Merja Heinäniemi, Sui Huang, Pekka Abrahamsson

机构 * Tampere University(坦佩雷大学) University of Eastern Finland(东芬兰大学)

专题命中 领域大模型 :foundation model(title,abstract);分类 cs.LG

AI总结 研究利用时间序列基础模型从消费级可穿戴设备预测心率变异性,针对数据碎片化问题引入变异性保留插补方法,结果显示TSFMs在无需微调时优于传统基线模型,为其在真实数据集上的性能建立基线,凸显特定领域微调对临床部署的潜力。

Comments Accepted to Computing in Cardiology (CinC) 2026. 4 pages, 2 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07643 2026-07-23 cs.CV 版本更新 78%

Universality Reconsidered: Rethinking the Validation of Foundation Models for General-Purpose 3D Medical Segmentation

揭示通用3D医学分割中的模态差异与泛化幻觉

Yichi Zhang, Le Xue, Feiyang Xiao, Wenbo Zhang, Gang Feng, Chenguang Zheng, Yuan Qi, Yuan Cheng, Zixin Hu

机构 * Fudan University, Shanghai, China.(复旦大学) Shanghai Academy of Artificial Intelligence for Science, Shanghai, China.(上海人工智能科学研究院) Shanghai Universal Medical Imaging Diagnostic Center, Shanghai, China.(上海通用医学影像诊断中心)

专题命中 领域大模型 :foundation model(title,abstract)

AI总结 本文通过UMD数据集揭示3D医学分割中模态差异与泛化幻觉问题,指出现有基础模型在实际应用中存在显著性能差异,需转向多模态训练以提升通用性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19822 2026-07-23 eess.SP 新提交 75%

WARA: A Closed-Loop Multi-Agent Framework for Wireless Optimization Autoresearch

WARA:用于无线优化自动研究的闭环多智能体框架

Yuan Guo, Yilong Chen, Chao Hu, Xianghao Yu, Liang Hong, Jie Xu

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文针对无线领域提出端到端自动研究框架WARA,通过闭环多智能体系统将研究工作流程分三个阶段,经工件介导过程和控制器管理验证工件,设计评分智能体评估有效性,其性能优于一次性大语言模型生成,接近同行评审论文质量。

Comments 2026 IEEE/CIC International Conference on Communications in China (ICCC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19406 2026-07-23 cs.LG 新提交 57%

NMR Elucidation as an Agentic Search Problem, Not a Modeling Problem

核磁共振解析作为一个智能体搜索问题,而非建模问题

Irina Espejo Morales, Damon Hinz, Marvin Alberts, Geraud Krawezik, Haewon Jeong, Shirley Ho

专题命中 领域大模型 :LLM(abstract);分类 cs.LG

AI总结 研究针对NMR数据结构解析这一化学等领域的瓶颈,构建由冻结语言模型支持的自主智能体,将其解析过程视为受限搜索而非建模任务,在多个数据集上取得良好结果,为自动化光谱分析的多步骤编排框架提供了方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28390 2026-07-23 cs.AI 版本更新 57%

You Live More Than Once: Towards Hierarchical Skill Meta-Evolving

你活不止一次:迈向分层技能元进化

Xujun Li, Kehan Zheng, Mingyuan Zhao, Yize Geng, Jinfeng Zhou, Qi Zhu, Fei Mi, Lifeng Shang, Minlie Huang, Hongning Wang

机构 * Department of Computer Science and Technology, Tsinghua University(清华大学计算机科学与技术系) Huawei Foundation Model Department(华为基础模型部门)

专题命中 领域大模型 :LLM(abstract_cn);分类 cs.AI

AI总结 本文提出HiSME,一种轻量级分层技能元进化方法,通过从智能体任务执行轨迹中学习元技能,联合优化技能和技能进化策略,以持续提升部署的智能体系统在不同下游场景中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19988 2026-07-23 cs.CY 新提交 50%

What Does the Credential Still Certify? Cognitive Stewardship for AI-Mediated Education

证书仍然证明什么?人工智能介导教育的认知管理

Kai Yao

专题命中 领域大模型 :LLM(abstract)

AI总结 研究探讨生成式AI对教育评估前提的改变,开发认知管理框架,审核30所大学的AI评估指南,发现公共政策分类AI使用较好但解释证书有效性不足,强调大学需制定使认证逻辑可见的政策。

Comments Accepted at the Ninth AAAI/ACM Conference on AI, Ethics, and Society (AIES 2026), Malmö, Sweden, October 12--14, 2026. 13 pages, 3 figures; supplementary material is available as an ancillary file

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.22649 2026-07-23 cs.CV 版本更新 50%

Interactive Medical-SAM2 GUI: A Napari-based semi-automatic annotation tool for medical images

交互式医学-SAM2 GUI:基于Napari的半自动标注工具用于医学图像

Woojae Hong, Jong Ha Hwang, Jiyong Chung, Joongyeon Choi, Hyunggun Kim, Yong Hwy Kim

机构 * Department of Biomechatronic Engineering, Sungkyunkwan University(生物机电工程系,全州大学) Department of Neurosurgery, Seoul National University Hospital, Seoul National University College of Medicine(神经外科,首尔国立大学医院,首尔国立大学医学院)

专题命中 领域大模型 :prompting(abstract)

AI总结 交互式医学-SAM2 GUI 提供基于Napari的本地工作流,实现高效的3D医学图像半自动标注与导出功能。

Comments Planning to submit JOSS (Journal of Open Source Software)

详情

展开后加载摘要…

URL PDF HTML 收藏