arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-27 至 2026-07-27 共收录 16 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 16 篇

2604.26577 2026-07-27 cs.AI cs.CY cs.RO 版本更新 91%

Benchmarking the Safety of Large Language Models for Robotic Health Attendant Control

对大型语言模型在机器人健康护理员控制中的安全性的基准测试

Mahiro Nakao, Kazuhiro Takemoto

机构 * Kyushu Institute of Technology(九州工业技术大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);分类 cs.AI

AI总结 本文通过270条有害指令评估72个LLM,在模拟环境中测试其安全性,发现模型大小和发布日期影响安全性能,专有模型更安全,但医疗领域微调和提示防御策略效果有限,需将安全性作为首要考量。

Comments 20 pages, 9 figures, 3 tables, 8 pages supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12393 2026-07-27 cs.CL cs.AI 版本更新 90%

MedKGent: A Large Language Model Agent Framework for Constructing Temporally Evolving Medical Knowledge Graph

MedKGent:用于构建随时间演变的医学知识图谱的大语言模型智能体框架

Duzhen Zhang, Zixiao Wang, Zhong-Zhi Li, Yahan Yu, Shuncheng Jia, Jiahua Dong, Haotian Xu, Xing Wu, Yingying Zhang, Tielin Zhang, Jie Yang, Xiuying Chen, Le Song

机构 * Mohamed bin Zayed University of Artificial Intelligence(莫扎德大学人工智能学院) University of Chinese Academy of Sciences(中国科学院大学) Kyoto University(京都大学) Tsinghua University(清华大学) East China Normal University(华东师范大学) Center for Excellence in Brain Science and Intelligence Technology(脑科学与智能技术卓越中心) Brigham and Women’s Hospital, Harvard Medical School(哈佛医学院布里特妇女医院) GenBio AI

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究针对医学文献增长带来的知识结构化挑战,引入MedKGent框架,利用PubMed摘要通过两个智能体每日增量构建医学知识图谱,经评估其三元组有效性高,能显著改进大语言模型在医学问答基准上的检索增强生成。

Comments Accepted by Npj Digital Medicine

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21936 2026-07-27 cs.CL 新提交 88%

Leveraging External Knowledge for Historical Document Restoration via Retrieval-Augmented Large Language Models

通过检索增强大语言模型利用外部知识进行历史文献修复

Gabeen Kim, Kyeongpil Kang

机构 * Kangwon National University(江原国立大学)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 针对历史文献因物理损坏难以辨认及现有修复方法在恢复命名实体上的局限,提出利用检索增强大语言模型的修复框架,结合预训练模型隐含知识与外部上下文,实验表明该方法性能优于基线,是历史记录分析实用工具。

Comments Accepted to Findings of ACL 2026

Journal ref Findings of the Association for Computational Linguistics: ACL 2026, pages 43290-43304, 2026

URL PDF HTML 收藏
2607.22153 2026-07-27 cs.AI cs.LG 新提交 86%

Industrial Tokenization for LLM-Based Health Intelligence: A Federated Architecture for Industrial Evidence Integration

基于大语言模型的工业健康智能的工业令牌化:一种用于工业证据集成的联邦架构

Deshui Li, Xiao-Ming Yuan, Zishun Wang

机构 * Mingyang Smart Energy Co., Ltd.(明阳智慧能源集团股份有限公司)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 研究工业健康管理中异构信息源集成问题,提出工业令牌化概念及联邦架构,将特定源分析输出转为工业令牌,以实现跨源推理。给出基于振动诊断输出等的端到端诊断令牌路径,定位工业令牌化为语义接口。

Comments 10 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22100 2026-07-27 cs.CL cs.AI eess.AS 新提交 84%

MEUSLI: a Multilingual Projector for LLM-based ASR and Beyond

MEUSLI:一种用于基于大语言模型的自动语音识别及其他应用的多语言投影器

Lorenzo Concina, Seraphina Fong, Marco Matassoni, Alessio Brutti

机构 * Center for Augmented Intelligence, Fondazione Bruno Kessler(增强智能中心,布鲁诺·凯斯勒基金会) Department of Information Engineering and Computer Science, University of Trento(特伦托大学信息工程与计算机科学系)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 MEUSLI是首个多语言投影器家族,连接Whisper编码器与开源多语言大语言模型,实现28种欧洲语言的开源端到端自动语音识别。它扩展了单语言管道,能借助持续学习技术扩展到其他语言,还可用于语音翻译和主题识别等任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21625 2026-07-27 cs.AI 新提交 81%

Trajectory-Aware Retrieval Agents for Temporal Decision- Making

用于时间决策的轨迹感知检索代理

Jing Wang, Jie Shen, Xing Niu

机构 * Amazon(亚马逊)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究用大语言模型代理从长篇时间结构化文本中决策的问题,针对标准RAG丢弃时间结构缺陷,引入闭环代理框架TLM,其关键技术是LGCM,在医学问答、收益电话会议惊喜预测和隔夜股票缺口预测任务中表现出色。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19618 2026-07-27 cs.CV cs.AI cs.LG 版本更新 81%

The pretraining domain outweighs the training objective in setting the privacy-utility trade-off of differentially private medical image analysis

自监督预训练在差分隐私医疗图像分析中的作用

Soroosh Tayebi Arasteh, Mina Farajiamiri, Mahshad Lotfinia, Behrus Hinrichs-Puladi, Jonas Bienzeisler, Mohamed Alhaskir, Mirabela Rusu, Christiane Kuhl, Sven Nebelung, Daniel Truhn

专题命中 领域大模型 :pretraining(title,abstract);分类 cs.AI、cs.LG

AI总结 本文研究了自监督预训练在差分隐私医疗图像分析中的作用,发现DINOv3初始化在DP下优于ImageNet初始化,但不如领域特定监督预训练。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21920 2026-07-27 stat.AP 新提交 80%

Systematic Literature Reviews With Two Multi-Agentic Systems And Human-In-The-Loop

基于两个多智能体系统和人在回路的系统文献综述

Zexin Ren, Zixuan Zhao, Qiyun Li, Yawen Wu, Lanjing Wang, Renjie Luo, Yi Xu, Qing Guo, Jin Shi, En Xie, Feifang Hu, Qian Shi

专题命中 领域大模型 :LLM(summary_cn,abstract)

AI总结 针对临床试验系统文献综述传统方法的不足,提出含人在回路的两个多智能体系统,筛选MAS用多LLM智能体等提高准确性,提取MAS结合多种手段确保准确与可扩展,重现网络荟萃分析得出新临床结论。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22463 2026-07-27 cs.HC cs.AI 新提交 79%

Beyond Perspectives: A Trio-Ethnography of Interpretation Evolution in LLM-Supported Programming Education

超越视角:大语言模型支持的编程教育中解释演变的三人民族志研究

Jennie Ren, Jordan H. McDowell, Kyrie Zhixuan Zhou

机构 * Mercer University(梅森大学) University of Texas at San Antonio(德克萨斯大学圣安东尼奥分校)

专题命中 领域大模型 :LLM(title);prompting(abstract);分类 cs.AI

AI总结 研究通过三人民族志研究,探讨两位教学理念不同的计算机教育工作者和一名学生在大语言模型支持的编程教育中,如何通过对话使解释演变,揭示课堂外学习过程,促使教育工作者反思,为教学适应提供参考。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21887 2026-07-27 cs.HC cs.CL 新提交 77%

Towards Reducing Foreign Language Anxiety Using Level-Appropriate Embodied Conversational Agents

使用水平适配的具身对话代理降低外语焦虑

Krishan Rajaratnam, Wenbin Gan, Yuan Sun

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 研究针对外语焦虑影响二语习得问题,提出基于欧洲共同语言参考标准的多智能体具身对话系统,通过“生成-评估-再生”循环适配用户水平。小样本试点研究表明该系统生成的对话句子更适配学习者,虽未显著降低焦虑,但提供了相关见解。

Comments 8 pages, 6 figures, published in the proceedings of EDULEARN26

Journal ref K. Rajaratnam, W. Gan, Y. Sun (2026) TOWARDS REDUCING FOREIGN LANGUAGE ANXIETY USING LEVEL-APPROPRIATE EMBODIED CONVERSATIONAL AGENTS, EDULEARN26 Proceedings, Article 1459

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27347 2026-07-27 cs.CL 版本更新 77%

Mapping Political-Elite Networks in Europe with a Multilingual Joint Entity-Relation Extraction Pipeline

用多语言联合实体关系抽取管道绘制欧洲政治精英网络

Kirill Solovev, Jana Lasser

机构 * IDea_Lab, University of Graz(格拉茨大学IDea_Lab)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出模块化、全开放权重的多语言联合实体关系抽取管道,从大规模非结构化新闻语料中构建带符号的时间知识图谱,通过跨度命名实体识别、三阶段链接级联和约束混合专家模型实现高文本正确性,并在奥地利和波兰案例中验证其有效性。

Comments Updated NET-ROL citation per their request

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.22375 2026-07-27 cs.AI 新提交 70%

IDEAgent: Agentic Quality-Diversity Search for Research Idea Generation

IDEAgent:用于研究想法生成的智能体质量多样性搜索

Varun Gumma, Navonil Majumder, Soumitra Sinhahajari, Soujanya Poria

机构 * DeCLaRe Lab, Nanyang Technological University(声明实验室,南洋理工大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对大语言模型在生成研究想法时质量与多样性独立导致的局限,提出将研究构思视为质量多样性搜索。介绍多智能体框架IDEAgent,通过多目标反馈驱动质量,轻量级记忆等实现多样性,开发Yield指标评估,实验表明其性能优于基线,还证实修复改进对质量提升的重要性并开源。

Comments Under Review

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21970 2026-07-27 cs.CV cs.AI 新提交 70%

TextSLIP: Text Self-Supervised CLIP for Medical Report Generation

TextSLIP:用于医学报告生成的文本自监督CLIP

Haoyu Jiang, Ziping Cong

专题命中 领域大模型 :language model(abstract);pretraining(abstract);分类 cs.AI

AI总结 研究针对现有CLIP方法在医学报告生成中语义监督不足问题,提出TextSLIP框架,通过模态内文本对比学习增强CLIP,经实验验证其在报告生成指标上有改进,表明文本级对比学习对改善医学视觉-文本对齐有潜力。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21850 2026-07-27 cs.CV cs.AI 新提交 70%

SCALE: Self-Supervised Constraint-Aware Layout GEneration for Local P&R DRV Fixing at Advanced Nodes

SCALE:用于先进节点局部布局与布线设计规则违规修复的自监督约束感知布局生成

Chia-Tung Ho, Haoyu Yang, Guanglei Zhou, Yoshi Nishi, Yaguang Li, Walker Turner, Cunxi Yu, Yiran Chen, Brucek Khailany

机构 * NVIDIA(英伟达) Duke University(杜克大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对先进节点局部P&R DRV修复难题,提出SCALE框架,通过自监督布局生成、利用自然语言规则约束和高温采样等方法,生成DRC注释布局违规对微调DRC-VLM,有效提升了最先进代理的修复解决率。

Comments 8 pages, 5 Figures, 6 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.13465 2026-07-27 cs.LG stat.ML 版本更新 70%

AdamNX: An Adam improvement algorithm based on a novel exponential decay mechanism for the second-order moment estimate

AdamNX:一种基于二阶矩估计的新型指数衰减机制的Adam改进算法

Meng Zhu, Quan Xiao, Weidong Min

机构 * School of Information Management and Mathematics, Jiangxi University of Finance and Economics(江西财经大学信息管理与数学学院) School of Mathematics and Computer Science, Nanchang University(南昌大学数学与计算机科学学院) Institute of Metaverse, Nanchang University(南昌大学元宇宙研究院) Jiangxi Provincial Key Laboratory of Virtual Reality(江西省虚拟现实重点实验室)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究Adam中二阶矩估计的指数衰减机制,提出AdamNX及新衰减率,使更新在训练平稳阶段接近动量-SGD行为,通过图像分类等任务实验报告结果,代码已开源。

Comments 29 pages, 6 figures, 12 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21605 2026-07-27 cs.HC 新提交 67%

Natural Language Processing in Health Professions Education: A Scoping Review

卫生职业教育中的自然语言处理:一项范围综述

Javad Mohammad Alizadeh, Pegah Saebi, Mukesh Kumar Patel, Huanmei Wu

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 该范围综述遵循特定框架和指南,综合64项研究,梳理NLP和AI在卫生职业教育中的应用,确定七个主题领域,发现有技术前景但也有挑战,强调公共卫生教育是证据空白区及未来研究投资重点。

Comments This manuscript has been accepted at the 14th IEEE International Conference on Healthcare Informatics (ICHI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏