arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-07-24 至 2026-07-24 共收录 23 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 23 篇

2606.08532 2026-07-24 cs.AI 版本更新 90%

DN-Hypo-Pipeline: An AI-Driven Workflow for Generating Hypotheses using Large Language Models and Scientific Explanations

DN-Hypo-Pipeline:一种基于大语言模型和科学解释的AI驱动假设生成工作流

Lei Lin, Xinlong Pan, Ronghao Wang, Chunbao Zhou, Jue Wang, Yangang Wang, Ivana Rasovska

机构 * Computer Network Information Center, Chinese Academy of Sciences, China(中国科学院计算机网络信息中心)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract_cn);prompting(abstract)

AI总结 提出DN-Hypo-Pipeline,利用大语言模型和科学解释作为先验知识,从现有文献中推导新假设,在数据科学建模中通过统计推断和专家评估证明优于直接生成方法,并验证了生成假设对应的算法性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20462 2026-07-24 cs.AI 新提交 90%

Marking the Wrong Symptoms: Evaluating LLM Watermarks in Medical Texts

标记错误症状:评估医学文本中的大语言模型水印

Melanie Rieff, Robin Staab, Thibaud Gloaguen, Stefan Hegselmann, Martin Vechev

机构 * ETH Zurich(苏黎世联邦理工学院) Berlin Institute of Health at Charité – Universitätsmedizin Berlin(柏林夏里特医学院柏林健康研究所) Deutsches Herzzentrum der Charité – Medical Heart Center of Charité and German Heart Institute Berlin(柏林夏里特医学院德国心脏中心与柏林德国心脏研究所)

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究LLM水印对医学性能的影响,在11个LLM和7个VLM上对5种水印方案进行多任务基准测试,引入人类专家验证管道补充评估,发现水印会致多种退化,特定领域评估是医学中水印模型安全部署的前提。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20923 2026-07-24 cs.DL cs.AI cs.CY 新提交 89%

Scientific exploration, collaboration and labor division in the large language model era

大语言模型时代的科学探索、合作与分工

Xiang Zheng, Xi Hong, Jialin Liu, Chaoqun Ni

机构 * Information School, University of Wisconsin–Madison(威斯康星大学麦迪逊分校信息学院)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 研究大语言模型时代科学家科研变化,通过关联数据和分析论文贡献声明发现,2022年后科学家跨学科探索增加,合作网络更具跨学科性,分工更分化,有强AI写作信号者变化更明显,表明此时代科学探索、合作与分工正广泛重组。

Comments Main text: 21 pages, 4 figures. Supplementary materials: 25 pages, 13 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20428 2026-07-24 cs.CL cs.HC cs.MA 新提交 89%

Human-in-the-Loop Large Language Model Framework for Identification of Cutaneous Immune-Related Adverse Events

用于识别皮肤免疫相关不良事件的人在回路大语言模型框架

Charles Lu, Olivia Burke, Debby Cheng, Adam Kashlan, Caitlyn Duffy, Zeyun Lu, Lirit Fuksman, Jin Ning Tian, Andrew Sedlack, Priya Katyal, Eudora Lee, Ralina Karagenova, Chuck Lin, Kun-Hsing Yu, Nicole LeBoeuf, Alexander Gusev, Yevgeniy R. Semenov

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

AI总结 研究旨在通过人在回路的大语言模型框架检测皮肤免疫相关不良事件,采用检索增强等方法,相比人工审查提高了准确性、一致性并缩短审查时间,还试点了大语言模型在跨器官系统识别免疫毒性及数据提取方面的应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20528 2026-07-24 cs.AI 新提交 89%

PromptPack: Scaling LLM Annotation Agents for Online Recommendation

PromptPack:扩展用于在线推荐的大语言模型注释代理

Sebastian Koralewski, Merwan Barlier, Yulia Stolin, Blaž Škrlj

机构 * Teads Inc.(缇德思公司)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 研究在线推荐平台用LLMs提取广告素材特征时按创意提示成本高的问题,提出可扩展的PromptPack代理,通过上下文内批处理等实现扩展,经实验评估,相比基线,它大幅降低成本、提高吞吐量且保留AUC。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21570 2026-07-24 cs.CL cs.HC 新提交 88%

MedGame: Storytelling Gamification Empowered by Large Language Models for Medical Education

MedGame:由大语言模型赋能的用于医学教育的故事化游戏化

Qian Wu, Xinrong Zhou, Zizhan Ma, Kai Chen, Zheyao Gao, Xun Lin, Hongqiu Wu, Longfei Gou, Yixiao Liu, Ann Sin Nga Lau, Qi Dou

机构 * CUHK(香港中文大学) Southern Medical University(南方医科大学) Peking University(北京大学) Tencent(腾讯)

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 研究旨在利用大语言模型助力医学教育,提出MedGame框架,通过双引擎设计将临床病例转化为故事化游戏,构建MedGame Bench进行评估,实验显示特定任务微调提升开源模型表现,学生研究表明其更具吸引力和实用性。

Comments Work in Progress; an explorational design and study on AI+Education+Game

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20429 2026-07-24 cs.CL cs.AI 新提交 86%

More Is Not More: What Matters for Diversity in LLM Opinions?

更多并非更好:大语言模型观点多样性的关键因素是什么?

Qiyang Yao

机构 * New York University(纽约大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型观点多样性,通过析因实验分离输入条件设定和交互架构两维度,在7个模型上评估,发现更多角色细节非单调增多样性,不同架构探索不同观点区,组合架构覆盖更广,低成本措施效果差,揭示多样性受干预结构形式和组合影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21530 2026-07-24 cs.SE cs.AI 新提交 85%

From Resource Flow to Executable Tests: Petri-Net-Guided LLM Test Generation for Concurrent Stateful Rust APIs

从资源流到可执行测试:用于并发有状态 Rust API 的 Petri 网引导的大语言模型测试生成

Kaiwen Zhang, Guanjun Liu

机构 * Tongji University(同济大学)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对并发有状态 Rust API 测试生成问题,提出 Petri 网引导方法,将 API 相关要素表示为有色令牌和转换来导出场景,用作基于大语言模型代码合成的中间表示,经一系列机制确保测试生成的有效性和准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21327 2026-07-24 cs.DL cs.AI 新提交 85%

From Static Bibliometrics to Dynamic Knowledge Graphs: An LLM-Powered Framework for Modernizing Science, Technology, and Innovation (STI) Analytics

从静态文献计量学到动态知识图谱:一个由大语言模型驱动的框架,用于实现科学、技术与创新(STI)分析的现代化

Muhsen Hammoud

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对文献计量指标的问题,提出由大语言模型驱动、整合多种传统的混合框架,经五层架构实现,将LLMs作为候选生成器,通过多阶段验证,支持多种分析,贡献了验证中介原则并讨论治理考量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21519 2026-07-24 cs.IR 新提交 85%

Diffusion Language Model for Recommendation

用于推荐的扩散语言模型

Chengyi Liu, Yongqi Zhou, Junwei Pan, Zhixiang Feng, Chengguo Yin, Haijie Gu, Jie Jiang, Yinghao Liu, Yujuan Ding, Qing Li, Wenqi Fan

专题命中 领域大模型 :language model(title,abstract);LLM(abstract);large language model(abstract)

AI总结 研究针对现有推荐系统中自回归范式的不足,受扩散语言模型启发,提出 DLMRec。该模型引入协作感知随机分词器、课程驱动训练策略、稳定性感知投票机制,为推荐提供了新的离散扩散语言模型及有效方法。

Comments 30 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21257 2026-07-24 cs.HC 新提交 85%

Exploring the Design Space of LLM-Based Programming Support in CS Education: A Scoping Review through the Lens of Assistance Governance

探索计算机科学教育中基于大语言模型的编程支持的设计空间:通过辅助治理视角的范围审查

Minsun Kim, S. Moonwara A. Monisha, Zihan Wu, David H. Smith

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 该研究通过范围审查和定性综合,对90个基于大语言模型的编程支持系统进行分析,提出PEA三维分析视角,贡献治理手册与配置图,为分析现有系统及设计未来工具提供词汇表,以解决辅助治理决策隐含难比较的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20560 2026-07-24 cs.LG 新提交 81%

Chronofy: A Temporal-Logical Decay Architecture for Information Validity in Time-Aware Retrieval-Augmented Generation

Chronofy:一种用于时间感知检索增强生成中信息有效性的时态逻辑衰减架构

Muntaser Syed, Marius Silaghi, Sheikh Abujar, Sharun Akter

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对RAG系统中因未考虑时间来源导致的时间幻觉问题,提出Chronofy三层神经符号框架,通过嵌入时间有效性到表示、检索和推理层,经实验验证该框架能提高检索精度、减少幻觉并启用数据重新获取触发机制。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20848 2026-07-24 cs.AI 新提交 79%

Auditing Evidence Use in Medical LLM Diagnosis

医学大语言模型诊断中证据使用的审计

Junchi Liao, Jiawen Deng, Fuji Ren

机构 * University of Electronic Science and Technology of China(电子科技大学)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

AI总结 研究医学大语言模型诊断时证据使用情况,通过分解患者信息为证据单元等方法审计,在多个数据集上评估五个模型,发现准确性可能掩盖证据使用问题,结果促使对医学大语言模型评估进行角色感知审计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.11346 2026-07-24 cs.AI cs.PL 版本更新 79%

Compile, Then Page: Executable SOP Programs and a Capability-Gated Runtime for Procedural LLM Agents

编译,然后分页:用于过程性语言模型代理的可执行标准操作程序和能力门控运行时

Chenglin Yu, Li Yin, Qingxin Fan, Ying Yu, RunyangRay Zhong, Ming Li

机构 * The Hong Kong Polytechnic University(香港理工大学) The University of Hong Kong(香港大学) Zhejiang Normal University(浙江师范大学) Research Institute for Generative AI, The Hong Kong Polytechnic University(香港理工大学生成式人工智能研究所)

专题命中 领域大模型 :LLM(title,abstract);分类 cs.AI

AI总结 研究针对企业代理遵循SOP的问题,将SOP约束编译成可执行伪代码,用程序引导堆栈机运行,通过实验表明编译文本有益,运行时指导受能力门控,给出编译后经模型级纪律检查再启用活动框架分页的实际指导。

Comments 9 pages, 3 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20557 2026-07-24 cs.LG cs.AI 新提交 76%

Monkey King Bang: A Unified Scientific Multimodal Foundation Model

孙悟空爆炸:一个统一的科学多模态基础模型

Hesen Chen, Xinyu Su, Xiaomeng Yang, Yuetan Lin, Zixiong Yang, Junyi An, Fenglei Cao, Yifeng Jiao, Yunqi Zhang, Yuan Cheng, Zhiyu Tan, Hao Li, Libo Wu, Yuan Qi

机构 * Shanghai Academy of AI for Science(上海人工智能研究院)

专题命中 领域大模型 :foundation model(title);分类 cs.AI、cs.LG

AI总结 研究针对科学多领域推理需求,引入统一科学多模态模型MKB,围绕共享Transformer主干及定制组件构建,涵盖多科学分支。通过两阶段训练,在多方面实验表现出色,证明该范式可行,为跨领域科学多模态探索提供基础。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20453 2026-07-24 cs.CL cs.AI cs.LG 新提交 75%

A Knowledge-Injection Framework for Zero-Shot Adaptation of LLMs to Delirium Prediction

一种用于将大语言模型零样本适应谵妄预测的知识注入框架

Jessica Sena, Shesadree Priyadarshani, Miguel Contreras, Bharat Gandhi, Scott Siegel, Subhash Nerella, Parisa Rashidi

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 针对大语言模型零样本适应谵妄预测中领域知识不足问题,提出轻量级知识注入框架。在推理时用外部临床知识报告增强数据摘要,无需微调或检索。实验表明该方法能提升模型性能,缩小与前沿模型差距,且收益依赖临床意义内容。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21307 2026-07-24 cs.LO cs.AI cs.ET 新提交 70%

Scaling Up Formal Representation of Clinical Trial Protocols in Ensemble Logic Using LLMs: A Preliminary Study

使用大语言模型在集成逻辑中扩大临床试验协议的形式化表示:一项初步研究

Yan Huang, Xubing Hao, Xiaojin Li, Rashmie Abeysinghe, Xiaoqian Jiang, Licong Cui, Guo-Qiang Zhang

机构 * McGovern Medical School(麦戈文医学学院) McWilliams School of Biomedical Informatics(麦克威廉斯生物医学信息学学院) The University of Texas Health Science Center at Houston(德克萨斯大学健康科学中心休斯顿分校)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究针对临床试验协议依赖非结构化文本阻碍自动化推理等问题,引入CT-TEL工作流程,利用大语言模型将叙述性临床协议转为TEL公式,通过反向翻译评估保真度,为协议映射到可计算逻辑及临床试验模拟提供初步证据。

Comments Proceedings of the 2026 American Medical Informatics Association Symposium, to appear

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21513 2026-07-24 cs.HC cs.IR 新提交 67%

Transparent by Design, Usable in Practice? A Formative Usability Study of a Conversational Product Advisor

设计透明,实践可用?对话式产品顾问的形成性可用性研究

Kevin Schott, Dagmar Kern, Daniel Hienert

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 研究对话式产品顾问的可用性,通过对含受限自然语言生成等功能的笔记本搜索聊天机器人进行研究,发现设计透明不保证理解,排名解释有严重问题,参与者虽看重省力但希望有更多直接操作控件,贡献了可用性问题及设计建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20426 2026-07-24 cs.CL cs.AI 新提交 62%

Knowledge Injection Exists in MoE? Exploring Expert-Aware Contrast Decoding in MoE for Mitigating LLMs'Hallucinations

知识注入存在于混合专家模型中吗?探索混合专家模型中基于专家感知的对比解码以减轻大语言模型的幻觉

Xinyue Fang, Zhiliang Tian, Zhen Huang, Ziyi Pan, Zhihua Wen, Xi Wang, Quntian Fang, Dongsheng Li

机构 * College of Computer Science and Technology, National University of Defense Technology(国防科技大学计算机科学与技术学院)

专题命中 领域大模型 :LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究探索混合专家模型中基于专家感知的对比解码以减轻大语言模型幻觉问题。提出EAACD方法,利用MoE高层专家差异,将专家分组对比校准预测,放大低可靠性专家幻觉提供负面参考,在四个数据集上优于所有基线。

Comments Accepted by ACL2

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20583 2026-07-24 q-bio.GN cs.AI 新提交 57%

Foundation-model-guided radiogenomic discovery linking cancer genomes to cancer scans

基础模型引导的放射基因组学发现:将癌症基因组与癌症扫描联系起来

Frederik Hauke, Jeremias Krause, Patrick Wienholt, Christiane Kuhl, Ingo Kurth, Sikander Hayat, Jakob Nikolas Kather, Sven Nebelung, Daniel Truhn

机构 * University Hospital RWTH Aachen(RWTH亚琛大学医院) TU Dresden(德累斯顿技术大学) TUD Dresden University of Technology(德累斯顿技术大学) Heidelberg University Hospital(海德堡大学医院)

专题命中 领域大模型 :language model(abstract);分类 cs.AI

AI总结 研究将基于Evo~2的基因组分析与临床成像结合,全基因组识别基因-表型关联。对TCGA队列体细胞突变用Evo~2预测严重程度评分,与放射组学特征关联。在TCGA-cRCC中恢复已知驱动基因,发现新的显著基因,证明该方法可发现传统方法难以察觉的基因-成像关联。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20527 2026-07-24 cs.AI 新提交 57%

Evaluating and Guarding Citation Faithfulness in Agentic Scientific Synthesis

评估和保障智能科学合成中的引用忠实性

Taewan Goo, Junsik Kim, Kyulhee Han, GwonYul Jo, Jong-Soo Kim, Tae-Hyung Kim

机构 * Seoul National University(首尔国立大学) BioNexus(生物 Nexus)

专题命中 领域大模型 :LLM(abstract);分类 cs.AI

AI总结 研究智能语言模型系统引用答案检查的可靠性问题,提出黄金锚定评估协议和可部署防护措施,能验证验证者、测量重新归因,为无支撑引用设限,经多模型和管道验证后作为单GPU工具包发布。

Comments 20 pages, 5 figures. Includes supplementary material (Appendices S1-S6). Open single-GPU reproducibility kit included

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20836 2026-07-24 astro-ph.IM physics.soc-ph 新提交 50%

How to Craft the Right Language AI Policy For Your Research Group (Some Assembly Required)

如何为你的研究团队制定合适的语言人工智能政策(需一些组装工作)

Michelle Ntampaka, S. Burke-Spolaor, Ioana Ciucă, Ana Maria Delgado, Kartheik G. Iyer, Kelly Lockhart, Adele Plunkett, Mercedes López-Morales, Ashish A. Mahabal, Susan E. Mullally, Rohit Raj, Jan Rerink, Jeffrey Smith, Joshua S. Speagle, John Soltis, John F. Wu, Mikaeel Yunus

专题命中 领域大模型 :prompting(abstract)

AI总结 探讨为何不存在适用于天文学研究团队的单一正确人工智能政策,引入四种研究实验室原型,基于团队优先级探讨其对人工智能相关决策的影响,提供使政策与团队科学价值观和使命一致的框架,助研究领导者决策。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31533 2026-07-24 cs.CV 版本更新 50%

MV-GEL: Language-Driven Multi-View Geometric Entity Localization on Meshes

MV-GEL:语言驱动的多视图网格几何实体定位

Kartik Bali, Roland Aydin

机构 * Helmholtz Zentrum Hereon(亥姆霍兹赫里恩研究中心) Institute for Continuum and Material Mechanics, Hamburg University of Technology(汉堡工业大学连续介质与材料力学研究所) German Research Center for Artificial Intelligence(德国人工智能研究中心)

专题命中 领域大模型 :language model(abstract)

AI总结 提出MV-GEL框架,通过语言查询定位网格上的细粒度几何实体,利用视角选择模块GELviews优先选择可观察性高的视角,结合VLM分割和光线投射提升定位精度。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏