arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-06-29 至 2026-06-29 共收录 19 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 19 篇

2606.26879 2026-06-29 cs.AI 新提交 92%

A Pipeline for Generating Longitudinal Synthetic Clinical Notes Using Large Language Models

使用大型语言模型生成纵向合成临床笔记的流水线

William Poulett, Alice Waterhouse, Ben Wallace, Scarlett Kynoch, Amaia Imaz Blanco, Michael Spence, Jonathan Pearson

机构 * NHS England Data Science and Applied AI Team(NHS英格兰数据科学与应用人工智能团队)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);分类 cs.AI

AI总结 提出一种模块化流水线,结合结构化患者生成、半结构化旅程模拟和LLM生成非结构化笔记,生成纵向一致的合成临床数据集,支持临床AI开发并避免隐私风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21641 2026-06-29 cs.LG cs.AI 新提交 92%

When Is an LLM Worth It for Hyperparameter Optimization? A Budget-Matched Study on Tabular Data Finds the Warm-Start Is a Default Configuration, Not the Model

LLM何时值得用于超参数优化?基于表格数据的预算匹配研究发现热启动是默认配置,而非模型

Carson Rodrigues, Oysturn Vas, Isaiah Abner DCosta, Nithish Kumar Prabhakaran

机构 * Celabe University of Waterloo(滑铁卢大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过预算匹配的多种子实验,发现LLM作为HPO顾问的初始强点来自固定默认配置,其自身提议仅带来微小提升,被经典搜索方法在少量评估内超越。

Comments 10 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27611 2026-06-29 cs.LG 新提交 90%

COOPA: A Modular LLM Agent Architecture for Operations Research Problems

COOPA: 面向运筹学问题的模块化LLM智能体架构

Chuanhao Li, Xiaoan Xu, Dirk Bergemann, Ethan X. Fang, Yehua Wei, Zhuoran Yang

机构 * Tsinghua University(清华大学) Duke University(杜克大学) Yale University(耶鲁大学)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.LG

AI总结 提出COOPA模块化LLM智能体架构,通过迭代置信度建模、元素级溯源与多求解器路由,提升运筹问题建模准确性与可解释性,在多个基准上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26519 2026-06-29 cs.AI 新提交 90%

What the LLM Should Not Say: Boundary-Aware Context Grounding for A Seven-Channel EEG Agent

面向低通道EEG智能体的边界感知上下文接地

Zhiyuan Xu, Yueqing Dai, Junling Li, Junwen Luo

机构 * Shanghai Pulse Element Intelligent Technology Co., Ltd. (NeuraDock)(上海脉冲元素智能科技有限公司(NeuraDock))

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出NeuraDock Agent架构,通过分离确定性本地EEG引擎与硬件感知语言层,实现LLM对低通道EEG数据的边界感知接地,经288次测试验证了系统在数值重复性、故障恢复和边界感知方面的有效性。

Comments 25 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27930 2026-06-29 cs.IR stat.AP 新提交 89%

An LLM-Powered Semantic Alignment Framework for Journal Recommendation

基于LLM的语义对齐框架用于期刊推荐

Yanglin Yan, Zicheng Xie, Tianchen Gao, Rui Pan, Hansheng Wang

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出一种基于大语言模型的语义对齐框架,将期刊推荐转化为稿件内容与期刊范围描述之间的语义匹配问题,无需训练即可实现高效推荐。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28070 2026-06-29 cs.AI 新提交 89%

JD Oxygen AI Item Center (Oxygen AIIC) V1: An Industrial-Scale LLM/VLM-Centric Solution for Item Understanding, Management, and Applications

JD Oxygen AI 商品中心 (Oxygen AIIC) V1:面向商品理解、管理和应用的工业级 LLM/VLM 解决方案

Oxygen AIIC, Chan Long, Chao Liu, Chaofan Chen, Chaohui Dong, Chunyuan Guo, Danping Liu, Debin Liu, Deping Xiang, Fulai Xu, Guangyue Liu, Hao Li, Huichun Hu, Jian Yang, Jianan Wang, Jianbo Zhao, Jiaoyang Li, Jiaxing Wang, Jinglong Li, Jinjin Guo, Jun Fang, Jun Liu, Kai Zhou, Li Wang, Lili Gao, Liying Chen, Luning Yang, Mengdi Zhou, Pengzhang Liu, Qi Lv, Qianyun Wang, Qixia Jiang, Ruyue Li, Shimu Liang, Shuxing Wang, Sijie Zhang, Siqi Li, Tianhao Gao, Wang Ke, Weihu Huang, Wencan Lai, Wenjie Zhang, Xiaohui Zhang, Xiaojing Dong, Ya Liu, Yifeng Zhang, Yixiang Wang, Yongtai Zhang, Yongyi Liao, Zhaoru Chen, Zhen Chen, Zhiyong Ma, Zhiyuan Liu, Zhongwei Liu, Ziyan Xing

机构 * Oxygen AIIC(氧气AIIC)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 针对电商平台海量SKU的知识生产与服务挑战,提出基于LLM/VLM的工业级平台Oxygen AIIC,通过本体工程、S2D知识识别架构、自进化模型和统一商品通道,实现高精度、高吞吐的知识生产,并在搜索、推荐等场景取得显著收益。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01693 2026-06-29 cs.DB cond-mat.mtrl-sci 版本更新 88%

LitMOF: An LLM Multi-Agent for Literature-Validated Metal-Organic Frameworks Database Correction and Expansion

LitMOF:用于文献验证的金属有机框架数据库校正与扩展的LLM多智能体系统

Honghui Kim, Dohoon Kim, Jihan Kim

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 提出LitMOF框架,利用大语言模型多智能体从原始文献验证并修复MOF数据库中的结构错误,成功修复9227个无效条目并发现8771个新MOF,通过直接空气捕获案例证明结构错误严重影响材料筛选可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27593 2026-06-29 cs.AI cs.LG 新提交 86%

Odyssey: Constructing Verifiable Local Truth-Preserving Foundation Models

Odyssey: 构建可验证的局部保真基础模型

Sridhar Mahadevan

机构 * Adobe Research(Adobe 研究院) University of Massachusetts, Amherst(马萨诸塞大学阿默斯特分校)

专题命中 领域大模型 :foundation model(title,abstract);LLM(abstract,abstract_cn);分类 cs.AI、cs.LG

AI总结 提出一种名为ODYSSEY的范畴论框架,通过组合“foundries”构建可验证的局部保真基础模型,并引入Universal Foundry Learning和Foundry SQL实现形式化构造与查询。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.10808 2026-06-29 cs.CL cs.IR 85%

ColBERT Retrieval and Ensemble Response Scoring for Language Model Question Answering

基于ColBERT检索和集成响应评分的语言模型问答系统

Alex Gichamba, Tewodros Kederalah Idris, Brian Ebiyau, Eric Nyberg, Teruko Mitamura

专题命中 领域大模型 :language model(title,abstract);large language model(abstract);small language model(abstract);分类 cs.CL

AI总结 本文提出基于ColBERT检索和集成响应评分的方法,提升小语言模型在电信领域问答任务中的性能,Phi-2模型达到81.9%准确率,Falcon-7B模型达到57.3%准确率。

Comments 7 pages, 2 figures, and 8 tables. This paper has been accepted at the 2024 IEEE Global Communications (GLOBECOM) Workshops

Journal ref 2024 IEEE Globecom Workshops (GC Wkshps), 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27973 2026-06-29 cs.CL cs.AI 新提交 82%

From Black-Box to Clinical Insight: A Multi-Stage Explainable Framework for Speech-Based Cognitive Impairment Detection

从黑盒到临床洞察:用于语音认知障碍检测的多阶段可解释框架

Yasaman Haghbin, Sina Rashidi, Ali Zolnour, Fatemeh Taherinezhad, Ali Fartoot, Hossein Azadmaleki, James M Noble, Maryam Dadkhah, Maryam Zolnoori

机构 * Independent Researcher(独立研究者) Columbia University(哥伦比亚大学) Chalmers University of Technology(查尔姆斯理工大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.CL、cs.AI

AI总结 提出多阶段可解释框架,结合SHAP、语言学特征和LLM推理,将黑盒Transformer预测转化为临床叙事,在NIA PREPARE基准上F1=72.11%,医生评估显示与患者认知特征高度一致,SUS评分82/100。

Comments Accepted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.28044 2026-06-29 cs.CL 新提交 81%

A Tree-of-Thoughts Inspired Hybrid Approach for Legal Case Judgement Summarization using LLMs

一种基于思维树的混合方法用于法律案例判决摘要生成

Aniket Deroy, Kripabandhu Ghosh, Saptarshi Ghosh

机构 * IIT Kharagpur(印度理工学院德里加尔加尔普分校) IISER Kolkata(印度科学研究所科希拉)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出一种基于思维树的提取-抽象混合方法,利用LLMs(DeepSeek和LLama)生成法律判决摘要,实验表明该方法优于纯提取或纯抽象方法。

Comments Accepted at ICAIL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17901 2026-06-29 eess.IV cs.CV cs.GT 版本更新 78%

MeDUET: Disentangled Unified Pretraining for 3D Medical Image Synthesis and Analysis

MeDUET:面向3D医学图像合成与分析的解耦统一预训练

Junkai Liu, Ling Shao, Le Zhang

专题命中 领域大模型 :pretraining(title,abstract)

AI总结 提出MeDUET框架,在变分自编码器潜在空间中通过解耦学习域不变内容因子和域特定风格因子,统一3D医学图像合成与分析任务,提升合成质量、收敛速度和域泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25651 2026-06-29 cs.CL 新提交 77%

MedGuards: Multi-Agent System for Reliable Medical Error Detection and Correction

MedGuards: 用于可靠医疗错误检测与纠正的多智能体系统

Congbo Ma, Hu Wang, Yichun Zhang, Farah E. Shamout

机构 * New York University Abu Dhabi(纽约大学阿布扎比分校) Khalifa University(哈利法大学) New York University(纽约大学)

专题命中 领域大模型 :LLM(abstract_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出MedGuards框架,通过多智能体上下文学习与置信度引导仲裁机制,无需额外训练即可检测、定位和纠正医疗文本错误,并引入关键词优先纠正评分(KPCS)评估指标。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02521 2026-06-29 cs.LO 版本更新 75%

Large Lemma Miners: Can LLMs do Induction Proofs for Hardware?

大引理挖掘器:LLMs能否为硬件生成归纳证明?

Romy Peled, Daniel Kroening, Michael Tautschnig, Yakir Vizel

专题命中 领域大模型 :large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文探讨LLMs在硬件验证中生成归纳证明的能力,提出神经符号方法,通过两个提示框架生成候选不变量并验证,成功生成正确证明。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10551 2026-06-29 cs.HC 版本更新 75%

An Empirical Study to Understand How Students Use ChatGPT for Writing Essays

一项实证研究:了解学生如何利用ChatGPT撰写论文

Andrew Jelson, Daniel Manesh, Alice Jang, Daniel Dunlap, Young-Ho Kim, Sang Won Lee

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 研究通过70名学生的在线实验,分析学生使用ChatGPT撰写论文时的查询模式,发现性别、种族和自我效能等因素影响AI使用模式,且不同使用模式与写作乐趣和所有权感知相关。

Comments 35 pages, 16 figures, 6 tables, Submitted to ACM CHI 2026

Journal ref CHI '26: Proceedings of the 2026 CHI Conference on Human Factors in Computing Systems

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.16065 2026-06-29 cs.LG cs.AI math.ST stat.ML stat.TH 版本更新 73%

Can Generative Artificial Intelligence Survive Data Contamination? Theoretical Guarantees under Contaminated Recursive Training

生成式人工智能能否在数据污染中幸存?污染递归训练下的理论保证

Kevin Wang, Hongqian Niu, Didong Li

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文首次严格证明在温和条件下,即使模型递归训练于自身生成的数据,仍能收敛到真实数据分布,并揭示了数据限制与模型限制之间的相变。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27394 2026-06-29 cs.DL cs.LG 新提交 70%

Forecasting Technological Directions in Wireless Networks and Mobile Computing via AutoML Framework

通过AutoML框架预测无线网络与移动计算的技术方向

Ahmed Abolfadl, Marwa Mahmoud, Basma Afifi, Mervat Abu-Elkheir, Maggie Mashaly

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.LG

AI总结 提出一种集成聚类、主题建模和时间序列分析的自动化管道,用于预测无线网络与移动计算领域的研究趋势,通过元学习选择聚类算法和逐次减半策略优化主题模型,结合ARIMA等模型预测主题热度,实验RMSE为36.76。

Comments Conference: 2025 IEEE Middle East Conference on Communications and Networking (MECOM)

Journal ref Proc. IEEE IEEE Middle East Conference on Communications and Networking (MECOM), Cairo, Egypt, 2025, pp. 1-6

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27386 2026-06-29 cs.DL cs.AI 新提交 70%

Agentic Publication Protocol: An Attempt to Modernize Scientific Publication

Agentic Publication Protocol:科学出版现代化的一次尝试

Sirui Lu, Xiao-Liang Qi

机构 * Max-Planck-Institut für Quantenoptik(马克斯·普朗克量子光学研究所) Munich Center for Quantum Science and Technology(慕尼黑量子科学与技术中心) Leinweber Institute for Theoretical Physics(莱因韦伯理论物理研究所)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出Agentic Publication Protocol(APP),一种将论文与代码、数据、环境信息及智能体指令打包的轻量级仓库格式,使未来研究者能直接使用操作知识。

Comments 16 pages, 5 figures and 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10938 2026-06-29 cs.CL cs.AI cs.LG 版本更新 67%

ELF: Embedded Language Flows

ELF:嵌入式语言流

Keya Hu, Linlu Qiu, Yiyang Lu, Hanhong Zhao, Tianhong Li, Yoon Kim, Jacob Andreas, Kaiming He

机构 * MIT(麻省理工学院)

专题命中 领域大模型 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ELF,一种基于连续时间流匹配的连续嵌入空间扩散模型,通过最小调整即可在离散领域有效工作,实验显示其在生成质量与采样步骤上优于现有模型。

Comments Tech report. arXiv v2: add distillation results in Appendix B. https://linlu-qiu.github.io/assets/html/elf_pd.html

详情

展开后加载摘要…

URL PDF HTML 收藏