arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12496 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12496 篇

2608.11241 2026-08-13 cs.AI cs.IR 新提交 90%

RecSys Factory: Bounding LLM Agent Autonomy to Decision Points in the Industrial Recommender Lifecycle

RecSys Factory:限制LLM智能体在工业推荐生命周期内的自主决策点

Dongyang Ao, Kaixiang Fang, Shijie Xu

机构 * Tencent(腾讯) FiT(腾讯FiT)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 RecSys Factory 是限制 LLM 智能体自主到决策点的平台,解决工业推荐系统运营的三角困境,在腾讯三业务线部署 78 天,CLI 调度成功率达 78.6%。

Comments 21 pages, 6 figures, 9 tables. Reports a 78-day deployment across three heterogeneous industrial recommender business lines (1,624 CLI-tool dispatches). Companion paper: AutoResearch (P3b), which instantiates the same substrate for autonomous research

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16749 2026-08-13 cs.CR cs.AI 交叉投稿 90%

Evaluating LLM Generated Detection Rules in Cybersecurity

评估大语言模型(LLM)生成的网络安全检测规则

Anna Bertiger, Bobby Filar, Aryan Luthra, Stefano Meschiari, Aiden Mitchell, Sam Scholten, Vivek Sharath

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出开源评估框架与基准指标,以保留集法对比LLM与人工生成的网络安全规则,多维度评估LLM规则生成器有效性,并分析了Sublime Security的自动检测工程师(ADE)能力。

Comments Preprint of a paper accepted at the Conference on Applied Machine Learning in Information Security (CAMLIS 2025). 11 pages, 3 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07202 2026-08-10 cs.AI 新提交 90%

Authoring and Management of Transparent Research Integrity Assessments of Randomised Clinical Trial Publications Using LLM-assisted Tools and Provenance Knowledge Graphs

使用LLM辅助工具和来源知识图谱撰写与管理随机临床试验出版物的透明研究完整性评估

Milan Markovic, Goutham Indukuri, Somayajulu Sripada, Colby J. Vorland, Jack Wilkinson, Clare Robertson, Mark Bolland, Andrew Grey, Miriam Brazzelli, Alison Avenell

机构 * Interdisciplinary Institute, University of Aberdeen(阿伯丁大学跨学科研究所) University of Aberdeen(阿伯丁大学) Indiana University(印第安纳大学) University of Manchester(曼彻斯特大学) Aberdeen Centre for Evaluation, University of Aberdeen(阿伯丁大学阿伯丁评估中心) University of Auckland(奥克兰大学)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本文介绍了基于LLM的INSPECT-AI工具,结合INSPECT-SR框架与RIPE-O本体,生成含140项评估的RIPE-KG,用于辅助人工评估已发表RCT的研究完整性。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06632 2026-08-10 cs.AI 新提交 90%

Shape Your Feed: An LLM-based Agentic System for Conversational Recommendation

塑造你的信息流:一种基于大语言模型的智能体对话推荐系统

Ziyun Xu, Bosen Ding, Yue Zhang, Ji Qi, Qingyuan Song, Jizhou Huang, Liwei Wang, Jefferey Santelli, Yue Weng, Qichao Que, Zhenheng Yang, Junfeng Pan, Linhong Zhu

机构 * Meta Platforms(元平台公司)

专题命中 领域大模型 :LLM(title,summary_cn);preference optimization(abstract,abstract_cn);分类 cs.AI

AI总结 本文提出基于LLM的智能体推荐框架SYF,采用三层架构实现实时多模态内容协同策划,经离线评估与在线A/B实验验证,可提升信息流相关性与用户情感,为工业场景提供交互式推荐方案。

Comments Accepted in RecSys 2026 Industrial Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06422 2026-08-10 cs.LG 新提交 90%

Sharding Prevents LLM Oversight Failures and Adversarial Exploitation

分片可防止大语言模型(LLM)的监督失效与对抗性利用

Victor Akinwande, J. Zico Kolter, Aran Nayebi

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.LG

AI总结 该研究针对LLM监督中裁决数量增加导致一致性下降的问题,提出分片方法,可提升监督一致性、抵御对抗攻击,且分片后较弱裁判可超越更强的整体裁判。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03866 2026-08-05 cs.AI cs.SY eess.SY 新提交 90%

ADMITBench: A Safety-Governed Reference Framework for Evaluating the Admissibility of Industrial LLM Advisories

ADMITBench:用于评估工业LLM咨询建议可采纳性的安全管控参考框架

Yash Misra, Javal Vyas, Siddharth Gutta, Mehmet Mercangöz

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本研究提出ADMITBench框架,用于评估工业LLM咨询建议的可采纳性,该框架采用带版本的安全管控评估契约,0.1.0版本为公开参考实现,面向技术与研究评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.03382 2026-08-05 cs.IR cs.LG 新提交 90%

LLM-Derived Priors for Thompson Sampling in Cold-Start Comment Recommendation

用于冷启动评论推荐中汤普森采样的大语言模型衍生先验

Eugene Lee, Oseong Choi, Byungsoo Kang, Taeyeong Jang

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 该研究提出用大语言模型(LLM)从评论文本提取语义信号生成贝叶斯先验,用于冷启动评论推荐的汤普森采样,经在线A/B/C测试验证其在稀疏反馈场景中效果显著。

Comments 10 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.10016 2026-08-04 cs.IR cs.LG 版本更新 90%

Tokenizing Numerical and Embedding Features for LLM RecSys

用于语言模型推荐系统的数值和嵌入特征分词

Zhe Xu, Ankit Peshin, Chiyu Zhang, Feng Qi, Johnson Lui, Anil Ramakrishna, Justin Johnson, Carl Hu, Kaushik Rangadurai, Luke Simon

机构 * Meta

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 研究针对多数基于大语言模型的推荐器无法利用非文本信号的问题,提出软令牌融合框架,将数值和嵌入特征映射到LLM嵌入空间,在基于共享参数LLM的双塔检索模型中实例化该框架,实验证明该方法有效提升了检索性能。

Journal ref Second Tokenization Workshop @ COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28889 2026-08-03 cs.HC cs.AI 新提交 90%

Human-LLM Collaborative Inductive Coding for Conceptualizing K-12 Educator AI Use

面向K-12教育工作者AI使用的人机协同归纳编码方法

Alex Liu, Min Sun, Lief Esbenshade, Michael Xiao, Victor Tian, Zachary Zhang, Kevin He

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出多阶段人机协同编码流程,将LLM作为标注工具辅助K-12教育工作者交互语料库编码,保留人类概念权威,构建含72个条目的分层编码本,为定性研究提供可审计模板。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28683 2026-08-03 cs.SE cs.AI 新提交 90%

Metaphor-Induced Algorithmic Steering: Cross-Domain Procedural Transfer in LLM Code Generation

隐喻诱导的算法引导:LLM代码生成中的跨领域过程迁移

Zhibo Hu, Chen Wang, Yanfeng Shu, Hye-young Paik, Liming Dong, Liming Zhu

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本研究提出MASC框架,发现隐喻会诱导LLM代码生成模型迁移低效率过程模式,可高检测率识别此类隐喻技能与低效率实现,揭示其通过源场景过程模式迁移运作的机制。

Comments 12 pages, 11 tables, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28538 2026-07-31 cs.CV cs.LG 新提交 90%

ScaFE: Data-Efficient Scar Classification with LLM-Generated Clinical Feature Programs

ScaFE:基于大语言模型生成的临床特征程序实现数据高效的瘢痕分类

Ruman Wang, Hangting Ye

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 ScaFE将LLM临床知识转化为本地可执行的特征程序,结合轻量级随机森林,在瘢痕分类任务中实现数据高效、跨站点的高性能,且决策可审计,优于现有基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28019 2026-07-31 cs.LG 新提交 90%

Building a User Foundation Model for the Open Web

面向开放网络的用户基础模型构建

Solal Vernier, Ivan Can Arisoy, Merwan Barlier, Blaž Škrlj

机构 * Teads(泰兹)

专题命中 领域大模型 :LLM(summary_cn,abstract);foundation model(title,abstract);language model(abstract);分类 cs.LG

AI总结 该研究针对开放网络RTB场景下用户身份碎片化问题,构建基于自监督学习的用户基础模型,经LLM优化预训练后,在竞价胜率、CTR等生产任务中取得显著性能提升。

Comments RecSys'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.20462 2026-07-24 cs.AI 新提交 90%

Marking the Wrong Symptoms: Evaluating LLM Watermarks in Medical Texts

标记错误症状:评估医学文本中的大语言模型水印

Melanie Rieff, Robin Staab, Thibaud Gloaguen, Stefan Hegselmann, Martin Vechev

机构 * ETH Zurich(苏黎世联邦理工学院) Berlin Institute of Health at Charité – Universitätsmedizin Berlin(柏林夏里特医学院柏林健康研究所) Deutsches Herzzentrum der Charité – Medical Heart Center of Charité and German Heart Institute Berlin(柏林夏里特医学院德国心脏中心与柏林德国心脏研究所)

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究LLM水印对医学性能的影响,在11个LLM和7个VLM上对5种水印方案进行多任务基准测试,引入人类专家验证管道补充评估,发现水印会致多种退化,特定领域评估是医学中水印模型安全部署的前提。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19739 2026-07-23 cs.IR cs.AI 新提交 90%

Personalized Recommendation Tool Learning via Autonomous Language Agents

通过自主语言智能体进行个性化推荐工具学习

Mingdai Yang, Zhiwei Liu, Weizhi Zhang, Yibo Wang, Hao Peng, Philip Yu

机构 * Microsoft(微软公司)

专题命中 领域大模型 :LLM(summary_cn,abstract);language agent(title);large language model(abstract);language model(abstract)

AI总结 研究针对基于大语言模型的智能体在推荐系统中的局限性,提出PRTA框架,让LLM作中央规划器与多推荐模型交互,负责高级推理和个性化工具选择,传统模型进行全排序评分,设计反射机制,实验表明该框架提升了全排序推荐性能。

Comments 6 pages. Accepted by RecSys'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07053 2026-07-22 cs.AI cs.SY eess.SY 版本更新 90%

Animating Petascale Time-varying Data on Commodity Hardware with LLM-assisted Scripting

在消费级硬件上利用LLM辅助脚本动画化exascale时变数据

Ishrat Jahan Eliza, Xuan Huang, Aashish Panta, Alper Sahistan, Zhimin Li, Amy A. Gooch, Valerio Pascucci

机构 * University of Utah(犹他大学) Vanderbilt University(范德比大学) ViSOAR LLC

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出一个用户友好的框架,用于在消费级工作站上生成exascale时变数据的3D动画,通过通用动画描述符、高效数据访问、定制渲染系统和LLM辅助交互接口,使非可视化专家科学家能快速生成高质量动画。

Comments ©2026 IEEE. Personal use of this material is permitted. 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses. N.B. Due to the limitation "The abstract field cannot be longer than 1,920 characters", the abstract here is shorter than that in the original PDF file

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13038 2026-07-16 cs.CY cs.AI 新提交 90%

Designing Safety-Constrained LLM Systems for Public Health Information Access

设计用于公共卫生信息访问的安全约束大语言模型系统

Ben Torkian, Jun Zhou

机构 * University of South Carolina(南卡罗来纳大学)

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对公共卫生信息访问,尤其是母婴健康资源导航,设计实现安全约束大语言模型系统。采用多层架构,含领域受限RAG等,通过可控数据管道确保回复基于精选资源。经场景验证,系统安全约束执行一致、性能稳定,为相关领域部署LLM系统提供指导。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00011 2026-07-15 cs.IR cs.AI cs.SE 版本更新 90%

SkillSelect-Serve: QoS-Aware Budgeted Skill Service Recommendation for LLM Agents

SkillSelect-Serve:面向小型LLM代理的预算可控且QoS感知的技能服务推荐与组合

Jingyuan Zheng, Dongjing Wang, Xin Zhang, Hao Chen, Youhuizi Li, Xudong Shen, Haiping Zhang, Butian Huang, Dongjin Yu, Guandong Xu

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出SkillSelect-Serve框架,将技能选择建模为服务推荐与组合问题,通过双粒度效用建模和预算约束优化,在35,353个技能和586个任务查询上优于固定top-k检索基线。

Comments 18 pages (14-page main text + appendices), 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15245 2026-07-09 cs.CL cs.HC 版本更新 90%

Practicing with Language Models Cultivates Human Empathic Communication

与语言模型练习培养人类共情沟通

Aakriti Kumar, Nalin Poungpeth, Diyi Yang, Bruce Lambert, Matthew Groh

机构 * Kellogg School of Management, Northwestern University(西北大学凯洛格管理学院) Northwestern Institute for Complex Systems, Northwestern University(西北大学复杂系统研究所) Ryan Institute on Complexity, Northwestern University(西北大学复杂性研究院) Department of Computer Science, Stanford University(斯坦福大学计算机科学系) Department of Communication Studies, Northwestern University(西北大学传播学系) Department of Computer Science, Northwestern University(西北大学计算机科学系)

专题命中 领域大模型 :LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.CL

AI总结 研究通过实验平台探讨共情沟通技能的提升,发现简短的LLM指导干预能有效提升参与者与规范共情沟通模式的匹配度,并发现沉默共情效应。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00448 2026-07-07 cs.IR cs.AI 新提交 90%

Real-Time Hard Negative Sampling via LLM-based Clustering for Large-Scale Two-Tower Retrieval

基于LLM聚类的实时硬负采样用于大规模双塔检索

Ivan Ji, Liuyi Hu, Harrison, Zhao, Lei Huang, Qunshu Zhang, Max, Fan, Aameek Singh

机构 * Meta

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 针对双塔模型训练中负样本易学习的问题,提出利用大语言模型聚类生成硬负样本的实时采样方法,能有效提升模型性能并降低流行度偏差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27611 2026-06-29 cs.LG 新提交 90%

COOPA: A Modular LLM Agent Architecture for Operations Research Problems

COOPA: 面向运筹学问题的模块化LLM智能体架构

Chuanhao Li, Xiaoan Xu, Dirk Bergemann, Ethan X. Fang, Yehua Wei, Zhuoran Yang

机构 * Tsinghua University(清华大学) Duke University(杜克大学) Yale University(耶鲁大学)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.LG

AI总结 提出COOPA模块化LLM智能体架构,通过迭代置信度建模、元素级溯源与多求解器路由,提升运筹问题建模准确性与可解释性,在多个基准上优于基线方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26519 2026-06-29 cs.AI 新提交 90%

What the LLM Should Not Say: Boundary-Aware Context Grounding for A Seven-Channel EEG Agent

面向低通道EEG智能体的边界感知上下文接地

Zhiyuan Xu, Yueqing Dai, Junling Li, Junwen Luo

机构 * Shanghai Pulse Element Intelligent Technology Co., Ltd. (NeuraDock)(上海脉冲元素智能科技有限公司(NeuraDock))

专题命中 领域大模型 :LLM(title,summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出NeuraDock Agent架构,通过分离确定性本地EEG引擎与硬件感知语言层,实现LLM对低通道EEG数据的边界感知接地,经288次测试验证了系统在数值重复性、故障恢复和边界感知方面的有效性。

Comments 25 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.26346 2026-06-26 cs.AI 新提交 90%

How Do Tool-Augmented LLM Agents Perform on Real-World Energy Analytics Tasks?

工具增强的LLM智能体在真实世界能源分析任务中的表现如何?

David Akinpelu, Akintonde Abbas, Rereloluwa Alimi, Ayodeji Lana

机构 * Independent Researcher(独立研究员) Tume AI

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 针对能源领域缺乏智能体评估基准的问题,构建了包含243个专家策划问题的测试环境,评估工具增强的LLM智能体在数据检索、知识解释和定量建模三类任务上的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25941 2026-06-25 cs.HC cs.AI cs.SY eess.SY 新提交 90%

Explainable Control Framework (XCF) based on Fuzzy Model-Agnostic Explanation and LLM Agent-Supported Interface

基于模糊模型无关解释与LLM智能体支持接口的可解释控制框架(XCF)

Faliang Yin, Hak-Keung Lam, David Watson

机构 * Department of Engineering, Faculty of Natural, Mathematical & Engineering Sciences, King’s College London(工程系,自然、数学与工程科学学院,伦敦国王学院)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出可解释控制框架XCF,通过分层模糊模型无关解释方法HFMAE-C和LLM智能体接口,为闭环控制器提供模型无关的解释,并在倒立摆和Turtlebot避障案例中验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.25057 2026-06-25 cs.CL 新提交 90%

LLM-Based Scientific Peer Review: Methods, Benchmarks, and Reliability Challenges

基于LLM的科学同行评审:方法、基准与可靠性挑战

Thi Huyen Nguyen, Zahra Ahmadi

机构 * L3S Research Center, Leibniz University Hannover(莱布尼茨汉诺威大学L3S研究中心) Peter L. Reichertz Institute for Medical Informatics of TU Braunschweig and Hannover Medical School(布伦瑞克工业大学与汉诺威医学院彼得·L·赖歇茨医学信息学研究所) Lower Saxony Center for AI and Causal Methods in Medicine (CAIMed)(下萨克森州医学人工智能与因果方法中心(CAIMed))

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文综述了基于大语言模型的科学同行评审,聚焦批评生成与分数预测两大功能,分析了建模方法、基准评估、数据局限及鲁棒性风险,并提出了未来研究方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22493 2026-06-23 physics.optics cs.AI 新提交 90%

An LLM-Orchestrated Agent for Directional-Coupler Design with Self-Consistent Eigenmode and FDTD Validation

一种用于定向耦合器设计的LLM编排智能体,具有自洽本征模和FDTD验证

Saumya Biswas, Amrit De, Md Tauhidul Islam

机构 * Department of Mechanical Engineering, University of Maryland, College Park(马里兰大学学院市机械工程系) Apsidal LLC Department of Radiation Oncology, Stanford University(斯坦福大学放射肿瘤科)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 提出一种由大语言模型编排的智能体,结合本征模求解器和FDTD验证,自动设计SOI 2×2定向耦合器,实现高精度50/50分束。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22664 2026-06-23 cs.AI 版本更新 90%

MBABench: Evaluating LLM Agents on End-to-End Spreadsheet Tasks in Finance

WorkstreamBench: 评估LLM代理在金融领域的端到端电子表格任务

Thomson Yen, Julian Poeltl, Harshith Srinivas Gear, Yilin Meng, Joshua Fan, Adam Shen, Yili Liu, Ali Bauyrzhan, Siri Du, Haoyang Liu, Daniel Guetta, Hongseok Namkoong

机构 * Decision, Risk, and Operations Division, Columbia Business School(哥伦比亚商学院决策、风险与运营部门) ESB Business School, Reutlingen University(图宾根大学ESB商学院)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出WorkstreamBench,用于评估LLM代理在金融领域复杂端到端电子表格任务中的能力,重点在于财务建模和情景分析等关键流程,通过三个维度(准确性、公式、格式)的细粒度标准来衡量解决方案质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19509 2026-06-19 cs.AI 新提交 90%

LLM Doesn't Know What It Doesn't Know: Detecting Epistemic Blind Spots via Cross-Model Attribution Divergence on Clinical Tabular Data

LLM 不知道它不知道什么:通过跨模型归因分歧检测临床表格数据上的认知盲点

Akshat Dasula, Prasanna Desikan, Jaideep Srivastava

机构 * Centific AI Research(Centific AI研究)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究大语言模型在结构化临床数据上的认知不确定性,通过跨模型归因分歧分析,发现其口头置信度空洞、存在逆难度效应,并提出基于归因分歧的校准方法,无需训练即可提升准确率并降低校准误差。

Comments Accepted at EIML@ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10574 2026-06-16 cs.AI 版本更新 90%

LLM Jaggedness Unlocks Scientific Creativity

LLM Jaggedness Unlocks Scientific Creativity

Shray Mathur, J. Anibal Boscoboinik, Esther H. R. Tsai, Kevin G. Yager

机构 * Center for Functional Nanomaterials, Brookhaven National Laboratory(功能纳米材料中心,布鲁赫萨尔国家实验室)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文研究了大型语言模型(LLMs)在科学创意生成中的不规则进步现象,提出了SciAidanBench基准测试集,通过评估不同模型在科学问题上的创意生成能力,揭示了模型在跨任务、提示和领域层面的不均衡表现,并展示了如何通过推理计算、知识聚合和头脑风暴等机制利用这种不规则性来提升科学创造力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.13082 2026-06-12 cs.CL 新提交 90%

sebis at CRF Filling 2026: A Two-Stage Local LLM Pipeline for Medical CRF Filling

sebis at CRF Filling 2026: 用于医疗CRF填写的两阶段本地LLM流水线

Katharina Sommer, Tristan Till, Florian Matthes

机构 * Technical University of Munich(慕尼黑工业大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 提出基于MedGemma-27B的两阶段本地流水线,分离二值存在分类与值提取,通过少样本上下文学习实现隐私保护,在CRF填写任务上取得0.55 macro-F1,排名第二。

Comments Published in Proceedings of the Third Workshop on Patient-Oriented Language Processing (CL4Health), LREC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.10120 2026-06-11 cs.IR cs.AI cs.HC 版本更新 90%

MetaPlate: Counterfactual-Guided RAG-LLM Tool for Personalized Food Recommendation and Hyperglycemia Prevention

MetaPlate: 反事实引导的RAG-LLM工具用于个性化食物推荐和高血糖预防

Asiful Arefeen, Carol Johnston, Hassan Ghasemzadeh

机构 * College of Health Solutions, Arizona State University(亚利桑那州立大学健康解决方案学院) School of Computing and Augmented Intelligence, Arizona State University(亚利桑那州立大学计算与增强智能学院)

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 提出MetaPlate框架,结合反事实解释、机器学习预测和RAG-LLM,生成个性化膳食建议以预防餐后高血糖,经注册营养师评估证明其可行性和有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏