arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-05-01 至 2026-05-01 共收录 18 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 18 篇

2604.27321 2026-05-01 cs.CR cs.AI cs.IR 91%

Toward Autonomous SOC Operations: End-to-End LLM Framework for Threat Detection, Query Generation, and Resolution in Security Operations

迈向自主SOC操作:面向安全操作中威胁检测、查询生成与解决的端到端LLM框架

Md Hasan Saju, Akramul Azim

机构 * Ontario Tech University(安大略技术大学)

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出端到端威胁管理框架,通过集成基于集成的检测、语法约束查询生成和检索增强的解决支持,自动化安全操作流程,提升效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27433 2026-05-01 cs.HC 90%

Beyond One-Size-Fits-All Exercises: Personalizing Computer Science Worksheets with Large Language Models

超越一刀切练习:利用大语言模型个性化计算机科学练习册

Franco Ortiz, Runlong Ye, Michael Liut

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn)

AI总结 本文研究利用大语言模型根据学生学习者画像生成个性化编程课程练习,发现个性化材料显著提高低知识学生完成率和正确率,且不降低任务难度。

Comments Accepted at ITiCSE

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27872 2026-05-01 cs.AI 90%

Modeling Clinical Concern Trajectories in Language Model Agents

语言模型代理中临床关注轨迹建模

Sukesh Subaharan, Venkatesan VS, Murugadasan P, Sivakumar D, Gautham N, Ganeshkumar M

专题命中 领域大模型 :LLM(summary_cn,abstract);language model(title,abstract);large language model(abstract);分类 cs.AI

AI总结 本文研究通过显式状态动态揭示临床关注轨迹,提出轻量级架构以生成连续升级压力信号,使LLM代理更符合临床实际需求。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19423 2026-05-01 cs.IR 89%

UniRec: Unified Multimodal Encoding for LLM-Based Recommendations

UniRec:基于LLM的推荐系统的统一多模态编码

Zijie Lei, Tao Feng, Zhigang Hua, Yan Xie, Guanyu Lin, Shuang Yang, Ge Liu, Jiaxuan You

专题命中 领域大模型 :LLM(title,title_cn);large language model(abstract);language model(abstract)

AI总结 UniRec通过统一多模态编码解决推荐系统中多模态信息的理解挑战,提出三元组表示和分层Q-Former结构,实现在多个基准测试中提升15%的性能。

Journal ref Transactions on Machine Learning Research, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27470 2026-05-01 cs.CL 88%

HealthBench Professional: Evaluating Large Language Models on Real Clinician Chats

HealthBench Professional: 评估大型语言模型在真实临床对话中的表现

Rebecca Soskin Hicks, Mikhail Trofimov, Dominick Lim, Rahul K. Arora, Foivos Tsimpourlas, Preston Bowman, Michael Sharman, Chi Tong, Kavin Karthik, Arnav Dugar, Akshay Jagadeesh, Khaled Saab, Johannes Heidecke, Ashley Alexander, Nate Gross, Karan Singhal

机构 * OpenAI

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL

AI总结 本文提出HealthBench Professional基准,用于评估大型语言模型在临床实践中真实任务的表现,包含三个核心用例,通过医师评分系统评估模型性能,提供医疗AI领域跟踪前沿模型进展的测量工具。

Comments Data link in paper; Blog: https://openai.com/index/making-chatgpt-better-for-clinicians/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27555 2026-05-01 cs.AI 87%

SpatialGrammar: A Domain-Specific Language for LLM-Based 3D Indoor Scene Generation

SpatialGrammar: 一种面向领域的语言用于基于LLM的3D室内场景生成

Song Tang, Kaiyong Zhao, Yuliang Li, Qingsong Yan, Penglei Sun, Junyi Zou, Qiang Wang, Xiaowen Chu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

专题命中 领域大模型 :LLM(title,title_cn);分类 cs.AI

AI总结 本文提出SpatialGrammar,一种领域特定语言,通过BEV网格放置确定性编译生成有效3D几何,提升空间准确性和物理合理性。SG-Agent通过编译器反馈迭代优化场景,SG-Mini在单次生成场景中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.14541 2026-05-01 cs.CL 87%

LLM-based User Profile Management for Recommender System

基于大语言模型的用户画像管理用于推荐系统

Seunghwan Bang, Hwanjun Song

机构 * Ulsan National Institute of Science and Technology(乌山国立科学研究院) Korea Advanced Institute of Science and Technology(韩国先进科学技术研究院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 本文提出PURE框架,通过系统提取和总结用户评论中的关键信息,构建和维护动态用户画像,提升推荐系统的个性化能力。

Comments Accepted at SIGIR 2025 Workshop

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27351 2026-05-01 cs.AI cs.CL cs.LG 87%

Heterogeneous Scientific Foundation Model Collaboration

异质科学基础模型协作

Zihao Li, Jiaru Zou, Feihao Fang, Xuying Ning, Mengting Ai, Tianxin Wei, Sirui Chen, Xiyuan Yang, Jingrui He

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

专题命中 领域大模型 :foundation model(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出Eywa框架,通过将语言模型与领域特定基础模型结合,提升科学领域多模态任务的推理能力,实验显示其在结构化数据任务中表现更优。

Comments Preprint. 57 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27673 2026-05-01 cs.AI cs.CY cs.HC cs.LG cs.SI 82%

The TEA Nets framework combines AI and cognitive network science to model targets, events and actors in text

TEA Nets框架结合人工智能与认知网络科学,用于建模文本中的目标、事件和主体

Sebastiano Franchini, Alexis Carrillo, Edoardo Sebastiano De Duro, Riccardo Improta, Ali Aghazadeh Ardebili, Massimo Stella

机构 * CogNosco Lab, Department of Psychology and Cognitive Science, University of Trento(CogNosco实验室,心理学与认知科学系,特伦托大学)

专题命中 领域大模型 :LLM(summary_cn,abstract);分类 cs.AI、cs.LG

AI总结 TEA Nets框架通过认知网络科学和人工智能提取文本中的主体、事件和目标,展示了在阴谋文本和LLM生成文本中进行可解释情绪检测、语义框架分析和语言研究的能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27092 2026-05-01 cs.AI physics.optics 81%

End-to-end autonomous scientific discovery on a real optical platform

端到端自主科学发现于真实光学平台

Shuxing Yang, Fujia Chen, Rui Zhao, Junyao Wu, Yize Wang, Haiyao Luo, Ning Han, Qiaolu Chen, Yuze Hu, Wenhao Li, Mingzhu Li, Hongsheng Chen, Yihao Yang

机构 * State Key Laboratory of Extreme Photonics and Instrumentation, College of Information Science and Electronic Engineering, ZJU-Hangzhou Global Scientific and Technological Innovation Center, The Electromagnetics Academy at Zhejiang University, Zhejiang University(极端光子学与仪器国家重点实验室,信息科学与电子工程学院,浙大杭州国际科学技术创新中心,浙江大学电磁学学院,浙江大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出Qiushi Discovery Engine,通过非线性研究阶段、Meta-Trace记忆和双层架构,在真实光学平台实现端到端自主科学发现,首次实验验证了非平凡物理机制。

Comments 25 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26959 2026-05-01 cs.CY cs.AI cs.MA 81%

CareGuardAI: Context-Aware Multi-Agent Guardrails for Clinical Safety & Hallucination Mitigation in Patient-Facing LLMs

CareGuardAI:面向临床安全与幻觉抑制的上下文感知多智能体守卫机制

Elham Nasarian, Abhilash Neog, Kwok-Leung Tsui, Niyousha HosseiniChimeh

机构 * Grado Department of Industrial & Systems Engineering, Virginia Tech, Blacksburg, VA 24061, USA(弗吉尼亚理工大学格拉多工业与系统工程系,弗吉尼亚理工大学,布莱克斯堡,VA 24061,美国) Department of Computer Science, Virginia Tech, Blacksburg, VA 24061, USA(弗吉尼亚理工大学计算机科学系,弗吉尼亚理工大学,布莱克斯堡,VA 24061,美国) Dept of Industrial, Manufacturing, and Systems Engineering at University of Texas at Arlington, Arlington, TX 76019, USA(德克萨斯理工大学阿灵顿分校工业、制造与系统工程系,阿灵顿,TX 76019,美国)

专题命中 领域大模型 :LLM(summary_cn);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 CareGuardAI通过引入临床安全风险评估和幻觉风险评估,结合多阶段管道和迭代优化,提升患者面对LLM的可靠性与安全性,优于基线模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27724 2026-05-01 cs.AI 77%

Iterative Multimodal Retrieval-Augmented Generation for Medical Question Answering

迭代多模态检索增强生成用于医疗问答

Xupeng Chen, Binbin Shi, Chenqian Le, Jiaqi Zhang, Kewen Wang, Ran Gong, Jinhan Zhang, Chihang Wang

机构 * New York University, New York, USA(纽约大学) Tsinghua University, Beijing, China(清华大学) Independent Researcher(独立研究者) Chinese Academy of Sciences, Beijing, China(中国科学院)

专题命中 领域大模型 :LLM(abstract,abstract_cn);language model(abstract);分类 cs.AI

AI总结 MED-VRAG通过多模态检索增强生成框架,利用文档页面图像而非OCR文本进行医疗问答,提升准确率至78.6%,并验证检索和迭代对问答性能的积极影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.24262 2026-05-01 cs.LG 77%

Coverage-Aware Web Crawling for Domain-Specific Supplier Discovery via a Web--Knowledge--Web Pipeline

面向领域供应商发现的覆盖感知网络爬虫:通过网络-知识-网络流水线

Yijiashun Qi, Yijiazhen Qi, Tanmay Wagh

机构 * University of Michigan(密歇根大学) The University of Hong Kong(香港大学) Santa Clara University(圣克拉拉大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);prompting(abstract);分类 cs.LG

AI总结 本文提出网络-知识-网络流水线,通过迭代爬取领域网页、提取知识并引导爬虫,提高中小企业发现的覆盖率和精度,实验显示其在半导体设备制造领域表现优异。

Comments Accepted by 2026 7th International Conference on Computer Information and Big Data Applications

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.19768 2026-05-01 cs.AI cs.CR cs.LG 73%

GAVEL: Towards Rule-Based Safety Through Activation Monitoring

GAVEL:通过激活监控实现基于规则的安全性

Shir Rozenfeld, Rahul Pankajakshan, Itay Zloczower, Eyal Lenga, Gilad Gressel, Yisroel Mirsky

机构 * Ben Gurion University of the Negev(本·古里安大学) Amrita Vishwa Vidyapeetham(阿米塔大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文提出基于规则的激活安全性方法,通过细粒度可解释的激活元素捕捉领域特定行为,提升精度并支持定制化,为可扩展的AI治理奠定基础。

Comments Accepted to ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27969 2026-05-01 cs.SE cs.AI 70%

From Mirage to Grounding: Towards Reliable Multimodal Circuit-to-Verilog Code Generation

从幻象到基础:迈向可靠的多模态电路到Verilog代码生成

Guang Yang, Xing Hu, Xiang Chen, Xin Xi

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security, Hangzhou(杭州高新技术区(滨江)区块链与数据安全研究院,杭州) School of Artificial Intelligence and Computer Science, Nantong University(人工智能与计算机科学学院,南通大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 本文提出VeriGround模型,通过标识符匿名化、拒绝增强和D-ORPO对齐,解决了多模态模型在电路到Verilog代码生成中的可靠性问题,验证了真实视觉基础的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.14352 2026-05-01 cs.CY cs.AI cs.LO 70%

Epistemic reflections on AI answering our questions: overwatch, erudite, logician, interlocutor

关于AI回答问题的认知反思:监视、博学、逻辑学家、对话者

Johan F. Hoorn, Ella-Jenna Oosterglorenwoud

机构 * The Hong Kong Polytechnic University(香港理工大学) Eindhoven University of Technology (TU/e)(埃因霍温理工大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);分类 cs.AI

AI总结 本文探讨AI在金融、法律等领域被广泛依赖的问题,指出其缺乏逻辑验证和实证验证,可能导致误判和剽窃。提出需了解推理系统以使AI成为可信的对话伙伴。

Comments 22 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.21850 2026-05-01 cond-mat.mtrl-sci 67%

OptiMat Alloys: a FAIR, living database of multi-principal element alloys enabled by a conversational agent

OptiMat 合金:由对话代理驱动的多主元合金FAIR活数据库

Yang Hu, Vladyslav Turlo

专题命中 领域大模型 :large language model(abstract);language model(abstract)

AI总结 OptiMat Alloys通过对话代理实现多主元合金探索,结合活数据库、网页界面和不确定性量化,使计算合金筛选更易用,拓展FAIR原则至按需知识生成。

Comments See demo here https://youtu.be/lQzuorkzPMc

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27875 2026-05-01 cs.CV 50%

Frequency-Aware Semantic Fusion with Gated Injection for AI-generated Image Detection

具有门控注入的频率感知语义融合用于AI生成图像检测

Shuchang Zhou, Shangkun Wu, Jiwei Wei, Ke Liu, Ran Ran, Caiyan Qin, Yang Yang

机构 * University of Electronic Science and Technology of China(电子科技大学) Harbin Institute of Technology(哈尔滨工业大学)

专题命中 领域大模型 :foundation model(abstract)

AI总结 本文提出FGINet,通过BMFE和LGFI机制提升AI生成图像检测的泛化能力,采用HCL框架学习紧凑且分离的表示。

详情

展开后加载摘要…

URL PDF HTML 收藏