arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-02-25 至 2026-02-25 共收录 14 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 14 篇

2602.20324 2026-02-25 cs.AI cs.CL cs.LG 89%

An artificial intelligence framework for end-to-end rare disease phenotyping from clinical notes using large language models

基于大语言模型的端到端罕见病表型从临床笔记中提取人工智能框架

Cathy Shyr, Yan Hu, Rory J. Tinker, Thomas A. Cassini, Kevin W. Byram, Rizwan Hamid, Daniel V. Fabbri, Adam Wright, Josh F. Peterson, Lisa Bastarache, Hua Xu

专题命中 领域大模型 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 RARE-PHENIX通过整合大语言模型、本体标准化和监督排名,实现了端到端罕见病表型分析,优于现有深度学习基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21127 2026-02-25 cs.HC cs.AI cs.CR cs.SI 85%

"Are You Sure?": An Empirical Study of Human Perception Vulnerability in LLM-Driven Agentic Systems

你确定吗?:一项关于LLM驱动代理系统中人类感知脆弱性的实证研究

Xinfeng Li, Shenyu Dai, Kelong Zheng, Yue Xiao, Gelei Deng, Wei Dong, Xiaofeng Wang

机构 * Nanyang Technological University(南洋理工大学) KTH(皇家理工学院) William & Mary(威廉与玛丽学院)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 研究通过实证分析揭示人类对LLM驱动代理系统中代理介导欺骗的脆弱性,并提出基于HAT-Lab的防御策略。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21045 2026-02-25 cs.HC cs.CL 85%

PaperTrail: A Claim-Evidence Interface for Grounding Provenance in LLM-based Scholarly Q&A

PaperTrail: 一种用于在基于大语言模型的学术问答中建立溯源的声明-证据接口

Anna Martin-Boyle, Cara A. C. Leckey, Martha C. Brown, Harmanpreet Kaur

机构 * University of Minnesota(明尼苏达大学) NASA Langley Research Center(NASA兰利研究中心)

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL

AI总结 PaperTrail通过分解LLM回答和源文档为声明与证据,帮助学术领域更严谨地验证LLM的可信度,并揭示其信任worthiness。

Comments 25 pages, 3 figures. Accepted at the ACM CHI conference on Human Factors in Computing Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20663 2026-02-25 cs.CR 85%

ICSSPulse: A Modular LLM-Assisted Platform for Industrial Control System Penetration Testing

ICSSPulse:一个模块化的LLM辅助平台用于工业控制系统渗透测试

Michail Takaronis, Athanasia Kollarou, Vyron Kampourakis, Vasileios Gkioulos, Sokratis Katsikas

专题命中 领域大模型 :LLM(title,abstract);large language model(abstract);language model(abstract)

AI总结 ICSSPulse是一个模块化平台,利用LLM生成报告,用于工业控制系统安全评估和渗透测试。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07172 2026-02-25 cs.AI 83%

NewtonBench: Benchmarking Generalizable Scientific Law Discovery in LLM Agents

NewtonBench: 在LLM代理中评估可推广的科学定律发现

Tianshi Zheng, Kelvin Kiu-Wai Tam, Newt Hue-Nam K. Nguyen, Baixuan Xu, Zhaowei Wang, Jiayang Cheng, Hong Ting Tsang, Weiqi Wang, Jiaxin Bai, Tianqing Fang, Yangqiu Song, Ginny Y. Wong, Simon See

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) NVIDIA(英伟达)

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 NewtonBench通过反事实定律变化生成科学定律发现任务,评估LLM代理在复杂系统中发现隐藏原理的能力,并揭示其在系统复杂性和观测噪声下的脆弱性。

Comments ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05598 2026-02-25 cs.IR cs.AI 83%

AgentDR: Dynamic Recommendation with Implicit Item-Item Relations via LLM-based Agents

AgentDR: 通过基于LLM的代理进行动态推荐:利用隐式物品-物品关系

Mingdai Yang, Nurendra Choudhary, Jiangshu Du, Edward W. Huang, Philip S. Yu, Karthik Subbian, Danai Koutra

机构 * Amazon(亚马逊) University of Michigan(密歇根大学)

专题命中 领域大模型 :LLM(title,abstract);prompting(abstract);分类 cs.AI

AI总结 AgentDR通过基于LLM的代理利用隐式物品-物品关系,结合记忆机制和提示策略,提升动态推荐的全排名性能和相关性。

Comments 12 pages, accepted by WWW'26 as long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20644 2026-02-25 cs.SE 82%

An LLM-driven Scenario Generation Pipeline Using an Extended Scenic DSL for Autonomous Driving Safety Validation

基于扩展Scenic DSL的LLM驱动场景生成流水线用于自动驾驶安全验证

Fida Khandaker Safa, Yupeng Jiang, Xi Zheng

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract)

AI总结 本文提出基于扩展Scenic DSL和LLM的场景生成流水线,实现高精度自动驾驶安全验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.08055 2026-02-25 q-bio.OT 82%

MCPmed: A Call for MCP-Enabled Bioinformatics Web Services for LLM-Driven Discovery

MCPmed: 一种面向LLM驱动发现的MCP启用生物信息学Web服务的呼吁

Matthias Flotho, Ian Ferenc Diks, Philipp Flotho, Leidy-Alejandra G. Molano, Pascal Hirsch, Andreas Keller

专题命中 领域大模型 :LLM(title);large language model(abstract);language model(abstract)

AI总结 MCPmed旨在通过MCP协议提升生物信息学Web服务的自动化和互操作性,以支持LLM驱动的发现研究。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.08274 2026-02-25 cs.CL cs.AI 81%

Language Modeling and Understanding Through Paraphrase Generation and Detection

通过改写生成与检测实现语言模型与理解

Jan Philip Wahle

专题命中 领域大模型 :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本研究通过分解改写类型提升语言模型对语义等价的理解能力,在剽窃检测和重复问题识别中取得显著成效。

Comments PhD Thesis (Dissertation), University of Göttingen Germany, 2025. 186 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.12007 2026-02-25 cs.IR cs.AI 77%

Diffusion Generative Recommendation with Continuous Tokens

基于连续令牌的扩散生成推荐

Haohao Qu, Shanru Lin, Yujuan Ding, Yiqi Wang, Wenqi Fan

机构 * The Hong Kong Polytechnic University(香港理工大学) City University of Hong Kong(香港城市大学) National University of Defense Technology(国防科技大学)

专题命中 领域大模型 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI

AI总结 ContRec通过整合连续令牌和扩散模型,提升基于LLM的推荐系统性能。

Comments Accepted by The ACM Web Conference (WWW 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20639 2026-02-25 cs.AI 70%

Grounding LLMs in Scientific Discovery via Embodied Actions

通过具身动作 grounding LLMs 在科学发现中

Bo Zhang, Jinfeng Zhou, Yuxuan Chen, Jianing Yin, Minlie Huang, Hongning Wang

机构 * Tsinghua University, Beijing, China(清华大学)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 通过具身动作框架,LLMs在科学发现中实现更稳定的物理模拟和更高的建模准确性。

Comments 24 pages, 7 figures, 7 tables. Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.21825 2026-02-25 cs.AI 70%

DS-STAR: Data Science Agent for Solving Diverse Tasks across Heterogeneous Formats and Open-Ended Queries

DS-STAR:跨异构格式和开放性查询的多样化任务数据科学代理

Jaehyun Nam, Jinsung Yoon, Jiefeng Chen, Raj Sinha, Jinwoo Shin, Tomas Pfister

机构 * Google Cloud(谷歌云) KAIST(韩国科学技术院)

专题命中 领域大模型 :large language model(abstract);language model(abstract);分类 cs.AI

AI总结 DS-STAR是一种专门设计用于跨异构数据格式和开放性查询的代理,能生成高质量研究报告并超越传统问答能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.21142 2026-02-25 cs.CV cs.LG 57%

LUMEN: Longitudinal Multi-Modal Radiology Model for Prognosis and Diagnosis

LUMEN: 长期多模态放射学模型用于预后和诊断

Zhifan Jiang, Dong Yang, Vishwesh Nath, Abhijeet Parida, Nishad P. Kulkarni, Ziyue Xu, Daguang Xu, Syed Muhammad Anwar, Holger R. Roth, Marius George Linguraru

机构 * 1 Sheikh Zayed Institute for Pediatric Surgical Innovation, Children's National Hospital, Washington DC, USA 2 Nvidia Corporation, Santa Clara, CA, USA 3 ETSI Telecomunicaci\' o n, Universidad Polit\' e cnica de Madrid, Madrid, Spain 4 School of Medicine Health Sciences, George Washington University, Washington DC, USA

专题命中 领域大模型 :language model(abstract);分类 cs.LG

AI总结 LUMEN模型通过多任务指令微调提升纵向放射影像的诊断与预后能力。

Comments Accepted to IEEE International Symposium on Biomedical Imaging (ISBI) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.20446 2026-02-25 cs.CR 50%

Understanding Human-AI Collaboration in Cybersecurity Competitions

理解网络安全竞赛中的人机协作

Tingxuan Tang, Nicolas Janis, Kalyn Asher Montague, Kevin Eykholt, Dhilung Kirat, Youngja Park, Jiyong Jang, Adwait Nadkarni, Yue Xiao

专题命中 领域大模型 :prompting(abstract)

AI总结 研究探讨了网络安全竞赛中人类与AI协作的有效性,发现AI代理在自主引导提示和工具使用时能超越多数人类团队。

详情

展开后加载摘要…

URL PDF HTML 收藏