arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12565 信号源:cs.CL, cs.AI, cs.LG

1. 领域大模型 12565 篇

2607.28218 2026-07-31 stat.AP 新提交 86%

Bridging Probabilistic LLMs and Deterministic Statistical Validation: The PROVE Multi-Agent Framework for Clinical Trial Reporting

连接概率型大语言模型与确定性统计验证:用于临床试验报告的PROVE多智能体框架

Zhaohua Lu, Cheng Zheng, Yuanyuan Han

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究提出PROVE多智能体框架,结合LLM与程序化验证器,在临床试验报告TFL验证中,LLM辅助语义匹配可显著提升差异检测的召回率与F1值,兼顾解读灵活性与数值准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27789 2026-07-31 cs.IR 新提交 86%

From Understanding to Action: Feedback-Grounded Policy Discovery for Generative Recommendation

从理解到行动:面向生成式推荐的反馈驱动策略发现

Zhi Chen, Minmao Wang, Xingchen Liu, Haoqiang Liang, Huihuang Lin, Likang Wu, Hongke Zhao, Yulong Wang, Shijie Yi, Fei Pan, Peng Jiang

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 该研究针对生成式推荐的“理解-行动差距”,提出反馈驱动智能体框架,经蒸馏迁移至轻量模型实现无LLM在线推理,在基准测试与在线A/B测试中均取得推荐效果提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.06300 2026-07-30 cs.CL cs.AI cs.LG 版本更新 86%

$\texttt{AMEND++}$: Benchmarking Eligibility Criteria Amendments in Clinical Trials

AMEND++:临床试验资格标准修订的基准测试

Trisha Das, Mandis Beigi, Jacob Aptekar, Jimeng Sun

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) Medidata Solutions(Medidata解决方案)

专题命中 领域大模型 :LLM(abstract,abstract_cn);language model(abstract,abstract_cn);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 AMEND++通过CAMLM模型提升临床试验资格标准修订预测的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.09995 2026-07-28 cs.CE 版本更新 86%

QuantHarness: Price-Driven Multi-Agent LLMs for High-Frequency Trading

QuantHarness:用于高频交易的价格驱动多智能体大语言模型

Fei Xiong, Xiang Zhang, Aosong Feng, Siqi Sun, Chenyu You

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 研究针对高频交易需求,引入QuantHarness多智能体LLM框架,将交易分解为四个智能体,利用结构化信号与LLM推理结合,经多金融工具实验验证,该框架在多指标上优于基线方法,为高频金融市场实时决策提供可行路径。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15932 2026-07-08 cs.CV 版本更新 86%

NAMD: Virtual Follow-up Computed Tomography Synthesis via Nodule-Aligned Multimodal Diffusion Models for Early Lung Cancer Diagnosis

基于LLM驱动多模态扩散的结节对齐潜在空间学习:用于肺结节进展预测

James Song, Yifan Wang, Chuan Zhou, Liyue Shen

机构 * Department of EECS, University of Michigan(电子工程与计算机科学系,密歇根大学) University of Michigan Medical School(密歇根大学医学学院)

专题命中 领域大模型 :LLM(title_cn,summary_cn)

AI总结 本文提出NAMD框架,通过生成1年随访CT图像预测肺结节进展,利用结节对齐潜在空间和LLM驱动控制机制,在NLST数据集上实现优于基线和现有方法的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.21059 2026-06-23 cs.CR 新提交 86%

DEFENGRAPH: Knowledge Graph-Enhanced LLMs for Blue Team Cyber Defense

DEFENGRAPH:面向蓝队网络防御的知识图谱增强型大语言模型

Zhen Wang, Kristen Moore, Qin Wang, Guangsheng Yu, Minjune Kim, Diksha Goel, Gang Li, Ahmed Ibrahim, Ahmad Mohsin, Helge Janicke

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出DEFENGRAPH框架,通过双层静态-动态知识图谱与图路径检索、上下文过滤和重排序增强LLM的上下文推理,在红蓝对抗演习数据上显著提升防御决策的召回率和精确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.18405 2026-06-18 cs.CR 新提交 86%

Evaluating the Effectiveness of LLMs in Aiding Compliance Testing of PKCS#1-v1.5

评估LLM在辅助PKCS#1-v1.5合规性测试中的有效性

Polina Kozyreva, Endadul Hoque

专题命中 领域大模型 :LLM(title_cn,summary_cn)

AI总结 研究结合语法变异与LLM代码合成的方法,在PKCS#1 v1.5签名验证的48个加密库实现中,重现了13个非平凡违规类别中的10个,包括所有5个签名伪造类别,并发现1个新差异,但LLM幻觉(82.5%)是主要限制因素。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.14932 2026-06-16 cs.IR 新提交 86%

Retrieval-as-a-Service:A System-Oriented Analysis of Industrial Retrieval Pipelines in Web Systems

检索即服务:Web系统中工业检索管道的系统导向分析

Fang Liu, Yuan Yuan, Yifan Dang, Xuncheng Zhang, Cuiqianhe Du

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文从系统角度调查工业检索管道,提出统一RaaS管道抽象,分析LLM集成的影响,为大规模Web系统提供设计指南。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08819 2026-06-15 cond-mat.mtrl-sci 86%

TEM Agent: enhancing transmission electron microscopy (TEM) with modern AI tools

TEM Agent:利用现代AI工具增强透射电子显微镜(TEM)

Morgan K. Wall, Alexander J. Pattison, Edward S. Barnard, Stephanie M. Ribet, Peter Ercius

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出TEM Agent框架,通过模型上下文协议(MCP)方法结合商业LLM,实现对TEM多个子系统的访问与控制,简化复杂显微镜生态系统,提升用户完成各类难度实验的能力。

Comments 22 pages, 4 figures

Journal ref Npj Computational Materials (2026) 1-10

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.12986 2026-06-12 cs.SE 新提交 86%

The Rise of AI-Native Software Engineering: Implications for Practice, Education, and the Future Workforce

AI原生软件工程的崛起:对实践、教育和未来劳动力的影响

Mamdouh Alenezi

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文系统综述了生成式AI和LLM对软件工程的变革,提出AI原生SE的概念框架、九维能力模型、四阶段课程路线图及研究议程,强调培养工程师的判断、验证与编排能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.00462 2026-06-09 cs.CY 版本更新 86%

AI Self-preferencing in Algorithmic Hiring: Empirical Evidence and Insights

算法招聘中的AI自我偏好:实证证据与洞见

Jiannan Xu, Gujie Li, Jane Yi Jiang

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 通过大规模简历实验和模拟,发现LLM在招聘中偏好自己生成的简历,导致使用同模型简历的候选人获得23%-60%的短名单优势,且可通过干预减少50%以上偏差。

Comments This paper has been accepted as a non-archival submission at EAAMO 2025 and AIES 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.03221 2026-06-03 cs.IR 86%

VirtualMLE: A Virtual ML Engineer that Optimizes Sequential Recommenders

VirtualMLE: 一种优化序列推荐器的虚拟机器学习工程师

Shiteng Cao, Jingwen Liu, Junda She, Zhiheng Li

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出VirtualMLE,一种利用LLM认知能力将推荐器优化组织为执行、反思和记忆更新闭环的框架,在SASRec和HSTU上以更少试验达到竞争性推荐质量,并展示了跨数据集迁移调优启发式的潜力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.30105 2026-05-29 cs.SE 86%

EvoRepair: Enhancing Vulnerability Repair Agents Through Experience-Based Self-Evolution

EvoRepair: 通过基于经验的自我进化增强漏洞修复智能体

Haichuan Hu, Guoqing Xie, Quanjun Zhang, Jiawei Liu, Shengcheng Yu, Chunrong Fang, Zhenyu Chen, Liang Xiao

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出EvoRepair框架,通过循环学习-修复过程积累和复用漏洞修复经验,在多个基准上显著提升LLM的自动漏洞修复性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08318 2026-05-27 quant-ph 86%

A Model Context Protocol Server for Quantum Execution in Hybrid Quantum-HPC Environments

用于混合量子-HPC环境中量子执行的模型上下文协议服务器

Masaki Shiraishi, Ikko Hamamura, Tatsuya Ishigaki, Tadashi Kadowaki

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出基于MCP服务器的AI驱动框架,使LLM代理能通过自然语言自动执行量子计算工作流,包括采样和期望值计算等原语。

Comments Accepted to QC4C3 workshop at QCNC 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.25357 2026-05-26 cs.CV cs.MA 86%

Towards Reliable Fetal Ultrasound Interpretation with Multi-Agent Collaboration

面向可靠胎儿超声解读的多智能体协作

Xiaotian Hu, Mingxuan Liu, Junwei Huang, Kasidit Anmahapong, Yifei Chen, Yiming Huang, Xuguang Bai, Zihan Li, Hongjia Yang, Yingqi Hao, Hong Xu, Yu Jiang, Tian Tian, Yi Liao, Haibo Qu, Qiyuan Tian

机构 * Tsinghua University(清华大学) University of California San Diego(加州大学圣地亚哥分校) West China Second University Hospital, Sichuan University(四川大学西昌医学院)

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 提出FetUSAgents多智能体系统,通过协作LLM代理和双路径证据仲裁(DPEA)整合视觉工具与临床推理,在胎儿超声VQA、报告生成等任务上超越最强基线25%以上。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23676 2026-05-25 cs.HC 86%

AI at the Front Lines of Platform Governance: Using LLMs to Support Illegal Content Reporting under the Digital Services Act

平台治理前线的AI:利用大语言模型支持《数字服务法案》下的非法内容举报

Marie-Therese Sekwenz, Shreyan Biswas, Rita Hermann-Gsenger, Ujwal Gadiraju

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本研究通过受控用户实验(N=450),比较了无辅助、传统可解释AI(XAI)和评估性AI(EvalAI)三种条件下,大语言模型辅助用户举报非法内容的效果,发现EvalAI在AI错误时提高了条款级准确性并减少了分类偏差,但两种AI均未显著提升用户解释质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.18771 2026-05-20 cs.IR 86%

LWGR: Lagrangian-Constrained Personalized World Knowledge for Generative Recommendation

LWGR: 基于拉格朗日约束的个性化世界知识用于生成推荐

Lingyu Mu, Hao Deng, Haibo Xing, Kaican Lin, Zhitong Zhu, Yu Zhang, Xiaoyi Zeng, Zhengxiao Liu, Zheng Lin, Jinxin Hu

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出LWGR框架,通过拉格朗日约束将LLM中的个性化世界知识转移到生成推荐中,改进了知识提取和融合过程,实验表明其在多个数据集上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.17075 2026-05-19 cs.CR 86%

A Red Teaming Framework for Evaluating Robustness of AI-enabled Security Orchestration, Automation, and Response Systems

一种用于评估AI增强的安全编排、自动化和响应系统鲁棒性的红队框架

Ayan Javeed Shaikh, Nathaniel D. Bastian, Ankit Shah

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出了一种结合大语言模型和强化学习的自主红队框架,用于评估企业网络中自主防御系统的鲁棒性,展示了单一LLM代理在多阶段攻击中的不足以及领域特定安全模型的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12817 2026-05-14 cs.LG cs.AI cs.CL 86%

Training Large Language Models to Predict Clinical Events

训练大型语言模型以预测临床事件

Benjamin Turtel, Paul Wilczewski, Kris Skotheim

机构 * Lightning Rod Labs(Lightning Rod实验室)

专题命中 领域大模型 :large language model(title);language model(title);分类 cs.CL、cs.AI、cs.LG

AI总结 本文通过扩展前瞻性学习,利用纵向临床记录生成预测示例,提升模型对临床事件的预测能力,减少校准误差并改进Brier分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07525 2026-05-12 cs.SE 86%

Can LLMs Solve Science or Just Write Code? Evaluating Quantum Solver Generation

LLMs能否解决科学问题或只是编写代码?评估量子求解器生成

Luciano Baresi, Domenico Bianculli, Maryse Ernzer, Livia Lestingi, Fabrizio Pastore, Seung Yeob Shin

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文提出Q-SAGE方法,通过迭代优化评估LLM生成量子求解器的能力,发现迭代改进提升成功率但带来计算开销,模型能力增强后失败模式从执行错误转为数值不准确,揭示LLM在量子软件中的局限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.09901 2026-05-04 cs.LG cs.AI cs.CL cs.HC 86%

Comparing Exploration-Exploitation Strategies of LLMs and Humans: Insights from Standard Multi-armed Bandit Experiments

比较语言模型和人类的探索-利用策略:来自标准多臂老虎机实验的见解

Ziyuan Zhang, Darcy Wang, Ningyuan Chen, Rodrigo Mansur, Vahid Sarhangian

机构 * Department of Mechanical & Industrial Engineering, University of Toronto(机械与工业工程系,多伦多大学) The Rotman School of Management, University of Toronto(罗特曼管理学院,多伦多大学) Department of Psychiatry, University of Toronto(精神病学系,多伦多大学)

专题命中 领域大模型 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文通过多臂老虎机实验比较语言模型、人类和算法的探索-利用策略,发现启用思考使语言模型行为更接近人类,但在复杂环境中表现受限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20405 2026-04-16 cs.CR 86%

ChatGPT: Excellent Paper! Accept It. Editor: Imposter Found! Review Rejected

ChatGPT: 优秀论文!接受它。编辑:冒名顶替者发现!审稿被拒

Kanchon Gharami, Sanjiv Kumar Sarkar, Safayat Bin Hakim, Yongxin Liu, Nahid Farhady Ghalaty, Shafika Showkat Moni

专题命中 领域大模型 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract)

AI总结 本文探讨了LLM在科学论文写作与审稿中的风险,提出通过隐式提示注入技术攻击和防御LLM审稿的漏洞,旨在增强同行评审过程的可靠性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23849 2026-03-26 cs.IR 86%

VILLA: Versatile Information Retrieval From Scientific Literature Using Large LAnguage Models

VILLA:利用大语言模型从科学文献中进行多用途信息检索

Blessy Antony, Amartya Dutta, Sneha Aggarwal, Vasu Gatne, Ozan Gökdemir, Samantha Grimes, Adam Lauring, Brian R. Wasik, Anuj Karpatne, T. M. Murali

专题命中 领域大模型 :large language model(title);language model(title);LLM(abstract)

AI总结 本文提出VILLA框架,通过构建病毒突变提取任务,解决复杂开放任务中科学信息提取的挑战,展示其在信息检索中的优越性能。

Comments Under review at ACM KDD 2026 (AI for Sciences Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11700 2025-12-16 cs.IR 86%

Exploring the Upper Limits of Text-Based Collaborative Filtering Using Large Language Models: Discoveries and Insights

探索基于文本的协同过滤的上限:发现与洞察

Ruyu Li, Wenhao Deng, Yu Cheng, Zheng Yuan, Jiaqi Zhang, Fajie Yuan

专题命中 领域大模型 :language model(title,abstract);large language model(title)

AI总结 本文通过实验探讨使用大语言模型作为编码器对基于文本的协同过滤性能的影响,发现其在提升表现的同时也带来了一些负面结果。

Journal ref Proceedings of the 34th ACM International Conference on Information and Knowledge Management (CIKM 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20177 2025-11-26 cs.IR 86%

Enhancing Sequential Recommendation with World Knowledge from Large Language Models

利用大语言模型的世界知识增强序列推荐

Tianjie Dai, Xu Chen, Yunmeng Shu, Jinsong Lan, Xiaoyong Zhu, Jiangchao Yao, Bo Zheng

专题命中 领域大模型 :large language model(title);language model(title);LLM(abstract)

AI总结 GRASP通过整合生成增强检索和整体注意力机制,利用大语言模型的世界知识提升序列推荐性能,有效缓解幻觉噪声影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18806 2025-10-22 cs.CY 86%

Integrating Large Language Models and Evaluating Student Outcomes in an Introductory Computer Science Course

Annapurna Vadaparty, David H. Smith, Samvrit Srinath, Mounika Padala, Christine Alvarado, Jamie Gorson Benario, Daniel Zingaro, Leo Porter

专题命中 领域大模型 :large language model(title);language model(title);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25378 2025-10-01 cs.SE 86%

Detecting and Fixing API Misuses of Data Science Libraries Using Large Language Models

Akalanka Galappaththi, Francisco Ribeiro, Sarah Nadi

专题命中 领域大模型 :large language model(title);language model(title);LLM(abstract)

Comments 10 pages, 3 figures, accepted in CASCON 25

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.09041 2025-06-23 eess.SP cs.SY eess.SY 86%

Towards Wireless Native Big AI Model: The Mission and Approach Differ From Large Language Model

Zirui Chen, Zhaoyang Zhang, Chenyu Liu, Ziqing Xing

专题命中 领域大模型 :language model(title,abstract);large language model(title)

Comments Accepted by SCIENCE CHINA Information Sciences. Paper Link: https://www.sciengine.com/SCIS/doi/10.1007/s11432-024-4464-8

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02626 2025-05-06 cs.CV 86%

Detect, Classify, Act: Categorizing Industrial Anomalies with Multi-Modal Large Language Models

Sassan Mokhtar, Arian Mousakhan, Silvio Galesso, Jawad Tayyub, Thomas Brox

机构 * University of Bonn(波恩大学) University of Freiburg(弗赖堡大学) Endress + Hauser(Endress+Hauser公司)

专题命中 领域大模型 :large language model(title);language model(title);LLM(abstract)

Comments Accepted as a spotlight presentation paper at the VAND Workshop, CVPR 2025. 10 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.01838 2025-04-03 cs.CV 86%

Prompting Medical Vision-Language Models to Mitigate Diagnosis Bias by Generating Realistic Dermoscopic Images

Nusrat Munia, Abdullah-Al-Zubaer Imran

专题命中 领域大模型 :language model(title,abstract);prompting(title)

Comments Paper accepted at International Symposium on Biomedical Imaging (ISBI 2025)

详情

展开后加载摘要…

URL PDF HTML 收藏