arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32034 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32034 篇

2508.01451 2025-08-05 cs.CR cs.SE 89%

Think Broad, Act Narrow: CWE Identification with Multi-Agent Large Language Models

Mohammed Sayagh, Mohammad Ghafari

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01402 2025-08-05 cs.CV 89%

ForenX: Towards Explainable AI-Generated Image Detection with Multimodal Large Language Models

Chuangchuang Tan, Jinglu Wang, Xiang Ming, Renshuai Tao, Yunchao Wei, Yao Zhao, Yan Lu

机构 * Beijing Jiaotong University(北京交通大学) Microsoft Research Asia(微软亚洲研究院)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.00321 2025-08-04 cs.HC 89%

Evaluating the Efficacy of Large Language Models for Generating Fine-Grained Visual Privacy Policies in Homes

Shuning Zhang, Ying Ma, Xin Yi, Hewu Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11557 2025-07-30 cs.IR 89%

Enhancing Spectral Knowledge Interrogation: A Reliable Retrieval-Augmented Generative Framework on Large Language Models

Jiheng Liang, Zujie Xie, Ziru Yu, Xiangyang Yu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 16 pages,10 figures,3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20163 2025-07-29 cs.CV 89%

Player-Centric Multimodal Prompt Generation for Large Language Model Based Identity-Aware Basketball Video Captioning

Zeyu Xi, Haoying Sun, Yaofei Wu, Junchi Yan, Haoran Zhang, Lifang Wu, Liang Wang, Changwen Chen

机构 * Beijing University of Technology(北京理工大学) Shanghai Jiao Tong University(上海交通大学) Chinese Academy of Sciences(中国科学院) The Hong Kong Polytechnic University(香港理工大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by ICCV 2025 (Poster)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.17271 2025-07-24 cs.SE 89%

Seed&Steer: Guiding Large Language Models with Compilable Prefix and Branch Signals for Unit Test Generation

Shuaiyu Zhou, Zhengran Zeng, Xiaoling Zhou, Rui Xie, Shikun Zhang, Wei Ye

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16716 2025-07-23 cs.CV 89%

Enhancing Remote Sensing Vision-Language Models Through MLLM and LLM-Based High-Quality Image-Text Dataset Generation

Yiguo He, Junjie Zhu, Yiying Li, Xiaoyu Zhang, Chunping Qiu, Jun Wang, Qiangjuan Huang, Ke Yang

机构 * Intelligent Game and Decision Lab (IGDL)(智能游戏与决策实验室)

专题命中 评测与基准 :language model(title,abstract);LLM(title);large language model(abstract);foundation model(abstract)

Comments SUBMIT TO IEEE TRANSACTIONS

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.16585 2025-07-23 cs.CR 89%

LLMxCPG: Context-Aware Vulnerability Detection Through Code Property Graph-Guided Large Language Models

Ahmed Lekssays, Hamza Mouhcine, Khang Tran, Ting Yu, Issa Khalil

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments This paper is accepted at USENIX 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.13212 2025-07-23 cs.IR 89%

Limitations of Automatic Relevance Assessments with Large Language Models for Fair and Reliable Retrieval Evaluation

David Otero, Javier Parapar, Álvaro Barreiro

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Journal ref SIGIR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05962 2025-07-09 cs.HC 89%

Evaluation of Large Language Model-Driven AutoML in Data and Model Management from Human-Centered Perspective

Jiapeng Yao, Lantian Zhang, Jiping Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00854 2025-07-09 cs.CL cs.AI cs.LG cs.MM q-bio.NC 89%

EEG2TEXT-CN: An Exploratory Study of Open-Vocabulary Chinese Text-EEG Alignment via Large Language Model and Contrastive Learning on ChineseEEG

Jacky Tai-Yu Lu, Jung Chiang, Chi-Sheng Chen, Anna Nai-Yun Tung, Hsiang Wei Hu, Yuan Chiao Cheng

机构 * Department of Artificial Intelligence in Healthcare, International Academia of Biomedical Innovation Technology(人工智能医疗系,国际生物医学创新技术学院) National Taiwan University(台湾大学) Neuro Industry Research, Neuro Industry, Inc.(神经产业研究,神经产业公司) Department of Biomedical Engineering, University of Southern California(生物医学工程系,南加州大学) Taiwan Artificial Intelligence Association(台湾人工智能协会)

专题命中 评测与基准 :language model(title,abstract);large language model(title);pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.22954 2025-07-01 cs.SI cs.SE 89%

Evaluating and Improving Large Language Models for Competitive Program Generation

Minnan Wei, Ziming Li, Xiang Chen, Menglin Zheng, Ziyan Qu, Cheng Yu, Siyu Chen, Xiaolin Ju

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.08174 2025-07-01 cs.CL cs.AI cs.LG cs.MM 89%

Sample then Identify: A General Framework for Risk Control and Assessment in Multimodal Large Language Models

Qingni Wang, Tiantian Geng, Zhiyuan Wang, Teng Wang, Bo Fu, Feng Zheng

机构 * University of Electronic Science and Technology of China(电子科技大学) Southern University of Science and Technology(南方科技大学) University of Birmingham(伯明翰大学) The University of Hong Kong(香港大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ICLR 2025 Spotlights

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11484 2025-06-26 cs.SE 89%

VulStamp: Vulnerability Assessment using Large Language Model

Hao Shen, Ming Hu, Xiaofei Xie, Jiaye Li, Mingsong Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.19160 2025-06-25 eess.SY cs.SY 89%

AgenticControl: An Automated Control Design Framework Using Large Language Models

Mohammad Narimani, Seyyed Ali Emami

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17647 2025-06-24 cs.SE 89%

Improving Compiler Bug Isolation by Leveraging Large Language Models

Yixian Qi, Jiajun Jiang, Fengjie Li, Bowen Chen, Hongyu Zhang, Junjie Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 12 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17627 2025-06-24 cs.SE 89%

CodeMorph: Mitigating Data Leakage in Large Language Model Assessment

Hongzhou Rao, Yanjie Zhao, Wenjie Zhu, Ling Xiao, Meizhen Wang, Haoyu Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted by ICSE 2025 (Industry Challenge Track)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.17330 2025-06-24 cs.SE 89%

Large Language Models for Spreadsheets: Benchmarking Progress and Evaluating Performance with FLARE

Simon Thorne

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 18 Pages, 10 Tables, 1 Colour Figure

Journal ref Proceedings of the EuSpRIG 2025 Conference "Spreadsheet Risk Management", University of Greenwich, London, ISBN: 978-1-905404-60-5

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11874 2025-06-16 cs.SE 89%

A Short Survey on Formalising Software Requirements using Large Language Models

Arshad Beg, Diarmuid O'Donoghue, Rosemary Monahan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Submitted to SAIV 2025 as extended abstract and received valuable comments improving our draft. This version is the improved one after addressing suggestions from reviewers for improving the draft

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.06227 2025-06-16 cs.PL 89%

CompilerGPT: Leveraging Large Language Models for Analyzing and Acting on Compiler Optimization Reports

Peter Pirkelbauer, Chunhua Liao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments C3PO at ISC HPC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10365 2025-06-13 cs.SE 89%

AutoGEEval++: A Multi-Level and Multi-Geospatial-Modality Automated Evaluation Framework for Large Language Models in Geospatial Code Generation on Google Earth Engine

Shuyang Hou, Zhangxiao Shen, Huayi Wu, Haoyue Jiao, Ziqi Liu, Lutong Xie, Chang Liu, Jianyuan Liang, Yaxian Qing, Xiaopu Zhang, Dehua Peng, Zhipeng Gui, Xuefeng Guan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.18843 2025-06-12 cs.SE 89%

Improving the Readability of Automatically Generated Tests using Large Language Models

Matteo Biagiola, Gianluca Ghislotti, Paolo Tonella

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments To be published in: 2025 IEEE Conference on Software Testing, Verification and Validation (ICST)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12768 2025-06-12 cs.CL cs.AI cs.LG 89%

CROW: Eliminating Backdoors from Large Language Models via Internal Consistency Regularization

Nay Myat Min, Long H. Pham, Yige Li, Jun Sun

机构 * School of Computing and Information Systems, Singapore Management University, Singapore(计算与信息系统学院,新加坡国立管理大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at ICML 2025, 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.16222 2025-06-12 cs.LG cs.AI cs.CL cs.CR 89%

An Interpretable N-gram Perplexity Threat Model for Large Language Model Jailbreaks

Valentyn Boreiko, Alexander Panfilov, Vaclav Voracek, Matthias Hein, Jonas Geiping

机构 * University of Tübingen(图宾根大学) Tübingen AI Center(图宾根人工智能中心) Max Planck Institute for Intelligent Systems(智能系统马克斯·普朗克研究所) ELLIS Institute Tübingen(图宾根ELLIS研究所)

专题命中 评测与基准 :language model(title,abstract);large language model(title);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.08147 2025-06-11 cs.CL cs.AI cs.LG 89%

Multilingual Hate Speech Detection in Social Media Using Translation-Based Approaches with Large Language Models

Muhammad Usman, Muhammad Ahmad, M. Shahiki Tash, Irina Gelbukh, Rolando Quintero Tellez, Grigori Sidorov

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.07748 2025-06-10 cs.DL 89%

Research quality evaluation by AI in the era of Large Language Models: Advantages, disadvantages, and systemic effects

Mike Thelwall

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07978 2025-06-10 cs.CL cs.AI cs.LG 89%

AfroBench: How Good are Large Language Models on African Languages?

Jessica Ojo, Odunayo Ogundepo, Akintunde Oladipo, Kelechi Ogueji, Jimmy Lin, Pontus Stenetorp, David Ifeoluwa Adelani

机构 * Masakhane NLP(Masakhane自然语言处理) Mila - Quebec AI Institute & McGill University(Mila-魁北克人工智能研究所及麦吉尔大学) Canada CIFAR AI Chair(加拿大CIFAR人工智能主席) Lelapa AI(Lelapa人工智能) The African Research Collective(非洲研究集体) University of Waterloo(滑铁卢大学) University College London(伦敦大学学院)

专题命中 评测与基准 :large language model(title);language model(title);LLM(abstract);prompting(abstract)

Comments Accepted to ACL 2025 (Findings)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.05637 2025-06-09 cs.IT eess.SP math.IT 89%

Joint User Association and Beamforming Design for ISAC Networks with Large Language Models

Haoyun Li, Ming Xiao, Kezhi Wang, Robert Schober, Dong In Kim, Yong Liang Guan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00894 2025-06-03 cs.SE cs.AI cs.CL cs.LG 89%

CODEMENV: Benchmarking Large Language Models on Code Migration

Keyuan Cheng, Xudong Shen, Yihao Yang, Tengyue Wang, Yang Cao, Muhammad Asif Ali, Hanbin Wang, Lijie Hu, Di Wang

机构 * Provable Responsible AI and Data Analytics (PRADA) Lab(可证明责任人工智能与数据分析实验室) King Abdullah University of Science and Technology(国王 Abdullah 科学与技术大学) Peking University(北京大学) South China University of Technology(华南理工大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ACL 2025 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00688 2025-06-03 cs.LG cs.AI cs.CL 89%

Existing Large Language Model Unlearning Evaluations Are Inconclusive

Zhili Feng, Yixuan Even Xu, Alexander Robey, Robert Kirk, Xander Davies, Yarin Gal, Avi Schwarzschild, J. Zico Kolter

机构 * Carnegie Mellon University(卡内基梅隆大学) UK AI Security Institute(英国人工智能安全研究所) University of Oxford(牛津大学)

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏