arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 31957 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 31957 篇

2412.02279 2024-12-04 cs.CL cs.AI 90%

A Comprehensive Evaluation of Large Language Models on Aspect-Based Sentiment Analysis

Changzhi Zhou, Dandan Song, Yuhang Tian, Zhijing Wu, Hao Wang, Xinyu Zhang, Jun Yang, Ziyi Yang, Shuhao Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);small language model(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02408 2024-12-03 cs.CL cs.LG 90%

GLaPE: Gold Label-agnostic Prompt Evaluation and Optimization for Large Language Model

Xuanchang Zhang, Zhuosheng Zhang, Hai Zhao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.19547 2024-12-02 cs.CL cs.AI 90%

Training Agents with Weakly Supervised Feedback from Large Language Models

Dihong Gong, Pu Lu, Zelong Wang, Meng Zhou, Xiuqiang He

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.01247 2024-12-02 cs.AI cs.CL cs.IT math.IT 90%

Conversational Complexity for Assessing Risk in Large Language Models

John Burden, Manuel Cebrian, Jose Hernandez-Orallo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 15 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.16337 2024-11-26 cs.CL cs.AI cs.HC 90%

Can AI grade your essays? A comparative analysis of large language models and teacher ratings in multidimensional essay scoring

Kathrin Seßler, Maurice Fürstenberg, Babette Bühler, Enkelejda Kasneci

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted at LAK '25

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.15320 2024-11-26 cs.CL cs.AI 90%

PPLqa: An Unsupervised Information-Theoretic Quality Metric for Comparing Generative Large Language Models

Gerald Friedland, Xin Huang, Yueying Cui, Vishaal Kapoor, Ashish Khetan, Sanjiv Das

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.03027 2024-11-26 cs.CR cs.AI cs.CL 90%

JailBreakV: A Benchmark for Assessing the Robustness of MultiModal Large Language Models against Jailbreak Attacks

Weidi Luo, Siyuan Ma, Xiaogeng Liu, Xiaoyu Guo, Chaowei Xiao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02783 2024-11-22 cs.CL cs.LG 90%

Large Language Models on Graphs: A Comprehensive Survey

Bowen Jin, Gang Liu, Chi Han, Meng Jiang, Heng Ji, Jiawei Han

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments 25 pages

Journal ref Transactions on Knowledge and Data Engineering (TKDE) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12759 2024-11-21 cs.CL cs.AI 90%

A Novel Approach to Eliminating Hallucinations in Large Language Model-Assisted Causal Discovery

Grace Sng, Yanming Zhang, Klaus Mueller

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11289 2024-11-19 cs.CL cs.AI 90%

LP Data Pipeline: Lightweight, Purpose-driven Data Pipeline for Large Language Models

Yungi Kim, Hyunsoo Ha, Seonghoon Yang, Sukyung Lee, Jihoo Kim, Chanjun Park

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20181 2024-11-19 cs.CR cs.AI cs.DC cs.LG 90%

Blockchain for Large Language Model Security and Safety: A Holistic Survey

Caleb Geren, Amanda Board, Gaby G. Dagher, Tim Andersen, Jun Zhuang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments Accepted to SIGKDD Explorations, to appear Dec 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.00888 2024-11-18 cs.CL cs.AI cs.CR 90%

Security and Privacy Challenges of Large Language Models: A Survey

Badhan Chandra Das, M. Hadi Amini, Yanzhao Wu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.06852 2024-11-12 cs.CL cs.AI 90%

Evaluating Large Language Models on Financial Report Summarization: An Empirical Study

Xinqi Yang, Scott Zang, Yong Ren, Dingjie Peng, Zheng Wen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.04962 2024-11-08 cs.AI cs.CL 90%

Position Paper On Diagnostic Uncertainty Estimation from Large Language Models: Next-Word Probability Is Not Pre-test Probability

Yanjun Gao, Skatje Myers, Shan Chen, Dmitriy Dligach, Timothy A Miller, Danielle Bitterman, Guanhua Chen, Anoop Mayampurath, Matthew Churpek, Majid Afshar

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to GenAI4Health Workshop at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.02730 2024-11-06 cs.CL cs.LG 90%

A Natural Language Processing Approach to Support Biomedical Data Harmonization: Leveraging Large Language Models

Zexu Li, Suraj P. Prabhu, Zachary T. Popp, Shubhi S. Jain, Vijetha Balakundi, Ting Fang Alvin Ang, Rhoda Au, Jinying Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

Comments 32 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.14419 2024-11-06 cs.SE cs.CL cs.LG 90%

Evaluation and Improvement of Fault Detection for Large Language Models

Qiang Hu, Jin Wen, Maxime Cordy, Yuheng Huang, Wei Ma, Xiaofei Xie, Lei Ma

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17935 2024-11-05 cs.CL cs.AI 90%

Tool Learning with Large Language Models: A Survey

Changle Qu, Sunhao Dai, Xiaochi Wei, Hengyi Cai, Shuaiqiang Wang, Dawei Yin, Jun Xu, Ji-Rong Wen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments The article has been accepted by Frontiers of Computer Science (FCS), with the DOI: {10.1007/s11704-024-40678-2}

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13911 2024-11-05 cs.CV cs.AI cs.CL 90%

TOPA: Extending Large Language Models for Video Understanding via Text-Only Pre-Alignment

Wei Li, Hehe Fan, Yongkang Wong, Mohan Kankanhalli, Yi Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments NeurIPS 2024 (Spotlight)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05121 2024-11-05 cs.AI cs.CL 90%

Large Language Model for Table Processing: A Survey

Weizheng Lu, Jing Zhang, Ju Fan, Zihao Fu, Yueguo Chen, Xiaoyong Du

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.18760 2024-11-04 cs.CL cs.AI 90%

TaskBench: Benchmarking Large Language Models for Task Automation

Yongliang Shen, Kaitao Song, Xu Tan, Wenqi Zhang, Kan Ren, Siyu Yuan, Weiming Lu, Dongsheng Li, Yueting Zhuang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted to NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.00045 2024-11-04 cs.CL cs.AI 90%

A Novel Psychometrics-Based Approach to Developing Professional Competency Benchmark for Large Language Models

Elena Kardanova, Alina Ivanova, Ksenia Tarasova, Taras Pashchenko, Aleksei Tikhoniuk, Elen Yusupova, Anatoly Kasprzhak, Yaroslav Kuzminov, Ekaterina Kruchinskaia, Irina Brun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 36 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.20745 2024-11-01 cs.LG cs.AI 90%

Shopping MMLU: A Massive Multi-Task Online Shopping Benchmark for Large Language Models

Yilun Jin, Zheng Li, Chenwei Zhang, Tianyu Cao, Yifan Gao, Pratik Jayarao, Mao Li, Xin Liu, Ritesh Sarkhel, Xianfeng Tang, Haodong Wang, Zhengyang Wang, Wenju Xu, Jingfeng Yang, Qingyu Yin, Xian Li, Priyanka Nigam, Yi Xu, Kai Chen, Qiang Yang, Meng Jiang, Bing Yin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments NeurIPS 2024 Datasets and Benchmarks Track Accepted. Modified typos in Figure 9

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.02420 2024-11-01 cs.CL cs.AI 90%

Factuality of Large Language Models: A Survey

Yuxia Wang, Minghan Wang, Muhammad Arslan Manzoor, Fei Liu, Georgi Georgiev, Rocktim Jyoti Das, Preslav Nakov

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments 11 pages, 1 figure and 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.07457 2024-10-30 cs.LG cs.CL 90%

GLBench: A Comprehensive Benchmark for Graph with Large Language Models

Yuhan Li, Peisong Wang, Xiao Zhu, Aochuan Chen, Haiyun Jiang, Deng Cai, Victor Wai Kin Chan, Jia Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.10574 2024-10-29 cs.CR cs.AI cs.ET cs.LG 90%

Detection Made Easy: Potentials of Large Language Models for Solidity Vulnerabilities

Md Tauseef Alam, Raju Halder, Abyayananda Maiti

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13005 2024-10-29 cs.CL cs.AI cs.SI 90%

Understanding Sarcoidosis Using Large Language Models and Social Media Data

Nan Miles Xi, Hong-Long Ji, Lin Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Journal ref Journal of Healthcare Informatics Research, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.14147 2024-10-22 cs.SI cs.AI cs.CY cs.LG 90%

Leveraging Large Language Models for Enhancing Public Transit Services

Jiahao Wang, Amer Shalaby

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI、cs.LG

Comments 24 pages, 18 figures, submitting to Journal of ITS

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03421 2024-10-22 cs.CL cs.AI 90%

One2set + Large Language Model: Best Partners for Keyphrase Generation

Liangying Shao, Liang Zhang, Minlong Peng, Guoqi Ma, Hao Yue, Mingming Sun, Jinsong Su

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by EMNLP 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13901 2024-10-21 cs.CR cs.AI cs.CL cs.ET 90%

SoK: Prompt Hacking of Large Language Models

Baha Rababah, Shang, Wu, Matthew Kwiatkowski, Carson Leung, Cuneyt Gurcan Akcora

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.13604 2024-10-18 cs.IR cs.AI cs.CL 90%

Large Language Models as Narrative-Driven Recommenders

Lukas Eberhard, Thorsten Ruprechter, Denis Helic

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

Comments Under review; 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏