arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32034 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32034 篇

2402.07910 2024-02-14 cs.HC 89%

Experimental Interface for Multimodal and Large Language Model Based Explanations of Educational Recommender Systems

Hasan Abu-Rasheed, Christian Weber, Madjid Fathi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.14890 2024-02-13 cs.AI cs.CC cs.CL cs.LG 89%

NPHardEval: Dynamic Benchmark on Reasoning Ability of Large Language Models via Complexity Classes

Lizhou Fan, Wenyue Hua, Lingyao Li, Haoyang Ling, Yongfeng Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 23 pages, 7 figures, 2 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.05952 2024-02-12 cs.LG cs.AI cs.CL 89%

Advancing Graph Representation Learning with Large Language Models: A Comprehensive Survey of Techniques

Qiheng Mao, Zemin Liu, Chenghao Liu, Zhuo Li, Jianling Sun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.04088 2024-02-07 cs.CL cs.AI cs.LG stat.AP 89%

The Use of a Large Language Model for Cyberbullying Detection

Bayode Ogunleye, Babitha Dharmaraj

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 14 pages, Journal of Analytics

Journal ref Analytics 2 (2023), no. 3: 694-707

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03396 2024-02-07 cs.SE cs.AI cs.CL cs.CR cs.LG 89%

UniTSyn: A Large-Scale Dataset Capable of Enhancing the Prowess of Large Language Models for Program Testing

Yifeng He, Jiabo Huang, Yuyang Rong, Yiwen Guo, Ethan Wang, Hao Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.15812 2024-02-07 cs.LG cs.AI cs.CL 89%

Peering Through Preferences: Unraveling Feedback Acquisition for Aligning Large Language Models

Hritik Bansal, John Dang, Aditya Grover

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 31 pages, Accepted to ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.13802 2024-01-31 cs.SE cs.AI cs.CL cs.LG 89%

Investigating the Efficacy of Large Language Models for Code Clone Detection

Mohamad Khajezade, Jie JW Wu, Fatemeh Hendijani Fard, Gema Rodríguez-Pérez, Mohamed Sami Shehata

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.09631 2024-01-29 cs.IR 89%

Context-Driven Interactive Query Simulations Based on Generative Large Language Models

Björn Engelmann, Timo Breuer, Jana Isabelle Friese, Philipp Schaer, Norbert Fuhr

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at ECIR 2024 (Full Paper)

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.10529 2024-01-26 cs.CV cs.AI cs.CL cs.LG 89%

Mementos: A Comprehensive Benchmark for Multimodal Large Language Model Reasoning over Image Sequences

Xiyao Wang, Yuhang Zhou, Xiaoyu Liu, Hongjin Lu, Yuancheng Xu, Feihong He, Jaehong Yoon, Taixi Lu, Gedas Bertasius, Mohit Bansal, Huaxiu Yao, Furong Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 27 pages, 23 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08329 2024-01-17 cs.HC 89%

Understanding User Experience in Large Language Model Interactions

Jiayin Wang, Weizhi Ma, Peijie Sun, Min Zhang, Jian-Yun Nie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 15 pages + 3 page references + 2 page Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.03109 2024-01-17 cs.SE 89%

Lost in Translation: A Study of Bugs Introduced by Large Language Models while Translating Code

Rangeet Pan, Ali Reza Ibrahimzada, Rahul Krishna, Divya Sankar, Lambert Pouguem Wassi, Michele Merler, Boris Sobolev, Raju Pavuluri, Saurabh Sinha, Reyhaneh Jabbarvand

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Published in ICSE 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.17147 2024-01-12 cs.CL cs.AI cs.HC cs.LG 89%

Heterogeneous Value Alignment Evaluation for Large Language Models

Zhaowei Zhang, Ceyao Zhang, Nian Liu, Siyuan Qi, Ziqi Rong, Song-Chun Zhu, Shuguang Cui, Yaodong Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments v3 is the camera-ready version for AAAI-24 Workshop on Public Sector LLMs: Algorithmic and Sociotechnical Design. 7 pages of main content, 1 page of references, 3 pages of appendices, and 7 figures. Our full prompts are released in the repo: https://github.com/zowiezhang/HVAE

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.00991 2024-01-03 cs.CR 89%

A Novel Evaluation Framework for Assessing Resilience Against Prompt Injection Attacks in Large Language Models

Daniel Wankit Yip, Aysan Esmradi, Chun Fai Chan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted to be published in the Proceedings of The 10th IEEE CSDE 2023, the Asia-Pacific Conference on Computer Science and Data Engineering 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17343 2024-01-01 cs.CL cs.AI cs.LG cs.MM cs.SD eess.AS 89%

AQUALLM: Audio Question Answering Data Generation Using Large Language Models

Swarup Ranjan Behera, Krishna Mohan Injeti, Jaya Sai Kiran Patibandla, Praveen Kumar Pokala, Balakrishna Reddy Pailla

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10982 2023-12-19 cs.CR 89%

A Comprehensive Survey of Attack Techniques, Implementation, and Mitigation Strategies in Large Language Models

Aysan Esmradi, Daniel Wankit Yip, Chun Fai Chan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted to be published in the Proceedings of the 3rd International Conference on Ubiquitous Security 2023 (UbiSec-2023)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.04860 2023-12-11 cs.SE 89%

Are We Testing or Being Tested? Exploring the Practical Applications of Large Language Models in Software Testing

Robson Santos, Italo Santos, Cleyton Magalhaes, Ronnie de Souza Santos

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.14580 2023-11-27 cs.CV 89%

Large Language Models as Automated Aligners for benchmarking Vision-Language Models

Yuanfeng Ji, Chongjian Ge, Weikai Kong, Enze Xie, Zhengying Liu, Zhengguo Li, Ping Luo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.08400 2023-11-15 cs.CV 89%

Towards Open-Ended Visual Recognition with Large Language Model

Qihang Yu, Xiaohui Shen, Liang-Chieh Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09624 2023-11-14 cs.CL cs.AI cs.LG 89%

ASSERT: Automated Safety Scenario Red Teaming for Evaluating the Robustness of Large Language Models

Alex Mei, Sharon Levy, William Yang Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments In Findings of the 2023 Conference on Empirical Methods in Natural Language Processing

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03533 2023-11-14 cs.SE 89%

Large Language Models for Software Engineering: Survey and Open Problems

Angela Fan, Beliz Gokkaya, Mark Harman, Mitya Lyubarskiy, Shubho Sengupta, Shin Yoo, Jie M. Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.11167 2023-11-10 cs.CL cs.AI cs.LG 89%

Large Language Models are Fixated by Red Herrings: Exploring Creative Problem Solving and Einstellung Effect using the Only Connect Wall Dataset

Saeid Naeini, Raeid Saqur, Mozhgan Saeidi, John Giorgi, Babak Taati

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments v4,v3: Mincor cosmetic adjustments, typo-fixes etc. from V2. Fixed Fig. 2 caption overlapping with text in S2.2. V2: with added OCW-Randomized and OCW-WordNet results in Section 4.3 (added). 22 pages with Appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04124 2023-11-08 cs.CL cs.AI cs.LG 89%

Unveiling Safety Vulnerabilities of Large Language Models

George Kour, Marcel Zalmanovici, Naama Zwerdling, Esther Goldbraich, Ora Nova Fandina, Ateret Anaby-Tavor, Orna Raz, Eitan Farchi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments To be published in GEM workshop. Conference on Empirical Methods in Natural Language Processing (EMNLP). 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.01957 2023-10-31 cs.DB 89%

Automatic Data Transformation Using Large Language Model: An Experimental Study on Building Energy Data

Ankita Sharma, Xuanmao Li, Hong Guan, Guoxin Sun, Liang Zhang, Lanjun Wang, Kesheng Wu, Lei Cao, Erkang Zhu, Alexander Sim, Teresa Wu, Jia Zou

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 10 pages, 7 figures

Journal ref 2023 IEEE International Conference on Big Data

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13735 2023-10-24 cs.CL cs.AI cs.LG 89%

Aligning Large Language Models through Synthetic Feedback

Sungdong Kim, Sanghwan Bae, Jamin Shin, Soyoung Kang, Donghyun Kwak, Kang Min Yoo, Minjoon Seo

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to EMNLP 2023 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11593 2023-10-19 cs.CL cs.AI cs.LG 89%

Automated Evaluation of Personalized Text Generation using Large Language Models

Yaqing Wang, Jiepu Jiang, Mingyang Zhang, Cheng Li, Yi Liang, Qiaozhu Mei, Michael Bendersky

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.10176 2023-10-17 cs.CL cs.AI cs.LG 89%

Large Language Models Meet Open-World Intent Discovery and Recognition: An Evaluation of ChatGPT

Xiaoshuai Song, Keqing He, Pei Wang, Guanting Dong, Yutao Mou, Jingang Wang, Yunsen Xian, Xunliang Cai, Weiran Xu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accpeted to EMNLP 2023 (Main Conference)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05727 2023-10-10 cs.CL cs.AI cs.LG cs.SE 89%

The Program Testing Ability of Large Language Models for Code

Weimin Xiong, Yiwen Guo, Hao Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.10592 2023-10-03 cs.CV 89%

MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models

Deyao Zhu, Jun Chen, Xiaoqian Shen, Xiang Li, Mohamed Elhoseiny

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Project Website: https://minigpt-4.github.io/; Code, Pretrained Model, and Dataset: https://github.com/Vision-CAIR/MiniGPT-4; Deyao Zhu and Jun Chen contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.16021 2023-09-29 cs.CR 89%

HuntGPT: Integrating Machine Learning-Based Anomaly Detection and Explainable AI with Large Language Models (LLMs)

Tarek Ali, Panos Kostakos

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10895 2023-09-21 cs.HC cs.MA 89%

Large Language Models as Agents in the Clinic

Nikita Mehandru, Brenda Y. Miao, Eduardo Rodriguez Almaraz, Madhumita Sushil, Atul J. Butte, Ahmed Alaa

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 4 pages

详情

展开后加载摘要…

URL PDF HTML 收藏