arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32034 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32034 篇

2408.04840 2024-08-14 cs.CV cs.AI cs.CL cs.LG 89%

mPLUG-Owl3: Towards Long Image-Sequence Understanding in Multi-Modal Large Language Models

Jiabo Ye, Haiyang Xu, Haowei Liu, Anwen Hu, Ming Yan, Qi Qian, Ji Zhang, Fei Huang, Jingren Zhou

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.19913 2024-08-09 cs.CL cs.AI cs.LG cs.RO 89%

MANGO: A Benchmark for Evaluating Mapping and Navigation Abilities of Large Language Models

Peng Ding, Jiading Fang, Peng Li, Kangrui Wang, Xiaochen Zhou, Mo Yu, Jing Li, Matthew R. Walter, Hongyuan Mei

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments COLM 2024 camera-ready

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.03847 2024-08-08 eess.SY cs.SY 89%

GAIA -- A Large Language Model for Advanced Power Dispatch

Yuheng Cheng, Huan Zhao, Xiyuan Zhou, Junhua Zhao, Yuji Cao, Chao Yang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.02793 2024-08-07 cs.AR 89%

Evaluating Large Language Models for Automatic Register Transfer Logic Generation via High-Level Synthesis

Sneha Swaroopa, Rijoy Mukherjee, Anushka Debnath, Rajat Subhra Chakraborty

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14814 2024-08-02 cs.CL cs.AI cs.CY cs.HC cs.LG 89%

The opportunities and risks of large language models in mental health

Hannah R. Lawrence, Renee A. Schneider, Susan B. Rubin, Maja J. Mataric, Daniel J. McDuff, Megan Jones Bell

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 15 pages, 2 tables, 4 figures

Journal ref JMIR Ment Health 2024;11:e59479

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07930 2024-08-02 cs.SE 89%

On Inter-dataset Code Duplication and Data Leakage in Large Language Models

José Antonio Hernández López, Boqi Chen, Mootez Saaz, Tushar Sharma, Dániel Varró

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.21429 2024-08-01 cs.SE 89%

Chat-like Asserts Prediction with the Support of Large Language Model

Han Wang, Han Hu, Chunyang Chen, Burak Turhan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.20018 2024-07-30 cs.DC 89%

Efficient Training of Large Language Models on Distributed Infrastructures: A Survey

Jiangfei Duan, Shuo Zhang, Zerui Wang, Lijuan Jiang, Wenwen Qu, Qinghao Hu, Guoteng Wang, Qizhen Weng, Hang Yan, Xingcheng Zhang, Xipeng Qiu, Dahua Lin, Yonggang Wen, Xin Jin, Tianwei Zhang, Peng Sun

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.15862 2024-07-24 cs.LG cs.AI cs.CL cs.CY 89%

Performance Evaluation of Lightweight Open-source Large Language Models in Pediatric Consultations: A Comparative Analysis

Qiuhong Wei, Ying Cui, Mengwei Ding, Yanqin Wang, Lingling Xiang, Zhengxiong Yao, Ceran Chen, Ying Long, Zhezhen Jin, Ximing Xu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 27 pages in total with 17 pages of main manuscript and 10 pages of supplementary materials; 4 figures in the main manuscript and 2 figures in supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.13761 2024-07-19 cs.CV 89%

SegPoint: Segment Any Point Cloud via Large Language Model

Shuting He, Henghui Ding, Xudong Jiang, Bihan Wen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments ECCV 2024, Project Page: https://heshuting555.github.io/SegPoint

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16147 2024-07-19 cs.RO 89%

Chat2Scenario: Scenario Extraction From Dataset Through Utilization of Large Language Model

Yongqi Zhao, Wenbo Xiao, Tomislav Mihalj, Jia Hu, Arno Eichberger

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments IEEE Intelligent Vehicles Symposium (IV 2024)

Journal ref 2024 IEEE Intelligent Vehicles Symposium (IV)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.10875 2024-07-19 cs.AR 89%

SA-DS: A Dataset for Large Language Model-Driven AI Accelerator Design Generation

Deepak Vungarala, Mahmoud Nazzal, Mehrdad Morsali, Chao Zhang, Arnob Ghosh, Abdallah Khreishah, Shaahin Angizi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 4 pages, 5 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.12858 2024-07-19 cs.CL cs.AI cs.CV cs.LG 89%

Grounding and Evaluation for Large Language Models: Practical Challenges and Lessons Learned (Survey)

Krishnaram Kenthapadi, Mehrnoosh Sameki, Ankur Taly

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Survey Article for the ACM SIGKDD International Conference on Knowledge Discovery and Data Mining (KDD 2024) Tutorial

Journal ref Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10227 2024-07-16 cs.SE 89%

KAT: Dependency-aware Automated API Testing with Large Language Models

Tri Le, Thien Tran, Duy Cao, Vy Le, Tien Nguyen, Vu Nguyen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

Comments ICST 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18125 2024-07-16 cs.CL cs.AI cs.CY cs.LG 89%

ResumeAtlas: Revisiting Resume Classification with Large-Scale Datasets and Large Language Models

Ahmed Heakl, Youssef Mohamed, Noran Mohamed, Aly Elsharkawy, Ahmed Zaky

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 8 pages, 6 figures, 1 table, 6th International Conference on AI in Computational Linguistics

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00770 2024-07-16 cs.CL cs.AI cs.CY cs.LG 89%

Bias and Fairness in Large Language Models: A Survey

Isabel O. Gallegos, Ryan A. Rossi, Joe Barrow, Md Mehrab Tanjim, Sungchul Kim, Franck Dernoncourt, Tong Yu, Ruiyi Zhang, Nesreen K. Ahmed

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted at Computational Linguistics, Volume 50, Number 3

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.08532 2024-07-12 cs.CR cs.SE 89%

Tactics, Techniques, and Procedures (TTPs) in Interpreted Malware: A Zero-Shot Generation with Large Language Models

Ying Zhang, Xiaoyan Zhou, Hui Wen, Wenjia Niu, Jiqiang Liu, Haining Wang, Qiang Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 19 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.10854 2024-07-12 cs.CV 89%

A Comprehensive Study of Multimodal Large Language Models for Image Quality Assessment

Tianhe Wu, Kede Ma, Jie Liang, Yujiu Yang, Lei Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16442 2024-07-02 cs.CV 89%

EmoLLM: Multimodal Emotional Understanding Meets Large Language Models

Qu Yang, Mang Ye, Bo Du

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);foundation model(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.15422 2024-06-26 cs.CL cs.AI cs.LG 89%

A Data-Centric Approach To Generate Faithful and High Quality Patient Summaries with Large Language Models

Stefan Hegselmann, Shannon Zejiang Shen, Florian Gierse, Monica Agrawal, David Sontag, Xiaoyi Jiang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.15704 2024-06-25 cs.CV 89%

video-SALMONN: Speech-Enhanced Audio-Visual Large Language Models

Guangzhi Sun, Wenyi Yu, Changli Tang, Xianzhao Chen, Tian Tan, Wei Li, Lu Lu, Zejun Ma, Yuxuan Wang, Chao Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at ICML 2024. arXiv admin note: substantial text overlap with arXiv:2310.05863

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.11213 2024-06-25 cs.SE 89%

A Survey of AIOps for Failure Management in the Era of Large Language Models

Lingzhe Zhang, Tong Jia, Mengxi Jia, Yifan Wu, Aiwei Liu, Yong Yang, Zhonghai Wu, Xuming Hu, Philip S. Yu, Ying Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 35 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00794 2024-06-24 cs.CL cs.AI cs.LG 89%

Getting Serious about Humor: Crafting Humor Datasets with Unfunny Large Language Models

Zachary Horvitz, Jingru Chen, Rahul Aditya, Harshvardhan Srivastava, Robert West, Zhou Yu, Kathleen McKeown

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.17600 2024-06-21 cs.CV 89%

MM-SafetyBench: A Benchmark for Safety Evaluation of Multimodal Large Language Models

Xin Liu, Yichen Zhu, Jindong Gu, Yunshi Lan, Chao Yang, Yu Qiao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.13232 2024-06-21 cs.CL cs.AI cs.IR cs.LG 89%

Towards Robust Evaluation: A Comprehensive Taxonomy of Datasets and Metrics for Open Domain Question Answering in the Era of Large Language Models

Akchay Srivastava, Atif Memon

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 22 pages, 13 tables, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.12224 2024-06-19 cs.RO 89%

Leveraging Large Language Model for Heterogeneous Ad Hoc Teamwork Collaboration

Xinzhu Liu, Peiyan Li, Wenju Yang, Di Guo, Huaping Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09799 2024-06-17 cs.CY 89%

GeoSEE: Regional Socio-Economic Estimation With a Large Language Model

Sungwon Han, Donghyun Ahn, Seungeon Lee, Minhyuk Song, Sungwon Park, Sangyoon Park, Jihee Kim, Meeyoung Cha

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.07914 2024-06-17 cs.SD eess.AS 89%

Can Large Language Models Understand Spatial Audio?

Changli Tang, Wenyi Yu, Guangzhi Sun, Xianzhao Chen, Tian Tan, Wei Li, Jun Zhang, Lu Lu, Zejun Ma, Yuxuan Wang, Chao Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at Interspeech 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.01133 2024-06-17 cs.PF 89%

Impact of Generative AI (Large Language Models) on the PRA model construction and maintenance, observations

Valentin Rychkov, Claudia Picoco, Emilie Caleca

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.14860 2024-06-11 cs.CL cs.AI cs.LG 89%

Ranking Large Language Models without Ground Truth

Amit Dhurandhar, Rahul Nair, Moninder Singh, Elizabeth Daly, Karthikeyan Natesan Ramamurthy

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ACL 2024

详情

展开后加载摘要…

URL PDF HTML 收藏