arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32034 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32034 篇

2402.14865 2024-06-10 cs.CL cs.AI cs.LG 89%

Dynamic Evaluation of Large Language Models by Meta Probing Agents

Kaijie Zhu, Jindong Wang, Qinlin Zhao, Ruochen Xu, Xing Xie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments International Conference on Machine Learning (ICML) 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.18969 2024-05-29 cs.CL cs.AI cs.IT cs.LG math.IT 89%

A Survey on Large Language Models from Concept to Implementation

Chen Wang, Jin Zhao, Jiaqi Gong

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Section 3 lacks to clarity and accuracy in defining the applications and capabilities of LLMs. More rework needs to be done on illustrate how LLMs being used in cross-domains

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.10897 2024-05-28 cs.CL cs.AI cs.LG 89%

Generalized Category Discovery with Large Language Models in the Loop

Wenbin An, Wenkai Shi, Feng Tian, Haonan Lin, QianYing Wang, Yaqiang Wu, Mingxiang Cai, Luyan Wang, Yan Chen, Haiping Zhu, Ping Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted by ACL 2024 Findings, code and data are available at https://github.com/Lackel/LOOP

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.13052 2024-05-24 cs.HC cs.AI cs.CL cs.CY cs.LG 89%

Large Language Models Can Infer Personality from Free-Form User Interactions

Heinrich Peters, Moran Cerf, Sandra C. Matz

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.02491 2024-05-24 cs.CL cs.AI cs.LG 89%

Measuring Social Norms of Large Language Models

Ye Yuan, Kexin Tang, Jianhao Shen, Ming Zhang, Chenguang Wang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16458 2024-05-22 cs.LG cs.AI cs.CL 89%

BioCoder: A Benchmark for Bioinformatics Code Generation with Large Language Models

Xiangru Tang, Bill Qian, Rick Gao, Jiakang Chen, Xinyun Chen, Mark Gerstein

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.11971 2024-05-21 cs.CV 89%

Data Augmentation for Text-based Person Retrieval Using Large Language Models

Zheng Li, Lijia Si, Caili Guo, Yang Yang, Qiushi Cao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10621 2024-05-20 cs.IR cs.AI cs.CL cs.LG 89%

Large language models can accurately predict searcher preferences

Paul Thomas, Seth Spielman, Nick Craswell, Bhaskar Mitra

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.06725 2024-05-16 q-bio.NC cs.AI cs.CL cs.LG 89%

On the Shape of Brainscores for Large Language Models (LLMs)

Jingkai Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments Published as a workshop paper at ICLR AGI Workshop 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.15595 2024-05-15 cs.HC cs.CY 89%

Comuniqa : Exploring Large Language Models for improving speaking skills

Manas Mhasakar, Shikhar Sharma, Apurv Mehra, Utkarsh Venaik, Ujjwal Singhal, Dhruv Kumar, Kashish Mittal

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at 7th ACM SIGCAS/SIGCHI Conference of Computing and Sustainable Societies : ACM COMPASS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.11595 2024-05-13 cs.SE 89%

A Deep Dive into Large Language Models for Automated Bug Localization and Repair

Soneya Binta Hossain, Nan Jiang, Qiang Zhou, Xiaopeng Li, Wen-Hao Chiang, Yingjun Lyu, Hoan Nguyen, Omer Tripp

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05438 2024-05-10 cs.IR 89%

Information Extraction from Historical Well Records Using A Large Language Model

Zhiwei Ma, Javier E. Santo, Greg Lackey, Hari Viswanathan, Daniel O'Malley

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04652 2024-05-09 cs.HC 89%

AffirmativeAI: Towards LGBTQ+ Friendly Audit Frameworks for Large Language Models

Yinru Long, Zilin Ma, Yiyang Mei, Zhaoyuan Su

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13236 2024-05-06 cs.DC cs.ET 89%

LLMChain: Blockchain-based Reputation System for Sharing and Evaluating Large Language Models

Mouhamed Amine Bouchiha, Quentin Telnoff, Souhail Bakkali, Ronan Champagnat, Mourad Rabah, Mickaël Coustaty, Yacine Ghamri-Doudane

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Paper accepted at IEEE 48th Annual Computers, Software, and Applications Conference (COMPSAC) IEEE, Osaka, Japan (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18824 2024-04-30 cs.CL cs.AI cs.LG 89%

Benchmarking Benchmark Leakage in Large Language Models

Ruijie Xu, Zengzhi Wang, Run-Ze Fan, Pengfei Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments 30 pages; Homepage: https://gair-nlp.github.io/benbench

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18746 2024-04-30 cs.MM cs.CV 89%

Enhancing Interactive Image Retrieval With Query Rewriting Using Large Language Models and Vision Language Models

Hongyi Zhu, Jia-Hong Huang, Stevan Rudinac, Evangelos Kanoulas

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.17607 2024-04-30 cs.IR cs.AI cs.CL cs.LG cs.SI 89%

Utilizing Large Language Models to Identify Reddit Users Considering Vaping Cessation for Digital Interventions

Sai Krishna Revanth Vuruma, Dezhi Wu, Saborny Sen Gupta, Lucas Aust, Valerie Lookingbill, Caleb Henry, Yang Ren, Erin Kasson, Li-Shiun Chen, Patricia Cavazos-Rehg, Dian Hu, Ming Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.16651 2024-04-26 cs.CR 89%

Evolutionary Large Language Models for Hardware Security: A Comparative Survey

Mohammad Akyash, Hadi Mardani Kamali

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08475 2024-04-19 cs.CL cs.AI cs.CV cs.LG cs.MM 89%

Can We Edit Multimodal Large Language Models?

Siyuan Cheng, Bozhong Tian, Qingbin Liu, Xi Chen, Yongheng Wang, Huajun Chen, Ningyu Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments EMNLP 2023. Add the Exact Match/Accuracy results of Reliability and T-Generality

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.05836 2024-04-18 cs.CL cs.AI cs.LG 89%

Can Large Language Models Infer Causation from Correlation?

Zhijing Jin, Jiarui Liu, Zhiheng Lyu, Spencer Poff, Mrinmaya Sachan, Rada Mihalcea, Mona Diab, Bernhard Schölkopf

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

Comments ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09717 2024-04-16 cs.CL cs.AI cs.LG 89%

Unveiling Imitation Learning: Exploring the Impact of Data Falsity to Large Language Model

Hyunsoo Cho

专题命中 评测与基准 :language model(title,abstract);large language model(title);instruction tuning(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Under review @ *ACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.09254 2024-04-16 cs.CV 89%

TEXT2TASTE: A Versatile Egocentric Vision System for Intelligent Reading Assistance Using Large Language Model

Wiktor Mucha, Florin Cuconasu, Naome A. Etori, Valia Kalokyri, Giovanni Trappolini

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments Accepted at ICCHP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.09432 2024-04-05 cs.CL cs.AI cs.LG 89%

RoleCraft-GLM: Advancing Personalized Role-Playing in Large Language Models

Meiling Tao, Xuechen Liang, Tianyu Shi, Lei Yu, Yiting Xie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.14801 2024-04-04 q-bio.QM 89%

Assessing the Utility of Large Language Models for Phenotype-Driven Gene Prioritization in Rare Genetic Disorder Diagnosis

Junyoung Kim, Jingye Yang, Kai Wang, Chunhua Weng, Cong Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 56 pages, 6 figures, 6 tables, 2 supplementary tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.16417 2024-03-26 cs.NE 89%

Leveraging Large Language Model to Generate a Novel Metaheuristic Algorithm with CRISPE Framework

Rui Zhong, Yuefeng Xu, Chao Zhang, Jun Yu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.15281 2024-03-25 econ.GN q-fin.EC 89%

Measuring Gender and Racial Biases in Large Language Models

Jiafu An, Difang Huang, Chen Lin, Mingzhu Tai

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13925 2024-03-22 cs.CL cs.AI cs.LG 89%

Reducing Large Language Model Bias with Emphasis on 'Restricted Industries': Automated Dataset Augmentation and Prejudice Quantification

Devam Mondal, Carlo Lipizzi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09906 2024-03-18 cs.SE 89%

Reality Bites: Assessing the Realism of Driving Scenarios with Large Language Models

Jiahui Wu, Chengjie Lu, Aitor Arrieta, Tao Yue, Shaukat Ali

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05156 2024-03-15 cs.CR 89%

On Protecting the Data Privacy of Large Language Models (LLMs): A Survey

Biwei Yan, Kun Li, Minghui Xu, Yueyan Dong, Yue Zhang, Zhaochun Ren, Xiuzhen Cheng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract)

Comments 18 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12366 2024-02-20 cs.LG cs.AI cs.CL 89%

A Critical Evaluation of AI Feedback for Aligning Large Language Models

Archit Sharma, Sedrick Keh, Eric Mitchell, Chelsea Finn, Kushal Arora, Thomas Kollar

专题命中 评测与基准 :language model(title,abstract);large language model(title);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏