arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32034 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32034 篇

2311.03837 2023-11-08 cs.IR cs.CL 89%

OLaLa: Ontology Matching with Large Language Models

Sven Hertling, Heiko Paulheim

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments Accepted at K-CAP 2023 conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10160 2023-11-07 physics.med-ph cs.AI 89%

RadOnc-GPT: A Large Language Model for Radiation Oncology

Zhengliang Liu, Peilong Wang, Yiwei Li, Jason Holmes, Peng Shu, Lian Zhang, Chenbin Liu, Ninghao Liu, Dajiang Zhu, Xiang Li, Quanzheng Li, Samir H. Patel, Terence T. Sio, Tianming Liu, Wei Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.03412 2023-11-07 cs.CL 89%

From Base to Conversational: Japanese Instruction Dataset and Tuning Large Language Models

Masahiro Suzuki, Masanori Hirano, Hiroki Sakaji

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.CL

Comments 10 pages, 1 figure, 2 tables. The paper is a camera-ready version of IEEE BigData 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01152 2023-11-03 cs.CL 89%

Predicting Question-Answering Performance of Large Language Models through Semantic Consistency

Ella Rabinovich, Samuel Ackerman, Orna Raz, Eitan Farchi, Ateret Anaby-Tavor

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP2023 GEM workshop, 17 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.00681 2023-11-02 cs.CL 89%

Are Large Language Models Reliable Judges? A Study on the Factuality Evaluation Capabilities of LLMs

Xue-Yong Fu, Md Tahmid Rahman Laskar, Cheng Chen, Shashi Bhushan TN

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments accepted by Generation, Evaluation & Metrics (GEM) Workshop at EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.19737 2023-10-31 cs.AI 89%

Adversarial Attacks and Defenses in Large Language Models: Old and New Threats

Leo Schwinn, David Dobre, Stephan Günnemann, Gauthier Gidel

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.11638 2023-10-31 cs.CL 89%

Systematic Assessment of Factual Knowledge in Large Language Models

Linhao Luo, Thuy-Trang Vu, Dinh Phung, Gholamreza Haffari

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Accepted by EMNLP 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.14802 2023-10-27 cs.CL 89%

Estimating Large Language Model Capabilities without Labeled Test Data

Harvey Yiyun Fu, Qinyuan Ye, Albert Xu, Xiang Ren, Robin Jia

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to EMNLP 2023 Findings. Camera-ready version. Code: https://github.com/harvey-fin/icl-estimate

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15317 2023-10-25 cs.CL cs.CY 89%

Exploring the Potential of Large Language Models in Generating Code-Tracing Questions for Introductory Programming Courses

Aysa Xuemo Fan, Ranran Haoran Zhang, Luc Paquette, Rui Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by Findings of EMNLP, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.03030 2023-10-24 cs.CL 89%

Benchmarking Large Language Models on CMExam -- A Comprehensive Chinese Medical Exam Dataset

Junling Liu, Peilin Zhou, Yining Hua, Dading Chong, Zhongyu Tian, Andrew Liu, Helin Wang, Chenyu You, Zhenhua Guo, Lei Zhu, Michael Lingzhi Li

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by NeurIPS 2023 Datasets and Benchmarks Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13091 2023-10-23 cs.CL 89%

Large Language Models are Not Yet Human-Level Evaluators for Abstractive Summarization

Chenhui Shen, Liying Cheng, Xuan-Phi Nguyen, Yang You, Lidong Bing

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 19 pages, 5 figures

Journal ref Findings of EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.12321 2023-10-20 cs.CL 89%

A Survey of GPT-3 Family Large Language Models Including ChatGPT and GPT-4

Katikapalli Subramanyam Kalyan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);pretraining(abstract);分类 cs.CL

Comments Preprint under review, 58 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11171 2023-10-20 cs.CL 89%

TrueTeacher: Learning Factual Consistency Evaluation with Large Language Models

Zorik Gekhman, Jonathan Herzig, Roee Aharoni, Chen Elkind, Idan Szpektor

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted as a long paper in EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.08167 2023-10-13 cs.CL 89%

Multiclass Classification of Policy Documents with Large Language Models

Erkan Gunes, Christoffer Koch Florczak

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.07289 2023-10-12 cs.CL 89%

Beyond Factuality: A Comprehensive Evaluation of Large Language Models as Knowledge Generators

Liang Chen, Yang Deng, Yatao Bian, Zeyu Qin, Bingzhe Wu, Tat-Seng Chua, Kam-Fai Wong

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to EMNLP 2023 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.06762 2023-10-11 cs.CL 89%

TRACE: A Comprehensive Benchmark for Continual Learning in Large Language Models

Xiao Wang, Yuansen Zhang, Tianze Chen, Songyang Gao, Senjie Jin, Xianjun Yang, Zhiheng Xi, Rui Zheng, Yicheng Zou, Tao Gui, Qi Zhang, Xuanjing Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);instruction tuning(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.05863 2023-10-11 eess.AS cs.AI cs.CV cs.SD 89%

Fine-grained Audio-Visual Joint Representations for Multimodal Large Language Models

Guangzhi Sun, Wenyi Yu, Changli Tang, Xianzhao Chen, Tian Tan, Wei Li, Lu Lu, Zejun Ma, Chao Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.08377 2023-10-10 cs.CL 89%

Text Classification via Large Language Models

Xiaofei Sun, Xiaoya Li, Jiwei Li, Fei Wu, Shangwei Guo, Tianwei Zhang, Guoyin Wang

专题命中 评测与基准 :language model(title,abstract);large language model(title);LLM(abstract);prompting(abstract)

Comments Pre-print Version

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03293 2023-10-06 cs.CL 89%

A New Dialogue Response Generation Agent for Large Language Models by Asking Questions to Detect User's Intentions

Siwei Wu, Xiangqing Shen, Rui Xia

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03283 2023-10-06 cs.CL 89%

A Formalism and Approach for Improving Robustness of Large Language Models Using Risk-Adjusted Confidence Scores

Ke Shen, Mayank Kejriwal

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.15461 2023-09-28 cs.CL 89%

ChatCounselor: A Large Language Models for Mental Health Support

June M. Liu, Donghao Li, He Cao, Tianhe Ren, Zeyi Liao, Jiamin Wu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10929 2023-09-21 cs.CL 89%

Specializing Small Language Models towards Complex Style Transfer via Latent Attribute Pre-Training

Ruiqi Xu, Yongfeng Huang, Xin Chen, Lin Zhang

专题命中 评测与基准 :language model(title,abstract);small language model(title);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.10238 2023-09-20 cs.CL 89%

PolicyGPT: Automated Analysis of Privacy Policies with Large Language Models

Chenhao Tang, Zhengliang Liu, Chong Ma, Zihao Wu, Yiwei Li, Wei Liu, Dajiang Zhu, Quanzheng Li, Xiang Li, Tianming Liu, Lei Fan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.09338 2023-09-19 cs.CL 89%

Performance of the Pre-Trained Large Language Model GPT-4 on Automated Short Answer Grading

Gerd Kortemeyer

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08949 2023-09-19 cs.CL 89%

Enhancing Large Language Model Induced Task-Oriented Dialogue Systems Through Look-Forward Motivated Goals

Zhiyuan Hu, Yue Feng, Yang Deng, Zekun Li, See-Kiong Ng, Anh Tuan Luu, Bryan Hooi

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 7 Pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.08922 2023-09-19 cs.CL 89%

Multimodal Multi-Hop Question Answering Through a Conversation Between Tools and Efficiently Finetuned Large Language Models

Hossein Rajabzadeh, Suyuchen Wang, Hyock Ju Kwon, Bang Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.16797 2023-09-11 cs.CL 89%

Simple LLM Prompting is State-of-the-Art for Robust and Multilingual Dialogue Evaluation

John Mendonça, Patrícia Pereira, Helena Moniz, João Paulo Carvalho, Alon Lavie, Isabel Trancoso

专题命中 评测与基准 :prompting(title,abstract);LLM(title);large language model(abstract);language model(abstract)

Comments DSTC11 best paper for Track 4

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.00029 2023-09-04 cs.AI cs.CY cs.SE 89%

Exploring the Potential of Large Language Models to Generate Formative Programming Feedback

Natalie Kiesler, Dominic Lohr, Hieke Keuning

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Accepted to FIE 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.09662 2023-08-31 cs.CL 89%

Red-Teaming Large Language Models using Chain of Utterances for Safety-Alignment

Rishabh Bhardwaj, Soujanya Poria

专题命中 评测与基准 :language model(title,abstract);large language model(title);LLM(abstract);prompting(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06966 2023-08-29 cs.CL 89%

EcomGPT: Instruction-tuning Large Language Models with Chain-of-Task Tasks for E-commerce

Yangning Li, Shirong Ma, Xiaobin Wang, Shen Huang, Chengyue Jiang, Hai-Tao Zheng, Pengjun Xie, Fei Huang, Yong Jiang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Initial version of EcomGPT

详情

展开后加载摘要…

URL PDF HTML 收藏