arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 32006 信号源:cs.CL, cs.AI, cs.LG

1. 评测与基准 32006 篇

2410.03848 2024-10-08 cs.CL cs.CV 89%

Using Prompts to Guide Large Language Models in Imitating a Real Person's Language Style

Ziyang Chen, Stylios Moscholios

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03546 2024-10-07 cs.HC cs.CY cs.LG 89%

Multidimensional Human Activity Recognition With Large Language Model: A Conceptual Framework

Syed Mhamudul Hasan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.03181 2024-10-07 cs.CL 89%

Kiss up, Kick down: Exploring Behavioral Changes in Multi-modal Large Language Models with Assigned Visual Personas

Seungjong Sun, Eungu Lee, Seo Yeon Baek, Seunghyun Hwang, Wonbyung Lee, Dongyan Nan, Bernard J. Jansen, Jang Hyun Kim

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03347 2024-10-03 cs.CL 89%

Towards Interpretable Mental Health Analysis with Large Language Models

Kailai Yang, Shaoxiong Ji, Tianlin Zhang, Qianqian Xie, Ziyan Kuang, Sophia Ananiadou

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments Accepted by EMNLP 2023 main conference as a long paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.00526 2024-10-02 cs.CL 89%

Benchmarking Large Language Models for Conversational Question Answering in Multi-instructional Documents

Shiwei Wu, Chen Zhang, Yan Gao, Qimeng Wang, Tong Xu, Yao Hu, Enhong Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.17146 2024-10-02 cs.CL 89%

Outcome-Constrained Large Language Models for Countering Hate Speech

Lingzi Hong, Pengcheng Luo, Eduardo Blanco, Xiaoying Song

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted for presentation at the EMNLP 2024 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15186 2024-10-01 cs.AR cs.AI 89%

Location is Key: Leveraging Large Language Model for Functional Bug Localization in Verilog

Bingkun Yao, Ning Wang, Jie Zhou, Xi Wang, Hong Gao, Zhe Jiang, Nan Guan

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.03937 2024-10-01 cs.CL 89%

TongGu: Mastering Classical Chinese Understanding with Knowledge-Grounded Large Language Models

Jiahuan Cao, Dezhi Peng, Peirong Zhang, Yongxin Shi, Yang Liu, Kai Ding, Lianwen Jin

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.09972 2024-09-30 cs.CL 89%

Think Twice Before Trusting: Self-Detection for Large Language Models through Comprehensive Answer Reflection

Moxin Li, Wenjie Wang, Fuli Feng, Fengbin Zhu, Qifan Wang, Tat-Seng Chua

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP findings 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16788 2024-09-26 cs.CL 89%

Mitigating the Bias of Large Language Model Evaluation

Hongli Zhou, Hui Huang, Yunfei Long, Bing Xu, Conghui Zhu, Hailong Cao, Muyun Yang, Tiejun Zhao

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.16191 2024-09-25 cs.CL 89%

HelloBench: Evaluating Long Text Generation Capabilities of Large Language Models

Haoran Que, Feiyu Duan, Liqun He, Yutao Mou, Wangchunshu Zhou, Jiaheng Liu, Wenge Rong, Zekun Moore Wang, Jian Yang, Ge Zhang, Junran Peng, Zhaoxiang Zhang, Songyang Zhang, Kai Chen

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15706 2024-09-25 cs.HC cs.AI 89%

Improving Emotional Support Delivery in Text-Based Community Safety Reporting Using Large Language Models

Yiren Liu, Yerong Li, Ryan Mayfield, Yun Huang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.15334 2024-09-25 cs.CL 89%

Evaluating Large Language Models with Tests of Spanish as a Foreign Language: Pass or Fail?

Marina Mayor-Rocher, Nina Melero, Elena Merino-Gómez, María Grandury, Javier Conde, Pedro Reviriego

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01909 2024-09-25 cs.CL cs.SD eess.AS 89%

Pinyin Regularization in Error Correction for Chinese Speech Recognition with Large Language Models

Zhiyuan Tang, Dong Wang, Shen Huang, Shidong Shang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

Comments Interspeech 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.03882 2024-09-25 cs.CL cs.SD eess.AS 89%

Spontaneous Speech-Based Suicide Risk Detection Using Whisper and Large Language Models

Ziyun Cui, Chang Lei, Wen Wu, Yinan Duan, Diyang Qu, Ji Wu, Runsen Chen, Chao Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted by Interspeech 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14997 2024-09-24 cs.CL 89%

Enhancing Aspect-based Sentiment Analysis in Tourism Using Large Language Models and Positional Information

Chun Xu, Mengmeng Wang, Yan Ren, Shaolin Zhu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 19 pages, 17 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.06853 2024-09-24 cs.CL 89%

History, Development, and Principles of Large Language Models-An Introductory Survey

Zichong Wang, Zhibo Chu, Thang Viet Doan, Shiwen Ni, Min Yang, Wenbin Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14473 2024-09-24 cs.CE cs.CL 89%

A Large Language Model and Denoising Diffusion Framework for Targeted Design of Microstructures with Commands in Natural Language

Nikita Kartashov, Nikolaos N. Vlassis

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 29 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.14371 2024-09-24 cs.CL 89%

The Ability of Large Language Models to Evaluate Constraint-satisfaction in Agent Responses to Open-ended Requests

Lior Madmoni, Amir Zait, Ilia Labzovsky, Danny Karmon

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);prompting(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.05216 2024-09-24 cs.CL 89%

Large Language Model as an Assignment Evaluator: Insights, Feedback, and Challenges in a 1000+ Student Course

Cheng-Han Chiang, Wei-Chih Chen, Chun-Yi Kuan, Chienchou Yang, Hung-yi Lee

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments EMNLP 2024 main conference paper. An empirical report of our course: Introduction to Generative AI 2024 Spring (https://speech.ee.ntu.edu.tw/~hylee/genai/2024-spring.php)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.07938 2024-09-24 cs.CL 89%

EconLogicQA: A Question-Answering Benchmark for Evaluating Large Language Models in Economic Sequential Reasoning

Yinzhu Quan, Zefang Liu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01133 2024-09-24 cs.LG eess.SP 89%

Evaluating Large Language Models as Virtual Annotators for Time-series Physical Sensing Data

Aritra Hota, Soumyajit Chatterjee, Sandip Chakraborty

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Journal ref ACM Transactions on Intelligent Systems and Technology 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.13940 2024-09-23 cs.CL 89%

A User-Centric Multi-Intent Benchmark for Evaluating Large Language Models

Jiayin Wang, Fengran Mo, Weizhi Ma, Peijie Sun, Min Zhang, Jian-Yun Nie

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.09054 2024-09-17 cs.SE cs.AI cs.PL 89%

Evaluating the Performance of Large Language Models in Competitive Programming: A Multi-Year, Multi-Grade Analysis

Adrian Marius Dumitran, Adrian Catalin Badea, Stefan-Gabriel Muscalu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments 7 pages, Inista 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.07556 2024-09-16 cs.CL 89%

Truth-Aware Context Selection: Mitigating Hallucinations of Large Language Models Being Misled by Untruthful Contexts

Tian Yu, Shaolei Zhang, Yang Feng

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments Accepted to ACL 2024 Findings. Code is available at: https://github.com/ictnlp/TACS

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.02219 2024-09-12 cs.IR cs.AI 89%

A Normative Framework for Benchmarking Consumer Fairness in Large Language Model Recommender System

Yashar Deldjoo, Fatemeh Nazary

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.16528 2024-09-11 cs.CL 89%

Evaluating the Ability of Large Language Models to Reason about Cardinal Directions

Anthony G Cohn, Robert E Blackwell

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 9 pages, 3 figures, 1 table. Short paper accepted by COSIT 24, The 16th Conference on Spatial Information Theory

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.15991 2024-09-06 cs.SE cs.LG cs.PL 89%

WhiteFox: White-Box Compiler Fuzzing Empowered by Large Language Models

Chenyuan Yang, Yinlin Deng, Runyu Lu, Jiayi Yao, Jiawei Liu, Reyhaneh Jabbarvand, Lingming Zhang

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.LG

Comments Published in OOPSLA 2024

Journal ref Proc. ACM Program. Lang., Vol. 8, No. OOPSLA2, Article 296. Publication date: October 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00202 2024-09-04 cs.CL 89%

The creative psychometric item generator: a framework for item generation and validation using large language models

Antonio Laverghetta, Simone Luchini, Averie Linell, Roni Reiter-Palmon, Roger Beaty

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL

Comments CREAI 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.00089 2024-09-04 cs.CR cs.AI 89%

Watermarking Techniques for Large Language Models: A Survey

Yuqing Liang, Jiancheng Xiao, Wensheng Gan, Philip S. Yu

专题命中 评测与基准 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

Comments Preprint. 19 figures, 7 tables

详情

展开后加载摘要…

URL PDF HTML 收藏