arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 12169 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 12169 篇

2308.07120 2024-06-04 cs.CL 83%

Position: Key Claims in LLM Research Have a Long Tail of Footnotes

Anna Rogers, Alexandra Sasha Luccioni

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments ICML 2024 camera-ready (https://openreview.net/forum?id=M2cwkGleRL)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.17804 2024-05-29 cs.CL 83%

Detection-Correction Structure via General Language Model for Grammatical Error Correction

Wei Li, Houfeng Wang

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Long paper. Accepted by ACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12948 2024-05-29 cs.CL 83%

GumbelSoft: Diversified Language Model Watermarking via the GumbelMax-trick

Jiayi Fu, Xuandong Zhao, Ruihan Yang, Yuansen Zhang, Jiangjie Chen, Yanghua Xiao

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.01831 2024-05-29 cs.SD cs.LG eess.AS 83%

Audio Flamingo: A Novel Audio Language Model with Few-Shot Learning and Dialogue Abilities

Zhifeng Kong, Arushi Goel, Rohan Badlani, Wei Ping, Rafael Valle, Bryan Catanzaro

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.LG

Comments ICML 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.15818 2024-05-28 cs.CL 83%

DuanzAI: Slang-Enhanced LLM with Prompt for Humor Understanding

Yesian Rohn

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.10431 2024-05-20 cs.CL 83%

Thinking Fair and Slow: On the Efficacy of Structured Prompts for Debiasing Language Models

Shaz Furniturewala, Surgan Jandial, Abhinav Java, Pragyan Banerjee, Simra Shahid, Sumit Bhatia, Kokil Jaidka

专题命中 其他LLM :language model(title);LLM(abstract);prompting(abstract);分类 cs.CL

Comments The first two authors have equal contribution

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05776 2024-05-10 cs.CL 83%

Experimental Pragmatics with Machines: Testing LLM Predictions for the Inferences of Plain and Embedded Disjunctions

Polina Tsvilodub, Paul Marty, Sonia Ramotowska, Jacopo Romoli, Michael Franke

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

Comments 8 pages, 3 figures, to appear in the Proceedings of the 46th Annual Conference of the Cognitive Science Society (2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.18722 2024-04-30 cs.CV cs.CL 83%

Improving Automatic Text Recognition with Language Models in the PyLaia Open-Source Library

Solène Tarride, Yoann Schneider, Marie Generali-Lince, Mélodie Boillet, Bastien Abadie, Christopher Kermorvant

专题命中 其他LLM :language model(title,abstract);small language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.04329 2024-04-18 cs.CL 83%

Formal Aspects of Language Modeling

Ryan Cotterell, Anej Svete, Clara Meister, Tianyu Liu, Li Du

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00487 2024-04-02 cs.HC cs.AI 83%

Contextual AI Journaling: Integrating LLM and Time Series Behavioral Sensing Technology to Promote Self-Reflection and Well-being using the MindScape App

Subigya Nepal, Arvind Pillai, William Campbell, Talie Massachi, Eunsol Soul Choi, Orson Xu, Joanna Kuc, Jeremy Huckins, Jason Holden, Colin Depp, Nicholas Jacobson, Mary Czerwinski, Eric Granholm, Andrew T. Campbell

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00998 2024-03-05 cs.CL 83%

Predictions from language models for multiple-choice tasks are not robust under variation of scoring methods

Polina Tsvilodub, Hening Wang, Sharon Grosch, Michael Franke

专题命中 其他LLM :language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 8 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.10920 2024-02-20 cs.AR cs.AI cs.ET 83%

Designing Silicon Brains using LLM: Leveraging ChatGPT for Automated Description of a Spiking Neuron Array

Michael Tomlinson, Joe Li, Andreas Andreou

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.11723 2024-02-20 cs.HC cs.CL 83%

Shaping Human-AI Collaboration: Varied Scaffolding Levels in Co-writing with Language Models

Paramveer S. Dhillon, Somayeh Molaei, Jiaqi Li, Maximilian Golub, Shaochun Zheng, Lionel P. Robert

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Appearing at CHI 2024 (Honolulu, HI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.08995 2024-02-15 cs.HC cs.AI 83%

AgentLens: Visual Analysis for Agent Behaviors in LLM-based Autonomous Systems

Jiaying Lu, Bo Pan, Jieyi Chen, Yingchaojie Feng, Jingyuan Hu, Yuchen Peng, Wei Chen

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.06066 2024-01-12 cs.CL 83%

DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models

Damai Dai, Chengqi Deng, Chenggang Zhao, R. X. Xu, Huazuo Gao, Deli Chen, Jiashi Li, Wangding Zeng, Xingkai Yu, Y. Wu, Zhenda Xie, Y. K. Li, Panpan Huang, Fuli Luo, Chong Ruan, Zhifang Sui, Wenfeng Liang

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.01656 2023-12-06 cs.IR cs.AI cs.CV cs.HC 83%

The Contemporary Art of Image Search: Iterative User Intent Expansion via Vision-Language Model

Yilin Ye, Qian Zhu, Shishi Xiao, Kang Zhang, Wei Zeng

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.AI

Comments Accepted by The 2024 ACM SIGCHI Conference on Computer-Supported Cooperative Work & Social Computing (CSCW) (Proc. CSCW 2024)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15813 2023-11-28 cs.CV cs.AI 83%

FlowZero: Zero-Shot Text-to-Video Synthesis with LLM-Driven Dynamic Scene Syntax

Yu Lu, Linchao Zhu, Hehe Fan, Yi Yang

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments Project page: https://flowzero-video.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.11136 2023-11-28 cs.CY cs.AI cs.SI 83%

Is There Any Social Principle for LLM-Based Agents?

Jitao Bai, Simiao Zhang, Zhonghao Chen

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments 4 pages, 1 figure

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.08358 2023-11-21 cs.CL 83%

MEAL: Stable and Active Learning for Few-Shot Prompting

Abdullatif Köksal, Timo Schick, Hinrich Schütze

专题命中 其他LLM :prompting(title,abstract);foundation model(abstract);分类 cs.CL

Comments EMNLP 2023 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09194 2023-11-16 cs.CL 83%

Structural Priming Demonstrates Abstract Grammatical Representations in Multilingual Language Models

James A. Michaelov, Catherine Arnett, Tyler A. Chang, Benjamin K. Bergen

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted at EMNLP 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.07611 2023-11-15 cs.CL 83%

Intentional Biases in LLM Responses

Nicklaus Badyal, Derek Jacoby, Yvonne Coady

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.02801 2023-11-07 cs.LG 83%

On the Intersection of Self-Correction and Trust in Language Models

Satyapriya Krishna

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.LG

Comments Working Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09233 2023-10-16 cs.IR cs.CL 83%

AgentCF: Collaborative Learning with Autonomous Language Agents for Recommender Systems

Junjie Zhang, Yupeng Hou, Ruobing Xie, Wenqi Sun, Julian McAuley, Wayne Xin Zhao, Leyu Lin, Ji-Rong Wen

专题命中 其他LLM :language agent(title);LLM(abstract);language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14539 2023-10-12 cs.CR cs.CL 83%

Jailbreak in pieces: Compositional Adversarial Attacks on Multi-Modal Language Models

Erfan Shayegani, Yue Dong, Nael Abu-Ghazaleh

专题命中 其他LLM :language model(title,abstract);LLM(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.08133 2023-09-07 eess.AS cs.CL 83%

Large-scale Language Model Rescoring on Long-form Data

Tongzhou Chen, Cyril Allauzen, Yinghui Huang, Daniel Park, David Rybach, W. Ronny Huang, Rodrigo Cabrera, Kartik Audhkhasi, Bhuvana Ramabhadran, Pedro J. Moreno, Michael Riley

专题命中 其他LLM :language model(title,abstract);LLM(abstract);分类 cs.CL

Comments 5 pages, accepted in ICASSP 2023

Journal ref ICASSP 2023 - 2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.08985 2023-07-19 cs.HC cs.AI 83%

PromptCrafter: Crafting Text-to-Image Prompt through Mixed-Initiative Dialogue with LLM

Seungho Baek, Hyerin Im, Jiseung Ryu, Juhyeong Park, Takyeon Lee

专题命中 其他LLM :LLM(title);large language model(abstract);language model(abstract);分类 cs.AI

Comments 5 pages, AI & HCI Workshop at the 40 International Conference on Machine Learning (ICML) 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.01370 2023-07-11 cs.CL 83%

Multilingual Language Models are not Multicultural: A Case Study in Emotion

Shreya Havaldar, Sunny Rai, Bhumika Singhal, Langchen Liu, Sharath Chandra Guntuku, Lyle Ungar

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL

Comments Accepted to WASSA at ACL 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.04576 2023-04-11 cs.CL 83%

Learnings from Data Integration for Augmented Language Models

Alon Halevy, Jane Dwivedi-Yu

专题命中 其他LLM :language model(title,abstract);large language model(abstract);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.03754 2023-04-10 cs.CL cs.CV 83%

Language Models are Causal Knowledge Extractors for Zero-shot Video Question Answering

Hung-Ting Su, Yulei Niu, Xudong Lin, Winston H. Hsu, Shih-Fu Chang

专题命中 其他LLM :language model(title,abstract);prompting(abstract);分类 cs.CL

Comments CVPR 2023 Workshop L3D-IVU

详情

展开后加载摘要…

URL PDF HTML 收藏
2209.04889 2023-03-17 cs.CL 83%

Chain of Explanation: New Prompting Method to Generate Higher Quality Natural Language Explanation for Implicit Hate Speech

Fan Huang, Haewoon Kwak, Jisun An

专题命中 其他LLM :prompting(title,abstract);language model(abstract);分类 cs.CL

Comments Accepted by The Web Conference Companion, 2023

详情

展开后加载摘要…

URL PDF HTML 收藏