arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11601 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11601 篇

2405.11850 2024-05-21 cs.CV 85%

Rethinking Overlooked Aspects in Vision-Language Models

Yuan Liu, Le Tian, Xiao Zhou, Jie Zhou

专题命中 指令微调 :language model(title,abstract);instruction tuning(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.05949 2024-05-10 cs.CV 85%

CuMo: Scaling Multimodal LLM with Co-Upcycled Mixture-of-Experts

Jiachen Li, Xinyao Wang, Sijie Zhu, Chia-Wen Kuo, Lu Xu, Fan Chen, Jitesh Jain, Humphrey Shi, Longyin Wen

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.04840 2024-05-09 cs.IR 85%

Federated Adaptation for Foundation Model-based Recommendations

Chunxu Zhang, Guodong Long, Hongkuan Guo, Xiao Fang, Yang Song, Zhaojie Liu, Guorui Zhou, Zijian Zhang, Yang Liu, Bo Yang

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract)

Comments Accepted as a regular paper of IJCAI'24

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.12461 2024-05-07 cs.LG cs.AI cs.CL 85%

Analyzing And Editing Inner Mechanisms Of Backdoored Language Models

Max Lamparth, Anka Reuel

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Final version accepted at FAccT 24

Journal ref The 2024 ACM Conference on Fairness, Accountability, and Transparency (FAccT 24), June 3-6, 2024, Rio de Janeiro, Brazil

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.07218 2024-04-11 eess.AS cs.SD 85%

Mega-TTS 2: Boosting Prompting Mechanisms for Zero-Shot Speech Synthesis

Ziyue Jiang, Jinglin Liu, Yi Ren, Jinzheng He, Zhenhui Ye, Shengpeng Ji, Qian Yang, Chen Zhang, Pengfei Wei, Chunfeng Wang, Xiang Yin, Zejun Ma, Zhou Zhao

专题命中 指令微调 :prompting(title,abstract);LLM(abstract);language model(abstract)

Comments Accepted by ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2404.00701 2024-04-02 cs.CV 85%

Training-Free Semantic Segmentation via LLM-Supervision

Wenfang Sun, Yingjun Du, Gaowen Liu, Ramana Kompella, Cees G. M. Snoek

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 22 pages,10 figures, conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.03849 2024-03-25 cs.CV 85%

LEGO: Learning EGOcentric Action Frame Generation via Visual Instruction Tuning

Bolin Lai, Xiaoliang Dai, Lawrence Chen, Guan Pang, James M. Rehg, Miao Liu

专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract)

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.14459 2024-03-20 cs.HC 85%

Bridging the Gulf of Envisioning: Cognitive Design Challenges in LLM Interfaces

Hariharan Subramonyam, Roy Pea, Christopher Lawrence Pondoc, Maneesh Agrawala, Colleen Seifert

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.20703 2024-03-15 cs.LG cs.AI cs.CL stat.ML 85%

Vanishing Gradients in Reinforcement Finetuning of Language Models

Noam Razin, Hattie Zhou, Omid Saremi, Vimal Thilak, Arwen Bradley, Preetum Nakkiran, Joshua Susskind, Etai Littwin

专题命中 指令微调 :language model(title,abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

Comments Accepted to ICLR 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.16494 2024-03-14 cs.CV 85%

ArGue: Attribute-Guided Prompt Tuning for Vision-Language Models

Xinyu Tian, Shu Zou, Zhaoyuan Yang, Jing Zhang

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract)

Comments Accepted to CVPR2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05135 2024-03-11 cs.CV 85%

ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment

Xiwei Hu, Rui Wang, Yixiao Fang, Bin Fu, Pei Cheng, Gang Yu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments Project Page: https://ella-diffusion.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.01209 2024-03-05 cs.CV 85%

Data-free Multi-label Image Recognition via LLM-powered Prompt Tuning

Shuo Yang, Zirui Shang, Yongqi Wang, Derong Deng, Hongwei Chen, Qiyuan Cheng, Xinxiao Wu

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.12408 2024-02-21 cs.LG cs.AI cs.CL 85%

ModelGPT: Unleashing LLM's Capabilities for Tailored Model Generation

Zihao Tang, Zheqi Lv, Shengyu Zhang, Fei Wu, Kun Kuang

专题命中 指令微调 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2402.03749 2024-02-07 cs.CV 85%

Vision Superalignment: Weak-to-Strong Generalization for Vision Foundation Models

Jianyuan Guo, Hanting Chen, Chengcheng Wang, Kai Han, Chang Xu, Yunhe Wang

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract)

Comments 12 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.09503 2024-01-26 cs.CV 85%

JM3D & JM3D-LLM: Elevating 3D Understanding with Joint Multi-modal Cues

Jiayi Ji, Haowei Wang, Changli Wu, Yiwei Ma, Xiaoshuai Sun, Rongrong Ji

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

Comments 16 pages, 4 figures, 10 tables, 3D understanding

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.12215 2024-01-23 cs.CV 85%

Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models

Chenyu Lian, Hong-Yu Zhou, Yizhou Yu, Liansheng Wang

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract)

Comments Technical report

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.08787 2024-01-18 cs.CV 85%

Segment Anything Model Can Not Segment Anything: Assessing AI Foundation Model's Generalizability in Permafrost Mapping

Wenwen Li, Chia-Yu Hsu, Sizhe Wang, Yezhou Yang, Hyunho Lee, Anna Liljedahl, Chandi Witharana, Yili Yang, Brendan M. Rogers, Samantha T. Arundel, Matthew B. Jones, Kenton McHenry, Patricia Solis

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.06323 2023-12-12 cs.CV 85%

Learning Hierarchical Prompt with Structured Linguistic Knowledge for Vision-Language Models

Yubin Wang, Xinyang Jiang, De Cheng, Dongsheng Li, Cairong Zhao

专题命中 指令微调 :language model(title,abstract);large language model(abstract);foundation model(abstract)

Comments AAAI2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02251 2023-12-06 cs.DB cs.AI cs.CL cs.LG 85%

Fine-Tuning Language Models for Context-Specific SQL Query Generation

Amine Rebei

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.05845 2023-11-13 cs.CL cs.AI cs.LG 85%

Tamil-Llama: A New Tamil Language Model Based on Llama 2

Abhinand Balachandran

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.02126 2023-11-07 cs.CV 85%

PILL: Plug Into LLM with Adapter Expert and Attention Gate

Fangyuan Zhang, Tingting Liang, Zhengyuan Wu, Yuyu Yin

专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.10944 2023-11-06 astro-ph.IM astro-ph.GA astro-ph.SR 85%

Towards an astronomical foundation model for stars with a Transformer-based model

Henry W. Leung, Jo Bovy

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2310.03693 2023-10-06 cs.CL cs.AI cs.CR cs.LG 85%

Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!

Xiangyu Qi, Yi Zeng, Tinghao Xie, Pin-Yu Chen, Ruoxi Jia, Prateek Mittal, Peter Henderson

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2309.04158 2023-09-11 cs.CV 85%

Context-Aware Prompt Tuning for Vision-Language Model with Dual-Alignment

Hongyu Hu, Tiancheng Lin, Jie Wang, Zhenbang Sun, Yi Xu

专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.04275 2023-08-09 cs.CL cs.AI cs.LG 85%

In-Context Alignment: Chat with Vanilla Language Models Before Fine-Tuning

Xiaochuang Han

专题命中 指令微调 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2307.14692 2023-07-28 cs.CR 85%

Backdoor Attacks for In-Context Learning with Language Models

Nikhil Kandpal, Matthew Jagielski, Florian Tramèr, Nicholas Carlini

专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract)

Comments AdvML Frontiers Workshop 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.11455 2023-05-22 cs.CL cs.AI cs.LG 85%

Shattering the Agent-Environment Interface for Fine-Tuning Inclusive Language Models

Wanqiao Xu, Shi Dong, Dilip Arumugam, Benjamin Van Roy

专题命中 指令微调 :language model(title,abstract);RLHF(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2206.08349 2023-05-03 cs.LG cs.AI cs.CL 85%

Know your audience: specializing grounded language models with listener subtraction

Aaditya K. Singh, David Ding, Andrew Saxe, Felix Hill, Andrew K. Lampinen

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

Comments 28 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2304.07058 2023-04-17 cs.RO 85%

FM-Loc: Using Foundation Models for Improved Vision-based Localization

Reihaneh Mirjalili, Michael Krawez, Wolfram Burgard

专题命中 指令微调 :foundation model(title,abstract);large language model(abstract);language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2203.02155 2022-03-07 cs.CL cs.AI cs.LG 85%

Training language models to follow instructions with human feedback

Long Ouyang, Jeff Wu, Xu Jiang, Diogo Almeida, Carroll L. Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, John Schulman, Jacob Hilton, Fraser Kelton, Luke Miller, Maddie Simens, Amanda Askell, Peter Welinder, Paul Christiano, Jan Leike, Ryan Lowe

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏