BT-Adapter: Video Conversation is Feasible Without Video Instruction Tuning
专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
AI 大模型
大语言模型、预训练、指令微调、后训练和语言模型应用。
专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
专题命中 指令微调 :prompting(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to ACL 2024 findings
专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)
专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ICML 2024; Code and data are available at https://github.com/princeton-nlp/LESS
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 19 Pages, 5 Figures, 8 Tables. Accepted by ACL 2024
专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ACL 2024 Findings
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted by ACL 2024
专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);instruction tuning(abstract)
Comments CVPR 2024
专题命中 指令微调 :language model(title,abstract);large language model(abstract);foundation model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments NAACL 2024
专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :language model(title,abstract);large language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :language model(title,abstract);large language model(abstract);SFT(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 14 pages, 4 figures, 3 tables
专题命中 指令微调 :instruction tuning(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)
专题命中 指令微调 :instruction tuning(title,abstract);LLM(abstract);large language model(abstract);language model(abstract)
Comments 34 pages, 6 figures
专题命中 指令微调 :language model(title,abstract);RLHF(abstract);preference optimization(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 23 pages, 5 figures, 7 tables, 4 algorithms
专题命中 指令微调 :language agent(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments v4 contains a few additional experiments
专题命中 指令微调 :language agent(title,abstract);language model(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Code, data, and models are available at https://fireact-agent.github.io
专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Open Research Project. 7 pages, 1 figure, 5 tables
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)
专题命中 指令微调 :LLM(title,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :language model(title,abstract);LLM(abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 指令微调 :language model(title,abstract);instruction tuning(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 18 pages, 7 figures
专题命中 指令微调 :language model(title,abstract);pretraining(abstract);prompting(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted to findings of EMNLP 2022. Data and code available at https://github.com/vbursztyn/compositional-fine-tuning
推理如何从训练数据中演变:使用国际象棋的实证研究
机构 * Department of Computer Science and Engineering, University of California San Diego, San Diego, United States(计算机科学与工程系,加州大学圣地亚哥分校,圣地亚哥,美国)
专题命中 指令微调 :post-training(title);SFT(abstract,abstract_cn);language model(abstract,comments);分类 cs.AI、cs.LG
AI总结 研究语言模型推理从监督微调到强化学习的演变,发现直接预测最佳走法的微调能提升性能,但强化学习阶段导致不一致推理,而多步轨迹训练则能获得更稳定的推理。
Comments Accepted at ICML 2026. An earlier version appeared at the NeurIPS 2025 Foundations of Reasoning in Language Models (FoRLM) Workshop (Oral)
机构 * University of Modena and Reggio Emilia(摩德纳和雷吉奥艾米利亚大学) ; University of Pisa(比萨大学) ; IIT-CNR(意大利国家研究 council(IIT))
专题命中 指令微调 :instruction tuning(title);LLM(abstract);large language model(abstract);language model(abstract)
Comments ICCV 2025 Workshop on What is Next in Multimodal Foundation Models