arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11601 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11601 篇

2508.04389 2025-08-07 cs.AI 84%

GuirlVG: Incentivize GUI Visual Grounding via Empirical Exploration on Reinforcement Learning

Weitai Kang, Bin Lei, Gaowen Liu, Caiwen Ding, Yan Yan

机构 * University of Illinois Chicago(伊利诺伊大学芝加哥分校) University of Minnesota(明尼苏达大学) Cisco Research(思科研究)

专题命中 指令微调 :large language model(abstract);language model(abstract);pretraining(abstract);post-training(abstract)

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.23588 2025-08-01 cs.CL 84%

DiffLoRA: Differential Low-Rank Adapters for Large Language Models

Alexandre Misrahi, Nadezhda Chirkova, Maxime Louis, Vassilina Nikoulina

机构 * EPFL(瑞士联邦理工学院) NAVER LABS Europe(NAVER LABS欧洲)

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.18013 2025-07-30 cs.CL 84%

Technical Report of TeleChat2, TeleChat2.5 and T1

Zihan Wang, Xinzhang Liu, Yitong Yao, Chao Wang, Yu Zhao, Zhihao Yang, Wenmin Deng, Kaipeng Jia, Jiaxin Peng, Yuyao Huang, Sishi Xiong, Zhuo Jiang, Kaidong Yu, Xiaohui Hu, Fubei Yao, Ruiyu Fang, Zhuoru Jiang, Ruiting Song, Qiyi Xie, Rui Xue, Xuewei He, Yanlei Xue, Zhu Yuan, Zhaoxi Zhang, Zilu Huang, Shiquan Wang, Xin Wang, Hanming Wu, Mingyuan Wang, Xufeng Zhan, Yuhan Sun, Zhaohu Xing, Yuhao Jiang, Bingkai Yang, Shuangyong Song, Yongxiang Li, Zhongjiang He, Xuelong Li

专题命中 指令微调 :language model(abstract);pretraining(abstract);post-training(abstract);SFT(abstract)

Comments 32 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.10231 2025-06-13 cs.CL 84%

Classifying Unreliable Narrators with Large Language Models

Anneliese Brei, Katharine Henry, Abhisheik Sharma, Shashank Srivastava, Snigdha Chaturvedi

机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) Virginia Polytechnic Institute and State University(弗吉尼亚理工学院和州立大学)

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Comments ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11878 2025-06-10 cs.CL cs.CE q-fin.CP 84%

Open-FinLLMs: Open Multimodal Large Language Models for Financial Applications

Jimin Huang, Mengxi Xiao, Dong Li, Zihao Jiang, Yuzhe Yang, Yifei Zhang, Lingfei Qian, Yan Wang, Xueqing Peng, Yang Ren, Ruoyu Xiang, Zhengyu Chen, Xiao Zhang, Yueru He, Weiguang Han, Shunian Chen, Lihang Shen, Daniel Kim, Yangyang Yu, Yupeng Cao, Zhiyang Deng, Haohang Li, Duanyu Feng, Yongfu Dai, VijayaSai Somasundaram, Peng Lu, Guojun Xiong, Zhiwei Liu, Zheheng Luo, Zhiyuan Yao, Ruey-Ling Weng, Meikang Qiu, Kaleb E Smith, Honghai Yu, Yanzhao Lai, Min Peng, Jian-Yun Nie, Jordan W. Suchow, Xiao-Yang Liu, Benyou Wang, Alejandro Lopez-Lira, Qianqian Xie, Sophia Ananiadou, Junichi Tsujii

机构 * The Fin AI(Fin AI) Wuhan University(武汉大学) Columbia University(哥伦比亚大学) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Nanjing University(南京大学) Rensselaer Polytechnic Institute(罗格斯理工学院) The University of Manchester(曼彻斯特大学) Stevens Institute of Technology(史泰斯理工学院) National University of Singapore(新加坡国立大学) University of Florida(佛罗里达大学) University of Montreal(蒙特利尔大学) Yale University(耶鲁大学) New York University(纽约大学) Harvard University(哈佛大学) NVIDIA(英伟达) Artificial Intelligence Research Centre(人工智能研究中心) Archimedes/Athena Research Centre(Archimedes/Athena研究中心)

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Comments 33 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.12882 2025-06-09 cs.CR cs.CL cs.SE 84%

ProSec: Fortifying Code LLMs with Proactive Security Alignment

Xiangzhe Xu, Zian Su, Jinyao Guo, Kaiyuan Zhang, Zhenting Wang, Xiangyu Zhang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments The first two authors contributed equally to this work

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03524 2025-06-06 cs.CL cs.SE 84%

Seed-Coder: Let the Code Model Curate Data for Itself

ByteDance Seed, Yuyu Zhang, Jing Su, Yifan Sun, Chenguang Xi, Xia Xiao, Shen Zheng, Anxiang Zhang, Kaibo Liu, Daoguang Zan, Tao Sun, Jinhua Zhu, Shulin Xin, Dong Huang, Yetao Bai, Lixin Dong, Chao Li, Jianchong Chen, Hanzhi Zhou, Yifan Huang, Guanghan Ning, Xierui Song, Jiaze Chen, Siyao Liu, Kai Shen, Liang Xiang, Yonghui Wu

机构 * ByteDance Seed(字节跳动种子)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);pretraining(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12348 2025-05-20 cs.AI 84%

Reasoning-CV: Fine-tuning Powerful Reasoning LLMs for Knowledge-Assisted Claim Verification

Zhi Zheng, Wee Sun Lee

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08838 2025-05-20 eess.IV cs.AI cs.CV 84%

Ultrasound Report Generation with Multimodal Large Language Models for Standardized Texts

Peixuan Ge, Tongkun Su, Faqin Lv, Baoliang Zhao, Peng Zhang, Chi Hong Wong, Liang Yao, Yu Sun, Zenan Wang, Pak Kin Wong, Ying Hu

机构 * Shenzhen Institutes of Advanced Technology(深圳先进技术研究院) University of Macau(澳门大学) Chinese PLA General Hospital(中国人民解放军总医院) Macau University of Science and Technology(澳门科学技术大学)

专题命中 指令微调 :large language model(title);language model(title);分类 cs.AI

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.18089 2025-03-25 cs.CL 84%

$D^2LoRA$: Data-Driven LoRA Initialization for Low Resource Tasks

Javad SeraJ, Mohammad Mahdi Mohajeri, Mohammad Javad Dousti

专题命中 指令微调 :large language model(abstract);language model(abstract);post-training(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.12668 2025-03-18 cs.LG cs.PF 84%

ZO2: Scalable Zeroth-Order Fine-Tuning for Extremely Large Language Models with Limited GPU Memory

Liangyu Wang, Jie Ren, Hang Xu, Junxiao Wang, Huanyi Xie, David E. Keyes, Di Wang

专题命中 指令微调 :large language model(title);language model(title);分类 cs.LG

Comments 14 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.18101 2025-03-11 cs.CV cs.CL 84%

Detecting Offensive Memes with Social Biases in Singapore Context Using Multimodal Large Language Models

Cao Yuxuan, Wu Jiayang, Alistair Cheong Liang Chuen, Bryan Shan Guanrong, Theodore Lee Chong Jen, Sherman Chann Zhi Shen

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Comments Accepted at 3rd Workshop on Cross-Cultural Considerations in NLP (C3NLP), co-located with NAACL 2025. This is an extended version with some appendix moved to the main body

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.20527 2025-03-03 cs.CL cs.CY 84%

Supervised Fine-Tuning LLMs to Behave as Pedagogical Agents in Programming Education

Emily Ross, Yuval Kansal, Jake Renzella, Alexandra Vassar, Andrew Taylor

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.13474 2025-02-20 cs.CL 84%

Towards Lightweight, Adaptive and Attribute-Aware Multi-Aspect Controllable Text Generation with Large Language Models

Chenyu Zhu, Yefeng Liu, Chenyang Lyu, Xue Yang, Guanhua Chen, Longyue Wang, Weihua Luo, Kaifu Zhang

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Comments 17 pages,9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.09760 2025-02-03 cs.LG 84%

Targeted Vaccine: Safety Alignment for Large Language Models against Harmful Fine-Tuning via Layer-wise Perturbation

Guozhi Liu, Weiwei Lin, Tiansheng Huang, Ruichao Mo, Qi Mu, Li Shen

专题命中 指令微调 :large language model(title);language model(title);分类 cs.LG

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.12698 2025-01-28 cs.CL 84%

Training Dialogue Systems by AI Feedback for Improving Overall Dialogue Impression

Kai Yoshida, Masahiro Mizukami, Seiya Kawano, Canasai Kruengkrai, Hiroaki Sugiyama, Koichiro Yoshino

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Accepted to ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10937 2025-01-22 cs.CL cs.SD eess.AS 84%

Leveraging Chain of Thought towards Empathetic Spoken Dialogue without Corresponding Question-Answering Data

Jingran Xie, Shun Lei, Yue Yu, Yang Xiang, Hui Wang, Xixin Wu, Zhiyong Wu

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);SFT(abstract)

Comments Accepted by ICASSP 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10365 2025-01-22 cs.CY cs.AI cs.SE 84%

Can LLMs Identify Gaps and Misconceptions in Students' Code Explanations?

Priti Oli, Rabin Banjade, Andrew M. Olney, Vasile Rus

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract);preference optimization(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05895 2024-11-12 cs.CL 84%

One Small and One Large for Document-level Event Argument Extraction

Jiaren Peng, Hongda Sun, Wenzhong Yang, Fuyuan Wei, Liang He, Liejun Wang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);small language model(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.20654 2024-06-24 cs.CL cs.IR 84%

Passage-specific Prompt Tuning for Passage Reranking in Question Answering with Large Language Models

Xuyang Wu, Zhiyuan Peng, Krishna Sravanthi Rajanala Sai, Hsin-Tai Wu, Yi Fang

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Comments Accepted at Gen-IR@SIGIR24

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.13582 2024-06-21 cs.CL 84%

Translation and Fusion Improves Zero-shot Cross-lingual Information Extraction

Yang Chen, Vedaant Shah, Alan Ritter

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);instruction tuning(abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.09096 2024-06-13 cs.CL 84%

Defending Large Language Models Against Jailbreaking Attacks Through Goal Prioritization

Zhexin Zhang, Junxiao Yang, Pei Ke, Fei Mi, Hongning Wang, Minlie Huang

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

Comments ACL 2024 Main Conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.19763 2024-05-31 cs.CL 84%

Enhancing Reinforcement Learning with Label-Sensitive Reward for Natural Language Understanding

Kuo Liao, Shuang Li, Meng Zhao, Liqun Liu, Mengge Xue, Zhenyu Hu, Honglin Han, Chengguo Yin

专题命中 指令微调 :large language model(abstract);language model(abstract);foundation model(abstract);SFT(abstract)

Comments Accept at ACL2024 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2405.03794 2024-05-08 cs.CL 84%

Detecting Anti-Semitic Hate Speech using Transformer-based Large Language Models

Dengyi Liu, Minghao Wang, Andrew G. Catlin

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.05525 2024-03-12 cs.AI 84%

DeepSeek-VL: Towards Real-World Vision-Language Understanding

Haoyu Lu, Wen Liu, Bo Zhang, Bingxuan Wang, Kai Dong, Bo Liu, Jingxiang Sun, Tongzheng Ren, Zhuoshu Li, Hao Yang, Yaofeng Sun, Chengqi Deng, Hanwei Xu, Zhenda Xie, Chong Ruan

专题命中 指令微调 :LLM(abstract);language model(abstract);foundation model(abstract);instruction tuning(abstract)

Comments https://github.com/deepseek-ai/DeepSeek-VL

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.07310 2024-01-17 cs.CL 84%

Harnessing Large Language Models Over Transformer Models for Detecting Bengali Depressive Social Media Text: A Comprehensive Study

Ahmadul Karim Chowdhury, Md. Saidur Rahman Sujon, Md. Shirajus Salekin Shafi, Tasin Ahmmad, Sifat Ahmed, Khan Md Hasib, Faisal Muhammad Shah

专题命中 指令微调 :large language model(title);language model(title);分类 cs.CL

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.12010 2025-09-26 cs.LG cs.AI cs.CL 84%

Bias Similarity Measurement: A Black-Box Audit of Fairness Across LLMs

Hyejun Jeong, Shiqing Ma, Amir Houmansadr

机构 * UMass Amherst(马萨诸塞大学阿姆赫斯特分校)

专题命中 指令微调 :LLM(abstract,comments);large language model(abstract);language model(abstract);instruction tuning(abstract)

Comments Code available at https://github.com/HyejunJeong/bias_llm

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.20047 2026-08-21 cs.CL cs.CR cs.LG 新提交 84%

Auditing Cross-Lingual Fairness in Language Model Watermarking

语言模型水印的跨语言公平性审计

Alexander Nemecek, Osama Zafar, Debargha Ganguly, Vikash Singh, Vipin Chaudhary, Erman Ayday

机构 * Case Western Reserve University(凯斯西储大学)

专题命中 指令微调 :language model(title,abstract);large language model(abstract);分类 cs.CL、cs.LG

AI总结 该研究提出含四组件的跨语言公平性评估框架,应用于多方案、生成器、语言及模型 regime,揭示单语言评估无法发现的失效模式,发现水印跨语言公平性差距源于语言属性的结构性问题。

Comments 24 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.02782 2026-08-20 cs.AI cs.CL eess.AS 版本更新 84%

When Audio-Language Models Fail to Leverage Multimodal Context for Dysarthric Speech Recognition

音频-语言模型在利用多模态上下文进行构音障碍语音识别时的失效问题

Pehuén Moure, Niclas Pokel, Bilal Bounajma, Yingqiang Gao, Roman Boehringer, Longbiao Cheng, Shih-Chii Liu

专题命中 指令微调 :language model(title,abstract);prompting(abstract);分类 cs.CL、cs.AI

AI总结 该研究构建基于SAP数据集的基准,发现现有音频-语言模型无法有效利用构音障碍语音的临床上下文,而LoRA适配方法可将WER降低52%,为包容性ASR提供测试平台。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.13430 2026-08-14 cs.CL cs.AI 新提交 84%

Are You Sure You're Sure? On the Impact of Instruction Tuning on Confidence and Lexical Diversity

你确定你确定吗?指令微调对置信度和词汇多样性的影响

Irina Proskurina, Mayank Kumar, Oyindolapo O. Komolafe

机构 * Cohere Labs(Cohere实验室) Laboratoire Hubert Curien(于贝尔·居里实验室) Bennett University(班尼特大学) Western University(西安大略大学)

专题命中 指令微调 :instruction tuning(title,abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本文研究指令微调对语言模型置信度与生成理由词汇多样性的影响,发现指令微调虽小幅降低校准度但显著改变置信度,且对理由多样性的影响存在差异,二者是指令微调的不同效应。

详情

展开后加载摘要…

URL PDF HTML 收藏