arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11567 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11567 篇

2606.29371 2026-06-30 stat.AP 88%

Semantic insurance pricing with large language models

基于大语言模型的语义保险定价

Christopher Blier-Wong, Derek Kusmenko

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 利用预训练大语言模型从保单的自然语言描述中提取嵌入特征,替代手工特征输入标准精算定价模型,在法国车险数据上验证了其在小样本下的优势,并讨论了微调与提示敏感性问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.29097 2026-06-30 cs.CV 88%

TrafficAlign: Aligning Large Language Models for Traffic Scenario Generation

TrafficAlign: 对齐大语言模型用于交通场景生成

Zhi Tu, Liangkun Niu, Tianyi Zhang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 提出TrafficAlign框架,利用真实驾驶视频合成交通场景并对齐大语言模型,生成场景使自动驾驶模型碰撞率提升10.8%,微调后碰撞率降低36.1%。

Comments Accepted to CVPR 2026

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), June 2026, pp. 39744-39754

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27484 2026-06-29 cs.CV 新提交 88%

Fine-tuning a multimodal large language model for clinician-grade autism behavioral scoring from short home videos

微调多模态大语言模型用于从短视频中对自闭症行为进行临床级评分

Mohammadmahdi Honarmand, Parnian Azizian, Aaron Kline, Kae Nurge, Zerin Nasrin Tumpa, Saimourya Surabhi, Kaitlyn Dunlap, Yang Qian, Ali Kargarandehkordi, Sameer Neupane, Peter Washington, Dennis P. Wall

机构 * Stanford University(斯坦福大学) University of Hawaii at Manoa(夏威夷大学马诺阿分校) University of California San Francisco(加利福尼亚大学旧金山分校)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract,abstract_cn)

AI总结 微调Gemini 2.5 Pro模型,从400个临床评分的家庭视频中提取30个行为特征,在99名儿童上实现与临床医生评分的一致性提升40%,并零样本达到53%的自闭症诊断F1提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.19684 2026-06-19 cs.CV 新提交 88%

Exploring Multi-Modal Large Language Models and Two-Stage Fine-Tuning for Fashion Image Retrieval

探索多模态大语言模型与两阶段微调在时尚图像检索中的应用

Nguyen Cao Hoang, Hoang Bui Le, Nam Vo Hoang, Trung-Nghia Le

机构 * University of Science, VNU-HCM(胡志明市国家大学下属理科大学) Vietnam National University, Ho Chi Minh(胡志明市国家大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 提出融合多模态大语言模型(LLaVA)生成属性感知三元组,并采用两阶段微调策略增强对比学习,以解决时尚图像检索中标注数据稀缺和负采样简单的问题。

Comments SOICT 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23783 2026-06-08 cs.CY 版本更新 88%

Benchmarking LLMs for Community Governance Simulation with Life-history Narratives

用生命历程叙事对社区治理模拟中的大语言模型进行基准测试

Xu Chen, Yuanzi Li, Lei Wang, Nan Lu, Yang Wang, Anding Wang, Lei Shi, Xiaoxing Fu, Ji-Rong Wen

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 针对社区治理中居民个体模拟需求,提出包含数据集、基准测试、算法和系统的框架,通过丰富生命历程叙事提升LLM模拟保真度,并设计curriculum-LoRA算法在降低调用成本的同时保持高保真度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26574 2026-05-27 cs.CR 88%

GradSentry: Gradient Spectral Entropy for Backdoor Sample Filtering in Large Language Model Fine-Tuning

GradSentry: 大语言模型微调中基于梯度谱熵的后门样本过滤

Haodong Zhao, Tianyi Xu, Tianhang Zhao, Zhuosheng Zhang, Gongshen Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 提出GradSentry方法,利用每个样本梯度的谱熵区分后门样本与干净样本,无需聚类即可在任意投毒比例下有效过滤后门样本。

Comments Work in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14442 2026-05-15 cs.CY 88%

GGBound: A Genome-Grounded Agent for Microbial Life-Boundary Prediction

GGBound:一种基于基因组的微生物生命边界预测代理

Hanbo Huang, Xuan Gong, Jing Wang, Lei Bai, Xiang Xiao, Weishu Zhao, Shiyu Liang

专题命中 指令微调 :LLM(summary_cn,abstract);SFT(abstract,abstract_cn);foundation model(abstract)

AI总结 本文提出GGBound代理,通过基因组条件化和工具增强的LLM,解决微生物生命边界预测问题,构建了涵盖1525种菌株的基准数据集,并通过三阶段优化流程提升预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19115 2026-05-12 cs.CV 88%

Generative Giants, Retrieval Weaklings: Why do Multimodal Large Language Models Fail at Multimodal Retrieval?

生成巨人,检索弱者:为何多模态大语言模型在多模态检索中表现不佳?

Hengyi Feng, Zeang Sheng, Meiyi Qiang, Yang Li, Wentao Zhang

机构 * University of Electronic Science and Technology of China(电子科技大学) Peking University(北京大学) Tencent Inc(腾讯公司) Zhongguancun Academy(中关村学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 研究揭示多模态大语言模型在多模态检索中表现不佳的原因,通过稀疏自编码器分析发现其表示空间主要由文本语义构成,视觉语义不足,导致检索性能下降,提出ReAlign方法提升检索效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07764 2026-05-11 cs.RO 88%

CommandSwarm: Safety-Aware Natural Language-to-Behavior-Tree Generation for Robotic Swarms

CommandSwarm: 为机器人群体提供安全意识的自然语言到行为树生成

Mohammed Majid, Amjad Yousef Majid

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出CommandSwarm系统,通过多语言翻译、安全过滤和约束提示生成XML行为树,验证了紧凑量化领域适应的LLM在机器人群体控制中的有效性,强调了解析器接受和安全过滤的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.07201 2026-05-11 cs.CL cs.AI cs.LG 88%

PSK@EEUCA 2026: Fine-Tuning Large Language Models with Synthetic Data Augmentation for Multi-Class Toxicity Detection in Gaming Chat

PSK@EEUCA 2026: 通过合成数据增强微调大语言模型用于游戏聊天中的多类毒性检测

Srikar Kashyap Pulipaka

机构 * Independent Researcher(独立研究员)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract_cn);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出通过合成数据增强微调大语言模型,用于游戏聊天中的多类毒性检测,实验结果显示在测试集上达到0.6234的F1-macro分数,发现验证性能高反而导致测试转移差的'验证陷阱'现象。

Comments Accepted to the EEUCA workshop at ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02921 2026-05-05 q-fin.GN q-fin.TR 88%

Debiasing LLMs by Fine-tuning

通过微调去偏大语言模型

Zhenyu Gao, Wenxi Jiang, Yutong Yan

专题命中 指令微调 :LLM(summary_cn,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出一种基于监督微调的方法,利用LoRA技术训练指令数据集以减少LLM的预测偏差,通过参数层面干预改善模型的预测能力,实验验证了该方法在控制预测和股票收益预测中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10554 2026-05-05 cs.CV 88%

Grounding Everything in Tokens for Multimodal Large Language Models

基于令牌的多模态大语言模型的 grounding

Xiangxuan Ren, Zhongdao Wang, Liping Hou, Pin Tang, Guoqing Wang, Chao Ma

机构 * MoE Key Lab of Artificial Intelligence(人工智能混合专家模型关键实验室) AI Institute, Shanghai Jiao Tong University(上海交通大学人工智能研究院) Central Research Institute, Huawei(华为中央研究院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出GETok方法,通过整合可学习的令牌词汇提升多模态大语言模型在2D空间中的物体定位能力,实验显示其在多种指引用例任务中表现更优。

Comments 19 pages, 16 figures, 12 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.07050 2026-04-23 cs.IR cs.AI cs.CL cs.LG 88%

ReasonRank: Empowering Passage Ranking with Strong Reasoning Ability

ReasonRank: 通过强推理能力增强文档排序

Wenhan Liu, Xinyu Ma, Weiwei Sun, Yutao Zhu, Yuchen Li, Dawei Yin, Zhicheng Dou

机构 * Gaoling School of Artificial Intelligence, Renmin University of China(中国人民大学人工智能学院 Gallagher 分校) Baidu Inc., Beijing, China(百度公司,北京,中国) Carnegie Mellon University(卡内基梅隆大学)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文提出ReasonRank,通过自动化生成推理密集型训练数据和两阶段训练方法,提升文档排序性能,实验表明其优于现有基线并具有更低延迟。

Comments 25 pages, accepted by ACL2026 main conference

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.10997 2026-03-31 cond-mat.mtrl-sci 88%

Data-driven Prediction of Ionic Conductivity in Solid-State Electrolytes with Machine Learning and Large Language Models

基于机器学习和大语言模型的固态电解质离子导电性数据驱动预测

Haewon Kim, Taekgi Lee, Seongeun Hong, Kyeong-Ho Kim, Yongchul G. Chung

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出利用机器学习和大语言模型预测固态电解质离子导电性,通过结合几何描述符和结构标签数据,提升预测精度并实现可解释的结构-性质分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21077 2026-03-30 cs.CV 88%

CoVFT: Context-aware Visual Fine-tuning for Multimodal Large Language Models

CoVFT:面向多模态大语言模型的上下文感知视觉微调

Nan Zhou, Huiqun Wang, Yaoyan Zheng, Di Huang

机构 * State Key Laboratory of Complex and Critical Software Environment, Beihang University(北京航空航天大学复杂关键软件环境国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出CoVFT框架,通过整合上下文向量提取和上下文混合专家模块,解决多模态任务中视觉微调的不稳定性问题,实现更稳定的视觉更新。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02465 2026-03-27 eess.SP 88%

Large Language Models Can Achieve Explainable and Training-Free One-shot HRRP ATR

大语言模型可实现可解释且无需训练的一次性高分辨率距离谱自动目标识别

Lingfeng Chen, Panhe Hu, Zhiliang Pan, Qi Liu, Zhen Liu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出一种无需训练且可解释的框架,利用大语言模型将一维HRRP信号转换为文本散射中心表示,通过少样本上下文学习对齐语义空间,实现无需参数更新的ATR。

Comments Submitted to IEEE SPL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.14858 2026-03-06 astro-ph.HE astro-ph.IM 88%

Large Language Model-driven Analysis of General Coordinates Network (GCN) Circulars

基于大语言模型的通用坐标网络(GCN)圆周分析

Vidushi Sharma, Ronit Agarwala, Judith L. Racusin, Leo P. Singer, Tyler Barna, Eric Burns, Michael W. Coughlin, Dakota Dutko, Courey Elliott, Rahul Gupta, Ashish Mahabal, Nikhil Mukund

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文利用大语言模型自动解析GCN圆周,实现暂现体观测信息的高效提取与分类,准确率达97.2%。

Comments 21 pages, 11 figures, 7 tables. Published in ApJS

Journal ref The Astrophysical Journal Supplement Series, 2026, Volume 283, Number 1, Pages 30

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.01235 2026-03-04 cs.CR 88%

A Fingerprint for Large Language Models

大型语言模型的指纹

Zhiguang Yang, Hanzhou Wu

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文提出了一种新型黑盒指纹技术,用于检测大型语言模型的侵权行为,通过分析模型输出的向量空间相似性,实现高效且鲁棒的指纹验证。

Comments Updated by Hanzhou Wu, 8 pages

Journal ref IS&T Electronic Imaging, Media Watermarking, Security, and Forensics (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05132 2026-03-03 cs.CL cs.AI cs.LG 88%

Training Large Language Models To Reason In Parallel With Global Forking Tokens

训练大型语言模型以并行推理与全局分叉标记

Sheng Jia, Xiao Wang, Shiva Prasad Kasiviswanathan

机构 * University of Toronto(多伦多大学) Amazon(亚马逊) Vector Institute(向量研究所)

专题命中 指令微调 :large language model(title);language model(title);SFT(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出SSFT和GFPO方法,通过集合基于的损失和双射匹配,提升大型语言模型在并行推理中的多样性和准确性,从而在数学推理和代码生成任务中取得优于传统SFT的性能。

Comments Accepted at ICLR 2026

Journal ref The Fourteenth International Conference on Learning Representations (ICLR 2026), https://openreview.net/forum?id=xBQvvkg4Wc

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.19505 2026-02-24 cs.CV 88%

Test-Time Computing for Referring Multimodal Large Language Models

测试时计算用于指代多模态大语言模型

Mingrui Wu, Hao Chen, Jiayi Ji, Xiaoshuai Sun, Zhiyuan Liu, Liujuan Cao, Ming-Ming Cheng, Rongrong Ji

机构 * Key Laboratory of Multimedia Trusted Perception and Efficient Computing, Ministry of Education of China, Xiamen University(多媒体可信感知与高效计算重点实验室,中国教育部,厦门大学) VCIP, CS, Nankai University(VCIP,计算机科学,南开大学) Tsinghua University(清华大学) Zhongguancun Academy, Beijing, China(中关村学院,北京,中国)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 ControlMLLM++通过注入可学习的视觉提示实现多模态大语言模型的测试时适应,提升细粒度视觉推理能力。

Comments arXiv admin note: substantial text overlap with arXiv:2407.21534

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.16981 2026-02-16 cs.CR 88%

SmartGuard: Leveraging Large Language Models for Network Attack Detection through Audit Log Analysis and Summarization

SmartGuard: 借助大语言模型通过审计日志分析与总结进行网络攻击检测

Hao Zhang, Shuo Shao, Song Li, Zhenyu Zhong, Yan Liu, Zhan Qin

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 SmartGuard通过结合抽象行为与大语言模型,实现基于审计日志的网络攻击检测,具有高准确率和良好的可扩展性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.05485 2026-02-06 cs.CY 88%

Fine-Tuning Large Language Models for Automatic Detection of Sexually Explicit Content in Spanish-Language Song Lyrics

对西班牙语歌曲歌词中色情内容进行自动检测的大型语言模型微调

Dolores Zamacola Sánchez de Lamadrid, Eduardo C. Garrido-Merchán

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文通过微调GPT模型,实现了对西班牙语歌曲歌词中色情内容的自动检测,并提出音乐内容评级的政策建议。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.00777 2026-01-05 cs.SD cs.CV 88%

Investigating the Viability of Employing Multi-modal Large Language Models in the Context of Audio Deepfake Detection

探讨在音频深度伪造检测中使用多模态大语言模型的可行性

Akanksha Chuchra, Shukesh Reddy, Sudeepta Mishra, Abhijit Das, Abhinav Dhall

机构 * Indian Institute of Technology, Ropar, India(印度理工学院罗帕尔分校) Machine Intelligence Group, Birla Institute of Technology and Science, Pilani, Hyderabad Campus, India(比拉理工科学院帕利尼 Hyderabad 分校机器智能小组) Monash University, Melbourne, Australia(墨尔本大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 本文探讨了多模态大语言模型在音频深度伪造检测中的可行性,通过结合音频输入与多提示方法,展示了模型在域内数据上的良好表现及潜在应用价值。

Comments Accepted at IJCB 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.09121 2025-12-19 cs.CV 88%

MMRel: Benchmarking Relation Understanding in Multi-Modal Large Language Models

MMRel:多模态大语言模型中关系理解的基准测试

Jiahao Nie, Gongjie Zhang, Wenbin An, Yun Xing, Yap-Peng Tan, Alex C. Kot, Shijian Lu

机构 * Interdisciplinary Graduate Programme, Nanyang Technological University, Singapore(南洋理工大学跨学科研究生项目) Alibaba DAMO Academy, Singapore(阿里巴巴达摩院) Xi’an Jiaotong University, China(西安交通大学) Nanyang Technological University, Singapore(南洋理工大学) VinUniversity, Vietnam(文莱大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

AI总结 MMRel是一个用于评估和提升多模态大语言模型关系理解能力的基准测试,包含大规模高质量的关系数据和对抗性案例,通过实验验证其在提升模型关系理解方面的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.12385 2025-11-18 cs.CR cs.SE 88%

GenSIaC: Toward Security-Aware Infrastructure-as-Code Generation with Large Language Models

Yikun Li, Matteo Grella, Daniel Nahmias, Gal Engelberg, Dan Klein, Giancarlo Guizzardi, Thijs van Ede, Andrea Continella

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.04604 2025-11-18 cs.SE 88%

Contrastive Learning-Enhanced Large Language Models for Monolith-to-Microservice Decomposition

Khaled Sellami, Mohamed Aymen Saied

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.02001 2025-11-11 cs.DC 88%

EcoLoRA: Communication-Efficient Federated Fine-Tuning of Large Language Models

Han Liu, Ruoyao Wen, Srijith Nair, Jia Liu, Wenjing Lou, Chongjie Zhang, William Yeoh, Yevgeniy Vorobeychik, Ning Zhang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.00011 2025-10-28 eess.SP 88%

Movable Antenna Enhanced Federated Fine-Tuning of Large Language Models via Hybrid Client Selection Optimization

Yang Zhao, Yue Xiu, Chengxiao Dai, Ning Wei, Dusit Niyato

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.17274 2025-10-21 cs.CV 88%

Enhanced Motion Forecasting with Plug-and-Play Multimodal Large Language Models

Katie Luo, Jingwei Ji, Tong He, Runsheng Xu, Yichen Xie, Dragomir Anguelov, Mingxing Tan

机构 * Computer and Information Sciences Department, Cornell University(康奈尔大学计算机与信息科学系) Waymo LLC(Waymo公司) UC Berkeley(伯克利大学)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

Comments In proceedings of IROS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.09078 2025-09-30 cs.SE 88%

An Exploratory Study on Fine-Tuning Large Language Models for Secure Code Generation

Junjie Li, Fazle Rabbi, Cheng Cheng, Aseem Sangalay, Yuan Tian, Jinqiu Yang

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract)

Comments 37 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏