arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

共收录 11585 信号源:cs.CL, cs.AI, cs.LG

1. 指令微调 11585 篇

2607.19364 2026-08-12 cs.AI cs.CL 版本更新 87%

SAE-StatSteer: Statistical Consensus Feature Selection for Optimization-Free Activation Steering of Large Language Models

用于大语言模型激活空间控制的基于统计的稀疏特征干预

Oshayer Siddique, J. M Areeb Uzair Alam, Md Jobayer Rahman Rafy, Syed Rifat Raiyan, Hasan Mahmud, Md Kamrul Hasan

机构 * Islamic University of Technology(伊斯兰科技大学) Systems and Software Lab (SSL)(系统与软件实验室)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

AI总结 研究大语言模型激活空间控制问题时,提出基于统计的稀疏特征干预方法,先经可靠性过滤,再用三个统计量排序特征,构建引导方向。在多模型、领域和配置上实验,发现该方法有特定领域转移效果,且引导受多种因素影响,强调评估应兼顾质量与行为转移。

Comments Under review, 26 pages, 5 figures, 16 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.06160 2026-08-04 cs.CL cs.AI 版本更新 87%

LongCrafter: Towards Diverse Long-Context Understanding via Evidence-Graph-Guided Instruction Synthesis

LongCrafter:通过证据图引导的指令合成实现多样化的长上下文理解

Chenhao Yuan, Yinhao Xu, Shuwen Xu, Xizhi Yang, Jiaxiang Liu, Chenxi Zhou, Shaoping Huang, Haolin Ren, Pengfei Cao, Jun Zhao, Kang Liu

机构 * University of Chinese Academy of Sciences(中国科学院大学) The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所认知与决策智能复杂系统重点实验室)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对现有长上下文理解方法的局限,提出LongCrafter框架,结合分层任务分类法与证据管道,生成多样化长上下文SFT数据,微调后的模型在多个数据集上表现优异,能有效缓解“中间迷失”问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.13627 2026-08-04 cs.LG cs.CL 版本更新 87%

(How) Learning Rates Regulate Catastrophic Overtraining

(如何) 学习率调节灾难性过训练

Mark Rofin, Aditya Varre, Nicolas Flammarion

机构 * EPFL(瑞士联邦理工学院)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);pretraining(abstract);post-training(abstract)

AI总结 研究通过隐式正则化分析学习率对微调中灾难性遗忘的影响,发现学习率大小影响模型收敛方向,并揭示学习率衰减加剧预训练模型尖锐性从而导致灾难性过训练。

Comments COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29238 2026-08-03 cs.CL cs.AI cs.CY cs.ET cs.HC 新提交 87%

Small Is Enough: Per-User Style Rewriting of AI-Edited Text via LoRA Adapters

小模型已足够:通过LoRA适配器对AI编辑文本进行单用户风格重写

Antorweep Chakravorty

机构 * University of Stavanger(斯塔万格大学)

专题命中 指令微调 :LLM(summary_cn,abstract);language model(abstract);small language model(abstract);分类 cs.CL、cs.AI

AI总结 InMyStyle是注重隐私的单用户系统,用多本地辅助LLM构建配对训练示例,微调0.5B-7B参数模型的LoRA适配器,可将AI编辑文本重写为用户风格,小模型即可完成重写任务,其输出感知AI性低于辅助AI生成内容

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18874 2026-06-29 cs.LG cs.CL 版本更新 87%

Retaining by Doing: The Role of On-Policy Data in Mitigating Forgetting

在做中保留:在线策略数据在缓解遗忘中的作用

Howard Chen, Noam Razin, Karthik Narasimhan, Danqi Chen

专题命中 指令微调 :SFT(summary_cn,abstract);language model(abstract);post-training(abstract);分类 cs.CL、cs.LG

AI总结 本文系统比较了监督微调(SFT)和强化学习(RL)在语言模型后训练中的遗忘模式,发现RL因使用在线策略数据而更少遗忘,并验证了在线策略数据是缓解遗忘的关键因素。

Journal ref Proceedings of the 43rd International Conference on Machine Learning (ICML), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.11502 2026-06-26 cs.CL cs.AI 新提交 87%

When Role-playing, Do Models Believe What They Say?

角色扮演时,模型是否相信它们所说的话?

Benjamin Sturgeon, David Africa, Sid Black

机构 * MATS

专题命中 指令微调 :LLM(summary_cn,abstract_cn);language model(abstract);SFT(abstract);prompting(abstract)

AI总结 通过线性真实探针研究角色扮演对LLM内部表征的影响,发现角色扮演主要改变输出而非内部真实表征,而紧急错位则更显著地改变内部表征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07082 2026-06-16 cs.LG cs.AI 版本更新 87%

On the Geometry of On-Policy Distillation

论在线策略蒸馏的几何结构

Zhennan Shen, Yanshu Li, Qingyu Yin, Chak Tou Leong, Zhilin Wang, Yanxu Chen, Rongduo Han, Sunbowen Lee, Yi R. Fung

机构 * HKUST(香港科技大学) UT Austin(得克萨斯大学奥斯汀分校) Zhejiang University(浙江大学) Hong Kong PolyU(香港理工大学) USTC(中国科学技术大学) BUPT(北京邮电大学) Nankai University(南开大学) BIT(北京理工大学)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文通过参数空间诊断,揭示在线策略蒸馏(OPD)的更新轨迹具有松弛离主成分、子空间锁定等独特几何特性,表明其并非介于SFT和RLVR之间的中间方法。

Comments 17 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09737 2026-06-15 cs.LG cs.AI 版本更新 87%

STaR-DRO: Stateful Tsallis Reweighting for Group-Robust Structured Prediction

STaR-DRO: 面向群体鲁棒结构化预测的状态化Tsallis重加权

Samah Fodeh, Ganesh Puthiaraju, Elyas Irankhah, Afshan Khan, Sreeraj Ramachandran, Linhai Ma, Srivani Talakokkul, Sarah Schellhorn

机构 * Yale University(耶鲁大学) Yale School of Medicine(耶鲁医学院)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 提出STaR-DRO框架,结合Tsallis镜像上升和稀疏entmax映射,仅对持续困难群体上权重,在结构化预测中提升标签准确性和鲁棒性,在EPPC Miner任务上相比SFT和标准DRO分别提升F1分数1.08和2.20。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.09059 2026-06-09 cs.LG cs.AI cs.CV 新提交 87%

Stage-1 Controls the Entropy Regime, Not the Outcome

Stage-1 控制熵状态,而非最终结果

Jianxiong Shen

机构 * University of California, Berkeley(加州大学伯克利分校)

专题命中 指令微调 :SFT(summary_cn,abstract);language model(abstract);post-training(abstract);分类 cs.AI、cs.LG

AI总结 本文通过小数据实验研究两阶段后训练中Stage-1(SFT或OPD)的作用,发现其主要影响策略熵状态,但对最终性能影响有限。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.07006 2026-06-08 cs.LG cs.CL 新提交 87%

RASFT: Rollout-Adaptive Supervised Fine-Tuning for Reasoning

RASFT: 用于推理的滚动自适应监督微调

Yongliang Miao, Fengyuan Liu, Wei Shi, Yanguang Liu, Fei Sun, Na Zou, Mengnan Du

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) New Jersey Institute of Technology(新泽西理工学院) Institute of Computing Technology, CAS(中国科学院计算技术研究所)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.LG

AI总结 提出RASFT框架,通过基于策略rollout的问题级可解性校准专家监督,在模型困难时加强指导、表现可靠时放松模仿并纳入自生成轨迹,同时使用裁剪逆比约束策略漂移,在多个推理基准上优于SFT和RL方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.13702 2026-06-02 cs.LG cs.AI 87%

Value-Free Policy Optimization via Reward Partitioning

通过奖励划分实现无价值函数策略优化

Bilal Faye, Hanane Azzag, Mustapha Lebbah

机构 * LIPN, Université Paris 13(巴黎第十三大学LIPN实验室) Université Paris 13(巴黎第十三大学) Université de Versailles Saint-Quentin Paris(巴黎- versaillies圣quentin大学)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);language model(abstract);preference optimization(abstract)

AI总结 提出Reward Partition Optimization (RPO)方法,通过基于划分的奖励归一化消除价值函数学习,实现稳定、高效的策略优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.06006 2026-06-02 cs.LG cs.AI cs.NE 87%

Optuna vs Code Llama: Are LLMs a New Paradigm for Hyperparameter Tuning?

Optuna vs Code Llama:LLM 是超参数调优的新范式吗?

Roman Kochnev, Arash Torabi Goodarzi, Zofia Antonina Bentyn, Dmitry Ignatov, Radu Timofte

机构 * Computer Vision Lab, CAIDAS & IFI, University of Würzburg, Germany(计算机视觉实验室,CAIDAS与IFI,乌尔姆大学,德国)

专题命中 指令微调 :LLM(title_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 通过微调参数高效的 Code Llama 模型,提出基于大语言模型的超参数优化方法,在多种视觉架构上实现与 Optuna 相当或更优的 RMSE 并大幅降低计算开销。

Journal ref Proceedings of the IEEE/CVF International Conference on Computer Vision Workshops (ICCVW), pp. 5664-5674, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13853 2026-05-27 cs.CL cs.AI 87%

APEX-Searcher: Refining Credit Assignment with Subgoaling for Agentic Retrieval-Augmented Generation

APEX-Searcher: 通过子目标细化信用分配以增强智能体检索增强生成

Kun Chen, Qingchao Kong, Zhao Feifei, Wenji Mao

机构 * University of Chinese Academy of Sciences(中国科学院大学) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部) Wenge Technology Co., Ltd(Wenger科技有限公司)

专题命中 指令微调 :SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 针对复杂多跳问答中检索路径模糊和端到端强化学习奖励稀疏的问题,提出APEX-Searcher,通过分离规划与执行的信用分配(规划用RL优化、执行用SFT学习),在多个基准上取得一致提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.19523 2026-05-20 cs.CL cs.AI cs.CV 87%

Investigating Cross-Modal Skill Injection: Scenarios, Methods, and Hyperparameters

探究跨模态技能注入:场景、方法与超参数

Zhiyu Xu, Lean Wang, Yuanxin Liu, Lei Li, Hao Zhou, Fandong Meng, Jie Zhou, Xu Sun

机构 * State Key Laboratory for Multimedia Information Processing, School of Computer Science, Peking University(多媒体信息处理国家重点实验室,计算机科学学院,北京大学) WeChat AI, Tencent Inc., China(腾讯公司,中国) The University of Hong Kong(香港大学)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文研究了跨模态技能注入在不同场景下的表现,分析了其方法和超参数的影响,发现其在指令遵循和跨语言任务中表现良好,但在数学推理中存在困难,同时指出经典方法如TA和DARE在性能上优于其他融合方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12289 2026-05-13 cs.LG cs.AI 87%

PriorZero: Bridging Language Priors and World Models for Decision Making

PriorZero:连接语言先验与世界模型以实现决策制定

Junyu Xiong, Yuan Pu, Jia Tang, Yazhe Niu

机构 * University of Science and Technology of China(中国科学技术大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Nanjing University of Aeronautics and Astronautics(南京航空航天大学) The Chinese University of Hong Kong MMLab(香港中文大学MMLab)

专题命中 指令微调 :LLM(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 PriorZero通过解耦的rollout训练设计,将LLM生成的语义先验整合到基于世界模型的规划中,提升探索效率和长期性能,适用于文本冒险游戏和指令遵循任务。

Comments 30 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12264 2026-05-13 cs.CR cs.CL cs.LG 87%

Reconstruction of Personally Identifiable Information from Supervised Finetuned Models

从监督微调模型中重建个人身份信息

Sae Furukawa, Alina Oprea

机构 * Northeastern University(东北大学)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文研究了从监督微调模型中重建个人身份信息的问题,提出COVA算法在前缀攻击下优于现有提取方法,揭示了不同PII类型泄露程度差异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07892 2026-05-13 cs.LG cs.CL 87%

Safety Alignment as Continual Learning: Mitigating the Alignment Tax via Orthogonal Gradient Projection

安全对齐作为持续学习:通过正交梯度投影缓解对齐税

Guanglong Sun, Siyuan Zhang, Liyuan Wang, Jun Zhu, Hang Su, Yi Zhong

机构 * School of Life Sciences, IDG/McGovern Institute for Brain Research(生命科学学院,IDG/麦戈文脑科学研究所) Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua-Bosch Joint ML Center, THBI Lab, BNRist Center(计算机科学与技术系,人工智能研究所,清华大学-博世联合机器学习中心,THBI实验室,BNRist中心) Tsinghua University, Beijing, China(清华大学,北京,中国)

专题命中 指令微调 :SFT(abstract,abstract_cn);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 本文通过持续学习视角研究安全对齐与通用能力退化之间的权衡,提出OGPSA方法通过正交梯度投影提升安全性和实用性,实验显示在不同训练流程中显著改善安全-效用权衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09922 2026-05-12 cs.CL cs.AI 87%

Team-Based Self-Play With Dual Adaptive Weighting for Fine-Tuning LLMs

基于双自适应加权的团队自博弈:用于微调大语言模型

Wu Li, Yigeng Zhou, Zesheng Shi, Yequan Wang, Min Zhang, Jing Li

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Beijing Academy of Artificial Intelligence, Beijing, China(北京人工智能研究院)

专题命中 指令微调 :LLM(summary_cn,abstract);SFT(abstract,abstract_cn);分类 cs.CL、cs.AI

AI总结 本文提出TPAW算法,通过团队协作与竞争机制提升自监督下LLM对齐效果,采用双自适应加权机制提高优化效率,实验证明其在多种模型和基准测试中表现优异。

Comments Accepted by ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.23629 2026-05-08 cs.AI cond-mat.dis-nn cond-mat.stat-mech cs.LG physics.soc-ph 87%

Emergent Slow Thinking in LLMs as Inverse Tree Freezing

大语言模型中涌现的慢思考作为逆树冻结

Sihan Hu, Xiansheng Cai, Yuan Huang, Zhiyuan Yao, Linfeng Zhang, Pan Zhang, Youjin Deng, Kun Chen

机构 * Hefei National Laboratory, University of Science and Technology of China(中国科学技术大学合肥微尺度物质科学国家实验室) Hefei National Laboratory for Physical Sciences at the Microscale and Department of Modern Physics, University of Science and Technology of China(中国科学技术大学合肥微尺度物质科学国家实验室和现代物理系) Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所) School of Fundamental Physics and Mathematical Sciences, Hangzhou Institute for Advanced Study, UCAS(杭州高等研究院基础物理与数学科学学院) DP Technology(DP技术) Lanzhou Center for Theoretical Physics, Key Laboratory of Theoretical Physics of Gansu Province, Key Laboratory of Quantum Theory and Applications of MoE, Gansu Provincial Research Center for Basic Disciplines of Quantum Physics, Lanzhou University(兰州理论物理中心、甘肃省理论物理重点实验室、教育部量子理论与应用重点实验室、甘肃省量子物理基础学科省重点实验室、兰州大学) AI for Science Institute, Beijing(北京人工智能科学研究院)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 本文通过统计物理视角揭示大语言模型中慢思考的涌现机制,提出逆树冻结结构,并提出Annealed-RLVR方法提升模型性能。

Comments 34 pages, 17 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27840 2026-05-01 cs.LG cs.AI 87%

CastFlow: Learning Role-Specialized Agentic Workflows for Time Series Forecasting

CastFlow:学习用于时间序列预测的角色专用代理工作流

Bokai Pan, Mingyue Cheng, Zhiding Liu, Shuo Yu, Xiaoyu Tao, Yuchong Wu, Qi Liu, Defu Lian, Enhong Chen

机构 * State Key Laboratory of Cognitive Intelligence, University of Science and Technology of China(认知智能国家重点实验室,中国科学技术大学)

专题命中 指令微调 :LLM(abstract,abstract_cn);SFT(abstract,abstract_cn);large language model(abstract);language model(abstract)

AI总结 CastFlow通过动态代理框架实现多视角时间模式提取和多轮上下文特征获取,提升时间序列预测的准确性和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.15815 2026-04-21 cs.CL cs.AI cs.HC 87%

User-Assistant Bias in LLMs

大语言模型中的用户-助手偏见

Xu Pan, Jingxuan Fan, Zidi Xiong, Ely Hahami, Jorin Overwiening, Ziqian Xie

机构 * Harvard University(哈佛大学) University of Texas Health Science Center at Houston(德克萨斯大学健康科学中心休斯顿分校)

专题命中 指令微调 :LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 本文研究了大语言模型中因角色标签训练数据不一致导致的用户-助手偏见,通过UserAssist基准测试发现指令微调模型存在强用户偏见,而基础和推理模型接近中性,揭示了角色标签训练的潜在影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02574 2026-04-06 cs.CR cs.AI cs.LG 87%

Understanding the Effects of Safety Unalignment on Large Language Models

理解安全对齐偏差对大语言模型的影响

John T. Halloran

机构 * Leidos(Leidos公司)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.AI、cs.LG

AI总结 研究通过JT和WO方法评估六种大模型在恶意和良性任务中的表现,发现WO方法使模型更易执行恶意活动,而JT方法则更易产生幻觉。通过监督微调有效限制WO带来的攻击能力。

Comments 12 pages, 2 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21437 2026-03-31 cs.CL cs.LG 87%

A Systematic Study of In-the-Wild Model Merging for Large Language Models

对大型语言模型在真实场景中模型合并的系统研究

Oğuz Kağan Hitit, Leander Girrbach, Zeynep Akata

机构 * Koç University(科奇大学) Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Helmholtz Munich(亥姆霍兹慕尼黑中心)

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.LG

AI总结 本文系统评估了在真实场景中合并异构专家模型的效果,发现任务算术是唯一在该场景下可靠提升性能的方法,其他方法效果不显著。

Journal ref Transactions on Machine Learning Research (03/2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21075 2026-03-30 cs.LG cs.AI 87%

Aligning LLMs with Biomedical Knowledge using Balanced Fine-Tuning

通过平衡微调对齐大语言模型与生物医学知识

Zhenchao Tang, Fang Wang, Haohuai He, Jiale Zhou, Tianxu Lv, Jun Zhu, Shouzhi Chen, Minghao Yang, Yu Wang, Jiayang Wu, Yidong Song, Yaokun Li, Jiehui Huang, Dawei Huang, Zhi Song, Jianhua Yao

机构 * Tencent AI for Life Sciences Lab(腾讯AI生命科学实验室) Sun Yat-sen University(中山大学) The Hong Kong Polytechnic University(香港理工大学) Westlake University(西湖大学) The Hong Kong University of Science and Technology(香港科技大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);foundation model(abstract)

AI总结 本文提出平衡微调方法,通过双尺度后训练技术提升大语言模型对生物医学知识的理解与生成能力,实验表明其在医疗和生物学推理任务中优于传统方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.12222 2026-03-17 cs.LG cs.AI cs.CV 87%

Towards On-Policy SFT: Distribution Discriminant Theory and its Applications in LLM Training

迈向在线策略微调:分布判别理论及其在大语言模型训练中的应用

Miaosen Zhang, Yishan Liu, Shuxia Lin, Xu Yang, Qi Dai, Chong Luo, Weihao Jiang, Peng Hou, Anxiang Zeng, Xin Geng, Baining Guo

专题命中 指令微调 :SFT(title,abstract);LLM(title);分类 cs.AI、cs.LG

AI总结 本文提出分布判别理论及两种技术,提升SFT的泛化能力,实验表明其性能超越主流离线RL方法,且保持SFT效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04106 2025-12-05 cs.SE cs.AI cs.CL cs.CR 87%

Retrieval-Augmented Few-Shot Prompting Versus Fine-Tuning for Code Vulnerability Detection

检索增强的少样本提示与微调在代码漏洞检测中的比较

Fouad Trad, Ali Chehab

机构 * Electrical and Computer Engineering(电气与计算机工程) American University of Beirut(贝鲁特美国大学)

专题命中 指令微调 :prompting(title,abstract);large language model(abstract,comments);language model(abstract,comments);分类 cs.CL、cs.AI

AI总结 本研究比较了检索增强的少样本提示与微调方法在代码漏洞检测中的性能,发现检索增强提示在效率和效果上均优于微调方法。

Comments Accepted in the 3rd International Conference on Foundation and Large Language Models (FLLM2025)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.03527 2025-11-20 cs.CL cs.LG 87%

FANAL -- Financial Activity News Alerting Language Modeling Framework

Urjitkumar Patel, Fang-Chun Yeh, Chinmay Gondhalekar, Hari Nalluri

专题命中 指令微调 :language model(title,abstract);large language model(abstract,comments);preference optimization(abstract);分类 cs.CL、cs.LG

Comments Accepted for the IEEE International Workshop on Large Language Models for Finance, 2024. This is a preprint version

Journal ref 2024 IEEE International Conference on Big Data, Dec 15-18, 2024, Electronic ISBN: 979-8-3503-6248-0, Electronic ISSN: 2573-2978

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14250 2025-11-14 cs.CL cs.AI cs.CR 87%

Siren: A Learning-Based Multi-Turn Attack Framework for Simulating Real-World Human Jailbreak Behaviors

Yi Zhao, Youzhi Zhang

机构 * Department of Computing The Hong Kong Polytechnic University Hong Kong SAR, China Centre for Artificial Intelligence Robotics Hong Kong Institute of Science \& Innovation Chinese Academy of Sciences Hong Kong SAR, China

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)

Comments Accepted at ACSAC 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.26457 2025-10-31 cs.SE cs.AI cs.CL 87%

SecureReviewer: Enhancing Large Language Models for Secure Code Review through Secure-aware Fine-tuning

Fang Liu, Simiao Liu, Yinghao Zhu, Xiaoli Lian, Li Zhang

机构 * 1 State Key Laboratory of Complex \& Critical Software Environment, School of Computer Science Engineering, Beihang University, China

专题命中 指令微调 :large language model(title);language model(title);LLM(abstract);分类 cs.CL、cs.AI

Comments Accepted by ICSE 2026. Code and data: https://github.com/SIMIAO515/SecureReviewer

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06748 2025-09-01 cs.LG cs.CL 87%

Refusal Tokens: A Simple Way to Calibrate Refusals in Large Language Models

Neel Jain, Aditya Shrivastava, Chenyang Zhu, Daben Liu, Alfy Samuel, Ashwinee Panda, Anoop Kumar, Micah Goldblum, Tom Goldstein

机构 * University of Maryland(马里兰大学) Capital One(Capital One公司) Columbia University(哥伦比亚大学)

专题命中 指令微调 :language model(title,abstract);large language model(title);分类 cs.CL、cs.LG

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏