arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-03-09 至 2026-03-09 共收录 219 信号源:cs.CL, cs.AI, cs.LG

1. 预训练与数据 13 篇

2506.14757 2026-03-09 astro-ph.CO astro-ph.IM hep-ph physics.data-an 90%

Large Language Models -- the Future of Fundamental Physics?

大语言模型——基础物理学的未来?

Caroline Heneka, Florian Nieser, Ayodele Ore, Tilman Plehn, Daniel Schiller

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);pretraining(abstract)

AI总结 本文探讨了大语言模型在基础物理学中的应用,展示了Qwen2.5 LLM结合连接网络在宇宙参数回归和光锥生成中的优越性能。

Comments 35 pages, 10 figures, 6 tables. v2: matched published version

Journal ref SciPost Phys. 20, 070 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.10735 2026-03-09 cs.AI cs.CL cs.CY cs.LG 90%

Transforming Agency. On the mode of existence of Large Language Models

代理的转变。大型语言模型的存在模式

Xabier E. Barandiaran, Lola S. Almendros

机构 * IAS-Research Centre for Life, Mind, and Society, Dept. Philosophy UPV/EHU, University of the Basque Country(生命、心灵与社会研究所,哲学系,巴斯克大学) Institute for Science and Technology Studies, University of Salamanca (Spain)(科学与技术研究所,萨拉曼卡大学)

专题命中 预训练与数据 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文探讨了大型语言模型作为代理的本体特征,指出其缺乏自主代理的必要条件,但能通过文本和计算躯体影响人类代理形式。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11089 2026-03-09 cs.CL cs.AI 88%

DataChef: Cooking Up Optimal Data Recipes for LLM Adaptation via Reinforcement Learning

DataChef: 通过强化学习为LLM适应生成最优数据配方

Yicheng Chen, Zerun Ma, Xinchen Xie, Yining Li, Kai Chen

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室)

专题命中 预训练与数据 :LLM(title,abstract);large language model(abstract);language model(abstract);post-training(abstract)

AI总结 DataChef通过强化学习自动生成最优数据配方,使LLM适应性能达到人类专家水平。

Comments 20 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06088 2026-03-09 cs.CL cs.AI 84%

Experiences Build Characters: The Linguistic Origins and Functional Impact of LLM Personality

经验塑造性格:大语言模型人格的语言起源与功能影响

Xi Wang, Mengdie Zhuang, Jiqun Liu

机构 * University of Sheffield(谢菲尔德大学) University of Oklahoma(俄克拉荷马大学)

专题命中 预训练与数据 :LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI

AI总结 本研究通过持续预训练和大五人格框架,揭示了大语言模型人格的形成机制,发现模型能力在特定性格类型中表现最佳,并揭示了训练数据语言特征对推理性能的影响。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06565 2026-03-09 cs.AI cs.LG 81%

Boosting deep Reinforcement Learning using pretraining with Logical Options

通过逻辑选项预训练提升深度强化学习

Zihan Ye, Phil Chau, Raban Emunds, Jannis Blüml, Cedric Derstroff, Quentin Delfosse, Oleg Arenz, Kristian Kersting

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

AI总结 通过逻辑选项预训练提升深度强化学习,实现目标导向行为与长周期决策能力的提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02406 2026-03-09 cs.LG cs.AI 81%

Rigidity-Aware Geometric Pretraining for Protein Design and Conformational Ensembles

面向刚性的几何预训练用于蛋白质设计与构象集合

Zhanghan Ni, Yanjing Li, Zeju Qiu, Bernhard Schölkopf, Hongyu Guo, Weiyang Liu, Shengchao Liu

机构 * University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) University of Washington(华盛顿大学) MPI for Intelligent Systems, Tübingen(智能系统马克斯·普朗克研究所,图宾根) National Research Council of Canada(加拿大国家研究理事会) University of Ottawa(渥太华大学) The Chinese University of Hong Kong(香港中文大学)

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

AI总结 RigidSSL通过刚性感知的几何预训练,提升蛋白质设计和构象集合的生成能力。

Comments The Fourteenth International Conference on Learning Representations; Code available at: https://github.com/ZhanghanNi/RigidSSL.git

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18300 2026-03-09 cs.CV cs.AI cs.LG cs.RO 81%

FALCON: Future-Aware Learning with Contextual Object-Centric Pretraining for UAV Action Recognition

FALCON:面向未来的学习与基于上下文的对象中心预训练用于无人机动作识别

Ruiqi Xian, Xiyang Wu, Tianrui Guan, Xijun Wang, Boqing Gong, Dinesh Manocha

专题命中 预训练与数据 :pretraining(title,abstract);分类 cs.AI、cs.LG

AI总结 FALCON通过结合对象感知的遮蔽自动编码和对象中心双时间线未来重建,提升无人机动作识别的准确率和推理速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.08818 2026-03-09 cs.LG cs.AI 79%

From Tokenizer Bias to Backbone Capability: A Controlled Study of LLMs for Time Series Forecasting

从分词偏差到骨干能力:对用于时间序列预测的LLM进行受控研究

Xinyu Zhang, Shanshan Feng, Xutao Li, Kenghong Lin, Fan Li, Pengfei Jia

机构 * Harbin Institute of Technology(哈尔滨工业大学) The Hong Kong Polytechnic University(香港理工大学) Wuhan University(武汉大学)

专题命中 预训练与数据 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 本文通过设计三个具有相同架构但不同预训练策略的模型,研究了LLM在时间序列预测中的性能,发现其表现有限,无法超越专门训练的模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06449 2026-03-09 cs.CV 67%

CaTok: Taming Mean Flows for One-Dimensional Causal Image Tokenization

CaTok:通过Mean流平滑均值流以实现一维因果图像标记化

Yitong Chen, Zuxuan Wu, Xipeng Qiu, Yu-Gang Jiang

机构 * Institute of Trustworthy Embodied AI, Fudan University(可信具身人工智能研究所,复旦大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Key Laboratory of Multimodal Embodied AI(上海多模态具身人工智能重点实验室)

专题命中 预训练与数据 :language model(abstract);foundation model(abstract)

AI总结 CaTok 通过 MeanFlow 解码器实现一维因果图像标记化,提升图像生成与重建性能。

Comments Project website is available in https://sharelab-sii.github.io/catok-web

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.07722 2026-03-09 cs.CL 57%

Critical Confabulation: Can LLMs Hallucinate for Social Good?

关键性虚构:大语言模型是否可以为社会公益而虚构?

Peiqi Sui, Eamon Duede, Hoyt Long, Richard Jean So

机构 * McGill University(麦吉尔大学) Purdue University(普渡大学) University of Chicago(芝加哥大学) Duke University(杜克大学)

专题命中 预训练与数据 :LLM(abstract);分类 cs.CL

AI总结 本研究提出关键性虚构,利用大语言模型的虚构能力填补历史档案中的遗漏,通过开放性叙述填空任务验证其在知识生产中的应用价值。

Comments ICLR2026 Camera Ready. 27 pages, 5 figures, 11 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13687 2026-03-09 cs.CV 50%

Towards Scalable Pre-training of Visual Tokenizers for Generation

面向生成任务的视觉分词器可扩展预训练

Jingfeng Yao, Yuda Song, Yucong Zhou, Xinggang Wang

机构 * Huazhong University of Science and Technology(华中科技大学) MiniMax

专题命中 预训练与数据 :pretraining(abstract)

AI总结 VTP通过联合优化图像-文本对比、自监督和重建损失,提升视觉分词器的生成性能和扩展性。

Comments Our pre-trained models are available at https://github.com/MiniMax-AI/VTP

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06327 2026-03-09 eess.AS 50%

Classification of Autistic and Non-Autistic Children's Speech: A Cross-Linguistic Study in Finnish, French, and Slovak

自闭症与非自闭症儿童语音分类:芬兰、法语和斯洛伐克语的跨语言研究

Sofoklis Kakouros, Ida-Lotta Myllylä

专题命中 预训练与数据 :language model(abstract)

AI总结 研究通过跨语言分析,探讨自闭症儿童语音特征在不同语言中的泛化能力,发现部分语音线索具有跨语言一致性,但需语言感知建模以提升分类性能。

Comments Accepted to Speech Prosody 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05757 2026-03-09 cs.RO 50%

EmboAlign: Aligning Video Generation with Compositional Constraints for Zero-Shot Manipulation

EmboAlign:通过组合约束对齐视频生成以实现零样本操控

Gehao Zhang, Zhenyang Ni, Payal Mohapatra, Han Liu, Ruohan Zhang, Qi Zhu

机构 * Northwestern University(西北大学) Stanford University(斯坦福大学)

专题命中 预训练与数据 :language model(abstract)

AI总结 EmboAlign通过视觉语言模型生成组合约束,对齐视频生成模型输出,提升零样本机器人操控的成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 指令微调 18 篇

2506.15751 2026-03-09 cs.AI cs.CL cs.LG 90%

Sysformer: Safeguarding Frozen Large Language Models with Adaptive System Prompts

Sysformer: 通过自适应系统提示保护冻结的大语言模型

Kartik Sharma, Yiqiao Jin, Vineeth Rakesh, Yingtong Dou, Menghai Pan, Mahashweta Das, Srijan Kumar

机构 * Georgia Institute of Technology(佐治亚理工学院) Visa Research(Visa研究)

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 Sysformer通过自适应系统提示提高大语言模型的安全性,显著提升对有害提示的拒绝率和对安全提示的合规性。

Comments ICLR 2026. Code available at https://github.com/Ksartik/sysformer

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20975 2026-03-09 cs.CR cs.AI 89%

REx86: A Local Large Language Model for Assisting in x86 Assembly Reverse Engineering

REx86:一种用于协助x86汇编逆向工程的本地大语言模型

Darrin Lea, James Ghawaly, Golden Richard, Aisha Ali-Gombe, Andrew Case

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);LLM(abstract);分类 cs.AI

AI总结 REx86是一种本地大语言模型,通过微调提升x86汇编逆向工程的效率,显著提高代码理解和解决率。

Comments Accepted in 2025 Annual Computer Security Applications Conference (ACSAC)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05776 2026-03-09 cs.CL cs.AI 88%

PVminerLLM: Structured Extraction of Patient Voice from Patient-Generated Text using Large Language Models

PVminerLLM: 从患者生成的文本中使用大语言模型进行结构化提取患者声音

Samah Fodeh, Linhai Ma, Ganesh Puthiaraju, Srivani Talakokkul, Afshan Khan, Ashley Hagaman, Sarah Lowe, Aimee Roundtree

专题命中 指令微调 :large language model(title,abstract);language model(title,abstract);分类 cs.CL、cs.AI

AI总结 PVminerLLM通过监督微调的大语言模型从患者生成的文本中提取结构化患者声音,实现高精度的F1分数,为健康公平性和护理协调提供新的分析工具。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22266 2026-03-09 cs.LG cs.AI 82%

LLMTM: Benchmarking and Optimizing LLMs for Temporal Motif Analysis in Dynamic Graphs

LLMTM:动态图中基于时间 motif 分析的 LLM 评估与优化

Bing Hao, Minglai Shao, Zengyi Wo, Yunlong Chu, Yuhang Liu, Ruijie Wang

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);prompting(abstract)

AI总结 本文提出 LLMTM 基准测试,评估 LLM 在动态图时间 motif 分析中的性能,并开发结构感知调度器以优化效率与精度的平衡。

Comments Accepted to AAAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.08723 2026-03-09 eess.AS eess.SP 82%

ParaS2S: Benchmarking and Aligning Spoken Language Models for Paralinguistic-aware Speech-to-Speech Interaction

ParaS2S:用于基于语篇语言模型的语音到语音交互的基准测试与对齐

Shu-wen Yang, Ming Tu, Andy T. Liu, Xinghua Qu, Hung-yi Lee, Lu Lu, Yuxuan Wang, Yonghui Wu

专题命中 指令微调 :language model(title);LLM(abstract);SFT(abstract)

AI总结 ParaS2S通过强化学习框架提升语音到语音交互中对语篇线索的处理能力,实现响应内容和风格的显著改进。

Comments To appear in ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06123 2026-03-09 cs.CL cs.LG 81%

Diffusion Language Models Are Natively Length-Aware

扩散语言模型天生具有长度感知能力

Vittorio Rossi, Giacomo Cirò, Davide Beltrame, Luca Gandolfi, Paul Röttger, Dirk Hovy

机构 * Department of Computing Sciences, Bocconi University, Milan, Italy(计算机科学系,博科尼大学,米兰,意大利)

专题命中 指令微调 :language model(title,abstract);分类 cs.CL、cs.LG

AI总结 本文提出通过动态裁剪上下文窗口减少扩散语言模型生成步骤,从而提升效率并减少计算消耗,在多个基准测试中实现显著的性能提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03294 2026-03-09 cs.CL cs.AI cs.LG 80%

Fine-Tuning and Evaluating Conversational AI for Agricultural Advisory

对话式农业建议的微调与评估

Sanyam Singh, Naga Ganesh, Vineet Singh, Lakshmi Pedapudi, Ritesh Kumar, SSP Jyothi, Archana Karanam, Waseem Pasha, Ekta Kumari, C. Yashoda, Mettu Vijaya Rekha Reddy, Shesha Phani Debbesa, Chandan Dash

机构 * Digital Green

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出了一种混合LLM架构,通过微调和拼接层提升农业建议的准确性与安全性,释放了farmerchat-prompts库以促进领域特定农业AI的发展。

Comments 22 pages, 5 figures, 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.17095 2026-03-09 cs.LG cs.AI 79%

FLoRG: Federated Fine-tuning with Low-rank Gram Matrices and Procrustes Alignment

FLoRG: 联邦微调与低秩格拉姆矩阵及普鲁斯特对齐

Chuiyang Meng, Ming Tang, Vincent W. S. Wong

机构 * The University of British Columbia(不列颠哥伦比亚大学) Southern University of Science and Technology(南方科技大学)

专题命中 指令微调 :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.AI、cs.LG

AI总结 FLoRG通过使用单一低秩矩阵和普鲁斯特对齐方法,提高联邦微调的效率和准确性,减少通信开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.14273 2026-03-09 eess.AS cs.SD 78%

Efficient Emotion and Speaker Adaptation in LLM-Based TTS via Characteristic-Specific Partial Fine-Tuning

基于特征特定部分微调的LLM语音合成中高效情感与说话人适应

Tianrui Wang, Meng Ge, Cheng Gong, Chunyu Qiang, Haoyu Wang, Zikang Huang, Yu Jiang, Ye Ni, Yuheng Lu, Xiaobao Wang, Engsiong Chng, Xie Chen, Longbiao Wang, Jianwu Dang

机构 * Tianjin Key Laboratory of Cognitive Computing and Application(天津认知计算与应用重点实验室) College of Intelligence and Computing(智能与计算学院) Tianjin University(天津大学) TeleAI, China Telecom(TeleAI,中国电信) Southeast University(东南大学) Shanghai Jiao Tong University(上海交通大学) Huiyan Technology Co., Ltd(慧言科技有限公司) Nanyang Technological University(南洋理工大学) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(深圳先进技术研究所,中国科学院)

专题命中 指令微调 :LLM(title,abstract)

AI总结 本文提出CSP-FT方法,通过特征特定部分微调提升LLM语音合成在情感和说话人适应中的性能,实现参数更新效率与模型表现的平衡。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.02795 2026-03-09 cs.CV 75%

VSearcher: Long-Horizon Multimodal Search Agent via Reinforcement Learning

VSearcher:通过强化学习实现长周期多模态搜索代理

Ruiyang Zhang, Qianguo Sun, Chao Song, Yiyan Qi, Zhedong Zheng

机构 * University of Macau(澳门大学)

专题命中 指令微调 :large language model(abstract);language model(abstract);SFT(abstract)

AI总结 VSearcher通过强化学习实现多模态搜索代理,提升长周期多轮工具使用能力,在多模态网络搜索任务中表现优异。

Comments 23 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06403 2026-03-09 cs.LG 70%

Adapter-Augmented Bandits for Online Multi-Constrained Multi-Modal Inference Scheduling

适配器增强的带状机用于在线多约束多模态推断调度

Xianzhi Zhang, Yue Xu, Yinlin Zhu, Di Wu, Yipeng Zhou, Miao Hu, Guocong Quan

机构 * School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, 510006, China.(中山大学计算机科学与工程学院) School of Computing, Macquarie University, NSW 2109, Australia(麦考瑞大学计算机学院)

专题命中 指令微调 :large language model(abstract);language model(abstract);分类 cs.LG

AI总结 M-CMAB通过多适配器增强框架,实现多模态任务调度中的多约束优化,提升推断效率和预算利用效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06492 2026-03-09 cs.LG cs.AI cs.CL cs.NE 67%

NOBLE: Accelerating Transformers with Nonlinear Low-Rank Branches

NOBLE:通过非线性低秩分支加速Transformer

Ethan Smith

机构 * Canva Research(Canva研究)

专题命中 指令微调 :pretraining(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 NOBLE通过非线性低秩分支提升Transformer训练效率,实现显著的加速效果,同时保持较低的参数开销。

Comments 14 pages, 5 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05928 2026-03-09 cs.CL cs.AI cs.HC cs.LG 67%

Addressing the Ecological Fallacy in Larger LMs with Human Context

在更大规模的语言模型中通过人类上下文解决生态谬误

Nikita Soni, Dhruv Vijay Kunjadiya, Pratham Piyush Shah, Dikshya Mohanty, H. Andrew Schwartz, Niranjan Balasubramanian

机构 * Department of Computer Science, Stony Brook University(计算机科学系,石英布鲁克大学) College of Connected Computing, Vanderbilt University, USA(连接计算学院,范德比大学,美国)

专题命中 指令微调 :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 通过HuLM任务建模作者语言上下文,提升大模型在多个下游任务上的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23136 2026-03-09 cs.CL cs.AI cs.LG 67%

Modality Collapse as Mismatched Decoding: Information-Theoretic Limits of Multimodal LLMs

模态崩溃作为不匹配解码:多模态大语言模型的信息论限制

Jayadev Billa

机构 * Yahoo(雅虎) Nuance BBN

专题命中 指令微调 :LLM(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 研究揭示多模态大语言模型中模态崩溃现象的信息论限制,指出解码器评分规则决定了可访问信息量,通过LoRA干预验证了训练目标对情绪检测性能的提升作用。

Comments 24 pages, 11 tables, 2 figures. Code: https://github.com/jb1999/modality_collapse_paper, submitted for review COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.06542 2026-03-09 cs.SD cs.AI 57%

RAMoEA-QA: Hierarchical Specialization for Robust Respiratory Audio Question Answering

RAMoEA-QA:面向呼吸音频问答的分层专业化

Gaia A. Bertolino, Yuwei Zhang, Tong Xia, Domenico Talia, Cecilia Mascolo

机构 * University of Cambridge(剑桥大学) Tsinghua University(清华大学) University of Calabria(卡拉布里亚大学)

专题命中 指令微调 :LLM(abstract);分类 cs.AI

AI总结 RAMoEA-QA通过分层专业化机制,统一处理多种呼吸音频问答任务,提升在不同领域和任务转换下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05822 2026-03-09 cs.LG 57%

Self-Auditing Parameter-Efficient Fine-Tuning for Few-Shot 3D Medical Image Segmentation

自审计参数高效微调用于少样本3D医学图像分割

Son Thai Ly, Hien V. Nguyen

机构 * University of Houston(德克萨斯大学)

专题命中 指令微调 :foundation model(abstract);分类 cs.LG

AI总结 SEA-PEFT通过自审计参数高效微调方法,提升少样本3D医学图像分割的Dice指标,训练参数少于1%

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.05654 2026-03-09 astro-ph.SR physics.space-ph 50%

Active regions and the large-scale magnetic field of solar cycle 24

第24个太阳周期中的活跃区域和大尺度磁场

Ismo Tähtinen, Timo Asikainen, Kalevi Mursula

专题命中 指令微调 :SFT(abstract)

AI总结 研究第24个太阳周期中活跃区域的经度分布对大尺度磁场的影响,发现其对磁场强度的增强具有显著作用。

Comments 13 pages, 11 figures

Journal ref Astronomy and Astrophysics, 2026, 706, A235. Astronomy and Astrophysics, 2026, 706, A235. Astronomy and Astrophysics, 2026, 706, A235

详情

展开后加载摘要…

URL PDF HTML 收藏