arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-06 至 2026-04-06 共收录 10 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 10 篇

2409.18512 2026-04-06 cs.SD cs.AI cs.CL eess.AS 86%

Expressive Prompting: Improving Emotion Intensity and Speaker Consistency in Zero-Shot TTS

表达性提示:改进零样本语音合成中的情感强度和说话人一致性

Haoyu Wang, Chunyu Qiang, Tianrui Wang, Cheng Gong, Yu Jiang, Yuheng Lu, Chen Zhang, Longbiao Wang, Jianwu Dang

机构 * Tianjin Key Laboratory of Cognitive Computing and Application, College of Intelligence and Computing, Tianjin University(天津大学智能与计算学部认知计算与应用天津市重点实验室) Kuaishou Technology Co., Ltd(快手科技有限公司) Institute of Artificial Intelligence, China Telecom(中国电信人工智能研究院) Shenzhen Institute of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究院) Huiyan Technology (Tianjin) Co., Ltd(慧眼科技(天津)有限公司)

专题命中 其他LLM :prompting(title);LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文提出一种两阶段提示选择策略,通过评估提示的音调特征、感知音频质量和文本情感一致性,提升零样本语音合成的情感表达和说话人一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03081 2026-04-06 cs.CR cs.AI cs.CL 81%

Supply-Chain Poisoning Attacks Against LLM Coding Agent Skill Ecosystems

针对LLM编码代理技能生态系统的供应链污染攻击

Yubin Qu, Yi Liu, Tongcheng Geng, Gelei Deng, Yuekang Li, Leo Yu Zhang, Ying Zhang, Lei Ma

机构 * Griffith University(格里菲斯大学) The State Information Center(国家信息中心) Nanyang Technological University(南洋理工大学) University of New South Wales(新南威尔士大学) Wake Forest University(维克森林大学)

专题命中 其他LLM :LLM(title,abstract);分类 cs.CL、cs.AI

AI总结 本文研究了LLM编码代理技能生态系统中供应链攻击对行动空间的影响,提出DDIPE方法通过嵌入恶意逻辑到技能文档中实现隐式payload执行,实验显示其在强防御下可绕过11.6%-33.5%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2302.08150 2026-04-06 cs.CL cs.AI 81%

Reanalyzing L2 Preposition Learning with Bayesian Mixed Effects and a Pretrained Language Model

用贝叶斯混合效应模型和预训练语言模型重新分析L2介词学习

Jakob Prange, Man Ho Ivy Wong

机构 * Hong Kong Polytechnic University(香港理工大学) Hong Kong Shue Yan University(香港树仁大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 本文利用贝叶斯和神经模型分析中文学习者在两项测试中的介词理解表现,发现学生能力、任务类型和刺激句子间存在关键交互作用。

Comments To appear at ACL 2023, Toronto

详情

展开后加载摘要…

URL PDF HTML 收藏
2112.07874 2026-04-06 cs.CL cs.AI 81%

Linguistic Frameworks Go Toe-to-Toe at Neuro-Symbolic Language Modeling

语言框架在神经符号语言建模中展开对决

Jakob Prange, Nathan Schneider, Lingpeng Kong

机构 * Georgetown University(乔治城大学) The University of Hong Kong(香港大学)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL、cs.AI

AI总结 研究探讨了语言图表示如何提升神经语言模型性能,发现语义短语结构最有效,且词性类别影响效果差异。

Comments Accepted to NAACL 2022 (slight typesetting divergences to NAACL camera-ready due to TexLive 2020/2021 mismatches)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02560 2026-04-06 cs.CL 79%

Dependency-Guided Parallel Decoding in Discrete Diffusion Language Models

基于依赖性的并行解码在离散扩散语言模型中

Liran Ringel, Ameen Ali, Yaniv Romano

机构 * Department of Computer Science, Technion – Israel Institute of Technology(以色列理工学院计算机科学系) Blavatnik School of Computer Science and AI, Tel Aviv, Israel(特拉维夫布拉瓦特尼克计算机科学与人工智能学院) Department of Electrical and Computer Engineering, Technion – Israel Institute of Technology(以色列理工学院电气与计算机工程系)

专题命中 其他LLM :language model(title,abstract);分类 cs.CL

AI总结 本文提出DEMASK方法,通过预测掩码位置间的依赖关系,实现并行解码以提升生成效率,同时保持或提升输出质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02788 2026-04-06 cs.LG 77%

Structure-Aware Commitment Reduction for Network-Constrained Unit Commitment with Solver-Preserving Guarantees

具有结构意识的承诺减少用于网络受限的机组调度与求解器保持保证

Guangwen Wang, Jiaqi Wu, Yang Weng, Baosen Zhang

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract);分类 cs.LG

AI总结 本文提出一种求解器兼容的维度缩减框架,通过利用机组调度决策中的结构规律,减少分支限界树的搜索负担,保持可行性并确保最优解。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.18985 2026-04-06 cs.SI 75%

Simulating Online Social Media Conversations on Controversial Topics Using AI Agents Calibrated on Real-World Data

利用真实数据校准的AI代理模拟争议性话题的在线社交媒体对话

Elisa Composta, Nicolo' Fontana, Francesco Corso, Francesco Pierri

专题命中 其他LLM :LLM(abstract);large language model(abstract);language model(abstract)

AI总结 本文研究了基于LLM的代理在模拟微博客社交网络中的行为,探讨了其在不同场景下生成内容、互动及意见演变的机制,发现其生成内容在语气和毒性方面不如真实数据多样,需更精细的认知建模以模拟人类行为。

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.00127 2026-04-06 cs.CL cs.CY cs.HC 74%

Prompting ChatGPT for Translation: A Comparative Analysis of Translation Brief and Persona Prompts

通过提示词引导ChatGPT进行翻译:翻译简报与角色提示的比较分析

Sui He

专题命中 其他LLM :prompting(title);分类 cs.CL

AI总结 本文比较了翻译简报与角色提示在ChatGPT翻译任务中的效果,发现某些元素虽有助于人与人之间的交流,但对提升翻译质量有限,需进一步探索如何将翻译理论工具应用于人机交互的新流程。

Journal ref https://aclanthology.org/2024.eamt-1.27/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17677 2026-04-06 cs.CL cs.AI cs.LG 67%

Adaptive Guidance for Retrieval-Augmented Masked Diffusion Models

适应性引导的检索增强掩码扩散模型

Jaemin Kim, Jong Chul Ye

机构 * KAIST(韩国科学技术院)

专题命中 其他LLM :language model(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出ARAM框架,通过动态校准引导尺度提升检索增强扩散模型在知识密集型问答中的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02877 2026-04-06 cs.CV 50%

Unlocking Positive Transfer in Incrementally Learning Surgical Instruments: A Self-reflection Hierarchical Prompt Framework

解锁增量学习手术仪器中的正向迁移:一种自反思分层提示框架

Yu Zhu, Kang Li, Zheng Li, Pheng-Ann Heng

机构 * The Chinese University of Hong Kong(香港中文大学) University of Electronic Science and Technology of China(电子科技大学)

专题命中 其他LLM :foundation model(abstract)

AI总结 本文提出自反思分层提示框架,通过正向和反向知识迁移提升手术仪器增量分割性能,改进现有技能并避免灾难性遗忘。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏