arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

语言大模型 / LLM

大语言模型、预训练、指令微调、后训练和语言模型应用。

2026-04-07 至 2026-04-07 共收录 396 信号源:cs.CL, cs.AI, cs.LG

1. 其他LLM 25 篇

2603.29496 2026-04-07 cs.AI cs.LG 62%

Metriplector: From Field Theory to Neural Architecture

Metriplector:从场论到神经架构

Dan Oprisa, Peter Toth

机构 * Spheroid Labs

专题命中 其他LLM :language model(abstract);分类 cs.AI、cs.LG

AI总结 Metriplector是一种基于场论的神经网络基本单元,通过耦合的度量三重动力学模拟物理系统,利用诺特定理推导出应力能张量作为输出,应用于图像识别、语言模型和机器人控制等领域。

Comments 37 pages, 15 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05387 2026-04-07 cs.CL 57%

The Generalization Ridge: Information Flow in Natural Language Generation

通用 ridge:自然语言生成中的信息流

Ruidi Chang, Chunyuan Deng, Hanjie Chen

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 研究揭示了 transformer 模型中信息流的非单调趋势,通过信息理论框架分析隐藏表示与目标输出间的互信息变化,发现中间层形成泛化 ridge,为理解模型泛化机制提供新视角。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19606 2026-04-07 cs.CL 57%

Languages in Whisper-Style Speech Encoders Align Both Phonetically and Semantically

语言在Whisper风格的语音编码器中同时对齐语音和语义

Ryan Soh-Eun Shim, Domenico De Cristofaro, Chengzhi Martin Hu, Alessandro Vietti, Barbara Plank

机构 * LMU Munich(慕尼黑大学) Munich Center for Machine Learning(慕尼黑机器学习中心) Free University of Bozen-Bolzano(博尔扎诺自由大学) Technical University of Munich(慕尼黑工业大学)

专题命中 其他LLM :language model(abstract);分类 cs.CL

AI总结 研究通过控制发音验证跨语言对齐源于语义而非语音相似性,发现语音翻译检索在无语音提示时仍表现优异,且在低资源语言上提升了自动语音识别性能。

Comments Submitted to Interspeech 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04918 2026-04-07 cs.HC 50%

Comparing Human Oversight Strategies for Computer-Use Agents

比较计算机使用代理的人类监督策略

Chaoran Chen, Zhiping Zhang, Zeya Chen, Eryue Xu, Yinuo Yang, Ibrahim Khalilov, Simret A Gebreegziabher, Yanfang Ye, Ziang Xiao, Yaxing Yao, Tianshi Li, Toby Jia-Jun Li

专题命中 其他LLM :LLM(abstract)

AI总结 研究通过混合方法比较四种监督策略,发现策略更影响用户暴露于问题行为而非纠正能力,计划策略降低代理问题行为发生率,但干预成功率不均一,信任差异明显。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03627 2026-04-07 cs.CR cs.SE 50%

A Faceted Classification of Authenticator-Centric Authentication Techniques

面向认证中心的认证技术的多维分类

Alex R. Mattukat, Vincent Schmandt, Timo Langstrof, Michael Zerbe, Horst Lichter

专题命中 其他LLM :LLM(abstract)

AI总结 本文提出面向认证中心的认证技术的多维分类方案,通过文献综述和语义聚类构建认证器和认证技术的目录,探讨未来研究方向。

Comments This is the accepted version of a paper that will appear in the proceedings of the 21st International Conference on Evaluation of Novel Approaches of Software Engineering (ENASE 2026). The final published version will be available from Science and Technology Publications (SCITEPRESS). 13 pages, 4 tables, 4 Figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.24708 2026-04-07 eess.AS 50%

SenSE: Semantic-Aware High-Fidelity Universal Speech Enhancement

SenSE:基于语义的高保真通用语音增强

Xingchen Li, Hanke Xie, Ziqian Wang, Zihan Zhang, Longshuai Xiao, Shuai Wang, Lei Xie

专题命中 其他LLM :language model(abstract)

AI总结 SenSE提出一种两阶段生成式通用语音增强框架,通过语言模型建模语义先验,引导流匹配过程生成语义忠实的语音,提升上下文保真度,并引入双路径掩码条件训练策略提升模型灵活性和适应性。

Comments Accepted by ICME 2026

详情

展开后加载摘要…

URL PDF HTML 收藏