arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

AI 大模型

大模型对齐与安全

大模型对齐、安全、越狱、红队、提示注入和可信评测。

2026-04-09 至 2026-04-09 共收录 12 信号源:cs.CL, cs.AI, cs.CY, cs.LG

1. 其他安全 12 篇

2604.07116 2026-04-09 cs.CL 79%

Yale-DM-Lab at ArchEHR-QA 2026: Deterministic Grounding and Multi-Pass Evidence Alignment for EHR Question Answering

耶鲁-DM实验室参加ArchEHR-QA 2026:用于电子病历问答的确定性接地和多轮证据对齐

Elyas Irankhah, Samah Fodeh

机构 * Yale University(耶鲁大学)

专题命中 其他安全 :alignment(title,abstract);分类 cs.CL

AI总结 本文提出确定性接地和多轮证据对齐方法,用于电子病历问答任务,通过模型多样性与投票策略提升性能,实验结果显示对齐准确率受限于推理能力。

Comments 9 pages, 2 figures. System description for ArchEHR-QA 2026 shared task

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06571 2026-04-09 cs.CL cs.AI cs.IR cs.LG 67%

LLM-based Schema-Guided Extraction and Validation of Missing-Person Intelligence from Heterogeneous Data Sources

基于大型语言模型的异构数据源中缺失人员情报提取与验证方案

Joshua Castillo, Ravi Mukkamala

机构 * Old Dominion University(欧道明大学)

专题命中 其他安全 :safety(abstract);分类 cs.CL、cs.AI、cs.LG

AI总结 本文提出Guardian Parser Pack,通过AI驱动的解析与规范化流程,将多源调查文档统一为符合模式的表示,提升缺失人员情报的提取与验证效率,同时展示系统架构及性能评估结果。

Comments 9 pages, 6 figures. Accepted at International Conference on Intelligent Digitization of Systems and Services (IDSS 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06767 2026-04-09 cs.LG cs.CL 62%

Geometric Properties of the Voronoi Tessellation in Latent Semantic Manifolds of Large Language Models

大型语言模型潜在语义流形中Voronoi分割的几何特性

Marshall Brett

机构 * MARS Labs(MARS实验室)

专题命中 其他安全 :alignment(abstract);分类 cs.CL、cs.LG

AI总结 研究大型语言模型在潜在语义流形中的Voronoi分割,通过浮点32精度重新计算消除bfloat16量化伪影,验证表达性差距的线性缩放定律,并展示通过边距优化程序重塑Voronoi分割的可行性。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06523 2026-04-09 quant-ph cs.AI cs.LG 62%

Soft-Quantum Algorithms

软量子算法

Basil Kyriacou, Mo Kordzanganeh, Maniraman Periyasamy, Alexey Melnikov

机构 * Terra Quantum AG

专题命中 其他安全 :alignment(abstract);分类 cs.AI、cs.LG

AI总结 本文提出通过单个正则化项训练保持单位性的矩阵,再通过电路对齐恢复门基架构,从而提升量子机器学习效率。

Comments 6 pages, 6 figures, 0 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07067 2026-04-09 cs.CL 57%

Is Cross-Lingual Transfer in Bilingual Models Human-Like? A Study with Overlapping Word Forms in Dutch and English

双语模型中的跨语言迁移是否具有人类特性?一项以荷兰语和英语重叠词形研究

Iza Škrjanec, Irene Elisabeth Winther, Vera Demberg, Stefan L. Frank

机构 * Saarland University(萨尔大学) Zuse School ELIZA(Zuse ELIZA 学院) Radboud University(拉德堡德大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 研究探讨双语模型中跨语言激活是否模仿人类处理模式,发现词形共享影响模型表现,频率而非形式一致性主导效果,仅在特定条件下重现人类处理特征。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06912 2026-04-09 cs.CV cs.AI 57%

Q-Zoom: Query-Aware Adaptive Perception for Efficient Multimodal Large Language Models

Q-Zoom:基于查询的自适应感知以实现高效多模态大语言模型

Yuheng Shi, Xiaohuan Pei, Linfeng Wen, Minjing Dong, Chang Xu

机构 * University of Sydney(悉尼大学) Sun Yat-sen University(中山大学) City University of Hong Kong(香港城市大学)

专题命中 其他安全 :alignment(abstract);分类 cs.AI

AI总结 Q-Zoom通过高效粗到细的框架优化多模态大语言模型的高分辨率感知,提升推理速度并保持精度,实验表明其在文档识别和高分辨率场景中表现优异。

Comments 16 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06487 2026-04-09 cs.CL 57%

Closing the Speech-Text Gap with Limited Audio for Effective Domain Adaptation in LLM-Based ASR

通过有限音频缩小语音-文本差距以实现基于LLM的ASR的有效领域适应

Thibault Bañeras-Roux, Sergio Burdisso, Esaú Villatoro-Tello, Dairazalia Sánchez-Cortés, Shiran Liu, Severin Baroudi, Shashi Kumar, Hasindri Watawana, Manjunath K E, Kadri Hacioglu, Petr Motlicek, Andreas Stolcke

机构 * Idiap Research Institute(Idiap 研究所) Laboratoire d'Informatique et des Systèmes(信息系统实验室) Uniphore Brno University of Technology(布尔诺理工大学)

专题命中 其他安全 :alignment(abstract);分类 cs.CL

AI总结 本文研究了有限音频在基于LLM的ASR领域适应中的作用,比较了纯文本适应、配对语音-文本适应和混合批处理策略,发现少量语音能有效提升性能。

Comments Submitted to Interspeech

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04300 2026-04-09 cs.LG 57%

LUMINA: Foundation Models for Topology Transferable ACOPF

LUMINA:适用于拓扑可转移ACOPF的基座模型

Yijiang Li, Zeeshan Memon, Hongwei Jin, Stefano Fenu, Keunju Song, Sunash B Sharma, Parfait Gasana, Hongseok Kim, Liang Zhao, Kibaek Kim

机构 * Argonne National Laboratory(阿贡国家实验室) Emory University(埃默里大学) Sogang University(西江大学)

专题命中 其他安全 :safety(abstract);分类 cs.LG

AI总结 本文提出LUMINA框架,通过系统研究ACOPF问题,提炼出三个指导科学基座模型设计的原则,旨在解决受约束科学系统中的物理定律和安全限制挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06868 2026-04-09 eess.SY cs.SY 50%

Compressing Correct-by-Design Synthesis for Stochastic Homogeneous Multi-Agent Systems with Counting LTL

为随机同质多智能体系统压缩正确-by-设计合成

Xinyuan Qiu, Ruohan Wang, Siyuan Liu, Sofie Haesaert

专题命中 其他安全 :safety(abstract)

AI总结 本文研究了基于计数线性时序逻辑(cLTL)的随机同质多智能体系统,通过确定性有限自动机(DFA)实现满足概率的结构化张量分解,并提出双树值迭代框架以提升计算效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06694 2026-04-09 cs.SD 50%

AudioKV: KV Cache Eviction in Efficient Large Audio Language Models

AudioKV: 在高效大音频语言模型中实现KV缓存淘汰

Yuxuan Wang, Peize He, Xiyan Gui, Xiaoqian Liu, Junhao He, Xuyang Liu, Zichen Wen, Xuming Hu, Linfeng Zhang

机构 * EPIC Lab, Shanghai Jiao Tong University(上海交通大学EPIC实验室) Xidian University(西安电子科技大学) HKUST (GZ)(香港科技大学(广州))

专题命中 其他安全 :alignment(abstract)

AI总结 本文提出AudioKV框架,通过硬件友好的语义-音频对齐机制优先处理音频关键注意力头,结合Spectral Score Smoothing技术提升缓存效率,实验表明其在压缩比40%时保持高精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06506 2026-04-09 cs.CR cs.SE 50%

Guiding Symbolic Execution with Static Analysis and LLMs for Vulnerability Discovery

通过静态分析和LLMs引导符号执行以发现漏洞

Md Shafiuzzaman, Achintya Desai, Wenbo Guo, Tevfik Bultan

专题命中 其他安全 :safety(abstract)

AI总结 SAILOR结合静态分析与LLM合成自动构建符号执行Harness,通过三个阶段发现内存安全漏洞,实验表明其在大规模代码库中显著提升漏洞检测效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06494 2026-04-09 cs.CV cs.GR 50%

DesigNet: Learning to Draw Vector Graphics as Designers Do

DesigNet:学习如设计师所作的方式绘制矢量图形

Tomas Guija-Valiente, Iago Suárez

机构 * Machine Learning Circle(机器学习圈) Universidad Politécnica de Madrid, Departamento de Inteligencia Artificial(马德里理工大学人工智能系) Qualcomm XR Labs(高通XR实验室)

专题命中 其他安全 :alignment(abstract)

AI总结 DesigNet通过引入连续性和对齐性自 refinement 模块,实现了对 SVG 序列的直接操作,提升了矢量图形的编辑性和专业设计流程的集成性。

详情

展开后加载摘要…

URL PDF HTML 收藏