Evaluating Semantic Fragility in Text-to-Audio Generation Systems Under Controlled Prompt Perturbations
在受控提示扰动下评估文本到音频生成系统中的语义脆弱性
专题命中 音频语音多模态 :multi-modal(abstract);分类 cs.AI
AI总结 本文评估文本到音频生成系统在受控提示扰动下的语义脆弱性,通过三种扰动方法测试不同模型的鲁棒性,发现大模型在语义一致性上表现更好,但音频和时间分析显示存在持续差异。
Comments 8 pages, 4 figures, Under ICCC'26 review