AI Safety Landscape for Large Language Models: Taxonomy, State-of-the-art, and Future Directions
大语言模型的安全性景观:分类、现状与未来方向
机构 * College of Computing and Data Science(计算与数据科学学院)
专题命中 安全训练 :safety(title,abstract);AI safety(title,abstract);trustworthy(abstract);分类 cs.AI
AI总结 本文提出新型框架,从可信AI、负责任AI和安全AI三个视角审视AI安全,综述当前研究进展,通过大语言模型等实例展示创新方法,旨在推动AI安全研究并提升数字转型信任度。