VTutor: An Open-Source SDK for Generative AI-Powered Animated Pedagogical Agents with Multi-Media Output
专题命中 安全评测 :alignment(abstract);trustworthy(abstract);分类 cs.AI
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :alignment(abstract);trustworthy(abstract);分类 cs.AI
专题命中 安全评测 :safety(abstract);AI safety(abstract);分类 cs.LG
Comments 19 pages, 7 figures
Journal ref 38th Conference on Neural Information Processing Systems (NeurIPS 2024)
专题命中 安全评测 :safety(abstract);AI safety(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);jailbreak(abstract);分类 cs.CL
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.AI
专题命中 安全评测 :alignment(abstract);trustworthy(abstract);分类 cs.AI
Comments Accepted to PSS Workshop at AAAI25
专题命中 安全评测 :safety(abstract);AI safety(abstract);分类 cs.AI
Comments November 2024 v1.0
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.CL
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.CL
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.CL
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.LG
Comments 19 pages, 4 figures
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.CL
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.AI
Comments Technical report. Project page: https://metadriverse.github.io/metaurban/
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.LG
Comments 25 pages
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.CL
Comments This work is still under work and we welcome your contribution
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.AI
Comments The 23rd International Semantic Web Conference, November 11--15, 2024, Hanover, MD - Posters and Demos track
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.AI
Comments Accepted in Workshop on Evaluation and Trustworthiness of Generative AI Models, KDD 2024
专题命中 安全评测 :safety(abstract);AI safety(abstract);分类 cs.CY
Comments 10 pages
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.CY
Comments To appear in the proceedings of the 7th AAAI / ACM Conference on AI, Ethics, and Society (AIES), October 2024
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.CY
Comments 27 pages in total with 17 pages of main manuscript and 10 pages of supplementary materials; 4 figures in the main manuscript and 2 figures in supplementary material
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.CL
Comments arXiv admin note: text overlap with arXiv:2310.16263
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.AI
专题命中 安全评测 :safety(abstract);trustworthy(abstract);分类 cs.AI
Comments 43 pages, 5 figures
专题命中 安全评测 :alignment(abstract);trustworthy(abstract);分类 cs.CL
专题命中 安全评测 :safety(abstract);jailbreak(abstract);分类 cs.CL
Comments 9+6 pages, Submitted to ACL 2024
专题命中 安全评测 :safety(abstract);prompt injection(abstract);分类 cs.LG
专题命中 安全评测 :alignment(abstract);safety(abstract);分类 cs.LG
专题命中 安全评测 :safety(abstract);AI safety(abstract);分类 cs.CL
Comments 19 pages, 14 figures