Data Alignment for Zero-Shot Concept Generation in Dermatology AI
专题命中 安全评测 :alignment(title);trustworthy(abstract);分类 cs.CL、cs.LG
Comments Accepted as a workshop paper to ICLR 2024
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :alignment(title);trustworthy(abstract);分类 cs.CL、cs.LG
Comments Accepted as a workshop paper to ICLR 2024
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments 13 pages
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.AI
Comments 16 pages, 5 figures
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI、cs.CY
Comments in French language
专题命中 安全评测 :alignment(title,abstract);分类 cs.AI、cs.LG
Comments 7 pages, plus references and appendix
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.CY
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI、cs.CY
Journal ref 28th International Conference on Evaluation and Assessment in Software Engineering (EASE 2024), June 18-21, 2024, Salerno, Italy
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.CY
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.LG
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI、cs.LG
Comments Accepted at the 41st International Conference on Machine Learning (ICML) 2024
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments 10 pages excluding bibliography
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
Comments ICLR 2024 Spotlight
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.CL、cs.AI
Comments We open-source all our code at: https://github.com/WisdomShell/FreeEval
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.CL、cs.AI
Comments 23 pages, 17 figures, 2024 Annual Conference of the North American Chapter of the Association for Computational Linguistics
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.AI
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI、cs.LG
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments submitted to journal: accident analysis and prevention
专题命中 安全评测 :alignment(title,abstract);分类 cs.AI、cs.LG
Comments 17 pages, 4 figures
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI、cs.LG
Comments Manuscript accepted to ACM Computing Surveys
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.LG
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.LG
专题命中 安全评测 :trustworthy(title,abstract);分类 cs.AI、cs.LG
Comments Published in IEEE TPAMI. Minor revision compared to the previous version
专题命中 安全评测 :safety(title,abstract);分类 cs.CL、cs.LG
Comments H.T., C.C., and Z.W. contribute equally. Work done during H.T. and Z.W.'s internship at UCSC, and C.C. and Y.Z.'s internship at UNC
专题命中 安全评测 :prompt injection(title,abstract);分类 cs.CL、cs.AI
Comments The data and code can be found at https://github.com/Leezekun/instruction-following-robustness-eval
专题命中 安全评测 :alignment(title,abstract);分类 cs.CL、cs.CY
Comments Socially Responsible Language Modelling Research (SoLaR) @ NeurIPs 2023
专题命中 安全评测 :safety(title,abstract);分类 cs.AI、cs.LG
Comments 9 pages, 4 figures, 2 tables