Generative AI regulation can learn from social media regulation
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments Presented at 2nd Workshop on Regulatable ML at NeurIPS 2024
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments Presented at 2nd Workshop on Regulatable ML at NeurIPS 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI
Comments Accepted by AAAI2025
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Journal ref European Journal of Computer Science and Information Technology,12 (6),35-45, 2024 Print ISSN: 2054-0957 (Print)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 10 pages, 6 figures, ICDH 2024 invited paper
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments 7 pages, 1table, 1 figure
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments 14 pages. Published version
Journal ref Big Data & Society 11(1), 1-14 (2024)
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
Comments 12 pages, submitted to TKDE
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments 43 pages
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
Comments EMNLP Findings 2024
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
Comments Accepted by EMNLP Findings 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments 76 pages
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY
专题命中 AI治理与伦理 :DPO(abstract);分类 cs.CL
Comments 17 pages, 5 Figures
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
Journal ref ACM conference on Equity and Access in Algorithms, Mechanisms, and Optimization, 2024
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI
Comments Accepted at The First Workshop on AI Behavioral Science (AIBS 2024), held in conjunction with KDD 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI
Comments 42 pages
专题命中 AI治理与伦理 :RLHF(abstract);分类 cs.AI
Comments The first three authors contributed equally to this work
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments CVPR 2024 Highlight - Code: https://github.com/Picsart-AI-Research/OpenBias