Computing Power and the Governance of Artificial Intelligence
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments Figures can be accessed at: https://github.com/lheim/CPGAI-Figures
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments Figures can be accessed at: https://github.com/lheim/CPGAI-Figures
专题命中 AI治理与伦理 :safety(abstract);分类 cs.LG
Comments AI for Science Workshop, NeurIPS 2023. 11 pages, 5 figures, 4 tables
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
Comments preprint
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments Camera-ready for EACL 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments EACL 2024 SRW
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
Comments IEEE ICCE 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG
Comments Accepted to Machine Learning and the Physical Sciences Workshop, NeurIPS 2023
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.LG
Comments 15 pages, 4 figures, 3 tables. To appear in Algorithmic Fairness through the Lens of Time Workshop at NeurIPS 2023
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CL
Comments 15 pages (incl Appendix), 4 figures, 8 tables
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
Comments Accepted to EMNLP Industry Track 2023
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG
Comments 31 pages, 20 figures
Journal ref NeurIPS 2023
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments Working Paper
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.LG
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 9 pages, 1 figure, 2 tables
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments Accepted to IEEE International Conference on Trust, Privacy and Security in Intelligent Systems, and Applications (TPS) 2023
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments 30 pages, accepted for publication in Jan Maarten Schraagen (Ed.) 'Responsible Use of AI in Military Systems', CRC Press [Forthcoming]
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CY
Comments 6 pages 2 figures
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
专题命中 AI治理与伦理 :safety(abstract);分类 cs.LG
Journal ref International Conference on Machine Learning 2023
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments Accepted for publication at xAI-2023 conference
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CY
Comments 9 pages, 3 figures, GIScience 2023 conference
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.LG
Comments ICML 2023
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 12 pages
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
专题命中 AI治理与伦理 :safety(abstract);分类 cs.LG
Comments Reincarnating Reinforcement Learning Workshop at ICLR 2023