How Are LLMs Mitigating Stereotyping Harms? Learning from Search Engine Studies
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
Comments Accepted at AAAI/ACM AI, Ethics, and Society
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
Comments Accepted at AAAI/ACM AI, Ethics, and Society
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Journal ref Findings of the Association for Computational Linguistics: NAACL 2024
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments Submitted for review, data visualization tool available at: www.crosscare.net
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CY
Comments 18 pages, 2 figures
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.LG
Journal ref ICML 2024
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments under review. arXiv admin note: text overlap with arXiv:2402.01822
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 15 pages, 7 figures
Journal ref International Journal of Innovative Science and Research Technology: Vol. 9 (2024): No. 5, 994-1008
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 18 pages, 1 graphical abstract, 1 figure, 72 references
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI
Comments 5 pages, multimodal ethical dataset building, accepted in the NeurIPS 2023 MP2 workshop
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CY
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
Comments 14 pages, 9 figures
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY
Comments This is an English version of the original article arXiv:2405.00225v1 [cs.CY] (Hacia una implementación ética e inclusiva de la Inteligencia Artificial en las organizaciones: un marco multidimensional)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CY
Comments in Spanish language
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments to be published in 32nd IEEE International Requirements Engineering 2024 Conference (RE'24) - Doctoral Symposium. arXiv admin note: text overlap with arXiv:2404.14356
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 109 pages, 5 figures, submitted to Automation in Construction
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI
Comments 17 pages, 9 figures
专题命中 AI治理与伦理 :safety(abstract);分类 cs.LG
Comments Changed hyper-parameter choice which affects some of the convergence rate results in the paper
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CY
Comments Privacy Law Scholars Conference 2023; Common Market Law Review (forthcoming)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments The first two authors contribute equally
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.LG
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CY
Comments Figures can be accessed at: https://github.com/lheim/CPGAI-Figures
专题命中 AI治理与伦理 :safety(abstract);分类 cs.LG
Comments AI for Science Workshop, NeurIPS 2023. 11 pages, 5 figures, 4 tables
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI
Comments preprint
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL
Comments Camera-ready for EACL 2024