Perceptions of Discriminatory Decisions of Artificial Intelligence: Unpacking the Role of Individual Characteristics
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
专题命中 AI治理与伦理 :prompt injection(abstract);分类 cs.CL、cs.CY
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
Comments 5 pages
Journal ref The 2024 Conference on Empirical Methods in Natural Language Processing
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
Comments EMNLP 2024, 20 pages
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY
Comments 21 pages, 3 Figures, 5 Tables
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.LG
Comments The Version of Record of this contribution is published in Springer LNCS 14912 and is available online at https://doi.org/10.1007/978-3-031-68323-7_33
Journal ref Lecture Notes in Computer Science, Vol. 14912 (2024), pp. 375-380. Springer
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
Comments submitted to IEEE Transactions on Technology & Society
Journal ref IEEE Transactions on Technology and Society, Vol. 4, No. 2, pp. 171-187, 2023
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY
Comments ICML 2024 camera-ready version (Spotlight paper). 9 pages, 2 tables
Journal ref Proceedings of ICML 2024, in PMLR 235:32711-32725. URL: https://proceedings.mlr.press/v235/longpre24b.html
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.LG
Comments arXiv admin note: substantial text overlap with arXiv:2404.15149
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
Comments KDD 2024 Tutorial&Survey; Tutorial Website: https://llm-ir-bias-fairness.github.io/
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
Comments 6 pages paper content, 17 pages of appendix
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.AI、cs.CY
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
Comments 18 pages, 2 figures, 1 table
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
专题命中 AI治理与伦理 :prompt injection(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.CY
Journal ref DISO 2, 49 (2023)
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :safety(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :trustworthy(abstract);分类 cs.CL、cs.AI
Comments 15 pages total (including appendix), NAACL 2024 Industry Track
专题命中 AI治理与伦理 :safety(abstract);分类 cs.AI、cs.LG
Comments submitted
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.AI、cs.CY
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
Journal ref Exploring the psychology of LLMs' moral and legal reasoning. Artificial Intelligence, Volume 224, 2024
专题命中 AI治理与伦理 :alignment(abstract);分类 cs.CL、cs.AI
Comments 22 pages, 13 figures. Project Website: https://uni-moe.github.io/. Working in progress