A Survey on Trustworthiness in Foundation Models for Medical Image Analysis
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.CY、cs.LG
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全评测 :trustworthy(abstract);分类 cs.AI、cs.CY、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments EMNLP 2024 Findings. This version extends the training with recent LLMs, evaluation with new metrics, and NLU tasks
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.CY
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.CY
Comments 17 pages
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Paper was accepted at ACM KDD -2024 -- Undergraduate Consortium. Please find the link: https://kdd2024.kdd.org/undergraduate-consortium/
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.AI、cs.CY、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Survey paper
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.CY、cs.LG
Comments A preprint, 17 pages. 11 images
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ACL 2024;Benchmark at https://github.com/c-box/StructEval ;Leaderboard at https://huggingface.co/spaces/Bowieee/StructEval_leaderboard
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Paper published at Machine Learning for Healthcare 2024 (MLHC'24)
专题命中 安全评测 :alignment(abstract);trustworthy(abstract)
Comments preprint
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ACL 2024 Workshop Towards Knowledgeable Language Models
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Survey Article for the ACM SIGKDD International Conference on Knowledge Discovery and Data Mining (KDD 2024) Tutorial
Journal ref Proceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD 2024)
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Code available at https://github.com/pliang279/HEMM
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.CY
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments We open-source our data, model, and code at: https://github.com/linzhiqiu/t2v_metrics ; Project page: https://linzhiqiu.github.io/papers/vqascore
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.CY
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
Comments 22 pages
专题命中 安全评测 :trustworthy(abstract);分类 cs.CL、cs.AI、cs.LG
Comments Accepted by ACL 2024
专题命中 安全评测 :DPO(abstract);分类 cs.CL、cs.AI、cs.LG
Comments ACL 2024. Project website: https://zjunlp.github.io/project/SafeEdit Benchmark: https://huggingface.co/datasets/zjunlp/SafeEdit
专题命中 安全评测 :alignment(abstract);分类 cs.CL、cs.AI、cs.LG
专题命中 安全评测 :safety(abstract);分类 cs.CL、cs.AI、cs.LG