What Teaches Robots to Walk, Teaches Them to Trade too -- Regime Adaptive Execution using Informed Data and LLMs
专题命中 安全训练 :alignment(abstract);分类 cs.AI、cs.LG
Comments arXiv admin note: substantial text overlap with arXiv:2405.09747
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 安全训练 :alignment(abstract);分类 cs.AI、cs.LG
Comments arXiv admin note: substantial text overlap with arXiv:2405.09747
专题命中 安全训练 :safety(abstract);分类 cs.CL、cs.AI
Comments IJCAI 2024 Survey Track
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.CY
Journal ref International Journal of Law, Ethics, and Technology 2024
专题命中 安全训练 :safety(abstract);分类 cs.CL、cs.AI
Comments Preprint, 10 pages main with 10 pages appendix
专题命中 安全训练 :alignment(abstract);分类 cs.CL、cs.CY
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Comments Accepted by Communications in Transportation Research
专题命中 安全训练 :trustworthy(abstract);分类 cs.CL、cs.AI
Comments 28 pages, 1 figure
专题命中 安全训练 :RLHF(abstract);分类 cs.AI、cs.LG
专题命中 安全训练 :jailbreak(abstract);分类 cs.CL、cs.LG
Comments 20 pages
专题命中 安全训练 :alignment(abstract);分类 cs.CL、cs.LG
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
专题命中 安全训练 :safety(abstract);分类 cs.CL、cs.AI
Comments 10 pages
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Comments Accepted at IJCAI-24 survey track
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Comments ACM e-Energy 2024
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Comments 7 pages, 5 figures
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Comments Accepted to 6th Annual Learning for Dynamics & Control Conference. arXiv admin note: text overlap with arXiv:2209.12336
专题命中 安全训练 :alignment(abstract);分类 cs.AI、cs.LG
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Comments Accecpted at ECAI 2023
专题命中 安全训练 :alignment(abstract);分类 cs.CL、cs.LG
Comments CVPR 2024. The feedback datasets are released at: https://huggingface.co/datasets/YangyiYY/LVLM_NLF
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Comments 8 pages, 5 figures
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Comments 4 pages, 2 figures. Appeared in 2023 International Conference on Artificial Neural Networks (ICANN) proceedings. Published version copyrighted by Springer. This work was funded by the Horizon Europe Twinning project TERAIS, G.A. number 101079338 and in part by the national project APVV-21-0105. Link to the code: https://zenodo.org/doi/10.5281/zenodo.10694747
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
专题命中 安全训练 :safety(abstract);分类 cs.CY、cs.LG
专题命中 安全训练 :trustworthy(abstract);分类 cs.AI、cs.CY
专题命中 安全训练 :safety(abstract);分类 cs.CL、cs.AI
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Journal ref Book of Abstracts, ICUR 2022
专题命中 安全训练 :safety(abstract);分类 cs.AI、cs.LG
Journal ref Thirty-seventh Conference on Neural Information Processing Systems. 2023
专题命中 安全训练 :safety(abstract);分类 cs.CL、cs.AI