Fine-Grained Human Feedback Gives Better Rewards for Language Model Training
专题命中 偏好对齐 :RLHF(abstract);分类 cs.CL
Comments NeurIPS 2023 camera-ready
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
专题命中 偏好对齐 :RLHF(abstract);分类 cs.CL
Comments NeurIPS 2023 camera-ready
专题命中 偏好对齐 :RLHF(abstract);分类 cs.CL
Comments Accepted to BabyLM workshop at CoNLL
专题命中 偏好对齐 :alignment(abstract);分类 cs.CL
Comments ACL 2023 Camera Ready, GitHub Repo: https://github.com/microsoft/DeFacto
专题命中 偏好对齐 :alignment(abstract);分类 cs.CL
Comments 22 pages,11 figures
专题命中 偏好对齐 :RLHF(abstract);分类 cs.AI
Comments 17 pages
专题命中 偏好对齐 :alignment(abstract);分类 cs.CL
专题命中 偏好对齐 :alignment(abstract);分类 cs.AI
Journal ref In Proceedings of 2023 IEEE International Conference on Robot & Human Interactive Communication (RO-MAN)
专题命中 偏好对齐 :RLHF(abstract);分类 cs.CL
Comments 21 pages, 4 figures, accepted by Meta-Radiology
Journal ref Meta-Radiology (2023)100017
专题命中 偏好对齐 :alignment(abstract);分类 cs.CL
专题命中 偏好对齐 :RLHF(abstract);分类 cs.CL
专题命中 偏好对齐 :alignment(abstract);分类 cs.CL
Comments work in progress
专题命中 偏好对齐 :RLHF(abstract);分类 cs.CL
专题命中 偏好对齐 :alignment(abstract);分类 cs.CL
专题命中 偏好对齐 :alignment(abstract);分类 cs.AI
Comments Accepted CogSci 2023
专题命中 偏好对齐 :safety(abstract);分类 cs.CL
Comments Version 1, April 11, 2023. 48 pages
专题命中 偏好对齐 :RLHF(abstract);分类 cs.CL
专题命中 偏好对齐 :safety(abstract);分类 cs.AI
专题命中 偏好对齐 :alignment(abstract);分类 cs.AI
专题命中 偏好对齐 :RLHF(abstract);分类 cs.LG
专题命中 偏好对齐 :alignment(abstract);分类 cs.LG
专题命中 偏好对齐 :alignment(abstract);分类 cs.CL
Comments First two authors contributed equally to this work
专题命中 偏好对齐 :trustworthy(abstract);分类 cs.CY
专题命中 偏好对齐 :safety(abstract);分类 cs.AI
Comments To be published in Proceedings of the 19th International Conference on Autonomous Agents and Multiagent Systems (AAMAS 2020). 9 pages
专题命中 偏好对齐 :safety(abstract);分类 cs.AI
Comments Accepted by the 3rd Conference on Robot Learning, Osaka, Japan (CoRL 2019)
专题命中 偏好对齐 :alignment(abstract);分类 cs.CL
专题命中 偏好对齐 :safety(abstract);分类 cs.LG
Comments Published in the proceedings of IEEE Intelligent Transportation Systems Conference 2018
专题命中 偏好对齐 :safety(abstract);分类 cs.AI
专题命中 偏好对齐 :分类 cs.CL、cs.AI、cs.LG;alignment(comments)
Comments AAAI 2025 AI Alignment Track
基于视觉语言模型的图像传输个性化数字语义通信
专题命中 偏好对齐 :alignment(abstract)
AI总结 针对现有语义通信方案忽略接收端依赖语义的问题,提出整合VLM与LDM的PDSC框架,构建容量受限的个性化语义率失真问题,实验证实其在带宽受限场景下的源语义一致性与个性化表现优于CDDM、MoS等基线。
Comments Accepted by IEEE GLOBECOM 2026
Sci-Surf:通过人类反馈与智能摘要实现科学文献发现
专题命中 偏好对齐 :alignment(abstract)
AI总结 针对现有学术发现平台支持不足的问题,提出以意图为中心的Sci-Surf系统,结合反馈驱动推荐与多模态论文消化,经评估推荐质量和消化质量有可测量提升。