Improving Text-to-Image Generation with Input-Side Inference-Time Scaling
机构 * TikTok ; University of Maryland, College Park(马里兰大学)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.CL
AI 大模型
大模型对齐、安全、越狱、红队、提示注入和可信评测。
机构 * TikTok ; University of Maryland, College Park(马里兰大学)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.CL
机构 * University of California, Riverside(加州大学河滨分校) ; University of Virginia(弗吉尼亚大学)
专题命中 偏好对齐 :alignment(abstract);RLHF(abstract);分类 cs.CL
机构 * Imperial College London(伦敦帝国学院) ; Harvard University(哈佛大学)
专题命中 偏好对齐 :alignment(abstract);RLHF(abstract);分类 cs.CL
Comments Published as a conference paper at COLM 2025
机构 * UIUC Urbana(伊利诺伊大学 Urbana分校) ; Stanford University(斯坦福大学)
专题命中 偏好对齐 :RLHF(abstract);safety(abstract);分类 cs.LG
Comments Accepted at NeurIPS 2025 as an oral
机构 * School of Engineering, Westlake University, Hangzhou, China(西湖大学工程学院) ; School of Cyberspace Security, Nanjing University of Science and Technology, Nanjing, China(南京理工大学网络安全学院)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.AI
机构 * University of Potsdam(波恩大学) ; University of Trento(特伦特大学) ; Saarland University(萨尔大学) ; ETH Zurich(苏黎世联邦理工学院) ; Amsterdam UMC(阿姆斯特丹医疗中心) ; Free University of Bozen Bolzano(博兹纳自由大学) ; University of Amsterdam(阿姆斯特丹大学) ; Heriot-Watt University(赫里奥特-瓦特大学) ; DFKI(德意志联邦研究所) ; UCL(伦敦大学学院) ; University of Edinburgh(爱丁堡大学)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.CL
Comments Accepted at EMNLP 2025 (Main) Source code: https://github.com/lm-playpen/playpen Please send correspodence to: lm-playschool@googlegroups.com
专题命中 偏好对齐 :alignment(abstract);RLHF(abstract);分类 cs.CL
Comments EMNLP 2025
机构 * Luke Marks ; Amir Abdullah ; Clement Neo ; Rauno Arike ; David Krueger ; Philip Torr ; Fazl Barez
专题命中 偏好对齐 :RLHF(abstract);safety(abstract);分类 cs.LG
Comments 19 pages, 8 figures. Accepted to NeurIPS 2024
机构 * NC AI
专题命中 偏好对齐 :alignment(abstract);safety(abstract);分类 cs.CL
Comments 19 pages, 1 figure, 14 tables. Technical report for VARCO-VISION-2.0, a Korean-English bilingual VLM in 14B and 1.7B variants. Key features: multi-image understanding, OCR with text localization, improved Korean capabilities
机构 * University of Liverpool(利物浦大学) ; University of Exeter(埃克塞特大学) ; Purple Mountain Laboratories(紫金山实验室) ; University of Bristol(布里斯托大学)
专题命中 偏好对齐 :alignment(abstract);safety(abstract);分类 cs.AI
机构 * School of Computer Science and Engineering, Northeastern University(计算机科学与工程学院,东北大学) ; NiuTrans Research(NiuTrans研究院) ; CAS Key Laboratory of Behavioral Science, Institute of Psychology, CAS(行为科学重点实验室,心理学研究所)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.CL
Comments Accepted by EMNLP 2025 Findings
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.AI
专题命中 偏好对齐 :alignment(abstract);RLHF(abstract);分类 cs.CL
Comments Presented at ACL 2025 SRW
机构 * Tencent AI Lab(腾讯AI实验室)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.AI
机构 * School of Computer Engineering, Jimei University, Xiamen, 361021, China(厦门大学计算机工程学院) ; College of Science, Mathematics and Technology, Wenzhou-Kean University, Wenzhou, 325060, China(温州-凯恩大学科学、数学与技术学院) ; The Hong Kong University of Science and Technology (Guangzhou), Guangzhou, 511453, China(香港科学与技术大学(广州)) ; School of Professional Studies, New York University, New York, 10003, United States(纽约大学专业研究学院) ; School of Informatics, Xiamen University, Xiamen, 361102, China(厦门大学信息学院)
专题命中 偏好对齐 :RLHF(abstract);prompt injection(abstract);分类 cs.AI
机构 * CISPA Helmholtz Center for Information Security(CISPA海德堡信息安全研究中心)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.AI
Comments To Appear in the 34th USENIX Security Symposium, August 2025
机构 * University of Washington(华盛顿大学)
专题命中 偏好对齐 :alignment(abstract);RLHF(abstract);分类 cs.LG
Comments COLM 2025
机构 * Singapore University of Technology and Design(新加坡科技设计大学) ; National University of Singapore(国立新加坡大学) ; The University of Tokyo(东京大学) ; MiroMind(MiroMind公司) ; Institute for Infocomm Research, A*Star, Singapore(新加坡*星研究院信息与通信研究所)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.CL
Comments ACL25 Main
机构 * Univ. Grenoble Alpes(格勒诺布尔阿尔卑斯大学) ; CNRS(法国国家科学研究中心) ; Grenoble INP(格勒诺布尔研究所) ; GIPSA-lab(GIPSA实验室)
专题命中 偏好对齐 :alignment(abstract);trustworthy(abstract);分类 cs.CL
Journal ref Machine Learning with Applications, Volume 21, 2025, 100684, ISSN 2666-8270
机构 * Nanyang Technological University(南洋理工大学)
专题命中 偏好对齐 :RLHF(abstract);DPO(abstract);分类 cs.CL
Comments 36 Pages
机构 * The Chinese University of Hong Kong(香港中文大学) ; Amazon Web Services(亚马逊网络服务)
专题命中 偏好对齐 :RLHF(abstract);DPO(abstract);分类 cs.LG
Comments arXiv admin note: substantial text overlap with arXiv:2407.09072
机构 * University of Notre Dame(诺特大学) ; Amazon.com Inc(亚马逊公司)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.CL
Comments Accepted to ACL 2025 Main Conference
机构 * University of Wisconsin–Madison(威斯康星大学麦迪逊分校) ; Amazon(亚马逊) ; Georgia Institute of Technology(佐治亚理工学院)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.LG
Comments ACL 2025, Main Conference
机构 * Baidu Inc.(百度公司)
专题命中 偏好对齐 :alignment(abstract);RLHF(abstract);分类 cs.CL
Comments ACL 2025
专题命中 偏好对齐 :alignment(abstract);safety(abstract);分类 cs.CL
Comments Code in https://github.com/allenai/hybrid-preferences, MultiPref dataset in https://huggingface.co/datasets/allenai/multipref, Updated related work and acknowledgments
专题命中 偏好对齐 :RLHF(abstract);DPO(abstract);分类 cs.CL
Comments 7 pages
机构 * Department of Computer Science and Technology, Northeastern University, China(东北大学计算机科学与技术系) ; Department of Computer Science and Technology, Institute for AI, Tsinghua University, China(清华大学人工智能研究院计算机科学与技术系) ; Beijing National Research Center for Information Science and Technology, China(北京信息科学与技术国家研究中心)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.AI
Comments 16 pages, 10 tables, 5 figures
机构 * School of Artificial Intelligence, Jilin University(吉林大学人工智能学院) ; Engineering Research Center of Knowledge-Driven Human-Machine Intelligence, MOE, China(知识驱动人机智能工程研究中心,教育部,中国) ; International Center of Future Science, Jilin University(未来科学国际中心,吉林大学)
专题命中 偏好对齐 :RLHF(abstract);DPO(abstract);分类 cs.CL
Comments 18 pages, 3 figures, 6 tables
专题命中 偏好对齐 :RLHF(abstract);DPO(abstract);分类 cs.AI
Comments ACL 2025 Main. Code is released at https://github.com/fatemehpesaran310/lpoi
机构 * Northwestern Polytechnical University, School of Automation, Xi’an, China(西北工业大学自动化学院,西安,中国) ; Northwestern Polytechnical University, School of Cybersecurity, Xi’an, China(西北工业大学网络安全学院,西安,中国) ; Binjiang Institute of Artificial Intelligence, ZJUT, Hangzhou, China(浙大宁波理工学院滨海人工智能研究院,杭州,中国) ; Alibaba Group, Hangzhou, China(阿里巴巴集团,杭州,中国)
专题命中 偏好对齐 :alignment(abstract);DPO(abstract);分类 cs.CL
Comments Accepted by ACL 2025 findings