arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Johns Hopkins University(约翰斯·霍普金斯大学)

2026-07-23 至 2026-07-23 共收录 3
2607.20410 2026-07-23 cs.CL 新提交

LKValues: Aligning Large Language Models with Sri Lankan Societal Values

LKValues:使大语言模型与斯里兰卡社会价值观保持一致

Nethmi Muthugala, Supryadi, Surangika Ranathunga, Nisansa de Silva, Ruijie Tao, Ovindu Gunatunga, Pengyun Zhu, Shaowei Zhang, Jingting Zheng, Deyi Xiong

机构 * TJUNLP Lab, School of Computer Science and Technology, Tianjin University(天津大学计算机科学与技术学院TJUNLP实验室) School of Mathematical and Computational Sciences, Massey University(梅西大学数学与计算科学学院) Department of Computer Science & Engineering, University of Moratuwa(莫拉图瓦大学计算机科学与工程系) Johns Hopkins University(约翰霍普金斯大学) School of Computing, University of Colombo(科伦坡大学计算机学院)

AI总结 研究针对大语言模型价值对齐存在西方文化偏见问题,以斯里兰卡为例,提出LKValues资源套件,通过调查得出社会价值观,构建语料库和评估基准,经实验发现其能改善模型表现,为低资源国家价值对齐提供可复制流程。

Comments 37 pages, 10 figures, and 15 tables. Includes appendices. Datasets are available at the project repository

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.21302 2026-07-23 cs.CR cs.AI cs.SE

Locus: Agentic Predicate Synthesis for Directed Fuzzing

Locus:面向定向模糊测试的代理谓词合成

Jie Zhu, Chihao Shen, Ziyang Li, Jiahao Yu, Yizheng Chen, Kexin Pei

机构 * University of Chicago(芝加哥大学) University of Maryland(马里兰大学) Johns Hopkins University(约翰霍普金斯大学) Northwestern University(西北大学)

AI总结 Locus通过合成语义谓词提升定向模糊测试效率,发现多个未修补漏洞。

Journal ref ICSE '26: 2026 IEEE/ACM 48th International Conference on Software Engineering

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05865 2026-07-23 cs.CV cs.AI cs.CR 版本更新

CGCE: Classifier-Guided Concept Erasure in Generative Models

CGCE:生成模型中的分类器引导概念擦除

Viet Nguyen, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学)

AI总结 研究针对生成模型不安全内容生成的问题,提出分类器引导概念擦除(CGCE)框架。该框架用轻量级分类器检测并细化不良概念提示,仅在推理时修改不安全嵌入,能防止有害内容生成,在安全性和性能间取得平衡,实验验证其有效性。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏