Journal refKarly V. Coffey, Gloria L. Krahn, John P. Hanley, Jacob E. Neely, Identifying implicit bias in LLM-based chat AI toward people with intellectual disabilities, Disability and Health Journal, 2026, 102086, ISSN 1936-6574
LP-SFT: Local-Preserving Supervised Fine-Tuning via Multimodal Entropy Structure
LP-SFT:通过多模态熵结构进行局部保持监督微调
Yueyang Wang, Baolong Bi, Shuo Lu, Jingyuan Zhang, Jiajun Shi
机构
*
School of Mathematical Sciences, Peking University(北京大学数学科学学院)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
College of Computing, Georgia Institute of Technology(佐治亚理工学院计算学院)
TRIDENT: Enhancing Large Language Model Safety with Tri-Dimensional Diversified Red-Teaming Data Synthesis
TRIDENT:通过三维多样化红队数据合成增强大语言模型安全性
Xiaorui Wu, Xiaofeng Mao, Fei Li, Xin Zhang, Xuanhong Li, Chong Teng, Donghong Ji, Zhuang Li
机构
*
Key Laboratory of Aerospace Information Security and Trusted Computing, Ministry of Education, School of Cyber Science and Engineering, Wuhan University(航空信息安全与可信计算重点实验室,教育部,网络安全工程学院,武汉大学)
;
Ant Group(蚂蚁集团)
;
Ant International(蚂蚁国际)
;
School of Computing Technologies, Royal Melbourne Institute of Technology(计算技术学院,皇家墨尔本理工学院)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);LLM(abstract,abstract_cn);SFT(abstract,abstract_cn)
SPAGBias: Uncovering and Tracing Structured Spatial Gender Bias in Large Language Models
SPAGBias:揭示和追踪大型语言模型中的结构化空间性别偏见
Binxian Su, Haoye Lou, Shucheng Zhu, Weikang Wang, Ying Liu, Dong Yu, Pengyuan Liu
机构
*
School of Information Science, Beijing Language and Culture University(北京语言大学信息科学学院)
;
Libraries, Renmin University of China(中国人民大学图书馆)
;
School of Humanities, Tsinghua University(清华大学人文学院)
;
Shanghai University of Finance and Economics(上海财经大学)
;
National Print Media Language Resources Monitoring & Research Center(国家印刷媒体语言资源监测与研究中心)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);LLM(summary_cn,abstract_cn);instruction tuning(abstract)
机构
*
Northwestern University(西北大学)
;
The University of Tokyo(东京大学)
;
RIKEN AIP(理化学研究所AIP)
;
Zhejiang University(浙江大学)
;
University of California, Davis(加州大学戴维斯分校)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);LLM(abstract);SFT(abstract)