PsychoSafe: Eliciting Psychologically-Informed Refusals in Large Language Models
PsychoSafe:在大语言模型中引发基于心理学的拒绝
Gianluca Barmina, Federico Torrielli, Sven Harms, Jacob Nielsen, Felix Mächtle, Stine Lyngsø Beltoft, Peter Schneider-Kamp, Thomas Eisenbarth, Lukas Galke Poech, Anne Lauscher
机构
*
University of Southern Denmark(南丹麦大学)
;
University of Turin(都灵大学)
;
University of Hamburg(汉堡大学)
;
University of Lübeck(吕贝克大学)
专题命中
预训练与数据
:LLM(summary_cn,abstract);large language model(title,abstract);language model(title,abstract);prompting(abstract)
LLM-Guided Test-Time Discovery of Quantum-Chemical Approximation Algorithms
LLM引导的量子化学近似算法测试时发现
Masaya Hagai, Yuta Suzuki, Tomoya Murata, Shuhei Kurita, Masaki Adachi
机构
*
Lattice Lab, Toyota Motor Corporation(丰田汽车公司格子实验室)
;
Department of Chemistry, Graduate School of Science, Nagoya University(名古屋大学理学部化学科)
;
National Institute of Informatics(国家信息研究所)
CodePMP: Scalable Preference Model Pretraining for Large Language Model Reasoning
Huimu Yu, Xing Wu, Haotian Xu, Debing Zhang, Songlin Hu
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
;
Xiaohongshu Inc(小红书公司)
专题命中
预训练与数据
:large language model(title,abstract);language model(title,abstract);pretraining(title,abstract);RLHF(abstract)
Agent-Centric Projection of Prompting Techniques and Implications for Synthetic Training Data for Large Language Models
Dhruv Dhamani, Mary Lou Maher
专题命中
预训练与数据
:large language model(title,abstract);language model(title,abstract);prompting(title,abstract);LLM(abstract)
Comments8 pages, 5 figures. Accepted at ICAART 2025. Derived from an early draft at 2312.17601. arXiv admin note: substantial text overlap with arXiv:2312.17601
Common Corpus: The Largest Collection of Ethical Data for LLM Pre-Training
Common Corpus: 最大的伦理数据集用于LLM预训练
Pierre-Carl Langlais, Pavel Chizhov, Catherine Arnett, Carlos Rosas Hinostroza, Mattia Nee, Eliot Krzystof Jones, Irène Girard, David Mach, Anastasia Stasenko, Ivan P. Yamshchikov
机构
*
PleIAs
专题命中
预训练与数据
:LLM(title,title_cn);large language model(abstract);language model(abstract);small language model(abstract)