Persistent Personas? Role-Playing, Instruction Following, and Safety in Extended Interactions
持久的人格?角色扮演、指令遵循与在扩展互动中的安全性
Pedro Henrique Luz de Araujo, Michael A. Hedderich, Ali Modarressi, Hinrich Schuetze, Benjamin Roth
机构
*
University of Vienna, Faculty of Computer Science(维也纳大学计算机科学系)
;
Doctoral School Computer Science, University of Vienna(维也纳大学计算机科学博士学院)
;
Center for Information and Language Processing, LMU Munich(慕尼黑大学信息与语言处理中心)
;
Munich Center for Machine Learning(慕尼黑机器学习中心)
;
University of Vienna, Faculty of Philological and Cultural Studies(维也纳大学文学与文化研究系)
Trustworthy Data-driven Chronological Age Estimation from Panoramic Dental Images
可信的数据驱动全景牙科图像Chronological年龄估计
Ainhoa Vivel-Couso, Nicolás Vila-Blanco, María J. Carreira, Alberto Bugarín-Diz, Inmaculada Tomás, Jose M. Alonso-Moral
机构
*
Centro Singular de Investigación en Tecnoloxías Intelixentes (CiTIUS), Universidade de Santiago de Compostela(智能技术研究中心(CiTIUS)、圣地亚哥-德孔波斯特拉大学)
;
Department of Electronics and Computing, Universidade de Santiago de Compostela(电子与计算系、圣地亚哥-德孔波斯特拉大学)
;
Oral Sciences Research Group, Universidade de Santiago de Compostela(口腔科学研究组、圣地亚哥-德孔波斯特拉大学)
;
Instituto de Investigación Sanitaria de Santiago de Compostela (IDIS), Universidade de Santiago de Compostela(圣地亚哥-德孔波斯特拉卫生研究院(IDIS)、圣地亚哥-德孔波斯特拉大学)
CommentsThis paper is a preliminary version of an accepted article in Information Systems Frontiers, Springer, Special Issue "Explainability in Human-Centric AI". Please cite the final published version of the paper, not this preprint. The final published version can be found at https://link.springer.com/article/10.1007/s10796-025-10682-3
机构
*
East China University of Science and Technology(东华大学)
;
Shanghai Changning Mental Health Center, Affiliated Mental Health Center of East China Normal University(上海昌宁心理健康中心,华东师范大学附属心理健康中心)
Contextual StereoSet: Stress-Testing Bias Alignment Robustness in Large Language Models
上下文立体集:在大型语言模型中压力测试偏见对齐的鲁棒性
Abhinaba Basu, Pavan Chakraborty
机构
*
Indian Institute of Information Technology, Allahabad (IIITA)(印度信息与技术研究所(Allahabad))
;
National Institute of Electronics and Information Technology (NIELIT)(国家电子与信息技术研究所)
Trustworthy scientific inference with generative models
可信的生成模型科学推断
James Carzon, Luca Masserano, Joshua D. Ingram, Alex Shen, Antonio Carlos Herling Ribeiro Junior, Tommaso Dorigo, Michele Doro, Joshua S. Speagle, Rafael Izbicki, Ann B. Lee
Comments15 pages, 7 tables, 1 figure, 4 appendices. System paper describing automated age-rating for Russian screenplays using fine-tuned Phi-3-mini. Includes baseline comparisons, human evaluation, and production deployment. Code and model weights available at https://github.com/nikita-zmanovskiy/qwertyAI. Developed during Wink Hackathon, November 2025
机构
*
Department of Computer and Network Engineering, College of Information Technology, United Arab Emirates University(计算机与网络工程系,信息科技学院,阿联酋大学)
;
Khalifa University of Science and Technology(科技大学)
机构
*
Nanyang Technological University(南洋理工大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Huazhong University of Science and Technology(华中科技大学)
SAMUeL: Efficient Vocal-Conditioned Music Generation via Soft Alignment Attention and Latent Diffusion
SAMUeL:通过软对齐注意力和潜在扩散实现高效的语音条件音乐生成
Hei Shing Cheung, Boya Zhang, Jonathan H. Chan
机构
*
Division of Engineering Science University of Toronto(工程科学系 马尼托瓦大学)
;
Innovative Cognitive Computing Center King Mongkut's University of Technology Thonburi(创新认知计算中心 王后大学技术吞武里)
机构
*
Computer Science, Fudan University(复旦大学计算机科学系)
;
Institute of Modern Languages and Linguistics, Fudan University(复旦大学现代语言与语言学研究所)
;
Shanghai SII(上海SII)
RoboSafe: Safeguarding Embodied Agents via Executable Safety Logic
RoboSafe: 通过可执行的安全逻辑保障具身智能体
Le Wang, Zonghao Ying, Xiao Yang, Quanchen Zou, Zhenfei Yin, Tianlin Li, Jian Yang, Yaodong Yang, Aishan Liu, Xianglong Liu
机构
*
Beihang University(北航大学)
;
AI Security Lab(360AI安全实验室)
;
The University of Sydney(悉尼大学)
;
Nanyang Technological University(南洋理工大学)
;
Peking University(北京大学)
;
Beijing Academy of Artificial Intelligence(北京人工智能研究院)
A Real-World Evaluation of LLM Medication Safety Reviews in NHS Primary Care
对NHS初级医疗中基于LLM的药物安全审查系统的真实世界评估
Oliver Normand, Esther Borsi, Mitch Fruin, Lauren E Walker, Jamie Heagerty, Chris C. Holmes, Anthony J Avery, Iain E Buchan, Harry Coppock
机构
*
i.AI, Department for Science, Innovation, and Technology(i.AI,科学、创新与技术部门)
;
Centre for Experimental Therapeutics, University of Liverpool(实验治疗中心,利物浦大学)
;
Civic Health Innovation Labs, University of Liverpool(公民健康创新实验室,利物浦大学)
;
Downing Street(唐宁街10号)
;
Department of Statistics, University of Oxford(统计系,牛津大学)
;
Ellison Institute of Technology(埃利森技术研究所)
;
Centre for Academic Primary Care, University of Nottingham(学术初级护理中心,诺丁汉大学)
;
The UK AI Security Institute(英国人工智能安全研究所)
;
Department of Computing, Imperial College London(计算系,伦敦帝国学院)
Deliberation on Priors: Trustworthy Reasoning of Large Language Models on Knowledge Graphs
对先验的探讨:大型语言模型在知识图谱上的可信推理
Jie Ma, Ning Qu, Zhitao Gao, Rui Xing, Jun Liu, Hongbin Pei, Jiang Xie, Linyun Song, Pinghui Wang, Jing Tao, Zhou Su
机构
*
MOE KLINNS Lab, Xi’an Jiaotong University(MOE KLINNS实验室,西安交通大学)
;
School of Computer Science and Technology, Xi’an Jiaotong University(计算机科学与技术学院,西安交通大学)
;
Shaanxi Province Key Laboratory of Big Data Knowledge Engineering(陕西省大数据知识工程重点实验室)
;
School of Artificial Intelligence, Chongqing University of Post and Telecommunications(人工智能学院,重庆邮电大学)
;
School of Computer Science, Northwestern Polytechnical University(计算机学院,西北工业大学)
TrafficGamer: Reliable and Flexible Traffic Simulation for Safety-Critical Scenarios with Game-Theoretic Oracles
TrafficGamer: 用于安全关键场景的可靠且灵活的交通仿真方法,基于博弈论 oracle
Guanren Qiao, Guorui Quan, Jiawei Yu, Shujun Jia, Guiliang Liu
机构
*
School of Data Science, the Chinese University of Hong Kong, Shenzhen(数据科学学院,香港中文大学(深圳))
;
University of Manchester(曼彻斯特大学)
;
Shenyang MXNavi Co.,Ltd.(沈阳MXNavi有限公司)