DoubtProbe: Black-Box Jailbreak Defense via Structural Verification and Semantic Auditing
DoubtProbe:通过结构验证与语义审计的黑盒越狱防御
Xuanyu Yin, Yilin Jiang, Jun Zhou, Kai Chen, Zhengfu Cao, Xiaolei Dong
机构
*
East China Normal University(东华大学)
;
The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.CL
Mixtures of Subspaces for Bandwidth Efficient Context Parallel Training
子空间混合:面向带宽高效上下文并行训练
Sameera Ramasinghe, Ajanthan Thalaiyasingam, Hadi Mohaghegh Dolatabadi, Gil Avraham, Violetta Shevchenko, Yan Zuo, Chamin Hewa Koneputugodage, Alexander Long
机构
*
East China University of Science and Technology(华东理工大学)
;
Tsinghua University(清华大学)
;
Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)
;
University of Science and Technology of China(中国科学技术大学)
专题命中
效率与部署
:large language model(abstract);language model(abstract);分类 cs.CL
Comments8 pages, 1 figure, 4 tables. Evaluated on a production 15-node compute fleet with 114 real task traces. Code available at https://aispark.airlive.com/joe-hackathon/
机构
*
Beijing Normal University(北京师范大学)
;
BNU-HKBU United International College(北师港浸大联合国际学院)
;
University of Macau(澳门大学)
;
Shenzhen Research Institute of Big Data(深圳市大数据研究院)
;
Guangdong Key Laboratory of Artificial Intelligence and Multi-Modal Data Processing(广东省人工智能与多模态数据处理重点实验室)
专题命中
效率与部署
:language model(abstract);small language model(abstract);分类 cs.AI
I'm Sorry Driver, I'm Afraid I Can't Do That: Appraising the Safety of LLMs within Automotive Contexts
抱歉,司机,恐怕我不能这么做:评估LLMs在汽车环境中的安全性
Shaun Feakins, Ibrahim Habli, Kim Littler, Robert Palin
机构
*
UKRI AI Centre for Doctoral Training in Safe Artificial Intelligence Systems (SAINTS)(英国研究理事会安全人工智能系统博士培训中心(SAINTS))
;
University of York(约克大学)
;
Jaguar Land Rover(捷克·陆罗恩)
机构
*
Department of Computer Science, Birla Institute of Technology(比拉理工学院计算机科学系)
;
School of Computer Engineering, Kalinga Institute of Industrial Technology(凯林加工业技术学院计算机工程系)
;
Birla AI Labs, Office of Ananya Birla, Aditya Birla Group(比拉人工智能实验室,阿尼娅·比拉办公室,阿迪塔亚比拉集团)
Teaching the Way, Not the Answer: Privileged Tutoring Distillation for Multimodal Policy Optimization
教方法而非答案:用于多模态策略优化的特权辅导蒸馏
Shizhe Xiang, Ke An, Wenlong Yu, Yue Liu, Jian Luan, Pei Fu, Qilong Wang
机构
*
Tianjin University(天津大学)
;
Beijing Institute of Technology(北京理工大学)
;
Singapore Management University(新加坡国立大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Xiaomi Inc(小米公司)