MATS: An Audio Language Model under Text-only Supervision
MATS: 一种基于纯文本监督的音频语言模型
Wen Wang, Ruibing Hou, Hong Chang, Shiguang Shan, Xilin Chen
机构
*
Key Laboratory of Intelligent Information Processing of Chinese Academy of Sciences (CAS), Institute of Computing Technology, CAS, China(中国科学院智能信息处理重点实验室(中国科学院))
;
University of Chinese Academy of Sciences, China(中国科学院大学)
专题命中
预训练与数据
:language model(title,abstract);LLM(abstract);large language model(abstract)
MixtureVitae: Open Web-Scale Pretraining Dataset With High Quality Instruction and Reasoning Data Built from Permissive-First Text Sources
MixtureVitae:基于宽容优先策略构建的开放网络级预训练数据集,包含高质量指令和推理数据
Huu Nguyen, Victor May, Harsh Raj, Marianna Nezhurina, Yishan Wang, Yanqi Luo, Minh Chien Vu, Taishi Nakamura, Ken Tsui, Van Khue Nguyen, David Salinas, Aleksandra Krasnodębska, Christoph Schuhmann, Mats Leon Richter, Xuan-Son, Vu, Jenia Jitsev
Retrieval-augmented Prompt Learning for Pre-trained Foundation Models
基于检索的提示学习用于预训练基础模型
Xiang Chen, Yixin Ou, Quan Feng, Lei Li, Piji Li, Haibo Ye, Sheng-Jun Huang, Shuofei Qiao, Shumin Deng, Huajun Chen, Ningyu Zhang
机构
*
MIIT Key Laboratory of Pattern Analysis and Machine Intelligence, College of Computer Science and Technology, Nanjing University of Aeronautics and Astronautics(信息产业部模式分析与机器智能重点实验室,计算机科学与技术学院,南京航空航天大学)
;
Zhejiang University(浙江大学)
;
Hunan Vanguard Group Corporation Limited(湖南先锋集团有限公司)
;
National University of Singapore(新加坡国立大学)
LookAhead Tuning: Safer Language Models via Partial Answer Previews
LookAhead Tuning: 通过部分答案预览实现更安全的语言模型
Kangwei Liu, Mengru Wang, Yujie Luo, Lin Yuan, Mengshu Sun, Lei Liang, Zhiqiang Zhang, Jun Zhou, Bryan Hooi, Shumin Deng
机构
*
Zhejiang University(浙江大学)
;
Zhejiang University - Ant Group Joint Laboratory of Knowledge Graph(浙江大学-蚂蚁集团知识图谱联合实验室)
;
Ant Group(蚂蚁集团)
;
National University of Singapore(新加坡国立大学)
专题命中
预训练与数据
:language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG
Unlocking In-Context Learning for Natural Datasets Beyond Language Modelling
Jelena Bratulić, Sudhanshu Mittal, David T. Hoffmann, Samuel Böhm, Robin Tibor Schirrmeister, Tonio Ball, Christian Rupprecht, Thomas Brox
机构
*
Computer Vision Group, University of Freiburg(弗赖堡大学计算机视觉组)
;
Neuromedical A.I. Lab, Medical Center -- University of Freiburg(弗赖堡大学医学神经AI实验室)
;
Medical Physics, Medical Center -- University of Freiburg(弗赖堡大学医学物理)
;
Visual Geometry Group, University of Oxford(牛津大学视觉几何组)
专题命中
预训练与数据
:language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI、cs.LG
CommentsBest Paper Honorable Mention at GCPR 2025 (German Conference on Pattern Recognition). This is the updated version submitted to the conference, not the official conference proceedings
机构
*
Shanghai Jiao Tong University(上海交通大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Huawei Noah’s Ark Lab(华为诺亚实验室)
;
Huawei Technologies Co., Ltd(华为技术有限公司)
;
Tsinghua University(清华大学)
;
The Chinese University of Hong Kong(香港中文大学)
专题命中
预训练与数据
:LLM(title);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI、cs.LG
CommentsV2 polishes writing and adds Appendix G; V3 polishes writing and changes the title; V4 improves writing and adds Appendix H (more uniform attention results)