机构
*
Beijing Institute of Technology(北京理工大学)
;
State Key Laboratory of General Artificial Intelligence, BIGAI(国家一般人工智能重点实验室,BIGAI)
;
Deep Glint
;
Zhejiang University(浙江大学)
;
The University of Hong Kong(香港大学)
;
Shandong Agricultural University(山东农业大学)
Neuron-Aware Data Selection In Instruction Tuning For Large Language Models
面向神经元的数据选择用于大语言模型的指令微调
Xin Chen, Junchao Wu, Shu Yang, Runzhe Zhan, Zeyu Wu, Min Yang, Shujian Huang, Lidia S. Chao, Derek F. Wong
机构
*
NLP
;
CT Lab, Department of Computer and Information Science, University of Macau(计算机与信息科学系,澳门大学CT实验室)
;
Artificial Intelligence Research Institute, Shenzhen University of Advanced Technology(深圳先进技术大学人工智能研究院)
;
Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
;
Provable Responsible AI and Data Analytics Lab, KAUST(可证明责任AI与数据分析实验室,卡尔斯兰大学)
;
National Key Laboratory for Novel Software Technology, Nanjing University(新型软件技术国家重点实验室,南京大学)
专题命中
指令微调
:large language model(title,abstract);language model(title,abstract);instruction tuning(title,abstract);分类 cs.CL
Partially Recentralization Softmax Loss for Vision-Language Models Robustness
部分重校正softmax损失用于视觉-语言模型鲁棒性
Hao Wang, Jinzhe Jiang, Xin Zhang, Chen Li
专题命中
指令微调
:language model(title,abstract);large language model(abstract);分类 cs.CL、cs.AI
AI总结
本文提出部分重校正softmax损失,通过限制top K softmax输出提升预训练多模态模型的对抗鲁棒性,实验显示细调后模型对主流攻击更具鲁棒性。
CommentsThe study described in Section 4 was conducted without required institutional review board approval. The paper is withdrawn pending completion of the approval process
Accelerating Stroke MRI with Diffusion Probabilistic Models through Large-Scale Pre-training and Target-Specific Fine-Tuning
通过大规模预训练和目标特定微调加速中风MRI
Yamin Arefeen, Sidharth Kumar, Steven Warach, Hamidreza Saber, Jonathan Tamir
机构
*
Chandra Family Department of Electrical and Computer Engineering(查克拉家族电气与计算机工程系)
;
Department of Imaging Physics(成像物理系)
;
Dell Medical School Department of Neurology(德莱尔医学院神经学系)
;
Dell Medical School Department of Neurosurgery(德莱尔医学院神经外科系)
;
Dell Medical School Department of Diagnostic Medicine(德莱尔医学院诊断医学系)
;
Oden Institute for Computational Engineering and Sciences(奥登计算工程与科学研究院)
MovieTeller: Tool-augmented Movie Synopsis with ID Consistent Progressive Abstraction
MovieTeller: 借助工具的电影概要与ID一致的渐进抽象
Yizhi Li, Xiaohan Chen, Miao Jiang, Wentao Tang, Gaoang Wang
机构
*
Central Universities(中央高校)
;
National Natural Science Foundation of China(中国国家自然科学基金委员会)
;
Research Fund for International Scientists of National Natural Science Foundation of China(中国国家自然科学基金委员会国际科学家研究基金)
Towards unified brain-to-text decoding across speech production and perception
迈向跨语音生成与感知的统一脑-文本解码
Zhizhang Yuan, Yang Yang, Gaorui Zhang, Baowen Cheng, Zehan Wu, Yuhao Xu, Xiaoying Liu, Liang Chen, Ying Mao, Meng Li
机构
*
Computer Science and Technology(计算机科学与技术)
;
Zhejiang University(浙江大学)
;
Shanghai Institute of Microsystem and Information Technology(上海微系统与信息工程研究所)
;
Chinese Academy of Sciences(中国科学院)
;
Department of Neurosurgery(神经外科部门)
;
Huashan Hospital, Fudan University(复旦大学华山医院)
专题命中
后训练与偏好优化
:LLM(abstract);large language model(abstract);language model(abstract);post-training(abstract)
AI总结
本文提出一种统一的脑-句子解码框架,用于 Mandarin Chinese 的语音生成与感知,通过单字符数据训练实现句子级解码,并通过多模态神经动态比较提升解码性能。