Kandinsky 5.0: A Family of Foundation Models for Image and Video Generation
Kandinsky 5.0:图像与视频生成的基础模型系列
Vladimir Arkhipkin, Vladimir Korviakov, Nikolai Gerasimenko, Denis Parkhomenko, Viacheslav Vasilev, Alexey Letunovskiy, Nikolai Vaulin, Maria Kovaleva, Ivan Kirillov, Lev Novitskiy, Denis Koposov, Nikita Kiselev, Alexander Varlamov, Dmitrii Mikhailov, Vladimir Polovnikov, Andrey Shutkin, Julia Agafonova, Ilya Vasiliev, Anastasiia Kargapoltseva, Anna Dmitrienko, Anastasia Maltseva, Anna Averchenkova, Olga Kim, Tatiana Nikulina, Denis Dimitrov
APEX-Searcher: Refining Credit Assignment with Subgoaling for Agentic Retrieval-Augmented Generation
APEX-Searcher: 通过子目标细化信用分配以增强智能体检索增强生成
Kun Chen, Qingchao Kong, Zhao Feifei, Wenji Mao
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS部)
;
Wenge Technology Co., Ltd(Wenger科技有限公司)
专题命中
指令微调
:SFT(summary_cn,abstract);large language model(abstract);language model(abstract);分类 cs.CL、cs.AI
CommentsWe identified inaccuracies in the security analysis: the closed-form intrinsic-dimension lower bound on the feature-forgery attacker (Proposition 4.2, Section 4, Appendix V) and the cross-backend noise calibration for the joint z-score threshold (Section 5.1, Table 2). These affect the claimed attack-resistance guarantees. We are withdrawing the paper to correct them before resubmission
机构
*
University of Electronic Science and Technology of China(电子科技大学)
;
Xizang University(西藏大学)
;
ZenWeave AI
;
The State Key Laboratory of Tibetan Intelligence(藏语智能国家重点实验室)
;
Nanyang Technological University(南洋理工大学)
专题命中
指令微调
:LLM(abstract,abstract_cn);large language model(abstract);language model(abstract);instruction tuning(abstract)
FTibSuite: A Comprehensive Resource Suite for Tibetan Vision-Language Modeling
FTibSuite:面向藏语视觉语言建模的综合资源套件
Guixian Xu, Yide Liang, Zeli Su, Xuexian Song, Ziyin Zhang, Yushuang Dong, Ting Zhang, Xu Han
机构
*
Hainan International College, Minzu University of China(民族大学海南国际学院)
;
School of Information Engineering, Minzu University of China(民族大学信息工程学院)
;
Shanghai Jiao Tong University(上海交通大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
HydraPrompt: An Adaptive and Asymmetric Framework of Vision-Language Models for Synthetic Image Detection
HydraPrompt: 面向合成图像检测的视觉语言模型自适应非对称框架
Senyuan Shi, Hao Tan, Zichang Tan, Shuhan Feng, Ajian Liu, Sergio Escalera, Jun Wan
机构
*
Beijing University of Posts and Telecommunications(北京邮电大学)
;
School of Advanced Interdisciplinary Sciences (SAIS), University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院)
;
Shenzhen Institute of Advanced Technology (SIAT), Chinese Academy of Sciences(中国科学院深圳先进技术研究所)
;
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所MAIS)
;
University of Barcelona(巴塞罗那大学)
AirCast-SR: A Foundation Model for Kilometer-Scale Atmospheric Super-Resolution via Latent Consistency Diffusion
AirCast-SR: 基于潜在一致性扩散的千米级大气超分辨率基础模型
Somnath Luitel, Manmeet Singh, Joshua Durkee, Abdullah Al Fahad, Naveen Sudharsan, Prabhjot Singh, Cenlin He, Harsh Kamath, Zong-Liang Yang, Krishnagopal Halder, Sandeep Juneja, Parthasarathi Mukhopadhyay, Saptarishi Dhanuka, Amit Kumar Srivastava
机构
*
Department of Earth, Environmental, and Atmospheric Sciences, Western Kentucky University, Bowling Green, KY, USA(地球、环境与大气科学系,西部肯塔基大学)
;
NASA Goddard Space Flight Center, Greenbelt, MD, USA(NASA戈达德太空飞行中心)
;
The University of Texas at Austin, Austin, TX, USA(德克萨斯大学奥斯汀分校)
;
NSF National Center for Atmospheric Research, Boulder, CO, USA(国家大气科学研究中心)
;
Leibniz Centre for Agricultural Landscape Research (ZALF), Berlin, Germany(莱比锡农业景观研究中心(ZALF))
;
Ashoka University, Sonipat, India(阿什oka大学)
CroCo: Cross-Lingual Contrastive Preference Tuning on Self-Generations
CroCo: 基于自生成结果的跨语言对比偏好调优
Mike Zhang, Ali Basirat, Desmond Elliott
机构
*
Department of Computer Science (DIKU), University of Copenhagen(哥本哈根大学计算机科学系(DIKU))
;
Centre for Language Technology (CST), University of Copenhagen(哥本哈根大学语言技术中心)
;
Pioneer Centre for Artificial Intelligence(先锋人工智能中心)
专题命中
指令微调
:large language model(abstract);language model(abstract);preference optimization(abstract);分类 cs.CL、cs.AI
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Inner Mongolia University of Technology(内蒙古科技大学)
;
Tsinghua University(清华大学)
;
Shandong University(山东大学)
Seeing vs. Believing: Evaluating the Language Bias of Open-Source MLLMs in Counter-Intuitive Scenes
看见 vs. 相信:评估开源多模态大模型在反直觉场景中的语言偏见
Chen Ling, Tongwei Zhang, Hanqian Li, Nai Ding
机构
*
Zhejiang University(浙江大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))
专题命中
指令微调
:large language model(abstract);language model(abstract);prompting(abstract);分类 cs.AI