Messages, Not Tokens: Grounded Coresets for Faithful VLM Compression
消息而非令牌:用于忠实VLM压缩的基础核心集
Long Qian, Jiaqi Wei, Bingke Zhu, Yingying Chen, Jinqiao Wang
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Wuhan AI Research(武汉人工智能研究院)
;
Cardiff University(卡迪夫大学)
RING: Retrieval-Internalized Generation for Continual Large-Scale Knowledge Injection
RING:用于持续大规模知识注入的检索内化生成
Shicheng Xu, Liang Pang, Liyi Chen, Zihao Wei, Jingcheng Deng, Yan Gao, Yi Wu, Yao Hu, Huawei Shen, Xueqi Cheng
机构
*
State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Xiaohongshu Inc.(小红书科技有限公司)
机构
*
The City College of New York(纽约城市学院)
;
INSAIT
;
Sofia University “St. Kliment Ohridski”(圣克莱门特奥赫里德斯基索非亚大学)
;
Julius-Maximilians-Universität Würzburg(维尔茨堡大学)
;
State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Shenzhen University of Advanced Technology(深圳先进技术研究院)
Mitigating Backdoors via Decoy Shortcuts and Knowledge Decoupling
通过诱饵捷径与知识解耦缓解后门攻击
Zixuan Zhu, Rui Wang, Lihua Jing, Jinwen Zhong
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
Learning-Based Motion Planning for Dynamic Environments: From Foundational Algorithms to Emerging Paradigms
动态环境下基于学习的运动规划:从基础算法到新兴范式
Zongyuan Shen, Shalabh Gupta, Shancheng Zhao, Dehua Zhou, Gao Wang, Rui Cheng, Yaming Ou, Zhongqiang Ren, Yikui Zhai, C. L. Philip Chen
机构
*
College of Information Science and Technology, Jinan University(暨南大学信息科学技术学院)
;
University of Connecticut(康涅狄格大学)
;
Guangzhou Maritime University(广州海事大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Global College, Shanghai Jiao Tong University(上海交通大学全球学院)
;
Wuyi University(五邑大学)
;
South China University of Technology(华南理工大学)
IoU-PD: IoU-Aware Privileged Distillation for Visual Grounding with Multimodal Large Language Models
IoUPD:用于多模态大语言模型视觉定位的IoU感知特权蒸馏
Xiuyuan Zhu, Ke Lu, Hao Wu, Siwen Jiao, Zijin Du, Dongming Zhang, Jian Xue
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
State Key Laboratory of Communication Content Cognition(通信内容认知技术国家重点实验室)
;
Peng Cheng Laboratory(鹏城实验室)
LongCrafter: Towards Diverse Long-Context Understanding via Evidence-Graph-Guided Instruction Synthesis
LongCrafter:通过证据图引导的指令合成实现多样化的长上下文理解
Chenhao Yuan, Yinhao Xu, Shuwen Xu, Xizhi Yang, Jiaxiang Liu, Chenxi Zhou, Shaoping Huang, Haolin Ren, Pengfei Cao, Jun Zhao, Kang Liu
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所认知与决策智能复杂系统重点实验室)
机构
*
Shanghai Astronomical Observatory, Chinese Academy of Sciences, Shanghai 200030, China(上海天文台,中国科学院,上海200030,中国)
;
School of Astronomy and Space Sciences, University of Chinese Academy of Sciences, Beijing 101408, China(中国科学院大学天文与空间科学学院,北京101408,中国)
;
Science Talent Training Center, Gainesville, FL, 32606 USA(科学人才培训中心,佛罗里达州盖恩斯维尔,32606 USA)
A Hamiltonian-Inspired Local-Operator Ansatz for Slimming Large Language Models
一种用于高效大语言模型的通用张量结构压缩方案
Ying Lu, Peng-Fei Zhou, Qi-Xuan Fang, Pan Zhang, Shi-Ju Ran, Gang Su
机构
*
School of Physical Sciences, University of Chinese Academy of Sciences(中国科学院大学物理科学学院)
;
Kavli Institute for Theoretical Sciences, University of Chinese Academy of Sciences(中国科学院大学理论科学研究院)
;
Center for Quantum Physics and Intelligent Sciences, Department of Physics, Capital Normal University(首都师范大学量子物理与智能科学中心)
;
Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所)
机构
*
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
Ant Group(蚂蚁集团)
A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook
大型音频语言模型综述:通用性、可信度与展望
Kaiwen Luo, Zhenhong Zhou, Leyan Wang, Liang Lin, Tianyu Shao, Yuanhe Zhang, Yang Xiao, Yuxuan Li, Miao Yu, Kailin Lyu, Jiaming Zhang, Li Sun, Songze Li, Yueming Wu, Ting Dang, Xiaojun Jia, Dongrui Liu, Kai Li, Rohan Kumar Das, Siyuan Liang, Xinfeng Li, Qiankun Li, Jing Chen, Xingjun Ma, Kun Wang, Junhao Dong, Deqing Zou, Yu Cheng, Xia Hu, Zhigang Zeng, Sen Su, Yang Liu, Yu-Gang Jiang, Philip S. Yu, Yew-Soon Ong
机构
*
Nanyang Technological University(南洋理工大学)
;
Independent Researcher(独立研究者)
;
The University of Melbourne(墨尔本大学)
;
North China Electric Power University(华北电力大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Huazhong University of Science and Technology(华中科技大学)
;
Tsinghua University(清华大学)
;
Fortemedia Singapore(富媒体新加坡)
;
Tencent(腾讯)
;
Fudan University(复旦大学)
;
Wuhan University(武汉大学)
;
Chinese University of Hong Kong(香港中文大学)
;
Chongqing University of Posts and Telecommunications(重庆邮电大学)
;
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
Missing-by-Design: Certifiable Modality Deletion for Revocable Multimodal Sentiment Analysis
缺失-by-设计:可撤销多模态情感分析的可验证模态删除
Rong Fu, Ziming Wang, Chunlei Meng, Jiekai Wu, Kangan Qian, Hao Zhang, Simon Fong
机构
*
University of Macau(澳门大学)
;
Zhejiang University(浙江大学)
;
Fudan University(复旦大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Juntendo University(立命馆大学)
;
Tsinghua University(清华大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
Comments21 pages, 6 figures. In the previous version, Juntendo University was erroneously listed as the affiliation; we must clarify that this paper has absolutely no relation to Juntendo University. Therefore, we have replaced this affiliation in the new version
MMPhysVideo: Physically Plausible Video Generation Through Joint RGB-Perception Modeling
MMPhysVideo: 通过联合多模态建模提升视频生成的物理合理性
Shubo Lin, Xuanyang Zhang, Wei Cheng, Weiming Hu, Gang Yu, Jin Gao
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(中国科学院自动化研究所多模态人工智能系统国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
StepFun(阶跃星辰)
;
Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(多模态信息超级智能安全北京市重点实验室)
;
School of Information Science and Technology, Shanghai Tech University(上海科技大学信息科学与技术学院)
机构
*
Aerospace Information Research Institute, Chinese Academy of Sciences(中国科学院航天信息研究所)
;
Key Laboratory of Technology in Geo-Spatial Information Processing and Application System, Chinese Academy of Sciences(中国科学院地理空间信息处理与应用系统技术重点实验室)
;
School of Electronic, Electrical and Communication Engineering, University of Chinese Academy of Sciences(中国科学院大学电子、电气与通信工程学院)
机构
*
Fundation Model Research Center, CASIA(中国科学院自动化研究所基础模型研究中心)
;
School of Artificial Intelligence, UCAS(中国科学院大学人工智能学院)
;
Institute for AI Industry Research (AIR), Tsinghua University(清华大学人工智能产业研究院)
;
College of Automotive and Energy Engineering (CAEE), Tongji University(同济大学汽车与能源工程学院)
机构
*
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Weixin AI, Tencent Inc(腾讯微信人工智能)
机构
*
Research Center for Intelligent Computing Systems, Institute of Computing Technology, CAS(中国科学院计算技术研究所智能计算系统研究中心)
;
School of Computer Science and Technology, University of Chinese Academy of Sciences(中国科学院大学计算机科学与技术学院)
;
Dong Feng Off-Road Vehicle Co., Ltd(东风越野车有限公司)
机构
*
Department of computer science, National University of Singapore(新加坡国立大学计算机科学系)
;
School of Artificial Intelligence, Shandong University(山东大学人工智能学院)
;
Shanghai Advanced Research Institute, Chinese Academy of Science(中国科学院上海先进研究院)
;
University of Chinese Academy of Sciences, Beijing(中国科学院大学北京校区)
PerturbMap: Cross-Context Transfer of Single-Cell Perturbation Responses
PerturbMap:单细胞扰动响应的跨上下文迁移
Panpan Cui, Yiqi Liu, Wenhao Sun
机构
*
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉科学学院)
;
Institute of Computing Technology, CAS(中国科学院计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Hong Kong University of Science and Technology(香港科技大学)
Can LVLMs Uncover the Truth Behind Visual Illusions? An Analysis of Perceptual and Reasoning Capabilities
大型视觉语言模型(LVLMs)能否揭示视觉错觉背后的真相?感知与推理能力分析
Liangjie Zhao, Jiaqing Lyu, Kexin Tang, Zecheng Fang, Rong Yin, Yulan Hu, Da Li, Jianing Li
机构
*
Adelaide University(阿德莱德大学)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Tsinghua University(清华大学)
;
Amap, Alibaba Group(阿里巴巴集团高德地图)
;
Beihang University(北京航空航天大学)
What If Prompt Injection Never Left? Rethinking Agent Security through Cross-Session Stored Prompt Injection
如果提示注入从未消失?探索智能体系统中的跨会话存储提示注入
Yuanbo Xie, Wenlei Zhu, Tianyun Liu, Yingjie Zhang, Suchen Liu, Yulin Li, Liya Su, Tingwen Liu
机构
*
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
AI Sec Lab, Beijing Chaitin Technology Co.,Ltd(北京柴坦科技有限公司AI安全实验室)
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
CommentsAfter further review of the current submission, we have identified potential legal and intellectual property concerns associated with keeping the manuscript publicly available as a preprint. In particular, there are ongoing considerations regarding institutional affiliation information, intellectual property ownership, and related compliance matters
Veritas++: Value-aware On-Policy Distillation for Perception-Enhanced AIGI Detection
Veritas++:面向感知增强的AIGI检测的值感知在线策略蒸馏
Hao Tan, Jun Lan, Zichang Tan, Ajian Liu, Zijian Yu, Chuanbiao Song, Huijia Zhu, Weiqiang Wang, Jun Wan, Zhen Lei
机构
*
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences (UCAS)(中国科学院大学先进交叉科学学院)
;
Institute of Automation, Chinese Academy of Sciences (CASIA)(中国科学院自动化研究所)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences (UCAS)(中国科学院大学人工智能学院)
;
Ant Group(蚂蚁集团)
;
Sangfor Technologies Inc.(深信服科技股份有限公司)
EvoPINN: Agentic Discovery of Executable Algorithms for Physics-Informed Neural Networks
EvoPINN:面向物理信息神经网络可执行算法的智能体式发现框架
Peng Yin, Kai Li, Yifan Zhang, Jian Cheng
机构
*
School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉科学学院)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
机构
*
MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
CAIR, HKISI, Chinese Academy of Sciences(中国科学院香港创新研究院人工智能与机器人创新中心)
;
SCSE, FIE, M.U.S.T(澳门科技大学创新工程学院计算机科学与工程学院)