SpatialVAM:Spatial-Aware Multi-View Video Diffusion as a Data-Efficient Robot Policy
多视角视频扩散策略:一种3D空间-时间感知的视频动作模型
Peiyan Li, Yixiang Chen, Yuan Xu, Jiabing Yang, Xiangnan Wu, Jun Guo, Nan Sun, Long Qian, Xinghang Li, Xin Xiao, Jing Liu, Nianfeng Liu, Tao Kong, Yan Huang, Liang Wang, Tieniu Tan
机构
*
New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所模式识别国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
FiveAges(五时代)
;
Tsinghua University(清华大学)
;
Xi’an Jiaotong University(西安交通大学)
;
Wuhan University(武汉大学)
;
Nanjing University(南京大学)
VANE: Reliable Test-Time Training for Vision-Language-Action Models via Future Visual Representation Prediction
VANE:通过未来视觉表示预测实现视觉-语言-动作模型的可靠测试时训练
Hongjin Ji, Guoyang Xia, Luoyang Sun, Fangxiang Feng, Lei Ren
机构
*
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Li Auto Inc.(理想汽车)
机构
*
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
CITIC Securities(中信证券)
;
School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)
ATLAS: Agentic Taxonomy of Large-Scale Software Ecosystems
ATLAS: 大规模软件生态系统的智能体分类体系
Junyi Lu, Mengyao Lyu, Jiahui Wu, Lei Yu, Chengwei Liu, Fengjun Zhang, Li Yang, Chun Zuo, Yang Liu
机构
*
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Nanyang Technological University(南洋理工大学)
;
Nankai University(南开大学)
;
Sinosoft Company Limited(中软国际有限公司)
机构
*
SKLP, ICT, CAS & UCAS(SKLP、信息科技研究院、中国科学院及中国科学院大学)
;
University of Aberdeen(阿伯丁大学)
;
University of Leeds(利兹大学)
;
SKLP, ICT, CAS(SKLP、信息科技研究院、中国科学院)
机构
*
Guangdong University of Technology(广东工业大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Capital Normal University(首都师范大学)
;
Xiamen University(厦门大学)
;
Beijing Jiaotong University(北京交通大学)
机构
*
Sichuan University(四川大学)
;
Sun Yat-sen University(中山大学)
;
Australian National University(澳大利亚国立大学)
;
Peking University(北京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Shanghai Jiao Tong University(上海交通大学)
GraphWalker: Agentic Knowledge Graph Question Answering via Synthetic Trajectory Curriculum
GraphWalker: 通过合成轨迹课程实现基于知识图谱的代理问答
Shuwen Xu, Yao Xu, Jiaxiang Liu, Chenhao Yuan, Wenshuo Peng, Jun Zhao, Kang Liu
机构
*
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所复杂系统认知与决策智能重点实验室)
;
Department of Electronic Engineering, Tsinghua University(清华大学电子工程系)
ForesightSafety-SAGE:A Fully Automated Scenario Generation and Safety Evaluation Framework for LLM Agents
VESTA: 一种全自动的LLM智能体场景生成与安全评估框架
Lu Jia, Haibo Tong, Feifei Zhao, Jindong Li, Dongqi Liang, Ping Wu, Qian Zhang, Yi Zeng
机构
*
BrainCog AI Lab, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所类脑人工智能实验室)
;
Beijing Institute of AI Safety and Governance (Beijing-AISI)(北京人工智能安全与治理研究院)
;
Beijing Key Laboratory of Safe AI and Superalignment(北京市安全人工智能与超级对齐重点实验室)
;
School of Artificial Intelligence, UCAS(中国科学院大学人工智能学院)
;
Long-term AI(长期人工智能)
How Long Reasoning Chains Influence LLMs' Judgment of Answer Factuality
推理链长度如何影响LLM对答案事实性的判断
Minzhu Tu, Shiyu Ni, Keping Bi
机构
*
State Key Laboratory of AI Safety(人工智能安全国家重点实验室)
;
Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Beijing University of Post and Telecommunications(北京邮电大学)
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
Li Auto
;
Zhejiang Lab(浙江实验室)
;
State Key Lab of CAD&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室)
IR275K: A Benchmark for Infrared Multi-Frame Super-Resolution Toward Efficient Remote Sensing
IR275K:面向高效遥感的红外多帧超分辨率基准测试
Jie Deng, Heyang Wang, Changxin Wang, Junkai Shen, Hongyi Chen, Zhiping He, Hongxing Qi, Xudong Zhang, Jianyu Wang
机构
*
Hangzhou Institute for Advanced Study(杭州高等研究院)
;
Shanghai Institute of Technical Physics of the Chinese Academy of Sciences(中国科学院上海技术物理研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
Commentsv5: Fixed PDF rendering compatibility issue affecting Apple PDFKit (macOS Preview/iOS PDF viewer). No changes to technical content compared to v4
机构
*
Key Laboratory of Space Active Opto-Electronics Technology, Shanghai Institute of Technical Physics, Chinese Academy of Sciences(中国科学院上海技术物理研究所空间主动光电技术重点实验室)
;
Hangzhou Institute for Advanced Study, University of Chinese Academy of Sciences(中国科学院大学杭州高等研究院)
SemDINO: Foundation Prior-Guided Cross-Temporal Semantic Alignment Network for Remote Sensing Change Detection
SemDINO: 一种基于DINOv3的跨时间语义对齐变化检测网络
Xinyu Tong, Meihua Zhou, Jinxiao Sun, Zaiyan Zhang, Hongruixuan Chen, Lei Wang
机构
*
Xinjiang Institute of Ecology and Geography, Chinese Academy of Sciences(中国科学院新疆生态与地理研究所)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
School of Computer Science, Xiangtan University(湘潭大学计算机科学学院)
;
College of Information and Communication Engineering, Harbin Engineering University(哈尔滨工程大学信息与通信工程学院)
机构
*
Shanghai Qi Zhi Institute(上海期智研究院)
;
Institute of Interdisciplinary Information Sciences, Tsinghua University(清华大学交叉信息研究院)
;
Xiongan AI Institute(雄安人工智能研究院)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)
;
The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))
;
East China Normal University(华东师范大学)
Ultrasound Tomography of Musculoskeletal Tissues with Generative Neural Physics
生成式神经物理实现组织力学的定量体积超声成像
Zhijun Zeng, Youjia Zheng, Chang Su, Qianhang Wu, Hao Hu, Zeyuan Dong, Yang Lv, Ligang Cui, Zhiyong Hou, Weijun Lin, Zuoqiang Shi, Yubing Li, He Sun
机构
*
College of Future Technology, Peking University(未来技术学院,北京大学)
;
National Biomedical Imaging Center, Peking University(北京大学国家生物医学成像中心)
;
Department of Mathematical Sciences, Tsinghua University(清华大学数学科学系)
;
School of Physical Sciences, University of Chinese Academy of Sciences(中国科学院大学物理科学学院)
;
School of EECE, University of Chinese Academy of Sciences(中国科学院大学电子工程与计算机科学学院)
;
Department of Orthopedics, Peking University Third Hospital(北京大学第三医院骨科部)
;
Department of Ultrasound, Peking University Third Hospital(北京大学第三医院超声科)
;
Department of Orthopaedic Surgery, The Third Hospital of Hebei Medical University(河北医科大学第三医院骨科部)
;
Yau Mathematical Sciences Center, Tsinghua University(清华大学姚期智数学科学中心)
;
Yanqi Lake Beijing Institute of Mathematical Sciences and Applications(北京燕琦湖数学科学与应用研究院)
Multi-Representation Geometric Hierarchy Fusion: An Implicit-Submap Driven Framework for Resilient 3D Place Recognition
多表示几何层次融合:一种用于鲁棒三维地点识别的隐式子图驱动框架
Xiaohui Jiang, Haijiang Zhu, Chade Li, Ning An
机构
*
College of Information and Technology, Beijing University of Chemical Technology(信息与技术学院,北京化工大学)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(人工智能学院,中国科学院大学)
;
Research Institute of Mine Artificial Intelligence, China Coal Research Institute(矿山人工智能研究院,中国煤炭科研院)
Look Ahead Before You Distill: Future Trajectory Validation of Teacher Guidance for Agentic On-Policy Distillation
蒸馏前先前瞻:智能体策略内蒸馏中教师指导的未来轨迹验证
Chishui Chen, Yaoyou Fan, Te Sun, Yi Yang, Chenghao Sun, Delin Mao, Hongbo Qiao, Zuowei Zhang, Junxi Wang, Chenxing Sun, Yangen Hu, Lu Pan, Xuyang Liu, Linfeng Zhang
机构
*
Meituan LongCat Interaction(美团龙猫交互)
;
Shanghai Jiao Tong University(上海交通大学)
;
Fudan University(复旦大学)
;
Peking University(北京大学)
;
Nanjing University(南京大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
Jilin University(吉林大学)
;
University of Science and Technology of China(中国科学技术大学)
;
The Hong Kong Polytechnic University(香港理工大学)
SVL: Empowering Spiking Neural Networks for Efficient 3D Open-World Understanding
SVL:基于脉冲的视觉-语言预训练用于高效的3D开放世界理解
Xuerui Qiu, Peixi Wu, Yaozhi Wen, Shaowei Gu, Yuqi Pan, Xinhao Luo, Bo XU, Guoqi Li
机构
*
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院)
;
Zhongguancun Academy(中关村学院)
;
University of Science and Technology of China(中国科学技术大学)
;
Peking University(北京大学)
机构
*
Hangzhou Institute for Advanced Study, UCAS, school of Intelligent Science and Technology(杭州高等研究院,UCAS,智能科学与技术学院)
;
State Key Laboratory of AI Safety, Institute of Computing Technology (ICT), Chinese Academy of Sciences (CAS)(人工智能安全国家重点实验室,计算技术研究所,中国科学院)
;
University of Chinese Academy of Sciences (UCAS)(中国科学院大学)
IoU-PD: IoU-Aware Privileged Distillation for Visual Grounding with Multimodal Large Language Models
IoUPD:用于多模态大语言模型视觉定位的IoU感知特权蒸馏
Xiuyuan Zhu, Ke Lu, Hao Wu, Siwen Jiao, Zijin Du, Dongming Zhang, Jian Xue
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
State Key Laboratory of Communication Content Cognition(通信内容认知技术国家重点实验室)
;
Peng Cheng Laboratory(鹏城实验室)
LongCrafter: Towards Diverse Long-Context Understanding via Evidence-Graph-Guided Instruction Synthesis
LongCrafter:通过证据图引导的指令合成实现多样化的长上下文理解
Chenhao Yuan, Yinhao Xu, Shuwen Xu, Xizhi Yang, Jiaxiang Liu, Chenxi Zhou, Shaoping Huang, Haolin Ren, Pengfei Cao, Jun Zhao, Kang Liu
机构
*
University of Chinese Academy of Sciences(中国科学院大学)
;
The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所认知与决策智能复杂系统重点实验室)
机构
*
Shanghai Astronomical Observatory, Chinese Academy of Sciences, Shanghai 200030, China(上海天文台,中国科学院,上海200030,中国)
;
School of Astronomy and Space Sciences, University of Chinese Academy of Sciences, Beijing 101408, China(中国科学院大学天文与空间科学学院,北京101408,中国)
;
Science Talent Training Center, Gainesville, FL, 32606 USA(科学人才培训中心,佛罗里达州盖恩斯维尔,32606 USA)
A Hamiltonian-Inspired Local-Operator Ansatz for Slimming Large Language Models
一种用于高效大语言模型的通用张量结构压缩方案
Ying Lu, Peng-Fei Zhou, Qi-Xuan Fang, Pan Zhang, Shi-Ju Ran, Gang Su
机构
*
School of Physical Sciences, University of Chinese Academy of Sciences(中国科学院大学物理科学学院)
;
Kavli Institute for Theoretical Sciences, University of Chinese Academy of Sciences(中国科学院大学理论科学研究院)
;
Center for Quantum Physics and Intelligent Sciences, Department of Physics, Capital Normal University(首都师范大学量子物理与智能科学中心)
;
Institute of Theoretical Physics, Chinese Academy of Sciences(中国科学院理论物理研究所)
机构
*
School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
;
Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所)
;
Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所)
;
Ant Group(蚂蚁集团)
A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook
大型音频语言模型综述:通用性、可信度与展望
Kaiwen Luo, Zhenhong Zhou, Leyan Wang, Liang Lin, Tianyu Shao, Yuanhe Zhang, Yang Xiao, Yuxuan Li, Miao Yu, Kailin Lyu, Jiaming Zhang, Li Sun, Songze Li, Yueming Wu, Ting Dang, Xiaojun Jia, Dongrui Liu, Kai Li, Rohan Kumar Das, Siyuan Liang, Xinfeng Li, Qiankun Li, Jing Chen, Xingjun Ma, Kun Wang, Junhao Dong, Deqing Zou, Yu Cheng, Xia Hu, Zhigang Zeng, Sen Su, Yang Liu, Yu-Gang Jiang, Philip S. Yu, Yew-Soon Ong
机构
*
Nanyang Technological University(南洋理工大学)
;
Independent Researcher(独立研究者)
;
The University of Melbourne(墨尔本大学)
;
North China Electric Power University(华北电力大学)
;
Beijing University of Posts and Telecommunications(北京邮电大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
;
University of Science and Technology of China(中国科学技术大学)
;
Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Huazhong University of Science and Technology(华中科技大学)
;
Tsinghua University(清华大学)
;
Fortemedia Singapore(富媒体新加坡)
;
Tencent(腾讯)
;
Fudan University(复旦大学)
;
Wuhan University(武汉大学)
;
Chinese University of Hong Kong(香港中文大学)
;
Chongqing University of Posts and Telecommunications(重庆邮电大学)
;
University of Illinois Chicago(伊利诺伊大学芝加哥分校)
Missing-by-Design: Certifiable Modality Deletion for Revocable Multimodal Sentiment Analysis
缺失-by-设计:可撤销多模态情感分析的可验证模态删除
Rong Fu, Ziming Wang, Chunlei Meng, Jiekai Wu, Kangan Qian, Hao Zhang, Simon Fong
机构
*
University of Macau(澳门大学)
;
Zhejiang University(浙江大学)
;
Fudan University(复旦大学)
;
Shanghai AI Laboratory(上海人工智能实验室)
;
Juntendo University(立命馆大学)
;
Tsinghua University(清华大学)
;
University of Chinese Academy of Sciences(中国科学院大学)
Comments21 pages, 6 figures. In the previous version, Juntendo University was erroneously listed as the affiliation; we must clarify that this paper has absolutely no relation to Juntendo University. Therefore, we have replaced this affiliation in the new version
MMPhysVideo: Physically Plausible Video Generation Through Joint RGB-Perception Modeling
MMPhysVideo: 通过联合多模态建模提升视频生成的物理合理性
Shubo Lin, Xuanyang Zhang, Wei Cheng, Weiming Hu, Gang Yu, Jin Gao
机构
*
State Key Laboratory of Multimodal Artificial Intelligence Systems, CASIA(中国科学院自动化研究所多模态人工智能系统国家重点实验室)
;
School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)
;
StepFun(阶跃星辰)
;
Beijing Key Laboratory of Super Intelligent Security of Multi-Modal Information(多模态信息超级智能安全北京市重点实验室)
;
School of Information Science and Technology, Shanghai Tech University(上海科技大学信息科学与技术学院)