Spatial Policy: Guiding Visuomotor Robotic Manipulation with Spatial-Aware Modeling and Reasoning
机构 * Tsinghua University(清华大学) ; Beijing University of Technology(北京理工大学) ; Guangzhou University(广州大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
AI 大模型
视频理解、视频生成、视频语言模型和时序视觉推理。
机构 * Tsinghua University(清华大学) ; Beijing University of Technology(北京理工大学) ; Guangzhou University(广州大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
Comments 13 pages
机构 * Xi’an Jiaotong University(西安交通大学) ; Amap, Alibaba Group(阿里巴巴集团) ; DAMO Academy, Alibaba Group(阿里巴巴达摩院)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Accepted to NeurIPS 2025 as Spotlight Presentation. Code: https://github.com/MIV-XJTU/FSDrive
机构 * Google DeepMind(谷歌DeepMind) ; USC(美国斯克利普斯大学) ; Stanford(斯坦福大学) ; Toyota Research Institute(丰田研究机构)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project page: https://pointscoder.github.io/PhysWorld_Web/
机构 * University of California, Berkeley(加州大学伯克利分校) ; University of California, Santa Cruz(加州大学圣克ruz分校) ; University of Illinois at Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校) ; University of Chicago(芝加哥大学) ; Amazon(亚马逊) ; Information Commissioner’s Office(信息专员办公室)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
Comments NeurIPS 2025 Datasets & Benchmarks
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * Department of Statistical Science, University College London(统计科学系,伦敦大学学院) ; Core AI team at Meta Reality Labs(Meta Reality Labs人工智能核心团队)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Accepted by IEEE TCSVT, Code: https://github.com/littlewhitesea/Text-Driven-Pano-Gen
机构 * Texas A&M University(德克萨斯A&M大学) ; NEC Laboratories America(NEC美国实验室)
专题命中 视频生成 :video diffusion(abstract);分类 cs.CV
机构 * Dalian University of Technology(大连理工大学) ; Kling Team, Kuaishou Technology(快手科技 Kling 团队) ; ZMO AI Inc.(ZMO人工智能公司) ; Oxford University(牛津大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project Page URL:https://libaolu312.github.io/VFXMaster/
机构 * UC, Santa Barbara(加州大学圣芭芭拉分校) ; Adobe Research(Adobe研究院) ; MIT-IBM Watson AI Lab(麻省理工-IBM沃森人工智能实验室)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
Comments 19 pages, 9 figures
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments This survey will be regularly updated at: https://github.com/GigaAI-research/General-World-Models-Survey
机构 * Department of Computer Science(计算机科学系) ; Graduate School of Artificial Intelligence, POSTECH, South Korea(人工智能研究生院,POSTECH,韩国)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * Adobe Research(Adobe研究机构) ; University of Michigan(密歇根大学) ; UNC Chapel Hill(北卡罗来纳大学教堂山分校)
专题命中 视频生成 :video diffusion(abstract);分类 cs.CV
Comments ICCV 2025; First three authors contributed equally. Project page: https://veggie-gen.github.io/
机构 * School of Computer Science, Northwestern Polytechnical University(西北工业大学计算机学院) ; School of Computing, National University of Singapore(新加坡国立大学计算机学院) ; School of Computing and Data Science, The University of Hong Kong(香港大学计算机与数据科学学院) ; School of Astronautics, Northwestern Polytechnical University(西北工业大学航天学院)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments 39th Conference on Neural Information Processing Systems (NeurIPS 2025)
机构 * Stanford University(斯坦福大学) ; Harvard University(哈佛大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Project page: https://video-synthesis-variational.github.io/
机构 * Nanyang Technological University(南洋理工大学) ; StepFun
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * Queen’s University and Vector Institute(女王大学和向量研究所) ; University of Tokyo(东京大学) ; University of Toronto(多伦多大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments 43 pages, 11 figures, 14 tables
机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) ; Michigan State University(密歇根州立大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * College of Computer and Information Engineering, Zhejiang Gongshang University(浙江工商大学计算机与信息工程学院) ; Wangxuan Institute of Computer Technology, Peking University(北京大学王轩计算机技术研究所) ; School of Information Science and Technology, University of Science and Technology of China(中国科学技术大学信息科学与技术学院) ; Binjiang Institute of Zhejiang University(浙江大学滨江学院) ; School of Computer Science and Information Engineering, Hefei University of Technology(合肥工业大学计算机科学与信息工程学院)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * Department of Computer Science(计算机科学系) ; Cranberry-Lemon University(Cranberry-Lemon 大学) ; Texas A&M University(德克萨斯A&M大学) ; eBay Inc.(eBay公司)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * Simon Fraser University(西蒙弗雷泽大学) ; Adobe Research(Adobe研究院)
专题命中 视频生成 :long video(abstract);分类 cs.CV
Comments Project website: https://multicoinx.github.io/multicoin/
机构 * Carnegie Mellon University(卡内基梅隆大学) ; ByteDance Seed(字节跳动种子)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments 14 pages, 7 figures
机构 * Robotics and AI Institute(机器人与人工智能研究所) ; Brown University(布朗大学)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * State Key Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(信息处理国家重点实验室,计算机学院,北京大学) ; Hong Kong University of Science and Technology(香港科技大学) ; National University of Singapore(新加坡国家大学) ; Beijing Innovation Center of Humanoid Robotics(北京人形机器人创新中心)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
机构 * seas.upenn.edu(宾夕法尼亚大学塞as学院)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
机构 * School of Cyber Science and Engineering, Xi'an Jiaotong University(西安交通大学计算机科学与工程学院) ; Interdisciplinary Research Center of Frontier science and technology, Xi'an Jiaotong University(西安交通大学前沿科学与技术交叉研究中心) ; School of Software Engineering, Xi'an Jiaotong University(西安交通大学软件工程学院) ; Department of Industrial and Systems Engineering, Hong Kong Polytechnic University(香港理工大学工业与系统工程系) ; School of Cyber Science and Engineering, Wuhan University(武汉大学计算机科学与工程学院)
专题命中 视频生成 :video generation(abstract);分类 cs.CV
Comments Accepted by ACM Computing Surveys
机构 * University of California, Santa Cruz(加州大学圣克ruz分校) ; University of California, Los Angeles(加州大学洛杉矶分校) ; IIT Bombay(印度理工学院班加罗尔) ; Microsoft(微软公司)
专题命中 视频生成 :text-to-video(abstract);分类 cs.CV
机构 * UNC Chapel Hill(北卡罗来纳大学教堂山分校) ; Nanyang Technological University(南洋理工大学)
专题命中 视频生成 :video diffusion(abstract);分类 cs.CV
Comments EMNLP 2025 main; The first two authors contribute equally. Project Page: https://raccoon-mllm-gen.github.io/
机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校) ; Alibaba International Digital Commerce, Hangzhou(阿里巴巴国际数字商业)
专题命中 视频生成 :video generation(abstract);分类 cs.CV