Venus: An Efficient Edge Memory-and-Retrieval System for VLM-based Online Video Understanding
Venus: 一种高效的边缘内存与检索系统用于基于VLM的在线视频理解
Shengyuan Ye, Bei Ouyang, Tianyi Qian, Liekang Zeng, Mu Yuan, Xiaowen Chu, Weijie Hong, Xu Chen
机构
*
School of Computer Science and Engineering, Sun Yat-sen University, Guangzhou, China(计算机科学与工程学院,中山大学,广州,中国)
;
Department of Information Engineering, The Chinese University of Hong Kong, Hong Kong SAR, China(信息工程系,香港中文大学,香港特别行政区,中国)
;
Shenzhen Smart City Communications Co., Ltd., China(深圳智慧城市通信有限公司,中国)
CommentsAccepted to NeurIPS 2025 Workshops: SPACE in Vision, Language, and Embodied AI; and What Makes a Good Video: Next Practices in Video Generation and Evaluation
CitySeeker: How Do VLMS Explore Embodied Urban Navigation With Implicit Human Needs?
CitySeeker: VLMS如何通过隐含人类需求探索具身城市导航
Siqi Wang, Chao Liang, Yunfan Gao, Erxin Yu, Sen Li, Yushi Li, Jing Li, Haofen Wang
机构
*
Department of Computing, The Hong Kong Polytechnic University(香港理工大学计算机系)
;
Tongji University(同济大学)
;
Nanjing Institute of Geography and Limnology, Chinese Academy of Sciences(中国科学院南京地理与湖泊研究所)
;
Research Centre for Data Science & Artificial Intelligence(数据科学与人工智能研究中心)
AlignMerge - Alignment-Preserving Large Language Model Merging via Fisher-Guided Geometric Constraints
AlignMerge - 通过Fisher引导的几何约束实现的保持对齐的大语言模型合并
Aniruddha Roy, Jyoti Patel, Aman Chadha, Vinija Jain, Amitava Das
机构
*
AI Institute, University of South Carolina(AI研究院,南卡罗来纳大学)
;
Indian Institute of Technology, Kharagpur(印度理工学院,Khargpur分校)
;
Islamic University of Technology(伊斯兰科技大学)
;
Stanford University, USA(斯坦福大学,美国)
;
Amazon AI, USA(亚马逊AI,美国)
;
HCL(HCL公司)
;
Evalueserve(Evalueserve公司)
;
Apple (USA)(苹果(美国))
;
Google (USA)(谷歌(美国))
;
Pragya Lab, BITS Pilani, Goa(Pragya实验室, BITS Pilani,Goa分校)
SAT: Dynamic Spatial Aptitude Training for Multimodal Language Models
SAT:多模态语言模型的动态空间能力训练
Arijit Ray, Jiafei Duan, Ellis Brown, Reuben Tan, Dina Bashkirova, Rose Hendrix, Kiana Ehsani, Aniruddha Kembhavi, Bryan A. Plummer, Ranjay Krishna, Kuo-Hao Zeng, Kate Saenko
机构
*
Boston University(波士顿大学)
;
University of Washington(华盛顿大学)
;
Allen Institute for AI(人工智能研究院)
;
Microsoft Research(微软研究院)
;
New York University(纽约大学)
SIMA 2: A Generalist Embodied Agent for Virtual Worlds
SIMA 2: 一种通用的具身代理用于虚拟世界
SIMA team, Adrian Bolton, Alexander Lerchner, Alexandra Cordell, Alexandre Moufarek, Andrew Bolt, Andrew Lampinen, Anna Mitenkova, Arne Olav Hallingstad, Bojan Vujatovic, Bonnie Li, Cong Lu, Daan Wierstra, Daniel P. Sawyer, Daniel Slater, David Reichert, Davide Vercelli, Demis Hassabis, Drew A. Hudson, Duncan Williams, Ed Hirst, Fabio Pardo, Felix Hill, Frederic Besse, Hannah Openshaw, Harris Chan, Hubert Soyer, Jane X. Wang, Jeff Clune, John Agapiou, John Reid, Joseph Marino, Junkyung Kim, Karol Gregor, Kaustubh Sridhar, Kay McKinney, Laura Kampis, Lei M. Zhang, Loic Matthey, Luyu Wang, Maria Abi Raad, Maria Loks-Thompson, Martin Engelcke, Matija Kecman, Matthew Jackson, Maxime Gazeau, Ollie Purkiss, Oscar Knagg, Peter Stys, Piermaria Mendolicchio, Raia Hadsell, Rosemary Ke, Ryan Faulkner, Sarah Chakera, Satinder Singh Baveja, Shane Legg, Sheleem Kashem, Tayfun Terzi, Thomas Keck, Tim Harley, Tim Scholtes, Tyson Roberts, Volodymyr Mnih, Yulan Liu, Zhengdong Wang, Zoubin Ghahramani
Large Language Models for Power System Security: A Novel Multi-Modal Approach for Anomaly Detection in Energy Management Systems
用于电力系统安全的大型语言模型:一种用于能源管理系统异常检测的新型多模态方法
Aydin Zaboli, Junho Hong, Alexandru Stefanov, Chen-Ching Liu, Chul-Sang Hwang
机构
*
Department of Electrical and Computer Engineering, University of Michigan -- Dearborn, MI, 48128 USA.(电气与计算机工程系,密歇根大学迪尔伯恩分校)
;
Department of Electrical Sustainable Energy, Technische Universiteit Delft, 2628 CD Delft, Netherlands.(可持续能源系,代尔夫特理工大学)
;
Bradley Department of Electrical and Computer Engineering, Virginia Polytechnic Institute and State University, Blacksburg, VA 24061, USA.(布雷德利电气与计算机工程系,弗吉尼亚理工学院和州立大学)
;
Smart Grid Research Division System Reliability Research Team, Korea Electrotechnology Research Institute (KERI), Gwangju-si, 61751, South Korea.(智能电网研究分会系统可靠性研究团队,韩国电力技术研究所(KERI))
Spatial-SSRL: Enhancing Spatial Understanding via Self-Supervised Reinforcement Learning
Spatial-SSRL: 通过自监督强化学习增强空间理解
Yuhong Liu, Beichen Zhang, Yuhang Zang, Yuhang Cao, Long Xing, Xiaoyi Dong, Haodong Duan, Dahua Lin, Jiaqi Wang
机构
*
Shanghai AI Laboratory(上海人工智能实验室)
;
Shanghai Jiao Tong University(上海交通大学)
;
The Chinese University of Hong Kong(香港中文大学)
;
Shanghai Innovation Institute(上海创新研究院)
NeuroVascU-Net: A Unified Multi-Scale and Cross-Domain Adaptive Feature Fusion U-Net for Precise 3D Segmentation of Brain Vessels in Contrast-Enhanced T1 MRI
Mohammad Jafari Vayeghan, Niloufar Delfan, Mehdi Tale Masouleh, Mansour Parvaresh Rizi, Behzad Moshiri
机构
*
School of Electrical and Computer Engineering, College of Engineering, University of Tehran(电信工程学院,工程学院,德黑兰大学)
;
Department of EECS, Lassonde School of Engineering, York University(电子工程系,拉索nde工程学院,约克大学)
;
Department of Neurosurgery, School of Medicine, Iran University of Medical Sciences(神经外科系,医学院,伊朗医学科学大学)
;
Department of Electrical and Computer Engineering, University of Waterloo(电子工程系,滑铁库大学)
CubeletWorld: A New Abstraction for Scalable 3D Modeling
CubeletWorld: 一种可扩展3D建模的新抽象
Azlaan Mustafa Samad, Hoang H. Nguyen, Lukas Berg, Henrik Müller, Yuan Xue, Daniel Kudenko, Zahra Ahmadi
机构
*
L3S Research Center(L3S研究所以)
;
Leibniz University Hannover(汉诺威莱布尼茨大学)
;
University of Tennessee at Chattanooga(田纳西大学查塔努加分校)
;
PLRI Medical Informatics Institute(医学信息学研究所)
;
Hannover Medical School(汉诺威医学院)
Text to Robotic Assembly of Multi Component Objects using 3D Generative AI and Vision Language Models
通过3D生成AI和视觉语言模型实现多组件物体的文本到机器人组装
Alexander Htet Kyaw, Richa Gupta, Dhruv Shah, Anoop Sinha, Kory Mathewson, Stefanie Pender, Sachin Chitta, Yotto Koga, Faez Ahmed, Lawrence Sass, Randall Davis
机构
*
Massachusetts Institute of Technology (MIT)(麻省理工学院)
;
MIT(麻省理工学院)
;
Google DeepMind(谷歌DeepMind)
;
Google, Paradigms of Intelligence(谷歌、范式智能)
;
Autodesk Research(Autodesk研究)
;
MIT Mechanical Engineering(麻省理工学院机械工程系)
;
MIT Architecture(麻省理工学院建筑系)
;
MIT CSAIL(麻省理工学院计算机科学与人工智能实验室)