机构
*
School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院)
;
College of Information Science and Technology, Eastern Institute of Technology(东方理工学院信息科学与技术学院)
Reliability-Aware Geometric Fusion for Robust Audio-Visual Navigation
可靠性感知的几何融合用于鲁棒的音频视觉导航
Teng Liu, Yinfeng Yu
机构
*
Joint Research Laboratory for Embodied Intelligence, Xinjiang University(新疆大学联合具身智能研究实验室)
;
Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing, Xinjiang University(新疆大学丝绸之路多语种认知计算联合国际研究实验室)
;
School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)
Audio Spatially-Guided Fusion for Audio-Visual Navigation
音频空间引导融合用于音频视觉导航
Xinyu Zhou, Yinfeng Yu
机构
*
Joint Research Laboratory for Embodied Intelligence, Xinjiang University(新疆大学联合研究实验室,具身智能)
;
Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing, Xinjiang University(新疆大学丝绸之路多语言认知计算国际联合研究实验室)
;
School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)
Spatial-Aware Conditioned Fusion for Audio-Visual Navigation
空间感知条件融合用于音视频导航
Shaohang Wu, Yinfeng Yu
机构
*
Joint Research Laboratory for Embodied Intelligence, Xinjiang University(新疆大学具身智能联合研究实验室)
;
Joint International Research Laboratory of Silk Road Multilingual Cognitive Computing, Xinjiang University(新疆大学丝绸之路多语种认知计算联合国际研究实验室)
;
School of Computer Science and Technology, Xinjiang University(新疆大学计算机科学与技术学院)
机构
*
University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校)
;
University of Science and Technology of China(中国科学技术大学)
;
Arizona State University(亚利桑那州立大学)
;
Honda Research Institute, USA(本田美国研究所)
FLEX: A Largescale Multimodal, Multiview Dataset for Learning Structured Representations for Fitness Action Quality Assessment
FLEX:一个大规模多模态、多视角数据集,用于学习结构化表示以评估健身动作质量
Hao Yin, Lijun Gu, Paritosh Parmar, Lin Xu, Tianxiao Guo, Xiujin Liu, Weiwei Fu, Yang Zhang, Tianyou Zheng
机构
*
School of Biomedical Engineering (Suzhou), USTC(中国科学技术大学苏州生物医学工程学院)
;
Suzhou Institute of Biomedical Engineering and Technology, CAS(中国科学院苏州生物医学工程技术研究所)
;
Institute of High-Performance Computing, A*STAR, Singapore(新加坡科技研究局高性能计算研究所)
;
School of Psychology, Beijing Sports University(北京体育大学心理学院)
;
School of Competitive Sports, Beijing Sports University(北京体育大学竞技体育学院)
;
Department of Robotics, University of Michigan(密歇根大学机器人系)
V2X-QA: A Comprehensive Reasoning Dataset and Benchmark for Multimodal Large Language Models in Autonomous Driving Across Ego, Infrastructure, and Cooperative Views
V2X-QA:面向自动驾驶多视角的多模态大语言模型综合数据集与基准测试
Junwei You, Pei Li, Zhuoyu Jiang, Weizhe Tang, Zilin Huang, Rui Gan, Jiaxi Liu, Yan Zhao, Sikai Chen, Bin Ran
机构
*
Department of Civil and Environmental Engineering, University of Wisconsin–Madison(威斯康星大学麦迪逊分校土木与环境工程系)
;
Department of Civil and Architectural Engineering and Construction Management, University of Wyoming(怀俄明大学土木与建筑工程及施工管理系)
;
School of Transportation, Southeast University(东南大学交通学院)
Zheng-Xin Yong, Parv Mahajan, Andy Wang, Ida Caspary, Yernat Yestekov, Zora Che, Mosh Levy, Elle Najt, Dennis Murphy, Prashant Kulkarni, Lev McKinney, Kei Nishimura-Gasparian, Ram Potham, Aengus Lynch, Michael L. Chen
机构
*
Constellation
;
Anthropic Fellows Program(Anthropic研究员项目)
;
Brown University(布朗大学)
;
University of Wisconsin-Madison(威斯康星大学麦迪逊分校)
;
Imperial College London(伦敦帝国学院)
;
University of Maryland, College Park(马里兰大学帕克分校)
;
Georgia Institute of Technology(佐治亚理工学院)
;
Bar Ilan University(巴伊兰大学)
;
University of Toronto(多伦多大学)
;
University of Oxford(牛津大学)
专题命中
多模态评测
:multimodal(abstract);分类 cs.CL、cs.AI
AI总结
Kimi K2.5作为开源大模型,在安全评估中显示出潜在风险,包括CBRNE滥用、网络安全漏洞及政治偏见,但其在拒绝恶意请求方面表现较弱,凸显开源模型的安全挑战。