arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Southern California(南加州大学)

2026-04-14 至 2026-04-14 共收录 8
2604.11762 2026-04-14 cs.CV cs.LG eess.SP physics.med-ph stat.ML

MosaicMRI: A Diverse Dataset and Benchmark for Raw Musculoskeletal MRI

MosaicMRI:一个多样化的数据集和基准用于原始骨科MRI

Paula Arguello, Berk Tinaz, Mohammad Shahab Sepehri, Maryam Soltanolkotabi, Mahdi Soltanolkotabi

机构 * University of Southern California(南加州大学) USC Center on AI Foundations for the Sciences(南加州大学科学人工智能基础中心) University of Utah(犹他大学)

AI总结 本文提出MosaicMRI数据集,用于训练和评估机器学习方法,通过多样化解剖结构和成像参数,研究模型在不同场景下的表现,揭示跨解剖相关性的重要性。

Comments 15 pages, 6 figures, preliminary version

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11610 2026-04-14 cs.CL

Self-Evolving LLM Memory Extraction Across Heterogeneous Tasks

跨异质任务的自演化大语言模型记忆提取

Yuqing Yang, Tengxiao Liu, Wang Bill Zhu, Taiwei Shi, Linxin Song, Robin Jia

机构 * University of Southern California(南加州大学) University of California, Santa Barbara(加州大学圣塔芭芭拉分校)

AI总结 本文提出BEHEMOTH基准,通过集群-based策略CluE提升跨异质任务的记忆提取效果,实验显示CluE在异质任务中表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08718 2026-04-14 cs.CV cs.AI cs.RO

Accelerating Transformer-Based Monocular SLAM via Geometric Utility Scoring

通过几何效用评分加速基于Transformer的单目SLAM

Xinmiao Xiong, Bangya Liu, Hao Wang, Dayou Li, Nuo Chen, Andrew Feng, Mingyu Ding, Suman Banerjee, Yang Zhou, Zhiwen Fan

机构 * UW–Madison(威斯康星大学麦迪逊分校) Texas A&M(德州农工大学) USC(南加州大学) UNC Chapel Hill(北卡罗来纳大学教堂山分校)

AI总结 本文提出LeanGate,通过预测几何效用评分在重特征提取前筛选帧,减少冗余计算,提升SLAM效率与准确性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10404 2026-04-14 cs.ET cs.LG

Sense Less, Infer More: Agentic Multimodal Transformers for Edge Medical Intelligence

感知更少,推断更多:面向边缘医疗智能的代理多模态变压器

Chengwei Zhou, Zhaoyan Jia, Haotian Yu, Xuming Chen, Brandon Lee, Christopher Pulliam, Steve Majerus, Massoud Pedram, Gourav Datta

机构 * Case Western Reserve University(凯斯西储大学) University of Southern California(南加州大学)

AI总结 本文提出AMI框架,通过代理多模态变压器在边缘设备上实现高效医疗监测,在减少传感器使用的同时提升诊断准确性。

Comments 7 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24329 2026-04-14 cs.CL cs.AI cs.CV

GameplayQA: A Benchmarking Framework for Decision-Dense POV-Synced Multi-Video Understanding of 3D Virtual Agents

GameplayQA: 一种用于3D虚拟代理多视频理解的决策密集型视角同步评估框架

Yunzhe Wang, Runhui Xu, Kexin Zheng, Tianyi Zhang, Jayavibhav Niranjan Kogundi, Soham Hans, Volkan Ustun

机构 * University of Southern California(南加州大学)

AI总结 GameplayQA通过密集标注多玩家3D游戏视频,构建了2.4K诊断QA对,评估代理感知与推理能力,揭示了前沿MLLM在时间同步、跨视频定位及决策密度处理上的不足。

Comments Accepted to the Annual Meeting of the Association for Computational Linguistics (ACL 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18373 2026-04-14 cs.CV

MASS: Motion-Aware Spatial-Temporal Grounding for Physics Reasoning and Comprehension in Vision-Language Models

MASS:面向视觉-语言模型中物理推理与理解的运动感知空间-时间 grounding

Xiyang Wu, Zongxia Li, Jihui Jin, Guangyao Shi, Gouthaman KV, Vishnu Raj, Nilotpal Sinha, Jingxi Chen, Fan Du, Dinesh Manocha

机构 * University of Maryland(马里兰大学) Dolby Laboratories(杜比实验室) University of Southern California(南加州大学)

AI总结 MASS通过引入空间-时间信号提升视觉-语言模型对物理现象的理解能力,提出MASS-Bench基准测试集并验证模型在物理推理中的优越性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.11892 2026-04-14 cs.CV

DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning

DecAlign:解耦多模态表示学习的分层跨模态对齐

Chengxuan Qian, Shuo Xing, Shawn Li, Yue Zhao, Zhengzhong Tu

机构 * Texas A&M University(德克萨斯A&M大学) University of Southern California(南加州大学)

AI总结 DecAlign通过分层跨模态对齐框架解耦多模态表示,结合原型引导最优传输策略和多模态Transformer提升语义一致性,实验显示在四个基准上优于现有方法。

Comments Accepted by ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.11964 2026-04-14 cs.LG stat.ML

A Complete Decomposition of KL Error using Refined Information and Mode Interaction Selection

基于精炼信息和模式交互选择的KL误差完整分解

James Enouen, Mahito Sugiyama

机构 * University of Southern California(南加州大学) National Institute of Informatics, SOKENDAI(国立信息学研究所,综合研究大学院大学)

AI总结 本文通过引入高阶模式交互,提出KL误差的完整分解方法,开发MAHGenTa算法,提升生成和分类任务的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏