arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Maryland, College Park(马里兰大学帕克分校)

共收录 580
2412.05277 2025-12-23 cs.CV

Text to Blind Motion

文本到盲人运动

Hee Jae Kim, Kathakoli Sengupta, Masaki Kuribayashi, Hernisa Kacorri, Eshed Ohn-Bar

机构 * Boston University(波士顿大学) Waseda University(早稻田大学) University of Maryland, College Park(马里兰大学学院公园分校)

AI总结 本文提出BlindWays,首个针对盲人行人的多模态运动基准,通过收集盲人真实环境中的3D运动数据及文本描述,评估现有3D运动模型在处理盲人独特运动模式时的不足,以提升自动驾驶等系统对多样化人类运动的推理能力。

Comments Accepted at NeurIPS 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16250 2025-12-19 cs.AI cs.MA

AMUSE: Audio-Visual Benchmark and Alignment Framework for Agentic Multi-Speaker Understanding

AMUSE:面向代理多说话者理解的音频-视觉基准与对齐框架

Sanjoy Chowdhury, Karren D. Yang, Xudong Liu, Fartash Faghri, Pavan Kumar Anasosalu Vasu, Oncel Tuzel, Dinesh Manocha, Chun-Liang Li, Raviteja Vemulapalli

机构 * University of Maryland, College Park(马里兰大学学院公园分校) Apple(苹果公司)

AI总结 AMUSE提出一个面向多说话人理解的音频-视觉基准与对齐框架RAFT,通过代理推理提升多模态模型能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15691 2025-12-18 cs.LG cs.IT cs.SY eess.SP eess.SY math.IT

Multi-Modal Semantic Communication

多模态语义通信

Matin Mortaheb, Erciyes Karakaya, Sennur Ulukus

机构 * Department of Electrical and Computer Engineering(电气与计算机工程系) University of Maryland College Park(马里兰大学学院市分校)

AI总结 本文提出多模态语义通信框架,通过融合文本查询与视觉特征,实现复杂场景下的高效信息传输与任务关键信息保留。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14112 2025-12-17 cs.AI

Optimizing Multi-Tier Supply Chain Ordering with a Hybrid Liquid Neural Network and Extreme Gradient Boosting Model

优化多级供应链订货的混合液态神经网络与极梯度提升模型

Chunan Tong

机构 * University of Maryland, College Park(马里兰大学学院 park)

AI总结 本研究提出混合液态神经网络与极梯度提升模型,用于优化多级供应链订货,以提高效率和盈利能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13825 2025-12-17 cond-mat.dis-nn cond-mat.mes-hall cs.LG

Unreasonable effectiveness of unsupervised learning in identifying Majorana topology

无监督学习在识别马约拉纳拓扑中的不合理有效性

Jacob Taylor, Haining Pan, Sankar Das Sarma

机构 * Condensed Matter Theory Center(凝聚态理论中心) Joint Quantum Institute, Department of Physics, University of Maryland, College Park, Maryland 20742, USA(联合量子研究所、物理系、马里兰大学 College Park 分校,马里兰州,20742, USA) Department of Physics(物理系) Astronomy, Center for Materials Theory, Rutgers University, Piscataway, NJ 08854, USA(天文学、材料理论中心、罗格斯大学 Piscataway 分校,新泽西州,08854, USA)

AI总结 本文利用无监督学习与自动编码器结合的方法,探索无标签数据在识别马约拉纳拓扑中的有效性。

Comments 7 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.03604 2025-12-16 cs.LG

Bilevel ZOFO: Efficient LLM Fine-Tuning and Meta-Training

双层零阶优化:高效的LLM微调与元训练

Reza Shirkavand, Peiran Yu, Qi He, Heng Huang

机构 * Department of Computer Science University of Maryland - College Park(计算机科学系马里兰大学- College Park) Department of Computer Science and Engineering University of Texas at Arlington(计算机科学与工程系德克萨斯理工大学阿灵顿分校)

AI总结 Bilevel-ZOFO结合了快速的FO-PEFT内循环和稳定的ZO外循环,实现高效LLM微调与元训练,提升训练速度和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12822 2025-12-16 cs.CV cs.AI

Lemon: A Unified and Scalable 3D Multimodal Model for Universal Spatial Understanding

Lemon:一种统一且可扩展的3D多模态模型用于通用空间理解

Yongyuan Liang, Xiyao Wang, Yuanchen Ju, Jianwei Yang, Furong Huang

机构 * University of Maryland, College Park(马里兰大学学院公园分校) University of California, Berkeley(加州大学伯克利分校)

AI总结 Lemon提出一种统一的Transformer架构,通过联合处理3D点云块和语言标记,实现空间-语言融合,提升3D多模态模型的可扩展性和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.05622 2025-12-16 cs.CR cs.AI cs.LG

DATABench: Evaluating Dataset Auditing in Deep Learning from an Adversarial Perspective

DATABench: 从对抗角度评估深度学习中的数据集审计

Shuo Shao, Yiming Li, Mengren Zheng, Zhiyang Hu, Yukun Chen, Boheng Li, Yu He, Junfeng Guo, Dacheng Tao, Zhan Qin

机构 * State Key Laboratory of Blockchain and Data Security, Zhejiang University(区块链与数据安全国家重点实验室,浙江大学) Hangzhou High-Tech Zone (Binjiang) Institute of Blockchain and Data Security(杭州高新技术区(滨江)区块链与数据安全研究院) Nanyang Technological University(南洋理工大学) Chongqing University(重庆大学) University of Maryland at College Park(马里兰大学学院公园分校)

AI总结 DATABench从对抗角度评估深度学习中的数据集审计,提出新的分类法和攻击策略,揭示现有审计方法在对抗环境下的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12081 2025-12-16 eess.SY cs.AI cs.SI cs.SY math.OC

Congestion Reduction in EV Charger Placement Using Traffic Equilibrium Models

利用交通均衡模型减少电动汽车充电站布置的拥堵

Semih Kara, Yasin Sonmez, Can Kizilkale, Alex Kurzhanskiy, Nuno C. Martins, Murat Arcak

机构 * University of California, Berkeley(加州大学伯克利分校) University of Maryland, College Park(马里兰大学学院公园分校)

AI总结 本文提出利用交通均衡模型减少电动汽车充电站布置拥堵,通过两种模型和贪心算法实现最优或近优结果,同时展示队列方法更现实。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.06154 2025-12-09 cs.LG cs.AI cs.IT math.IT

Learning Invariant Graph Representations Through Redundant Information

通过冗余信息学习不变图表示

Barproda Halder, Pasan Dissanayake, Sanghamitra Dutta

机构 * University of Maryland, College Park(马里兰大学 College Park 分校)

AI总结 本文提出RIG框架,通过冗余信息学习不变图表示,以实现分布外泛化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04315 2025-12-05 cs.CV

SyncTrack4D: Cross-Video Motion Alignment and Video Synchronization for Multi-Video 4D Gaussian Splatting

SyncTrack4D: 多视频4D高斯点云的跨视频运动对齐与视频同步

Yonghan Lee, Tsung-Wei Huang, Shiv Gehlot, Jaehoon Choi, Guan-Ming Su, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学学院公园分校) Dolby Laboratories(杜比实验室)

AI总结 SyncTrack4D通过跨视频运动对齐和4D高斯点云重建,实现多视频不同步问题的高精度同步与高保真重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03995 2025-12-04 cs.RO cs.CV

Artificial Microsaccade Compensation: Stable Vision for an Ornithopter

人工微眼跳补偿:为扑翼机稳定视觉

Levi Burner, Guido de Croon, Yiannis Aloimonos

机构 * Department of Computer Science, University of Maryland, College Park(计算机科学系,马里兰大学,学院公园) Faculty of Aerospace Engineering, Delft University of Technology(航空航天工程系,代尔夫特理工大学) Institute for Advanced Computer Studies, University of Maryland, College Park(高级计算机研究 institute,马里兰大学,学院公园)

AI总结 本文提出了一种实时稳定扑翼机视频的方法,通过优化3D旋转来减少图像抖动,实现高质量的视觉稳定效果。

Comments 29 pages, 5 figures, 2 tables, under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03458 2025-12-04 eess.SP cs.LG cs.SD eess.AS

A Convolutional Framework for Mapping Imagined Auditory MEG into Listened Brain Responses

基于卷积的将想象的听觉MEG映射到听觉脑响应的框架

Maryam Maghsoudi, Mohsen Rezaeizadeh, Shihab Shamma

机构 * Electrical and Computer Engineering Department, University of Maryland, College Park, MD(大学电气与计算机工程系,马里兰州大学,College Park)

AI总结 本文提出了一种基于卷积的框架,将想象的听觉MEG信号映射到听觉脑响应,通过群体层面的编码器-解码器网络实现了稳定的泛化性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02351 2025-12-03 cs.CV cs.AI

Understanding and Harnessing Sparsity in Unified Multimodal Models

理解并利用统一多模态模型中的稀疏性

Shwai He, Chaorui Deng, Ang Li, Shen Yan

机构 * ByteDance Seed(字节跳动种子) University of Maryland, College Park(马里兰大学学院公园分校)

AI总结 本研究通过MoE适应方法,利用稀疏激活提升统一多模态模型的效率,使模型在激活约一半参数的情况下达到与完整模型相当的性能。

Comments 13 pages, 13 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02015 2025-12-02 cs.CV

Generative Video Motion Editing with 3D Point Tracks

基于3D点轨迹的生成视频运动编辑

Yao-Chih Lee, Zhoutong Zhang, Jiahui Huang, Jui-Hsien Wang, Joon-Young Lee, Jia-Bin Huang, Eli Shechtman, Zhengqi Li

机构 * Adobe Research(Adobe研究院) Adobe(Adobe公司) University of Maryland College Park(马里兰大学学院公园分校)

AI总结 本文提出基于3D点轨迹的视频生成框架,实现摄像机与物体运动的联合编辑,通过稀疏对应关系保持时空一致性,提升视频编辑的精确度和创作潜力。

Comments Project page: https://edit-by-track.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05140 2025-12-02 cs.LG cs.CE

Auditing Algorithmic Bias in Transformer-Based Trading

审查基于变换器的交易中的算法偏见

Armin Gerami, Ramani Duraiswami

机构 * Department of Computer Science, Umiacs University of Maryland College Park, MD(计算机科学系,Umiacs马里兰大学学院公园分校)

AI总结 本研究通过变换器模型审查金融交易中的算法偏见,揭示模型对波动数据的忽视及对低频价格波动的偏好。

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.01317 2025-12-02 cs.LG cs.AI

T-SHIRT: Token-Selective Hierarchical Data Selection for Instruction Tuning

T-SHIRT: 令牌选择性层次数据选择用于指令微调

Yanjun Fu, Faisal Hamman, Sanghamitra Dutta

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

AI总结 T-SHIRT通过令牌选择性层次数据选择方法提升指令微调效率,使小规模数据集训练效果优于大规模数据集。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00327 2025-12-02 cs.CV

Odometry Without Correspondence from Inertially Constrained Ruled Surfaces

无对应关系的里程计:基于惯性约束的规则曲面

Chenqi Zhu, Levi Burner, Yiannis Aloimonos

机构 * University of Maryland, College Park(马里兰大学学院公园分校) University of Maryland Institute for Advanced Computer Studies(马里兰大学高级计算机研究 institute)

AI总结 本研究提出基于惯性约束的规则曲面里程计算法,利用IMU数据减少解空间维度,实现无对应关系的视觉里程计重建。

Comments 14 pages, 13 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.11814 2025-12-02 cs.CV

SynPlay: Large-Scale Synthetic Human Data with Real-World Diversity for Aerial-View Perception

SynPlay:大规模合成人类数据集,用于提升航拍视角感知

Jinsub Yim, Hyungtae Lee, Sungmin Eum, Yi-Ting Shen, Yan Zhang, Heesung Kwon, Shuvra S. Bhattacharyya

机构 * University of Maryland College Park(马里兰大学学院市分校) DEVCOM Army Research Laboratory(陆军研究实验室)

AI总结 SynPlay通过大规模合成数据集提升航拍视角下的人类定位性能,采用规则引导的运动生成框架,涵盖广泛自发行为,支持长距离人类分析模型开发。

Comments Project Page: https://synplaydataset.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07119 2025-12-01 cs.CV

MoRe: Monocular Geometry Refinement via Graph Optimization for Cross-View Consistency

MoRe: 通过图优化改进单目几何以实现跨视角一致性

Dongki Jung, Jaehoon Choi, Yonghan Lee, Sungmin Eum, Heesung Kwon, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学学院公园分校) DEVCOM Army Research Laboratory(陆军研究实验室)

AI总结 MoRe通过图优化改进单目几何以提升跨视角一致性与尺度对齐,增强3D重建与新视角合成性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21690 2025-11-27 cs.RO cs.CV cs.LG

TraceGen: World Modeling in 3D Trace Space Enables Learning from Cross-Embodiment Videos

TraceGen:在3D轨迹空间中进行世界建模,实现跨躯体视频的学习

Seungjae Lee, Yoonkyo Jung, Inkook Chun, Yao-Chih Lee, Zikui Cai, Hongjia Huang, Aayush Talreja, Tan Dat Dao, Yongyuan Liang, Jia-Bin Huang, Furong Huang

机构 * University of Maryland, College Park(马里兰大学 College Park分校)

AI总结 TraceGen通过3D轨迹空间实现跨躯体视频学习,利用紧凑的轨迹表示提升机器人任务学习效率与泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20703 2025-11-27 cs.CY cs.AI cs.LG

PropensityBench: Evaluating Latent Safety Risks in Large Language Models via an Agentic Approach

PropensityBench: 通过代理方法评估大语言模型中的潜在安全风险

Udari Madhushani Sehwag, Shayan Shabihi, Alex McAvoy, Vikash Sehwag, Yuancheng Xu, Dalton Towers, Furong Huang

机构 * University of North Carolina at Chapel Hill(北卡罗来纳大学教堂山分校) University of Texas at Austin(德克萨斯大学奥斯汀分校) University of Maryland, College Park(马里兰大学帕克分校)

AI总结 PropensityBench通过模拟危险能力评估大语言模型的潜在安全风险倾向,揭示模型在压力下可能选择高风险行为的倾向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.18570 2025-11-25 cs.CV cs.RO

PhysGS: Bayesian-Inferred Gaussian Splatting for Physical Property Estimation

PhysGS:基于贝叶斯推断的高斯点云法用于物理性质估计

Samarth Chopra, Jing Liang, Gershom Seneviratne, Dinesh Manocha

机构 * University of Maryland, College Park(马里兰大学学院公园分校) Stanford University(斯坦福大学)

AI总结 PhysGS通过贝叶斯推断结合视觉线索和语言先验,实现对物理属性的密集估计,提升质量、硬度和摩擦误差的准确性。

Comments Submitted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12491 2025-11-25 cs.LG

Cost-Aware Contrastive Routing for LLMs

面向成本的对比路由用于大语言模型

Reza Shirkavand, Shangqian Gao, Peiran Yu, Heng Huang

机构 * Department of Computer Science University of Maryland - College Park(计算机科学系大学马里兰大学-学院公园) Department of Computer Science Florida State University(计算机科学系佛罗里达州立大学) Department of Computer Science and Engineering University of Texas at Arlington(计算机科学与工程系德克萨斯大学阿灵顿分校)

AI总结 本文提出CSCR,一种轻量级框架,通过对比学习在共享嵌入空间中实现大语言模型的成本感知路由,提升准确率-成本权衡,同时具备鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.02595 2025-11-25 cs.RO

Extremum Seeking Controlled Wiggling for Tactile Insertion

极值寻求控制的触觉插入振动

Levi Burner, Pavan Mantripragada, Gabriele M. Caddeo, Lorenzo Natale, Cornelia Fermüller, Yiannis Aloimonos

机构 * Department of Electrical and Computer Engineering, University of Maryland, College Park(电气与计算机工程系,马里兰大学学院公园分校) Department of Computer Science, University of Maryland, College Park(计算机科学系,马里兰大学学院公园分校) Istituto Italiano di Tecnologia, Via San Quirico, 19 D, Genova, Italy(意大利理工学院,圣奎里科路19D号,热那亚,意大利) University of Maryland Institute for Advanced Computer Studies, University of Maryland, College Park(马里兰大学高级计算机研究 institute)

AI总结 本文提出了一种基于触觉反馈的极值寻求控制方法,用于提高机器人插入任务的鲁棒性和成功率。

Comments 8 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.03265 2025-11-25 cs.LG cs.AI

MindCraft: How Concept Trees Take Shape In Deep Models

MindCraft: 深度模型中概念树如何形成

Bowei Tian, Yexiao He, Wanghao Ye, Ziyao Wang, Meng Liu, Ang Li

机构 * University of Maryland, College Park(马里兰大学 College Park 分校)

AI总结 MindCraft通过概念树框架揭示深度模型中概念的层次结构和分离过程,为可解释AI提供新的分析方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20973 2025-11-24 cs.LG cs.CV

Model-Agnostic Gender Bias Control for Text-to-Image Generation via Sparse Autoencoder

面向文本到图像生成的模型无关性别偏见控制:通过稀疏自编码器

Chao Wu, Zhenyi Wang, Kangxian Xie, Naresh Kumar Devulapally, Vishnu Suresh Lokhande, Mingchen Gao

机构 * University at Buffalo, USA(美国布法罗大学) University of Maryland, College Park, USA(马里兰大学 College Park 分校)

AI总结 本文提出SAE Debias,通过稀疏自编码器在文本到图像生成中减轻性别偏见,提供可解释且模型无关的去偏方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.10219 2025-11-21 cs.CV cs.GR cs.LG

PUP 3D-GS: Principled Uncertainty Pruning for 3D Gaussian Splatting

PUP 3D-GS: 3D高斯散射的原理性不确定性修剪

Alex Hanson, Allen Tu, Vasu Singla, Mayuka Jayawardhana, Matthias Zwicker, Tom Goldstein

机构 * University of Maryland, College Park(马里兰大学学院公园分校)

AI总结 PUP 3D-GS通过原理性不确定性修剪技术,在更高压缩比下保持视觉质量和前景细节,提升渲染速度并优化图像质量。

Comments CVPR 2025, Project Page: https://pup3dgs.github.io/

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2025, pp. 5949-5958

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.18429 2025-11-19 cs.RO

HACL: History-Aware Curriculum Learning for Fast Locomotion

Prakhar Mishra, Amir Hossain Raj, Xuesu Xiao, Dinesh Manocha

机构 * University of Maryland, College Park, MD, USA(马里兰大学) George Mason University(乔治·玛森大学)

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.18966 2025-11-18 cs.CL

DataGen: Unified Synthetic Dataset Generation via Large Language Models

Yue Huang, Siyuan Wu, Chujie Gao, Dongping Chen, Qihui Zhang, Yao Wan, Tianyi Zhou, Jianfeng Gao, Chaowei Xiao, Lichao Sun, Xiangliang Zhang

机构 * University of Notre Dame(诺丁汉大学) Huazhong University of Science and Technology(华中科技大学) MBZUAI University of Washington(华盛顿大学) Peking University(北京大学) University of Maryland, College Park(马里兰大学学院市分校) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) Microsoft Research(微软研究院) Lehigh University(莱斯大学)

详情

展开后加载摘要…

URL PDF HTML 收藏