arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Michigan(密歇根大学安娜堡分校)

2026-03-31 至 2026-03-31 共收录 9
2603.27800 2026-03-31 cs.CV

Diversity Matters: Dataset Diversification and Dual-Branch Network for Generalized AI-Generated Image Detection

多样性至关重要:数据多样化与双分支网络用于通用的AI生成图像检测

Nusrat Tasnim, Kutub Uddin, Khalid Malik

机构 * Korea Aerospace University(韩国航空大学) University of Michigan-Flint(密歇根大学弗林特分校)

AI总结 本文提出Diversity Matters框架,通过数据多样性与特征域互补性提升AI生成图像检测的鲁棒性和泛化能力,采用双分支网络结合CLIP特征提升检测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.08673 2026-03-31 cs.CV

Thinking with Camera: A Unified Multimodal Model for Camera-Centric Understanding and Generation

通过摄像头思考:一个统一的多模态模型用于以摄像头为中心的理解与生成

Kang Liao, Size Wu, Zhonghua Wu, Linyi Jin, Chao Wang, Yikai Wang, Fei Wang, Wei Li, Chen Change Loy

机构 * S-Lab, Nanyang Technological University(南洋理工大学S-Lab) SenseTime Research(商汤科技研究院) University of Michigan(密歇根大学) Max-Planck Institute for Informatics(马克斯·普朗克信息学研究所)

AI总结 本文提出Puffin模型,通过将摄像头视为语言,实现以摄像头为中心的多模态理解与生成,结合语言回归和扩散生成,提升空间感知能力,实验表明其在跨视角任务中表现优异。

Comments Accepted by ICLR2026. Project Page: https://kangliao929.github.io/projects/puffin/

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.06233 2026-03-31 cs.CV

AnthroTAP: Learning Point Tracking with Real-World Motion

AnthroTAP: 通过真实世界运动学习点跟踪

Inès Hyeonsu Kim, Seokju Cho, Jahyeok Koo, Junghyun Park, Jiahui Huang, Honglak Lee, Joon-Young Lee, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能) Adobe Research(Adobe研究院) University of Michigan(密歇根大学) LG AI Research(LG人工智能研究院)

AI总结 AnthroTAP通过生成大规模伪标注点跟踪数据提升真实世界视频的点跟踪性能,利用人类运动的结构复杂性,结合SMPL模型和光流一致性过滤,实现优于现有方法的性能。

Comments CVPR 2026. Project Page: https://cvlab-kaist.github.io/AnthroTAP/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27663 2026-03-31 cs.CV

LiDAR for Crowd Management: Applications, Benefits, and Future Directions

激光雷达用于人群管理:应用、优势与未来方向

Abdullah Khanfor, Chaima Zaghouani, Hakim Ghazzai, Ahmad Alsharoa, Gianluca Setti

机构 * College of Computer Science and Information Systems, Najran University(纳吉兰大学计算机科学与信息系统学院) College of Innovation & Technology, University of Michigan-Flint(密歇根大学弗林特分校创新与技术学院) King Abdullah University of Science and Technology (KAUST)(阿卜杜拉国王科技大学)

AI总结 本文探讨了激光雷达在人群管理中的应用与优势,分析了其在隐私保护、恶劣天气适应性和三维建模方面的优势,并提出未来研究方向,包括数据集稀缺性、传感器融合与点云处理等。

Comments 8 pages, 5 figures, 1 table

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27143 2026-03-31 cs.CV cs.LG

Follow Your Heart: Landmark-Guided Transducer Pose Scoring for Point-of-Care Echocardiography

跟随你的内心:面向点即护理超声的标志引导换能器姿态评分

Zaiyang Guo, Jessie N. Dong, Filippos Bellos, Jilei Hao, Emily J. MacKay, Trevor Chan, Shir Goldfinger, Sethu Reddy, Steven Vance, Jason J. Corso, Alison M. Pouch

机构 * University of Pennsylvania(宾夕法尼亚大学) University of Michigan(密歇根大学) Central Michigan University(中密歇根大学)

AI总结 本文提出一种多任务网络,通过换能器姿态评分模块和不确定性强的左室标志检测器,自动估计左室射血分数,无需复杂设备即可指导A4CH视图获取。

Comments Accepted for oral presentation at the International Symposium on Biomedical Imaging 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.27056 2026-03-31 cs.CY cs.AI cs.LG

Persona-Based Simulation of Human Opinion at Population Scale

基于人设的大众意见模拟

Mao Li, Frederick G. Conrad

机构 * University of Michigan(密歇根大学) Institute for Social Research(社会研究所)

AI总结 本文提出SPIRIT框架,通过分析社交媒体数据构建人设,实现个体化模拟,提升对人口层面意见和干预效果的预测能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24569 2026-03-31 cs.CV

POLY-SIM: Polyglot Speaker Identification with Missing Modality Grand Challenge 2026 Evaluation Plan

POLY-SIM:基于缺失模态的多模态说话人识别挑战2026评估计划

Marta Moscati, Muhammad Saad Saeed, Marina Zanoni, Mubashir Noman, Rohan Kumar Das, Monorama Swain, Yufang Hou, Elisabeth Andre, Khalid Mahmood Malik, Markus Schedl, Shah Nawaz

机构 * Institute of Computational Perception, Johannes Kepler University Linz, Austria(林茨约翰·开普勒大学计算感知研究所) University of Michigan-Flint, USA(密歇根大学弗林特分校) Sapienza University of Rome, Italy(罗马大学) Mohamed bin Zayed University of Artificial Intelligence(穆罕默德·本·扎耶德人工智能大学) Fortemedia Singapore, Singapore(新加坡Fortemedia公司) IT:U Interdisciplinary Transformation University Austria(奥地利跨学科转型大学) University of Augsburg, Germany(奥格斯堡大学) Human-centered AI Group, AI Lab, Linz Institute of Technology, Austria(奥地利林茨理工学院人工智能实验室人本人工智能组)

AI总结 本文针对多模态说话人识别中缺失模态和跨语言条件下的鲁棒性问题,提出POLY-SIM 2026挑战,设计标准化基准和评估框架以推动更实用的系统发展。

Comments Grand challenge at ACM MM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22339 2026-03-31 cs.LG cs.CL stat.ML

Problems with Chinchilla Approach 2: Systematic Biases in IsoFLOP Parabola Fits

Chinchilla方法2的问题2:等效FLOP拟合中的系统性偏差

Eric Czech, Zhiwei Xu, Yael Elmatad, Yixin Wang, William Held

机构 * Open Athena AI Foundation(开放雅典娜AI基金会) Department of Statistics, University of Michigan, Ann Arbor(密歇根大学安娜堡分校统计系)

AI总结 本文研究了Chinchilla方法2在拟合神经网络扩展定律时的系统性偏差,指出其在无噪声合成数据中仍存在偏差,影响参数分配,并提出通过变量投影方法改进。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17288 2026-03-31 stat.ML cs.LG

Learning to Choose or Choosing to Learn: Best-of-N vs. Supervised Fine-Tuning for Bit String Generation

学习如何选择还是选择学习:Best-of-N与监督微调在位串生成中的比较

Seamus Somerstep, Vinod Raman, Unique Subedi, Yuekai Sun

机构 * University of Michigan(密歇根大学) Apple(苹果公司)

AI总结 本文通过位串生成问题比较监督微调与Best-of-N两种方法,发现监督微调在收敛速度上更优,而在不可实现情况下Best-of-N表现更佳。

Comments AISTATS 2026 Camera Ready

详情

展开后加载摘要…

URL PDF HTML 收藏