arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

University of Michigan(密歇根大学安娜堡分校)

2026-03-03 至 2026-03-03 共收录 7
2602.18873 2026-03-03 cs.CV cs.AI

BiMotion: B-spline Motion for Text-guided Dynamic 3D Character Generation

BiMotion: B-spline 动作 for 文本引导的动态 3D 人物生成

Miaowei Wang, Qingxuan Yan, Zhi Cao, Yayuan Li, Oisin Mac Aodha, Jason J. Corso, Amir Vaxman

机构 * University of Edinburgh(爱丁堡大学) Cornell University(康奈尔大学) University of Michigan(密歇根大学) Voxel51

AI总结 BiMotion 通过 B-spline 曲线生成高质量文本引导的动态 3D 人物动作,提升动作生成的表现力和质量。

Comments Accepted to CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04388 2026-03-03 cs.LG

Learning to Orchestrate Agents in Natural Language with the Conductor

通过指挥模型学习自然语言中的代理协调

Stefan Nielsen, Edoardo Cetin, Peter Schwendeman, Qi Sun, Jinglue Xu, Yujin Tang

机构 * Sakana AI, Japan(日本Sakana AI公司) University of Michigan, USA(美国密歇根大学) Institute of Science Tokyo, Japan(日本东京科学研究所)

AI总结 本文提出通过强化学习训练指挥模型,实现自然语言中代理的协调,展示其在推理基准测试中的卓越性能。

Comments To appear at the 14th International Conference on Learning Representations (ICLR 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19661 2026-03-03 cs.CV

CodeV: Code with Images for Faithful Visual Reasoning via Tool-Aware Policy Optimization

CodeV: 通过工具感知策略优化实现基于图像的代码推理

Xinhai Hou, Shaoyuan Xu, Manan Biyani, Moyan Li, Jia Liu, Todd C. Hollon, Bryan Wang

机构 * University of Michigan(密歇根大学) The Ohio State University(俄亥俄州立大学)

AI总结 CodeV通过工具感知策略优化提升视觉推理的忠实度,实现更高准确率和更可靠的工具使用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.19025 2026-03-03 cs.DB cs.CL

SQUiD: Synthesizing Relational Databases from Unstructured Text

从无结构文本合成关系数据库

Mushtari Sadia, Zhenning Yang, Yunming Xiao, Ang Chen, Amrita Roy Chowdhury

机构 * University of Michigan(密歇根大学)

AI总结 SQUiD通过神经符号框架从无结构文本自动合成关系数据库,优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00905 2026-03-03 cs.CV

pySpatial: Generating 3D Visual Programs for Zero-Shot Spatial Reasoning

pySpatial: 为零样本空间推理生成3D视觉程序

Zhanpeng Luo, Ce Zhang, Silong Yong, Cunxi Dai, Qianwei Wang, Haoxi Ran, Guanya Shi, Katia Sycara, Yaqi Xie

机构 * Carnegie Mellon University(卡内基梅隆大学) University of Pittsburgh(匹兹堡大学) University of Michigan(密歇根大学)

AI总结 pySpatial通过生成3D视觉程序,使大语言模型在无需微调的情况下实现零样本空间推理,并在基准测试和实际导航中表现出色。

Comments Accepted at ICLR 2026, Project Page: Our project: https://pySpatial.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00720 2026-03-03 cs.LG

MARS: Harmonizing Multimodal Convergence via Adaptive Rank Search

MARS: 通过自适应排名搜索实现多模态收敛的统一

Minkyoung Cho, Insu Jang, Shuowei Jin, Zesen Zhao, Adityan Jothi, Ethem F. Can, Min-Hung Chen, Z. Morley Mao

机构 * University of Michigan(密歇根大学) NVIDIA(英伟达)

AI总结 MARS通过自适应排名搜索优化多模态大语言模型微调,平衡训练动态并提升性能。

Comments 17 pages; Project Page: this https URL: https://minkyoungcho.github.io/mars/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00046 2026-03-03 cs.LG cs.AI

REMIND: Rethinking Medical High-Modality Learning under Missingness--A Long-Tailed Distribution Perspective

REMIND: 重新思考医疗多模态学习中的缺失性——从长尾分布视角

Chenwei Wu, Zitao Shuai, Liyue Shen

机构 * University of Michigan(密歇根大学)

AI总结 REMIND从长尾分布视角重新思考医疗多模态学习中的高模态缺失问题,提出组专用混合专家架构和分布鲁棒优化策略,有效提升尾部模态组合的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏