arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Georgia Institute of Technology(佐治亚理工学院)

2026-03-20 至 2026-03-20 共收录 3
2603.19131 2026-03-20 cs.LG cs.RO

From Inference Efficiency to Embodied Efficiency: Revisiting Efficiency Metrics for Vision-Language-Action Models

从推理效率到具身效率:重新审视视觉-语言-动作模型的效率指标

Zhuofan Li, Hongkun Yang, Zhenyang Chen, Yangxuan Chen, Yingyan, Lin, Chaojian Li

机构 * Hong Kong University of Science and Technology(香港理工大学) Georgia Institute of Technology(佐治亚理工学院)

AI总结 本文重新审视视觉-语言-动作模型的效率指标,发现传统参数、FLOPs或token解码吞吐量无法反映机器人平台的实际表现,提出具身效率指标如任务完成时间、轨迹平滑度等,揭示传统方法在具身效率上的不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18448 2026-03-20 cs.LG

Seeking Universal Shot Language Understanding Solutions

寻找通用短语语言理解解决方案

Haoxin Liu, Harshavardhan Kamarthi, Zhiyuan Zhao, Hongjie Chen, B. Aditya Prakash

机构 * Georgia Institute of Technology(佐治亚理工学院) Dolby Laboratories(杜比实验室)

AI总结 本文提出SLU-SUITE框架,通过49万人工标注数据揭示VLM在SLU任务中的瓶颈,提出UniShot和AgentShots两种通用解决方案,实验显示在领域内任务优于专用模型,在领域外任务超越商业VLM。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18029 2026-03-20 cs.LG cs.AI

Engineering Verifiable Modularity in Transformers via Per-Layer Supervision

通过逐层监督在Transformer中工程化可验证的模ularity

J. Clayton Kerce

机构 * Georgia Tech Research Institute(佐治亚理工学院研究 institute)

AI总结 本文通过逐层监督和双流处理,揭示Transformer内部隐藏的模块化结构,实现对模型行为的更精确控制。

详情

展开后加载摘要…

URL PDF HTML 收藏