arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

2026-07-10 至 2026-07-10 共收录 3
2607.08236 2026-07-10 cs.CV 新提交

TVTA: Trajectory-Aware Viseme-Guided Temporal Aggregation for Event-Based Lip Reading

TVTA:基于轨迹感知的视素引导的基于事件的唇读时间聚合

Jingrong Zheng, Hongwei Ren, Xiangqian Wu

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 针对基于事件唇读方法的局限,提出时间增强框架,引入轨迹感知差分聚合、视素引导聚合及指数移动平均师生训练策略,在DVS-Lip基准上验证有效性,消融研究验证各部分贡献,定性结果表明学到有意义视素感知结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07287 2026-07-10 cs.RO 新提交

TouchWorld: A Predictive and Reactive Tactile Foundation Model for Dexterous Manipulation

TouchWorld:一种用于灵巧操作的预测性和反应性触觉基础模型

Jianyi Zhou, Feiyang Hong, Yunhao Li, Yicheng Zhao, Yongjue Cen, Zirui Liu, Jiakang Huang, Zirui Chen, Ruiyang Zhang, Weizhuo Zhu, Xuhua Song, Shuo Yang

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) PHANES AI(PHANES人工智能公司)

AI总结 研究针对日常环境中灵巧操作需预测与反应的问题,提出TouchWorld模型。该模型采用分层策略,分离多项任务。通过将触摸用于预测和反馈,提升局部接触适应性。在六个相关任务中表现出色,超越最强基线。

详情

展开后加载摘要…

URL PDF HTML 收藏
2202.13142 2026-07-10 cs.CV 版本更新

Real-World Blind Super-Resolution via Feature Matching with Implicit High-Resolution Priors

通过与隐式高分辨率先验进行特征匹配实现真实世界的盲超分辨率

Chaofeng Chen, Xinyu Shi, Yipeng Qin, Xiaoming Li, Xiaoguang Han, Tao Yang, Shihui Guo

机构 * School of Informatics, Xiamen University(厦门大学信息学院) School of Computer Science(计算机科学学院) Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院) DAMO Academy, Alibaba Group(阿里巴巴集团达摩院) SSE, The Chinese University of Hong Kong(香港中文大学(深圳)SSE)

AI总结 针对现实世界图像超分辨率难题,提出FeMaSR方法,在紧凑特征空间通过匹配LR与HR图像特征及解码来恢复逼真HR图像,利用预训练HR先验、语义正则化及残差连接,实验显示其效果优于以往方法。

Comments Fix training details and some typos

详情

展开后加载摘要…

URL PDF HTML 收藏