arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-05-01 至 2026-05-01 共收录 6
2604.27918 2026-05-01 cs.CV

Generate Your Talking Avatar from Video Reference

从视频参考生成您的对话人像

Zujin Guo, Zhenhui Ye, Yi Ren, Yuanming Li, Ce Chen, Zhibin Hong, Chen Change Loy

机构 * Nanyang Technological University(南洋理工大学) University of Melbourne(墨尔本大学) HeyGen Research(HeyGen研究院)

AI总结 本文提出TAVR框架,通过跨场景视频输入生成高保真的对话人像,采用三阶段训练方案提升跨场景适应性,并构建新基准测试集验证鲁棒性。

Comments Project Page: https://gseancdat.github.io/projects/TAVR

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27790 2026-05-01 cs.IR cs.AI cs.CL cs.CY cs.HC

How Generative AI Disrupts Search: An Empirical Study of Google Search, Gemini, and AI Overviews

生成式AI如何颠覆搜索:对谷歌搜索、吉米和AI概述的实证研究

Riley Grossman, Songjiang Liu, Michael K. Chen, Mike Smith, Cristian Borcea, Yi Chen

机构 * New Jersey Institute of Technology(新泽西理工学院) Nanyang Technological University(南洋理工大学) Indiana University Bloomington(印第安纳大学布卢明顿分校)

AI总结 本研究通过比较谷歌搜索、吉米和AI概述的搜索结果,发现生成式AI在信息检索中存在显著差异,影响网站可见性和内容质量。

Comments Paper Accepted to ACM SIGIR 2026 (49th International ACM SIGIR Conference on Research and Development in Information Retrieval)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.19528 2026-05-01 cs.LG cs.AI cs.DB

Revisiting RaBitQ and TurboQuant: A Symmetric Comparison of Methods, Theory, and Experiments

重新审视RaBitQ和TurboQuant:方法、理论和实验的对称比较

Jianyang Gao, Yutong Gou, Yuexuan Xu, Jifan Shi, Yongyi Yang, Shuolin Li, Raymond Chi-Wing Wong, Cheng Long

机构 * ETH Zurich(苏黎世联邦理工学院) Nanyang Technological University(南洋理工大学) University of Michigan(密歇根大学) Tsinghua University(清华大学) HKUST(香港科技大学)

AI总结 本文对比了RaBitQ和TurboQuant在方法、理论和实验证据上的表现,发现TurboQuant在内积估计、最近邻搜索和KV缓存量化任务中表现不如RaBitQ,并指出TurboQuant论文中的一些运行时间和召回率结果无法复现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27559 2026-05-01 cs.CV cs.AI

RIHA: Report-Image Hierarchical Alignment for Radiology Report Generation

RIHA:报告-图像层次对齐用于放射学报告生成

Yucheng Chen, Yang Yu, Yufei Shi, Conghao Xiong, Xulei Yang, Si Yong Yeo

机构 * Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李科钦医学院) MedVisAI Lab(医学影像人工智能实验室) Centre of AI in Medicine, Singapore(新加坡人工智能医学中心) Chinese University of Hong Kong, Hong Kong SAR, China(香港中文大学(深圳)) Department of Computer Science and Engineering(计算机科学与工程系)

AI总结 本文提出RIHA框架,通过多级对齐提升放射学报告生成的准确性,引入视觉和文本特征金字塔及跨模态对齐模块,实验表明其在自然语言生成和临床效果上优于现有方法。

Comments Accepted by Journal of Biomedical and Health Informatics (JBHI)

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27003 2026-05-01 cs.LG cs.AI

When Continual Learning Moves to Memory: A Study of Experience Reuse in LLM Agents

当持续学习转向记忆:对LLM智能体经验重用的研究

Qisheng Hu, Quanyu Long, Wenya Wang

机构 * Nanyang Technological University(南洋理工大学)

AI总结 研究揭示了内存增强型LLM智能体在持续学习中经验重用的问题,发现记忆检索时旧经验与新经验的竞争加剧了持续学习的瓶颈,提出了(k,v)框架以解耦外部记忆的设计关键要素。

Comments Working in progress

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12656 2026-05-01 cs.RO cs.LG

FeaXDrive: Feasibility-aware Trajectory-Centric Diffusion Planning for End-to-End Autonomous Driving

FeaXDrive: 为端到端自动驾驶的可行性感知轨迹导向扩散规划

Baoyun Wang, Zhuoren Li, Ran Yu, Yu Che, Xinrui Zhang, Ming Liu, Jia Hu, Chen Lv, Bo Leng

机构 * College of Automotive and Energy Engineering, Tongji University(同济大学汽车与能源工程学院) College of Transportation Engineering, Tongji University(同济大学交通工程学院) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院)

AI总结 FeaXDrive通过轨迹导向的扩散规划方法,提升自动驾驶中轨迹空间的可行性建模,改进轨迹几何和运动学可行性,增强可行驶区域一致性,实验表明其在NAVSIM基准上表现优异。

Comments 22 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏