arXivDaily arXiv每日学术速递 周一至周五更新

AI 大模型

视觉大模型 / VLM

视觉语言模型、视觉推理、视觉问答、图文理解和视觉 grounding。

2026-07-16 至 2026-07-16 共收录 2 信号源:cs.CV, cs.AI, cs.LG

1. 其他VLM 2 篇

2604.06614 2026-07-16 cs.CV cs.LG 版本更新 62%

Holistic Optimal Label Selection for Robust Prompt Learning under Partial Labels

整体最优标签选择用于在部分标签下的鲁棒提示学习

Yaqi Zhao, Haoliang Sun, Yating Wang, Yongshun Gong, Yilong Yin

机构 * Shandong University, Jinan, China(山东大学(济南,中国))

专题命中 其他VLM :vision-language model(abstract);分类 cs.CV、cs.LG

AI总结 本文提出Holistic Optimal Label Selection方法,通过局部密度过滤和全局最优传输策略,提升部分标签下的提示学习性能,实验表明其在八个基准数据集上表现优异。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.13147 2026-07-16 cs.SI 新提交 50%

How You Ask Shapes What You Get: Auditing Breast-Cancer Misinformation in TikTok Search

你如何通过提问来获取信息:审核TikTok搜索中的乳腺癌错误信息

Pooriya Jamie, Homa Hosseinmardi, Rezvaneh Rezapour, Aria Pessianzadeh, Patricia A. Ganz, Amir Ghasemian

专题命中 其他VLM :vision-language model(abstract)

AI总结 研究TikTok搜索中用户查询框架对乳腺癌错误信息曝光的影响,通过受控实验发现查询框架与错误信息曝光紧密相关,替代医学查询错误信息返回率高,医学信息查询也有错误信息,强调审核查询驱动搜索系统的重要性。

详情

展开后加载摘要…

URL PDF HTML 收藏