Bodhi VLM: Privacy-Alignment Modeling for Hierarchical Visual Representations in Vision Backbones and VLM Encoders via Bottom-Up and Top-Down Feature Search
Bodhi VLM:通过自上而下和自下而上的特征搜索实现视觉主干和VLM编码器中层次视觉表示的隐私对齐建模
机构 * Auckland University of Technology(奥克兰技术大学) ; Resideo Technologies, Inc.(Resideo技术公司) ; Guilin University of Electronic Technology(桂林电子科技大学) ; Universidad de Chile(智利大学)
专题命中 VLM训练与架构 :VLM(title,abstract);LLaVA(abstract);分类 cs.CV
AI总结 本文提出Bodhi VLM框架,通过NCP和MDAV聚类将敏感概念与分层神经表示的层间分组关联,并利用自上而下和自下而上的策略定位敏感特征区域,结合EMPA模块生成可解释的隐私预算对齐信号,验证了在目标检测和VLM视觉编码器中的有效性。