arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

European Conference on Computer Vision · 会议 · Computer Vision

共收录 555
2606.24296 2026-06-24 cs.CV 新提交

Hierarchical Spatial and Channel Aggregation for Cross-domain Few-shot Segmentation

跨域小样本分割的分层空间与通道聚合

Sujun Sun, Mingwu Ren, Haofeng Zhang

机构 * School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) State Key Laboratory of Intelligent Manufacturing of Advanced Construction Machinery(先进工程机械智能制造国家重点实验室)

AI总结 提出双分层聚合网络(DHANet),通过分层空间聚合(HSA)和分层通道聚合(HCA)模块分别缓解语义过对齐和属性过对齐,并引入在线概率语义库(OPSB)增强支持信息,在四个目标域数据集上取得最优性能。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24165 2026-06-24 cs.CV 新提交

Spectral Evolution-Guided Token Pruning in Multimodal Large Language Models

多模态大语言模型中基于谱演化引导的令牌剪枝

Bin Chen, Yuxiang Cai, Yadan Luo, Yi Zhang, Jianwei Yin, Zhi Chen

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) Zhejiang Key Laboratory of Digital-Intelligence Service Technology(浙江省数字化服务技术重点实验室) The University of Queensland(昆士兰大学) Singapore Management University(新加坡管理大学) The University of Southern Queensland(南昆士兰大学)

AI总结 提出跨层谱演化(CLSE)框架,通过频域分析令牌表示在Transformer层间的演化来评估重要性,实现无训练剪枝,在保持性能的同时减少计算开销。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24156 2026-06-24 cs.CV 新提交

Accelerating Multimodal Large Language Models with Prior-Corrected Token Reduction

利用先验校正的令牌缩减加速多模态大语言模型

Zengjie Chen, Yuxiang Cai, Jingcai Guo, Taotao Cai, Jianwei Yin, Zhi Chen

机构 * School of Software Technology, Zhejiang University(浙江大学软件学院) Zhejiang Key Laboratory of Digital-Intelligence Service Technology(浙江省数字化服务技术重点实验室) Hong Kong Polytechnic University(香港理工大学) The University of Southern Queensland(南昆士兰大学)

AI总结 提出PriorTR方法,通过分离任务条件注意力与模型先验注意力,在单次前向传播中估计先验并校正令牌重要性,实现无训练令牌缩减,提升多模态大语言模型效率与准确性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24144 2026-06-24 cs.CV 新提交

Geometry-Aware Style Transfer in 3D Gaussian Splatting

3D高斯泼溅中的几何感知风格迁移

Min Hyeok Bang, Jun Hyeong Kim, Seung-Wook Kim, Se-Ho Lee

机构 * Department of Computer Science and Artificial Intelligence/Center for Advanced Image Information Technology, Jeonbuk National University(全北国立大学计算机科学与人工智能系/高级图像信息技术中心) Division of Electronic and Communication Engineering, Pukyong National University(釜庆国立大学电子与通信工程系)

AI总结 提出一种几何感知风格迁移框架,通过解耦优化交替更新颜色和几何参数,并利用几何感知对比特征匹配(GCFM)将风格图像的结构特征迁移到高斯基元,实现外观与几何结构的同步迁移。

Comments 14 pages, 7 figures, accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24101 2026-06-24 cs.RO cs.CV 新提交

NavWM: A Unified Navigation World Model for Foresight-Driven Planning

NavWM:一种用于前瞻性规划的统一导航世界模型

Yanghong Mei, Longteng Guo, Ming-Ming Yu, Guiyu Zhao, Xingjian He, Jing Liu

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) Beihang University(北京航空航天大学) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 提出NavWM统一导航世界模型,通过潜在世界令牌提取几何与语义先验,结合锚点多模态轨迹预测框架生成多样化动作空间,利用视觉前瞻评估最优路径,在多种机器人数据集上显著提升未来状态生成与零样本导航成功率。

Comments 13 pages, 5 figures, accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24072 2026-06-24 cs.CV 新提交

Fabric Image Demoiréing Benchmark from Synthesis to Restoration

织物图像去摩尔纹基准:从合成到恢复

Pengchao Wei, Xiaojie Guo

机构 * Tianjin University(天津大学)

AI总结 提出首个织物图像去摩尔纹基准,通过物理合成框架构建大规模数据集,并定制基线模型,解决织物摩尔纹因宽带半周期特性导致的去噪难题。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23950 2026-06-24 cs.CV 新提交

DivRL: Disentangled Self-Similarity Rewards for Diverse Subject-Driven Generation

DivRL: 解耦自相似性奖励用于多样化主题驱动生成

Qian Wang, Zhenyu Li, Abdelrahman Eldesokey, Peter Wonka

机构 * KAUST(阿卜杜拉国王科技大学)

AI总结 提出DivRL框架,通过解耦视觉特征中的负自相似性度量(nSSM)和视觉语义匹配(VSM),采用“探索-抑制”策略联合优化身份一致性与结构多样性,解决主题驱动生成中的身份-多样性悖论。

Comments Accepted to ECCV 2026. Project page: https://qianwangx.github.io/DivRL/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23917 2026-06-24 cs.CV 新提交

Trustworthy Image Authentication using Forensic Knowledge Graphs

使用取证知识图谱的可信图像认证

Tai D. Nguyen, Matthew C. Stamm

机构 * Drexel University(德雷塞尔大学)

AI总结 提出取证知识图谱(FKG)框架,通过结构化取证证据提取与推理实现可解释的图像伪造检测,优于现有检测器和视觉语言模型。

Comments Accepted and Published at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23872 2026-06-24 cs.LG cs.AI 新提交

MGI: Member vs Generated Inference

MGI:成员与生成推断

Bihe Zhao, Michel Meintz, Juangui Xu, Franziska Boenisch, Adam Dziedzic

机构 * CISPA Helmholtz Center for Information Security(CISPA亥姆霍兹信息安全中心)

AI总结 针对生成模型输出与训练样本难以区分的问题,提出MGI任务,并设计数据断路器(DCB)方法,结合自编码器和潜在生成器的互补信号,有效区分训练成员与生成样本。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22424 2026-06-24 cs.CV 新提交

FlowDec: Temporal Conditional Flow Decorruptor for Robust Continuous Vision-Language Navigation

FlowDec:用于鲁棒连续视觉-语言导航的时间条件流去污染器

Yufei Zhang, Changhao Chen

机构 * The Hong Kong University of Science and Technology (Guangzhou), China(香港科技大学(广州))

AI总结 提出FlowDec,一种针对LM-based VLN-CE的图像恢复框架,通过混合时间条件策略和动作质心引导滤波,在导航精度和生成延迟上超越现有去污染方法。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22314 2026-06-24 cs.LG cs.AI cs.CV 新提交

Diffusion Integrated Gradients: Controllable Path Generation for Flexible Feature Attribution

扩散积分梯度:用于灵活特征归因的可控路径生成

Soyeon Kim, Kyowoon Lee, Jaesik Choi

机构 * KAIST(韩国科学技术院) Ajou University(亚洲大学) INEEJI Corp.(INEEJI公司)

AI总结 提出扩散积分梯度(DiffIG),通过扩散模型生成路径并嵌入用户引导,实现灵活可控的特征归因,在定量和定性上优于现有方法。

Comments 44 pages, 22 figures, 10 tables. Accepted to ECCV 2026; includes appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22220 2026-06-24 cs.CV cs.AI cs.LG 新提交

MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning

MultiMem: 多模态对比学习中的记忆化测量与缓解

Wenhao Wang, Franziska Boenisch, Michael Backes, Adam Dziedzic

机构 * CISPA Helmholtz Center for Information Security(CISPA亥姆霍兹信息安全中心)

AI总结 提出首个多模态对比学习记忆化度量MultiMem,发现跨模态语义错位是主要驱动因素,文本模态影响最大,并通过跨模态增强有效降低记忆化并提升性能。

Comments Accepted at The 19th European Conference on Computer Vision (ECCV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.20189 2026-06-24 cs.CV cs.AI cs.RO 新提交

HilDA: Hierarchical Distillation with Diffusion for Advancing Self-Supervised LiDAR Pre-training

HilDA:利用扩散的分层蒸馏推进自监督LiDAR预训练

Maciej Wozniak, Jesper Ericsson, Hariprasath Govindarajan, Truls Nyberg, Thomas Gustafsson, Patric Jensfelt, Olov Andersson

机构 * KTH Royal Institute of Technology(瑞典皇家理工学院) Linköping University(林雪平大学) TRATON AB(TRATON公司) Qualcomm Auto Ltd Sweden Filial(高通汽车有限公司瑞典分公司)

AI总结 提出HilDA框架,通过分层蒸馏(多层蒸馏和全局上下文蒸馏)结合时间占用扩散目标,自监督预训练LiDAR骨干网络,在3D检测、场景流和语义占用预测任务上达到最先进水平。

Comments Accepted to ECCV 2026. Maciej and Jesper contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23200 2026-06-23 eess.IV cs.CV 新提交

NGPS: Structure-Preserving Self-Supervised Denoising via Neighbor-Guided Patch Sampling

NGPS:基于邻域引导的补丁采样的结构保持自监督去噪

Jaehyun Cho, YoungJoon Yoo

机构 * Department of Artificial Intelligence, Chung-Ang University(Chung-Ang大学人工智能系) SNUAILAB

AI总结 提出NGPS框架,通过邻域引导的补丁采样在局部错位下构建自监督去噪目标,无需显式配准,在CT和MRI上提升保真度和结构敏感指标。

Comments The 19th European Conference on Computer Vision: ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23679 2026-06-23 cs.CV cs.AI cs.GR cs.LG 新提交

Semantic Browsing: Controllable Diversity for Image Generation

语义浏览:图像生成的可控多样性

Sara Dorfman, Maya Vishnevsky, Omer Dahary, Or Patashnik, Daniel Cohen-Or

机构 * Tel Aviv University(特拉维夫大学)

AI总结 针对文本到图像模型生成多样性不足且缺乏语义结构的问题,提出一种在文本层面引入多样性的方法,通过视觉语言模型和代理工作流实现用户可导航的语义变化空间。

Comments ECCV 2026. Project page: https://saradorfman1.github.io/SemanticBrowsing-webpage/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23634 2026-06-23 cs.CV 新提交

Pose Anything Anywhere:Model-free Object Poses from Arbitrary References

Pose Anything Anywhere: 任意参考图像下的无模型物体姿态估计

Hongli Xu, Jiaqi Hu, Junwen Huang, Boyang Zhong, Peter KT Yu, Nassir Navab, Benjamin Busam, Slobodan Ilic

机构 * Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Siemens AG(西门子股份公司) XYZ Robotics ROBOX

AI总结 提出PANY,一种统一的无模型框架,通过多视图变换器学习视图一致几何和跨视图对齐,支持单/稀疏参考视图和RGB-D输入,在YCB-V和LM-O上分别提升姿态精度12%和20%以上。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23557 2026-06-23 cs.CV 新提交

Dense Reward for Multi-View 3D Reasoning with Global Maps and Local Views

基于全局地图与局部视图的多视角3D推理的密集奖励

Jiho Choi, Seonho Lee, Seojeong Park, Hyunjung Shim

机构 * Graduate School of Artificial Intelligence, KAIST, Republic of Korea(韩国科学技术院人工智能研究生院) KRAFTON, Republic of Korea(韩国KRAFTON公司)

AI总结 提出DR-MV3D框架,通过全局一致性奖励和局部轨迹奖励对多视角3D VQA的中间推理过程进行密集监督,提升跨视图推理一致性。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23539 2026-06-23 cs.CV 新提交

LightSTAR: Efficient Visual Document Retrieval via Lightweight Selection with Vision-Adaptive Refinement

LightSTAR: 通过视觉自适应精炼的轻量级选择实现高效视觉文档检索

Tongkun Guan, Haocheng Wang, Wei Shen, Xiaokang Yang

机构 * MoE Key Lab of Artificial Intelligence, AI Institute, School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学与工程学院人工智能研究院教育部人工智能重点实验室)

AI总结 提出LightSTAR框架,通过免LLM的视觉选择快速筛选候选页,再经视觉自适应语义精炼进行细粒度匹配,在保持高检索精度的同时大幅降低延迟。

Comments Accpeted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23486 2026-06-23 cs.CV 新提交

From Reconstruction to Decision: A Post-Encoder Plug-in Adapter for Curvilinear Segmentation

从重建到决策:面向曲线分割的后编码器即插即用适配器

Qin Lei, Jiang Zhong, Xin Xiao, Yuming Yang, Hao Wu

机构 * Center for Big Data and Intelligent Medicine, The First Affiliated Hospital of Chongqing Medical University(重庆医科大学附属第一医院大数据与智能医学中心) Key Laboratory of Digital Health and Intelligent Medicine, Chongqing Municipal Health Commission(重庆市卫生健康委员会数字健康与智能医学重点实验室) Chongqing Translational Medicine Center(重庆市转化医学中心) College of Computer Science, Chongqing University(重庆大学计算机学院)

AI总结 提出PEPA轻量级后编码器适配器,通过目标条件蛇形上采样和自适应可微阈值化解决曲线分割中的重建与决策瓶颈,在冻结编码器基础上提升拓扑连通性。

Comments accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23455 2026-06-23 cs.CV 新提交

MeGAS: Thermomechanical Dynamic Gaussian Splatting for Thermophysical Scene Editing

MeGAS: 用于热物理场景编辑的热力学动态高斯泼溅

Zesong Yang, Yuanhang Lei, Liyuan Cui, Yihang Chen, Jiaer Huang, Boming Zhao, Peter Yichen Chen, Hujun Bao, Zhaopeng Cui

机构 * State Key Laboratory of CAD\&CG, Zhejiang University(浙江大学计算机辅助设计与图形学国家重点实验室) University of British Columbia(不列颠哥伦比亚大学)

AI总结 提出MeGAS框架,将热力学相变动力学融入3D高斯泼溅,通过温度属性、热对流-扩散求解器和MPM动力学实现热物理现象的物理真实合成,并采用拓扑自适应渲染策略处理极端变形。

Comments Accepted by ECCV 2026. Project page: http://zju3dv.github.io/MeGAS

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23362 2026-06-23 cs.CR cs.CV 新提交

TooBad: Backdoor Diffusion Models with Ultra-Low Poison Rate and Imperceptible Trigger

TooBad: 超低投毒率和不可察觉触发器的后门扩散模型

Vu Tuan Truong, Long Bao Le

机构 * INRS, University of Quebec(INRS大学)

AI总结 提出TooBad框架,通过针对扩散模型的触发器优化技术,在极低投毒率(0.5%)下实现高攻击成功率(>85%),并保持高隐蔽性和实用性。

Journal ref ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.23129 2026-06-23 cs.CV cs.LG 新提交

Spectral Gating via Damped Oscillations for Adaptive Implicit Neural Representations

基于阻尼振荡的谱门控自适应隐式神经表示

Alex Costanzino, Pierluigi Zama Ramirez, Giuseppe Lisanti, Luigi Di Stefano

机构 * University of Bologna(博洛尼亚大学) Ca’ Foscari University of Venice(威尼斯大学)

AI总结 提出将神经元激活建模为受迫阻尼谐振子的稳态响应,通过联合优化振荡器参数和网络权重,实现自适应谱门控,无需显式正则化即可从粗到细学习。

Comments Accepted at ECCV 2026. Project Page: https://alex-costanzino.github.io/fdho/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22875 2026-06-23 cs.CV 新提交

FedOT: Ownership Verification and Leakage Tracing via Watermarks for Federated LDMs

FedOT: 联邦潜扩散模型的所有权验证与泄露追踪水印

Wenlong Cheng, Yuan Gan, Yunqiu Xu, Jiaxu Miao

机构 * Northwest Normal University(西北师范大学) The University of Tokyo(东京大学) National University of Singapore(新加坡国立大学) Sun Yat-sen University(中山大学)

AI总结 提出FedOT框架,通过分块水印和潜向量变换解决联邦学习中潜扩散模型的所有权验证与恶意客户端泄露追踪问题。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22749 2026-06-23 cs.CV 新提交

RaysUp: Ultra-light Universal Feature Upsampling via Geometry-Aware Ray Representation

RaysUp: 基于几何感知射线表示的超轻量通用特征上采样

Yuchuan Ding, Linfei Li, Lin Zhang, Ying Shen

机构 * School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

AI总结 提出RaysUp,一种超轻量、任务无关且VFM无关的特征上采样框架,通过几何感知射线域重建高分辨率特征图,在多种密集预测任务上以16%参数和7倍加速实现最先进性能。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22527 2026-06-23 cs.CV 新提交

Trajectory Forcing: Structure-First Generation with Controllable Semantic Trajectories

轨迹强制:具有可控语义轨迹的结构优先生成

Merve Kocabas, Gege Gao, Bernhard Schölkopf, Andreas Geiger

机构 * University of Tübingen(图宾根大学) ETH Zürich(苏黎世联邦理工学院) Max Planck Institute for Intelligent Systems(马克斯·普朗克智能系统研究所) ELLIS Institute(ELLIS研究所) Tübingen AI Center(图宾根人工智能中心)

AI总结 提出轨迹强制框架,将生成过程组织为从全局布局到细节的语义阶段,每个阶段产生可解码的潜在状态,支持局部编辑,实现结构优先的可控图像合成。

Comments Project page: https://mervekocabas.github.io/TrajectoryForcing/

Journal ref Proceedings of the European Conference on Computer Vision (ECCV), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22416 2026-06-23 cs.CV 新提交

Gen2Balance: Generative Balancing for Long-Tailed Video Action Recognition

Gen2Balance:面向长尾视频动作识别的生成式平衡方法

Prajwal Gatti, Simon Jenni, Fabian Caba Heilbron, Dima Damen

机构 * University of Bristol(布里斯托大学) Adobe Research(Adobe 研究院)

AI总结 提出Gen2Balance方法,利用文本到视频生成模型将长尾训练集平衡为真实与生成视频的混合,结合两阶段训练策略缓解域偏移,在长尾基准上显著提升动作识别准确率。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22383 2026-06-23 cs.CV cs.AI cs.LG 新提交

Structured Hyperedge Adaptation for Parameter-Efficient Fine-Tuning of Vision Transformers

结构化超边适应用于视觉Transformer的参数高效微调

Edwin Kwadwo Tenagyei, Lei Wang, Ugochukwu Ejike Akpudo, Jun Zhou, Yongsheng Gao

机构 * Griffith University(格里菲斯大学) Data61/CSIRO(Data61/澳大利亚联邦科学与工业研究组织)

AI总结 提出HyperAdapter,一种基于超图的适配器架构,通过软超边路由实现结构化、组感知的适应,在参数预算下优于现有PEFT方法。

Comments Accepted at the 19th European Conference on Computer Vision (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22378 2026-06-23 cs.CV 新提交

Following the Flow: Advection-Consistent Modeling for Event-based Small Object Detection

跟随流动:面向事件相机小目标检测的平流一致性建模

Wen Guo, Fulong Cai, Wuzhou Quan

机构 * School of Information and Electronic Engineering, Shandong Technology and Business University(山东工商学院信息与电子工程学院) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

AI总结 针对事件相机小目标检测中稀疏异步测量和噪声干扰导致预测碎片化的问题,提出物理引导的平流一致性建模框架PACT,通过沿估计速度场传播特征并施加轨迹级一致性约束,保留弱事件响应,在基准数据集上IoU提升20.72%,准确率提升15.03%。

Comments Accepted at ECCV 2026. Code: https://github.com/fulongcai/PACT

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22285 2026-06-23 cs.CV 新提交

Efficient Document Tampering Localization with Multi-Level Discrepancy Features and Unified DCT-Quantization Embedding

基于多级差异特征与统一DCT-量化嵌入的高效文档篡改定位

Mohamed Dhouib, Ye Zhu, Sonia Vanier, Aymen Shabou

机构 * LIX, École Polytechnique, IP Paris, France(LIX,巴黎综合理工学院,IP Paris,法国) DataLab Groupe, Crédit Agricole S.A., France(DataLab集团,法国农业信贷银行,法国)

AI总结 提出DiffNet,通过多级差异变换和轻量级DCT-量化联合嵌入,在跨域和人工篡改定位上性能提升约30%,吞吐量提高7倍。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22197 2026-06-23 cs.CV 新提交

Multi4D: High-Fidelity Dynamic Gaussian Splatting via Multi-Level Competitive Allocation

Multi4D: 通过多级竞争分配实现高保真动态高斯泼溅

Rui Wang, Quentin Lohmeyer, Siyu Tang, Mirko Meboldt

机构 * ETH Zürich(苏黎世联邦理工学院)

AI总结 提出Multi4D框架,通过三级竞争分配(静态结构、持久动态几何、瞬态外观)解决动态高斯泼溅中运动一致性与视觉保真度的矛盾,实现高保真渲染和实时性能。

Comments Accepted by ECCV 2026, project page:https://batfacewayne.github.io/Multi4D.io/

详情

展开后加载摘要…

URL PDF HTML 收藏