arXivDaily arXiv每日学术速递 周一至周五更新

期刊&会议

European Conference on Computer Vision · 会议 · Computer Vision

2026-07-23 至 2026-07-23 共收录 8
2607.20357 2026-07-23 cs.CV 新提交

Look Less, Think Faster: Joint Token-Compute Adaptation for Multimodal LLMs

少看,快思考:多模态大语言模型的联合令牌-计算适配

Pengcheng Wang, Zhiquan Wang, Jayoung Lee, Zhuoyan Xu, Ran Xu, Saurabh Bagchi, Yin Li, Somali Chaterji

机构 * Purdue University(普渡大学) University of Wisconsin–Madison(威斯康星大学麦迪逊分校) NVIDIA(英伟达)

AI总结 针对多模态大语言模型推理成本高的问题,提出SmartVL框架,通过视觉侧令牌控制器和LLM侧计算控制器联合控制视觉令牌数量和模型计算能力,实验证明该框架优于先前方法,实现更好的精度-效率平衡。

Comments Accepted at ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19971 2026-07-23 cs.RO cs.CV 新提交

Unified Prediction and Planning via Conflict-Aware Disjoint Parameter Training

通过冲突感知不相交参数训练实现统一预测与规划

Taewon Seo, Seonae Jeon, Giwon Lee, Kuk-Jin Yoon, Daehee Park

机构 * DGIST(韩国科学技术院大邱庆北校区) KAIST(韩国科学技术院)

AI总结 研究社交机器人在拥挤环境中统一预测与规划问题,提出基于模型合并的不相交参数训练框架DPT,通过分布式参数学习减轻技能冲突,稀疏合并提升性能,在标准基准测试中验证其在机器人导航上通用且有效。

Comments Accepted at ECCV 2026. 38 pages, 14 figures. Project page: https://dpt2026.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19886 2026-07-23 cs.CV 新提交

MTVDiff: Multimodal Conditional Latent Diffusion for Enhanced Thermal-to-Visible Face Translation

MTVDiff:用于增强热红外到可见光面部翻译的多模态条件潜扩散

Zhiyuan Xia, Haojie Li, Jingyu Lin, Yiguo Qiao, Cunjian Chen

机构 * School of Computer Science and Engineering, Southeast University(东南大学计算机科学与工程学院) Key Laboratory of New Generation Artificial Intelligence Technology and Its Interdisciplinary Applications (Southeast University)(新一代人工智能技术及其交叉应用重点实验室(东南大学)) Monash University(莫纳什大学)

AI总结 针对热红外到可见光面部翻译的挑战,提出MTVDiff框架,通过双分支交叉注意力融合等三个核心技术,整合深度和文本信息,在多指标上优于现有方法,提升图像质量和面部验证性能,推动跨光谱面部图像翻译发展。

Comments Accepted by ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19826 2026-07-23 cs.CV 新提交

MoAKE: Toward Unified All-in-One Action Quality Assessment via Mixture of Action Knowledge Experts

MoAKE:通过动作知识专家混合实现统一的一体化动作质量评估

Huangbiao Xu, Huanqi Wu, Xiao Ke, Jiaxin Cai, Junyi Wu, Jinglin Xu

机构 * College of Computer and Data Science, Fuzhou University(福州大学计算机与数据科学学院) Fuzhou University(福州大学) Engineering Research Center of Big Data Intelligence, Ministry of Education(教育部大数据智能工程研究中心) School of Intelligence Science and Technology, University of Science and Technology Beijing(北京科技大学智能科学与技术学院) University of Science and Technology Beijing(北京科技大学)

AI总结 研究一体化动作质量评估难题,提出MoAKE框架,通过学习互补专家、定制原型及建模时间动态来减轻知识转移,在多数据集实验中显著优于现有方法,实现了零/少样本评估下的一致泛化。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19765 2026-07-23 cs.CV 新提交

Extending a Large View Synthesis Model for Multi-view Panoptic Segmentation

扩展用于多视图全景分割的大视图合成模型

Kwonyoung Ryu, In-Jae Lee, Jonghyun Jin, Hyunjee Lee, Jongmin Lee, Jaesik Park

机构 * POSTECH(浦项科技大学) POSCO DX(浦项制铁DX公司) Chung-Ang University(中央大学) Seoul National University(首尔国立大学)

AI总结 研究将大视图合成模型从外观渲染扩展到3D场景理解,提出复用冻结模型传播全景标签的分割管道,无需3D重建和特定训练,在ScanNet和Replica数据集上实验,分割质量佳且新视图合成表现优。

Comments Accepted to ECCV 2026. 31 pages, 7 figures, 9 tables. Project page: https://kwonyoung9120.github.io/PanopticLVSM/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19384 2026-07-23 cs.LG 新提交

SUM: Unified Geometric Surgery on Spatio-Temporal Adaptation Vectors for Federated Class Incremental Learning

SUM:用于联邦类增量学习的时空适应向量统一几何手术

Jaeik Kim, Jaeyoung Do

机构 * AIDAS Lab(AIDAS实验室) IPAI ECE, Seoul National University(首尔国立大学电子与计算机工程系)

AI总结 针对联邦类增量学习中时空干扰致灾难性遗忘问题,本文提出SUM框架,将其视为统一多任务学习,在聚合时对适应向量做几何手术,减轻客户端干扰与跨任务干扰,实验显示该方法在多基准测试中效果显著提升。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21618 2026-07-23 cs.CV 版本更新

4DGS360: 360° Gaussian Reconstruction of Dynamic Objects from a Single Video

4DGS360:从单个视频中进行动态物体的360度高斯重建

Jae Won Jang, Yeonjin Chang, Wonsik Shin, Juhwan Cho, Nojun Kwak

机构 * Seoul National University(首尔国立大学)

AI总结 本文提出4DGS360框架,通过3D原生初始化解决动态物体360度重建中的几何模糊问题,结合优化实现一致的4D重建,并引入iPhone360基准测试集验证方法有效性。

Comments Accepted to ECCV 2026. Project page: https://jaewon040.github.io/4dgs360/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.05865 2026-07-23 cs.CV cs.AI cs.CR 版本更新

CGCE: Classifier-Guided Concept Erasure in Generative Models

CGCE:生成模型中的分类器引导概念擦除

Viet Nguyen, Vishal M. Patel

机构 * Johns Hopkins University(约翰霍普金斯大学)

AI总结 研究针对生成模型不安全内容生成的问题,提出分类器引导概念擦除(CGCE)框架。该框架用轻量级分类器检测并细化不良概念提示,仅在推理时修改不安全嵌入,能防止有害内容生成,在安全性和性能间取得平衡,实验验证其有效性。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏