arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

共收录 1460
2607.03990 2026-07-07 cs.CV 新提交

InSpace: Structure-Aware 3D Indoor Scene Generation from a Single 360° Image

InSpace:从单张360°图像生成具有结构感知的3D室内场景

Gwanhyeong Koo, Hyunsu Kim, Youngji Kim, Taejae Lee, Siwoo Lim, Sunjae Yoon, Suyong Yeon, Chang D. Yoo

机构 * KAIST(韩国科学技术院) NAVER LABS(NAVER实验室) Chung-Ang University(中央大学)

AI总结 针对单图像到3D生成扩展到室内场景有挑战的问题,提出InSpace框架,利用360°图像,经估计部分场景几何、生成粗结构、产生详细布局和资产几何三阶段,还建数据集,实验表明其性能强。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03971 2026-07-07 cs.LG cs.AI 新提交

Order-based Causal Discovery for Multistage Processes

多阶段过程的基于顺序的因果发现

Eun-Yeol Ma, Junsub Jung, Heeyoung Kim

机构 * Department of Industrial and Systems Engineering, Korea Advanced Institute of Science and Technology(韩国科学技术院工业与系统工程系)

AI总结 针对多阶段过程中现有因果发现方法的不足,提出基于顺序的因果发现方法OCDM。通过结合过程知识和新算法推断因果结构,并用新剪枝技术消除伪边,实验证明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03681 2026-07-07 cs.CL 新提交

Annotating Korean adnominal ending constructions in corpus data: Beyond relative-clause identification

语料库数据中韩语定语词尾结构标注:超越关系从句识别

Jungyeul Park, Chulwoo Park

机构 * KAIST(韩国科学技术院) Anyang University(安阳大学)

AI总结 研究韩语定语词尾ETM,指出它非关系从句结构直接标记,提出基于语料库的类型学,通过多种因素区分结构,以有序规则程序为依存句法树库实现标注层并验证,发现不能仅从形态识别关系从句修饰。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03012 2026-07-07 cs.CV cs.AI cs.LG 新提交

HyperVAttention: Efficient Sparse Attention with Spatio-Temporal Clustering for Video Diffusion

HyperVAttention:用于视频扩散的具有时空聚类的高效稀疏注意力

Dongyeun Lee, Amir Zandieh, Vahab Mirrokni, Junmo Kim, Insu Han

机构 * KAIST(韩国科学技术院) Google Research(谷歌研究院)

AI总结 针对视频扩散中自注意力机制的二次复杂度问题,提出HyperVAttention框架,通过3D局部窗口聚类等方法解决聚类开销大及CTA利用率低的瓶颈,提升视频扩散中无训练稀疏注意力的质量和速度。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03005 2026-07-07 cs.LG stat.ME stat.ML 新提交

Transfer Learning in High-dimensional Ising Models

高维伊辛模型中的迁移学习

Joonho Kim, Seyoung Park

机构 * Graduate School of Artificial Intelligence, KAIST(韩国科学技术院人工智能研究生院)

AI总结 针对高维伊辛模型估计中目标样本量有限及利用未知相关辅助二元数据集困难的问题,提出迁移学习方法Trans-Ising,结合源筛选规则与两阶段估计程序,经理论分析和实验验证效果良好。

Comments Published as a conference paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02977 2026-07-07 cs.RO 新提交

Function-Space Diffusion for Motion Planning

用于运动规划的函数空间扩散

Zinuo Chang, Yipu Chen, Byoungwoo Park, Hongzhe Yu, Yongxin Chen

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) School of Aerospace Engineering, Georgia Institute of Technology(佐治亚理工学院航空航天工程学院) Korea Advanced Institute of Science and Technology(韩国科学技术院)

AI总结 研究提出函数空间扩散运动规划方法,将轨迹建模为连续函数在函数空间直接扩散,定义谱域正向过程,用基于离散正弦变换的傅里叶神经算子参数化反向过程,实现离散不变轨迹生成,提升规划性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02593 2026-07-07 cs.CV cs.CL 新提交

Token-level Response-visual Attention Guidance for Multimodal LLMs Knowledge Distillation

多模态大语言模型知识蒸馏的令牌级响应视觉注意力引导

Jaehyun Jang, Eunseop Yoon, Hee Suk Yoon, SooHwan Eom, Mark A. Hasegawa-Johnson, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究多模态大语言模型知识蒸馏,挑战传统依赖,发现下游性能与响应视觉注意力相似度强相关。提出令牌级响应视觉注意力引导方法,通过自适应加权散度,有效引导学生模型,实验证明其性能优于基线。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01885 2026-07-07 cs.CV 新提交

Diversity-aware View Partitioning for Scalable VGGT

面向可扩展VGGT的多样性感知视图划分

Jinsoo Park, Donggyu Choi, Ahyun Seo, Minsu Cho, Jeany Son

机构 * POSTECH(浦项科技大学) GIST(光州科学技术院) KAIST(韩国科学技术院) RLWRLD

AI总结 针对VGGT在大量视图下注意力计算成本高且冗余视图降低性能的问题,提出基于视觉差异和空间分散的图划分方法,将视图组织为多样性感知的平衡块,减少冗余注意力交互,提升相机位姿估计、多视图深度预测和3D重建性能。

Comments 34 pages, 11 figures, Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27112 2026-07-07 cs.LG cs.AI 新提交

Heavy-Ball Q-Learning with Residual Weighting Correction

带残差加权修正的重球Q学习

Donghwan Lee

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院(KAIST))

AI总结 提出一种带残差加权修正的重球Q学习算法,基于切换线性系统与联合谱半径分析其收敛性,并证明在特定条件下比标准Q学习收敛更快,同时扩展到线性函数逼近情形。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24633 2026-07-07 cs.RO 新提交

Beyond Monotonic Progress: Retry-Supervised Value Learning for Robot Imitation

超越单调进展:面向机器人模仿的重试监督值学习

Xinyao Qin, Junjie Lu, Kaixin Wang, Chuheng Zhang, Sinjae Kang, Kimin Lee, Min Xu, Bin Liang, Jun Yang, Li Zhao

机构 * Tsinghua University(清华大学) University of Technology Sydney(技术科技大学) Microsoft Research Asia(微软亚洲研究院) KAIST(韩国科学技术院)

AI总结 针对机器人模仿学习中演示数据包含错误与修正行为的问题,提出ReTVL框架,利用重试事件作为稀疏监督学习对错误敏感的值函数,通过全局进度校准与局部偏好学习捕捉错误-恢复结构,优化下游行为克隆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20216 2026-07-07 cs.AI cs.CE cs.CV cs.LG cs.RO

CostNav: A Navigation Benchmark for Real-World Economic-Cost Evaluation of Physical AI Agents

CostNav:一个用于现实世界经济成本评估的物理AI代理导航基准

Haebin Seong, Sungmin Kim, Yongjun Cho, Myunchul Joe, Geunwoo Kim, Yubeen Park, Sunhoo Kim, Samwoo Seong, Yoonshik Kim, Suhwan Choi, Jaeyoon Jung, Jiyong Youn, Jinmyung Kwak, Sunghee Ahn, Jaemin Lee, Younggil Do, Seungyeop Yi, Woojin Cheong, Minhyeok Oh, Minchan Kim, Seongjae Kang, Youngjae Yu, Yunsung Lee

机构 * KAIST(韩国国立科学技术院) University of California, Irvine(加州大学 Irvine 分校) Seoul National University(首尔国立大学)

AI总结 CostNav引入了一个经济导航基准,通过结合物理模拟和行业数据,评估AI代理的经济可行性,发现高任务成功率并不保证经济性,CANVAS在非零SLA合规性下表现最佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.04356 2026-07-07 cs.CV 版本更新

Stage-wise Attention-Guided Region Sequencing for Adversarial Attacks on Large Vision-Language Models

用于对大型视觉语言模型进行对抗攻击的逐阶段注意力引导区域排序

Jaehyun Kwak, Nam Cao, Boryeong Cho, Segyu Lee, Sumyeong Ahn, Se-Young Yun

机构 * KAIST(韩国科学技术院) KENTECH(KENTECH研究院)

AI总结 研究针对大型视觉语言模型的有针对性对抗攻击,基于注意力分析提出逐阶段注意力引导区域排序,介绍了黑盒区域排序框架SAGA,在多个模型上取得了最先进的攻击成功率和最佳不可感知性。

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.03024 2026-07-07 cs.CV 版本更新

SA-ResGS: Self-Augmented Residual 3D Gaussian Splatting for Next Best View Selection

SA-ResGS:用于下一个最佳视图选择的自增强残差3D高斯点云绘制

Kim Jun-Seong, Tae-Hyun Oh, Eduardo Pérez-Pellitero, Youngkyoon Jang

机构 * POSTECH(POSTECH大学) KAIST(韩国科学技术院) Huawei Noah’s Ark Lab(华为诺亚实验室) Rivian

AI总结 提出SA-ResGS框架,通过生成自增强点云稳定不确定性量化,增强不确定性感知监督。采用残差学习策略应对高斯分布监督不足问题,贡献包括物理视图选择策略、不确定性感知残差监督方案等,实验表明其性能优于基线。

Comments Accepted at ECCV 2026. Project page: https://saresgs.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05672 2026-07-07 cs.CV cs.AI cs.LG 版本更新

InverseCrafter: Efficient Video ReCapture as a Latent Domain Inverse Problem

InverseCrafter:作为潜在域逆问题的高效视频重新捕捉

Yeobin Hong, Suhyeon Lee, Hyungjin Chung, Jong Chul Ye

机构 * Graduate School of AI, KAIST, South Korea(韩国釜山国立大学人工智能研究生院) EverEx, South Korea(韩国EverEx公司) Korea University, South Korea(韩国国立庆熙大学)

AI总结 提出InverseCrafter框架,将新视角视频生成转化为潜在空间基于图像修复的逆问题,通过轻量级潜在掩码编码器建立算子等价,无需标注4D训练数据,实现高效合成与编辑。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05681 2026-07-07 cs.RO cs.AI cs.LG 版本更新

Verifier-free Test-Time Sampling for Vision-Language-Action Models

视觉语言动作模型的无验证测试时采样

Suhyeok Jang, Dongyoung Kim, Changyeon Kim, Youngsuk Kim, Jinwoo Shin

机构 * KAIST(韩国科学技术院) Seoul National University(首尔国立大学) RLWRLD

AI总结 针对视觉语言动作模型在高精度任务中的局限,提出无验证测试时缩放框架MG-Select,利用模型内部属性,通过参考动作令牌分布选最优动作,经联合训练改进参考分布,提升模型表现。

Comments Accepted to ICLR 2026. Project page: https://suhyeok-jang.github.io/mg-select/

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.12116 2026-07-07 cs.LG cs.AI cs.CL 版本更新

DynamixSFT: Dynamic Mixture Optimization of Instruction Tuning Collections

DynamixSFT:指令微调集合的动态混合优化

Haebin Shin, Lei Ji, Xiao Liu, Zhiwei Yu, Hyunwoo Yoo, Qi Chen, Yeyun Gong

机构 * University of Michigan(密歇根大学) Microsoft Research(微软研究院) KAIST AI(韩国科学技术院人工智能研究所) Drexel University(德雷塞尔大学)

AI总结 针对不断涌现的指令微调数据集,提出DynamixSFT动态自动优化方法。将问题转化为多臂老虎机设置,采用Prior-scaled Boltzmann Exploration和1-Step Look-ahead Reward更新采样概率,有效优化数据集并减少计算开销。

Comments ACL 2026 Findings

Journal ref Findings of the Association for Computational Linguistics: ACL 2026, pp. 39590-39603

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.20750 2026-07-07 cs.CV 版本更新

Enhanced Vision-Language Models for Diverse Sensor Understanding: Cost-Efficient Optimization and Benchmarking

增强视觉语言模型以理解多样传感器:成本高效的优化与基准测试

Sangyun Chung, Youngjoon Yu, Se Yeon Kim, Youngchae Chee, Yong Man Ro

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 提出传感器感知属性微调(SAFT)与多样负属性(DNA)优化,利用少量传感器数据克服RGB中心偏见,无需修改模型架构,显著提升非RGB传感器图像理解,并发布首个综合基准VS-TDX。

Comments The manuscript was posted before all internal disclosure and documentation checks were completed. We are withdrawing this version to avoid confusion while the authors complete the necessary review process

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02403 2026-07-03 cs.RO cs.AI cs.CV 新提交

ACID: Action Consistency via Inverse Dynamics for Planning with World Models

ACID: 通过逆动力学实现行动一致性以用于世界模型规划

Gawon Seo, Dongwon Kim, Suha Kwak

机构 * POSTECH KAIST(韩国科学技术院)

AI总结 提出ACID框架,通过逆动力学模型引入循环行动一致性约束,改进基于世界模型的决策时规划,在多种任务中提升规划效果并降低计算成本。

Comments Project Page: [this https URL](https://gawon1224.github.io/ACID/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01675 2026-07-03 cs.CV 新提交

HistoSeg++: Delving deeper with attention and multiscale feature fusion for biomarker segmentation

HistoSeg++: 基于注意力与多尺度特征融合的生物标志物分割深入探索

Saad Wazir, Rao Faizan, Daeyoung Kim

机构 * School of Computing, KAIST(韩国科学技术院计算机学院) Kyung Hee University (Global Campus)(庆熙大学(全球校区))

AI总结 提出一种新型Nested-UNet架构,通过内外注意力单元和通道特征重校准增强多尺度信息捕获,结合边缘感知损失提升边界精度,在三个公开数据集上表现优于现有方法。

Comments Published in the Proceedings of ICBBE 2025. The Version of Record is available at https://doi.org/10.1145/3794209.3794211

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00595 2026-07-03 cs.CV 新提交

GADA: Geometry-Aware Deformable Aggregation for Image-Based Gaussian Splatting

GADA: 基于图像的高斯泼溅的几何感知可变形聚合

Siwoo Lim, Sunjae Yoon, Gwanhyeong Koo, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Chung-Ang University(中央大学)

AI总结 提出几何感知可变形聚合(GADA),通过可变形偏移迭代校正空间错位,并引入隐式置信加权机制抑制不可靠证据,在保持高频细节的同时实现2.13倍FPS提升。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31394 2026-07-03 cs.LG cs.AI cs.CV q-bio.QM 新提交

Resolving superposition in AI for interpretability and cross-modal alignment in patient-neuronal images

解决AI中的叠加问题以实现可解释性与患者-神经元图像的跨模态对齐

Jisung Park, Seohyeon Kang, Daeun Yoo, Eunsu Lee, Seoin Cho, Wooyeop Choi, Ian Choi, James R. Evan, Daesoo Kim, Sonia Gandhi, Minee L. Choi

机构 * KAIST(韩国科学技术院) Konyang University(建阳大学) Chang Gung University(长庚大学) UCL Queen Square Institute of Neurology & The Francis Crick Institute(伦敦大学学院皇后广场神经病学研究所与弗朗西斯·克里克研究所)

AI总结 利用稀疏自编码器解决高维生物数据中神经网络表示空间的叠加问题,恢复几何保真度,并通过Gromov-Wasserstein最优传输实现图像与单细胞RNA测序数据的跨模态对齐。

Comments 10 pages, 7 figures (plus 14 in appendix), 1 table, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22982 2026-07-03 cs.RO 新提交

Distilling Collaborative Dynamics into Latent Space for Implicit Coordination in Decentralized Multi-Agent Manipulation

将协作动态蒸馏到潜在空间以实现分散式多智能体操作中的隐式协调

Chanyoung Park, Minsung Yoon, Andrew Jeong, Sung-eui Yoon

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 提出CLS-DP分散式多智能体框架,通过将多智能体动态蒸馏到潜在空间,在部分可观测下实现隐式协调,无需全局视图或通信,在RoboFactory任务中平均成功率38%,优于集中式基线20%。

Comments Accepted to IROS 2026 | Project Page: https://cosdeneb.github.io/cls-dp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.01564 2026-07-03 cs.LG math.AP math.OC math.PR 版本更新

Local exponential stability of mean-field Langevin descent-ascent and associated particle system

平均场Langevin下降-上升的局部指数稳定性及相关粒子系统

Geuntaek Seo, Minseop Shin, Pierre Monmarché, Beomjun Choi

机构 * Pohang University of Science and Technology(浦项科技大学) Korea Advanced Institute of Science and Technology(韩国科学技术院) Université Gustave Eiffel(古斯塔夫·埃菲尔大学)

AI总结 研究平均场Langevin下降-上升动力学在Wasserstein空间中的局部指数收敛性,证明混合纳什均衡具有稳健吸引域,且有限粒子系统继承该稳定性至指数时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00987 2026-07-02 cs.CV 新提交

AVSR-Diff: Scale-Agnostic Diffusion Priors for Temporally Consistent Arbitrary-Scale Video Super-Resolution

AVSR-Diff: 用于时间一致任意尺度视频超分辨率的尺度无关扩散先验

Geunhyuk Youk, Jeonghyeok Do, Dayeon Kim, Jihyong Oh, Munchurl Kim

机构 * KAIST(韩国科学技术院) CMLab, Chung-Ang University(中央大学CMLab)

AI总结 提出AVSR-Diff框架,通过解耦尺度无关的潜在去噪与连续坐标渲染,并引入时间门控特征循环和尺度感知傅里叶细化模块,实现任意尺度下的高保真时间一致视频超分辨率。

Comments Accepted to ECCV 2026. Project page: https://kaist-viclab.github.io/AVSR-Diff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00889 2026-07-02 cs.CV cs.AI 新提交

DeWorldSG: Depth-Aware 3D Semantic Scene Graph Generation via World-Model Priors

DeWorldSG: 基于世界模型先验的深度感知3D语义场景图生成

Seok-Young Kim, Abdelrahman Elskhawy, Taewook Ha, Dooyoung Kim, Eunjae Shin, Benjamin Busam, Woontack Woo

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) La Trobe University(拉筹伯大学)

AI总结 提出DeWorldSG框架,通过深度引导滤波估计实例级3D高斯分布,并利用世界模型先验聚合时空证据,生成时空鲁棒的3D语义场景图,在对象和谓词预测上达到最先进性能。

Comments 19 pages, 6 figures, ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00581 2026-07-02 cs.LG 新提交

Decision-focused Sparse Tangent Portfolio Optimization

决策聚焦的稀疏切线投资组合优化

Haeun Jeon, Seunghoon Choi, Hyunglip Bae, Yongjae Lee, Woo Chang Kim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Chonnam National University(全南国立大学) Ulsan National Institute of Science and Technology(乌山科学技术院)

AI总结 提出端到端决策聚焦学习框架,通过可微凸优化层和平滑top-k算子直接优化投资组合性能,在四个主要股票市场取得优于基线的样本外夏普比率。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00547 2026-07-02 cs.CV cs.AI 新提交

EgoGapBench: Benchmarking Egocentric Action Selection in Multi-Agent Scenes

EgoGapBench:多智能体场景中自我中心动作选择的基准测试

Jihyeok Jung, Jeewu Lee, Sanghyeop Kim, Chanhee Han, Seong Joon Oh

机构 * KAIST AI(韩国科学技术院人工智能研究所) Sogang University(成均馆大学) Ministry of Science and ICT(科学技术信息通信部)

AI总结 提出EgoGapBench基准,用于评估多智能体场景中的自我中心动作选择能力,发现多模态大语言模型表现远逊于人类,且现有自我中心数据微调无法弥合差距。

Comments 15 pages, 2 figures, 8 tables. Code and benchmark are available at https://github.com/jhCOR/EgoGapBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00525 2026-07-02 cs.CV 新提交

SPECSIA: Stylization Dataset for Novel-View Enhancement in Drawing-based 3D Animation

SPECSIA:用于基于绘图的3D动画中新颖视角增强的风格化数据集

Kyuwon Kim, Sunjae Yoon, Chang D. Yoo

机构 * School of Electrical Engineering, KAIST, Daejeon, Republic of Korea(韩国成均馆大学电子工程学院) Department of AI, Chung-Ang University, Seoul, Republic of Korea(韩国 Chung-Ang 大学人工智能系)

AI总结 提出SPECSIA-15K数据集和DraViE模块,通过数据先验去除新颖视角伪影,提升动画保真度和时间一致性,降低每角色适应成本。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00446 2026-07-02 cs.CV cs.AI 新提交

VideoSearch-R1: Iterative Video Retrieval and Reasoning via Soft Query Refinement

VideoSearch-R1: 通过软查询细化实现迭代视频检索与推理

Seohyun Lee, Seoung Choi, Dohwan Ko, Jongha Kim, Hyunwoo J. Kim

机构 * KAIST(韩国科学技术院) Korea University(高丽大学)

AI总结 提出VideoSearch-R1框架,通过软查询细化(SQR)在连续潜空间优化搜索查询,结合GRPO训练,实现大规模视频库的迭代检索与精确时序定位,性能达SOTA。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00409 2026-07-02 cs.CV 新提交

MedCAGD: Context-Aware Gated Decoder for Efficient Medical Image Segmentation

MedCAGD:用于高效医学图像分割的上下文感知门控解码器

Saad Wazir, Patrick Dominique Vibild, Dinh Phu Tran, Seongah Kim, Daeyoung Kim

机构 * School of Computing, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院计算学院) Department of Energy, Aalborg University(奥尔堡大学能源系)

AI总结 提出一种上下文感知门控解码器,通过轻量多尺度通道重校准、门控跳跃融合和全局上下文聚合机制,有效利用预训练编码器特征,在11个基准上优于强基线。

Comments Accepted at the European Conference on Computer Vision (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏