arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

共收录 203
2607.04423 2026-07-08 cs.CV cs.AI 新提交

Transferability Between Understanding and Generation in Unified Multimodal Models

统一多模态模型中理解与生成之间的可迁移性

Jiwon Kang, Heeji Yoon, Jaewoo Jung, Jaewon Min, Minkyeong Jeon, Biyeon Hwang, Sangwon Jung, Seungryong Kim

机构 * KAIST AI(韩国科学技术院人工智能研究所) Blynx(布林克斯公司) Trillionlabs(万亿实验室)

AI总结 研究统一多模态模型中理解与生成任务间的可迁移性,通过实验发现其依赖架构,据此提出实用训练策略,训练对应理解任务迁移至生成可提升性能并减少分布偏移。

Comments Accepted at ECCV 2026. Project Page: https://cvlab-kaist.github.io/UMM_Transferability/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03881 2026-07-07 q-bio.QM cs.LG 新提交

Smooth $\%$MinMax: A Differentiable Relaxation for Codon Harmonization

Smooth $\%$MinMax:一种用于密码子优化的可微松弛方法

Yoonho Jeong, Hyunwoo Choi, Ryan Fernandez Medina Hariri, Eok Kyun Lee, Seung Seo Lee, Insung S. Choi

机构 * Department of Chemistry, KAIST(韩国科学技术院化学系) School of Chemistry and Chemical Engineering, Highfield Campus, University of Southampton(南安普顿大学化学与化学工程学院)

AI总结 针对传统$\%$MinMax等密码子优化指标离散不可微、无法适配梯度驱动神经密码子设计的问题,提出Smooth $\%$MinMax可微松弛方法,实现两类密码子设计的衔接。

Comments 17 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04709 2026-07-07 cs.LG cs.CV 新提交

Hierarchical Scaffolding Enables Human-Like Cognitive Selectivity under Data Scarcity

分层脚手架在数据稀缺情况下实现类人认知选择性

Juhyoung Park, Jaehyuk Bae, Hyeonbo Yang, Se-Bum Paik

机构 * School of Computing(计算机学院) Department of Brain and Cognitive Sciences Korea Advanced Institute of Science and Technology(韩国科学技术院脑与认知科学系)

AI总结 受人类高效学习启发,引入基于认知心理学的分层学习框架SCALA,从粗概念结构引导模型到细粒度识别,有效提升数据稀缺时的准确率、泛化能力及新类别获取速度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04587 2026-07-07 cs.CV 新提交

RAF: Reliability-Aware Fusion of Camera, LiDAR, and 4D RADAR for Robust 3D Object Detection in Adverse Weather

RAF:用于恶劣天气下稳健3D目标检测的相机、激光雷达和4D雷达的可靠性感知融合

Heejun Park, Jaeseok Jeong, Kuk-Jin Yoon

机构 * Visual Intelligence Lab., KAIST(韩国科学技术院视觉智能实验室)

AI总结 针对恶劣天气下多传感器3D目标检测难题,提出RAF方法,通过明确监督像素可靠性估计,利用预训练网络,仅训练新增相机分支等,实验证明该方法有效提升检测精度。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.04356 2026-07-07 cs.LG 新提交

How Many Initial Points Does Bayesian Optimization Need?

贝叶斯优化需要多少初始点?

Mujin Cheon, James Odgers, Dong-Yeun Koh, Calvin Tsay

机构 * Korea Advanced Institute of Science & Technology (KAIST)(韩国科学技术院) HayanMind Inc.(哈扬思维公司) Technical University of Nuremberg (UTN)(纽伦堡工业大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) Helmholtz Munich(亥姆霍兹慕尼黑中心) Imperial College London(伦敦帝国理工学院)

AI总结 研究贝叶斯优化初始点数量选择问题,发现初始点数量与总成本呈U型关系,不同超参数和采集函数都存在此权衡,汤普森采样是例外,还给出实用建议。

Comments 4 pages. Accepted at the ICML 2026 Workshop on Decision-Making from Offline Datasets to Online Adaptation

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03990 2026-07-07 cs.CV 新提交

InSpace: Structure-Aware 3D Indoor Scene Generation from a Single 360° Image

InSpace:从单张360°图像生成具有结构感知的3D室内场景

Gwanhyeong Koo, Hyunsu Kim, Youngji Kim, Taejae Lee, Siwoo Lim, Sunjae Yoon, Suyong Yeon, Chang D. Yoo

机构 * KAIST(韩国科学技术院) NAVER LABS(NAVER实验室) Chung-Ang University(中央大学)

AI总结 针对单图像到3D生成扩展到室内场景有挑战的问题,提出InSpace框架,利用360°图像,经估计部分场景几何、生成粗结构、产生详细布局和资产几何三阶段,还建数据集,实验表明其性能强。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03971 2026-07-07 cs.LG cs.AI 新提交

Order-based Causal Discovery for Multistage Processes

多阶段过程的基于顺序的因果发现

Eun-Yeol Ma, Junsub Jung, Heeyoung Kim

机构 * Department of Industrial and Systems Engineering, Korea Advanced Institute of Science and Technology(韩国科学技术院工业与系统工程系)

AI总结 针对多阶段过程中现有因果发现方法的不足,提出基于顺序的因果发现方法OCDM。通过结合过程知识和新算法推断因果结构,并用新剪枝技术消除伪边,实验证明其优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03681 2026-07-07 cs.CL 新提交

Annotating Korean adnominal ending constructions in corpus data: Beyond relative-clause identification

语料库数据中韩语定语词尾结构标注:超越关系从句识别

Jungyeul Park, Chulwoo Park

机构 * KAIST(韩国科学技术院) Anyang University(安阳大学)

AI总结 研究韩语定语词尾ETM,指出它非关系从句结构直接标记,提出基于语料库的类型学,通过多种因素区分结构,以有序规则程序为依存句法树库实现标注层并验证,发现不能仅从形态识别关系从句修饰。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03012 2026-07-07 cs.CV cs.AI cs.LG 新提交

HyperVAttention: Efficient Sparse Attention with Spatio-Temporal Clustering for Video Diffusion

HyperVAttention:用于视频扩散的具有时空聚类的高效稀疏注意力

Dongyeun Lee, Amir Zandieh, Vahab Mirrokni, Junmo Kim, Insu Han

机构 * KAIST(韩国科学技术院) Google Research(谷歌研究院)

AI总结 针对视频扩散中自注意力机制的二次复杂度问题,提出HyperVAttention框架,通过3D局部窗口聚类等方法解决聚类开销大及CTA利用率低的瓶颈,提升视频扩散中无训练稀疏注意力的质量和速度。

Comments 21 pages, 8 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03005 2026-07-07 cs.LG stat.ME stat.ML 新提交

Transfer Learning in High-dimensional Ising Models

高维伊辛模型中的迁移学习

Joonho Kim, Seyoung Park

机构 * Graduate School of Artificial Intelligence, KAIST(韩国科学技术院人工智能研究生院)

AI总结 针对高维伊辛模型估计中目标样本量有限及利用未知相关辅助二元数据集困难的问题,提出迁移学习方法Trans-Ising,结合源筛选规则与两阶段估计程序,经理论分析和实验验证效果良好。

Comments Published as a conference paper at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02977 2026-07-07 cs.RO 新提交

Function-Space Diffusion for Motion Planning

用于运动规划的函数空间扩散

Zinuo Chang, Yipu Chen, Byoungwoo Park, Hongzhe Yu, Yongxin Chen

机构 * School of Electrical and Computer Engineering(电气与计算机工程学院) School of Aerospace Engineering, Georgia Institute of Technology(佐治亚理工学院航空航天工程学院) Korea Advanced Institute of Science and Technology(韩国科学技术院)

AI总结 研究提出函数空间扩散运动规划方法,将轨迹建模为连续函数在函数空间直接扩散,定义谱域正向过程,用基于离散正弦变换的傅里叶神经算子参数化反向过程,实现离散不变轨迹生成,提升规划性能。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02593 2026-07-07 cs.CV cs.CL 新提交

Token-level Response-visual Attention Guidance for Multimodal LLMs Knowledge Distillation

多模态大语言模型知识蒸馏的令牌级响应视觉注意力引导

Jaehyun Jang, Eunseop Yoon, Hee Suk Yoon, SooHwan Eom, Mark A. Hasegawa-Johnson, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) University of Illinois Urbana-Champaign(伊利诺伊大学厄巴纳-香槟分校)

AI总结 研究多模态大语言模型知识蒸馏,挑战传统依赖,发现下游性能与响应视觉注意力相似度强相关。提出令牌级响应视觉注意力引导方法,通过自适应加权散度,有效引导学生模型,实验证明其性能优于基线。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01885 2026-07-07 cs.CV 新提交

Diversity-aware View Partitioning for Scalable VGGT

面向可扩展VGGT的多样性感知视图划分

Jinsoo Park, Donggyu Choi, Ahyun Seo, Minsu Cho, Jeany Son

机构 * POSTECH(浦项科技大学) GIST(光州科学技术院) KAIST(韩国科学技术院) RLWRLD

AI总结 针对VGGT在大量视图下注意力计算成本高且冗余视图降低性能的问题,提出基于视觉差异和空间分散的图划分方法,将视图组织为多样性感知的平衡块,减少冗余注意力交互,提升相机位姿估计、多视图深度预测和3D重建性能。

Comments 34 pages, 11 figures, Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.27112 2026-07-07 cs.LG cs.AI 新提交

Heavy-Ball Q-Learning with Residual Weighting Correction

带残差加权修正的重球Q学习

Donghwan Lee

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院(KAIST))

AI总结 提出一种带残差加权修正的重球Q学习算法,基于切换线性系统与联合谱半径分析其收敛性,并证明在特定条件下比标准Q学习收敛更快,同时扩展到线性函数逼近情形。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.24633 2026-07-07 cs.RO 新提交

Beyond Monotonic Progress: Retry-Supervised Value Learning for Robot Imitation

超越单调进展:面向机器人模仿的重试监督值学习

Xinyao Qin, Junjie Lu, Kaixin Wang, Chuheng Zhang, Sinjae Kang, Kimin Lee, Min Xu, Bin Liang, Jun Yang, Li Zhao

机构 * Tsinghua University(清华大学) University of Technology Sydney(技术科技大学) Microsoft Research Asia(微软亚洲研究院) KAIST(韩国科学技术院)

AI总结 针对机器人模仿学习中演示数据包含错误与修正行为的问题,提出ReTVL框架,利用重试事件作为稀疏监督学习对错误敏感的值函数,通过全局进度校准与局部偏好学习捕捉错误-恢复结构,优化下游行为克隆。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.02403 2026-07-03 cs.RO cs.AI cs.CV 新提交

ACID: Action Consistency via Inverse Dynamics for Planning with World Models

ACID: 通过逆动力学实现行动一致性以用于世界模型规划

Gawon Seo, Dongwon Kim, Suha Kwak

机构 * POSTECH KAIST(韩国科学技术院)

AI总结 提出ACID框架,通过逆动力学模型引入循环行动一致性约束,改进基于世界模型的决策时规划,在多种任务中提升规划效果并降低计算成本。

Comments Project Page: [this https URL](https://gawon1224.github.io/ACID/)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.01675 2026-07-03 cs.CV 新提交

HistoSeg++: Delving deeper with attention and multiscale feature fusion for biomarker segmentation

HistoSeg++: 基于注意力与多尺度特征融合的生物标志物分割深入探索

Saad Wazir, Rao Faizan, Daeyoung Kim

机构 * School of Computing, KAIST(韩国科学技术院计算机学院) Kyung Hee University (Global Campus)(庆熙大学(全球校区))

AI总结 提出一种新型Nested-UNet架构,通过内外注意力单元和通道特征重校准增强多尺度信息捕获,结合边缘感知损失提升边界精度,在三个公开数据集上表现优于现有方法。

Comments Published in the Proceedings of ICBBE 2025. The Version of Record is available at https://doi.org/10.1145/3794209.3794211

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00595 2026-07-03 cs.CV 新提交

GADA: Geometry-Aware Deformable Aggregation for Image-Based Gaussian Splatting

GADA: 基于图像的高斯泼溅的几何感知可变形聚合

Siwoo Lim, Sunjae Yoon, Gwanhyeong Koo, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Chung-Ang University(中央大学)

AI总结 提出几何感知可变形聚合(GADA),通过可变形偏移迭代校正空间错位,并引入隐式置信加权机制抑制不可靠证据,在保持高频细节的同时实现2.13倍FPS提升。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31394 2026-07-03 cs.LG cs.AI cs.CV q-bio.QM 新提交

Resolving superposition in AI for interpretability and cross-modal alignment in patient-neuronal images

解决AI中的叠加问题以实现可解释性与患者-神经元图像的跨模态对齐

Jisung Park, Seohyeon Kang, Daeun Yoo, Eunsu Lee, Seoin Cho, Wooyeop Choi, Ian Choi, James R. Evan, Daesoo Kim, Sonia Gandhi, Minee L. Choi

机构 * KAIST(韩国科学技术院) Konyang University(建阳大学) Chang Gung University(长庚大学) UCL Queen Square Institute of Neurology & The Francis Crick Institute(伦敦大学学院皇后广场神经病学研究所与弗朗西斯·克里克研究所)

AI总结 利用稀疏自编码器解决高维生物数据中神经网络表示空间的叠加问题,恢复几何保真度,并通过Gromov-Wasserstein最优传输实现图像与单细胞RNA测序数据的跨模态对齐。

Comments 10 pages, 7 figures (plus 14 in appendix), 1 table, preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.22982 2026-07-03 cs.RO 新提交

Distilling Collaborative Dynamics into Latent Space for Implicit Coordination in Decentralized Multi-Agent Manipulation

将协作动态蒸馏到潜在空间以实现分散式多智能体操作中的隐式协调

Chanyoung Park, Minsung Yoon, Andrew Jeong, Sung-eui Yoon

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 提出CLS-DP分散式多智能体框架,通过将多智能体动态蒸馏到潜在空间,在部分可观测下实现隐式协调,无需全局视图或通信,在RoboFactory任务中平均成功率38%,优于集中式基线20%。

Comments Accepted to IROS 2026 | Project Page: https://cosdeneb.github.io/cls-dp/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00987 2026-07-02 cs.CV 新提交

AVSR-Diff: Scale-Agnostic Diffusion Priors for Temporally Consistent Arbitrary-Scale Video Super-Resolution

AVSR-Diff: 用于时间一致任意尺度视频超分辨率的尺度无关扩散先验

Geunhyuk Youk, Jeonghyeok Do, Dayeon Kim, Jihyong Oh, Munchurl Kim

机构 * KAIST(韩国科学技术院) CMLab, Chung-Ang University(中央大学CMLab)

AI总结 提出AVSR-Diff框架,通过解耦尺度无关的潜在去噪与连续坐标渲染,并引入时间门控特征循环和尺度感知傅里叶细化模块,实现任意尺度下的高保真时间一致视频超分辨率。

Comments Accepted to ECCV 2026. Project page: https://kaist-viclab.github.io/AVSR-Diff/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00889 2026-07-02 cs.CV cs.AI 新提交

DeWorldSG: Depth-Aware 3D Semantic Scene Graph Generation via World-Model Priors

DeWorldSG: 基于世界模型先验的深度感知3D语义场景图生成

Seok-Young Kim, Abdelrahman Elskhawy, Taewook Ha, Dooyoung Kim, Eunjae Shin, Benjamin Busam, Woontack Woo

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Technical University of Munich(慕尼黑工业大学) Munich Center for Machine Learning (MCML)(慕尼黑机器学习中心) La Trobe University(拉筹伯大学)

AI总结 提出DeWorldSG框架,通过深度引导滤波估计实例级3D高斯分布,并利用世界模型先验聚合时空证据,生成时空鲁棒的3D语义场景图,在对象和谓词预测上达到最先进性能。

Comments 19 pages, 6 figures, ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00581 2026-07-02 cs.LG 新提交

Decision-focused Sparse Tangent Portfolio Optimization

决策聚焦的稀疏切线投资组合优化

Haeun Jeon, Seunghoon Choi, Hyunglip Bae, Yongjae Lee, Woo Chang Kim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Chonnam National University(全南国立大学) Ulsan National Institute of Science and Technology(乌山科学技术院)

AI总结 提出端到端决策聚焦学习框架,通过可微凸优化层和平滑top-k算子直接优化投资组合性能,在四个主要股票市场取得优于基线的样本外夏普比率。

Comments ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00547 2026-07-02 cs.CV cs.AI 新提交

EgoGapBench: Benchmarking Egocentric Action Selection in Multi-Agent Scenes

EgoGapBench:多智能体场景中自我中心动作选择的基准测试

Jihyeok Jung, Jeewu Lee, Sanghyeop Kim, Chanhee Han, Seong Joon Oh

机构 * KAIST AI(韩国科学技术院人工智能研究所) Sogang University(成均馆大学) Ministry of Science and ICT(科学技术信息通信部)

AI总结 提出EgoGapBench基准,用于评估多智能体场景中的自我中心动作选择能力,发现多模态大语言模型表现远逊于人类,且现有自我中心数据微调无法弥合差距。

Comments 15 pages, 2 figures, 8 tables. Code and benchmark are available at https://github.com/jhCOR/EgoGapBench

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00525 2026-07-02 cs.CV 新提交

SPECSIA: Stylization Dataset for Novel-View Enhancement in Drawing-based 3D Animation

SPECSIA:用于基于绘图的3D动画中新颖视角增强的风格化数据集

Kyuwon Kim, Sunjae Yoon, Chang D. Yoo

机构 * School of Electrical Engineering, KAIST, Daejeon, Republic of Korea(韩国成均馆大学电子工程学院) Department of AI, Chung-Ang University, Seoul, Republic of Korea(韩国 Chung-Ang 大学人工智能系)

AI总结 提出SPECSIA-15K数据集和DraViE模块,通过数据先验去除新颖视角伪影,提升动画保真度和时间一致性,降低每角色适应成本。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00446 2026-07-02 cs.CV cs.AI 新提交

VideoSearch-R1: Iterative Video Retrieval and Reasoning via Soft Query Refinement

VideoSearch-R1: 通过软查询细化实现迭代视频检索与推理

Seohyun Lee, Seoung Choi, Dohwan Ko, Jongha Kim, Hyunwoo J. Kim

机构 * KAIST(韩国科学技术院) Korea University(高丽大学)

AI总结 提出VideoSearch-R1框架,通过软查询细化(SQR)在连续潜空间优化搜索查询,结合GRPO训练,实现大规模视频库的迭代检索与精确时序定位,性能达SOTA。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00409 2026-07-02 cs.CV 新提交

MedCAGD: Context-Aware Gated Decoder for Efficient Medical Image Segmentation

MedCAGD:用于高效医学图像分割的上下文感知门控解码器

Saad Wazir, Patrick Dominique Vibild, Dinh Phu Tran, Seongah Kim, Daeyoung Kim

机构 * School of Computing, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院计算学院) Department of Energy, Aalborg University(奥尔堡大学能源系)

AI总结 提出一种上下文感知门控解码器,通过轻量多尺度通道重校准、门控跳跃融合和全局上下文聚合机制,有效利用预训练编码器特征,在11个基准上优于强基线。

Comments Accepted at the European Conference on Computer Vision (ECCV 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00714 2026-07-02 cs.CL cs.AI 新提交

Self-conditioned Flow Map Language Models via Fixed-point Flows

自条件流映射语言模型通过不动点流

Jaehoon Yoo, Wonjung Kim, Floor Eijkelboom, Chanhyuk Lee, Nicholas M. Boffi, Seunghoon Hong, Jinwoo Kim

机构 * KAIST(韩国科学技术院) University of Amsterdam(阿姆斯特丹大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 提出不动点流框架,将自条件机制解释为不动点迭代,并设计二维流模型同时压缩迭代与流过程,实现少步生成,在OpenWebText上超越现有模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31329 2026-07-02 cs.RO cs.AI 新提交

3D HAMSTER: Bridging Planning and Control in Hierarchical Vision Language Action Models through 3D Trajectory Guidance

3D HAMSTER:通过3D轨迹引导在分层视觉语言动作模型中桥接规划与控制

Dongyoon Hwang, Byungkun Lee, Dongjin Kim, Hyojin Jang, Hoiyeong Jin, Jueun Mun, Minho Park, Hojoon Lee, Hyunseung Kim, Jaegul Choo

机构 * Kim Jaechul Graduate School of AI, KAIST(韩国科学技术院金载哲人工智能研究生院) Graduate School of Artificial Intelligence, POSTECH(浦项工业大学人工智能研究生院) KRAFTON AI

AI总结 提出3D HAMSTER框架,通过让规划器直接输出度量可靠的3D轨迹,弥合2D引导与3D低层策略之间的差距,在3D轨迹预测、仿真和真实操作中优于现有方法。

Comments Published in IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS) 2026. Code: https://github.com/DAVIAN-Robotics/3D_HAMSTER. Project page: https://davian-robotics.github.io/3D_HAMSTER/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.31825 2026-07-01 cs.CV cs.AI 新提交

Breaking Failure Cascades: Step-Aware Reinforcement Learning for Medical Multimodal Reasoning

打破失败级联:面向医学多模态推理的步骤感知强化学习

Junha Jung, Minbyul Jeong, Suhyeon Lim, Sungwook Jung, Jaehoon Yun, Taeyun Roh, Mujeen Sung, Jaewoo Kang

机构 * Korea University(高丽大学) Upstage AI Kyung Hee University(庆熙大学) KAIST(韩国科学技术院) Hanyang University College of Medicine(汉阳大学医学院) AIGEN Sciences

AI总结 提出步骤感知强化学习算法MRPO,通过为早期错误推理步骤分配指数级惩罚,打破失败级联,显著提升医学视觉问答准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏