arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

共收录 203
2608.13159 2026-08-14 cs.CV cs.GR 新提交

Splat-based Metal Artifact Reduction in Cone-Beam CT via Polychromatic Modeling

基于多色建模的锥束CT中基于Splat的金属伪影减少方法

Kiseok Choi, Inchul Kim, Jaemin Cho, Hyeongjun Cho, Min H. Kim

机构 * KAIST(韩国科学技术院)

AI总结 提出一种集成多色X射线投影模型等的Gaussian Splatting框架,无需手动金属掩码,联合优化参数与光谱,发布相关数据集,在CBCT金属伪影减少上性能优于现有最优方法。

Journal ref Computer Graphics forum, Volume 45 (2026), Number 2

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.12158 2026-08-13 cs.CV 新提交

Context Blindness in DPO: Mitigating Object Hallucination in MLLMs via Context-Calibrated Preference Optimization

DPO中的上下文盲区:通过上下文校准的偏好优化缓解多模态大语言模型(MLLMs)中的物体幻觉

Byungoh Ko, Jinyoung Park, Jongha Kim, Jeehye Na, Jaewon Cho, Hyunwoo J. Kim

机构 * Korea University(高丽大学) KAIST(韩国科学技术院)

AI总结 本研究针对MLLMs的物体幻觉问题,提出C²-DPO方法,通过最大化上下文偏好增益降低幻觉率,使Qwen2-VL-Instruct-2B的幻觉率相对降低36%且不损害通用推理能力。

Comments Accepted at ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.11788 2026-08-13 cs.CL cs.AI 新提交

TELLME: Test-Enhanced Learning for Language Model Enrichment

TELLME:面向语言模型增强的测试增强学习

Minjun Kim, Inho Won, Hyeonseok Lim, MinKyu Kim, Junghun Yuk, Wooyoung Go, Jongyoul Park, Jungyeul Park, KyungTae Lim

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Seoul National University of Science and Technology(首尔科学技术大学) National Security Research Institute(国家安全研究院)

AI总结 本研究提出TELLME方法,将测试增强学习(TEL)原理与持续预训练(CPT)结合,缓解大语言模型领域自适应中数据与成本问题,在金融领域表现优于现有方法,长期记忆保留提升显著。

Comments Findings of the Association for Computational Linguistics: EACL 2026

Journal ref Findings of the Association for Computational Linguistics: EACL 2026, pages 1655-1677

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10920 2026-08-12 cs.AI 新提交

IO Factory: Simulating AI-Enabled Influence Campaigns at Scale

IO Factory:大规模模拟AI驱动的影响力行动

Lukasz Olejnik, Wenchao Dong, Jonas R. Kunst, Signe Riemer-Sørensen, Tobias Herb, Meeyoung Cha, Daniel Thilo Schroeder

机构 * King’s College London(伦敦国王学院) Max Planck Institute for Security and Privacy(马克斯·普朗克安全与隐私研究所) BI Norwegian Business School(挪威商学院) University of Oslo(奥斯陆大学) SINTEF Digital(SINTEF数字研究所) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 IO Factory是AI驱动的大规模影响力行动模拟框架,可在受控平台中关联多环节数据,在10万智能体配置下可执行行动并生成可检查证据,支持可重复研究与红队分析。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10864 2026-08-12 cs.CV 新提交

Multi-View Relational Distillation for Spatial Reasoning with Vision-Language Models

面向视觉语言模型空间推理的多视图关系蒸馏

Kiet T. Nguyen, Hanbo Shim, Jinwoo Kim, Seunghoon Hong

机构 * KAIST(韩国科学技术院)

AI总结 针对视觉语言模型空间推理的几何脆弱性问题,提出多视图关系蒸馏方法,在保留语言对齐的同时提升视觉空间推理性能,可泛化至3D场景理解任务。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.10030 2026-08-12 cs.AI cs.MA 新提交

Automating and Scaling Behavioral Scientific Research on AI Agents

自动化与规模化针对AI智能体的行为科学研究

Soo Yong Lee, Jongha Lee, Jaewan Chun, Hyunjin Hwang, Fanchen Bu, Ziv Ben-Zion, Taekwan Kim, Denny Borsboom, Jaemin Yoo, Kijung Shin

机构 * KAIST(韩国科学技术院) Yale(耶鲁大学) University of Haifa(海法大学) UCL(伦敦大学学院) UvA(阿姆斯特丹大学) SNU(首尔大学)

AI总结 研究人员开发AEROBAT多智能体系统,自动化AI智能体行为科学研究流程,经实验验证其可生成测试假设、开展大量对照实验与模拟,能补充拓展人工研究。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09484 2026-08-11 cs.RO 新提交

Graph-Guided Safe Diffuser: Topological Graph Guidance for Safe Diffusion Planning

图引导的安全扩散器:用于安全扩散规划的拓扑图引导

Nakgyu Yang, KwangBin Lee, SooJean Han

机构 * School of Electrical Engineering, Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院电气工程学院)

AI总结 该研究提出图引导的安全扩散器(G2SD)框架,用高层拓扑图规划器引导低层扩散模型,解决扩散规划器的流形破裂问题,在Maze2D导航等任务中大幅提升无碰撞目标到达率与任务性能。

Comments 18 pages, 2 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.09240 2026-08-11 cs.LG cs.AI 新提交

Multimodal Federated Learning under Dual-Axis Modality Missingness

双轴模态缺失下的多模态联邦学习

Adiba Orzikulova, Jaehyun Kwak, Jaemin Shin, Yunqi Guo, Xiaomin Ouyang, Guoliang Xing, Steven Euijong Whang, Sung-Ju Lee

机构 * KAIST(韩国科学技术院) CUHK(香港中文大学) HKUST(香港科技大学)

AI总结 针对多模态联邦学习的双轴模态缺失问题,提出Flux框架,通过模态感知置信度调温与梯度解耦私有适配,在四个多模态数据集上取得最高平均宏F1,性能优于最强基准

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.08066 2026-08-11 cs.CV eess.IV 新提交

EvBS: Event-guided Blur Synthesis for Domain-adaptive Motion Deblurring

EvBS:用于域自适应运动去模糊的事件引导模糊合成

Junsik Jung, Seokryun Choi, Yoonki Cho, Woo Jae Kim, Andrew Jeong, Sung-Eui Yoon

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

AI总结 本文提出事件引导模糊合成框架EvBS,通过解耦运动与内容生成多样训练对,提升预训练去模糊模型的域自适应性能,经多基准实验验证其可增强模型在未见测试集上的鲁棒性。

Comments Accepted to ACM Multimedia 2026 (ACM MM 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07923 2026-08-11 cs.CV cs.MM cs.SD 新提交

SCoPE: Training-Free Audio-Visual Event Perception via Sparse Cross-Modal Prior Exchange

SCoPE:基于稀疏跨模态先验交换的无训练视听事件感知

Jaemo Jeong, Junho Yoon, Hyunju Kim, Dongman Lee

机构 * KAIST(韩国科学技术院)

AI总结 针对无训练视听事件感知的虚假共激活问题,提出SCoPE框架,通过跨模态标签竞争消除FCA,在LLP等数据集上显著提升性能且可直接迁移。

Comments 17 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.07169 2026-08-10 cs.AI cs.LG 新提交

Agent Memory Distillation: Empowering Small LLM Agents with Hierarchical Teacher Memory

智能体记忆蒸馏:用分层教师记忆赋能小型大语言模型智能体

Taeil Kim, Kangsan Kim, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

AI总结 本研究提出无需训练的Agent Memory Distillation框架,通过从大型教师智能体构建三类分层记忆迁移知识,提升小型大语言模型智能体的工具使用性能,在三个基准上实现显著准确率提升且优于现有基线。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.06694 2026-08-10 cs.AI cs.MA 新提交

A Multi-Agent Framework for Automated Coarse-Grained Molecular Dynamics of Polymers

用于聚合物自动化粗粒度分子动力学的多智能体框架

Joohee Choi, Junhyeong Lee, Seunghwa Ryu

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院(KAIST))

AI总结 本文提出CGMas多智能体框架,可自动完成聚合物粗粒度分子动力学的拓扑构建等全流程,完成27项任务,22项密度匹配度在5%内,模拟时间大幅缩短,确立了智能体式LLM用于聚合物粗粒化的可行性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05975 2026-08-07 cs.RO cs.AI 新提交

TRACE: Learned Proprioceptive Odometry for Legged Robots under Unreliable Contact Conditions

TRACE:不可靠接触条件下四足机器人的学习式本体里程计

Taehyeon Kong, Woojin Kim, Jemin Hwangbo

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院(KAIST))

AI总结 本研究提出TRACE模型,通过引入足部感知交叉注意力模块等技术,结合策略随机化与部分现实微调,提升四足机器人在不可靠接触条件下的本体里程计性能,降低位置漂移并改善仿真到现实的迁移效果。

Comments 8 pages, 7 figures. Submitted to IEEE Robotics and Automation Letters (RA-L)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.05209 2026-08-07 cs.CV 新提交

MapTCL: Temporal Consistency Learning via Bidirectional Alignment for Vectorized HD Map Construction

MapTCL:用于矢量化高清地图构建的双向对齐时序一致性学习

Hyeonseo Kim, Juyeb Shin, Hyeonjun Jeong, Hiwon Shin, Dongsuk Kum

机构 * Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 针对动态城市环境下在线高清地图构建的时序稳定性问题,提出即插即用模块MapTCL,通过双向矢量一致性学习与栅格地图一致性学习联合训练,在两个基准上显著提升基线模型性能且无额外推理开销。

Comments Accepted at 2026 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS)

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04764 2026-08-06 cs.CV cs.GR 新提交

Splat-Based Metal Artifact Reduction in Cone-Beam CT via Compact Attenuation Modeling

基于样条的锥形束CT金属伪影消除方法:通过紧凑衰减建模实现

Kiseok Choi, Jaemin Cho, Inchul Kim, Min H. Kim

机构 * KAIST(韩国科学技术院)

AI总结 本文针对锥形束CT的金属伪影问题,提出基于样条的框架,将物理多能前向模型融入连续高斯表示,实现高效联合优化,实验显示其收敛更快、抑伪影效果更优。

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04752 2026-08-06 cs.CV cs.GR 新提交

Revisiting Pose Sensitivity in Splat-based Computed Tomography under Sparse-view Reconstruction

稀疏视图重建下基于Splat的计算机断层扫描中姿态敏感性的再探讨

Kiseok Choi, Hyeongjun Cho, Inchul Kim, Min H. Kim

机构 * KAIST(韩国科学技术院)

AI总结 本研究针对基于Splat的CT在实际稀疏视图下的伪影问题,分析其源于姿态不准确性,推导了联合优化几何参数的稳定梯度框架,提升了重建保真度且易于集成。

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.04737 2026-08-06 cs.CV cs.GR 新提交

Dense Metric Depth Completion from Sparse Direct Time-of-Flight Sensors

基于稀疏直接飞行时间传感器的密集度量深度补全

Hakyeong Kim, Ruicheng Wang, Chengtang Yao, Jiaolong Yang, Min H. Kim

机构 * KAIST(韩国科学技术院) USTC(中国科学技术大学) Microsoft Research Asia(微软亚洲研究院)

AI总结 本文提出一种深度引导双分支视觉Transformer框架,结合dToF模拟流程,实现稀疏dToF到密集度量深度的零样本泛化补全,性能优于现有方法且高效。

Journal ref Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01780 2026-08-04 cs.CV cs.AI 新提交

Investigating Social Bias in Narrative Image Generation

探究叙事图像生成中的社会偏见

Junyeong Park, Sowon Min, Euna Jang, Soobin Kim, Jiho Jin, Hyunseung Lim, Gahyeon Bae, Hwajung Hong

机构 * KAIST(韩国科学技术院)

AI总结 本研究将偏见评估框架BBG适配图像生成,对比6种T2I模型在照片、分镜、漫画生成中的偏见表现,发现叙事视觉形式中偏见更易显现,强调需用多样视觉形式评估T2I系统。

Comments Accepted to GenAI4World Workshop at COLM 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01724 2026-08-04 cs.CL cs.AI cs.HC 新提交

TIDES: A Longitudinal Bilingual Dataset for Modeling Multi-Party Social Dynamics

TIDES:用于建模多方社会动态的纵向双语数据集

Heechan Lee, Jeonggyu Kang, Junho Myung, Jaywoong Jeong, Juho Kim, Joseph Seering

机构 * KAIST(韩国科学技术院) SkillBench

AI总结 研究针对现有群体对话数据集无法捕捉团队长期社会动态的问题,推出TIDES纵向双语数据集,基于其微调模型提升下一个说话人预测性能,同时发现预测效果与话语自然度存在潜在不匹配。

Comments The first two authors hold equal contribution. Accepted to COLM 2026. Project website: https://tides.cstlab.org/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01556 2026-08-04 cs.LG cs.AI 新提交

Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning

基于组去偏联邦学习的偏好异质性下大语言模型个性化奖励建模反思

Seongyoon Kim, Boryeong Cho, Jihwan Oh, Seokhyun Chung, Se-Young Yun

机构 * Institute of Engineering Research, Korea University(韩国大学工程研究所) Kim Jaechul Graduate School of AI, KAIST(韩国科学技术院金在哲人工智能研究生院) Industrial Management Engineering, Korea University(韩国大学产业管理工程学院)

AI总结 该研究针对大语言模型个性化奖励建模的偏好异质性问题,提出FedGD方法,通过组去偏的客户端采样抵消组不平衡影响,实现无需预先知晓潜在组的有效个性化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29419 2026-08-03 cs.LG cs.AI 新提交

Explore Beyond the Boundary Using Entropic Information

利用熵信息探索边界之外

Bumgeun Park, Donghwan Lee

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

AI总结 针对强化学习中稀疏与延迟奖励的探索难题,本文提出ENTINEX方法,利用熵信息识别状态分布边界并分配内在奖励,实验表明其性能优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.29059 2026-08-03 cs.CV 新提交

Learning from Adversity: Semantic-Aware Mask Refinement through Adversarial Perturbation

从逆境中学习:通过对抗性扰动实现语义感知的掩码细化

Beomyoung Kim, Sung Ju Hwang

机构 * NAVER Cloud(NAVER云) KAIST(韩国科学技术院)

AI总结 提出Phoenix框架,用对抗学习生成语义噪声、对比学习建模细化关系,在图像分割掩码细化任务中性能优于现有方法,可提升先进分割模型。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.28164 2026-07-31 cs.CV cs.GR 新提交

S-Avatar: Diffusion-Guided Gaussian Head Avatars from a Single Image

S-Avatar:基于单张图像的扩散引导高斯头部化身

Hail Song, Seokhwan Yang, Jiwon Yang, Woojin Cho, Woontack Woo

机构 * KAIST(韩国科学技术院) KAIST KI-ITC ARRC(韩国科学技术院KI-ITC ARRC)

AI总结 S-Avatar通过三阶段流水线,结合扩散引导3DGS生成与FLAME控制,从单张图像生成高逼真3D头部化身,提升了3D一致性,在新视点和表情生成上优于现有方法,适用于VR/AR应用。

Comments 15 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.27296 2026-07-31 cs.SD cs.MM 新提交

SKY-Piano: A Multimodal Piano Performance Dataset

SKY-Piano:多模态钢琴演奏数据集

Joonhyung Bae, Dawon Park, Taegyun Kwon, Yoon-Seok Choi, Hyeon Hur, Satoshi Obata, Shigeru Kai, Yohei Wada, Yu Takahashi, Akira Maezawa, Jaebum Park, Jonghwa Park, Juhan Nam

机构 * Seoul National University(首尔大学) KAIST(韩国科学技术院) Yamaha(雅马哈)

AI总结 该研究发布SKY-Piano多模态钢琴演奏数据集,含多类数据及标注工具,通过微调实验验证其用于MIDI到动作生成的可用性。

Comments Accepted to the 27th International Society for Music Information Retrieval Conference (ISMIR 2026), Abu Dhabi, UAE. Project page: https://joonhyungbae.github.io/skypiano/

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.26481 2026-07-30 cs.LG eess.SP 新提交

Conformal Changepoint Localization and Root Cause Analysis with Corrupted Observations

含损坏观测值的保序变点定位与根因分析

Seunghun Yu, Meiyi Zhu, Petar Popovski, Joonhyuk Kang, Osvaldo Simeone

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) King’s College London(伦敦国王学院) Aalborg University(奥尔堡大学) Northeastern University London(伦敦东北大学)

AI总结 本文针对含损坏观测值的系统,提出加权CONCH与加权CROC方法,结合元学习优化权重,可在保证置信集目标覆盖率的前提下缩小其规模,提升变点定位与根因分析的实用性。

Comments 34 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25565 2026-07-29 cs.CV 新提交

ReDesign: Recovering Editable Design Structures from Images via Agentic Decomposition

ReDesign:通过智能分解从图像中恢复可编辑设计结构

Jooyeol Yun, Jintae Park, Hyesu Lim, Junha Hyung, Hyungjin Chung, Jaegul Choo

机构 * KAIST AI(韩国科学技术院人工智能研究所) Helmholtz Munich(慕尼黑亥姆霍兹中心) Korea University(韩国大学)

AI总结 研究旨在从图像恢复可编辑设计文件,提出ReDesign智能框架,通过跨模态选工具生成层层次结构,引入优雅验证与评估基准,在视觉保真度和编辑性上表现出色,超越基线和管道。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.25292 2026-07-29 cs.AI 新提交

Instruction-Tuned Language Models Cannot Sample from Distributions They Can Describe

指令微调语言模型无法从它们能描述的分布中进行采样

Chaemin Jang, Dongman Lee, Jihee Kim

机构 * School of Computing, KAIST(韩国科学技术院计算学院) School of Business and Technology Management, KAIST(韩国科学技术院商业与技术管理学院)

AI总结 研究发现指令微调语言模型无法从其能描述的分布中采样,存在“知道/做”分裂,通过让模型描述分布可减半误差,还提出PPA在无额外成本下降低21%误差。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.23268 2026-07-28 cs.RO 新提交

Sling2Sim2Real: One-Shot Elastic System Identification for Non-Destructive Slingshot Policy Learning

Sling2Sim2Real:用于无损弹弓策略学习的一次性弹性系统识别

Wonjae Kang, Geonwoo Kim, Minseok Song, Daehyung Park

机构 * School of Computing, Korea Advanced Institute of Science and Technology(韩国科学技术院计算机学院)

AI总结 针对弹性物体操纵中校准现实与模拟弹性行为的挑战,提出Sling2Sim2Real框架;通过多起点Real2Sim系统识别方法及模拟策略学习等,从单次无损交互识别弹性参数,实现准确策略学习与稳健泛化,减少现实交互量。

Comments Accepted by IROS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21371 2026-07-24 cs.CV cs.AI 新提交

DINOde: Continuous Vision-Text Alignment for Open-Vocabulary Semantic Segmentation

DINOde:用于开放词汇语义分割的连续视觉-文本对齐

Sung-Hoon Yoon, Hoyong Kwon, Changgyoon Oh, Kuk-Jin Yoon

机构 * Multimodal Intelligence and Perception Lab., DGIST(多模态智能与感知实验室,大邱庆北科学技术院) Visual Intelligence Lab., KAIST(视觉智能实验室,韩国科学技术院)

AI总结 研究针对开放词汇语义分割中视觉与文本对齐问题,提出基于ODE的DINOde框架,通过语义文本流和全局上下文流、速度切向投影等组件,连续对齐视觉与文本,实验证明该方法优于现有方法,性能达领先水平。

Comments Accepted to ECCV 2026. 27 pages, 8 figures, and 10 tables. Includes supplementary material

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.21179 2026-07-24 cs.CV 新提交

Out of Sight, Still in Mind: Token Compression for Omni-LLMs

视而不见,仍记于心:全模态大语言模型的令牌压缩

Suho Yoo, Youngjoon Jang, Hyebin Cho, Joon Son Chung

机构 * KAIST(韩国科学技术院) VGG, University of Oxford(牛津大学视觉几何组)

AI总结 研究旨在降低Omni-LLMs推理时输入令牌成本,提出无需训练的ReMo框架,通过跨模态重分配信息压缩视觉令牌,在Qwen2.5-Omni上实验,去除54%输入令牌且准确率无损失,甚至略超全令牌模型。

Comments Preprint

详情

展开后加载摘要…

URL PDF HTML 收藏