arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

共收录 1464
2605.29703 2026-05-29 q-bio.NC cs.CV q-bio.TO

Subcortical Shape Variations and Their Associations with Cognition Across the 8th Decade of Life. A Study in the Lothian Birth Cohort 1936

皮层下形状变化及其与第八个十年生命期认知的关联:洛锡安出生队列1936研究

Maria del C. Valdes-Hernandez, Wonjung Park, Joanna Moodie, Susana Muñoz Maniega, Janie Corley, Fraser N. Sneden, Mark E. Bastin, Joanna M. Wardlaw, Simon R. Cox, Jinah Park

机构 * Department of Neuroimaging Sciences(神经影像科学系) University of Edinburgh(爱丁堡大学) Computer Graphics and Visualization Laboratory(计算机图形与可视化实验室) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院) Department of Psychology(心理学系) Edinburgh Futures Institute(爱丁堡未来研究所)

AI总结 利用洛锡安出生队列1936的纵向数据,通过ANCOVA和混合线性模型分析,研究第八个十年中皮层下结构的形状变化及其与认知老化的关联。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29613 2026-05-29 eess.AS cs.SD

Decoding Strategies for Diffusion-Based ASR: A Systematic Evaluation of Confidence-Based Thresholding

基于扩散的ASR解码策略:基于置信度阈值的系统评估

Jeong Hun Yeo, Minsu Kim, Hyeongseop Rha, Yong Man Ro

机构 * KAIST(韩国科学技术院) Google DeepMind(谷歌DeepMind)

AI总结 本文系统评估了基于扩散语言模型的ASR中三种解码策略,提出使用基于负对数似然的不确定性度量来监控解码进度,发现基于阈值的策略在准确率和速度上均优于固定步数策略,其中静态阈值策略在匹配自回归解码准确率的同时具有更高效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05964 2026-05-29 cs.LG

Uncertainty Estimation via Hyperspherical Confidence Mapping

基于超球面置信映射的不确定性估计

Eunseo Choi, Ho-Yeon Kim, Jaewon Lee, Taeyong jo, Myungjun lee, Heejin Ahn

机构 * KAIST(韩国科学技术院) Samsung Electronic Co., Ltd(三星电子有限公司)

AI总结 提出超球面置信映射(HCM),通过将输出分解为幅度和归一化方向向量并利用几何约束违反程度实现无采样、无分布假设的不确定性估计,在回归和分类任务中匹配或超越集成与证据方法且推理成本更低。

Comments Accepted at ICLR 2026. 24 pages, 7 figures, including appendix. Updated references

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.11171 2026-05-29 cs.CL cs.AI

A Language-Guided Bayesian Optimization for Efficient LoRA Hyperparameter Search

语言引导的贝叶斯优化用于高效LoRA超参数搜索

Baek Seong-Eun, Lee Jung-Mok, Kim Sung-Bin, Tae-Hyun Oh

机构 * Grad. School of AI, POSTECH, Pohang, Korea(POSTECH人工智能研究生院,韩国坡安) School of EE, KAIST, Daejeon, Korea(韩国科学技术院电子工程学院,韩国大田) School of Computing, KAIST, Daejeon, Korea(韩国科学技术院计算学院,韩国大田)

AI总结 提出一种利用预训练LLM领域知识的贝叶斯优化框架,通过语言提示将超参数映射到连续空间,结合子集训练代理评估,仅需约30次迭代即可发现比标准超参数提升20%以上性能的LoRA超参数。

Comments Accepted at ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.02069 2026-05-29 cs.LG stat.ML

Neural Logistic Bandits

神经逻辑老虎机

Seoungbin Bae, Dabeen Lee

机构 * Department of Industrial \& Systems Engineering, KAIST Department of Mathematical Sciences \& Research Institute of Mathematics, Seoul National University Interdisciplinary Program in Artificial Intelligence, Seoul National University

AI总结 针对神经逻辑老虎机问题,利用一种新型的自归一化向量值鞅的Bernstein型不等式,提出两种算法NeuralLog-UCB-1和NeuralLog-UCB-2,分别实现与有效维度相关的遗憾上界,改进了现有结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29577 2026-05-29 cs.CV

Mitigating State Aliasing in Vision-Language-Action Models via Inverse Dynamics Learning

通过逆动力学学习缓解视觉-语言-动作模型中的状态混叠

Kyujin Lee, Injae Kim, Jihwan Park, Yejun Ju, Minseok Joo, Hyunwoo J. Kim

机构 * KAIST(韩国科学技术院) Korea University(韩国大学)

AI总结 提出将逆动力学学习作为辅助目标,直接监督VLA视觉编码器,通过预测当前与未来观测之间的动作来捕捉细粒度视觉差异,从而缓解状态混叠问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29523 2026-05-29 cs.LG

K-FinHallu: A Hallucination Detection Benchmark for Multi-Turn RAG in Korean Finance

K-FinHallu:面向韩语金融多轮RAG的幻觉检测基准

Eunbyeol Cho, Yunseung Lee, Mirae Kim, Jeewon Yang, Youngjun Kwak, Edward Choi

机构 * KAIST AI(KAIST人工智能实验室) Financial Tech Lab(金融科技实验室) KakaoBank Corp(Kakao银行公司)

AI总结 提出K-FinHallu基准,通过构建多轮对话和层次化幻觉分类,评估LLM在韩语金融RAG中的幻觉检测能力,发现即使最强模型在细粒度金融诊断和合理弃权上表现不佳。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29366 2026-05-29 cs.LG

Solving Integer Linear Programming with Parallel Tempering

使用并行回火求解整数线性规划

Kyuil Sim, Sanghyeok Choi, Jinkyoo Park

机构 * KAIST(韩国科学技术院) University of Edinburgh(爱丁堡大学)

AI总结 提出一种无求解器、基于采样的整数线性规划优化框架,利用局部平衡提议和并行回火技术直接探索离散可行区域,在多个基准上优于或匹敌经典求解器。

Comments Preprint. Code available at https://github.com/ski-sim/ILP-with-ParallelTempering

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.29250 2026-05-29 cs.CL cs.AI cs.IR cs.LG

OmniRetrieval: Unified Retrieval across Heterogeneous Knowledge Sources

OmniRetrieval:跨异构知识源的统一检索

Jinheon Baek, Soyeong Jeong, Sangwoo Park, Woongyeong Yeo, Minki Kang, Patara Trirat, Heejun Lee, Sung Ju Hwang

机构 * KAIST(韩国科学技术院)

AI总结 提出OmniRetrieval框架,通过自然语言查询识别并调度到不同知识源的本地执行引擎,在13个数据集和309个知识库上超越单源基线,实现异构知识源统一检索。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28775 2026-05-28 cs.LG cs.AI cs.CL

Learn from Weaknesses: Automated Domain Specialization for Small Computer-Use Agents

从弱点中学习:小型计算机使用代理的自动化领域专业化

Suji Kim, Kangsan Kim, Sung Ju Hwang

机构 * KAIST(韩国科学技术院) Samsung Electronics(三星电子)

AI总结 提出LearnWeak框架,通过更强的参考代理识别学生代理在目标领域的弱点,自动合成针对性任务和监督信号,并引入误差感知专业化目标,显著提升小型计算机使用代理在多个领域的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28774 2026-05-28 cs.CL

Agent Explorative Policy Optimization for Multimodal Agentic Reasoning

Agent探索性策略优化用于多模态Agent推理

Minki Kang, Shizhe Diao, Ryo Hachiuma, Sung Ju Hwang, Pavlo Molchanov, Yu-Chiang Frank Wang, Byung-Kwan Lee

机构 * NVIDIA KAIST(韩国科学技术院)

AI总结 针对多模态Agent推理中思考与工具使用的不对称性(Thinking-Acting Gap),提出AXPO算法,通过固定思考前缀并重采样工具调用及其延续,结合基于不确定性的前缀选择,显著提升工具使用率和模型性能。

Comments Project page: https://byungkwanlee.github.io/AXPO-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28468 2026-05-28 cs.RO

EIT-Pneumatic Hybrid Robotic Skin for Practical and Accurate Force Map Reconstruction

EIT-气动混合机器人皮肤用于实用且精确的力图重建

Junhwi Cho, Sunggyu Bae, Junghyeon Ma, Hyosang Lee, Jung Kim, Kyungseo Park

机构 * Mechanical Engineering Department, KAIST(韩国科学技术院机械工程系) Department of Robotics and Mechatronics Engineering, DGIST(大邱科学技术院机器人与机电工程系) Mechanical Engineering Department, TU/e(埃因霍温理工大学机械工程系)

AI总结 提出一种结合电阻抗断层成像(EIT)与气动触觉传感的混合机器人皮肤,通过Tikhonov正则化逆重建和逐垫气动校准,实现大面积精确触觉传感,并降低灵敏度不均匀性。

Comments 8 pages, 8 figures. Accepted to IEEE International Conference on Robotics and Automation (ICRA) 2026. J. Cho, S. Bae, J. Ma contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28456 2026-05-28 cs.AI cs.CV eess.AS

Diffusion Large Language Models for Visual Speech Recognition

用于视觉语音识别的扩散大语言模型

Jeong Hun Yeo, Chae Won Kim, Hyeongseop Rha, Yong Man Ro

机构 * Integrated Vision Language Lab, KAIST, South Korea(韩国加耶大学集成视觉语言实验室)

AI总结 提出首个基于扩散大语言模型(DLLM)的视觉语音识别框架DLLM-VSR,通过迭代掩码去噪和灵活顺序解码,结合置信度引导的解掩码策略及两阶段训练,并引入长度引导候选解码以降低目标长度不确定性,在LRS3上取得19.5%的词错误率。

Comments Code: https://github.com/JeongHun0716/dllm-vsr

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28084 2026-05-28 cs.CL cs.AI

SMILE-Next: Teaching Large Language Models to Detect, Classify, and Reason about Laughter

SMILE-Next: 教授大型语言模型检测、分类和推理笑声

Lee Jung-Mok, Kim Sung-Bin, Joohyun Chang, Lee Hyun, Tae-Hyun Oh

机构 * School of EE, KAIST(韩国科学技术院电子工程系) Dept. of EE, POSTECH(POSTECH电子工程系) School of Computing, KAIST(韩国科学技术院计算机科学系)

AI总结 提出SMILE-Next数据集和包含笑声特定Self-Instruct与混合笑声专家框架的方法,用于实现多模态笑声理解,显著优于基线模型。

Journal ref Annual Meetings of the Association for Computational Linguistics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27984 2026-05-28 cs.CL cs.AI

KVoiceBench, KOpenAudioBench, and KMMAU: Agent-Driven Korean Speech Benchmarks for Evaluating SpeechLMs

KVoiceBench, KOpenAudioBench 和 KMMAU:用于评估语音语言模型的智能体驱动的韩语语音基准

Haechan Kim, Seungjun Chung, Inkyu Park, Jihoo Lee, Jonghyun Lee

机构 * KRAFTON Graduate School of AI, KAIST(韩国科学技术院人工智能研究生院) Department of Mathematical Sciences, Seoul National University(首尔国立大学数学科学系)

AI总结 针对语音语言模型评估中英语中心化的问题,提出两种智能体驱动的基准构建框架,构建并发布了三个韩语语音基准(KVoiceBench、KOpenAudioBench、KMMAU),通过评估八个最新模型揭示了英语-韩语性能差距和不同任务间的互补性弱点。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27408 2026-05-28 quant-ph cs.LG cs.NA math.NA

Neural Quantum Spectral Operator Learning for Solving Partial Differential Equations

神经量子谱算子学习求解偏微分方程

Chanyoung Kim, Myeonghwan Seong, Yujin Kim, Daniel K. Park, Youngjoon Hong

机构 * Department of Mathematical Sciences, KAIST(韩国科学技术院数学科学系) Department of Statistics and Data Science, Yonsei University(延世大学统计与数据科学系) Department of Applied Statistics, Yonsei University(延世大学应用统计学系) Department of Quantum Information, Yonsei University(延世大学量子信息系) Department of Mathematical Sciences, Seoul National University(首尔国立大学数学科学系)

AI总结 提出首个混合量子-经典无监督算子学习框架NVQLS,利用Legendre-Galerkin弱形式解决VQLS符号歧义并引入神经嵌入编码,在1D/2D参数化PDE上实现高精度求解。

Comments 31 pages (main 9 pages), 17 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26552 2026-05-28 cs.LG cs.AI

Aligning Few-Step Generative Models by Amortizing Sample-based Variational Inference

通过摊销基于样本的变分推断来对齐少步生成模型

Jaewoo Lee, Hyeongyu Kang, Dohyun Kim, Kyuil Sim, Woocheol Shin, Minsu Kim, Taeyoung Yun, Jeongjae Lee, Sanghyeok Choi, Tabitha Edith Lee, Jong Chul Ye, Jinkyoo Park

机构 * KAIST(韩国科学技术院) MongooseAI Mila – Quebec AI Institute(魁北克AI研究院) University of Edinburgh(爱丁堡大学) Université de Montréal(蒙特利尔大学) Omelet

AI总结 提出FAV框架,利用Stein变分梯度下降进行基于样本的变分推断,并通过固定点回归将粒子更新摊销到生成器参数中,实现对少步生成模型的对齐,在机器人操作和图像生成任务中优于现有方法。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09800 2026-05-28 cs.LG cs.DC cs.PF

Ariel-ML: Computing Parallelization with Embedded Rust for Neural Networks on Heterogeneous Multi-core Microcontrollers

Ariel-ML:面向异构多核微控制器的嵌入式Rust神经网络计算并行化

Zhaolan Huang, Kaspar Schleiser, Gyungmin Myung, Emmanuel Baccelli

机构 * KAIST, South Korea(韩国科学技术院) Inria, France(法国国家信息与自动化技术研究院)

AI总结 针对多核MCU上TinyML推理的并行化需求,提出基于嵌入式Rust的Ariel-ML工具包,通过通用TinyML流水线和多核支持,在多种32位MCU上实现低延迟推理,并保持与C/C++相当的内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.02304 2026-05-28 cs.RO

Imitating and Finetuning Model Predictive Control for Robust and Symmetric Quadrupedal Locomotion

模仿与微调模型预测控制实现鲁棒且对称的四足运动

Donghoon Youm, Hyunyoung Jung, Hyeongjun Kim, Jemin Hwangbo, Hae-Won Park, Sehoon Ha

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Georgia Institute of Technology(佐治亚理工学院)

AI总结 提出模仿与微调模型预测控制(IFM)框架,结合模型预测控制与模仿学习及强化学习,提升四足机器人在复杂地形上的运动性能、对称性和能效。

Journal ref IEEE Robotics and Automation Letters ( Volume: 8, Issue: 11, November 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27079 2026-05-27 cs.LG cs.AI cs.RO

Trust Region Q Adjoint Matching

信任区域Q伴随匹配

Yonghoon Dong, Kyungmin Lee, Changyeon Kim, Jaehyuk Kim, Jinwoo Shin

机构 * KAIST AI(韩国科学技术院人工智能) Seoul National University(首尔国立大学) RLWRLD

AI总结 针对预训练流策略的离策略强化学习不稳定性,提出信任区域Q伴随匹配方法,通过投影对偶下降自适应控制路径空间KL散度,实现稳定微调,在50个OGBench任务中离线RL成功率达68%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27039 2026-05-27 eess.AS cs.SD

Why Can't They Remember? Uncovering Representation and Retrieval Bottlenecks in Multi-Turn Acoustic Memory

为什么它们记不住?揭示多轮声学记忆中的表征和检索瓶颈

Yang Xiao, Siyi Wang, Han Yin, Hong Jia, Vidhyasaharan Sethu, Eun-Jung Holden, Ting Dang

机构 * The University of Melbourne(墨尔本大学) KAIST(韩国科学技术院) The University of Auckland(奥克兰大学) UNSW Sydney(新南威尔士大学悉尼分校)

AI总结 本文通过引入EnvMem基准,发现大型音频语言模型在多轮交互中非语音信息记忆失败的主要原因是表征轨迹漂移,而非注意力分配不足。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26955 2026-05-27 cs.CL cs.AI

JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors

JuICE:评估LLM裁判识别文化错误的基准

Jiho Jin, Junho Myung, Juhyun Oh, Junyeong Park, Rifki Afina Putri, Sunipa Dev, Vinodkumar Prabhakaran, Alice Oh

机构 * KAIST(韩国科学技术院) Google(谷歌) Universitas Gadjah Mada(加查马达大学)

AI总结 提出JuICE基准,包含7470个文化语言错误标注的多语言数据集,用于评估LLM裁判在长文本中识别深层文化错误的能力,发现最强模型F1仅0.52且常遗漏本地人易识别的错误。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26642 2026-05-27 cs.CV

Adaptation-Free Heterogeneous Collaborative Perception with Unseen Agent Configurations

无适应异构协同感知:应对未见过的智能体配置

Hyunchul Bae, Heejin Ahn

机构 * School of Electrical Engineering(电气工程学院) Korea Advanced Institute of Science and Technology (KAIST)(韩国科学技术院)

AI总结 提出ALF框架,通过将轻量级框级消息提升为自车兼容的辅助特征,实现与未见配置智能体的零适应协同感知,在V2X-Real上零样本评估中相对mAP@0.7提升35.91%,带宽仅需约9.6 Kbps。

Comments 9 pages main paper, 23 pages including references and appendix, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26463 2026-05-27 cs.CL cs.AI

Towards Error-Free EHRs: Reasoning-Intensive Consistency Verification Between Clinical Notes and Structured Tables in Electronic Health Records

迈向无差错的电子健康记录:临床笔记与结构化表格之间的推理密集型一致性验证

Yeonsu Kwon, Jiho Kim, Junseong Choi, Paloma Rabaey, Minseo Kim, Sujeong Im, Jeewon Yang, Jun-Min Lee, Sangji Lee, Jiwon Kim, Hangyul Yoon, Hyunwook Kwon, Edward Choi

机构 * KAIST(韩国科学技术院) Ghent University(根特大学) Samsung Medical Center(三星医疗中心) Samsung Changwon Hospital(三星昌原医院) Asan Medical Center(亚山医疗中心)

AI总结 针对电子健康记录中临床笔记与结构化表格数据不一致的问题,提出推理密集型基准EHR-ReasonCon和基于大语言模型的框架EHR-Inspector,通过锚点实体提取、时间引用和表格探索工具实现高效一致性验证。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26442 2026-05-27 cs.CL cs.AI

Alignment Tuning for Large Language Models: A Data-Centric Lens on Alignment Data Pipelines

大型语言模型的对齐调优:以数据为中心的对齐数据管道视角

Hwanjun Song

机构 * KAIST(韩国科学技术院)

AI总结 本文以数据为中心,将对齐调优重构为管道设计问题,分解为响应合成、偏好评估和偏好实例化三个阶段,并基于此框架统一分类现有对齐方法,总结设计权衡与失败模式,提炼高层原则,最后指出开放挑战。

Comments Accepted at the Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26256 2026-05-27 cs.AI

Personalizing Embodied Multimodal Large Language Model Agents over Long-term User Interactions

个性化具身多模态大语言模型代理在长期用户交互中的应用

Jeongeun Lee, Chanyoung Park, Dongha Lee

机构 * Yonsei University(延世大学) KAIST(韩国科学技术院)

AI总结 提出POLAR框架,通过多模态知识图谱记忆机制增强具身代理在长期交互中的个性化能力,显著提升多步推理和用户上下文跟踪性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26230 2026-05-27 cs.CV

Geometry-Aware Representation Denoising for Robust Multi-view 3D Reconstruction

几何感知表示去噪用于鲁棒的多视角3D重建

Jin Hyeon Kim, Jaeeun Lee, Claire Kim, Kyoungjin Oh, Paul Hyunbin Cho, Jaewon Min, Yeji Choi, Jihye Park, Hyunhee Park, Minkyu Park, Seungryong Kim

机构 * KAIST AI(韩国国立科学技术院人工智能研究所) Samsung Electronics(三星电子)

AI总结 提出几何感知表示去噪(GARD)框架,在前馈3D重建模型的特征空间中执行扩散式多视角恢复,同时恢复场景几何与高质量RGB图像,在DA3基准上验证有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.22133 2026-05-27 q-bio.BM cs.AI

Atom-level Protein Representation Learning Improves Protein Structure Prediction

原子级蛋白质表示学习改进蛋白质结构预测

Taewon Kim, Hyosoon Jang, Hyunjin Seo, Seonghwan Seo, Hyeongwoo Kim, Wonho Zhung, Mingyeong Shin, Wooyoun Kim, Sungsoo Ahn

机构 * KAIST(韩国科学技术院)

AI总结 提出结构感知预训练方法TriProRep,通过VQ-VAE联合建模三种对齐的残基级视图,在结构预测任务中优于仅序列和先前结构感知表示模型。

Comments Project Page: https://holymollyhao.github.io/TriProRep/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11651 2026-05-27 cs.CV cs.AI cs.CL

Hide to See: Reasoning-prefix Masking for Visual-anchored Thinking in VLM Distillation

Hide to See: 面向VLM蒸馏中视觉锚定思维的推理前缀掩码

Seonghoon Yu, Dongjun Nam, Byung-Kwan Lee, Jeany Son

机构 * KAIST(韩国科学技术院) NVIDIA(英伟达) POSTECH(POSTECH大学)

AI总结 提出一种推理前缀掩码蒸馏框架,通过掩码学生模型的显著推理前缀,迫使其在推理过程中更依赖视觉证据,从而缓解长推理轨迹中的视觉遗忘问题,提升多模态推理性能。

Comments Pre-print

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.15500 2026-05-27 cs.AI cs.LG

Understanding Reasoning in LLMs through Strategic Information Allocation under Uncertainty

不确定性下通过策略信息分配理解LLM中的推理

Jeonghye Kim, Xufang Luo, Minbeom Kim, Sangmook Lee, Dongsheng Li, Yuqing Yang

机构 * Microsoft Research(微软研究院) KAIST(韩国科学技术院) Seoul National University(首尔国立大学)

AI总结 本文提出一个信息论框架,将推理分解为程序推进和认知外化(不确定性标记级外化),证明零散外化能在无显式错误触发时恢复收敛,并通过实验表明小规模SFT即可调控该能力,从而将推理重新定义为不确定性下的策略信息分配。

详情

展开后加载摘要…

URL PDF HTML 收藏