arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

2026-05-28 至 2026-05-28 共收录 10
2605.28775 2026-05-28 cs.LG cs.AI cs.CL

Learn from Weaknesses: Automated Domain Specialization for Small Computer-Use Agents

从弱点中学习:小型计算机使用代理的自动化领域专业化

Suji Kim, Kangsan Kim, Sung Ju Hwang

机构 * KAIST(韩国科学技术院) Samsung Electronics(三星电子)

AI总结 提出LearnWeak框架,通过更强的参考代理识别学生代理在目标领域的弱点,自动合成针对性任务和监督信号,并引入误差感知专业化目标,显著提升小型计算机使用代理在多个领域的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28774 2026-05-28 cs.CL

Agent Explorative Policy Optimization for Multimodal Agentic Reasoning

Agent探索性策略优化用于多模态Agent推理

Minki Kang, Shizhe Diao, Ryo Hachiuma, Sung Ju Hwang, Pavlo Molchanov, Yu-Chiang Frank Wang, Byung-Kwan Lee

机构 * NVIDIA KAIST(韩国科学技术院)

AI总结 针对多模态Agent推理中思考与工具使用的不对称性(Thinking-Acting Gap),提出AXPO算法,通过固定思考前缀并重采样工具调用及其延续,结合基于不确定性的前缀选择,显著提升工具使用率和模型性能。

Comments Project page: https://byungkwanlee.github.io/AXPO-page/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28468 2026-05-28 cs.RO

EIT-Pneumatic Hybrid Robotic Skin for Practical and Accurate Force Map Reconstruction

EIT-气动混合机器人皮肤用于实用且精确的力图重建

Junhwi Cho, Sunggyu Bae, Junghyeon Ma, Hyosang Lee, Jung Kim, Kyungseo Park

机构 * Mechanical Engineering Department, KAIST(韩国科学技术院机械工程系) Department of Robotics and Mechatronics Engineering, DGIST(大邱科学技术院机器人与机电工程系) Mechanical Engineering Department, TU/e(埃因霍温理工大学机械工程系)

AI总结 提出一种结合电阻抗断层成像(EIT)与气动触觉传感的混合机器人皮肤,通过Tikhonov正则化逆重建和逐垫气动校准,实现大面积精确触觉传感,并降低灵敏度不均匀性。

Comments 8 pages, 8 figures. Accepted to IEEE International Conference on Robotics and Automation (ICRA) 2026. J. Cho, S. Bae, J. Ma contributed equally

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28456 2026-05-28 cs.AI cs.CV eess.AS

Diffusion Large Language Models for Visual Speech Recognition

用于视觉语音识别的扩散大语言模型

Jeong Hun Yeo, Chae Won Kim, Hyeongseop Rha, Yong Man Ro

机构 * Integrated Vision Language Lab, KAIST, South Korea(韩国加耶大学集成视觉语言实验室)

AI总结 提出首个基于扩散大语言模型(DLLM)的视觉语音识别框架DLLM-VSR,通过迭代掩码去噪和灵活顺序解码,结合置信度引导的解掩码策略及两阶段训练,并引入长度引导候选解码以降低目标长度不确定性,在LRS3上取得19.5%的词错误率。

Comments Code: https://github.com/JeongHun0716/dllm-vsr

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.28084 2026-05-28 cs.CL cs.AI

SMILE-Next: Teaching Large Language Models to Detect, Classify, and Reason about Laughter

SMILE-Next: 教授大型语言模型检测、分类和推理笑声

Lee Jung-Mok, Kim Sung-Bin, Joohyun Chang, Lee Hyun, Tae-Hyun Oh

机构 * School of EE, KAIST(韩国科学技术院电子工程系) Dept. of EE, POSTECH(POSTECH电子工程系) School of Computing, KAIST(韩国科学技术院计算机科学系)

AI总结 提出SMILE-Next数据集和包含笑声特定Self-Instruct与混合笑声专家框架的方法,用于实现多模态笑声理解,显著优于基线模型。

Journal ref Annual Meetings of the Association for Computational Linguistics 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27984 2026-05-28 cs.CL cs.AI

KVoiceBench, KOpenAudioBench, and KMMAU: Agent-Driven Korean Speech Benchmarks for Evaluating SpeechLMs

KVoiceBench, KOpenAudioBench 和 KMMAU:用于评估语音语言模型的智能体驱动的韩语语音基准

Haechan Kim, Seungjun Chung, Inkyu Park, Jihoo Lee, Jonghyun Lee

机构 * KRAFTON Graduate School of AI, KAIST(韩国科学技术院人工智能研究生院) Department of Mathematical Sciences, Seoul National University(首尔国立大学数学科学系)

AI总结 针对语音语言模型评估中英语中心化的问题,提出两种智能体驱动的基准构建框架,构建并发布了三个韩语语音基准(KVoiceBench、KOpenAudioBench、KMMAU),通过评估八个最新模型揭示了英语-韩语性能差距和不同任务间的互补性弱点。

Comments 16 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.27408 2026-05-28 quant-ph cs.LG cs.NA math.NA

Neural Quantum Spectral Operator Learning for Solving Partial Differential Equations

神经量子谱算子学习求解偏微分方程

Chanyoung Kim, Myeonghwan Seong, Yujin Kim, Daniel K. Park, Youngjoon Hong

机构 * Department of Mathematical Sciences, KAIST(韩国科学技术院数学科学系) Department of Statistics and Data Science, Yonsei University(延世大学统计与数据科学系) Department of Applied Statistics, Yonsei University(延世大学应用统计学系) Department of Quantum Information, Yonsei University(延世大学量子信息系) Department of Mathematical Sciences, Seoul National University(首尔国立大学数学科学系)

AI总结 提出首个混合量子-经典无监督算子学习框架NVQLS,利用Legendre-Galerkin弱形式解决VQLS符号歧义并引入神经嵌入编码,在1D/2D参数化PDE上实现高精度求解。

Comments 31 pages (main 9 pages), 17 figures, 8 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.26552 2026-05-28 cs.LG cs.AI

Aligning Few-Step Generative Models by Amortizing Sample-based Variational Inference

通过摊销基于样本的变分推断来对齐少步生成模型

Jaewoo Lee, Hyeongyu Kang, Dohyun Kim, Kyuil Sim, Woocheol Shin, Minsu Kim, Taeyoung Yun, Jeongjae Lee, Sanghyeok Choi, Tabitha Edith Lee, Jong Chul Ye, Jinkyoo Park

机构 * KAIST(韩国科学技术院) MongooseAI Mila – Quebec AI Institute(魁北克AI研究院) University of Edinburgh(爱丁堡大学) Université de Montréal(蒙特利尔大学) Omelet

AI总结 提出FAV框架,利用Stein变分梯度下降进行基于样本的变分推断,并通过固定点回归将粒子更新摊销到生成器参数中,实现对少步生成模型的对齐,在机器人操作和图像生成任务中优于现有方法。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09800 2026-05-28 cs.LG cs.DC cs.PF

Ariel-ML: Computing Parallelization with Embedded Rust for Neural Networks on Heterogeneous Multi-core Microcontrollers

Ariel-ML:面向异构多核微控制器的嵌入式Rust神经网络计算并行化

Zhaolan Huang, Kaspar Schleiser, Gyungmin Myung, Emmanuel Baccelli

机构 * KAIST, South Korea(韩国科学技术院) Inria, France(法国国家信息与自动化技术研究院)

AI总结 针对多核MCU上TinyML推理的并行化需求,提出基于嵌入式Rust的Ariel-ML工具包,通过通用TinyML流水线和多核支持,在多种32位MCU上实现低延迟推理,并保持与C/C++相当的内存占用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.02304 2026-05-28 cs.RO

Imitating and Finetuning Model Predictive Control for Robust and Symmetric Quadrupedal Locomotion

模仿与微调模型预测控制实现鲁棒且对称的四足运动

Donghoon Youm, Hyunyoung Jung, Hyeongjun Kim, Jemin Hwangbo, Hae-Won Park, Sehoon Ha

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院) Georgia Institute of Technology(佐治亚理工学院)

AI总结 提出模仿与微调模型预测控制(IFM)框架,结合模型预测控制与模仿学习及强化学习,提升四足机器人在复杂地形上的运动性能、对称性和能效。

Journal ref IEEE Robotics and Automation Letters ( Volume: 8, Issue: 11, November 2023

详情

展开后加载摘要…

URL PDF HTML 收藏