arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

2026-06-04 至 2026-06-04 共收录 7
2606.05162 2026-06-04 cs.CV

Controllable Dynamic 3D Shape Generation via 3D Trajectories and Text

基于3D轨迹和文本的可控动态3D形状生成

Jaeyeong Kim, Ines Kim, Jahyeok Koo, Seungryong Kim

机构 * KAIST AI Project(韩国科学技术院人工智能项目)

AI总结 提出T2Mo前馈框架,通过3D轨迹和文本条件生成可控动态3D形状,采用形状接地轨迹嵌入处理任意配置轨迹,实现空间精确跟随与全局语义一致。

Comments Project page: https://cvlab-kaist.github.io/T2Mo/

详情

展开后加载摘要…

URL PDF HTML 收藏
2606.04719 2026-06-04 cs.CL

Query-based Cross-Modal Projector Bolstering Mamba Multimodal LLM

基于查询的跨模态投影器增强Mamba多模态大语言模型

SooHwan Eom, Jay Shim, Gwanhyeong Koo, Haebin Na, Mark A. Hasegawa-Johnson, Sungwoong Kim, Chang D. Yoo

机构 * Korea Advanced Institute of Science and Technology / Korea, Republic of(韩国科学技术院) University of Illinois in Urbana-Champaign / United States of America(伊利诺伊大学厄巴纳-香槟分校) Korea University / Korea, Republic of(韩国大学)

AI总结 提出基于查询的跨模态投影器,通过交叉注意力压缩视觉令牌,消除手动设计2D扫描顺序的需求,提升Mamba多模态LLM的性能和吞吐量。

Comments Accepted to EMNLP 2024 Findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.24698 2026-06-04 cs.RO

Dynamic Policy Learning for Legged Robot with Simplified Model Pretraining and Model-Homotopy-Inspired Transfer

基于简化模型预训练与模型同伦启发迁移的足式机器人动态策略学习

Dongyun Kang, Min-Gyu Kim, Tae-Gyu Song, Hajun Kim, Sehoon Ha, Hae-Won Park

机构 * Department of Mechanical Engineering, Korea Advanced Institute of Science and Technology (KAIST)(机械工程系,韩国科学技术院(KAIST)) School of Interactive Computing, Georgia Institute of Technology(交互计算学院,佐治亚理工学院)

AI总结 提出一种延续学习框架,结合简化模型预训练和模型同伦启发迁移,高效生成和优化足式机器人的复杂动态行为,并在真实四足机器人上验证了翻转和墙面辅助等动态任务。

Comments 8 pages

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 7, pp. 8068-8075, July 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.08094 2026-06-04 cs.CL

Segment, Embed, and Align: A Universal Recipe for Aligning Subtitles to Signing

分割、嵌入和对齐:将字幕与手语对齐的通用方法

Zifan Jiang, Youngjoon Jang, Liliane Momeni, Gül Varol, Sarah Ebling, Andrew Zisserman

机构 * VGG, Dept. of Engineering Science, University of Oxford(视觉感知与计算实验室,工程科学系,牛津大学) University of Zurich(苏黎世大学) KAIST(韩国科学技术院) LIGM, CNRS, Univ Gustave Eiffel, ENPC, IP Paris(LIGM,国家科学研究中心,古斯塔夫·埃菲尔大学,巴黎理工大学,IP巴黎)

AI总结 提出一种通用框架SEA,利用预训练模型分割视频帧序列为单个手势、嵌入手势片段到与文本共享的潜在空间,并通过轻量动态规划实现高效对齐,在多个手语数据集上达到最先进性能。

Comments Camera-ready version of ACL 2026 (Main)

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.17956 2026-06-04 cs.CL

Towards Better Understanding of Program-of-Thought Reasoning in Cross-Lingual and Multilingual Environments

在跨语言和多语言环境中更好地理解程序思维推理

Patomporn Payoungkhamdee, Pume Tuchinda, Jinheon Baek, Samuel Cahyawijaya, Can Udomcharoenchaikit, Potsawee Manakul, Peerat Limkonchotiwat, Ekapol Chuangsuwanich, Sarana Nutanong

机构 * School of Information Science and Technology, VISTEC(信息科学与技术学院,VISTEC) KAIST(韩国科学技术院) Cohere SCB 10X AI Singapore(AI新加坡) Department of Computer Engineering, Chulalongkorn University(朱拉隆梭大学计算机工程系)

AI总结 通过分离推理与代码执行,提出评估程序思维提示的框架,发现微调显著提升多语言推理能力,且推理质量与答案准确性强相关。

Journal ref Findings of the Association for Computational Linguistics: ACL 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2502.05349 2026-06-04 math.OC cs.LG

Contextual Scenario Generation for Two-Stage Stochastic Programming

两阶段随机规划的情境生成

David Islip, Roy H. Kwon, Sanghyeon Bae, Woo Chang Kim

机构 * Department of Mechanical and Industrial Engineering, University of Toronto(机械与工业工程系,多伦多大学) Department of Industrial and Systems Engineering, Korea Advanced Institute of Science and Technology (KAIST)(工业与系统工程系,韩国科学技术院(KAIST))

AI总结 针对两阶段随机规划中情境数量大、部署受限的问题,提出两种情境生成方法(基于分布和基于任务),通过上下文信息学习生成少量替代情境,并保证决策质量。

Comments 79 pages, 12 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
1904.01214 2026-06-04 cs.LG cs.SY eess.SY math.OC stat.ML

Enhancement of Energy-Based Swing-Up Controller via Entropy Search

通过熵搜索增强基于能量的摆动上控制器

Chang Sik Lee, Dong Eui Chang

机构 * School of Electrical Engineering, KAIST, Daejeon, Korea.(韩国成均馆大学电气工程学院)

AI总结 本文利用熵搜索进行贝叶斯优化,改进基于能量的控制器,以实现旋转倒立摆(Furuta摆)的摆动控制,实验表明该控制器在各种初始条件下性能优于常规控制器。

Comments 6 pages, 2019 Asian Control Conference

详情

展开后加载摘要…

URL PDF HTML 收藏