arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Korea Advanced Institute of Science and Technology(韩国科学技术院)

2026-04-20 至 2026-04-20 共收录 6
2604.15857 2026-04-20 cs.CV

AHS: Adaptive Head Synthesis via Synthetic Data Augmentations

AHS: 通过合成数据增强实现自适应头部合成

Taewoong Kang, Hyojin Jang, Sohyun Jeong, Seunggi Moon, Gihwi Kim, Hoon Jin Jung, Jaegul choo

机构 * KAIST(韩国国立科学技术院) Korea University(韩国大学) FLIPTION

AI总结 本文提出AHS方法,通过合成数据增强解决头部合成中视角和表情多样性的限制,提升真实场景下的泛化能力。

Comments CVPR 2026, Project Page : https://keh0t0.github.io/AHS/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15809 2026-04-20 cs.CV

Aligning What Vision-Language Models See and Perceive with Adaptive Information Flow

对视觉-语言模型所见所感知进行对齐与适应性信息流

Chengxin Liu, Wonseok Choi, Chenshuang Zhang, Tae-Hyun Oh

机构 * KAIST(韩国科学技术院) POSTECH

AI总结 本文提出通过调节信息流提升视觉-语言模型的感知能力,通过动态令牌方法确定视觉令牌的重要性,从而提高视觉问答、视觉定位等任务的性能。

Comments CVPR 2026. Project page: https://cxliu0.github.io/AIF/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15612 2026-04-20 cs.RO cs.CV

GaussianFlow SLAM: Monocular Gaussian Splatting SLAM Guided by GaussianFlow

GaussianFlow SLAM:基于GaussianFlow的单目Gaussian Splatting SLAM

Dong-Uk Seo, Jinwoo Jeon, Eungchang Mason Lee, Hyun Myung

机构 * School of Electrical Engineering, KAIST (Korea Advanced Institute of Science and Technology)(韩国科学技术院电子工程学院)

AI总结 本文提出GaussianFlow SLAM,通过光学流引导场景结构和相机姿态优化,提升单目SLAM的映射质量和跟踪精度。

Comments 8 pages, 5 figures, 7 tables, accepted to IEEE RA-L

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.15555 2026-04-20 cs.CV

CXR-LT 2026 Challenge: Multi-Center Long-Tailed and Zero Shot Chest X-ray Classification

CXR-LT 2026挑战:多中心长尾和零样本胸片分类

Hexin Dong, Yi Lin, Pengyu Zhou, Fengnian Zhao, Alan Clint Legasto, Juno Cho, Dohui Kim, Justin Namuk Kim, Mingeon Kim, Sunwoo Kwak, Gabriel Moyà-Alcover, Ky Trung Nguyen, Thanh-Huy Nguyen, Ha-Hieu Pham, Huy-Hieu Pham, Huy Le Pham, Nikhileswara Rao Sulake, Aina Tur-Serrano, Ruichi Zhang, Ang Zu, Adam E. Flanders, Zhiyong Lu, Ronald M. Summers, Mingquan Lin, Hao Chen, Yuzhe Yang, George Shih, Yifan Peng

机构 * Department of Population Health Sciences, Weill Cornell Medicine(韦尔·科恩医学中心流行病学与公共卫生科学系) Department of Radiology, Fuwai Hospital, National Center for Cardiovascular Diseases, Chinese Academy of Medical Sciences and Peking Union Medical College(中国医学科学院阜外医院心血管病国家中心放射科) Department of Radiology, West China School of Medicine, Sichuan University(四川大学西昌医学院放射科) Sichuan University Affiliated Chengdu Second People’s Hospital(四川大学附属成都第二人民医院) Department of Radiology, Weill Cornell Medicine(韦尔·科恩医学中心放射科) School of Electrical Engineering, Korea Advanced Institute of Science and Technology(韩国科学技术院电子工程学院) Gwangju Institute of Science and Technology(光州科学技术院) Department of Biomedical Engineering, Case Western Reserve University(凯斯西储大学生物医学工程系) School of Electrical and Computer Engineering, Cornell Tech(康奈尔科技学院电气与计算机工程系) Department of Mathematics and Computer Science, Universitat de les Illes Balears(巴利阿里大学数学与计算机科学系) School of Computer Science and Engineering, VNU-HCM International University(VNU-HCM国际大学计算机科学与工程系) Vietnam National University, Ho Chi Minh City(越南国家大学河内市分校) School of Computer Science, Carnegie Mellon University(卡内基梅隆大学计算机科学系) VNU-HCM University of Science, Ho Chi Minh City(VNU-HCM科技大学河内市分校)

AI总结 本文提出CXR-LT 2026挑战,通过多中心数据集和零样本任务,研究长尾分布和开放世界下的胸片分类问题,评估视觉语言模型在罕见疾病检测中的表现。

Comments 25 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.13091 2026-04-20 cs.CV

Reasoning over Video: Evaluating How MLLMs Extract, Integrate, and Reconstruct Spatiotemporal Evidence

视频推理:评估大语言模型如何提取、整合和重构时空证据

Seunghwan Bang, Hwanjun Song

机构 * UNIST(全南大学) KAIST(韩国科学技术院)

AI总结 本文评估大语言模型在视频中的时空推理能力,提出VAEX-BENCH基准,通过合成数据测试抽象推理任务,揭示模型在抽象任务中的局限性。

Comments Project page: https://disl-lab.github.io/VAEX-Bench/

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.25897 2026-04-20 cs.CL cs.AI cs.CY

RoleConflictBench: A Benchmark of Role Conflict Scenarios for Evaluating LLMs' Contextual Sensitivity

RoleConflictBench: 一个用于评估LLM上下文敏感性的角色冲突场景基准

Jisu Shin, Hoyun Song, Juhyun Oh, Changgeon Ko, Eunsu Kim, Chani Jung, Alice Oh

机构 * Korea Advanced Institute of Science and Technology(韩国科学技术院)

AI总结 本文提出RoleConflictBench基准,通过生成13000个角色冲突场景,评估LLM在角色冲突中的上下文敏感性,发现模型更倾向于遵循角色偏好而非动态上下文线索。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏