arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

National University of Singapore(新加坡国立大学)

2026-03-05 至 2026-03-05 共收录 8
2603.04254 2026-03-05 cs.CV

EmbodiedSplat: Online Feed-Forward Semantic 3DGS for Open-Vocabulary 3D Scene Understanding

EmbodiedSplat: 在线前馈语义3DGS用于开放词汇3D场景理解

Seungjun Lee, Zihan Wang, Yunsong Wang, Gim Hee Lee

机构 * National University of Singapore(新加坡国立大学)

AI总结 EmbodiedSplat通过在线前馈3DGS实现开放词汇3D场景理解,结合CLIP编码和3D U-Net提升语义重建效率与泛化能力。

Comments CVPR 2026, Project Page: https://0nandon.github.io/EmbodiedSplat/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.04191 2026-03-05 cs.AI

Towards Realistic Personalization: Evaluating Long-Horizon Preference Following in Personalized User-LLM Interactions

迈向真实个性化:评估个性化用户-LLM交互中的长周期偏好跟随

Qianyun Guo, Yibo Li, Yue Liu, Bryan Hooi

机构 * National University of Singapore, Singapore(新加坡国立大学)

AI总结 RealPref提出一个评估个性化用户-LLM交互中长周期偏好跟随的基准,揭示LLM在长上下文和隐性偏好下的表现下降问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03995 2026-03-05 cs.LG cs.AI

Spectral Surgery: Training-Free Refinement of LoRA via Gradient-Guided Singular Value Reweighting

谱手术:通过梯度引导的奇异值重新加权实现LoRA的训练免费优化

Zailong Tian, Yanzhe Chen, Zhuoheng Han, Lizi Liao

机构 * School of Computing(计算学院) Information Systems, Singapore Management University(信息系统,新加坡管理大学) School of Computing, National University of Singapore(计算学院,新加坡国立大学) State Key Laboratory for Multimedia Information Processing, Peking University(多媒体信息处理国家重点实验室,北京大学)

AI总结 Spectral Surgery通过梯度引导的奇异值重新加权优化LoRA适配器,提升模型性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03836 2026-03-05 cs.RO

SkillVLA: Tackling Combinatorial Diversity in Dual-Arm Manipulation via Skill Reuse

SkillVLA: 通过技能复用解决双臂操作中的组合多样性问题

Xuanran Zhai, Zekai Huang, Longyan Wu, Qianyou Zhao, Qiaojun Yu, Jieji Ren, Ce Hao, Harold Soh

机构 * National University of Singapore(国立新加坡大学) Beijing Zhongguancun Academy(北京中关村学院) Shanghai Innovation Institute(上海创新研究院) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Fudan University(复旦大学) Smart Systems Institute, NUS(NUS智能系统研究所)

AI总结 SkillVLA通过技能复用解决双臂操作中的组合多样性问题,提升技能组合成功率至51%并在复杂任务中表现优异。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03772 2026-03-05 cs.DB cs.AI

Towards Effective Orchestration of AI x DB Workloads

面向AI与数据库工作负载有效编排的研究

Naili Xing, Haotian Gao, Zhanhao Zhao, Shaofeng Cai, Zhaojing Luo, Yuncheng Wu, Zhongle Xie, Meihui Zhang, Beng Chin Ooi

机构 * National University of Singapore(新加坡国立大学) Beijing Institute of Technology(北京理工大学) Renmin University of China(中国人民大学) Zhejiang University(浙江大学)

AI总结 本文研究了AI与数据库工作负载的有效编排问题,探讨了联合数据管理和查询处理的挑战,提出了查询优化、执行调度和分布式执行等关键问题,并展示了初步设计和结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.05091 2026-03-05 cs.CV

Factuality Matters: When Image Generation and Editing Meet Structured Visuals

事实性至关重要:当图像生成与编辑遇见结构化视觉

Le Zhuo, Songhao Han, Yuandong Pu, Boxiang Qiu, Sayak Paul, Yue Liao, Yihao Liu, Jie Shao, Xi Chen, Si Liu, Hongsheng Li

机构 * CUHK MMLab(香港大学多模态实验室) Beihang University(北京航空航天大学) Krea AI(Krea人工智能) Shanghai Jiao Tong University(上海交通大学) Shanghai AI Lab(上海人工智能实验室) Hugging Face National University of Singapore(新加坡国立大学) ByteDance(字节跳动) The University of Hong Kong(香港大学)

AI总结 本文提出了一种统一模型,通过整合视觉语言模型和FLUX.1 Kontext,提升结构化视觉生成与编辑的多模态理解与事实准确性。

Comments Accepted by ICLR 2026, Project page: https://structvisuals.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.03564 2026-03-05 cs.CV

Modeling Cross-vision Synergy for Unified Large Vision Model

跨视觉协同的统一大视觉模型建模

Shengqiong Wu, Lanhu Wu, Mingyang Bao, Wenhao Xu, Hanwang Zhang, Shuicheng Yan, Hao Fei, Tat-Seng Chua

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 PolyV通过统一架构和协同训练方法,实现了跨视觉模态的协同推理,显著提升了多模态视觉任务的性能。

Comments 21 pages, 9 figures, 16 tables, CVPR

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.17505 2026-03-05 cs.CV cs.AI cs.CL

Catch Me If You Can Describe Me: Open-Vocabulary Camouflaged Instance Segmentation with Diffusion

捕捉我如果你能描述我:基于扩散的开放词汇伪装实例分割

Tuan-Anh Vu, Duc Thanh Nguyen, Qing Guo, Nhat Chung, Binh-Son Hua, Ivor W. Tsang, Sai-Kit Yeung

机构 * The Hong Kong University of Science and Technology(香港科学与技术大学) CFAR & IHPC, A*STAR(CFAR与IHPC,A*STAR) Deakin University(德克萨斯大学) Nankai University(南开大学) National University of Singapore(新加坡国立大学) Trinity College Dublin(都柏林大学)

AI总结 本文提出基于扩散模型的开放词汇伪装实例分割方法,通过多尺度文本-视觉特征学习,提升伪装对象和新类别分割的性能。

Comments Accepted to IJCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏