arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-07-10 至 2026-07-10 共收录 7
2607.08605 2026-07-10 cs.CV cs.AI cs.LG 新提交

When Structured Sparse Autoencoders Learn Consistent Concepts Across Modalities

当结构化稀疏自编码器跨模态学习一致概念时

Weiduo Liao, Yunqiao Yang, Ying Wei

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

AI总结 研究视觉语言模型中普通稀疏自编码器难以学习模态一致概念的问题,提出结构化稀疏自编码器$S^2AE$,通过图像块分组及结构化稀疏正则化强化概念一致性,经实验验证该方法在语义对齐等方面有提升,能促进跨模态表示更连贯解缠。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08572 2026-07-10 cs.CV 新提交

Switch-Reasoner: Learn When to Think in Multitask Mixtures via Reinforcement Learning

Switch-Reasoner:通过强化学习在多任务混合中学习何时思考

Yiyang Fang, Pei Fu, Jinjie Li, Jian Liang, Wenke Huang, Ruijie Luo, Shaojie Zhang, Jian Luan, Yi R. Fung, Mang Ye

机构 * Wuhan University(武汉大学) Xiaomi Inc(小米公司) Wuhan University of Technology(武汉理工大学) Nanyang Technological University(南洋理工大学) The Hong Kong University of Science and Technology(香港科技大学)

AI总结 研究针对多模态大语言模型在异构多任务中“先思考后回答”范式的低效及训练后学习何时思考不稳定的问题,提出基于GRPO的Switch-Reasoner框架,通过双层调节机制实现推理模式自适应选择,实验验证其能减少不必要推理并平衡准确率与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08375 2026-07-10 cs.CV cs.AI 新提交

WCog-VLA: A Dual-Level World-Cognitive Vision-Language-Action Model for End-to-End Autonomous Driving

WCog-VLA:用于端到端自动驾驶的双级世界认知视觉-语言-行动模型

Xuerun Yan, Zhexi Lian, Nuoheng Zhang, Shiyu Fang, Haoran Wang, Chen Lv, Jia Hu, Binyang Song

机构 * Tongji University(同济大学) Nanyang Technological University(南洋理工大学)

AI总结 针对现有视觉-语言-行动模型在自动驾驶中存在的局限,提出双级世界认知的WCog-VLA框架,语义层统一认知推理,生成层引入新模型加速推理,构建数据集,实验证明该模型在NAVSIM基准测试中达到最优分数。

Comments 20 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08354 2026-07-10 cs.RO 新提交

SkillPlug: Unsupervised Skill Mining for Few-Shot Adaptation in Robotic Manipulation

SkillPlug:用于机器人操作中少样本适应的无监督技能挖掘

Zi-han Ding, Ziwei Wang

机构 * School of Electrical and Electronic Engineering, Nanyang Technological University(南洋理工大学电气与电子工程学院)

AI总结 针对机器人操作中学习可转移视觉运动模仿策略的挑战,提出SkillPlug框架,通过技能调节模块挖掘共享可转移技能库,经自监督学习形成任务共享先验,微调轻量级组件实现少样本适应,提升多任务和少样本适应性能。

Comments 8 pages, 8 figures, published to RA-L

Journal ref IEEE Robotics and Automation Letters, vol. 11, no. 8, pp. 9511-9518, Aug. 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.08014 2026-07-10 cs.CV cs.LG 新提交

FedTR: Federated Learning Framework with Transfer Learning for Industrial Visual Inspection

FedTR:用于工业视觉检测的带迁移学习的联邦学习框架

Vikash Sathiamoorthy, Shuo Huai, Hao Kong, Di Liu, Wendy Yong Yi Loy, Christian Makaya, Daren Ho, Ravi Subramaniam, Qian Lin, Weichen Liu

机构 * HP-NTU Digital Manufacturing Corporate Lab, Nanyang Technological University(惠普-南洋理工大学数字制造联合实验室,南洋理工大学) School of Computer Science and Engineering, Nanyang Technological University(南洋理工大学计算机科学与工程学院) Department of Computer Science, Norwegian University of Science and Technology(挪威科技大学计算机科学系) HP Inc.(惠普公司) HP Singapore(惠普新加坡公司)

AI总结 针对工业视觉检测中数据有限和任务复杂影响模型性能的问题,提出FedTR框架,结合迁移学习,先利用公开数据集训练,再在私有数据上微调,实验证明该方法在标签缺陷识别上有效,准确率高且性能与集中训练相当。

Comments Author's accepted version. Published in Proceedings of the Great Lakes Symposium on VLSI 2024 (GLSVLSI '24)

Journal ref Proceedings of the Great Lakes Symposium on VLSI 2024 (GLSVLSI '24), pp. 310-314, 2024

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.07830 2026-07-10 cs.RO 新提交

Physics-Guided Biomechanical Gait Adaptation for Humanoid Locomotion on Extreme Sloped Terrains

用于类人机器人在极端倾斜地形上运动的物理引导生物力学步态适应

Xuanyu Chen, Mohan Liu, Dengchen Mei, Zhihao Gu, Haitian Zhang, Kaimin Mao, Haiyue Zhu, Shijun Yan, Lin Wang

机构 * Nanyang Technological University(南洋理工大学) A*STAR(新加坡科技研究局)

AI总结 研究类人机器人在极端倾斜地形的运动控制问题,提出HumoSlope两阶段物理引导框架,第一阶段建立平衡先验,第二阶段引入BSGA调节奖励,实现对不同坡度地形的适应,实验验证了该方法的有效性。

Comments 12 pages,6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.03715 2026-07-10 cs.CV 新提交

Leveraging Pathology Co-occurrence for Test-Time Adaptation in Chest X-Ray Diagnosis

利用病理学共现进行胸部X光诊断的测试时适应

Woojin Jeong, Yujin Choi, Dongbin Kim, Soyeon Park, Jaewook Lee

机构 * Seoul National University(首尔国立大学) Nanyang Technological University(南洋理工大学) UNIST(蔚山科学技术院)

AI总结 研究针对医学影像模型在新临床地点性能下降问题,提出共现加权适应(CoWA)方法,利用疾病共现模式作适应可靠性信号,估计标签共现结构并降低偏离模式样本权重,在胸部X光基准测试中优于基线。

Comments Accepted to MICCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏