arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-05-18 至 2026-05-18 共收录 11
2605.15822 2026-05-18 cs.LG stat.ML

Intrinsic Wasserstein Rates for Score-Based Generative Models on Smooth Manifolds

基于光滑流形的分数布朗运动生成模型的内在Wasserstein速率

Guoji Fu, Taiji Suzuki, Wee Sun Lee, Atsushi Nitanda

机构 * National University of Singapore(国立新加坡大学) The University of Tokyo(东京大学) RIKEN Center for Advanced Intelligence Project(RIKEN高级智能项目中心) Agency for Science, Technology and Research (A ⋆ \star STAR)(科技研究局) Nanyang Technological University(南洋理工大学)

AI总结 本文研究了在光滑流形上基于分数布朗运动的生成模型的内在Wasserstein速率,证明了在满足一定条件的流形上,变差保持的SGM估计器能达到特定的样本指数,且分析了分数近似在不同噪声 regime 下的表现。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.15692 2026-05-18 cs.CL cs.LG

TemplateRL: Structured Template-Guided Reinforcement Learning for LLM Reasoning

TemplateRL: 结构化模板引导的强化学习用于大语言模型推理

Jinyang Wu, Chonghua Liao, Mingkuan Feng, Shuai Zhang, Zhengqi Wen, Haoran Luo, Ling Yang, Huazhe Xu, Jianhua Tao

机构 * Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) Princeton University(普林斯顿大学) Shanghai AI Lab(上海人工智能实验室) Beijing National Research Center for Information Science and Technology(北京信息科学与技术国家研究中心)

AI总结 TemplateRL通过结构化模板引导强化学习提升大语言模型推理能力,通过MCTS构建问题解决模板库并整合到RL训练中,提高轨迹命中率并减少无效探索,实验显示在AIME和AMC上表现优于GRPO。

Comments Accepted by ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.00794 2026-05-18 cs.RO

Detecting Heel Strike and toe off Events Using Kinematic Methods and LSTM Models

利用运动学方法和LSTM模型检测脚跟触地和脚尖离地事件

Longbin Zhang, Zhizhang Li, Xinyi Fu, Yi Xie, Xiaoyue Yan, Suiyuan Wang, Te Zhang, Hui Zhang, Kailun Yang, Tsung-Lin Wu, Prayook Jatesiktat, Ananda Sidarta, Wei Tech Ang

机构 * School of Artificial Intelligence and Robotics, Hunan University(湖南大学人工智能与机器人学院) School of Mechanical and Aerospace Engineering, Nanyang Technological University(南洋理工大学机械与航空航天工程学院) Fourth Hospital of Changsha, Hunan Normal University(长沙第四医院,湖南师范大学) Department of Stomatology, Hunan Provincial People’s Hospital, Hunan Normal University(湖南省级人民医院口腔科,湖南师范大学) Rehabilitation Research Institute of Singapore, Lee Kong Chian School of Medicine, Nanyang Technological University(新加坡康复研究中心,李光前医学院,南洋理工大学)

AI总结 本文评估了七种运动学方法和LSTM模型在检测脚跟触地和脚尖离地事件中的性能,发现Zeni等方法在运动学方法中准确率最高,而LSTM模型提供了无系统偏差的数据驱动替代方案。

详情

展开后加载摘要…

URL PDF HTML 收藏
2308.06822 2026-05-18 cs.LG cs.AI cs.CR math.OC

Approximate and Weighted Data Reconstruction Attack in Federated Learning

联邦学习中的近似和加权数据重建攻击

Yongcun Song, Ziqi Wang, Enrique Zuazua

机构 * Division of Mathematical Sciences, School of Physical and Mathematical Sciences, Nanyang Technological University(南洋理工大学数学科学学院,物理与数学科学学院) Chair for Dynamics, Control, Machine Learning and Numerics – Alexander von Humboldt Professorship, Department of Mathematics, Friedrich-Alexander-Universität Erlangen-Nürnberg(动态、控制、机器学习和数值学主席职位,数学系,埃尔兰根-纽伦堡弗里德里希-亚历山大大学) Chair of Computational Mathematics, Fundación Deusto(计算数学主席,德乌斯基金会) Departamento de Matemáticas, Universidad Autónoma de Madrid(数学系,马德里自治大学)

AI总结 本文提出了一种基于插值的近似方法,用于攻击联邦学习中的联邦平均场景,通过生成客户端本地训练过程中的中间模型更新,改进数据重建质量,并通过实验验证了其在图像数据重建中的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15705 2026-05-18 cs.RO cs.AI

Feedback World Model Enables Precise Guidance of Diffusion Policy

反馈世界模型使扩散策略获得精准指导

Tuo An, Jindou Jia, Gen Li, Jingliang Li, Chuhao Zhou, Pengfei Liu, Bofan Lyu, Jiaqi Bai, Xinying Guo, Geng Li, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University(南洋理工大学MARS实验室)

AI总结 本文提出反馈世界模型,通过实时反馈修正预测误差,提升机器人决策性能,实验显示在分布偏移下预测准确率和策略表现显著提升。

Comments 21 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15492 2026-05-18 cs.RO cs.CV

FLASH: Efficient Visuomotor Policy via Sparse Sampling

FLASH:通过稀疏采样实现高效的视觉-运动策略

Jiaqi Bai, Jindou Jia, Yuxuan Hu, Gen Li, Xiangyu Chen, Tuo An, Kuangji Zuo, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University, Singapore(马尔萨实验室,南洋理工大学,新加坡)

AI总结 FLASH通过稀疏采样和Legendre多项式轨迹表示,提升视觉-运动策略学习效率,实现更长的动作时间跨度和更快的推理速度,实验表明其在多个任务中达到最先进的性能。

Comments 19 pages, 10 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15224 2026-05-18 cs.AI cs.MA

ICRL: Learning to Internalize Self-Critique with Reinforcement Learning

ICRL: 通过强化学习学习内化自我批评

Jianbo Lin, Xiaomin Yu, Yi Xin, Yifu Guo, Zhuosong Jiang, Zhongqi Yue, Weishi Wang, Heqing Zou, Chengwei Qin, Hui Xiong

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Nanjing University(南京大学) Sun Yat-sen University(中山大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) SAP Microsoft Research(微软研究院)

AI总结 本文提出ICRL框架,通过联合训练求解器和批评者,使求解器在无外部批评时也能自我改进,提升代理和数学推理任务性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.14309 2026-05-18 cs.CV cs.AI cs.LG

ICED: Concept-level Machine Unlearning via Interpretable Concept Decomposition

ICED: 通过可解释的概念分解实现概念级机器去学习

Shen Lin, Jing Lin, Junhao Dong, Piotr Koniusz, Li Xu

机构 * Fujian Normal University(福建师范大学) Nanyang Technological University(南洋理工大学) University of New South Wales(新南威尔士大学) Data61 CSIRO(Data61澳大利亚联邦科学与工业研究组织)

AI总结 本文提出ICED框架,通过多模态大语言模型构建任务特定概念词汇,实现VLMs中概念级去学习,有效去除目标知识并保留非目标语义,实验表明其在目标遗忘和模型效用方面表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09673 2026-05-18 cs.LG cs.AI cs.NE stat.ML

Drawback of Enforcing Equivariance and its Compensation via the Lens of Expressive Power

强制等变性的弊端及其通过表达能力的视角进行补偿

Yuzhu Chen, Tian Qin, Xinmei Tian, Fengxiang He, Dacheng Tao

机构 * University of Science and Technology of China(中国科学技术大学) University of Edinburgh(爱丁堡大学) Nanyang Technological University(南洋理工大学)

AI总结 本文研究了强制等变性对表达能力的影响,发现其会降低表达能力,但通过扩大模型规模可补偿,并证明了补偿所需的规模上限,同时发现扩大后的架构具有更优的泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02342 2026-05-18 cs.RO

Whole-body motion planning and safety-critical control for aerial manipulation

全身运动规划与安全关键控制用于空中操作

Lin Yang, Jinwoo Lee, Domenico Campolo, H. Jin Kim, Jeonghyun Byun

机构 * School of Mechanical and Aerospace Engineering, Nanyang Technological University, Singapore(机械与航空航天工程学院,南洋理工大学,新加坡) Department of Aerospace Engineering, Seoul National University, South Korea(航空航天工程系,首尔国立大学,韩国)

AI总结 本文提出基于超级二次曲面的空中操作器全身运动规划与安全关键控制框架,通过融合Voronoi图与平衡流形生成平滑轨迹,并设计高阶控制屏障函数实现碰撞避让,实验验证其在复杂环境中的高效性和鲁棒性。

Comments Will be presented in 23rd IFAC World Congress 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2403.13805 2026-05-18 cs.CV cs.AI cs.LG

RAR: Retrieving And Ranking Augmented MLLMs for Visual Recognition

RAR:用于视觉识别的检索与排序增强多模态大语言模型

Ziyu Liu, Zeyi Sun, Yuhang Zang, Wei Li, Pan Zhang, Xiaoyi Dong, Yuanjun Xiong, Dahua Lin, Jiaqi Wang

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) MThreads, Inc.(MThreads公司) Nanyang Technological University(南洋理工大学)

AI总结 RAR结合CLIP的检索与MLLM的排序,提升细粒度识别精度,增强少样本和零样本任务表现。

Comments Project: https://github.com/Liuziyu77/RAR

详情

展开后加载摘要…

URL PDF HTML 收藏