arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-05-13 至 2026-05-13 共收录 22
2605.12431 2026-05-13 cs.CV

GaitProtector: Impersonation-Driven Gait De-Identification via Training-Free Diffusion Latent Optimization

GaitProtector: 通过无训练扩散潜在优化实现基于伪装的步态去标识

Huiran Duan, Qian Zhou, Zhongliang Guo, Junhao Dong, Yuqi Li, Guoying Zhao, Yingli Tian

机构 * City University of New York(纽约城市大学) Wuhan University(武汉大学) University of Aberdeen(阿伯丁大学) Nanyang Technological University(南洋理工大学) ELLIS Institute Finland(芬兰ELLIS研究所) University of Oulu(奥卢大学)

AI总结 本文提出GaitProtector框架,通过无训练扩散潜在优化实现基于伪装的步态去标识,通过伪装和伪装两个紧密耦合组件,在保持主导身体形状和运动动态的同时减少识别准确率。

Comments Accepted to the 20th IEEE International Conference on Automatic Face and Gesture Recognition (FG 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12357 2026-05-13 cs.AI

$δ$-mem: Efficient Online Memory for Large Language Models

$δ$-mem: 高效的大型语言模型在线内存

Jingdi Lei, Di Zhang, Junxian Li, Weida Wang, Kaixuan Fan, Xiang Liu, Qihan Liu, Xiaoteng Ma, Baian Chen, Soujanya Poria

机构 * Nanyang Technological University(南洋理工大学) Fudan University(复旦大学) Mind Lab Shanghai Jiao Tong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 本文提出$δ$-mem机制,通过紧凑的在线状态与注意力计算直接耦合,提升模型在长文本任务中的表现,无需全微调或替换backbone。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12185 2026-05-13 cs.CL cs.AI

Mitigating Context-Memory Conflicts in LLMs through Dynamic Cognitive Reconciliation Decoding

通过动态认知协调解码缓解LLM中的上下文内存冲突

Yigeng Zhou, Wu Li, Yifan Lu, Yequan Wang, Xuebo Liu, Wenya Wang, Jun Yu, Min Zhang, Jing Li

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Nanyang Technological University(南洋理工大学)

AI总结 本文提出动态认知协调解码方法,通过分析注意力图预测潜在冲突并选择解码路径,提升LLM在处理上下文内存冲突时的准确性和效率,同时构建ConflictKG基准测试集验证效果。

Comments Accepted by IEEE TASLP

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12131 2026-05-13 cs.AI

Rollout Cards: A Reproducibility Standard for Agent Research

Rollout Cards: 代理研究的可重复性标准

Charlie Masters, Ziyuan Liu, Stefano V. Albrecht

机构 * Deepflow Nanyang Technological University(南洋理工大学)

AI总结 本文提出Rollout Cards作为代理研究的可重复性标准,通过保留rollout记录并声明报告规则,解决评估结果不可复现的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12106 2026-05-13 cs.AI

Large Language Models as Amortized Pareto-Front Generators for Constrained Bi-Objective Convex Optimization

大语言模型作为约束双目标凸优化的 amortized 帕累托前沿生成器

Peipei Xu, SiYuan Ma, Yaohua Liu, Yu Wu, Guanliang Liu, Yang Zhang, Yong Liu

机构 * University of Shanghai for Science and Technology(上海科技大学) Nanyang Technological University(南洋理工大学) Guangdong Institute of Intelligence Science and Technology(广东智能科学与技术研究院) Georgia Institute of Technology(佐治亚理工学院) The University of Michigan(密歇根大学) The Hong Kong University of Science and Technology(香港科学与技术大学)

AI总结 本文提出DIPS框架,利用大语言模型生成约束双目标凸优化的帕累托前沿,通过紧凑离散化方案和三阶段课程优化,实现高效连续优化。

Comments 31 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.12046 2026-05-13 quant-ph cs.AI cs.LG

Rethink the Role of Neural Decoders in Quantum Error Correction

重新审视神经解码器在量子错误校正中的作用

Ge Yan, Shanchuan Li, Yuxuan Du

机构 * College of Computing Data Science, Nanyang Technological University, Singapore 639798, Singapore Department of Electrical Engineering Computer Science, Tokyo University of Agriculture \& Technology, Koganei, Tokyo, 184-8588, Japan School of Physical Mathematical Sciences, Nanyang Technological University, Singapore 639798, Singapore

AI总结 本文研究了神经解码器在表面码解码中的应用,探讨了在准确性与延迟约束下,通过架构重设计和压缩管道提升FPGA部署性能的方法,揭示了数据规模、归纳偏置和INT4量化对解码性能的影响。

Comments Accepted to ICML 2026; 33 Pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11931 2026-05-13 cs.CV

Learn to Think: Improving Multimodal Reasoning through Vision-Aware Self-Improvement Training

学会思考:通过视觉感知的自我改进训练提升多模态推理

Qihuang Zhong, Liang Ding, Wenjie Xuan, Juhua Liu, Bo Du, Dacheng Tao

机构 * School of Computer Science, National Engineering Research Center for Multimedia Software, Institute of Artificial Intelligence(计算机学院、多媒体软件国家工程研究中心、人工智能研究院) Hubei Key Laboratory of Multimedia(湖北多媒体重点实验室) Network Communication Engineering, Wuhan University, China(网络通信工程、武汉大学,中国) The University of Sydney, Australia(悉尼大学,澳大利亚) Nanyang Technological University, Singapore(南洋理工大学,新加坡)

AI总结 本文提出VISTA框架,通过视觉感知的自我改进训练提升多模态推理能力,解决数据不平衡和语言先验偏差问题,实验显示在多种训练场景下提升性能。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05680 2026-05-13 cs.CV

MotionGRPO: Overcoming Low Intra-Group Diversity in GRPO-Based Egocentric Motion Recovery

MotionGRPO: 克服基于GRPO的自主运动恢复中组内多样性低的问题

Nanjie Yao, Junlong Ren, Wenhao Shen, Hao Wang

机构 * The Hong Kong University of Science(香港科学与技术大学) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 本文提出MotionGRPO框架,通过强化学习后训练注入细粒度指导,解决自主运动恢复中组内多样性低的问题,提升局部关节精度和全局视觉合理性。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.29057 2026-05-13 cs.CV

LA-Sign: Looped Transformers with Geometry-aware Alignment for Skeleton-based Sign Language Recognition

LA-Sign:具有几何感知对齐的循环Transformer用于基于骨骼的手势识别

Muxin Pu, Mei Kuan Lim, Chun Yong Chong, Chen Change Loy

机构 * School of Information Technology, Monash University(莫纳什大学信息技术学院) S-Lab, Nanyang Technological University(南洋理工大学S实验室)

AI总结 LA-Sign通过循环Transformer和几何感知对齐,提升骨骼手势识别中多尺度运动理解,实验显示其在WLASL和MSASL基准上取得最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16156 2026-05-13 stat.ML cs.LG

Integral Imprecise Probability Metrics

积分不精确概率度量

Siu Lun Chau, Michele Caprio, Krikamol Muandet

机构 * Epistemic Intelligence & Computation Lab, College of Computing & Data Science, Nanyang Technological University, Singapore(新加坡南洋理工大学计算与数据科学学院认知智能与计算实验室) Department of Computer Science, The University of Manchester, United Kingdom(英国曼彻斯特大学计算机科学系) Manchester Centre for AI Fundamentals, Manchester, United Kingdom(英国曼彻斯特人工智能基础研究中心) Rational Intelligence Lab, CISPA Helmholtz Center for Information Security, Germany(德国CISPA海德堡信息安全中心理性智能实验室)

AI总结 本文提出积分不精确概率度量框架,用于比较不同不精确概率模型并量化epistemic不确定性,理论和实践均展示了其有效性。

Comments 48 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11769 2026-05-13 cs.CL

Safety-Oriented Evaluation of Language Understanding Systems for Air Traffic Control

面向安全的语言理解系统在空交通管制中的评估

Yujing Chang, Yash Guleria, Duc-Thinh Pham, Nhut-Huy Pham, Ningli Wang, Vu N. Duong, Sameer Alam

机构 * ATMRI, Nanyang Technological University (NTU), Singapore(航空交通管理研究所,南洋理工大学(NTU),新加坡) School of Management, Indian Institute of Technology Mandi, India(管理学院,印度理工学院曼迪分校,印度) Centre of AI Research, VinUniversity, Vietnam(人工智能研究中心,文大学,越南)

AI总结 本文提出面向安全的评估框架,揭示现有LLM在空交通管制中的可靠性不足,指出需建立后果意识的评估协议以确保AI辅助系统的安全部署。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11491 2026-05-13 cs.LG cs.AI

Understanding and Preventing Entropy Collapse in RLVR with On-Policy Entropy Flow Optimization

理解与防止RLVR中的熵崩溃:基于策略熵流的在线优化

Huimin Xu, Shuai Zhao, Xiaobao Wu, Anh Tuan Luu

机构 * Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) VinUniversity(文大学)

AI总结 本文提出OPEFO方法,通过平衡熵动态缓解RLVR中的熵崩溃问题,提升训练稳定性与性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.11477 2026-05-13 cs.CV

LDDR: Linear-DPP-Based Dynamic-Resolution Frame Sampling for Video MLLMs

LDDR:基于线性DPP的动态分辨率帧采样用于视频MLLMs

Jingfeng Chen, Jiawen Qian, Wendi Deng, Yinuo Guo, Jiaqi Yu, Sicong Leng, Raghuveer Thirukovalluru, Bhuwan Dhingra

机构 * Carnegie Mellon University(卡内基梅隆大学) Individual Researcher(个人研究员) National University Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Duke University(杜克大学)

AI总结 本文提出LDDR框架,通过任务条件特征空间中查询感知的DPP帧选择,在有限视觉token预算下提升视频理解,实现3倍速度提升,并通过组DPP重要性度量动态分配分辨率,优于现有基线方法。

Comments 21 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.10985 2026-05-13 cs.LG cs.AI q-bio.BM

Structural Interpretations of Protein Language Model Representations via Differentiable Graph Partitioning

通过可微分图划分对蛋白质语言模型表示进行结构解释

Siddhant Dutta, Edward Tan Beng Wai, Soumick Sarker, Pasan Gunawardane, Jagath C. Rajapakse

机构 * Nanyang Technological University(南洋理工大学)

AI总结 本文提出一种插件式框架,通过将ESM-2表示投影到蛋白质接触图并应用SoftBlobGIN网络,实现结构感知的消息传递和学习功能子结构,提升下游任务性能。

Comments 19 Pages, 8 figures, 11 Tables, Submitted to NeurIPS 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.09003 2026-05-13 cs.CV

FlashClear: Ultra-Fast Image Content Removal via Efficient Step Distillation and Feature Caching

FlashClear: 通过高效的步骤蒸馏和特征缓存实现超快图像内容移除

Yixin Tang, Jiawei Guo, Junxian Li, Zhiteng Li, Jixin Zhao, Bingya Zhang, Chenbo Wang, Yulun Zhang, Shangchen Zhou

机构 * Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学) Honor Device Co., Ltd(荣耀设备有限公司)

AI总结 本文提出FlashClear,通过区域感知对抗蒸馏和前景优先的注意力与缓存策略,实现高效内容移除,实验表明其在保持性能的同时显著提升速度,达到8.26倍和122倍的加速。

Comments Code: https://github.com/GuoCalix/FlashClear

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10956 2026-05-13 cs.SE cs.AI

Project-Level C-to-Rust Translation via Pointer Knowledge Graphs

基于指针知识图谱的项目级C到Rust翻译

Zhiqiang Yuan, Wenjun Mao, Zhuo Chen, Xiyue Shang, Chong Wang, Yiling Lou, Xin Peng

机构 * Fudan University(复旦大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出基于指针知识图谱的项目级C到Rust翻译方法PtrTrans,通过增强代码依赖图的指针语义,提升生成Rust代码的安全性和正确性,实验表明其在安全性与功能性上均优于现有方法。

Comments Accepted by FSE'26

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.15103 2026-05-13 cs.MA cs.AI

Vulnerable Agent Identification in Large-Scale Multi-Agent Reinforcement Learning

大规模多智能体强化学习中的脆弱智能体识别

Simin Li, Zihao Mao, Zheng Yuwei, Linhao Wang, Ruixiao Xu, Chengdong Ma, Zhiqian Liu, Xin Yu, Yuqing Ma, Xin Wang, Jie Luo, Bo An, Yaodong Yang, Weifeng Lv, Xianglong Liu

机构 * School of Computer Science and Engineering, Beihang University(北航计算机科学与工程学院) Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学计算机科学与工程系) School of Artificial Intelligence, Beihang University(北航人工智能学院) Institute for Artificial Intelligence, Peking University(北京大学人工智能研究院) Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 本文研究大规模多智能体强化学习中的脆弱智能体识别问题,提出通过分层对抗性去中心化均值场控制框架,结合Fenchel-Rockafellar变换和强化学习算法,有效识别脆弱智能体并降低计算复杂度。

Comments Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05615 2026-05-13 cs.CL

Video-Language Understanding: A Survey from Model Architecture, Model Training, and Data Perspectives

视频-语言理解:从模型架构、模型训练和数据视角的综述

Thong Nguyen, Yi Bin, Junbin Xiao, Leigang Qu, Yicong Li, Jay Zhangjie Wu, Cong-Duy Nguyen, See-Kiong Ng, Luu Anh Tuan

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 本文综述了视频-语言理解系统的关键任务与挑战,从模型架构、训练和数据角度总结方法,并比较性能,探讨未来研究方向。

Comments Accepted at ACL 2024 (Findings). Code is available at https://github.com/nguyentthong/video-language-understanding

详情

展开后加载摘要…

URL PDF HTML 收藏
2312.02549 2026-05-13 cs.CV cs.CL

DemaFormer: Damped Exponential Moving Average Transformer with Energy-Based Modeling for Temporal Language Grounding

DemaFormer: 带能量建模的阻尼指数移动平均变换器用于时序语言定位

Thong Nguyen, Xiaobao Wu, Xinshuai Dong, Cong-Duy Nguyen, See-Kiong Ng, Luu Anh Tuan

机构 * National University of Singapore(国立新加坡大学) Nanyang Technological University(南洋理工大学) Carnegie Mellon University(卡内基梅隆大学)

AI总结 本文提出DemaFormer,通过阻尼指数移动平均机制改进时序语言定位任务中的注意力机制,有效分离目标视频片段与其余片段。

Comments Accepted at EMNLP 2023 (Findings). Code is available at https://github.com/nguyentthong/demaformer

详情

展开后加载摘要…

URL PDF HTML 收藏
2305.12678 2026-05-13 cs.CL

Gradient-Boosted Decision Tree for Listwise Context Model in Multimodal Review Helpfulness Prediction

基于列表式上下文模型的梯度提升决策树在多模态评论有用性预测中的应用

Thong Nguyen, Xiaobao Wu, Xinshuai Dong, Anh Tuan Luu, Cong-Duy Nguyen, Zhen Hai, Lidong Bing

机构 * National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学) Carnegie Mellon University(卡内基梅隆大学) DAMO Academy(达摩院)

AI总结 本文提出列表式注意力网络和梯度提升决策树,用于多模态评论有用性预测,以提升模型泛化能力与排名准确性。

Comments Published in ACL 2023 (Findings). Code is available at https://github.com/nguyentthong/gbdt_listwise_mrhp

详情

展开后加载摘要…

URL PDF HTML 收藏
2211.03524 2026-05-13 cs.CL

Adaptive Contrastive Learning on Multimodal Transformer for Review Helpfulness Predictions

多模态Transformer上的自适应对比学习用于评论有用性预测

Thong Nguyen, Xiaobao Wu, Anh-Tuan Luu, Cong-Duy Nguyen, Zhen Hai, Lidong Bing

机构 * National University of Singapore(国立新加坡大学) VinAI Research(VinAI研究院) Nanyang Technological University(南洋理工大学) DAMO Academy(达摩院)

AI总结 本文提出多模态对比学习方法,通过增强跨模态关系和自适应加权方案提升多模态评论有用性预测性能,实验证明优于现有方法。

Comments Accepted to the main EMNLP 2022 conference. Code is available at https://github.com/nguyentthong/adaptive_contrastive_mrhp

详情

展开后加载摘要…

URL PDF HTML 收藏
2109.10616 2026-05-13 cs.CL

Enriching and Controlling Global Semantics for Text Summarization

增强与控制全局语义以文本摘要

Thong Nguyen, Anh Tuan Luu, Truc Lu, Tho Quan

机构 * VinAI Research(VinAI研究院) Nanyang Technological University(南洋理工大学) Ho Chi Minh City University of Technology(胡志明市技术大学) National University Ho Chi Minh City(胡志明市国家大学)

AI总结 本文提出通过引入带有归一化流的神经主题模型来捕捉文档全局语义,以解决摘要模型中短程依赖问题,从而提升摘要质量。

Comments Accepted to the main EMNLP 2021 conference. Code is available at https://github.com/nguyentthong/topicflow-sum

详情

展开后加载摘要…

URL PDF HTML 收藏