arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Nanyang Technological University(南洋理工大学)

2026-05-08 至 2026-05-08 共收录 16
2605.06481 2026-05-08 cs.RO

OA-WAM: Object-Addressable World Action Model for Robust Robot Manipulation

OA-WAM:面向鲁棒机器人操作的对象可寻址世界动作模型

Yushan Liu, Peibo Sun, Shoujie Li, Yifan Xie, Lingfeng Zhang, Xintao Chao, Shiyuan Dong, Fang Chen, Xiao-Ping Zhang, Wenbo Ding

机构 * Tsinghua University(清华大学) Shanghai Jiao Tong University(上海交通大学) Nanyang Technological University(南洋理工大学)

AI总结 OA-WAM通过分解帧为N+1槽状态,结合文本、图像和动作历史,提升机器人操作的鲁棒性,其可寻址对象状态在场景扰动下表现更优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06165 2026-05-08 cs.AI

Post Reasoning: Improving the Performance of Non-Thinking Models at No Cost

事后推理:在不增加成本的情况下提升非思考模型的性能

Richmond Sin Jing Xuan, Rishabh Bhardwaj, Soujanya Poria

机构 * Nanyang Technological University(南洋理工大学)

AI总结 本文提出Post-Reasoning方法,通过在生成最终回答后让模型解释答案,提升指令微调模型的性能,且不增加延迟或token成本,在117种模型-基准设置中提升了88.19%的性能,平均相对提升17.37%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.06076 2026-05-08 cs.CL

Navigating by Old Maps: The Pitfalls of Static Mechanistic Localization in LLM Post-Training

用旧地图导航:在LLM微调中静态机械定位的陷阱

Hang Chen, Jiaying Zhu, Hongyang Chen, Hongxu Liu, Xinyu Yang, Wenya Wang

机构 * School of Computer Science and Technology(计算机科学与技术学院) Xi’an Jiaotong University(西安交通大学) School of Computer Science and Engineering(计算机科学与工程学院) The Chinese University of Hong Kong(香港中文大学) Shaanxi Co., Ltd(陕西有限公司) China Mobile Group(中国移动集团) College of Computing and Data Science(计算与数据科学学院) Nanyang Technological University(南洋理工大学)

AI总结 研究探讨了在LLM微调中静态机械定位的局限性,提出三种新指标分析电路演变,并强调需要前瞻性机制定位。

Comments 26 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05951 2026-05-08 cs.AI

HaM-World: Soft-Hamiltonian World Models with Selective Memory for Planning

HaM-World: 带选择性记忆的软哈密顿世界模型用于规划

Haoyun Tang, Haodong Cui, Keyao Xu, Kun Wang, Zhandong Mei

机构 * Xi’an Jiaotong University(西安交通大学) Huazhong University of Science and Technology(华中科技大学) Nankai University(南开大学) Nanyang Technological University(南洋理工大学)

AI总结 HaM-World通过分解潜在状态为规范子空间和上下文子空间,结合Mamba选择性状态空间记忆,提升规划稳定性与鲁棒性,实现高精度预测和任务完成。

Comments 22 pages, 5 figures. Code: https://github.com/HaoyunT/HaM_World

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.00113 2026-05-08 cs.MA cs.AI cs.CE cs.CY cs.SI

AI Agents Alone Are Not (Yet) Sufficient for Social Simulation

仅靠AI代理不足以进行社会模拟

Yiming Li, Dacheng Tao

机构 * College of Computing and Data Science, Nanyang Technological University, Singapore(南洋理工大学计算机与数据科学学院,新加坡)

AI总结 本文指出LLM代理单独使用不足以实现真实的社会动态,提出需考虑环境互动和调度机制的统一框架。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.08110 2026-05-08 cs.CV cs.CL cs.LG

The ART of Composition: Attention-Regularized Training for Compositional Visual Grounding

构图的艺术:用于组合视觉定位的注意力正则化训练

Jiayun Luo, Mir Rayat Imtiaz Hossain, Pritam Sarkar, Boyang Li, Leonid Sigal

机构 * The University of British Columbia(不列颠哥伦比亚大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出CompART,通过分解标题为以对象为中心的短语并构建复合短语,提升多对象定位能力,验证了其在多种视觉语言模型上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05818 2026-05-08 cs.CR cs.AI cs.CL

LeakDojo: Decoding the Leakage Threats of RAG Systems

LeakDojo:解码RAG系统的泄漏威胁

Maosen Zhang, Jianshuo Dong, Boting Lu, Wenyue Li, Xiaoping Zhang, Tianwei Zhang, Han Qiu

机构 * Tsinghua University, China(清华大学, 中国) Ant International, China(蚂蚁集团, 中国) Nanyang Technological University, Singapore(南洋理工大学, 新加坡)

AI总结 LeakDojo通过可控评估揭示RAG系统泄漏风险,发现查询生成和对抗指令独立影响泄漏,且指令能力越强泄漏风险越高,RAG可信度提升可能增加泄漏风险。

Comments Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05776 2026-05-08 cs.AI

HEDP: A Hybrid Energy-Distance Prompt-based Framework for Domain Incremental Learning

HEDP:一种基于能量-距离提示的领域增量学习混合框架

Yu Feng, Zhen Tian, Haoran Luo, Xie Yu, Diancheng Cheng, Haoyue Zheng, Shuai Lyu, Ping Zong, Lianyuan Li, Xin Ge, Yifan Zhu

机构 * China Mobile Research Institute, China(中国移动研究院) Beihang University, China(北京航空航天大学) Beijing University of Posts and Telecommunications, China(北京邮电大学) Nanyang Technological University, Singapore(南洋理工大学)

AI总结 HEDP提出一种混合能量-距离提示框架,通过能量正则化损失和混合能量-距离加权机制提升领域分离性和适应性,在多个基准上实现2.57%的准确率提升,有效缓解灾难性遗忘。

Comments 13 pages, 6 figures, Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05668 2026-05-08 cs.AI cs.CV

Large Vision-Language Models Get Lost in Attention

大视觉-语言模型在注意力中迷失

Gongli Xi, Ye Tian, Mengyu Yang, Huahui Yi, Liang Lin, Xiaoshuai Hao, Kun Wang, Wendong Wang

机构 * School of Cyberspace Security, Beijing University of Posts(信息安全学院,北京邮电大学) State Key Laboratory of Networking and Switching Technology, Beijing University of Posts(网络与交换技术国家重点实验室,北京邮电大学) School of Computer Science (National Pilot Software Engineering School), Beijing University of Posts(计算机科学学院(国家试点软件工程学院),北京邮电大学) Nanyang Technological University, Singapore(新加坡南洋理工大学) Institute of Information Engineering, Chinese Academy of Sciences, Beijing, China(信息工程研究所,中国科学院北京研究院)

AI总结 研究揭示大视觉-语言模型中注意力与前馈网络的作用差异,提出基于信息论和几何的统一框架,发现注意力模块存在冗余问题。

Comments 25 pages, 10 figures. Accepted by ICML 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.05267 2026-05-08 cs.SE cs.AI

Bridging Generation and Training: A Systematic Review of Quality Issues in LLMs for Code

连接生成与训练:LLMs用于代码的品质问题系统综述

Kaifeng He, Xiaojun Zhang, Peiliang Cai, Mingwei Liu, Yanlin Wang, Chong Wang, Kaifeng Huang, Bihuan Chen, Xin Peng, Zibin Zheng

机构 * Sun Yat-sen University(中山大学) Nanyang Technological University(南洋理工大学) Tongji University(同济大学) Fudan University(复旦大学)

AI总结 本文系统综述114项研究,探讨训练数据质量如何影响代码生成质量,建立统一分类体系,提出18种传播机制,并总结检测与缓解技术,指出质量保障正从事后过滤转向数据驱动的闭环修复。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.26227 2026-05-08 cs.CV

HOI-aware Adaptive Network for Weakly-supervised Action Segmentation

面向HOI的自适应网络用于弱监督动作分割

Runzhong Zhang, Suchen Wang, Yueqi Duan, Yansong Tang, Yue Zhang, Yap-Peng Tan

机构 * Nanyang Technological University(南洋理工大学) Tsinghua University(清华大学) Beijing Jiaotong University(北京交通大学)

AI总结 本文提出AdaAct网络,通过利用视频级的时空局部人-物交互作为先验知识,动态适应HOI序列以区分模糊动作,实验验证了方法的有效性。

Comments Accepted to IJCAI 2023

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13670 2026-05-08 cs.LG

Advancing Analytic Class-Incremental Learning through Vision-Language Calibration

通过视觉-语言校准推进分析类增量学习

Binyu Zhao, Wei Zhang, Xingrui Yu, Zhaonian Zou, Ivor Tsang

机构 * School of Computer Science and Technology, Harbin Institute of Technology, China(哈尔滨工业大学计算机科学与技术学院) CFAR and IHPC, Agency for Science, Technology and Research (A*STAR), Singapore(新加坡科技研究局(A*STAR)的CFAR和IHPC) College of Computing and Data Science, Nanyang Technological University, Singapore(新加坡南洋理工大学计算与数据科学学院)

AI总结 本文提出VILA框架,通过双级视觉语言校准策略解决预训练模型分析类增量学习中的表示刚性问题,提升学习效率与稳定性,在多个基准测试中表现优异。

Comments 20 pages, 11 figures, 9 tables. Accepted by ICML2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.07322 2026-05-08 cs.RO cs.AI

Action-to-Action Flow Matching

动作到动作流匹配

Jindou Jia, Gen Li, Xiangyu Chen, Tuo An, Yuxuan Hu, Jingliang Li, Xinying Guo, Jianfei Yang

机构 * MARS Lab, Nanyang Technological University(南洋理工大学MARS实验室)

AI总结 本文提出A2A方法,通过利用前一动作的本体感知信息进行初始化,避免了随机噪声采样带来的高延迟问题,提升了动作生成的效率和鲁棒性。

Comments 20 pages, 19 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19972 2026-05-08 cs.CV

Boosting Reasoning in Large Multimodal Models via Activation Replay

通过激活回放提升大多模态模型的推理能力

Yun Xing, Xiaobin Hu, Qingdong He, Jiangning Zhang, Shuicheng Yan, Shijian Lu, Yu-Gang Jiang

机构 * Nanyang Technological University(南洋理工大学) National University of Singapore(国立新加坡大学) Tencent Youtu Lab(腾讯云图实验室) Zhejiang University(浙江大学) Fudan University(复旦大学)

AI总结 本文通过激活回放方法提升大模型的多模态推理能力,通过操控低熵激活来增强推理性能,验证了该方法在数学、视觉代理和视频推理等场景中的有效性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.14594 2026-05-08 cs.AI

SynBench: A Benchmark for Differentially Private Text Generation

SynBench:差分隐私文本生成的基准测试

Yidan Sun, Viktor Schlegel, Srinivasan Nandakumar, Iqra Zahid, Yuping Wu, Yulong Wu, Hao Li, Jie Zhang, Warren Del-Pinto, Goran Nenadic, Siew Kei Lam, Anil Anthony Bharath

机构 * Imperial College London, Imperial Global Singapore(帝国学院伦敦,帝国全球新加坡) University of Manchester, United Kingdom(曼彻斯特大学,英国) CFAR and IHPC, Agency for Science, Technology and Research (A*STAR), Singapore(CFAR和IHPC,科技研究局(A*STAR),新加坡) Nanyang Technological University, Singapore(南洋理工大学,新加坡) Imperial College London, United Kingdom(帝国学院伦敦,英国)

AI总结 本文提出SynBench基准测试,通过标准化评估框架和隐私审计,评估不同规模的LLM生成模型在差分隐私下的性能,揭示隐私数据生成与预训练数据的关联性对生成质量的影响。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.16516 2026-05-08 cs.LG cs.AI

Amortized Linear-time Exact Shapley Value for Product-Kernel Methods

产品核方法的 amortized 线性时间精确 Shapley 值

Majid Mohammadi, Siu Lun Chau, Krikamol Muandet

机构 * Rational Intelligence Lab, CISPA Helmholtz Center for Information Security(理性智能实验室,信息安全中心(CISPA)) Department of Computer Science, Vrije Universiteit Amsterdam(阿姆斯特丹自由大学计算机科学系) Epistemic Intelligence & Computation Lab, College of Computing & Data Science, Nanyang Technological University(认知智能与计算实验室,南洋理工大学计算机与数据科学学院)

AI总结 本文提出 PKeX-Shapley 算法,利用产品核的乘法结构在二次时间内精确计算所有特征的 Shapley 值,实现 amortized 线性时间 per 特征,扩展至 MMD 和 HSIC 等统计方法。

详情

展开后加载摘要…

URL PDF HTML 收藏