arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Nanyang Technological University(南洋理工大学)

2026-03-16 至 2026-03-16 共收录 9
2603.12989 2026-03-16 cs.CV cs.CR

Test-Time Attention Purification for Backdoored Large Vision Language Models

针对受污染的大视觉语言模型的测试时间注意力净化

Zhifang Zhang, Bojun Yang, Shuo He, Weitong Chen, Wei Emma Zhang, Olaf Maennel, Lei Feng, Miao Xu

机构 * University of Queensland(昆士兰大学) Southeast University(东南大学) Nanyang Technological University(南洋理工大学) Adelaide University(阿德莱德大学)

AI总结 本文提出CleanSight,一种无需训练的测试时间防御方法,通过检测和净化异常的视觉-文本注意力分布来对抗后门攻击,显著优于现有基于像素的净化方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12912 2026-03-16 cs.CV cs.AI

FedBPrompt: Federated Domain Generalization Person Re-Identification via Body Distribution Aware Visual Prompts

FedBPrompt: 通过身体分布感知的视觉提示实现联邦领域泛化的人重识别

Xin Xu, Weilong Li, Wei Liu, Wenke Huang, Zhixi Yu, Bin Yang, Xiaoying Liao, Kui Jiang

机构 * School of Computer Science and Technology, Wuhan University of Science and Technology, China(武汉理工大学计算机科学与技术学院,中国) NERC for Multimedia Software, School of Computer Science, Wuhan University, China(武汉大学计算机学院,中国) Nanyang Technological University, Singapore(新加坡南洋理工大学) Changsha Bus Group, China(中国长沙公交集团) Central South University of Forestry and Technology, China(中国林业科技大学) Harbin Institute of Technology Zhengzhou Research Institute, China(哈尔滨工业大学郑州研究院,中国)

AI总结 本文提出FedBPrompt,通过引入可学习的视觉提示引导Transformer关注行人区域,解决联邦领域泛化重识别中域偏移问题,同时设计轻量级提示微调策略降低通信开销。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26495 2026-03-16 cs.AI

OffTopicEval: When Large Language Models Enter the Wrong Chat, Almost Always!

OffTopicEval: 当大语言模型进入错误的聊天时,几乎总是!

Jingdi Lei, Varun Gumma, Rishabh Bhardwaj, Seok Min Lim, Chuan Li, Amir Zadeh, Soujanya Poria

机构 * Nanyang Technological University(南洋理工大学) Walled AI Labs(Walled AI实验室) Infocomm Media Development Authority, Singapore(新加坡信息通信媒体发展局) Lambda Labs(Lambda实验室)

AI总结 本文提出OffTopicEval评估套件,用于衡量大语言模型在特定任务中的操作安全性,发现所有模型在操作安全方面均表现不佳,通过提示基于的引导方法显著提升模型对无关查询的拒绝能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12873 2026-03-16 cs.CV

TRACE: Structure-Aware Character Encoding for Robust and Generalizable Document Watermarking

TRACE:面向结构的字符编码用于鲁棒且可泛化的文档水印

Jiale Meng, Jie Zhang, Runyi Hu, Zhe-Ming Lu, Tianwei Zhang, Yiming Li

机构 * Zhejiang University(浙江大学) Nanyang Technological University(南洋理工大学)

AI总结 TRACE通过扩散模型实现结构感知的局部字符编码,提升文档水印的鲁棒性和泛化能力,实验显示其在PSNR和提取精度上优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12868 2026-03-16 cs.RO

Beyond Imitation: Reinforcement Learning Fine-Tuning for Adaptive Diffusion Navigation Policies

超越模仿:用于自适应扩散导航策略的强化学习微调

Junhe Sheng, Ruofei Bai, Kuan Xu, Ruimeng Liu, Jie Chen, Shenghai Yuan, Wei-Yun Yau, Lihua Xie

机构 * Nanyang Technological University, Singapore(南洋理工大学,新加坡) A*STAR, Singapore(A*STAR,新加坡) National University of Singapore, Singapore(新加坡国立大学)

AI总结 本文提出一种针对扩散导航的强化学习微调框架,通过Group Relative Policy Optimization提升策略适应性,在Isaac Sim中提升成功率和SPL,减少碰撞,展示出更强的零样本迁移能力和安全泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12796 2026-03-16 cs.CV

Spectral Defense Against Resource-Targeting Attack in 3D Gaussian Splatting

频谱防御对抗资源攻击在3D高斯点云中

Yang Chen, Yi Yu, Jiaming He, Yueqi Duan, Zheng Zhu, Yap-Peng Tan

机构 * Nanyang Technological University(南洋理工大学) UESTC Tsinghua University(清华大学) GigaAI VinUniversity(文大学)

AI总结 本文提出频谱防御方法,通过3D频率滤波和2D频谱正则化,有效抑制资源攻击导致的高斯点云过度增长,提升3DGS的鲁棒性、精度和安全性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12688 2026-03-16 cs.CV cs.LG

STRAP-ViT: Segregated Tokens with Randomized -- Transformations for Defense against Adversarial Patches in ViTs

STRAP-ViT: 分离令牌与随机化变换以防御对抗性补丁在ViT中

Nandish Chattopadhyay, Anadi Goyal, Chandan Karfa, Anupam Chattopadhyay

机构 * Indian Institute of Technology, Guwahati, India(印度理工学院,古瓦哈蒂,印度) Nanyang Technological University, Singapore(南洋理工大学,新加坡)

AI总结 STRAP-ViT通过分离异常令牌并应用随机复合变换,有效防御对抗性补丁攻击,实现高鲁棒性。

Comments Accepted for publication at IEEE/ACM Design Automation Conference (DAC) 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.12648 2026-03-16 cs.CV

From Sparse to Dense: Multi-View GRPO for Flow Models via Augmented Condition Space

从稀疏到密集:通过增强条件空间的多视图GRPO用于流模型

Jiazi Bu, Pengyang Ling, Yujie Zhou, Yibin Wang, Yuhang Zang, Tianyi Wei, Xiaohang Zhan, Jiaqi Wang, Tong Wu, Xingang Pan, Dahua Lin

机构 * Shanghai Jiao Tong University(上海交通大学) S-Lab, Nanyang Technological University(南洋理工大学S实验室) University of Science and Technology of China(中国科学技术大学) Fudan University(复旦大学) The Chinese University of Hong Kong(香港中文大学) Shanghai AI Laboratory(上海人工智能实验室) Adobe Research(Adobe研究实验室) Stanford University(斯坦福大学) Shanghai Innovation Institute(上海创新研究院) CPII under InnoHK Project(InnoHK项目下的CPII)

AI总结 本文提出多视图GRPO,通过增强条件空间探索样本间关系,提升文本到图像流模型的对齐性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22645 2026-03-16 cs.CV

GeoZero: Incentivizing Reasoning from Scratch on Geospatial Scenes

GeoZero:从零开始激励地理空间场景的推理

Di Wang, Shunyu Liu, Wentao Jiang, Fengxiang Wang, Yi Liu, Xiaolei Qin, Zhiming Luo, Chaoyang Zhou, Haonan Guo, Jing Zhang, Bo Du, Dacheng Tao, Liangpei Zhang

机构 * Wuhan University(武汉大学) Zhongguancun Academy(中关村学院) Nanyang Technological University(南洋理工大学) Shanghai AI Laboratory(上海人工智能实验室)

AI总结 GeoZero通过构建两个数据集和A$^2$GRPO方法,使大语言模型在无预定义推理链监督下实现地理空间推理,提升了遥感任务的推理多样性和准确性。

Comments Code, data, and models are available at https://github.com/MiliLab/GeoZero

详情

展开后加载摘要…

URL PDF HTML 收藏