arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Nanyang Technological University(南洋理工大学)

2026-03-26 至 2026-03-26 共收录 11
2603.24454 2026-03-26 cs.CV

Unleashing Vision-Language Semantics for Deepfake Video Detection

释放视觉-语言语义以进行深度伪造视频检测

Jiawen Zhu, Yunqi Miao, Xueyi Zhang, Jiankang Deng, Guansong Pang

机构 * Singapore Management University(新加坡管理学院) The University of Warwick(沃里克大学) Nanyang Technological University(南洋理工大学) Imperial College London(伦敦帝国理工学院)

AI总结 本文提出VLAForge框架,通过ForgePerceiver增强视觉感知并引入身份感知VLA评分,利用跨模态语义提升深度伪造检测的判别能力。

Comments 14 pages, 7 figures, accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24260 2026-03-26 cs.CV cs.AI

Accelerating Diffusion-based Video Editing via Heterogeneous Caching: Beyond Full Computing at Sampled Denoising Timestep

通过异构缓存加速基于扩散的视频编辑:超越采样去噪时间步的全计算

Tianyi Liu, Ye Lu, Linfeng Zhang, Chen Cai, Jianjun Gao, Yi Wang, Kim-Hui Yap, Lap-Pui Chau

机构 * Nanyang Technological University(南洋理工大学) Shanghai Jiao Tong University(上海交通大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出HetCache框架,通过利用扩散基于掩码视频到视频生成中的异构性,减少冗余注意力运算,提升视频编辑效率与质量。

Comments 10 pages, 6 figures, accepted by CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.24166 2026-03-26 cs.CV

Heuristic-inspired Reasoning Priors Facilitate Data-Efficient Referring Object Detection

启发式推理先验促进数据高效的指代物体检测

Xu Zhang, Zhe Chen, Jing Zhang, Dacheng Tao

机构 * The University of Sydney(悉尼大学) La Trobe University(拉特罗布大学) Wuhan University(武汉大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出HeROD框架,通过注入启发式推理先验提升数据稀缺条件下的指代物体检测性能,实验表明其在低数据和少样本场景下优于现有基线。

Comments CVPR2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22094 2026-03-26 cs.CV

Principled Steering via Null-space Projection for Jailbreak Defense in Vision-Language Models

通过空域投影实现原理化引导用于视觉-语言模型中的对抗防御

Xingyu Zhu, Beier Zhu, Shuo Wang, Junfeng Fang, Kesen Zhao, Hanwang Zhang, Xiangnan He

机构 * MoE Key Lab of BIPC, University of Science and Technology of China(北京信息科技大学MoE关键实验室,中国科学技术大学) National University of Singapore(新加坡国立大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出NullSteer框架,通过线性变换在模型激活中构建拒绝方向,在良性子空间保持零扰动,动态诱导拒绝有害方向,提升安全性而不损害模型能力。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22070 2026-03-26 cs.CV

Adapting Point Cloud Analysis via Multimodal Bayesian Distribution Learning

通过多模态贝叶斯分布学习适应点云分析

Xingyu Zhu, Liang Yi, Shuo Wang, Wenbo Zhu, Yonglinag Wu, Beier Zhu, Hanwang Zhang

机构 * MoE Key Lab of BIPC, University of Science and Technology of China(脑信息处理实验室,中国科学技术大学) Opus AI Research(Opus AI研究院) Southeast University(东南大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出BayesMM框架,通过多模态贝叶斯分布学习实现测试时点云分析的持续适应,利用文本先验和流式视觉特征的高斯分布融合,提升在分布偏移下的鲁棒性。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22533 2026-03-26 cs.CV

Fast3Dcache: Training-free 3D Geometry Synthesis Acceleration

Fast3Dcache: 无训练3D几何合成加速

Mengyu Yang, Yanming Yang, Chenyi Xu, Chenxi Song, Yufan Zuo, Tong Zhao, Ruibo Li, Chi Zhang

机构 * AGI Lab, Westlake University(西溪大学AGI实验室) University of Electronic Science and Technology of China(电子科学与技术大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出Fast3Dcache,一种无训练的几何感知缓存框架,通过动态缓存调度和时空稳定性准则,显著加速3D扩散模型推理,同时保持几何精度。

Comments Accepted by CVPR 2026; Project page: https://fast3dcache-agi.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23950 2026-03-26 cs.RO

Event-Driven Proactive Assistive Manipulation with Grounded Vision-Language Planning

基于事件驱动的主动辅助操作与 grounded 视觉语言规划

Fengkai Liu, Hao Su, Haozhuang Chi, Rui Geng, Congzhi Ren, Xuqing Liu, Yucheng Xu, Yuichi Ohsita, Liyun Zhang

机构 * The University of Osaka(大阪大学) Nanyang Technological University(南洋理工大学) The University of Tokyo(东京大学)

AI总结 本文提出基于事件驱动的主动辅助操作方法,通过跟踪交互进度并分析状态转换,推断任务目标并生成辅助动作序列,提升人机协作效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23940 2026-03-26 cs.CV cs.AI

High-Fidelity Face Content Recovery via Tamper-Resilient Versatile Watermarking

通过抗篡改的多功能水印实现高保真的面部内容恢复

Peipeng Yu, Jinfeng Xie, Chengfu Ou, Xiaoyu Zhou, Jianwei Fei, Yunshu Dai, Zhihua Xia, Chip Hong Chang

机构 * Jinan University(暨南大学) University of Macau(澳门大学) Sun Yat-sen University(中山大学) Nanyang Technological University(南洋理工大学)

AI总结 本文提出VeriFi框架,结合版权保护、像素级篡改定位和高保真面部内容恢复,通过紧凑语义潜在水印和AIGC攻击模拟器提升水印鲁棒性和恢复质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.23910 2026-03-26 cs.AI

AnalogAgent: Self-Improving Analog Circuit Design Automation with LLM Agents

AnalogAgent: 基于LLM代理的自改进模拟电路设计自动化

Zhixuan Bao, Zhuoyi Lin, Jiageng Wang, Jinhai Hu, Yuan Gao, Yaoxin Wu, Xiaoli Li, Xun Xu

机构 * Nanyang Technological University(南洋理工大学) Institute for Infocomm Research(信息通信研究所) Institute of Microelectronics(微电子研究所) Eindhoven University of Technology(埃因霍温理工大学) Singapore University of Technology(新加坡科技学院)

AI总结 本文提出AnalogAgent,通过集成多代理系统与自演化记忆,实现模拟电路设计自动化,无需额外反馈,在多个基准测试中取得高通过率。

Comments 16 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.12410 2026-03-26 cs.AI

Are LLMs Smarter Than Chimpanzees? An Evaluation on Perspective Taking and Knowledge State Estimation

LLMs比黑猩猩更聪明吗?对视角取和知识状态估计的评估

Dingyi Yang, Junqi Zhao, Xue Li, Ce Li, Boyang Li

机构 * College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院) University of Science and Technology of China(中国科学技术大学) China University of Mining and Technology(中国矿业大学)

AI总结 本文评估LLM在预测角色下一步行动及检测角色不应具备的知识能力,发现当前最先进的LLM在两项任务上表现接近随机,远低于人类。

Comments 23 pages, 11 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06767 2026-03-26 cs.LG cs.AI

QUARK: Quantization-Enabled Circuit Sharing for Transformer Acceleration by Exploiting Common Patterns in Nonlinear Operations

QUARK:通过利用非线性操作中的共同模式实现变压器加速的量化启用电路共享

Zhixiong Zhao, Haomin Li, Fangxin Liu, Yuncheng Lu, Zongwu Wang, Tao Yang, Li Jiang, Haibing Guan

机构 * School of Computer Science, Shanghai Jiao Tong University(上海交通大学计算机科学学院) Shanghai Qi Zhi Institute(上海启智研究院) Nanyang Technological University(南洋理工大学) Huawei Technologies Co., Ltd(华为技术有限公司)

AI总结 QUARK通过利用非线性操作中的共同模式,实现高效电路共享,减少硬件资源需求,提升Transformer模型的推理速度和精度。

Comments Accepted by ICCAD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏