arXivDaily arXiv每日学术速递 周一至周五更新
arXiv周末暂无论文更新,休息一下吧,周末愉快~~

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

2026-03-19 至 2026-03-19 共收录 13
2603.17828 2026-03-19 cs.CV

TINA: Text-Free Inversion Attack for Unlearned Text-to-Image Diffusion Models

TINA:无文本逆向攻击用于未学习的文本到图像扩散模型

Qianlong Xiang, Miao Zhang, Haoyu Zhang, Kun Wang, Junhui Hou, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) City University of Hong Kong(香港城市大学) Shenzhen Loop Area Institute(深圳河套学院) Peng Cheng Laboratory(鹏城实验室) Shandong University(山东大学)

AI总结 TINA通过无文本逆向攻击揭示未学习模型中残留的视觉知识,挑战现有去概念化方法的局限性。

Comments 16 pages, accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17813 2026-03-19 cs.CV

M2P: Improving Visual Foundation Models with Mask-to-Point Weakly-Supervised Learning for Dense Point Tracking

M2P:通过Mask-to-Point弱监督学习改进视觉基础模型以实现密集点跟踪

Qiangqiang Wu, Tianyu Yang, Bo Fang, Jia Wan, Matias Di Martino, Guillermo Sapiro, Antoni B. Chan

机构 * Department of Computer Science, City University of Hong Kong(香港城市大学计算机科学系) Department of Electrical and Computer Engineering, Princeton University(普林斯顿大学电气与计算机工程系) Meituan, Shenzhen, China(美团(深圳,中国)) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) Department of Electrical and Computer Engineering, Duke University(杜克大学电气与计算机工程系)

AI总结 本文提出M2P学习方法,利用视频对象分割掩码注解改进视觉基础模型,通过局部结构一致性损失、掩码标签一致性损失和掩码边界约束,提升密集点跟踪性能,实验表明其在TAP-Vid-DAVIS基准上优于DINOv2和DINOv3。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.12220 2026-03-19 cs.CV

TechImage-Bench: Rubric-Based Evaluation for Technical Image Generation

TechImage-Bench: 基于评分标准的技术图像生成评估

Minheng Ni, Zhengyuan Yang, Yaowen Zhang, Linjie Li, Chung-Ching Lin, Kevin Lin, Zhendong Wang, Xiaofei Wang, Shujie Liu, Lei Zhang, Wangmeng Zuo, Lijuan Wang

机构 * Hong Kong Polytechnic University(香港理工大学) Harbin Institute of Technology(哈尔滨工业大学) Microsoft Project Website(微软项目网站)

AI总结 本文提出TechImage-Bench,通过评分标准评估技术图像生成,发现现有模型在科学准确性上存在显著差距,并展示评分标准对改进图像生成的监督作用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17613 2026-03-19 cs.CL cs.PL

VeriAgent: A Tool-Integrated Multi-Agent System with Evolving Memory for PPA-Aware RTL Code Generation

VeriAgent:一种集成工具的多智能体系统,具有进化记忆,用于PPA感知的RTL代码生成

Yaoxiang Wang, Qi Shi, ShangZhan Li, Qingguo Hu, Xinyu Yin, Bo Guo, Xu Han, Maosong Sun, Jinsong Su

机构 * Xiamen University(厦门大学) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出一种集成EDA工具的多智能体框架,用于高质量Verilog代码生成,通过进化记忆机制实现功能正确性和PPA指标的联合优化。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17492 2026-03-19 cs.CV

UAV-CB: A Complex-Background RGB-T Dataset and Local Frequency Bridge Network for UAV Detection

UAV-CB: 一种复杂背景RGB-T数据集和局部频率桥梁网络用于UAV检测

Shenghui Huang, Menghao Hu, Longkun Zou, Hongyu Chi, Zekai Li, Feng Gao, Fan Yang, Qingyao Wu, Ke Chen

机构 * Pengcheng Laboratory(鹏城实验室) South China University of Technology(南方科技大学) Peking University(北京大学) Xinjiang University(新疆大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出UAV-CB数据集和LFBNet网络,针对低空环境中的UAV检测复杂背景和伪装问题,通过局部频率空间建模提升RGB-T融合性能,实验证明其在伪装和杂乱背景下的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17449 2026-03-19 cs.CL

TRiMS: Real-Time Tracking of Minimal Sufficient Length for Efficient Reasoning via RL

TRiMS:通过强化学习实现高效的实时最小充分长度推理跟踪

Tingcheng Bian, Jinchang Luo, Mingquan Cheng, Jinyu Zhang, Xiaoling Xia, Ni Li, Yan Tao, Haiwei Wang

机构 * Baidu Inc.(百度公司) Shenzhen University(深圳大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出TRiMS,通过强化学习和最小充分长度指标,实现高效推理压缩,减少80%以上的推理token数量并提升准确性。

Comments 8 pages (main), 21 pages total including appendix, 18 figures.Code will be released

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17436 2026-03-19 cs.LG cs.AI

TimeAPN: Adaptive Amplitude-Phase Non-Stationarity Normalization for Time Series Forecasting

TimeAPN: 用于时间序列预测的自适应幅度-相位非平稳归一化

Yue Hu, Jialiang Tang, Siwei Yu, Baosheng Yu, Jing Zhang, Dacheng Tao

机构 * School of Mathematics, Harbin Institute of Technology(哈尔滨工业大学数学学院) School of Computer Science and Engineering, Nanjing University of Science and Technology(南京理工大学计算机科学与工程学院) Lee Kong Chian School of Medicine, Nanyang Technological University(南洋理工大学李科钦医学院) School of Computer Science, Wuhan University(武汉大学计算机学院) College of Computing and Data Science, Nanyang Technological University(南洋理工大学计算与数据科学学院)

AI总结 本文提出TimeAPN框架,通过时间与频率域联合建模和预测非平稳因素,结合自适应归一化机制提升长周期时间序列预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.17435 2026-03-19 cs.DC cs.AR cs.LG cs.PF

ZipServ: Fast and Memory-Efficient LLM Inference with Hardware-Aware Lossless Compression

ZipServ: 一种快速且内存高效的LLM推理方法,结合硬件感知的无损压缩

Ruibo Fan, Xiangrui Yu, Xinglin Pan, Zeyu Li, Weile Luo, Qiang Wang, Wei Wang, Xiaowen Chu

机构 * The Hong Kong University of Science(香港科学与技术大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 ZipServ通过硬件感知的无损压缩技术,提升LLM推理效率,减少内存占用,实现比cuBLAS快2.21倍的内核速度和1.22倍的端到端推理加速。

Comments ASPLOS'26 Accepted Paper

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.16895 2026-03-19 eess.SP cs.LG

EEG-SeeGraph: Interpreting functional connectivity disruptions in dementias via sparse-explanatory dynamic EEG-graph learning

EEG-SeeGraph: 通过稀疏解释性动态EEG图学习解读痴呆症的功能连接紊乱

Fengcheng Wu, Zhenxi Song, Guoyang Xu, Kaisong Hu, Zirui Wang, Yi Guo, Zhiguo Zhang

机构 * Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学(深圳)) Institute of Neurological Diseases, Shenzhen Bay Laboratory, Shenzhen, China(深圳湾实验室神经疾病研究院)

AI总结 本文提出EEG-SeeGraph,通过稀疏解释性动态EEG图学习方法,解析痴呆症中功能连接紊乱,具备噪声鲁棒性和可解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.13293 2026-03-19 cs.CV eess.IV

NutVLM: A Self-Adaptive Defense Framework against Full-Dimension Attacks for Vision Language Models in Autonomous Driving

NutVLM: 一种针对自动驾驶中视觉语言模型全维度攻击的自适应防御框架

Xiaoxu Peng, Dong Zhou, Jianwen Zhang, Guanghui Sun, Anh Tu Ngo, Anupam Chattopadhyay

机构 * Department of Control Science and Engineering, Harbin Institute of Technology(控制科学与工程系,哈尔滨工业大学) College of Computing and Data Science, Nanyang Technological University(计算与数据科学学院,南洋理工大学)

AI总结 本文提出NutVLM框架,通过NutNet++ sentinel检测并净化良性样本、局部修补和全局扰动,结合高效灰度遮蔽和专家引导的对抗提示调优,提升自动驾驶中视觉语言模型的鲁棒性与性能。

Comments 12 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02341 2026-03-19 cs.CV

TALO: Pushing 3D Vision Foundation Models Towards Globally Consistent Online Reconstruction

TALO:推动3D视觉基础模型向全球一致的在线重建迈进

Fengyi Zhang, Tianjun Zhang, Kasra Khosoussi, Zheng Zhang, Zi Huang, Yadan Luo

机构 * UQMM Lab, The University of Queensland(昆士兰大学UQMM实验室) Shanghai Jiao Tong University(上海交通大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出基于薄板样条的高自由度长期对齐框架,通过全局传播控制点纠正空间变化不一致,并采用点无关子图注册设计提升鲁棒性,实验表明其在多数据集和相机配置下均能获得更一致的几何和更低的轨迹误差。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.26219 2026-03-19 cs.CV cs.AI

Parameterizing Dataset Distillation via Gaussian Splatting

通过高斯点撒技术参数化数据集

Chenyang Jiang, Zhengcen Li, Hang Zhao, Qiben Shan, Shaocong Wu, Jingyong Su

机构 * The School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳校区计算机科学与技术学院) Institute of Perceptual Intelligence, Pengcheng Laboratory(感知智能研究院,鹏城实验室)

AI总结 本文提出GSDD,一种基于高斯点撒的数据集参数化技术,通过高效存储结构提升数据集压缩效率,增强多样性并提升蒸馏性能。

Comments 19 pages; Code is available on https://github.com/j-cyoung/GSDatasetDistillation

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.08485 2026-03-19 cs.CV

Test-Time 3D Occupancy Prediction

测试时3D占用预测

Fengyi Zhang, Xiangyu Sun, Huitong Yang, Zheng Zhang, Zi Huang, Yadan Luo

机构 * UQMM Lab, The University of Queensland(昆士兰大学UQMM实验室) Harbin Institute of Technology(哈尔滨工程大学)

AI总结 本文提出TT-Occ框架,通过实时集成视觉基础模型,实现灵活的3D高斯表示和占用预测,适用于不同体素分辨率和新类别识别。

Comments CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏