arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

共收录 1444
2504.09973 2026-01-01 cs.CV

Beyond Degradation Redundancy: Contrastive Prompt Learning for All-in-One Image Restoration

超越退化冗余:面向所有图像恢复的对比提示学习

Gang Wu, Junjun Jiang, Kui Jiang, Xianming Liu, Liqiang Nie

机构 * School of Computer Science and Technology, Harbin Institute of Technology(计算机科学与技术学院,哈尔滨工业大学) School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术学院,哈尔滨工业大学(深圳))

AI总结 本文提出对比提示学习框架,通过稀疏提示模块和对比提示正则化提升提示-任务对齐,实现更有效的图像恢复。

Comments Accepted by IEEE TPAMI

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23343 2025-12-30 cs.CL cs.AI cs.CV

AI Meets Brain: Memory Systems from Cognitive Neuroscience to Autonomous Agents

AI 与大脑:从认知神经科学到自主代理的记忆系统

Jiafeng Liang, Hao Li, Chang Li, Jiaqi Zhou, Shixin Jiang, Zekun Wang, Changkai Ji, Zhihao Zhu, Runxuan Liu, Tao Ren, Jinlan Fu, See-Kiong Ng, Xia Liang, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology(哈尔滨工业大学) Fudan University(复旦大学) Peking University(北京大学) National University of Singapore(新加坡国立大学)

AI总结 本文从认知神经科学到自主代理,系统综合了记忆的跨学科知识,探讨了记忆的定义、功能、分类、存储机制及安全问题,并展望了多模态记忆系统和技能获取的未来研究方向。

Comments 57 pages, 5 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.23219 2025-12-30 cs.CV

MM-UAVBench: How Well Do Multimodal Large Language Models See, Think, and Plan in Low-Altitude UAV Scenarios?

MM-UAVBench: 多模态大语言模型在低空无人机场景中的感知、推理与规划能力如何?

Shiqi Dai, Zizhi Ma, Zhicong Luo, Xuesong Yang, Yibin Huang, Wanyue Zhang, Chi Chen, Zonghao Guo, Wang Xu, Yufei Sun, Maosong Sun

机构 * Tsinghua University(清华大学) Nankai University(南开大学) Northwest Polytechnical University(西北工业大学) Chinese Academy of Sciences(中国科学院) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 MM-UAVBench通过系统评估多模态大语言模型在低空无人机场景中的感知、推理与规划能力,揭示其在复杂任务中的性能瓶颈与改进方向。

Comments 25 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.08270 2025-12-30 cs.LG cs.AI cs.CL cs.MM

Doctor Sun: A Bilingual Multimodal Large Language Model for Biomedical AI

Doctor Sun: 一种双语多模态大语言模型用于生物医学AI

Dong Xue, Ziyao Shao, Zhaoyang Duan, Fangzhou Liu, Bing Li, Zhongheng Zhang

机构 * Key Laboratory of Smart Manufacturing in Energy Chemical Process, Ministry of Education East China University of Science and Technology(能源化工过程智能制造重点实验室,东华大学) Research Institute of Intelligent Control and Systems Harbin Institute of Technology(智能控制与系统研究室,哈尔滨工业大学) Department of Emergency Medicine, Sir Run Run Shaw Hospital Zhejiang University School of Medicine(浙江大学医学院急诊医学科) Provincial Key Laboratory of Precise Diagnosis Treatment of Abdominal Infection, Sir Run Run Shaw Hospital Zhejiang University School of Medicine(腹部感染精准诊断治疗省级重点实验室,浙江大学医学院) School of Medicine Shaoxing University(绍兴大学医学院)

AI总结 Doctor Sun是一种双语多模态大语言模型,通过整合预训练视觉编码器和医学LLM,提升生物医学多模态任务的性能,并提供SunMed-VL数据集支持研究进展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.04869 2025-12-30 cs.CV

DSwinIR: Rethinking Window-based Attention for Image Restoration

DSwinIR: 重新思考图像修复中的基于窗口的注意力

Gang Wu, Junjun Jiang, Kui Jiang, Xianming Liu, Liqiang Nie

机构 * School of Computer Science and Technology, Harbin Institute of Technology(计算机科学与技术学院,哈尔滨工业大学) School of Computer Science and Technology, Harbin Institute of Technology (Shenzhen)(计算机科学与技术学院,哈尔滨工业大学(深圳))

AI总结 DSwinIR提出了一种新的可变形滑动窗口注意力机制,通过token为中心和内容感知的方法提升图像修复性能,实现更灵活的特征交互和感受野调整。

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.15759 2025-12-30 cs.CL cs.AI cs.CV

Vision Enhancing LLMs: Empowering Multimodal Knowledge Storage and Sharing in LLMs

视觉增强大语言模型:赋能大语言模型中的多模态知识存储与共享

Yunxin Li, Zhenyu Liu, Baotian Hu, Wei Wang, Yuxin Ding, Xiaochun Cao, Min Zhang

机构 * Research Institute of Computing and Intelligence(计算与智能研究 institute) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出MKS2方法,通过多模态知识存储与共享增强大语言模型的推理能力,提升其在物理和常识知识场景下的表现。

Comments 21 pages, 7 figures; Accepted by IEEE TIP

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.22336 2025-12-30 cs.AI cs.CL

Agent2World: Learning to Generate Symbolic World Models via Adaptive Multi-Agent Feedback

Agent2World: 通过自适应多智能体反馈学习生成符号世界模型

Mengkang Hu, Bowei Xia, Yuran Wu, Ailing Yu, Yude Zou, Qiguang Chen, Shijian Wang, Jiarui Jin, Kexin Li, Wenxiang Jiao, Yuan Lu, Ping Luo

机构 * The University of Hong Kong(香港大学) Xiaohongshu Inc.(小红书公司) UESTC(电子科技大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 Agent2World通过自适应多智能体反馈学习生成符号世界模型,提升推理和微调性能,实现30.95%的相对提升。

Comments 48 pages, 15 tables, 7 figures, Project page: https://agent2world.github.io

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21573 2025-12-29 cs.RO

World-Coordinate Human Motion Retargeting via SAM 3D Body

通过SAM 3D Body进行世界坐标人体动作重定向

Zhangzheng Tu, Kailun Su, Shaolong Zhu, Yukun Zheng

机构 * Dalian University of Technology(大连理工大学) Shenzhen University(深圳大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 本文提出通过SAM 3D Body进行世界坐标人体动作重定向,利用轻量级物理约束实现机器人可用动作生成。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.02845 2025-12-29 eess.SP cs.AI physics.ins-det

AI-Enhanced Real-Time Wi-Fi Sensing Through Single Transceiver Pair

通过单个收发器对实现增强型实时Wi-Fi感知

Yuxuan Liu, Chiya Zhang, Yifeng Yuan, Chunlong He, Weizheng Zhang, Gaojie Chen

机构 * School of Electronic and Information Engineering, Harbin Institute of Technology(电子与信息工程学院,哈尔滨工业大学) Peng Cheng Laboratory (PCL)(鹏城实验室) Guangdong Key Laboratory of Intelligent Information Processing, Shenzhen University(智能信息处理广东省重点实验室,深圳大学) School of Flexible Electronics (SoFE), State Key Laboratory of Optoelectronic Materials and Technologies (OEMT), Sun Yat-sen University(柔性电子学院,光电材料与技术国家重点实验室,中山大学)

AI总结 本文提出了一种基于单个收发器对的实时AI驱动Wi-Fi感知系统,通过利用先验信息和时间相关性提升感知精度,实现人体姿态估计和室内定位的高精度实时检测。

Comments 13 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.16509 2025-12-29 cs.CV

SlowFast-SCI: Slow-Fast Deep Unfolding Learning for Spectral Compressive Imaging

SlowFast-SCI: 慢-快深度展开学习用于光谱压缩成像

Haijin Zeng, Xuan Lu, Yurong Zhang, Qiangqiang Shen, Guoqing Chao, Li Jiang, Yongyong Chen

机构 * Harvard University(哈佛大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Shanghai Jiaotong University(上海交通大学) City University of Hong Kong(香港城市大学) Harbin Institute of Technology, Weihai(哈尔滨工业大学(威海)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳))

AI总结 SlowFast-SCI是一种双速深度展开框架,通过预训练和自适应模块实现高效自适应的光谱重建,显著提升参数效率和适应速度。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21569 2025-12-29 cs.LG

AnchorGK: Anchor-based Incremental and Stratified Graph Learning Framework for Inductive Spatio-Temporal Kriging

AnchorGK: 基于锚点的增量和分层图学习框架用于归纳性时空克里格法

Xiaobin Ren, Kaiqi Zhao, Katerina Taškova, Patricia Riddle

机构 * School of Computer Science(计算机科学学院) University of Auckland(奥克兰大学) Shenzhen Key Laboratory of Internet Information Collaboration(互联网信息协作深圳实验室) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳学院)

AI总结 AnchorGK通过引入锚点分层和增量图学习,提升时空克里格法在稀疏数据和异质特征下的预测性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21540 2025-12-29 cs.AI

Leash: Adaptive Length Penalty and Reward Shaping for Efficient Large Reasoning Model

Leash:自适应长度惩罚与奖励塑造用于高效大推理模型

Yanhao Li, Lu Ma, Jiaran Zhang, Lexiang Tang, Wentao Zhang, Guibo Luo

机构 * Peking University(北京大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 Leash通过自适应长度惩罚与奖励塑造,有效提升大模型推理效率,减少推理长度60%同时保持性能竞争力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21487 2025-12-29 cs.DC cs.AI

Efficient MoE Inference with Fine-Grained Scheduling of Disaggregated Expert Parallelism

高效MoE推理的细粒度调度 disaggregated专家并行性

Xinglin Pan, Shaohuai Shi, Wenxiang Lin, Yuxin Wang, Zhenheng Tang, Wei Wang, Xiaowen Chu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科学与技术大学(广州)) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Hong Kong Baptist University(香港 Baptist 大学) The Hong Kong University of Science(香港科学与技术大学)

AI总结 FinDEP通过细粒度任务调度优化disaggregated专家并行性,提升MoE推理吞吐量,实验显示在32-GPU系统上达到1.24倍速度提升。

详情

展开后加载摘要…

URL PDF HTML 收藏
2501.10447 2025-12-27 eess.SY cs.RO cs.SY

A Predictive Cooperative Collision Avoidance for Multi-Robot Systems Using Control Barrier Function

基于控制屏障函数的多机器人系统预测性协作避障

Xiaoxiao Li, Zhirui Sun, Hongpeng Wang, Shuai Li, Jiankun Wang

机构 * Harbin Institute of Technology Shenzhen(哈尔滨工业大学深圳研究院) Southern University of Science and Technology(南方科技大学) University of Oulu(奥卢大学) VTT-Technical Research Centre of Finland(芬兰技术研究中心)

AI总结 本文提出基于预测安全矩阵的多机器人系统协作避障方法,通过最小特征值强化安全条件,并嵌入路径冲突策略以避免死锁,提升系统鲁棒性和效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.21333 2025-12-25 cs.CV

Fast SAM2 with Text-Driven Token Pruning

快速SAM2与文本驱动的标记剪枝

Avilasha Mandal, Chaoning Zhang, Fachrina Dewi Puspitasari, Xudong Wang, Jiaquan Zhang, Caiyan Qin, Guoqing Wang, Yang Yang, Heng Tao Shen

机构 * School of Computer Science and Engineering, University of Electronic Science and Technology of China(电子科技大学计算机科学与工程学院) Department of Computer Science and Engineering, Indian Institute of Technology, Delhi(印度理工学院德里分校计算机科学与工程系) School of Robotics and Advanced Manufacture, Harbin Institute of Technology(哈尔滨工业大学机器人与先进制造学院)

AI总结 本文提出文本驱动的标记剪枝方法,提升SAM2视频分割效率,实现推理速度提升42.50%和内存使用降低37.41%。

Comments 28 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20949 2025-12-25 cs.CL cs.AI

Neural Probe-Based Hallucination Detection for Large Language Models

基于神经探针的大型语言模型幻觉检测

Shize Liang, Hongzhi Wang

机构 * Faculty of Computing, Harbin Institute of Technology(计算机学院,哈尔滨工业大学)

AI总结 本文提出基于神经网络的token级幻觉检测框架,通过冻结语言模型参数并使用MLP探针进行非线性建模,结合多目标损失函数和贝叶斯优化,实现对LLMs幻觉内容的高效检测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20159 2025-12-24 cs.SE cs.AI

AXIOM: Benchmarking LLM-as-a-Judge for Code via Rule-Based Perturbation and Multisource Quality Calibration

AXIOM:通过基于规则的扰动和多源质量校准构建LLM-as-a-Judge代码评估基准

Ruiqi Wang, Xinchen Wang, Cuiyun Gao, Chun Yong Chong, Xin Xia, Qing Liao

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Monash University Malaysia(墨尔本大学马来西亚分校) Zhejiang University(浙江大学)

AI总结 AXIOM通过基于规则的扰动和多源质量校准构建代码评估基准,以实现高质量代码评分的平衡分布和可靠评估。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.20115 2025-12-24 cs.LG

Sample-Efficient Policy Constraint Offline Deep Reinforcement Learning based on Sample Filtering

基于样本过滤的高效策略约束离线深度强化学习

Yuanhao Chen, Qi Liu, Pengbin Chen, Zhongjian Qiao, Yanjie Li

机构 * Guangdong Key Laboratory of Intelligent Morphing Mechanisms(广东智能变形机制与自适应机器人重点实验室) the Harbin Institute of Technology Shenzhen(哈尔滨工业大学深圳研究院) Faculty of Robot Science and Engineering(机器人科学与工程学院) Northeastern University(东北大学) School of Systems Engineering(系统工程学院) City University of Hong Kong(香港城市大学)

AI总结 本文提出一种基于样本过滤的策略约束离线深度强化学习方法,通过筛选高分转移样本提升样本效率和性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19730 2025-12-24 cs.LG cs.CR

ArcGen: Generalizing Neural Backdoor Detection Across Diverse Architectures

ArcGen: 在多样架构上实现神经后门检测的泛化

Zhonghao Yang, Cheng Luo, Daojing He, Yiming Li, Yu Li

机构 * Software Engineering Institute, East China Normal University(东华大学软件工程学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) Nanyang Technological University(南洋理工大学) College of Integrated Circuits, Zhejiang University(浙江大学集成电路学院)

AI总结 ArcGen通过引入对齐层和损失函数,提升神经后门检测在不同架构上的泛化能力,实现42.5%的性能提升。

Comments 16 pages, 8 figures. This article was accepted by IEEE Transactions on Information Forensics and Security. DOI: 10.1109/TIFS.2025.3610254

Journal ref in IEEE Transactions on Information Forensics and Security, vol. 20, pp. 10082-10097, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.06244 2025-12-24 cs.LG cs.AI cs.CR

Membership Inference Attack with Partial Features

基于部分特征的成员推断攻击

Xurun Wang, Guangrui Liu, Xinjie Li, Haoyu He, Lin Yao, Zhongyun Hua, Weizhe Zhang

机构 * School of Cyberspace Science, Harbin Institute of Technology(信息科学学院,哈尔滨工业大学) Department of Data science and Al, Faculty of IT, Monash University(数据科学与人工智能系,墨尔本大学) School of Software, Dalian University of Technology(软件学院,大连理工大学) School of Computer Science and Technology, Harbin Institute of Technology(计算机科学与技术学院,哈尔滨工业大学)

AI总结 本研究提出MRAD框架,通过记忆引导重建和异常检测,解决部分特征下的成员推断攻击问题,验证了其在多种数据集上的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.06865 2025-12-24 cs.LG cs.AI

FP=xINT:Representing Neural Networks via Low-Bit Series Basis Functions

FP=xINT:通过低比特级数基函数表示神经网络

Boyang Zhang, Daning Cheng, Yunquan Zhang, Jiake Tian, Jing Li, Fangming Liu

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Pengcheng Laboratory(鹏城实验室) University of Chinese Academy of Sciences(中国科学院大学) Harbin Institute of Technology(哈尔滨工业大学) South China University of Technology(华南理工大学)

AI总结 本文提出通过低比特级数基函数表示神经网络的方法,实现无需校准集的高精度量化,实验表明在4比特设置下ResNet-50的精度达到77.03%。

Comments AAAI2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19564 2025-12-23 cs.RO cs.AI

Results of the 2024 CommonRoad Motion Planning Competition for Autonomous Vehicles

2024年自动驾驶车辆运动规划竞赛结果

Yanliang Huang, Xia Yan, Peiran Yin, Zhenduo Zhang, Zeyan Shao, Youran Wang, Haoliang Huang, Matthias Althoff

机构 * Technical University of Munich(慕尼黑技术大学) RWTH Aachen(亚琛工业大学) Harbin Institute of Technology(哈尔滨工业大学) Karlsruhe Institute of Technology(卡尔斯鲁厄理工学院)

AI总结 2024年CommonRoad运动规划竞赛评估了自动驾驶车辆在高速公路和城市环境中的运动规划算法性能,通过四个维度比较了多种高性能规划器。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.19537 2025-12-23 cs.CL

Event Extraction in Large Language Model

大规模语言模型中的事件提取

Bobo Li, Xudong Han, Jiang Liu, Yuzhe Ding, Liqiang Jing, Zhaoqi Zhang, Jinheng Li, Xinya Du, Fei Li, Meishan Zhang, Min Zhang, Aixin Sun, Philip S. Yu, Hao Fei

机构 * National University of Singapore(新加坡国立大学) University of Sussex(苏塞克斯大学) Wuhan University(武汉大学) University of Texas at Dallas(德克萨斯大学达拉斯分校) Nanyang Technological University(南洋理工大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) University of Illinois at Chicago(伊利诺伊大学香槟分校)

AI总结 本文探讨了大规模语言模型中事件提取的系统组件,提出通过事件方案、结构和存储提升事件处理的可靠性与智能体准备性。

Comments 38 pages, 9 Figures, 5 Tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.11712 2025-12-23 cs.AI

Mitigating Hallucination Through Theory-Consistent Symmetric Multimodal Preference Optimization

通过理论一致的对称多模态偏好优化缓解幻觉

Wenqi Liu, Xuemeng Song, Jiaxi Li, Yinwei Wei, Na Zheng, Jianhua Yin, Liqiang Nie

机构 * Shandong University(山东大学) Southern University of Science and Technology(南方科技大学) University of Georgia(佐治亚大学) National University of Singapore(新加坡国立大学) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 SymMPO通过理论一致的对称多模态偏好优化方法,有效缓解多模态大语言模型中的幻觉问题。

Comments NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.11734 2025-12-23 cs.GR cs.CV

Recent Advances in 3D Object and Scene Generation: A Survey

近年来3D对象和场景生成的最新进展:综述

Xiang Tang, Ruotong Li, Xiaopeng Fan

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Pengcheng Laboratory(鹏城实验室) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文综述了3D对象和场景生成的最新进展,分析了主流生成模型和技术路径,指出了当前挑战与未来研究方向。

Comments 35 pages, 7 figures, 6 tables, Project page: https://github.com/xdlbw/Awesome-3D-Object-and-Scene-Generation

详情

展开后加载摘要…

URL PDF HTML 收藏
2406.05491 2025-12-23 cs.CV cs.CR

One Perturbation is Enough: On Generating Universal Adversarial Perturbations against Vision-Language Pre-training Models

一次扰动就足够:针对视觉-语言预训练模型生成通用对抗扰动

Hao Fang, Jiawei Kong, Wenbo Yu, Bin Chen, Jiawei Li, Hao Wu, Shutao Xia, Ke Xu

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出C-PGC方法,通过对比学习生成通用对抗扰动,攻击视觉-语言预训练模型的多模态对齐能力。

Comments Accepted by ICCV-2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.18228 2025-12-23 cs.SE cs.LG

Toward Efficient Testing of Graph Neural Networks via Test Input Prioritization

通过测试输入优先级提升图神经网络的效率

Lichen Yang, Qiang Wang, Zhonghao Yang, Daojing He, Yu Li

机构 * Computer Science and Technology(计算机科学与技术) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Integrated Circuits(集成电路) Zhejiang University(浙江大学) Software Engineering Institute(软件工程研究所) East China Normal University(华东师范大学)

AI总结 GraphRank通过引入模型无关属性和图结构信息,提升图神经网络测试输入优先级的效率和准确性。

Comments This is the author-accepted manuscript of a paper published in Automated Software Engineering Journal

Journal ref Autom Softw Eng 33, 14 (2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.15527 2025-12-23 eess.IV cs.CV

PIGUIQA: A Physical Imaging Guided Perceptual Framework for Underwater Image Quality Assessment

PIGUIQA: 一种基于物理成像的感知框架用于水下图像质量评估

Weizhi Xian, Mingliang Zhou, Leong Hou U, Zhengguo Li

机构 * Chongqing Research Institute of Harbin Institute of Technology(哈尔滨工业大学重庆研究所) Harbin Institute of Technology(哈尔滨工业大学) Faculty of Computing(计算机学院) School of Computer Science(计算机科学学院) University of Macau(澳门大学) Institute for Infocomm Research(信息与通信研究所以)

AI总结 PIGUIQA提出一种基于物理成像的感知框架,通过整合物理模型和局部感知机制,实现水下图像质量评估的高精度预测。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.17573 2025-12-22 cs.CV

RoomEditor++: A Parameter-Sharing Diffusion Architecture for High-Fidelity Furniture Synthesis

RoomEditor++: 一种用于高保真家具合成的参数共享扩散架构

Qilong Wang, Xiaofan Ming, Zhenyi Lin, Jinwen Li, Dongwei Ren, Wangmeng Zuo, Qinghua Hu

机构 * School of Artificial Intelligence, Tianjin University(天津大学人工智能学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) Engineering Research Center of City Intelligence and Digital Governance, Ministry of Education(教育部城市智能与数字治理工程研究中心)

AI总结 RoomEditor++通过参数共享的扩散架构实现高保真家具合成,提供公开数据集并优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.16786 2025-12-19 eess.SP cs.LG

Few-Shot Specific Emitter Identification via Integrated Complex Variational Mode Decomposition and Spatial Attention Transfer

基于集成复变分模态分解与空间注意力迁移的少样本特定发射机识别

Chenyu Zhu, Zeyang Li, Ziyi Xie, Jie Zhang

机构 * School of Information Science and Technology, Harbin Institute of Technology (Shenzhen)(信息科学与技术学院,哈尔滨工业大学(深圳)) Ranplan Wireless Network Design Ltd.(Ranplan无线网络设计有限公司)

AI总结 本文提出了一种结合复变分模态分解与空间注意力迁移的少样本特定发射机识别方法,通过有效特征提取和自适应加权提升识别性能,仅需10个符号即可达到96%的准确率。

Comments 14 pages, 12 Figures, 5 Table

详情

展开后加载摘要…

URL PDF HTML 收藏