arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Harbin Institute of Technology(哈尔滨工业大学)

共收录 1439
2603.23960 2026-03-26 cs.CV

Leave No Stone Unturned: Uncovering Holistic Audio-Visual Intrinsic Coherence for Deepfake Detection

不留死角:揭示深度伪造检测中的整体音频视觉内在一致性

Jielun Peng, Yabin Wang, Yaqi Li, Long Kong, Xiaopeng Hong

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出HAVIC方法,通过学习模态特定的结构一致性及跨模态微/宏观一致性,提升深度伪造检测的鲁棒性和泛化能力,实验表明其在跨数据集场景中性能提升显著。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.02507 2026-03-26 cs.CV

Rethinking Transparent Object Grasping: Depth Completion with Monocular Depth Estimation and Instance Mask

重新思考透明物体抓取:基于单目深度估计和实例掩码的深度补全

Yaofeng Cheng, Xinkai Gao, Sen Zhang, Chao Zeng, Fusheng Zha, Lining Sun, Chenguang Yang

机构 * State Key Laboratory of Robotics and System at Harbin Institute of Technology(哈尔滨工业大学机器人系统国家重点实验室) Lanzhou University of Technology(兰州理工大学) Department of Computer Science(计算机科学系) University of Liverpool(利物浦大学)

AI总结 本文提出ReMake框架,通过实例掩码和单目深度估计提升透明物体的深度补全精度,改进真实场景下的抓取可靠性。

Journal ref IEEE Robotics and Automation Letters ( Volume: 11, Issue: 5, May 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22953 2026-03-25 cs.CV

Cluster-Wise Spatio-Temporal Masking for Efficient Video-Language Pretraining

基于簇的时空掩码用于高效的视频-语言预训练

Weijun Zhuang, Yuqing Huang, Weikang Meng, Xin Li, Ming Liu, Xiaopeng Hong, Yaowei Wang, Wangmeng Zuo

机构 * Harbin Institute of Technology(哈尔滨工业大学) Pengcheng Laboratory(鹏城实验室)

AI总结 本文提出ClusterSTM策略,通过簇内掩码保留关键时空信息,提升视频-语言预训练效率,并在多任务上取得新状态。

Comments Accepted by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19709 2026-03-25 cs.RO

Morphology-Consistent Humanoid Interaction through Robot-Centric Video Synthesis

通过机器人中心视频合成实现形态一致的人形交互

Weisheng Xu, Jian Li, Yi Gu, Bin Yang, Haodong Chen, Shuyi Lin, Mingqian Zhou, Jing Tan, Qiwei Wu, Xiangrui Jiang, Taowen Wang, Jiawen Wen, Qiwei Liang, Jiaxi Zhang, Renjing Xu

机构 * Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Shenzhen University(深圳大学) University of Cambridge(剑桥大学)

AI总结 本文提出Dream2Act框架,通过生成视频合成实现零样本人形机器人交互,避免传统retargeting的形态差距问题,提升任务完成率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.07057 2026-03-25 cs.CV

SODA: Sensitivity-Oriented Dynamic Acceleration for Diffusion Transformer

SODA:面向敏感性的动态加速方法用于扩散变换器

Tong Shao, Yusen Fu, Guoying Sun, Jingde Kong, Zhuotao Tian, Jingyong Su

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 SODA通过细粒度敏感性分析动态调整缓存与剪枝策略,提升扩散变换器在可控加速比下的生成质量,实验表明其生成保真度达到最优。

Comments 23 pages, CVPR 2026 accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22352 2026-03-25 cs.LG cs.AI

WIST: Web-Grounded Iterative Self-Play Tree for Domain-Targeted Reasoning Improvement

WIST:基于网页的迭代自我对战树用于领域针对性推理改进

Fangyuan Li, Pengfei Li, Shijie Wang, Junqi Gao, Jianxing Liu, Biqing Qi, Yuqiang Li

机构 * Harbin Institute of Technology(哈尔滨工业大学) Shanghai Innovation Institute(上海创新研究院) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室)

AI总结 WIST通过基于网页的迭代自我对战树框架,无需预设领域语料,直接从开放网络学习,提升领域推理能力,优于纯内生自我进化和语料基础自我对战基线。

Comments 23 pages, 4 figures. Submitted to ACL2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.22096 2026-03-24 cs.AI

GSEM: Graph-based Self-Evolving Memory for Experience Augmented Clinical Reasoning

基于图的自演化记忆:用于经验增强的临床推理

Xiao Han, Yuzheng Fan, Sendong Zhao, Haochun Wang, Bing Qin

机构 * Research Center for Social Computing and Interactive Robotics, Harbin Institute of Technology, China(社会计算与交互机器人研究中心,哈尔滨工业大学,中国)

AI总结 本文提出GSEM,一种基于图的自演化记忆框架,通过双层记忆图组织临床经验,捕捉决策结构与经验间的关系依赖,实现应用感知检索和在线反馈校准,实验显示在两个基准上均取得最高准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21908 2026-03-24 cs.LG

SparseDVFS: Sparse-Aware DVFS for Energy-Efficient Edge Inference

SparseDVFS: 基于稀疏性的边缘推理能效优化动态电压频率调节框架

Ziyang Zhang, Zheshun Wu, Jie Liu, Luca Mottola

机构 * Harbin Institute of Technology(哈尔滨工业大学)

AI总结 本文提出SparseDVFS框架,通过区分计算密集型密集运算符和内存密集型稀疏运算符,利用专用频率三元组提升边缘推理能效,实验表明在保持成本优势的同时实现78.17%的能效提升。

Comments 14 pages, 19 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21904 2026-03-24 cs.CV cs.AI

SHAPE: Structure-aware Hierarchical Unsupervised Domain Adaptation with Plausibility Evaluation for Medical Image Segmentation

SHAPE:基于结构的分层无监督领域自适应与合理性评估用于医学图像分割

Linkuan Zhou, Yinghao Xia, Yufei Shen, Xiangyu Li, Wenjie Du, Cong Cong, Leyi Wei, Ran Su, Qiangguo Jin

机构 * School of Software, Northwestern Polytechnical University(西北工业大学软件学院) School of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术学院) School of Software Engineering, USTC(USTC软件工程学院) Australian Institute of Health Innovation, Macquarie University(麦考瑞大学健康创新研究所) Faculty of Applied Science, Macao Polytechnic University(澳门理工学院应用科学学院) School of Computer Software, Tianjin University(天津大学计算机软件学院)

AI总结 SHAPE通过结构感知的分层无监督领域自适应与合理性评估,提升医学图像分割在跨模态任务中的性能,采用超图合理性估计和结构异常修剪方法,显著提高心脏和腹部数据的Dice分数。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21544 2026-03-24 cs.NE cs.AI

Evolutionary Biparty Multiobjective UAV Path Planning: Problems and Empirical Comparisons

进化双目标多目标无人机路径规划:问题与实证比较

Kesheng Chen, Wenjian Luo, Xin Lin, Zhen Song, Yatong Chang

机构 * Guangdong Provincial Key Laboratory of Novel Security Intelligence Technologies, School of Computer Science and Technology, Harbin Institute of Technology, Shenzhen(广东省新型安全智能技术重点实验室,哈尔滨工业大学计算机科学与技术学院,深圳) Peng Cheng Laboratory(鹏城实验室) School of Artificial Intelligence/School of Future Technology, Nanjing University of Information Science and Technology(人工智能学院/未来技术学院,南京信息科学技术大学)

AI总结 本文首次提出双目标多目标无人机路径规划问题,改进并比较了多种多目标优化算法在效率与安全目标下的性能。

Comments \c{opyright} 2026 IEEE. Personal use of this material is permitted. Permission from IEEE must be obtained for all other uses, in any current or future media, including reprinting/republishing this material for advertising or promotional purposes, creating new collective works, for resale or redistribution to servers or lists, or reuse of any copyrighted component of this work in other works

Journal ref Chen, K., Luo, W., Lin, X., Song, Z., & Chang, Y. (2024). Evolutionary biparty multiobjective UAV path planning: Problems and empirical comparisons. IEEE Transactions on Emerging Topics in Computational Intelligence, 8(3), 2433-2445

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21530 2026-03-24 cs.SE cs.AI

LLM-Based Test Case Generation in DBMS through Monte Carlo Tree Search

通过蒙特卡洛树搜索的基于大语言模型的数据库管理系统测试用例生成

Yujia Chen, Yingli Zhou, Fangyuan Zhang, Cuiyun Gao

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Huawei Hong Kong Research Center(华为香港研究中心)

AI总结 本文提出MIST框架,通过蒙特卡洛树搜索生成不同数据库管理系统方言的语法正确且语义多样的测试用例,提升代码覆盖率。

Comments Accepted to ICSE 2026 Industry Challenge Track

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21502 2026-03-24 cs.LG cs.AI

Quotient Geometry, Effective Curvature, and Implicit Bias in Simple Shallow Neural Networks

商几何、有效曲率与浅层神经网络中的隐含偏差

Hang-Cheng Dong, Pengcheng Cheng

机构 * School of Instrumentation Science and Engineering, Harbin Institute of Technology(哈尔滨工程大学仪器科学与工程学院) Harbin Institute of Technology Suzhou Research Institute(哈尔滨工业大学苏州市研究院) School of Mathematics, Jilin University(吉林大学数学学院)

AI总结 本文通过商空间分析浅层神经网络的几何结构,提出有效曲率概念以去除对称性退化,揭示隐含偏差与预测器复杂度的关系。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.14408 2026-03-24 cs.CV cs.AI

Feature Recalibration Based Olfactory-Visual Multimodal Model for Enhanced Rice Deterioration Detection

基于特征重校准的嗅觉-视觉多模态模型用于增强稻米劣变检测

Rongqiang Zhao, Hengrui Hu, Yijing Wang, Mingchun Sun, Jie Liu

机构 * Faculty of Computing, Harbin Institute of Technology(哈尔滨工业大学计算机学院) National Key Laboratory of Smart Farm Technologies and Systems(国家智能农业技术与系统重点实验室)

AI总结 本文提出基于特征重校准的嗅觉-视觉多模态模型,通过改进的特征嵌入构造器和重校准注意力网络,提升稻米劣变检测的准确性和效率,相比传统方法提升11.51%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.20066 2026-03-24 cs.CV

PAUL: Uncertainty-Guided Partition and Augmentation for Robust Cross-View Geo-Localization under Noisy Correspondence

PAUL:基于不确定性的分区与增强以实现在噪声对应下的鲁棒跨视图地理定位

Zheng Li, Xueyi Zhang, Yanming Guo, Yuxiang Xie, Ding Zhaoyun, Siqi Cai, Haizhou Li, Mingrui Lao

机构 * National University of Defense Technology(国防科技大学) Shenzhen Loop Area Institute(深圳河套学院) School of Artificial Intelligence, The Chinese University of Hong Kong, Shenzhen(香港中文大学深圳人工智能学院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳研究院)

AI总结 本文提出PAUL框架,通过不确定性感知的共增强和证据共训练,解决跨视图地理定位中的噪声对应问题,提升鲁棒性。

Comments 10 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2401.04317 2026-03-24 cs.CV cs.CL

WiFi-GEN: High-Resolution Indoor Imaging from WiFi Signals Using Generative AI

WiFi-GEN:利用生成式人工智能进行高分辨率室内成像

Jianyang Shi, Bowen Zhang, Amartansh Dubey, Ross Murch, Liwen Jing

机构 * Pengcheng Laboratory(鹏城实验室) College of Big Data and Internet(大数据与互联网学院) Shenzhen Technology University(深圳技术大学) Department of Electrical Engineering(电子工程系) Indian Institute of Technology Delhi(印度理工学院德里分校) Department of Electronic and Computer Engineering(电子与计算机工程系) HKUST(香港科技大学) School of Computer Science and Technology(计算机科学与技术学院) Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳))

AI总结 本文提出WiFi-GEN,通过生成式人工智能将测量到的WiFi功率转换为高分辨率室内图像,其形状重建精度比物理模型方法高275%,且Frechet Inception Distance得分降低82%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21237 2026-03-24 cs.AI

ConsRoute:Consistency-Aware Adaptive Query Routing for Cloud-Edge-Device Large Language Models

ConsRoute:面向云-边-设备大语言模型的一致性感知自适应查询路由

Haoyu Qiao, Hao Zhang, Shanwen Mao, Siyao Cheng, Jie Liu

机构 * Department of Computer Science and Technology, Harbin Institute of Technology(哈尔滨工业大学计算机科学与技术系) National Key Laboratory of Smart Farm Technologies and Systems(国家智能农业技术与系统重点实验室) Department of Computer Science and Technology, Harbin Institute of Technology (ShenZhen)(哈尔滨工业大学(深圳)计算机科学与技术系)

AI总结 本文提出ConsRoute框架,通过语义一致性评估和高效路由策略提升大语言模型推理效率,减少延迟和成本,实验表明其性能接近云端且优于现有方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21134 2026-03-24 cs.RO cs.CV

Anatomical Prior-Driven Framework for Autonomous Robotic Cardiac Ultrasound Standard View Acquisition

基于解剖先验的自主机器人心脏超声标准视图采集框架

Zhiyan Cao, Zhengxi Wu, Yiwei Wang, Pei-Hsuan Lin, Li Zhang, Zhen Xie, Huan Zhao, Han Ding

机构 * State Key Laboratory of Intelligent Manufacturing Equipment and Technology, Huazhong University of Science and Technology(华中科技大学智能制造装备与技术国家重点实验室) School of Biomedical Engineering, Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)生物医学工程学院) Information Intelligence Lab, Department of Electrical Engineering, National Chung Hsing University(中原大学电子工程系信息智能实验室) Institute of Medical Equipment Science and Engineering, Huazhong University of Science and Technology(华中科技大学医学装备科学与工程研究院) Department of Ultrasound Medicine, Union Hospital, Tongji Medical College, Huazhong University of Science and Technology(华中科技大学同济医学院附属同济医院超声医学科) Institute of Systems Science (ISS), National University of Singapore (NUS)(新加坡国立大学系统科学研究所)

AI总结 本文提出结合心脏结构分割与自主探头调整的框架,通过解剖先验引导提升超声标准视图采集的自动化水平,实验表明其在分割精度和探头调整成功率上均有显著提升。

Comments Accepted for publication at the IEEE ICRA 2026. 8 pages, 5 figures, 3 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.21051 2026-03-24 cs.RO

Cortical Policy: A Dual-Stream View Transformer for Robotic Manipulation

皮层策略:一种双流视图变换器用于机器人操作

Xuening Zhang, Qi Lv, Xiang Deng, Miao Zhang, Xingbo Liu, Liqiang Nie

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) Shandong Jianzhu University(山东建筑大学)

AI总结 本文提出Cortical Policy,通过双流视图变换器提升机器人操作中的空间和动态推理能力,实验证明其在复杂任务中的优越性。

Comments Published as a conference paper at ICLR 2026. 10 pages, 4 figures. Appendix included

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20602 2026-03-24 stat.ML cs.AI cs.LG

Interpretable Operator Learning for Inverse Problems via Adaptive Spectral Filtering: Convergence and Discretization Invariance

通过自适应频谱滤波的可解释运算学习求解反问题:收敛性与离散不变性

Hang-Cheng Dong, Pengcheng Cheng, Shuhuan Li

机构 * School of Instrumentation Science and Engineering, Harbin Institute of Technology(仪器科学与工程学院,哈尔滨工业大学) School of Mathematics, Jilin University(吉林大学数学学院) School of Mathematics, Inner Mongolia University(内蒙古大学数学学院)

AI总结 SC-Net通过频谱域学习自适应滤波器,实现反问题的稳定求解,理论证明其收敛性并保证离散不变性,实验显示其在不同分辨率下均表现优异。

Comments 16 pages, 3 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.01498 2026-03-24 cs.CV

Tri-path DINO: Feature Complementary Learning for Remote Sensing Multi-Class Change Detection

三路径DINO:用于遥感多类变化检测的特征互补学习

Kai Zheng, Hang-Cheng Dong, Shoulei Liu, Zhenkai Wu, Fupeng Wei, Lei Ding, Wei Zhang

机构 * School of Computer Science and Technology, Zhejiang University(浙江大学计算机科学与技术学院) School of Instrumentation Science and Engineering, Harbin Institute of Technology(哈尔滨工业大学仪器科学与工程学院) Harbin Institute of Technology Suzhou Research Institute(哈尔滨工业大学苏州研究院) Ningbo Haichuang Group Co., Ltd.(宁波海创集团有限公司) School of Software Technology, Zhejiang University(浙江大学软件学院) School of Information Engineering, North China University of Water Resources and Electric Power(中国北方水利电力大学信息工程学院) Department of Geo-spatial Information, Information Engineering University(信息工程大学地理信息学院) Innovation Center of Yangtze River Delta, Zhejiang University(长三角创新中心,浙江大学)

AI总结 本文提出Tripath DINO架构,通过三路径互补特征学习策略提升预训练模型在复杂垂直领域快速适应能力,实现了在Gaza和SECOND数据集上的多类变化检测最优性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.12224 2026-03-24 cs.RO cs.AI

RoboFAC: A Comprehensive Framework for Robotic Failure Analysis and Correction

RoboFAC:机器人故障分析与纠正的综合框架

Zewei Ye, Weifeng Lu, Minghao Ye, Tao Lin, Shuo Yang, Junchi Yan, Bo Zhao

机构 * School of AI, Shanghai Jiao Tong University(上海交通大学人工智能学院) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳))

AI总结 RoboFAC通过构建大规模故障中心数据集,开发轻量级多模态模型,提升机器人故障诊断与纠正能力,实验显示其故障分析准确率比GPT-4o高34.1%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20236 2026-03-24 cs.RO

EnergyAction: Unimanual to Bimanual Composition with Energy-Based Models

EnergyAction: 从单臂到双臂操作的能量模型框架

Mingchen Song, Xiang Deng, Jie Wei, Dongmei Jiang, Liqiang Nie, Weili Guan

机构 * Harbin Institute of Technology (Shenzhen)(哈尔滨工业大学(深圳)) PengCheng Laboratory(鹏城实验室) Shenzhen Loop Area Institute(深圳河套学院)

AI总结 本文提出EnergyAction框架,通过能量模型将单臂操作策略迁移至双臂任务,解决双臂操作中数据不足和动作协调难题,实验显示其在模拟和真实任务中表现优异。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.20017 2026-03-23 cs.CL cs.DB cs.IR

RouterKGQA: Specialized--General Model Routing for Constraint-Aware Knowledge Graph Question Answering

RouterKGQA: 专用-通用模型路由用于约束感知的知识图谱问答

Bo Yuan, Hexuan Deng, Xuebo Liu, Min Zhang

机构 * Institute of Computing and Intelligence, Harbin Institute of Technology, Shenzhen, China(哈尔滨工业大学深圳研究院) Zhongguancun Academy, Beijing, China(中关村学院)

AI总结 RouterKGQA提出专用-通用模型协作框架,通过专用模型生成推理路径,通用模型在必要时进行知识图谱引导修复,提升性能并降低成本,实验显示在多个基准上F1和Hits@1均优于现有最佳方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19918 2026-03-23 cs.CV cs.AI

Learning Like Humans: Analogical Concept Learning for Generalized Category Discovery

像人类一样学习:用于通用类别发现的类比概念学习

Jizhou Han, Chenhao Ding, Yuhang He, Qiang Wang, Shaokun Wang, SongLin Dong, Yihong Gong

机构 * State Key Laboratory of Human-Machine Hybrid Augmented Intelligence, Institute of Artificial Intelligence and Robotics, Xi’an Jiaotong University(人机混合增强智能国家重点实验室,人工智能与机器人研究院,西安交通大学) School of Software Engineering, Xi’an Jiaotong University(软件工程学院,西安交通大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Shenzhen University of Advanced Technology(深圳大学)

AI总结 本文提出ATCG模块,通过类比已知知识生成文本概念,结合视觉特征提升类别发现性能,在六个基准测试中均取得显著提升,尤其在细粒度数据上表现突出。

Comments Accept by CVPR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19752 2026-03-23 cs.CV

PhysNeXt: Next-Generation Dual-Branch Structured Attention Fusion Network for Remote Photoplethysmography Measurement

PhysNeXt:下一代双分支结构注意力融合网络用于远程光体积脉搏波测记测量

Junzhe Cao, Bo Zhao, Zhiyi Niu, Dan Guo, Yue Sun, Haochen Liang, Yong Xu, Zitong YU

机构 * Harbin Institute of Technology, Shenzhen(哈尔滨工业大学(深圳)) Great Bay University(大湾区大学) Hefei University of Technology(合肥工业大学) Macao Polytechnic University(澳门理工学院)

AI总结 PhysNeXt通过融合视频帧和STMap表示,结合时空差分建模单元和跨模态交互模块,提升rPPG信号提取的鲁棒性,实验表明其在挑战性条件下具有更稳定和精细的信号恢复能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19714 2026-03-23 cs.CL

LoopRPT: Reinforcement Pre-Training for Looped Language Models

LoopRPT: 用于循环语言模型的强化预训练

Guo Tang, Shixin Jiang, Heng Chang, Nuo Chen, Yuhan Li, Huiming Fan, Jia Li, Ming Liu, Bing Qin

机构 * Harbin Institute of Technology, Harbin, China(哈尔滨工业大学) Tsinghua University, Beijing, China(清华大学) The Hong Kong University of Science and Technology, Guangzhou, China(香港科学与技术大学)

AI总结 本文提出LoopRPT框架,通过将下一步预测转化为推理任务,利用EMA教师参考和噪声潜在轨迹直接优化循环语言模型的中间表示,提升表示质量并实现准确度与计算量的帕累托最优。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.15164 2026-03-23 cs.CV

Multimodal Continual Instruction Tuning with Dynamic Gradient Guidance

多模态持续指令微调与动态梯度指导

Songze Li, Mingyu Gao, Tonghua Su, Xu-Yao Zhang, Zhongjie Wang

机构 * Harbin Institute of Technology(哈尔滨工业大学) Guangdong Laboratory of Artificial Intelligence and Digital Economy (SZ)(广东人工智能与数字经济发展实验室) Chongqing Research Institute of HIT(重庆哈工大研究院) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出通过几何参数空间方向向量近似缺失梯度,结合有限回放缓冲区和伯努利采样策略,有效缓解多模态持续指令微调中的灾难性遗忘问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.19313 2026-03-23 cs.CL cs.AI

Memory-Driven Role-Playing: Evaluation and Enhancement of Persona Knowledge Utilization in LLMs

基于记忆的角色扮演:评估和增强LLM中人设知识的利用

Kai Wang, Haoyang You, Yang Zhang, Zhongjie Wang

机构 * Harbin Institute of Technology(哈尔滨工业大学) Macquarie University(麦考瑞大学)

AI总结 本文提出Memory-Driven Role-Playing框架,通过MREval、MRPrompt和MRBench评估LLM在角色扮演中的记忆能力,验证了小模型能效媲美大模型,并证明上游记忆提升下游响应质量。

Comments 34 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18891 2026-03-20 cs.CV cs.LG

PromptHub: Enhancing Multi-Prompt Visual In-Context Learning with Locality-Aware Fusion, Concentration and Alignment

PromptHub: 通过局部感知融合、集中和对齐增强多提示视觉上下文学习

Tianci Luo, Jinpeng Wang, Shiyu Qin, Niu Lian, Yan Feng, Bin Chen, Chun Yuan, Shu-Tao Xia

机构 * Tsinghua Shenzhen International Graduate School, Tsinghua University(清华大学深圳国际研究生院,清华大学) Harbin Institute of Technology, Shenzhen(哈尔滨工业大学深圳分校) Meituan, Beijing(美团,北京)

AI总结 PromptHub通过局部感知融合、集中和对齐方法提升多提示视觉上下文学习性能,验证了其在多种视觉任务中的优越性及泛化能力。

Comments Accepted to ICLR 2026. 17 pages, 11 figures, and 9 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.18688 2026-03-20 cs.LG cs.CL

STEP: Scientific Time-Series Encoder Pretraining via Cross-Domain Distillation

STEP: 通过跨领域知识蒸馏实现科学时间序列的编码器预训练

Chen Zhang, Liwei Liu, Jun Tao, Xiaoyu Yang, Xuenan Xu, Kai Chen, Bowen Zhou, Wen Wu, Chao Zhang

机构 * Shanghai Aritificial Intelligence Laboratory(上海人工智能实验室) Tsinghua University(清华大学) Harbin Institute of Technology(哈尔滨工业大学) Sichuan University(四川大学) University of Cambridge(剑桥大学)

AI总结 本文提出STEP框架,通过跨领域知识蒸馏整合多领域基础模型,构建统一的科学时间序列编码器,提升科学时间序列的表示学习能力。

详情

展开后加载摘要…

URL PDF HTML 收藏