arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

共收录 1226
2510.00635 2026-04-09 cs.CV

Erased, But Not Forgotten: Erased Rectified Flow Transformers Still Remain Unsafe Under Concept Attack

被擦除,但未被遗忘:擦除的修正流变换器在概念攻击下仍不安全

Nanxiang Jiang, Zhaoxin Fan, Enhan Kang, Daiheng Gao, Yun Zhou, Yanxia Chang, Zheng Zhu, Yeying Jin, Wenjun Wu

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院未来区块链与隐私计算北京高精尖创新中心) University of Science and Technology of China(中国科学技术大学) National University of Defense Technology(国防科技大学) GigaAI National University of Singapore(新加坡国立大学)

AI总结 本文提出ReFlux,首个针对最新修正流T2I框架评估概念擦除鲁棒性的攻击方法,通过反注意力优化和动态引导策略,验证了概念擦除在修正流变换器中的有效性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2306.14685 2026-04-09 cs.CV cs.AI

DiffSketcher: Text Guided Vector Sketch Synthesis through Latent Diffusion Models

DiffSketcher: 通过潜在扩散模型实现文本引导的向量草图合成

Ximing Xing, Chuang Wang, Haitao Zhou, Jing Zhang, Qian Yu, Dong Xu

机构 * Beihang University(北京航空航天大学) The University of Hong Kong(香港大学)

AI总结 本文提出DiffSketcher,通过扩展的SDS损失优化贝塞尔曲线,实现从自然语言提示直接生成向量草图,提升生成质量与可控性。

Comments Accepted by NeurIPS 2023. Project page: https://ximinng.github.io/DiffSketcher-project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07171 2026-04-09 cs.LG

Smart Commander: A Hierarchical Reinforcement Learning Framework for Fleet-Level PHM Decision Optimization

智能指挥官:面向舰队级PHM决策优化的分层强化学习框架

Yong Si, Mingfei Lu, Jing Li, Yang Hu, Guijiang Li, Yueheng Song, Zhaokui Wang

机构 * School of Aerospace Engineering, Tsinghua University(清华大学航天航空学院) College of Information and Control Engineering, Xi'an University of Architecture and Technology(西安建筑科技大学信息与控制工程学院) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) First Aircraft Institute of Aviation Industry Corporation of China(中国航空工业集团公司第一飞机设计研究院) Science and Technology on Complex Aviation System Simulation Laboratory(复杂航空系统仿真重点实验室)

AI总结 本文提出Smart Commander框架,通过分层强化学习解决军事航空PHM中高维问题、稀疏反馈和随机任务配置带来的挑战,实现维护和后勤决策优化,展现出更高的效率和鲁棒性。

Comments 21 pages, 6 figures, 4 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06067 2026-04-08 cs.RO

HiPolicy: Hierarchical Multi-Frequency Action Chunking for Policy Learning

HiPolicy:分层多频动作分块用于策略学习

Jiyao Zhang, Zimu Han, Junhan Wang, Xionghao Wu, Shihong Lin, Jinzhou Li, Hongwei Fan, Ruihai Wu, Dongjiang Li, Hao Dong

机构 * CFCS, School of CS, PKU(北京大学计算机学院计算与金融研究中心) National Key Laboratory for Multimedia Information Processing, School of CS, PKU(北京大学计算机学院多媒体信息处理国家重点实验室) XJTU(西安交通大学) THU(清华大学) BUAA(北京航空航天大学) Jingdong Technology Information Technology Co., Ltd(京东科技信息技术有限公司)

AI总结 HiPolicy通过分层多频动作分块框架,联合预测不同频率的动作序列,以捕捉粗粒度高层次计划和精确的反应动作,提升策略学习的性能和执行效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05930 2026-04-08 cs.CL cs.AI

"I See What You Did There": Can Large Vision-Language Models Understand Multimodal Puns?

我看出你在那儿:大型视觉-语言模型能否理解多模态双关语?

Naen Xu, Jiayi Sheng, Changjiang Li, Chunyi Zhou, Yuyuan Li, Tianyu Du, Jun Wang, Zhihui Fu, Jinbao Li, Shouling Ji

机构 * Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Palo Alto Networks Hangzhou Dianzi University(杭州电子科技大学) Ningbo Global Innovation Center, Zhejiang University(浙江大学宁波全球创新中心) OPPO Research Institute(OPPO研究院) Qilu University of Technology(齐鲁工业大学)

AI总结 本文研究了大型视觉-语言模型理解多模态双关语的能力,提出多模态双关语生成流程和MultiPun数据集,通过评估发现模型在区分真实双关语与干扰项上表现不足,并提出提示级和模型级策略提升理解性能。

Comments ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05831 2026-04-08 cs.RO

BiCoord: A Bimanual Manipulation Benchmark towards Long-Horizon Spatial-Temporal Coordination

BiCoord: 一种面向长时域空间-时间协调的双臂操作基准

Xingyu Peng, Chen Gao, Liankai Jin, Annan Li, Si Liu

机构 * Beihang University(北京航空航天大学) Zhongguancun Academy(中关村学院) National University of Singapore(新加坡国立大学)

AI总结 BiCoord基准旨在解决双臂操作中长时域和紧密协调的问题,通过多样化的任务和量化指标评估协调性,揭示现有方法在长时域任务中的不足。

Comments 8 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.05517 2026-04-08 cs.AI

UniCreative: Unifying Long-form Logic and Short-form Sparkle via Reference-Free Reinforcement Learning

UniCreative:通过无参考强化学习统一长格式逻辑与短格式闪耀

Xiaolong Wei, Zerun Zhu, Simin Niu, Xingyu Zhang, Peiying Yu, Changxuan Xiao, Yuchen Li, Jicheng Yang, Zhejun Zhao, Chong Meng, Long Xia, Daiting Shi

机构 * Beihang University(北京航空航天大学) Baidu Inc.(百度公司) Renmin University of China(中国人民大学)

AI总结 本文提出UniCreative框架,通过自适应约束奖励模型和ACPO算法,实现无需监督细调的长短期创作统一,提升多任务表现并展现模型的元认知能力。

Comments Accepted to Findings of ACL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.02528 2026-04-08 cs.LG cs.AI

Incident-Guided Spatiotemporal Traffic Forecasting

基于事件的时空交通预测

Lixiang Fan, Bohao Li, Tao Zou, Junchen Ye, Bowen Du

机构 * the State Key Laboratory of Complex and Critical Software Environment, Beihang University(北京航空航天大学复杂关键软件环境国家重点实验室) School of Transportation Science and Engineering, Beihang University(北京航空航天大学交通科学与工程学院)

AI总结 本文提出IGSTGNN框架,通过ICSF和TIID模块建模事件影响,构建大规模数据集提升交通预测精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.06448 2026-04-07 cs.MA cs.AI cs.CL cs.SI

When AI Agents Collude Online: Financial Fraud Risks by Collaborative LLM Agents on Social Platforms

当AI代理在线合谋:社交平台上基于协作LLM代理的金融欺诈风险

Qibing Ren, Zhijie Zheng, Jiaxuan Guo, Junchi Yan, Lizhuang Ma, Jing Shao

机构 * Shanghai Jiao Tong University(上海交通大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学)

AI总结 研究大型多代理系统中集体金融欺诈的风险,通过MultiAgentFraudBench基准测试分析欺诈行为协作机制及影响因素,提出内容警告、LLM监控和群体韧性提升等缓解策略。

Comments ICLR 2026, Code is available at https://github.com/zheng977/MutiAgent4Fraud

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.20685 2026-04-07 cs.RO

C-NAV: Towards Self-Evolving Continual Object Navigation in Open World

C-NAV:迈向开放世界中的自进化持续物体导航

Ming-Ming Yu, Fei Zhu, Wenzhuo Liu, Yirong Yang, Qunbo Wang, Wenjun Wu, Jing Liu

机构 * Beihang University(北京航空航天大学) Centre for Artificial Intelligence and Robotics, HKISI-CAS(香港智能科学与工业研究院人工智能与机器人中心) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) Beijing Jiaotong University(北京交通大学)

AI总结 本文提出C-Nav框架,通过双路径抗遗忘机制和自适应采样策略,解决持续物体导航中的灾难性遗忘问题,实验表明其在多个模型架构上均优于现有方法,且内存需求显著降低。

Comments Accepted at NeurIPS 2025

Journal ref NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03957 2026-04-07 cs.LG cs.CL

BWTA: Accurate and Efficient Binarized Transformer by Algorithm-Hardware Co-design

BWTA:通过算法-硬件协同设计实现准确且高效的二值化Transformer

Yifu Ding, Xianglong Liu, Shenghao Jin, Jinyang Guo, Jiwen Lu

机构 * Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院) Department of Automation, Tsinghua University(清华大学自动化系)

AI总结 本文提出BWTA量化方案,通过算法-硬件协同设计实现低比特精度下的高效准确推理,实验显示在BERT和LLM上均达到全精度性能,同时显著提升推理效率。

Comments Under review

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03950 2026-04-07 cs.LG cs.AI

Diagonal-Tiled Mixed-Precision Attention for Efficient Low-Bit MXFP Inference

对角 tiled 混合精度注意力机制用于高效低比特 MXFP 推理

Yifu Ding, Xinhao Zhang, Jinyang Guo

机构 * State Key Laboratory of Complex & Critical Software Environment (SKLCCSE), Beihang University(北京航空航天大学复杂关键软件环境国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Beijing Jiaotong University(北京交通大学)

AI总结 本文提出了一种低比特混合精度注意力核,利用MXFP数据格式在下一代GPU架构上实现高效低比特MXFP推理,通过融合核和硬件级并行性提升推理速度而不牺牲模型性能。

Comments CVPR Workshop EDGE 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03526 2026-04-07 cs.CV cs.AI

Determined by User Needs: A Salient Object Detection Rationale Beyond Conventional Visual Stimuli

由用户需求决定:一种超越传统视觉刺激的显著目标检测方法

Chenglizhao Chen, Shujian Zhang, Luming Li, Wenfeng Song, Shuai Li

机构 * China University of Petroleum (East China)(中国石油大学(华东)) Beijing Information Science and Technology University(北京信息科技大学) Beihang University(北京航空航天大学)

AI总结 本文提出基于用户需求的显著目标检测方法,解决传统方法忽略用户主动需求的问题,推动下游任务发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03309 2026-04-07 cs.CV cs.AI

TreeGaussian: Tree-Guided Cascaded Contrastive Learning for Hierarchical Consistent 3D Gaussian Scene Segmentation and Understanding

TreeGaussian:基于树引导的级联对比学习用于层次一致的3D高斯场景分割与理解

Jingbin You, Zehao Li, Hao Jiang, Xinzhu Ma, Shuqin Gao, Honglong Zhao, Congcong Zheng, Tianlu Mao, Feng Dai, Yucheng Zhang, Zhaoqi Wang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Beihang University(北京航空航天大学)

AI总结 本文提出TreeGaussian,通过树引导的级联对比学习框架,解决3DGS在表示层次结构和捕捉整体-部分关系上的不足,提升分割一致性与质量。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03305 2026-04-07 cs.CV

HVG-3D: Bridging Real and Simulation Domains for 3D-Conditional Hand-Object Interaction Video Synthesis

HVG-3D: 联接真实与仿真领域用于3D条件手-物体交互视频合成

Mingjin Chen, Junhao Chen, Zhaoxin Fan, Yujian Lee, Zichen Dang, Lili Wang, Yawen Cui, Lap-Pui Chau, Yi Wang

机构 * Dept. of EEE, The Hong Kong Polytechnic University(香港理工大学电机及电子工程学系) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院未来区块链与隐私计算北京高精尖创新中心) Tsinghua University(清华大学) Beijing Normal-Hong Kong Baptist University(北京师范大学-香港浸会大学联合国际学院) State Key Laboratory of Virtual Reality Technology and Systems, School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院虚拟现实技术与系统国家重点实验室)

AI总结 HVG-3D提出一种统一框架,通过显式3D表示条件生成3D-aware手-物体交互视频,结合3D ControlNet与扩散架构,实现高保真度与时空可控性。

Comments Project page: https://hvg3d.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.08388 2026-04-07 cs.AI

A Hierarchical Error-Corrective Graph Framework for Autonomous Agents with LLM-Based Action Generation

一种用于自主代理的分层错误校正图框架:基于大语言模型的动作生成

Cong Cao, Jingyao Zhang, Kun Tong

机构 * Independent Researcher(独立研究者) Beihang University(北京航空航天大学)

AI总结 本文提出HECG框架,通过多维可转移策略、误差矩阵分类和因果-上下文图检索三大创新,提升自主代理在动态任务中的策略选择、错误分析和情境适应能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2410.21169 2026-04-07 cs.MM cs.AI cs.CL cs.CV

Document Parsing Unveiled: Techniques, Challenges, and Prospects for Structured Information Extraction

文档解析揭示:结构信息提取的技术、挑战与前景

Qintong Zhang, Bin Wang, Victor Shea-Jay Huang, Junyuan Zhang, Zhengren Wang, Hao Liang, Conghui He, Wentao Zhang

机构 * Peking University(北京大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Beihang University(北京航空航天大学)

AI总结 本文综述了文档解析研究,系统分类了现有方法,探讨了布局分析、多类型内容识别及VLM驱动的解析模型发展,总结了评估指标与挑战,提出了更准确可扩展的文档智能系统方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03144 2026-04-06 cs.AR cs.AI cs.CL

InCoder-32B-Thinking: Industrial Code World Model for Thinking

InCoder-32B-Thinking:工业代码世界模型用于推理

Jian Yang, Wei Zhang, Jiajun Wu, Junhang Cheng, Tuney Zheng, Fanglin Xu, Weicheng Gu, Lin Jing, Yaxin Du, Joseph Li, Yizhi Li, Yan Xing, Chuan Hao, Ran Tao, Ruihao Gong, Aishan Liu, Zhoujun Li, Mingjie Tang, Chenghua Lin, Siheng Chen, Wayne Xin Zhao, Xianglong Liu, Ming Zhou, Bryan Dai, Weifeng Lv

机构 * Beihang University(北京航空航天大学) IQuest Research Shanghai Jiao Tong University(上海交通大学) ELLIS University of Manchester(曼彻斯特大学) Sichuan University(四川大学) Langboat(朗博特)

AI总结 本文提出InCoder-32B-Thinking,通过工业代码世界模型生成推理轨迹,评估显示其在通用和工业基准上均取得领先开源结果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.03016 2026-04-06 cs.AI

Agentic-MME: What Agentic Capability Really Brings to Multimodal Intelligence?

Agentic-MME:代理能力为多模态智能带来了什么?

Qianshan Wei, Yishan Yang, Siyi Wang, Jinglin Chen, Binyu Wang, Jiaming Wang, Shuang Chen, Zechen Li, Yang Shi, Yuqi Tang, Weining Wang, Yi Yu, Chaoyou Fu, Qi Li, Yi-Fan Zhang

机构 * CASIA(中国科学院自动化研究所) UCAS(中国科学院大学) SEU(东南大学) NJU(南京大学) PKU(北京大学) BUAA(北京航空航天大学) NTU(南洋理工大学) UCLA(加州大学洛杉矶分校)

AI总结 Agentic-MME通过418个真实任务评估多模态代理能力,采用过程验证方法,量化效率并验证工具调用准确性,实验显示模型在复杂任务中表现显著下降。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02966 2026-04-06 cs.CV

Visual Prototype Conditioned Focal Region Generation for UAV-Based Object Detection

基于视觉原型的聚焦区域生成用于无人机目标检测

Wenhao Li, Zimeng Wu, Yu Wu, Zehua Fu, Jiaxin Chen

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Hangzhou Innovation Institute, Beihang University(北京航空航天大学杭州创新研究院)

AI总结 本文提出UAVGen框架,通过视觉原型条件扩散模型和聚焦区域增强数据管道提升无人机目标检测精度,实验表明其优于现有方法。

Comments CVPR2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02956 2026-04-06 cs.CV

Collaborative Multi-Mode Pruning for Vision-Language Models

多模式协作剪枝用于视觉-语言模型

Zimeng Wu, Yunhong Wang, Donghao Wang, Jiaxin Chen

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

AI总结 本文提出CoMP框架,通过联合参数和token剪枝,解决单一模式剪枝导致的性能下降问题,通过协作重要性度量和多模式剪枝策略提升高剪枝率下的模型性能。

Comments CVPR2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02738 2026-04-06 stat.ML cs.LG math.OC stat.CO

State estimations and noise identifications with intermittent corrupted observations via Bayesian variational inference

基于贝叶斯变分推断的间歇性损坏观测状态估计与噪声识别

Peng Sun, Ruoyu Wang, Xue Luo

机构 * School of Mathematical Sciences, Beihang University(北京航空航天大学数学科学学院) Key Laboratory of Mathematics, Informatics and Behavioral Semantics (LMIB), Beihang University(北京航空航天大学数学、信息与行为语义重点实验室(LMIB))

AI总结 本文提出了一种基于贝叶斯变分推断的变分贝叶斯自适应卡尔曼滤波方法,用于解决分布式传感器网络中间歇性数据丢失、观测损坏和未知噪声协方差的问题,通过双掩码生成模型提升状态估计和参数识别的准确性。

Comments 8 pages, 6 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02107 2026-04-03 cs.RO

HyVGGT-VO: Tightly Coupled Hybrid Dense Visual Odometry with Feed-Forward Models

HyVGGT-VO:紧密耦合的混合密集视觉里程计与前馈模型

Junxiang Pan, Lipu Zhou, Baojie Chen

机构 * School of Instrument Science and Opto-electronics Engineering, Beihang University(北京航空航天大学仪器科学与光电工程学院)

AI总结 本文提出HyVGGT-VO框架,结合稀疏VO的高效计算与前馈模型的密集重建能力,实现高效实时姿态估计与密集重建。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.01725 2026-04-03 cs.AI cs.LG

LiteInception: A Lightweight and Interpretable Deep Learning Framework for General Aviation Fault Diagnosis

LiteInception: 一种轻量且可解释的深度学习框架用于通用航空故障诊断

Zhihuan Wei, Xinhang Chen, Danyang Han, Yang Hu, Jie Liu, Xuewen Miao, Guijiang Li

机构 * Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新研究院) Science and Technology on Complex Aviation System Simulation Laboratory(复杂航空系统仿真重点实验室) The First Aircraft Institute of Aviation Industry Corporation of China(中国航空工业集团公司第一飞机设计研究院) School of Reliability and Systems Engineering, Beihang University(北京航空航天大学可靠性与系统工程学院)

AI总结 本文提出LiteInception框架,通过两阶段架构实现高效故障诊断,采用多方法融合压缩模型参数,提升推理速度与可解释性,验证了其在效率、精度和可解释性上的平衡。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.20331 2026-04-03 cs.CV

GVGS: Gaussian Visibility-Aware Multi-View Geometry for Accurate Surface Reconstruction

GVGS: 基于高斯可见性感知的多视角几何用于准确表面重建

Mai Su, Qihan Yu, Zhongtao Wang, Yilong Li, Chengwei Pan, Yisong Chen, Guoping Wang, Fei Zhu

机构 * School of Computer Science, Peking University(北京大学计算机科学学院) Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院)

AI总结 本文提出GVGS方法,通过显式建模高斯体的可见性,改进多视角几何一致性,提升表面重建精度,实验表明优于现有基于高斯的方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.15475 2026-04-03 cs.CV

Seeing through Light and Darkness: Sensor-Physics Grounded Deblurring HDR NeRF from Single-Exposure Images and Events

透过光与暗:基于传感器物理的去模糊HDR NeRF从单曝光图像和事件

Yunshan Qi, Lin Zhu, Nan Bao, Yifan Zhao, Jia Li

机构 * State Key Laboratory of Virtual Reality Technology and Systems, SCSE & QRI, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) School of Artificial Intelligence, Beijing Normal University(北京师范大学人工智能学院)

AI总结 本文提出基于传感器物理的NeRF框架,通过单曝光模糊LDR图像和对应事件实现高动态范围和锐利3D表示的合成,利用CRF模型提升HDR和去模糊效果。

Comments Accepted by the IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026. Project Page: https://icvteam.github.io/See-NeRF.html. Our code and datasets are publicly available at https://github.com/iCVTEAM/See-NeRF

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02344 2026-04-03 cs.CV

A multi-weight self-matching visual explanation for cnns on sar images

一种用于SAR图像的多权重自匹配视觉解释方法

Siyuan Sun, Yongping Zhang, Hongcheng Zeng, Yamin Wang, Wei Yang, Wanting Yang, Jie Chen

机构 * Beihang University(北京航空航天大学) Mianyang Tianyi Space Technology Co., Ltd(绵阳天仪空间科技有限公司)

AI总结 本文提出多权重自匹配类激活映射(MS-CAM)方法,用于提升CNN在SAR图像中的可解释性,通过匹配图像与特征图及梯度,结合通道和元素权重可视化决策依据,实验表明其能更准确地突出网络关注区域并提升解释性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11683 2026-04-03 cs.RO cs.AI

Robot Collapse: Supply Chain Backdoor Attacks Against VLM-based Robotic Manipulation

机器人崩溃:针对基于VLM的机器人操控的供应链后门攻击

Xianlong Wang, Hewen Pan, Hangtao Zhang, Minghui Li, Shengshan Hu, Ziqi Zhou, Lulu Xue, Peijin Guo, Aishan Liu, Leo Yu Zhang, Xiaohua Jia

机构 * City University of Hong Kong(香港城市大学) Huazhong University of Science and Technology(华中科技大学) Beihang University(北京航空航天大学) Griffith University(格里菲斯大学)

AI总结 本文提出TrojanRobot框架,通过在模块化机器人策略中嵌入恶意模块,操控LLM到VLM路径,验证了在18个真实任务和4个VLM上的优越性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2603.28183 2026-04-02 cs.AI

PReD: An LLM-based Foundation Multimodal Model for Electromagnetic Perception, Recognition, and Decision

PReD:基于大语言模型的电磁感知、识别与决策基础多模态模型

Zehua Han, Jing Xiao, Yiqi Duan, Mengyu Xiang, Yuheng Ji, Xiaolong Zheng, Chenghanyu Zhang, Zhendong She, Junyu Shen, Dingwei Tan, Shichu Sun, Zhou Cong, Mingxuan Liu, Fengxiang Wang, Jinping Sun, Yangang Sun

机构 * Tsinghua University(清华大学) National University of Defense Technology(国防科技大学) Beihang University(北京航空航天大学) Tianjin University(天津大学) Beijing University of Posts and Telecommunications(北京邮电大学) Peking University(北京大学) Institute of Microelectronics, Chinese Academy of Sciences(中国科学院微电子研究所) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) The Hong Kong University of Science and Technology(香港科技大学) Civil Aviation University of China(中国民航大学) Beijing Institute of Technology(北京理工大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 本文提出PReD,首个电磁领域基础模型,涵盖感知、识别与决策闭环,构建高质量多任务电磁数据集和评估基准,通过多阶段训练策略提升电磁领域能力,实验显示在PReD-Bench上达到最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.09504 2026-04-02 cs.CL

MVSS: A Unified Framework for Multi-View Structured Survey Generation

MVSS:多视图结构化调查生成的统一框架

Yinqi Liu, Yueqi Zhu, Yongkang Zhang, Feiran Liu, Yutong Shen, Yufei Sun, Xin Wang, Renzhao Liang, Yidong Wang, Cunxiang Wang

机构 * Beijing University of Technology(北京工业大学) Peking University(北京大学) Beihang University(北京航空航天大学) Tsinghua University(清华大学)

AI总结 本文提出MVSS框架,通过结构优先方法生成和对齐引用支撑的层级树、结构化比较表和调查文本,提升调查生成的结构组织和证据呈现质量。

详情

展开后加载摘要…

URL PDF HTML 收藏