arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

共收录 1226
2604.12308 2026-04-15 cs.CL

ContextLens: Modeling Imperfect Privacy and Safety Context for Legal Compliance

ContextLens:建模不完美隐私和安全上下文以满足法律合规

Haoran Li, Yulin Chen, Huihao Jing, Wenbin Hu, Tsz Ho Li, Chanhou Lou, Hong Ting Tsang, Sirui Han, Yangqiu Song

机构 * Beihang University(北京航空航天大学) HKUST(香港科技大学) National University of Singapore(新加坡国立大学) Faculty of Law, University of Macau(澳门大学法学院)

AI总结 本文提出ContextLens框架,利用LLM建模法律领域上下文,识别已知和未知因素以提升合规评估,实验表明其能有效提升LLM合规性评估性能。

Comments Accepted by ACL 26

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.12191 2026-04-15 cs.AI

Beyond Scores: Diagnostic LLM Evaluation via Fine-Grained Abilities

超越分数:通过细粒度能力进行诊断LLM评估

Xu Zhang, Xudong Gong, Jiacheng Qin, Qiang Wang, JiaQi Liao, Zhe Wang, Dawei Feng, Bo Ding

机构 * College of Computer Science Technology, National University of Defense Technology, Changsha, Hunan, China State Key Laboratory of Complex \& Critical Software Environment, Changsha, Hunan, China National Key Laboratory of Parallel School of Humanities Social Sciences, School of Public Administration, Beihang University, Beijing, China

AI总结 本文提出一种基于细粒度能力的诊断框架,通过多维项目反应理论估计模型能力,实现对不同任务的精准评估,提升模型改进和任务选择的针对性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2602.23061 2026-04-15 cs.IR cs.AI cs.CL cs.DB cs.LG

MoDora: Tree-Based Semi-Structured Document Analysis System

MoDora:基于树的半结构化文档分析系统

Bangrui Xu, Qihang Yao, Zirui Tang, Xuanhe Zhou, Yeye He, Shihan Yu, Qianqian Xu, Bin Wang, Guoliang Li, Conghui He, Fan Wu

机构 * Shanghai Jiao Tong University(上海交通大学) Microsoft Research(微软研究院) Beihang University(北航) Shanghai AI Lab(上海人工智能实验室) Tsinghua University(清华大学) Institute for Clarity in Documentation(文档清晰性研究所) Inria Paris-Rocquencourt(Inria巴黎-罗quentcourt研究中心) East China Normal University(华东师范大学) Scientific Writing Academy(科学写作学院)

AI总结 MoDora通过局部对齐聚合策略和组件相关树结构,提升半结构化文档的分析能力,实验表明其在准确性上优于基线方法。

Comments Extension of our SIGMOD 2026 paper. Please refer to source code available at https://github.com/weAIDB/MoDora

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00412 2026-04-15 cs.CR cs.AI

Red Teaming Large Reasoning Models

对大型推理模型进行红队测试

Jiawei Chen, Yang Yang, Chao Yu, Yu Tian, Zhi Cao, Xue Yang, Linghao Li, Hang Su, Zhaoxia Yin

机构 * Shanghai Key Laboratory of Multidimensional Information Processing, East China Normal University(上海多维信息处理关键实验室,东华大学) Zhongguancun Academy(中关村学院) Shenzhen International Graduate School, Tsinghua University(深圳国际研究生院,清华大学) Dept. of Comp. Sci. and Tech., THBI Lab, Tsinghua University(计算机科学与技术系,清华THBI实验室) Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 本文提出RT-LRM基准,评估大型推理模型的可信度,揭示其在面对推理风险时的脆弱性,并发布工具箱支持未来研究。

Comments 30 pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.10073 2026-04-15 cs.CR cs.CV

SecureWebArena: A Holistic Security Evaluation Benchmark for LVLM-based Web Agents

SecureWebArena: 一个针对基于大视觉-语言模型的Web代理的综合安全评估基准

Zonghao Ying, Yangguang Shao, Jianle Gan, Gan Xu, Wenxin Zhang, Quanchen Zou, Junzheng Shi, Zhenfei Yin, Mingchuan Zhang, Aishan Liu, Xianglong Liu

机构 * SKLCCSE, Beihang University(北京航空航天大学安全实验室) Institute of Information Engineering, CAS(中国科学院信息工程研究所) China University of Petroleum (East China)(中国石油大学(华东)) Zhejiang University of Technology(浙江工业大学) University of Chinese Academy of Science(中国科学院大学) AI Security Lab(360人工智能安全实验室) The University of Sydney(悉尼大学) Henan University of Science and Technology(河南理工大学)

AI总结 本文提出SecureWebArena,首个针对基于大视觉-语言模型的Web代理安全性的综合评估基准,通过六个真实模拟的Web环境和2970条高质量轨迹,分析代理在内部推理、行为轨迹和任务结果三个维度上的安全风险。

Comments ACL

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19742 2026-04-15 cs.CL cs.AI cs.IR

HiCoLoRA: Addressing Context-Prompt Misalignment via Hierarchical Collaborative LoRA for Zero-Shot DST

HiCoLoRA:通过分层协作LoRA解决上下文提示对齐问题

Shuyu Zhang, Yifan Wei, Xinru Wang, Yanmin Zhu, Yangfan He, Yixuan Weng, Bin Li, Yujie Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Beihang University(北京航空航天大学) University of Sydney(悉尼大学) University of Minnesota Twin Cities(明尼苏达大学双城分校) Westlake University(西湖大学) SIAT, CAS(中国科学院软件研究所)

AI总结 本文提出HiCoLoRA框架,通过增强零样本槽位推理实现上下文提示对齐,采用分层LoRA架构、谱联合领域-槽位聚类和语义增强SVD初始化,在多领域数据集上取得最优性能。

Comments Accepted in ACL2026 findings

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.19695 2026-04-15 cs.CL cs.AI cs.IR

DyBBT: Dynamic Balance via Bandit-inspired Targeting for Dialog Policy with Cognitive Dual-Systems

DyBBT:通过老虎机启发式目标实现对话策略的动态平衡

Shuyu Zhang, Yifan Wei, Jialuo Yuan, Xinru Wang, Yanmin Zhu, Bin Li, Yujie Liu

机构 * Shanghai Jiao Tong University(上海交通大学) Beihang University(北京航空航天大学) Stanford University(斯坦福大学) University of Sydney(悉尼大学) SIAT, CAS(中国科学院上海硅酸盐研究所) Beijing Institute of Graphic Communication(北京印刷学院)

AI总结 本文提出DyBBT框架,通过结构化认知状态空间解决对话探索挑战,结合快速直觉推理与慢速 deliberative 推理,提升对话策略的成功率、效率和泛化能力。

Comments Accepted in ACL2026 main

详情

展开后加载摘要…

URL PDF HTML 收藏
2508.01620 2026-04-15 cs.LG cs.CR cs.CV

IMU: Influence-guided Machine Unlearning

IMU: 基于影响的机器遗忘

Xindi Fan, Jing Wu, Mingyi Zhou, Pengwei Liang, Mehrtash Harandi, Dinh Phung

机构 * Harbin Institute of Technology(哈尔滨工业大学) Monash University(墨尔本大学) Beihang University(北航大学) City University of Hong Kong(香港城市大学)

AI总结 IMU通过利用影响函数作为优先信号,基于遗忘集进行机器遗忘,提升模型效用并减少对保留知识的扰动。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.05481 2026-04-15 cs.RO

Relative Pose Estimation for Nonholonomic Robot Formation with UWB-IO Measurements (Extended version)

非holonomic机器人编队的相对位姿估计(扩展版)

Kunrui Ze, Wei Wang, Shuoyu Yue, Guibin Sun, Kexin Liu, Jinhu Lü

机构 * School of Automation Science and Electrical Engineering, Beihang University(北京航空航天大学自动化科学与电气工程学院) Cavendish Laboratory, University of Cambridge(剑桥大学卡文迪许实验室) Zhongguancun Laboratory(中关村实验室)

AI总结 本文研究利用机载超宽带距离和惯性里程计测量实现多机器人分布式编队控制问题,提出局部帧下的并发学习估计器和协作定位算法,设计分布式编队跟踪控制器,通过实验证明方法有效性。

Comments 17 pages, 26 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11751 2026-04-14 cs.RO cs.AI

Grounded World Model for Semantically Generalizable Planning

基于语义泛化的世界模型用于规划

Quanyi Li, Lan Feng, Haonan Zhang, Wuyang Li, Letian Wang, Alexandre Alahi, Harold Soh

机构 * Independent(独立) EPFL(瑞士联邦理工学院洛桑) Beihang University(北京航空航天大学) University of Toronto(多伦多大学) NUS(新加坡国立大学)

AI总结 本文提出基于视觉-语言对齐潜在空间的世界模型,用于改进视觉-运动模型控制,实现更广泛的语义泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11611 2026-04-14 cs.CL cs.LG

Utilizing and Calibrating Hindsight Process Rewards via Reinforcement with Mutual Information Self-Evaluation

利用和校准通过互信息自我评估的 hindsight 过程奖励

Jiashu Yao, Heyan Huang, Zeming Liu, Yuhang Guo

机构 * Beijing Institute of Technology(北京理工大学) Beihang University(北京航空航天大学)

AI总结 本文提出MISE方法,通过生成自我评估提供密集奖励信号并校准环境反馈,使基于大语言模型的智能体能自主学习,理论证明其等价于结合互信息与KL散度的优化目标,实验表明其在无监督条件下优于基线方法。

Comments preprint

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.11411 2026-04-14 cs.CV

Online Reasoning Video Object Segmentation

在线推理视频目标分割

Jinyuan Liu, Yang Wang, Zeyu Zhao, Weixin Li, Song Wang, Ruize Han

机构 * Faculty of Computer Science and Artificial Intelligence, Shenzhen University of Advanced(深圳大学计算机科学与人工智能学院) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) School of Electrical and Information Engineering, Northeast Petroleum University(东北石油大学电气与信息工程学院)

AI总结 本文研究了在线推理视频目标分割,提出ORVOS框架和ORVOSB基准,通过持续更新分割提示和结构化时间令牌水库,在有限计算下实现长时序推理,解决严格因果性和指称转移问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2601.05505 2026-04-14 cs.CL

FlashMem: Distilling Intrinsic Latent Memory via Computation Reuse

FlashMem: 通过计算复用提炼内在潜在记忆

Yubo Hou, Zhisheng Chen, Tao Wan, Zengchang Qin

机构 * School of ASEE, Beihang University(北京航空航天大学ASEE学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) School of BME, Beijing Advanced Innovation Center for BME, Beihang University(北京航空航天大学生物医学工程学院/北京生物医学工程高精尖创新中心) CAIR and CECS, VinUniversity(VinUniversity计算与人工智能研究中心/计算机工程与计算机科学系)

AI总结 FlashMem通过计算复用直接从临时推理状态提炼内在记忆,消除冗余重参数化,提升推理效率和持久认知能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.19172 2026-04-14 cs.CV

MetroGS: Efficient and Stable Reconstruction of Geometrically Accurate High-Fidelity Large-Scale Scenes

MetroGS: 高精度大规模场景高效稳定重建

Kehua Chen, Tianlu Mao, Xinzhu Ma, Hao Jiang, Zehao Li, Zihan Liu, Shuqin Gao, Honglong Zhao, Feng Dai, Yucheng Zhang, Zhaoqi Wang

机构 * Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) University of Chinese Academy of Sciences(中国科学院大学) Beihang University(北京航空航天大学)

AI总结 本文提出MetroGS框架,通过分布式2D高斯点扩散表示和结构密集增强方案,结合单目与多视图优化策略,实现复杂城市环境中的高效高精度场景重建。

Comments Accepted by CVPR26; Project page: https://m3phist0.github.io/MetroGS

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10940 2026-04-14 cs.CV

AmodalSVG: Amodal Image Vectorization via Semantic Layer Peeling

AmodalSVG:基于语义层剥离的模态图像向量化

Juncheng Hu, Ziteng Xue, Guotao Liang, Anran Qi, Buyu Li, Sheng Wang, Dong Xu, Qian Yu

机构 * School of Software, Beihang University(北京航空航天大学软件学院) Igarashi Lab, The University of Tokyo(东京大学五十岚实验室) Bambu Lab Department of Computer Science, The University of Hong Kong(香港大学计算机科学系)

AI总结 AmodalSVG通过语义层剥离技术,实现对自然图像中遮挡区域的完整几何向量化,提升SVG的结构编辑能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.10923 2026-04-14 cs.CL cs.AI

Mem$^2$Evolve: Towards Self-Evolving Agents via Co-Evolutionary Capability Expansion and Experience Distillation

Mem$^2$Evolve:通过共进化能力扩展与经验蒸馏实现自进化智能体

Zihao Cheng, Zeming Liu, Yingyu Shan, Xinyi Wang, Xiangrong Zhu, Yunpu Ma, Hongru Wang, Yuhang Guo, Wei Lin, Yunhong Wang

机构 * Beihang University(北京航空航天大学) Beijing Institute of Technology(北京理工大学) Independent Researcher(独立研究者) Munich Center for Machine Learning(慕尼黑机器学习中心) University of Edinburgh(爱丁堡大学)

AI总结 本文提出Mem$^2$Evolve框架,通过共进化能力扩展与经验蒸馏实现自进化智能体,实验显示其在多个任务和基准上的性能显著优于传统方法。

Comments Accepted by ACL 2026 Main

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02756 2026-04-14 cs.LG

STDDN: A Physics-Guided Deep Learning Framework for Crowd Simulation

STDDN:一种基于物理的深度学习框架用于人群模拟

Zijin Liu, Xu Geng, Wenshuai Xu, Xiang Zhao, Yan Xia, You Song

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) School of Software, Beihang University(北京航空航天大学软件学院) Beijing Digital Native Digital City Research Center(北京数字原生数字城市研究中心)

AI总结 本文提出STDDN框架,通过引入流体动力学的连续方程,结合神经普通微分方程和动态图学习模块,改进人群模拟的物理约束与效率,实现更稳定和高效的模拟性能。

Journal ref International Conference on Learning Representations (ICLR), 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.17022 2026-04-14 cs.CV cs.AI cs.CL cs.LG cs.MM

GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning

GoT-R1:通过强化学习提升MLLM的视觉生成推理能力

Chengqi Duan, Rongyao Fang, Yuqing Wang, Kun Wang, Linjiang Huang, Xingyu Zeng, Hongsheng Li, Xihui Liu

机构 * HKU MMLAB(香港大学多媒体实验室) CUHK MMLAB(香港中文大学多媒体实验室) Sensetime(商汤科技) Beihang University(北京航空航天大学) SUAT(上海人工智能实验室)

AI总结 GoT-R1通过强化学习提升视觉生成中的语义-空间推理能力,改进了复杂提示下的图像生成效果,实验表明在T2I-CompBench基准上表现优异。

Comments Github page refer to: https://github.com/gogoduan/GoT-R1. Published as a conference paper at ICLR 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09285 2026-04-13 cs.AI

SAGE: A Service Agent Graph-guided Evaluation Benchmark

SAGE:基于服务代理图的评估基准

Ling Shi, Yuqin Dai, Ziyin Wang, Ning Gao, Wei Zhang, Chaozheng Wang, Yujie Wang, Wei He, Jinpeng Wang, Deiyi Xiong

机构 * Tianjin University(天津大学) Tsinghua University(清华大学) Beihang University(北京航空航天大学) Beijing University of Posts and Telecommunications(北京邮电大学) The Chinese University of Hong Kong(香港中文大学) Independent Researcher(独立研究员)

AI总结 本文提出SAGE基准,通过动态对话图验证逻辑合规性,解决现有基准无法评估多维度用户行为和SOP的问题,揭示模型在意图分类与后续动作推导间的执行差距。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.02241 2026-04-13 cs.CV cs.RO

UAV-Track VLA: Embodied Aerial Tracking via Vision-Language-Action Models

UAV-Track VLA: 通过视觉-语言-动作模型实现具身空中跟踪

Qiyao Zhang, Shuhua Zheng, Jianli Sun, Chengxiang Li, Xianke Wu, Zihan Song, Zhiyong Cui, Yisheng Lv, Yonglin Tian

机构 * Beijing Institute of Technology(北京理工大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Sanya(三亚学院) Beijing University of Posts and Telecommunications(北京邮电大学) Hunan University(湖南大学) Beihang University(北京航空航天大学) Flying Intelligence Team (Virtual Research Community)(飞行智能团队(虚拟研究社区))

AI总结 本文提出UAV-Track VLA模型,通过视觉-语言-动作融合解决动态城市场景中的具身跟踪问题,提升UAV的实时控制性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09253 2026-04-13 cs.CV cs.AI

Mosaic: Multimodal Jailbreak against Closed-Source VLMs via Multi-View Ensemble Optimization

Mosaic: 通过多视图集成优化实现对闭源视觉语言模型的多模态劫持

Yuqin Lan, Gen Li, Yuanze Hu, Weihao Shen, Zhaoxin Fan, Faguo Wu, Xiao Zhang, Laurence T. Yang, Zhiming Zheng

机构 * Beihang University(北京航空航天大学) Huazhong University of Science and Technology(华中科技大学)

AI总结 本文提出Mosaic框架,通过多视图集成优化减少对单一代理模型的依赖,提升对闭源VLMs的多模态劫持效果,实验显示其在安全基准上的攻击成功率和毒性均达到最优。

Comments 14pages, 9 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.09088 2026-04-13 cs.CV

Memory-Efficient Transfer Learning with Fading Side Networks via Masked Dual Path Distillation

通过遮蔽双路径蒸馏实现记忆高效的迁移学习

Yutong Zhang, Jiaxin Chen, Honglin Chen, Kaiqi Zheng, Shengcai Liao, Hanwen Zhong, Weixin Li, Yunhong Wang

机构 * State Key Laboratory of Virtual Reality Technology and Systems, Beihang University(北京航空航天大学虚拟现实技术与系统国家重点实验室) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) College of Information Technology, United Arab Emirates University(阿联酋大学信息技术学院)

AI总结 本文提出遮蔽双路径蒸馏方法,通过在微调中互蒸馏冻结主干和可学习侧网络,实现高效迁移学习,在推理时丢弃侧网络以加快速度,同时保持参数和内存效率,并在多个任务上验证了方法的准确性提升。

Comments CVPR2026 Accepted

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.08518 2026-04-13 math.OC cs.LG

SPP-SBL: Space-Power Prior Sparse Bayesian Learning for Block Sparse Recovery

SPP-SBL:空间功率先验稀疏贝叶斯学习用于块稀疏恢复

Yanhao Zhang, Zhihan Zhu, Yong Xia

机构 * LMIB of the Ministry of Education, School of Mathematical Sciences, Beihang University(北京航空航天大学数学科学学院教育部数学、信息与行为重点实验室)

AI总结 本文提出SPP-SBL方法,通过空间功率先验和EM算法结合高阶方程求解,解决块稀疏信号结构未知的恢复问题,提升恢复精度。

Comments IEEE Transactions on Signal Processing, 2026

Journal ref In IEEE Transactions on Signal Processing, vol. 74, pp. 1293-1308, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.08111 2026-04-10 cs.LG cs.CV

Bias Redistribution in Visual Machine Unlearning: Does Forgetting One Group Harm Another?

视觉机器遗忘中的偏见再分配:遗忘一组是否损害另一组?

Yunusa Haruna, Adamu Lawan, Ibrahim Haruna Abdulhamid, Hamza Mohammed Dauda, Jiaquan Zhang, Chaoning Zhang, Shamsuddeen Hassan Muhammad

机构 * NewraLab Beihang University(北京航空航天大学) GoerTek Alpha Lab(歌尔Alpha实验室) Skyline University Nigeria(尼日利亚天际线大学) UESTC(电子科技大学) Imperial College London(帝国理工学院)

AI总结 研究通过CLIP模型在CelebA数据集上探讨机器遗忘对偏见的再分配影响,发现遗忘某一性别群体会将偏见转移至相关群体,揭示嵌入空间中的性别主导结构。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.07372 2026-04-10 stat.ML cs.IT cs.LG math.IT math.OC

NS-RGS: Newton-Schulz based Riemannian gradient method for orthogonal group synchronization

NS-RGS:基于牛顿-施尔茨方法的黎曼梯度法用于正交群同步

Haiyang Peng, Deren Han, Xin Chen, Meng Huang

机构 * School of Mathematical Sciences, Beihang University(北京航空航天大学数学科学学院) Department of Systems Engineering and Engineering Management, The Chinese University of Hong Kong(香港中文大学系统工程与工程管理学系)

AI总结 本文提出NS-RGS方法,通过替代SVD或QR分解为牛顿-施尔茨迭代,降低计算成本,利用高效矩阵乘法与现代GPU/TPU架构,实现线性收敛并提升效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06036 2026-04-10 cs.DC cs.CV cs.LG

CodecSight: Leveraging Video Codec Signals for Efficient Streaming VLM Inference

CodecSight: 利用视频编码信号实现高效的流式视频语言模型推理

Yulin Zou, Yan Chen, Wenyan Chen, JooYoung Park, Shivaraman Nitin, Luo Tao, Francisco Romero, Dmitrii Ustiugov

机构 * Beihang University(北京航空航天大学) Georgia Institute of Technology(佐治亚理工学院)

AI总结 CodecSight通过利用视频编码器内嵌的时空结构信息,实现流式视频分析的高效推理,提升吞吐量并减少GPU计算量,同时保持高精度。

Comments 18 pages, 34 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.24499 2026-04-10 cs.CV

Reason-SVG: Enhancing Structured Reasoning for Vector Graphics Generation with Reinforcement Learning

Reason-SVG:通过强化学习增强向量图形生成的结构化推理

Ximing Xing, Ziteng Xue, Yandong Guan, Jing Zhang, Dong Xu, Qian Yu

机构 * Beihang University(北京航空航天大学) The University of Hong Kong(香港大学)

AI总结 Reason-SVG通过引入Drawing-with-Thought范式和混合奖励机制,提升大语言模型生成高质量SVG的能力,实现结构化推理与视觉一致性。

Comments Accepted by CVPR 2026. 16 pages, 7 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2412.10437 2026-04-10 cs.CV cs.GR cs.LG

SVGFusion: A VAE-Diffusion Transformer for Vector Graphic Generation

SVGFusion:一种用于矢量图形生成的VAE-扩散变换器

Ximing Xing, Juncheng Hu, Ziteng Xue, Jing Zhang, Buyu Li, Sheng Wang, Dong Xu, Qian Yu

机构 * Beihang University(北京航空航天大学) Bambu AI The University of Hong Kong(香港大学)

AI总结 本文提出SVGFusion框架,结合VAE-扩散架构生成高质量可编辑SVG,通过融合矢量与像素信息提升结构理解与生成质量。

Comments project page: https://ximinng.github.io/SVGFusionProject/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.06844 2026-04-09 cs.CV

CloudMamba: An Uncertainty-Guided Dual-Scale Mamba Network for Cloud Detection in Remote Sensing Imagery

CloudMamba: 一种基于不确定性引导的双尺度Mamba网络用于遥感影像中的云检测

Jiajun Yang, Keyan Chen, Zhengxia Zou, Zhenwei Shi

机构 * Beihang University(北京航空航天大学) Key Laboratory of Spacecraft Design Optimization and Dynamic Simulation Technologies, Ministry of Education(教育部航天器设计优化与动态模拟技术重点实验室)

AI总结 本文提出CloudMamba网络,通过引入不确定性引导的两阶段云检测策略和双尺度Mamba网络,提升遥感影像中云检测的准确性与效率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.04614 2026-04-09 cs.LG cs.AI

A Clinical Point Cloud Paradigm for In-Hospital Mortality Prediction from Multi-Level Incomplete Multimodal EHRs

一种用于院内死亡预测的临床点云范式:从多级不完整多模态电子健康记录

Bohao Li, Tao Zou, Junchen Ye, Yan Gong, Bowen Du

机构 * Beihang University(北京航空航天大学) The Hong Kong Polytechnic University(香港理工大学)

AI总结 本文提出HealthPoint范式,通过统一的4D空间表示多级不完整多模态EHRs,引入低秩关系注意力机制和分层交互策略,实现灵活的事件级交互与细粒度自监督,提升模态恢复和未标记数据利用效率,实验表明其在风险预测中性能优异。

Comments 20 pages

详情

展开后加载摘要…

URL PDF HTML 收藏