arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

共收录 1233
2503.18352 2025-12-19 cs.CV

Diffusion-4K: Ultra-High-Resolution Image Synthesis with Latent Diffusion Models

Diffusion-4K: 基于潜在扩散模型的超高清图像合成

Jinjin Zhang, Qiuyu Huang, Junjie Liu, Xiefan Guo, Di Huang

机构 * State Key Laboratory of Complex and Critical Software Environment(复杂与关键软件环境国家重点实验室) Beihang University(北京航空航天大学) School of Computer Science and Engineering(计算机科学与工程学院)

AI总结 Diffusion-4K通过引入Aesthetic-4K基准和基于小波的微调方法,实现了高质量超高清图像合成。

Comments Accepted to CVPR 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.15066 2025-12-18 cs.CV cs.AI

Tracking spatial temporal details in ultrasound long video via wavelet analysis and memory bank

通过小波分析和记忆库实现超声长视频中空间时间细节的跟踪

Chenxiao Zhang, Runshi Zhang, Junchen Wang

机构 * School of Mechanical Engineering and Automation, Beihang University(机械工程与自动化学院,北航)

AI总结 本文提出基于记忆库的小波过滤和融合网络,用于提高超声长视频中细粒度空间特征提取和小物体分割的精度。

Comments Chenxiao Zhang and Runshi Zhang contributed equally to this work. 14 pages, 11 figures

Journal ref Medical Image Analysis 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2507.20226 2025-12-18 cs.AI

Improving Subgraph Matching by Combining Algorithms and Graph Neural Networks

通过结合算法与图神经网络改进子图匹配

Shuyang Guo, Wenjin Xie, Ping Lu, Ting Deng, Richong Zhang, Jianxin Li, Xiangping Huang, Zhongyi Liu

机构 * SKLCCSE, Beihang University(北京航空航天大学软件学院) TravelSky Technology Limited(TravelSky科技有限公司) Beijing Engineering Research Centerof Civil Aviation Big Data(民航大数据北京工程研究中心)

AI总结 HFrame通过结合传统算法与图神经网络,提高了子图同态的匹配效率和准确性。

Comments KDD 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14550 2025-12-17 cs.CV

TAT: Task-Adaptive Transformer for All-in-One Medical Image Restoration

TAT:适用于所有医学图像恢复的任务自适应Transformer

Zhiwen Yang, Jiaju Zhang, Yang Yi, Jian Liang, Bingzheng Wei, Yan Xu

机构 * School of Biological Science and Medical Engineering(生物科学与医学工程学院) State Key Laboratory of Software Development Environment(软件开发环境国家重点实验室) Key Laboratory of Biomechanics and Mechanobiology of Ministry of Education(教育部生物力学与机力学重点实验室) Beijing Advanced Innovation Center for Biomedical Engineering(北京生物医学工程先进创新中心) Beihang University(北京航空航天大学) Sinovision Technologies (Beijing) Co., Ltd.(北京视界科技有限公司) ByteDance Inc.(字节跳动公司)

AI总结 TAT提出了一种任务自适应Transformer框架,通过动态调整权重和损失平衡策略,解决医学图像恢复中任务干扰和不平衡问题,实现多任务高性能恢复。

Comments This paper has been accepted by MICCAI 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.01510 2025-12-17 cs.CV

Luminance-Aware Statistical Quantization: Unsupervised Hierarchical Learning for Illumination Enhancement

具有亮度意识的统计量化:无监督分层学习用于照明增强

Derong Kong, Zhixiong Yang, Shengxi Li, Shuaifeng Zhi, Li Liu, Zhen Liu, Jingyuan Xia

机构 * College of Electronic Science and Technology, National University of Defense Technology(电子科学与技术学院,国防科技大学) College of Electronic and Information Engineering, Beihang University(电子与信息工程学院,北航)

AI总结 本文提出LASQ框架,通过无监督分层学习实现照明增强,改进亮度转换建模,提升低光照图像恢复的适应性和泛化能力。

Comments Accepted at NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.14158 2025-12-17 cs.CV cs.CR

CIS-BA: Continuous Interaction Space Based Backdoor Attack for Object Detection in the Real-World

CIS-BA:基于连续交互空间的面向现实世界目标检测的后门攻击

Shuxin Zhao, Bo Lang, Nan Xiao, Yilang Zhang

机构 * organization= State Key Laboratory of Complex \& Critical Software Environment , addressline= Beihang University , city= Beijing , postcode= 100191 , country= China organization= Zhongguancun Laboratory , addressline= , city= Beijing , postcode= 100080 , country= China

AI总结 CIS-BA通过引入连续交互空间的触发机制,实现了对现实世界目标检测模型的高效且鲁棒的后门攻击,有效提升了攻击成功率并规避了现有防御方法。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13472 2025-12-16 cs.CL

Scaling Laws for Code: Every Programming Language Matters

代码的缩放定律:每种编程语言都至关重要

Jian Yang, Shawn Guo, Lin Jing, Wei Zhang, Aishan Liu, Chuan Hao, Zhoujun Li, Wayne Xin Zhao, Xianglong Liu, Weifeng Lv, Bryan Dai

机构 * Beihang University(北京航空航天大学) Ubiquant

AI总结 本文首次系统研究了多语言代码预训练的缩放定律,通过大规模实验揭示不同编程语言在模型大小和数据量上的差异影响,并提出比例依赖的多语言缩放定律以优化训练资源分配。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.13279 2025-12-16 cs.CL

AIR: Post-training Data Selection for Reasoning via Attention Head Influence

AIR:通过注意力头影响进行推理的后训练数据选择

Jinrui Liu, Jeff Wu, Xuanguang Pan, Gavin Cheung, Shuai Ma, Chongyang Tao

机构 * Beihang University(北洋大学) Independent Researcher(独立研究者)

AI总结 AIR通过注意力头影响机制,提升大语言模型推理能力的后训练数据选择效率。

Comments 19 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2506.03761 2025-12-16 cs.CL

Pet-Bench: Benchmarking the Abilities of Large Language Models as E-Pets in Social Network Services

Pet-Bench: 评估大型语言模型作为社交网络服务中电子宠物的能力基准

Hongcheng Guo, Zheyong Xie, Shaosheng Cao, Boyang Wang, Weiting Liu, Zheyu Ye, Zhoujun Li, Zuozhu Liu, Wei Lu

机构 * Fudan University(复旦大学) Xiaohongshu Inc.(小红书公司) Beihang University(北航) Zhejiang University(浙江大学) Singapore University of Technology and Design(新加坡科技设计大学)

AI总结 Pet-Bench是一个评估大型语言模型作为电子宠物在社交网络服务中能力的基准测试,通过多样化的任务和7500多个互动实例,评估模型在自我进化和人际互动方面的表现,揭示模型大小和能力对性能的影响,推动情感沉浸式人-宠物互动的发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11856 2025-12-16 cs.LG cs.AI

GCoDE: Efficient Device-Edge Co-Inference for GNNs via Architecture-Mapping Co-Search

GCoDE: 通过架构映射联合搜索实现高效的设备-边缘协同推理

Ao Zhou, Jianlei Yang, Tong Qiao, Yingjie Qi, Zhi Yang, Weisheng Zhao, Chunming Hu

机构 * School of Software, Beihang University(北京航空航天大学软件学院) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Qingdao Research Institute, Beihang University(北京航空航天大学青岛研究院) School of Computer Science and Engineering, Peking University(北京大学计算机科学与工程学院) School of Integrated Circuits and Engineering, Beihang University(北京航空航天大学集成电路与工程学院)

AI总结 GCoDE通过架构映射联合搜索实现高效的设备-边缘协同推理,提升GNN推理效率与能耗表现。

Comments accepted by IEEE Transactions on Computers

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.11845 2025-12-16 cs.LG cs.AI

Airport Passenger Flow Forecasting via Deformable Temporal-Spectral Transformer Approach

通过可变形时频变换器方法进行机场乘客流量预测

Wenbo Du, Lingling Han, Ying Xiong, Ling Zhang, Biyue Li, Yisheng Lv, Tong Guo

机构 * School of Electronic and Information Engineering and State Key Laboratory of CNS/ATM, Beihang University(电子信息工程学院和 CNS/ATM 国家重点实验室,北京航空航天大学) Department of Information and Technology, Beijing Capital International Airport Co., Ltd.(信息与技术部,北京首都国际机场有限公司) College of Information and Electrical Engineering, China Agricultural University(信息与电气工程学院,中国农业大学) State Key Laboratory of Multimodal Artificial Intelligence Systems, Institute of Automation, Chinese Academy of Sciences(多模态人工智能系统国家重点实验室,中国科学院自动化研究所) School of Artificial Intelligence, University of the Chinese Academy of Sciences(人工智能学院,中国科学院大学)

AI总结 本文提出DTSFormer模型,通过可变形时频变换器方法提升机场乘客流量预测精度,有效捕捉异质趋势和周期性波动。

Comments 14 pages, 10 figures

Journal ref IEEE Transactions on Intelligent Transportation Systems 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.10863 2025-12-12 cs.CV cs.AI

MMSI-Video-Bench: A Holistic Benchmark for Video-Based Spatial Intelligence

MMSI-Video-Bench: 一个面向视频基于空间智能的综合基准

Jingli Lin, Runsen Xu, Shaohao Zhu, Sihan Yang, Peizhou Cao, Yunlong Ran, Miao Hu, Chenming Zhu, Yiman Xie, Yilin Long, Wenbo Hu, Dahua Lin, Tai Wang, Jiangmiao Pang

机构 * Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiaotong University(上海交通大学) The Chinese University of Hong Kong(香港中文大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Xi’an Jiaotong University(西安交通大学) University of Hong Kong(香港大学) Fudan University(复旦大学) University of California, Los Angeles(加州大学洛杉矶分校)

AI总结 MMSI-Video-Bench是一个综合评估视频基于空间智能的基准,通过多任务和多数据集评估25个MLLMs,揭示了人机推理差距和模型泛化不足的问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.15365 2025-12-12 eess.SY cs.LG cs.MA cs.SY

TranSimHub:A Unified Air-Ground Simulation Platform for Multi-Modal Perception and Decision-Making

TranSimHub:一个多模态感知与决策的空地协同仿真平台

Maonan Wang, Yirong Chen, Yuxin Cai, Aoyu Pang, Yuejiao Xie, Zian Ma, Chengcheng Xu, Kemou Jiang, Ding Wang, Laurent Roullet, Chung Shue Chen, Zhiyong Cui, Yuheng Kan, Michael Lepech, Man-On Pun

机构 * The Chinese University of Hong Kong, Shenzhen(香港中文大学(深圳)) Shanghai AI Laboratory(上海人工智能实验室) Stanford University(斯坦福大学) Nanyang Technological University(南洋理工大学) SenseTime Group Ltd(商汤科技有限公司) Beihang University(北京航空航天大学) Nokia Bell Labs(诺基亚贝尔实验室)

AI总结 TranSimHub是一个用于空地协同智能的统一仿真平台,支持多模态感知与决策研究,提供同步渲染和可控场景编辑功能。

Comments 9 pages, 4 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.04522 2025-12-12 cs.LG cs.AI

Toward a Unified Geometry Understanding: Riemannian Diffusion Framework for Graph Generation and Prediction

迈向统一几何理解:图生成与预测的黎曼扩散框架

Yisen Gao, Xingcheng Fu, Qingyun Sun, Jianxin Li, Xianxian Li

机构 * Key Lab of Education Blockchain and Intelligent Technology, Guangxi Normal University(教育区块链与智能技术重点实验室,广西师范大学) Computer Science and Engineering, The Hong Kong University of Science and Technology(计算机科学与工程,香港科学与技术大学) Guangxi Key Lab of Multi-source Information Mining & Security, Guangxi Normal University(广西多源信息挖掘与安全重点实验室,广西师范大学) School of Computer Science and Engineering, Beihang University(计算机科学与工程学院,北京航空航天大学)

AI总结 本文提出GeoMancer框架,通过黎曼扩散方法解决图数据生成与预测中的几何潜力释放问题,提升模型对复杂流形结构的学习能力。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.09377 2025-12-11 cs.RO

Observability Analysis and Composite Disturbance Filtering for a Bar Tethered to Dual UAVs Subject to Multi-source Disturbances

双无人机 tethered 杆的可观测性分析与复合扰动滤波

Lidan Xu, Dadong Fan, Junhong Wang, Wenshuo Li, Hao Lu, Jianzhong Qiao

机构 * School of Cyber Science and Technology, Beihang University(信息科学与技术学院,北航) School of Automation Science and Electrical Engineering, Beihang University(自动化科学与电气工程学院,北航) Beijing Engineering Research Center of Industrial Spectrum Imaging(工业频谱成像北京工程研究中心) School of Automation and Electrical Engineering, University of Science and Technology Beijing(自动化与电气工程学院,北京科技大学) Hangzhou Innovation Institute, Beihang University(杭州创新研究院,北航)

AI总结 本文提出双无人机 tethered 杆系统的可观测性分析与复合扰动滤波方法,证明在多源扰动下系统可观测性,并通过滤波方案实现低成本高鲁棒性的状态估计。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07863 2025-12-10 cs.LG

SetAD: Semi-Supervised Anomaly Learning in Contextual Sets

SetAD: 在上下文集合中进行半监督异常学习

Jianling Gao, Chongyang Tao, Xuelian Lin, Junfeng Liu, Shuai Ma

机构 * Beihang University(北京航空航天大学) Pengcheng Laboratory(鹏城实验室)

AI总结 SetAD提出了一种基于集合的半监督异常检测框架,通过集合级建模和上下文校准机制提升异常检测性能。

Comments 9 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07122 2025-12-09 cs.SE cs.AI

RisConFix: LLM-based Automated Repair of Risk-Prone Drone Configurations

RisConFix: 基于大语言模型的高风险无人机配置自动修复

Liping Han, Tingting Nie, Le Yu, Mingzhe Hu, Tao Yue

机构 * School of Computer Science Nanjing University of Posts and Telecommunications(南京邮电大学计算机科学学院) School of Computer Science and Engineering Beihang University(北京航空航天大学计算机科学与工程学院)

AI总结 RisConFix通过基于大语言模型的实时修复机制,有效提升无人机在高风险配置下的鲁棒性,实验显示其修复成功率高达97%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.07110 2025-12-09 cs.CV

MSN: Multi-directional Similarity Network for Hand-crafted and Deep-synthesized Copy-Move Forgery Detection

MSN:多方向相似性网络用于手工制作和深度合成的拷贝移动伪造检测

Liangwei Jiang, Jinluo Xie, Yecheng Huang, Hua Zhang, Hongyu Yang, Di Huang

机构 * State Key Laboratory of Software Development Environment, Beihang University(软件开发环境国家重点实验室,北京航空航天大学) Institute of Artificial Intelligence, Beihang University(人工智能研究院,北京航空航天大学) State Key Laboratory of Information Security, Institute of Information Engineering, Chinese Academy of Sciences(信息安全部国家重点实验室,信息工程研究所,中国科学院)

AI总结 本文提出多方向相似性网络(MSN)用于检测手工制作和深度合成的拷贝移动伪造,通过改进的表示和定位方法提升检测效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05853 2025-12-09 cs.CV

VRSA: Jailbreaking Multimodal Large Language Models through Visual Reasoning Sequential Attack

通过视觉推理序列攻击对多模态大语言模型进行劫持

Shiji Zhao, Shukun Xiong, Yao Huang, Yan Jin, Zhenyu Wu, Jiyang Guan, Ranjie Duan, Jialing Tao, Hui Xue, Xingxing Wei

机构 * Alibaba Group(阿里巴巴集团) Institute of Artificial Intelligence, Beihang University(北京航空航天大学人工智能研究院)

AI总结 VRSA通过视觉推理序列攻击方法,针对多模态大语言模型的视觉模态进行劫持,提升攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04441 2025-12-09 cs.CV

MindDrive: An All-in-One Framework Bridging World Models and Vision-Language Model for End-to-End Autonomous Driving

MindDrive: 一个整合世界模型和视觉-语言模型的全功能框架,用于端到端自动驾驶

Bin Sun, Yaoguang Cao, Yan Wang, Rui Wang, Jiachen Shang, Xiejie Feng, Jiayi Lu, Jia Shi, Shichun Yang, Xiaoyu Yan, Ziying Song

机构 * School of Transportation Science and Engineering, Beihang University(北京航空航天大学交通科学与工程学院) State Key Laboratory of Intelligent Transportation System, Beihang University(北京航空航天大学智能交通系统国家重点实验室) Hangzhou International Innovation Institute, Beihang University(北京航空航天大学杭州国际创新院) Contemporary Amperex Technology Co., Limited (CATL)(当代电动车技术有限公司(CATL)) Research Institute of Aero-Engine, Beihang University(北京航空航天大学航空发动机研究院) School of Computer Science and Technology, Beijing Jiaotong University(北京交通大学计算机科学与技术学院) China Automotive Engineering Research Institute Co., Ltd.(中国汽车工程研究院股份有限公司)

AI总结 MindDrive通过整合世界模型和视觉-语言模型,提出了一种端到端自动驾驶框架,实现高质量轨迹生成与多目标决策推理,提升自动驾驶的安全性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.18218 2025-12-09 math.OC cs.CV

DualHash: A Stochastic Primal-Dual Algorithm with Theoretical Guarantee for Deep Hashing

DualHash: 一种具有理论保证的随机对偶算法用于深度哈希

Luxuan Li, Xiao Wang, Chunfeng Cui

机构 * School of Mathematical Sciences, Beihang University(北京航空航天大学数学科学学院) School of Computer Science and Engineering, Sun Yat-Sen University(中山大学计算机科学与工程学院)

AI总结 DualHash通过理论保证的随机对偶算法解决深度哈希中的收敛问题,提供O(ε⁻⁴)和O(ε⁻³)复杂度的高效哈希方法。

Comments 27 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.04598 2025-12-09 cs.CL cs.AI cs.LG

HybridNorm: Towards Stable and Efficient Transformer Training via Hybrid Normalization

HybridNorm: 一种通过混合归一化实现稳定和高效Transformer训练的方法

Zhijian Zhuo, Yutao Zeng, Ya Wang, Sijun Zhang, Jian Yang, Xiaoqing Li, Xun Zhou, Jinwen Ma

机构 * School of Mathematical Sciences, Peking University(北京大学数学科学学院) Beihang University(北航) Capital University of Economics and Business(首都经济贸易大学)

AI总结 HybridNorm通过结合Pre-Norm和Post-Norm的优势,提升Transformer训练的稳定性与效率。

Comments Accepted by NeurIPS 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2407.11877 2025-12-09 cs.LO cs.AI

Bridging Weighted First Order Model Counting and Graph Polynomials

连接加权一阶模型计数与图多项式

Qipeng Kuang, Ondřej Kuželka, Yuanhong Wang, Yuyi Wang

机构 * Beihang University(北京航空航天大学)

AI总结 该研究通过将加权一阶模型计数与图多项式关联,定义了新的连通性多项式,并展示了其在解决一阶逻辑问题中的应用及与经典图多项式的联系。

Comments To be published in CSL 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04686 2025-12-09 cs.CV

Towards Cross-View Point Correspondence in Vision-Language Models

面向视觉-语言模型的跨视图点对应研究

Yipu Wang, Yuheng Ji, Yuyang Liu, Enshen Zhou, Ziqiang Yang, Yuxuan Tian, Ziheng Qin, Yue Liu, Huajie Tan, Cheng Chi, Zhiyuan Ma, Daniel Dajun Zeng, Xiaolong Zheng

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学先进交叉学科学院) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) Beihang University(北航大学) Jilin University(吉林大学) National University of Singapore(新加坡国立大学) Peking University(北京大学) Beijing Academy of Artificial Intelligence(北京人工智能研究院) Huazhong University of Science And Technology(华中科技大学)

AI总结 本文提出跨视图点对应任务和 CrossPoint-Bench 基准,通过 CroPond 模型在 CrossPoint-Bench 上取得超越 Gemini-2.5-Pro 的准确率,推动跨视图对应研究发展。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05965 2025-12-08 cs.CV

EditThinker: Unlocking Iterative Reasoning for Any Image Editor

EditThinker: 解锁任何图像编辑器的迭代推理

Hongyu Li, Manyuan Zhang, Dian Zheng, Ziyu Guo, Yimeng Jia, Kaituo Feng, Hao Yu, Yexin Liu, Yan Feng, Peng Pei, Xunliang Cai, Linjiang Huang, Hongsheng Li, Si Liu

机构 * Beihang University(北航大学) Meituan(美团) CUHK MMLab CUHK IMIXR Tsinghua University(清华大学)

AI总结 EditThinker通过迭代推理框架提升图像编辑指令遵循能力,利用强化学习优化编辑过程,显著提高模型性能。

Comments Project page: https://appletea233.github.io/think-while-edit

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.05578 2025-12-08 cs.RO

A Hyperspectral Imaging Guided Robotic Grasping System

基于超光谱成像的机器人抓取系统

Zheng Sun, Zhipeng Dong, Shixiong Wang, Zhongyi Chu, Fei Chen

机构 * Department of Mechanical and Automation Engineering, T-Stone Robotics Institute, The Chinese University of Hong Kong, Hong Kong SAR(机械与自动化工程系,T-Stone机器人研究所,香港中文大学,香港特别行政区) School of Instrumentation and Optoelectronic Engineering, Beihang University(仪器与光电工程学院,北航大学)

AI总结 本文提出一种基于超光谱成像的机器人抓取系统,通过PRISM和SpectralGrasp框架提升纺织品识别和分拣效率。

Comments 8 pages, 7 figures, Accepted to IEEE Robotics and Automation Letters (RA-L) 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01826 2025-12-08 cs.CV

GLDiTalker: Speech-Driven 3D Facial Animation with Graph Latent Diffusion Transformer

GLDiTalker: 基于图潜在扩散变换器的语音驱动3D面部动画

Yihong Lin, Zhaoxin Fan, Xianjia Wu, Lingyu Xiong, Liang Peng, Xiandong Li, Wenxiong Kang, Songju Lei, Huang Xu

机构 * South China University of Technology(南方科技大学) Beihang University(北航) Huawei Cloud(华为云) Nanjing University(南京大学)

AI总结 GLDiTalker通过图潜在扩散变换器解决语音驱动3D面部动画中的模态不一致问题,提升唇形同步精度和运动多样性。

Comments 9 pages, 5 figures

Journal ref the 34th International Joint Conference on Artificial Intelligence, 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.04747 2025-12-05 cs.LG

A Tutorial on Regression Analysis: From Linear Models to Deep Learning -- Lecture Notes on Artificial Intelligence

回归分析教程:从线性模型到深度学习 -- 人工智能讲座笔记

Jingyuan Wang, Jiahao Ji

机构 * Beihang University(北航大学)

AI总结 本文为人工智能课程提供回归分析教程,涵盖线性模型到深度学习的全面内容,包括各种回归方法及优化技术。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03996 2025-12-04 cs.CV cs.AI

Highly Efficient Test-Time Scaling for T2I Diffusion Models with Text Embedding Perturbation

面向T2I扩散模型的高效测试时缩放方法:文本嵌入扰动

Hang Xu, Linjiang Huang, Feng Zhao

机构 * MoE Key Lab of BIPC, USTC(信息与通信前沿技术联合实验室,中国科学技术大学) Beihang University(北京航空航天大学)

AI总结 本文提出文本嵌入扰动方法,通过结合频率引导的噪声调度与空间噪声扰动,提升T2I扩散模型生成质量与多样性,无需额外计算资源。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03404 2025-12-04 cs.CV

MOS: Mitigating Optical-SAR Modality Gap for Cross-Modal Ship Re-Identification

MOS:缓解光学-合成孔径雷达模态差距以实现跨模态舰船重识别

Yujian Zhao, Hankun Liu, Guanglin Niu

机构 * School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院)

AI总结 MOS通过模态一致表示学习和跨模态数据生成与融合,有效缓解光学与SAR图像间的模态差距,提升舰船跨模态重识别的准确率。

详情

展开后加载摘要…

URL PDF HTML 收藏