arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Beihang University(北京航空航天大学)

共收录 1233
2507.03724 2025-12-04 cs.CL

MemOS: A Memory OS for AI System

MemOS:人工智能系统中的内存操作系统

Zhiyu Li, Chenyang Xi, Chunyu Li, Ding Chen, Boyu Chen, Shichao Song, Simin Niu, Hanyu Wang, Jiawei Yang, Chen Tang, Qingchen Yu, Jihao Zhao, Yezhaohui Wang, Peng Liu, Zehao Lin, Pengyuan Wang, Jiahao Huo, Tianyi Chen, Kai Chen, Kehang Li, Zhen Tao, Huayi Lai, Hao Wu, Bo Tang, Zhengren Wang, Zhaoxin Fan, Ningyu Zhang, Linfeng Zhang, Junchi Yan, Mingchuan Yang, Tong Xu, Wei Xu, Huajun Chen, Haofen Wang, Hongkang Yang, Wentao Zhang, Zhi-Qin John Xu, Siheng Chen, Feiyu Xiong

机构 * MemTensor (Shanghai) Technology Co., Ltd.(MemTensor(上海)科技有限公司) Institute for Advanced Algorithms Research, Shanghai(上海先进算法研究所) Research Institute of China Telecom(中国电信研究院) Tongji University(同济大学) Zhejiang University(浙江大学) University of Science and Technology of China(中国科学技术大学) Peking University(北京大学) Renmin University of China(中国人民大学) Beihang University(北航) Shanghai Jiao Tong University(上海交通大学)

AI总结 MemOS是一种面向人工智能系统的内存操作系统,通过统一管理不同类型的内存资源,提升长上下文推理和持续个性化的能力。

Comments 36 pages, 10 figures, 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2409.18980 2025-12-04 cs.CL cs.AI cs.CV

IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web

IW-Bench: 评估大规模多模态模型的图像到网页转换能力

Hongcheng Guo, Wei Zhang, Junhao Chen, Yaonan Gu, Jian Yang, Junjia Du, Shaosheng Cao, Binyuan Hui, Tianyu Liu, Jianxin Ma, Chang Zhou, Zhoujun Li

机构 * Beihang University(北京航空航天大学) Alibaba Group(阿里巴巴集团) Tsinghua University(清华大学) Nanyang Technological University(南洋理工大学) National University of Singapore(新加坡国立大学)

AI总结 IW-Bench提出了一种新的基准,用于评估大规模多模态模型在图像到网页转换中的性能,通过元素准确率和布局准确率以及五跳提示方法来提升评估效果。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.03036 2025-12-03 cs.CV cs.AI

ViSAudio: End-to-End Video-Driven Binaural Spatial Audio Generation

ViSAudio:端到端视频驱动的双耳空间音频生成

Mengchen Zhang, Qi Chen, Tong Wu, Zihan Liu, Dahua Lin

机构 * Zhejiang University(浙江大学) Shanghai Artificial Intelligence Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) Stanford University(斯坦福大学) Beihang University(北航) The Chinese University of Hong Kong(香港中文大学)

AI总结 ViSAudio通过端到端双耳空间音频生成框架,从静音视频直接生成高质量空间音频,提升空间沉浸感和适应性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.20380 2025-12-03 cs.RO

LPVIMO-SAM: Tightly-coupled LiDAR/Polarization Vision/Inertial/Magnetometer/Optical Flow Odometry via Smoothing and Mapping

LPVIMO-SAM: 通过平滑与映射实现紧密耦合的激光雷达/偏振视觉/惯性/磁力计/光学流里程计

Derui Shan, Peng Guo, Wenshuo Li, Du Tao

机构 * Faculty of Information, North China University of Technology(信息学院,中国北方工业大学) Hangzhou Innovation Institute, Beihang University(杭州创新研究院,北京航空航天大学)

AI总结 LPVIMO-SAM通过融合激光雷达、偏振视觉、惯性、磁力计和光学流,实现高鲁棒性的实时里程计与地图构建。

Comments submitted to IROS2025

Journal ref 2025 IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), Hangzhou, China, 2025, pp. 6801-6807

详情

展开后加载摘要…

URL PDF HTML 收藏
2009.04413 2025-12-03 cs.CL cs.LG stat.ML

On SkipGram Word Embedding Models with Negative Sampling: Unified Framework and Impact of Noise Distributions

关于带有负采样的SkipGram词嵌入模型:统一框架和噪声分布的影响

Dezhi Liu, Richong Zhang, Ziqiao Wang

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) School of Computer Science and Technology, Tongji University(同济大学计算机科学与技术学院)

AI总结 本文提出了一种统一的词嵌入框架WCC,研究了噪声分布对模型学习的影响,并发现了优于现有模型的新嵌入方法。

Comments This work has been submitted to the IEEE for possible publication

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.02554 2025-12-03 cs.CV

OmniPerson: Unified Identity-Preserving Pedestrian Generation

OmniPerson: 统一的身份保持行人生成

Changxiao Ma, Chao Yuan, Xincheng Shi, Yuzhuo Ma, Yongfei Zhang, Longkun Zhou, Yujia Zhang, Shangze Li, Yifan Xu

机构 * Beihang University(北航大学) Pengcheng Laboratory(鹏城实验室)

AI总结 OmniPerson通过统一身份保持的行人生成管道,解决ReID中数据不足问题,实现高保真生成和身份一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01481 2025-12-02 cs.CV

ChronosObserver: Taming 4D World with Hyperspace Diffusion Sampling

ChronosObserver: 用超空间扩散采样驯服4D世界

Qisen Wang, Yifan Zhao, Peisen Shen, Jialu Li, Jia Li

机构 * State Key Laboratory of Virtual Reality Technology and Systems, SCSE, Beihang University(虚拟现实技术与系统国家重点实验室,北京航空航天大学)

AI总结 ChronosObserver通过超空间表示和引导采样,实现无需训练的高质量多视角时间同步视频生成,解决4D世界生成难题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.01255 2025-12-02 cs.CR cs.CL cs.SE

Large Language Models Cannot Reliably Detect Vulnerabilities in JavaScript: The First Systematic Benchmark and Evaluation

大语言模型无法可靠地检测JavaScript中的漏洞:首个系统性基准和评估

Qingyuan Fei, Xin Liu, Song Li, Shujiang Wu, Jianwei Hou, Ping Chen, Zifeng Kang

机构 * Lanzhou University(兰州大学) Zhejiang University(浙江大学) Beihang University(北京航空航天大学) Technology Support Center of the Cyberspace Administration of China(国家互联网信息办公室技术支撑中心) Fudan University(复旦大学) Beijing University of Posts(北京邮电大学)

AI总结 本文首次提出FORGEJS框架,构建首个系统性JavaScript漏洞检测基准ARENAJS,并揭示LLM在漏洞检测中的局限性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00794 2025-12-02 cs.CV

PolarGS: Polarimetric Cues for Ambiguity-Free Gaussian Splatting with Accurate Geometry Recovery

PolarGS: 极化线索用于无歧义的高斯点散射及准确的几何恢复

Bo Guo, Sijia Wen, Yifan Zhao, Jia Li, Zhiming Zheng

机构 * Institute of Artificial Intelligence, Beihang University(北航人工智能研究院) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算先进创新中心) State Key Laboratory of Virtual Reality Technology and Systems, School of Computer Science and Engineering, Beihang University(虚拟现实技术与系统国家重点实验室,北航计算机科学与工程学院)

AI总结 PolarGS通过引入偏振作为光学先验,解决3DGS在光度学模糊区域的几何重建问题,提升重建精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00743 2025-12-02 cs.CV

Multi-GRPO: Multi-Group Advantage Estimation for Text-to-Image Generation with Tree-Based Trajectories and Multiple Rewards

多组GRPO:基于树状轨迹和多奖励的文本到图像生成多组优势估计

Qiang Lyu, Zicong Chen, Chongxiao Wang, Haolin Shi, Shibo Gao, Ran Piao, Youwei Zeng, Jianlou Si, Fei Ding, Jing Li, Chun Pong Lau, Weiqiang Wang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Beihang University(北航) Alibaba Group(阿里巴巴集团) Beijing Jiaotong University(北京交通大学) TikTok Inc.(TikTok公司) City University of Hong Kong(香港城市大学)

AI总结 Multi-GRPO通过树状轨迹和多奖励分组机制,提升文本到图像生成的稳定性和多目标对齐性能。

Comments 20 pages, 15 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00712 2025-12-02 cs.LG

Exploiting Function-Family Structure in Analog Circuit Optimization

利用函数族结构进行模拟电路优化

Zhuohua Liu, Kaiqi Huang, Qinxin Mei, Yuanqi Hu, Wei W. Xing

机构 * School of Integrated Circuit Science and Engineering, Beihang University(集成电路科学与工程学院,北航) School of Mechatronic Control Engineering, Shenzhen University(机械电子控制工程学院,深大) School of Mathematical and Physical Science, University of Sheffield(数学与物理科学学院,谢菲尔德大学)

AI总结 本文提出电路先验网络CPN,利用预训练表格模型和直接预期改进方法,在模拟电路优化中实现高精度和高效性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00438 2025-12-02 cs.CV cs.AI

FR-TTS: Test-Time Scaling for NTP-based Image Generation with Effective Filling-based Reward Signal

FR-TTS: 基于有效填充奖励信号的NTP图像生成测试时扩展

Hang Xu, Linjiang Huang, Feng Zhao

机构 * MoE Key Lab of BIPC, USTC(信息与通信技术联合实验室,中国科学技术大学) Beihang University(北京航空航天大学)

AI总结 FR-TTS通过有效填充奖励信号提升NTP图像生成的测试时扩展性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2505.14227 2025-12-02 cs.CV cs.AI

VoQA: Visual-only Question Answering

VoQA:仅视觉的问题回答

Jianing An, Luyang Jiang, Jie Luo, Wenjun Wu, Lei Huang

机构 * SKLCCSE, School of Artificial Intelligence, Beihang University, Beijing, China(北京航空航天大学人工智能学院) Hangzhou International Innovation Institute, Beihang University, Hangzhou, China(北京航空航天大学杭州国际创新研究院)

AI总结 VoQA通过仅依赖视觉信息回答问题,改进了传统VQA的局限性,通过问题对齐微调策略提升纯视觉推理能力。

Comments 21 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2512.00305 2025-12-02 cs.AI

ChartPoint: Guiding MLLMs with Grounding Reflection for Chart Reasoning

ChartPoint: 通过 grounding 反射引导 MLLMs 进行图表推理

Zhengzhuo Xu, SiNan Du, Yiyan Qi, SiwenLu, Chengjin Xu, Chun Yuan, Jian Guo

机构 * Tsinghua University(清华大学) International Digital Economy Academy(国际数字经济学院) Beihang University(北航) Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州))

AI总结 ChartPoint通过引入 grounding 反射机制,提升 MLLMs 在图表推理中的表现,开发了两个指令微调模型,在多个图表基准上取得显著提升。

Comments Accepted by ICCV 2025

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22908 2025-12-01 cs.CV

ViGG: Robust RGB-D Point Cloud Registration using Visual-Geometric Mutual Guidance

ViGG: 基于视觉-几何互指导的鲁棒RGB-D点云配准

Congjia Chen, Shen Yan, Yufu Qu

机构 * Beihang University(北航大学) China Agricultural University(中国农业大学)

AI总结 ViGG通过视觉-几何互指导策略提升RGB-D点云配准的鲁棒性,优于现有方法。

Comments Accepted by WACV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.10555 2025-12-01 cs.CV cs.AI

A Style is Worth One Code: Unlocking Code-to-Style Image Generation with Discrete Style Space

一种风格等同于一个代码:通过离散风格空间解锁代码到风格图像生成

Huijie Liu, Shuhao Cui, Haoxiang Cao, Shuai Ma, Kai Wu, Guoliang Kang

机构 * Beihang University(北航大学) Kolors Team, Kuaishou Technology(快手科技色彩团队) South China Normal University(华南师范大学)

AI总结 本文提出CoTyle,通过离散风格空间实现代码到风格图像生成,以数值代码控制图像风格,提升生成效率与多样性。

Comments Code: https://github.com/Kwai-Kolors/CoTyle Demo: https://huggingface.co/spaces/Kwai-Kolors/CoTyle Homepage: https://kwai-kolors.github.io/CoTyle/

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.24693 2025-12-01 cs.SD cs.CL eess.AS

STAR-Bench: Probing Deep Spatio-Temporal Reasoning as Audio 4D Intelligence

STAR-Bench:探测深度时空推理作为音频4D智能

Zihan Liu, Zhikang Niu, Qiuyang Xiao, Zhisheng Zheng, Ruoqi Yuan, Yuhang Zang, Yuhang Cao, Xiaoyi Dong, Jianze Liang, Xie Chen, Leilei Sun, Dahua Lin, Jiaqi Wang

机构 * Fudan University(复旦大学) Shanghai AI Laboratory(上海人工智能实验室) The Chinese University of Hong Kong(香港中文大学) Shanghai Innovation Institute(上海创新研究院) Beihang University(北京航空航天大学) Shanghai Jiao Tong University(上海交通大学)

AI总结 STAR-Bench通过测试音频4D智能,揭示了模型在细粒度感知和推理上的不足,为未来模型发展提供方向。

Comments Homepage: https://internlm.github.io/StarBench/

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22659 2025-12-01 cs.AI cs.CV

Geometrically-Constrained Agent for Spatial Reasoning

几何约束代理用于空间推理

Zeren Chen, Xiaoya Lu, Zhijie Zheng, Pengrui Li, Lehan He, Yijin Zhou, Jing Shao, Bohan Zhuang, Lu Sheng

机构 * School of Software, Beihang University(北京航空航天大学软件学院) Shanghai AI Laboratory(上海人工智能实验室) Shanghai Jiao Tong University(上海交通大学) Shanghai Innovation Institute(上海创新研究院) ZIP Lab, Zhejiang University(浙江大学ZIP实验室)

AI总结 Geometrically-Constrained Agent 通过引入正式任务约束,解决视觉语言模型在空间推理中的语义到几何差距问题,实现更稳健的推理路径。

Comments 27 pages, 13 figures

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.22434 2025-12-01 cs.CR cs.AI

FastFHE: Packing-Scalable and Depthwise-Separable CNN Inference Over FHE

FastFHE: 基于FHE的可扩展打包和深度可分离CNN推理

Wenbo Song, Xinxin Fan, Quanliang Jing, Shaoye Luo, Wenqi Wei, Chi Lin, Yunfeng Lu, Ling Liu

机构 * Institute of Computing Technology, CAS(中国科学院计算技术研究所) UCAS(中国科学院大学) Fordham University(福特汉姆大学) Dalian University of Technology(大连理工大学) Beihang University(北京航空航天大学) Georgia Institute of Technology(佐治亚理工学院)

AI总结 FastFHE通过可扩展加密打包、深度可分离卷积、BN点积融合和Legendre多项式近似,提升FHE下CNN推理效率与精度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2509.01088 2025-12-01 cs.CL

Privacy-Preserving Reasoning with Knowledge-Distilled Parametric Retrieval Augmented Generation

基于知识蒸馏的参数化检索增强生成隐私保护推理

Jinwen Chen, Hainan Zhang, Liang Pang, Yongxin Tong, Haibo Zhou, Yuan Zhan, Wei Lin, Zhiming Zheng

机构 * Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing(北京未来区块链与隐私计算先进创新中心) School of Artificial Intelligence, Beihang University(北京航空航天大学人工智能学院) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Meituan(美团)

AI总结 DistilledPRAG通过知识蒸馏实现高效参数化RAG,提升隐私保护推理的准确性和泛化能力。

详情

展开后加载摘要…

URL PDF HTML 收藏
2504.17457 2025-12-01 cs.CV

Unveiling Hidden Vulnerabilities in Digital Human Generation via Adversarial Attacks

通过对抗攻击揭示数字人类生成中的隐藏漏洞

Zhiying Li, Yeying Jin, Fan Shen, Zhi Liu, Weibin Chen, Pengju Zhang, Xiaomei Zhang, Boyu Chen, Michael Shen, Kejian Wu, Zhaoxin Fan, Jin Dong

机构 * College of Cyber Security, Jinan University(济南大学网络安全学院) Beijing Advanced Innovation Center for Future Blockchain and Privacy Computing, School of Artificial Intelligence, Beihang University(北京未来区块链与隐私计算先进创新中心,北航人工智能学院) Hangzhou International Innovation Institute, Beihang University(杭州国际创新研究院,北航) Department of Electrical and Computer Engineering, National University of Singapore(新加坡国立大学电子与计算机工程系) Department of Electrical and Computer Science, University of Pittsburgh(匹兹堡大学电子与计算机科学系) State Key Laboratory of Multimodal Artificial Intelligence, Institute of Automation, Chinese Academy of Science(中国科学院多模态人工智能国家重点实验室,自动化研究所) Institute of Automation, Chinese Academy of Science(中国科学院自动化研究所) University College London(伦敦大学学院) Mingdu Tech(明都科技) Xreal Beijing Academy of Blockchain and Edge Computing(北京区块链与边缘计算研究院)

AI总结 本文提出TBA框架,通过生成针对性对抗示例揭示数字人类生成中的安全漏洞,实验显示其显著提升对抗攻击效果。

Comments 14 pages, 7 figures

Journal ref Pattern Recognition, 2025: 112621

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21202 2025-11-27 cs.CV

Towards an Effective Action-Region Tracking Framework for Fine-grained Video Action Recognition

迈向细粒度视频动作识别的有效动作-区域跟踪框架

Baoli Sun, Yihan Wang, Xinzhu Ma, Zhihui Wang, Kun Lu, Zhiyong Wang

机构 * DUT-RU International School of Information Science & Engineering, Dalian University of Technology, China(大连理工大学国际信息科学与工程学院,大连理工大学,中国) Beihang University, China(北京航空航天大学,中国) The University of Sydney, Australia(悉尼大学,澳大利亚)

AI总结 本文提出了一种动作-区域跟踪框架,通过查询-响应机制捕捉细粒度动作细节,提升视频动作识别性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.21107 2025-11-27 cs.LG cs.AI

Dynamic Stratified Contrastive Learning with Upstream Augmentation for MILP Branching

动态分层对比学习与上游增强用于MILP分支

Tongkai Lu, Shuai Ma, Chongyang Tao

机构 * SKLSDE Lab, Beihang University, Beijing, China(北京航空航天大学信息与科学计算实验室)

AI总结 本文提出动态分层对比学习与上游增强方法,通过GCNN模型提升MILP分支的准确性和效率,特别是在处理上游节点时表现更优。

Comments 18 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20090 2025-11-27 cs.AR cs.AI

R3A: Reliable RTL Repair Framework with Multi-Agent Fault Localization and Stochastic Tree-of-Thoughts Patch Generation

R3A:一种可靠的RTL修复框架,结合多智能体故障定位和随机树状思维补丁生成

Zizhang Luo, Fan Cui, Kexing Zhou, Runlin Guo, Mile Xia, Hongyuan Hou, Yun Liang

机构 * Peking University(北京大学) Beihang University(北航)

AI总结 R3A通过多智能体故障定位和随机树状思维补丁生成方法,有效提高了RTL修复的可靠性,修复率高达90.6%。

详情

展开后加载摘要…

URL PDF HTML 收藏
2311.01759 2025-11-27 cs.LG cs.AR

TinyFormer: Efficient Transformer Design and Deployment on Tiny Devices

TinyFormer: 在微型设备上高效设计和部署变换器

Jianlei Yang, Jiacheng Liao, Fanding Lei, Meichen Liu, Lingkun Long, Junyi Chen, Han Wan, Bei Yu, Weisheng Zhao

机构 * School of Computer Science and Engineering, Beihang University(北京航空航天大学计算机科学与工程学院) Qingdao Research Institute, Beihang University(北京航空航天大学青岛研究所) Department of Computer Science and Engineering, The Chinese University of Hong Kong(香港中文大学(深圳)计算机科学与工程系) Fert Beijing Research Institute, School of Integrated Circuit Science and Engineering, Beihang University(北京航空航天大学集成电路科学与工程学院)

AI总结 TinyFormer是一种专为微型设备设计的高效变换器框架,通过SuperNAS、SparseNAS和SparseEngine实现资源高效的模型设计与部署,显著提升推理速度。

Comments This paper is accepted by IEEE Transactions on Circuits and Systems I: Regular Papers

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20307 2025-11-26 cs.CV

TReFT: Taming Rectified Flow Models For One-Step Image Translation

TReFT: 修正流模型用于一步图像翻译

Shengqian Li, Ming Gao, Yi Liu, Zuzeng Lin, Feng Wang, Feng Dai

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所) Beihang University(北航) Tianjin University(天津大学) CreateAI

AI总结 TReFT通过简化架构和优化损失函数,实现修正流模型在一步图像翻译中的高效实时应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20306 2025-11-26 cs.CV

TaCo: Capturing Spatio-Temporal Semantic Consistency in Remote Sensing Change Detection

TaCo: 在遥感变化检测中捕捉时空语义一致性

Han Guo, Chenyang Liu, Haotian Zhang, Bowen Chen, Zhengxia Zou, Zhenwei Shi

机构 * Beihang University(北航大学)

AI总结 TaCo通过引入时空语义联合约束,有效解决遥感变化检测中的语义不一致问题,实现高精度变化识别。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.20156 2025-11-26 cs.CV cs.RO

Map-World: Masked Action planning and Path-Integral World Model for Autonomous Driving

Map-World: 遮蔽动作规划与路径积分世界模型用于自动驾驶

Bin Hu, Zijian Lu, Haicheng Liao, Chengran Yuan, Bin Rao, Yongkang Li, Guofa Li, Zhiyong Cui, Cheng-zhong Xu, Zhenning Li

机构 * University of Macau(澳门大学) National University of Singapore(新加坡国立大学) Purdue University(普渡大学) Chongqing University(重庆大学) Beihang University(北航大学)

AI总结 MAP-World通过结合遮蔽动作规划和路径加权世界模型,实现了高效的多模式自动驾驶规划,无需强化学习即可达到最佳性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2408.01840 2025-11-26 cs.CV

E$^{3}$NeRF: Efficient Event-Enhanced Neural Radiance Fields from Blurry Images

E$^{3}$NeRF:从模糊图像高效重建事件增强的神经辐射场

Yunshan Qi, Jia Li, Yifan Zhao, Yu Zhang, Lin Zhu

机构 * State Key Laboratory of Virtual Reality Technology and Systems, School of Computer Science and Engineering, Beihang University(虚拟现实技术与系统国家重点实验室,计算机科学与工程学院,北京航空航天大学) School of Computer Science, Beijing Institute of Technology(计算机学院,北京理工大学) SenseTime Research and Tetras.AI(商汤研究院和Tetras.AI)

AI总结 E$^{3}$NeRF通过结合模糊图像和事件流,高效重建清晰NeRF,适用于高速非均匀运动和低光场景。

详情

展开后加载摘要…

URL PDF HTML 收藏
2511.17405 2025-11-25 cs.CL cs.AI

Beyond Multiple Choice: Verifiable OpenQA for Robust Vision-Language RFT

超越多项选择:可验证的开放问答用于鲁棒的视觉-语言 RFT

Yesheng Liu, Hao Li, Haiyu Xu, Baoqi Pei, Jiahao Wang, Mingxuan Zhao, Jingshu Zheng, Zheqi He, JG Yao, Bowen Qin, Xi Yang, Jiajun Zhang

机构 * Institute of Automation, CAS(中国科学院自动化研究所) School of Artificial Intelligence, UCAS(中国科学技术大学人工智能学院) BAAI FlagEval Team(百度AI旗评团队) BUAA(北京航空航天大学) PKU(北京大学) ZJU(浙江大学)

AI总结 ReVeL通过重写和验证多项选择问题为开放式问题,提升视觉-语言模型在鲁棒性与数据效率上的表现。

Comments Project url: https://flageval-baai.github.io/ReVeL/

详情

展开后加载摘要…

URL PDF HTML 收藏