arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

Fudan University(复旦大学)

2026-07-23 至 2026-07-23 共收录 4
2607.19877 2026-07-23 cs.CV 新提交

Robust Activation Map Rectification for Weakly Supervised Volumetric Segmentation: Temporal Coherence as a Free Lunch

用于弱监督体积分割的鲁棒激活图校正:将时间相干性作为免费午餐

Renshu Gu, Jialiang Chen, Fei Gao, Hang Su, Jun Qi, Jiamin Xu, Yicheng Shen, Jiayu Zhang, Jiaxi Pan, Caiming Zhang, Gang Xu

机构 * School of Computer Science, Hangzhou Dianzi University(杭州电子科技大学计算机学院) Hangzhou Institute of Technology, Xidian University(西安电子科技大学杭州研究院) University of Yamanashi(山梨大学) Department of Electronic Engineering, School of Information Science and Engineering, Fudan University(复旦大学信息科学与工程学院电子工程系) Ruian People’s Hospital(瑞安市人民医院) School of Software, Shandong University(山东大学软件学院)

AI总结 针对弱监督体积分割中CAM不可靠问题,提出无训练无原型框架,利用VRAA抑制噪声放大信号,用BER机制校正不合理激活,该方法与模型无关,集成方便,实验显示相比现有方法有显著提升,减少推理时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19876 2026-07-23 cs.RO cs.CV 新提交

KineBench: Benchmarking Embodied World Models via IDM-Free Kinematic Grounding

KineBench:通过无逆动力学模型的运动学基础对具身世界模型进行基准测试

Zeyu Liu, Zhangzhe Zhu, Yang Zhang, Chenyou Fan, Chenjia Bai, Xuelong Li

机构 * Institute of Artificial Intelligence (TeleAI), China Telecom(中国电信人工智能研究院) National University of Singapore(新加坡国立大学) Fudan University(复旦大学) Tsinghua University(清华大学) Shenzhen Research Institute of Northwestern Polytechnical University(西北工业大学深圳研究院)

AI总结 研究旨在评估具身世界模型物理一致性,提出无逆动力学模型的KineBench基准测试。利用级联视觉基础模型提取姿态,在物理模拟器中闭环验证,纳入运动学指标,基于ManiSkill3的任务评估EWMs,揭示任务复杂度受限的非线性缩放,为数据缩放策略提供指导。

Comments Accept to ECCV2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19857 2026-07-23 cs.CV cs.AI 新提交

Memory-Augmented Multimodal Large Language Models for Small Object Understanding in Streaming Aerial Videos

用于流式航空视频中小目标理解的内存增强多模态大语言模型

Penglei Sun, Yehua Huang, Zhuoli Tao, Xiang Li, Runwei Guan, Yaoxian Song, Kaiyong Zhao, Henghui Ding, Bo Han, Yang Yang, Xiaowen Chu

机构 * The Hong Kong University of Science and Technology (Guangzhou)(香港科技大学(广州)) University of Freiburg(弗莱堡大学) Hangzhou City University(杭州城市大学) XGRIDS(XGRIDS公司) Fudan University(复旦大学) Hong Kong Baptist University(香港浸会大学)

AI总结 研究针对流式航空视频中小目标理解难题,提出像素级开放词汇数据集DroneEyes,以及含语义感知令牌路由器和分层内存库的多模态大语言模型SkyAnchor,从数据和方法角度应对挑战。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.19802 2026-07-23 cs.IR cs.LG 新提交

Zero-Observation User Reactivation with Gap-Driven Dimensional Gating

基于间隙驱动维度门控的零观测用户重新激活

Jiandong Ding, Tianying Liu, Fuyuan Liu, Huijie Qin, Tiandeng Wu

机构 * Fudan University(复旦大学) Huawei Technologies(华为技术)

AI总结 研究零观测用户重新激活问题,提出轻量级输出层插件DeltaGate,在三个亚马逊数据集实验,其能在保持主干冻结下,通过间隙和个性化表示调节路由维度,相比其他方法提升了Hit@10指标,且参数少、保留主干漂移。

Comments Accepted at the 20th ACM Conference on Recommender Systems (RecSys 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏