arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-05-25 至 2026-05-25 共收录 5
2605.23840 2026-05-25 cs.CV

MuellerPT: Decomposition Driven Pretraining for Dense Learning in Mueller Polarimetry

MuellerPT: 穆勒偏振测量中密集学习的分解驱动预训练

Adam Tlemsani, Yingdian Li, Maxime Giot, Naim Slim, Christopher J. Peters, Abhijeet Ghosh, Daniel S. Elson

机构 * Department of Computing, Imperial College London(帝国理工学院计算机系) Hamlyn Centre for Robotic Surgery, Imperial College London(帝国理工学院机器人外科中心) Department of Surgery and Cancer, Imperial College London(帝国理工学院外科与癌症系) Xi’an Institute of Optics and Precision Mechanics, Chinese Academy of Sciences(中国科学院西安光学精密机械研究所) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 提出MuellerPT,一种通过预测Lu-Chipman分解图进行物理引导预训练的方法,在少样本分割和分类任务中显著提升标签效率和跨样本泛化能力。

Comments Accepted to 29th International Conference on Medical Image Computing and Computer Assisted Intervention (MICCAI 2026)

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.23723 2026-05-25 cs.AI

MemAudit: Post-hoc Auditing of Poisoned Agent Memory via Causal Attribution and Structural Anomaly Detection

MemAudit:通过因果归因和结构异常检测对中毒代理记忆进行事后审计

Zhewen Tan, Yilun Yao, Huiyan Jin, Wenhan Yu, Guoan Wang, Mengyuan Fan, liang lu, Feng Liu, Xiangzheng Zhang, Duohe Ma, Tong Yang, Lin Sun

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) Qiyuan Tech(齐元科技) Laboratory of Multimedia Information Processing, School of Computer Science, Peking University(北京大学计算机科学学院多媒体信息处理实验室) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络安全学院)

AI总结 提出MemAudit框架,结合反事实记忆影响评分和记忆一致性图,对记忆增强型LLM代理中的恶意注入记忆进行事后因果审计,显著降低攻击成功率。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.07869 2026-05-25 cs.RO

USIM and U0: A Vision-Language-Action Dataset and Model for General Underwater Robots

USIM 和 U0:面向通用水下机器人的视觉-语言-动作数据集与模型

Junwen Gu, Zhiheng Wu, Pengxuan Si, Shuang Qiu, Zhentao Zhang, Yukai Feng, Luoyang Sun, Laien Luo, Lianyi Yu, Jian Wang, Zhengxing Wu

机构 * The Key Laboratory of Cognition and Decision Intelligence for Complex Systems, Institute of Automation, Chinese Academy of Sciences(认知与决策智能复杂系统重点实验室,自动化研究所,中国科学院) Baidu Inc.(百度公司) The School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院)

AI总结 提出一个统一框架,通过数据合成管道构建模拟数据集 USIM 和视觉-语言-动作模型 U0,实现水下机器人从避障导航到三维移动操作的多任务执行,在离线动作预测误差和在线成功率上达到最优。

Comments Project Page: https://vincentgu2000.github.io/u0project/

详情

展开后加载摘要…

URL PDF HTML 收藏
2605.15828 2026-05-25 cs.CV

Not All Tasks Quantize Equally: Fisher-Guided Quantization for Visual Geometry Transformer

并非所有任务量化平等:面向视觉几何Transformer的Fisher引导量化

Yipu Zhang, Jintao Cheng, Weilun Feng, Jiehao Luo, Chuanguang Yang, Zhulin An, Yongjun Xu, Wei Zhang

机构 * Department of Electronic and Computer Engineering, HKUST(香港科技大学电子与计算机工程系) State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) School of Data Science and Engineering, South China Normal University(华南师范大学数据科学与工程学院)

AI总结 提出Fisher引导量化方法,利用Fisher信息矩阵量化不同任务、块和通道的敏感性,在量化校准中保护关键通道和块,以解决前馈3D重建模型量化时任务间敏感性差异导致的精度损失问题。

详情

展开后加载摘要…

URL PDF HTML 收藏
2503.06684 2026-05-25 cs.CV

PixelPonder: Dynamic Patch Adaptation for Enhanced Multi-Conditional Text-to-Image Generation

PixelPonder: 动态补丁自适应增强多条件文本到图像生成

Yanjie Pan, Qingdong He, Zhengkai Jiang, Pengcheng Xu, Chaoyi Wang, Jinlong Peng, Haoxuan Wang, Yun Cao, Zhenye Gan, Mingmin Chi, Bo Peng, Yabiao Wang

机构 * Fudan University(复旦大学) Tencent Youtu Lab(腾讯优图实验室) Western University(西澳大学) University of Chinese Academy of Sciences(中国科学院大学)

AI总结 提出PixelPonder统一控制框架,通过补丁级自适应条件选择和时间感知控制注入机制,解决多条件文本到图像生成中结构失真和伪影问题,在保持文本语义一致性的同时提升空间对齐精度。

详情

展开后加载摘要…

URL PDF HTML 收藏