arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-08-04 至 2026-08-04 共收录 11
2608.02589 2026-08-04 cs.CV 新提交

CAPEval: A Decoupled Caption Evaluation across Understanding and Generation

CAPEval:跨理解与生成的解耦式标题评估

Zhipeng Liu, Haochen Wang, Zhaoxiang Zhang

机构 * University of Chinese Academy of Sciences(中国科学院大学) Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所)

AI总结 本研究提出解耦式标题评估基准CAPEval,将标题质量分为覆盖度与精确度,发现二者分别对应理解与生成任务性能,为标题生成器的选择优化提供指导。

Comments 21 pages, 8 figures. Code and dataset will be available at https://liuzhipenggg.github.io/CAPEval/

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02583 2026-08-04 cs.CV cs.AI cs.CL cs.IR 新提交

UEmbed: Unified Sparse and Dense Multimodal Embeddings

UEmbed:统一稀疏与稠密多模态嵌入

Tingyu Song, Mingxin Li, Yanzhao Zhang, Dingkun Long, Pengjun Xie, Zhijie Nie, Yilun Zhao, Shu Wu

机构 * CASIA(中国科学院自动化研究所) Alibaba Group(阿里巴巴集团) University of Chinese Academy of Sciences(中国科学院大学) Yale University(耶鲁大学)

AI总结 UEmbed是一种仅解码器的多模态嵌入模型,可单次前向传播生成稀疏与稠密表示,在MMEB-v2和BEIR上表现优异,统一了两类嵌入并支持多模态智能体应用。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02432 2026-08-04 cs.CV 新提交

Learning to Tessellate: Point Cloud Generation via Recursive Spectral Partitioning

学习镶嵌:通过递归谱划分生成点云

Monan Sun, Bangzhen Liu, Huaidong Zhang, Shengfeng He

机构 * South China University of Technology(华南理工大学) University of Chinese Academy of Sciences(中国科学院大学) City University of Hong Kong(香港城市大学) Singapore Management University(新加坡管理大学)

AI总结 该研究提出自回归框架PointRSP,通过拓扑保留的递归谱划分实现点云生成,引入拓扑感知划分自编码器与双流级联生成器,在生成质量、多样性及复杂3D拓扑泛化上达最优性能。

Comments Accepted by ECCV2026, project page: https://huggingface.co/Mo-nan/PointRSP

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02378 2026-08-04 cs.LG 新提交

Gecko: Fast Private Inference via Secure Public Encoder Offloading

Gecko:通过安全的公共编码器卸载实现快速私有推理

Cheng'an Wei, Kai Chen, Yue Zhao, Congyi Li, Shenchen Zhu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)

AI总结 Gecko通过安全卸载公共编码器实现快速私有推理,在图像和音频任务中推理耗时0.4-2.2秒、通信量≤10.8 MB,准确率与迁移学习基线相当,且能抵御模型提取攻击。

Comments 12 pages, 10 figures, and 5 tables

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02184 2026-08-04 cs.AI cs.FL cs.LO 新提交

PAC Approximation and DIRECT Optimization for Parametric Markov Models

参数马尔可夫模型的PAC近似与DIRECT优化

Zhiming Chi, Ying Liu, Andrea Turrini, Lijun Zhang, David N. Jansen

机构 * Key Laboratory of System Software (Chinese Academy of Sciences)(中国科学院系统软件重点实验室) Institute of Software, Chinese Academy of Sciences(中国科学院软件研究所) University of Chinese Academy of Sciences(中国科学院大学) Institute of Optics and Electronics, Chinese Academy of Sciences(中国科学院光电技术研究所) Institute of Intelligent Software Guangzhou(广州智能软件研究所)

AI总结 本文针对参数马尔可夫决策过程,采用场景方法合成PAC近似,结合统计模型检查分析黑盒参数模型,集成DIRECT算法实现无导数全局优化,在2997个基准上验证了DIRECT优化组件的性能。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.02134 2026-08-04 cs.CV 新提交

Messages, Not Tokens: Grounded Coresets for Faithful VLM Compression

消息而非令牌:用于忠实VLM压缩的基础核心集

Long Qian, Jiaqi Wei, Bingke Zhu, Yingying Chen, Jinqiao Wang

机构 * Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所) University of Chinese Academy of Sciences(中国科学院大学) Wuhan AI Research(武汉人工智能研究院) Cardiff University(卡迪夫大学)

AI总结 该研究针对VLM视觉令牌压缩的现有缺陷,提出无需训练的GMC方法,通过联合分配多维度证据支持并传输被丢弃状态,在大幅减少视觉令牌的同时保持VLM性能,经多基准实验验证有效。

Comments 32 pages, 6 figures, 18 tables, including appendix

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01630 2026-08-04 cs.CL cs.AI 新提交

RING: Retrieval-Internalized Generation for Continual Large-Scale Knowledge Injection

RING:用于持续大规模知识注入的检索内化生成

Shicheng Xu, Liang Pang, Liyi Chen, Zihao Wei, Jingcheng Deng, Yan Gao, Yi Wu, Yao Hu, Huawei Shen, Xueqi Cheng

机构 * State Key Laboratory of AI Safety, Institute of Computing Technology, CAS(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Xiaohongshu Inc.(小红书科技有限公司)

AI总结 RING是一种将检索内化的范式,通过三阶段训练学习参数化记忆的检索策略,在自主构建的News-2025基准上,其知识注入的准确性与效率优于或匹配现有方法。

Comments 16 pages

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.01488 2026-08-04 cs.CV 新提交

Towards Compact Unified Multimodal Tracking: Synergizing Knowledge Distillation with Structural Pruning

迈向紧凑的统一多模态目标跟踪:知识蒸馏与结构剪枝的协同

Yuqi Li, Yuedong Tan, Huiran Duan, Weilun Feng, Chuanguang Yang, Zhulin An, Zongwei Wu, Shiping Wen, Tingwen Huang, Yingli Tian

机构 * The City College of New York(纽约城市学院) INSAIT Sofia University “St. Kliment Ohridski”(圣克莱门特奥赫里德斯基索非亚大学) Julius-Maximilians-Universität Würzburg(维尔茨堡大学) State Key Laboratory of AI Safety, Institute of Computing Technology, Chinese Academy of Sciences(中国科学院计算技术研究所人工智能安全国家重点实验室) University of Chinese Academy of Sciences(中国科学院大学) Shenzhen University of Advanced Technology(深圳先进技术研究院)

AI总结 针对统一多模态跟踪模型计算负担大的问题,提出双对齐蒸馏框架,结合知识蒸馏与结构剪枝,在五组基准上实现了高准确率与5倍速度提升的紧凑模型。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00732 2026-08-04 cs.LG cs.CV 新提交

Mitigating Backdoors via Decoy Shortcuts and Knowledge Decoupling

通过诱饵捷径与知识解耦缓解后门攻击

Zixuan Zhu, Rui Wang, Lihua Jing, Jinwen Zhong

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院)

AI总结 本研究提出TR防御方法,通过蜜罐捷径捕获后门知识,结合知识解耦策略与自动捷径生成,在四个基准数据集和五个模型架构上有效缓解多种后门攻击,同时保留良性性能。

Comments 19 pages; 11 figures; 14Tables; Accept by IJCAI 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00625 2026-08-04 cs.RO cs.AI 新提交

Learning-Based Motion Planning for Dynamic Environments: From Foundational Algorithms to Emerging Paradigms

动态环境下基于学习的运动规划:从基础算法到新兴范式

Zongyuan Shen, Shalabh Gupta, Shancheng Zhao, Dehua Zhou, Gao Wang, Rui Cheng, Yaming Ou, Zhongqiang Ren, Yikui Zhai, C. L. Philip Chen

机构 * College of Information Science and Technology, Jinan University(暨南大学信息科学技术学院) University of Connecticut(康涅狄格大学) Guangzhou Maritime University(广州海事大学) University of Chinese Academy of Sciences(中国科学院大学) Global College, Shanghai Jiao Tong University(上海交通大学全球学院) Wuyi University(五邑大学) South China University of Technology(华南理工大学)

AI总结 本综述回顾2015至2025年动态环境下基于学习的运动规划代表性研究,提出学习作用分类法,分析相关影响因素,探讨安全可验证规划等开放挑战与未来方向。

详情

展开后加载摘要…

URL PDF HTML 收藏
2608.00613 2026-08-04 cs.RO 新提交

From Failures to Supervision: DynamicEnvPlan for Robust Long-Horizon Embodied Planning

从失败到监督:用于鲁棒长视距具身规划的DynamicEnvPlan

Hao Yuan, Yuxin Wang, Lei Ji, Zhiwei Yu

机构 * University of Chinese Academy of Sciences(中国科学院大学) Beijing Academy of Artificial Intelligence (BAAI)(北京人工智能研究院)

AI总结 该研究提出DynamicEnvPlan闭环框架,通过规划、扰动与防护校正模块生成恢复轨迹并分阶段微调,在104个任务-场景组合上使具身规划成功率从33.3%升至76.2%,提升了物理世界交互的鲁棒性。

详情

展开后加载摘要…

URL PDF HTML 收藏