arXivDaily arXiv每日学术速递 周一至周五更新

高校专区

University of Chinese Academy of Sciences(中国科学院大学)

2026-07-02 至 2026-07-02 共收录 6
2605.01896 2026-07-02 cs.CV 版本更新

Divide and Conquer: Decoupled Representation Alignment for Multimodal World Models

分而治之:多模态世界模型的解耦表示对齐

Junyuan Xiao, Dingkang Liang, Xin Zhou, Yixuan Ye, Tongtong Su, Guangmo Yi, Bin Xia, Qiang Lyu, Shurui Shi, Jun Huang, Jianlou Si, Wenming Yang

机构 * Tsinghua University(清华大学) Huazhong University of Science and Technology(华中科技大学) CSU(中南大学) ZJU(浙江大学) CUHK(香港中文大学) UCAS(中国科学院大学) Alibaba Group(阿里巴巴集团)

AI总结 提出M²-REPA方法,通过解耦扩散模型中间表示中的模态特定特征并与对应的专家基础模型对齐,实现多模态视频生成中多种基础模型先验的充分利用,显著提升视觉质量和长期一致性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00995 2026-07-02 stat.ML cs.LG 交叉投稿

Deep Multitask Learning for Mixed-Type Outcomes with Shared Sparsity

混合类型结果的深度多任务学习与共享稀疏性

Huichao Li, Tong Wang, Sanguo Zhang, Shuangge Ma

机构 * School of Mathematical Sciences, University of Chinese Academy of Sciences(中国科学院大学数学科学学院) School of Statistics and Data Science, Southeast University(东南大学统计与数据科学学院) Key Laboratory of Big Data Mining and Knowledge Management, Chinese Academy of Sciences(中国科学院大数据挖掘与知识管理重点实验室) Department of Biostatistics, Yale School of Public Health(耶鲁大学公共卫生学院生物统计学系)

AI总结 提出多任务变换框架,通过共享第一层的深度神经网络和组Lasso惩罚优化平滑秩准则,实现混合类型结果的预测和变量选择,并建立了非渐近超额风险界和变量选择一致性。

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00494 2026-07-02 cs.CV 新提交

HieDG: A Hierarchical Discrete Geometry-Guided Framework for Multi-Animal Tracking

HieDG: 一种用于多动物跟踪的层次化离散几何引导框架

Chenxun Deng, Zhongde Zhang, Ye Yuan, Chengyang Zhang, Yifan Zhang, Bohao Chen, Hongying Yan, Hang Zhou, Hua Han, Xi Chen

机构 * State Key Laboratory of Brain Cognition and Brain-inspired Intelligence Technology, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所脑认知与脑启发智能技术国家重点实验室) School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) School of Technology, Beijing Forestry University(北京林业大学工学院) School of Advanced Interdisciplinary Sciences, University of Chinese Academy of Sciences(中国科学院大学前沿交叉科学学院) College of Computer Science, Sichuan University(四川大学计算机学院) C²DL, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所C²DL) School of Automation, Chongqing University(重庆大学自动化学院) Faculty of Life and Health Sciences, Shenzhen University of Advanced Technology(深圳理工大学生命健康学院) School of Future Technology, University of Chinese Academy of Sciences(中国科学院大学未来技术学院)

AI总结 针对多动物跟踪中外观相似、密度高和运动不规则导致的身份关联困难,提出HieDG框架,通过两级残差码本将连续几何信号离散化为结构化令牌,与视觉嵌入对齐并集成到查询中,显著提升身份一致性。

Comments Accepted to ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏
2607.00009 2026-07-02 cs.CL cs.AI 新提交

Controllable Narrative Rendering for Enhanced Assisted Writing

可控叙事渲染以增强辅助写作

Mingzhe Lu, Yanbing Liu, Jiayue Wu, Jiarui Zhang, Qihao Wang, Yue Hu, Yunpeng Li, Yangyan Xu

机构 * Institute of Information Engineering, Chinese Academy of Sciences(中国科学院信息工程研究所) School of Cyber Security, University of Chinese Academy of Sciences(中国科学院大学网络空间安全学院) HiThink Research(海天瑞声)

AI总结 针对大语言模型在创意写作中安全编辑与无控制情节扩展的二元失败问题,提出基于叙事学故事/话语区分的Loom框架,通过三层流水线和意图中心符号链实现叙事意图与渲染密度的精确控制,在保持事实完整性的同时提升描述强度。

详情

展开后加载摘要…

URL PDF HTML 收藏
2510.27285 2026-07-02 cs.CV cs.CR 版本更新

Rethinking Robust Adversarial Concept Erasure in Diffusion Models

重新思考扩散模型中的鲁棒对抗性概念擦除

Qinghong Yin, Yu Tian, Heming Yang, Xiang Chen, Xianlin Zhang, Yue Ming, Xueming Li, Yue Zhang

机构 * Beijing University of Posts and Telecommunications(北京邮电大学) Dept. of Comp. Sci. and Tech., Institute for AI, Tsinghua University(计算机科学与技术系,人工智能研究院,清华大学) University of Chinese Academy of Sciences(中国科学院大学) Nanjing University of Aeronautics and Astronautics(南京航空航天大学)

AI总结 针对扩散模型中概念擦除的对抗训练忽视概念语义导致拟合不足的问题,提出语义引导的鲁棒对抗概念擦除方法S-GRACE,显著提升擦除性能26%并减少90%训练时间。

详情

展开后加载摘要…

URL PDF HTML 收藏
2411.11925 2026-07-02 cs.CV 版本更新

Continuous Speculative Decoding for Autoregressive Image Generation

连续推测解码用于自回归图像生成

Zili Wang, Zheng Zhang, Kun Ding, Qi Yang, Fei Li, Shiming Xiang

机构 * School of Artificial Intelligence, University of Chinese Academy of Sciences(中国科学院大学人工智能学院) MAIS, Institute of Automation, Chinese Academy of Sciences(中国科学院自动化研究所多模态人工智能系统实验室) JD.COM Inc(京东集团股份有限公司) China Tower Corporation Limited(中国铁塔股份有限公司)

AI总结 提出连续推测解码方法,通过近似准则、去噪轨迹对齐和接受-拒绝采样,加速连续视觉自回归模型,实现2倍以上加速且保持生成质量。

Comments ECCV 2026

详情

展开后加载摘要…

URL PDF HTML 收藏