arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-07-08 至 2026-07-08 共收录 92 信号源:cs.CV, cs.GR, cs.MM

1. 效率与蒸馏 9 篇

2607.04244 2026-07-08 cs.LG 新提交 50%

Quantize the Target, Quantize the Drafter: Efficient Inference with Qwen3.5-4B

量化目标,量化草稿生成器:使用Qwen3.5 - 4B进行高效推理

Jaeyeon Kim, Jewon Lee, Bo-Kyeong Kim

机构 * Nota Inc.(Nota公司)

专题命中 效率与蒸馏 :diffusion(abstract)

AI总结 研究旨在在资源受限的NVIDIA A10G GPU上实现Qwen3.5 - 4B的低延迟服务。核心方法是结合量化目标模型与推测性解码,通过量化感知蒸馏恢复精度,训练专用草稿生成器加速解码,还用量化等减少开销。贡献是实现加速并满足质量阈值,排名第三。

Comments All authors contributed equally. Our submission to Efficient Qwen Competition, ICML 2026 Workshop on AdaptFM

详情

展开后加载摘要…

URL PDF HTML 收藏

2. 其他图像生成 1 篇

2503.13212 2026-07-08 cs.LG 版本更新 50%

MAME: Multidimensional Adaptive Metamer Exploration with Human Perceptual Feedback

MAME:基于人类感知反馈的多维自适应同态体探索

Mina Kamao, Hayato Ono, Ayumu Yamashita, Kaoru Amano, Masataka Sawayama

机构 * Graduate School of Information Science and Technology(信息科学与技术研究生学校) The University of Tokyo(东京大学) Graduate School of System Informatics(系统信息科学研究生学校) Kobe University(大阪大学) Hokkaido University(北海道大学) Prometech CG Research(Prometech CG研究所)

专题命中 其他图像生成 :image generation(abstract)

AI总结 该研究针对人脑网络与人工模型对齐问题,提出MAME框架,通过人类感知反馈引导在线图像生成,在单个心理物理实验中成功测量多维人类同态体空间,发现人类与CNN模型在低级处理同态体空间对齐较差,强调早期视觉计算重要性,为研究人类视觉功能提供工具。

Comments 26 pages, 12 figures. Accepted at Journal of Vision

Journal ref Journal of Vision, 26(8):1, 1-14, 2026

详情

展开后加载摘要…

URL PDF HTML 收藏