arXivDaily arXiv每日学术速递 周一至周五更新

视觉与机器人

图像生成

图像生成、文生图、图像编辑、扩散模型和可控生成。

2026-05-01 至 2026-05-01 共收录 3 信号源:cs.CV, cs.GR, cs.MM

1. 可控生成 3 篇

2604.28169 2026-05-01 cs.CV cs.AI cs.LG 57%

PhyCo: Learning Controllable Physical Priors for Generative Motion

PhyCo:学习可控制的物理先验以生成运动

Sriram Narayanan, Ziyu Jiang, Srinivasa Narasimhan, Manmohan Chandraker

机构 * Carnegie Mellon University(卡内基梅隆大学) NEC Labs America(NEC美国实验室) UC San Diego(圣地亚哥大学)

专题命中 可控生成 :diffusion(abstract);分类 cs.CV

AI总结 PhyCo通过整合物理可控的生成模型,实现了在视频生成中物理一致性和可控性的提升,无需模拟器或几何重建。

Comments CVPR 2026. Project Page: https://phyco-video.github.io/

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27700 2026-05-01 q-fin.MF 50%

Data-Driven Stochastic Optimal Control for Intraday Electricity Trading by Renewable Producers

数据驱动的随机最优控制用于日内电力交易:可再生能源生产者

Chiheb Ben Hammouda, Michael Samet, Raúl Tempone

专题命中 可控生成 :diffusion(abstract)

AI总结 本文提出了一种数据驱动的连续时间随机最优控制框架,用于可再生能源生产者的日内电力交易,通过随机微分方程和跳跃扩散模型来应对市场波动和不平衡惩罚风险。

详情

展开后加载摘要…

URL PDF HTML 收藏
2604.27002 2026-05-01 cs.CR 50%

Membership Inference Attacks Against Video Large Language Models

针对视频大语言模型的成员推断攻击

Wei Song, Yuxin Cao, Ziqi Ding, Yi Liu, Gelei Deng, Yuekang Li

专题命中 可控生成 :image generation(abstract)

AI总结 本文研究了针对视频大语言模型的黑盒成员推断攻击,通过温度扰动生成与视频感知难度特征结合,验证了视频大语言模型对隐私风险的脆弱性。

详情

展开后加载摘要…

URL PDF HTML 收藏