一种通过逐步去噪生成图片等内容的生成模型。
扩散模型像把电视雪花屏倒着擦,一点点擦成能发朋友圈的图。
它常用于文生图、修图和视频生成,效果惊艳但细节可能乱编。
Multimodal AIMultimodal 生成视觉内容时,常依赖 Diffusion 路线。
PromptPrompt 为 Diffusion 指定生成方向和条件约束。
Neural-networkNeural-network 负责 Diffusion 中的噪声预测过程。