计算机视觉难度 ★★★★☆
扩散模型
先把图像"变模糊"加噪声,再学怎么"去模糊"——学会了就能从纯噪声生成新图像
分享:
📖 详细解释
🎯 一句话定义
先把图像"变模糊"加噪声,再学怎么"去模糊"——学会了就能从纯噪声生成新图像
⚙️ 工作原理
前向过程:逐步给图像加高斯噪声直到变成纯噪声。反向过程:训练网络预测噪声,逐步从纯噪声中去噪生成图像。Stable Diffusion、DALL·E、Midjourney都用扩散模型
💡 生活类比
"像雕石像:先有一块石头(随机噪声),然后一凿一凿地去掉多余部分(去噪),最后雕出精美的雕像"
🌍 真实应用
Midjourney、Stable Diffusion、DALL·E 3这些文生图工具,背后都是扩散模型——现在AIGC的主流技术