AI 绘画爆火:Diffusion 与 Midjourney、Stable Diffusion
2022 年之前,让电脑画一张"穿汉服的宇航员"几乎不可能。现在你打一行字,10 秒出图。背后最关键的技术叫扩散模型(Diffusion)。
一、扩散模型在干嘛
想象一张白噪音电视雪花屏,模型一步步把它"去噪",慢慢显现出一幅画。训练时,工程师先把清晰图逐步加噪变成雪花,再教模型逆着做——从雪花还原图画。
你输入"穿汉服的宇航员",模型并不是"画"出来的,而是从一堆噪点里,按你的描述一步步把不该有的噪点去掉,最后剩下符合描述的画面。这也是为什么 AI 图常有诡异手指——去噪过程是概率性的,细节容易翻车。
二、三大主流工具怎么选
- Midjourney:上手最简单,进 Discord 打
/imagine就行,出图审美高、适合概念设计。缺点是闭源、要订阅、不能本地跑。 - Stable Diffusion(SD):开源,能装在自己电脑上,可换模型、加插件(ControlNet 控姿势、LoRA 学风格),自由度最高,但需要一点折腾。
- DALL·E / 各家内置:ChatGPT、Gemini 里的生图,胜在"边聊边改",适合随手用。
三、新手避坑
- 提示词顺序有讲究:主体 → 环境 → 风格 → 画质词(如 “8k, highly detailed”)。
- 别指望一次出神图:多生几张挑,再用"垫图/局部重绘"精修。
- 版权要看清:商用前确认平台授权,SD 开源模型相对自由,MJ 订阅协议需细看。
四、它能帮你做什么
海报初稿、小说插图、电商主图、头像、灵感板——AI 绘画不是取代画师,是让"人人都能先把脑子里的画面亮出来"。
下一篇说更实用的:AI 怎么帮你写代码。