AI 绘画爆火:Diffusion 与 Midjourney、Stable Diffusion

2022 年之前,让电脑画一张"穿汉服的宇航员"几乎不可能。现在你打一行字,10 秒出图。背后最关键的技术叫扩散模型(Diffusion)

一、扩散模型在干嘛

想象一张白噪音电视雪花屏,模型一步步把它"去噪",慢慢显现出一幅画。训练时,工程师先把清晰图逐步加噪变成雪花,再教模型逆着做——从雪花还原图画。

你输入"穿汉服的宇航员",模型并不是"画"出来的,而是从一堆噪点里,按你的描述一步步把不该有的噪点去掉,最后剩下符合描述的画面。这也是为什么 AI 图常有诡异手指——去噪过程是概率性的,细节容易翻车。

二、三大主流工具怎么选

  • Midjourney:上手最简单,进 Discord 打 /imagine 就行,出图审美高、适合概念设计。缺点是闭源、要订阅、不能本地跑。
  • Stable Diffusion(SD):开源,能装在自己电脑上,可换模型、加插件(ControlNet 控姿势、LoRA 学风格),自由度最高,但需要一点折腾。
  • DALL·E / 各家内置:ChatGPT、Gemini 里的生图,胜在"边聊边改",适合随手用。

三、新手避坑

  1. 提示词顺序有讲究:主体 → 环境 → 风格 → 画质词(如 “8k, highly detailed”)。
  2. 别指望一次出神图:多生几张挑,再用"垫图/局部重绘"精修。
  3. 版权要看清:商用前确认平台授权,SD 开源模型相对自由,MJ 订阅协议需细看。

四、它能帮你做什么

海报初稿、小说插图、电商主图、头像、灵感板——AI 绘画不是取代画师,是让"人人都能先把脑子里的画面亮出来"。


下一篇说更实用的:AI 怎么帮你写代码。