S
Stable Diffusion
NEWStabilityAIがテキストから画像を生成するAIを発表
フリーミアムAI图像工具
Stable Diffusion 是什么
Stable Diffusion 是由 Stability AI 联合多家研究机构开发的开源深度学习文本到图像生成模型。与许多受限的闭源 AI 工具不同,它不仅支持云端运行,更允许用户将其免费下载并部署在本地个人电脑上,通过微调、LoRA、ControlNet 等丰富插件实现高度定制化的图像创作,是目前全球开源 AI 绘画生态的核心基石。
适合谁
- 原画师与视觉设计师:需要精准控制人物姿态、画面构图、色彩分布并进行高频次迭代的专业视觉创作者。
- 独立游戏与动漫开发者:希望快速生成角色原画、场景资产、UI 道具,且预算和设备条件允许的开发团队。
- AI 绘画发烧友与技术极客:乐于探索本地部署、模型微调、工作流定制(如使用 ComfyUI 搭建复杂管道)的技术型玩家。
能不能用、怎么用(访问指南)
- 访问地址:官方发布渠道为 Stability AI 官网(stability.ai),开源代码与模型权重主要托管在 GitHub 和 Hugging Face 平台。普通用户亦可通过 DreamStudio 或各类第三方 WebUI 工具(如 Automatic1111、ComfyUI)进行访问和使用。
- 地区可用性:作为开源模型本身,全球用户均可自由下载并在本地运行,无地区屏蔽。但若需访问 Hugging Face 等模型托管平台或使用 Stability AI 官方的在线云服务(如 Clipdrop),中国大陆地区用户通常需要特定的网络环境支持。
- 注册:本地部署和运行完全无需注册,即开即用;若使用官方在线服务 DreamStudio 或 Hugging Face 线上空间,通常需要使用邮箱、Google 或 Discord 账号进行注册登录。
- 费用:本地部署完全免费,但对个人电脑硬件(尤其是显卡)有较高要求,推荐使用 8GB 或以上显存的 NVIDIA 显卡。若使用官方云端 API 或在线生成服务,通常采用积分制或订阅制,会产生相应的生成费用。
- 语言:主流的本地 WebUI 界面默认为英文,但支持通过安装第三方插件实现中文界面。提示词(Prompts)输入通常以英文为主,对中文提示词的直接理解能力较弱,建议配合翻译工具或使用专门的中文微调模型。
跨生态对比:Stable Diffusion vs 同类
| 维度 | Stable Diffusion | Midjourney (欧美代表) | 文心一格 (中国代表) |
|---|---|---|---|
| 部署与访问 | 支持本地部署或云端 API,自由度极高 | 基于 Discord 社区,完全在云端运行 | 网页端直接访问,无需任何配置 |
| 控制与定制性 | 极高(可自由更换模型、使用 ControlNet 控制姿态、训练 LoRA) | 中等(依赖提示词微调,无法精细控制局部细节) | 较低(以预设风格和中文提示词生成为主) |
| 硬件门槛 | 高(本地运行需中高端独立显卡,显存推荐 8GB+) | 无(只要能运行 Discord 即可,由云端服务器渲染) | 无(纯网页端操作,对本地硬件无要求) |
| 费用模式 | 开源免费(本地运行仅消耗电费);云端服务按需付费 | 纯付费订阅制(通常每月 10 美元起) | 点数消耗制(注册送免费额度,后续可充值购买) |
| 中文支持度 | 一般(本地版需安装汉化插件,提示词建议使用英文) | 一般(虽然支持中文输入,但英文提示词效果更佳) | 极佳(原生支持中文,对中国传统文化、诗词理解深刻) |
选择建议:如果您拥有配置较好的显卡,追求极致的画面控制力、隐私性,并且愿意折腾技术,Stable Diffusion 是不二之选;如果您追求开箱即用、电影级的艺术审美且预算充足,推荐选择 Midjourney;如果您更习惯中文语境,主要生成国风、国潮等特定题材且不想配置复杂环境,文心一格 会是更便捷的起点。