AB
AiBoss站
教程

DALL·E 3

教程

DALL·E 3 入门教程:用自然语言生成图片的完整流程

DALL·E 3 是 OpenAI 推出的文生图模型,最大特点是无需钻研提示词技巧,用日常语言描述想法即可出图。本教程梳理可用的使用入口、开通与申请流程、逐步操作方法与一个完整示例,并说明额度、审核、出图数量等已知限制,适合刚接触 AI 绘画的读者按步骤上手。

DALL·E 3 是 OpenAI 推出的文生图模型。与 Midjourney、Stable Diffusion 这类需要专门学习提示词写法的工具相比,它最大的不同在于:用户不必掌握一套提示词语法,直接用自然语言把想法说出来就行。模型会自行把你的描述整理成提示词,再据此生成图片。对于刚接触 AI 绘画、还没建立起提示词直觉的人来说,这个门槛低得多。本教程面向第一次使用 DALL·E 3 的读者,讲清它有哪些使用入口、各自需要什么前置条件、具体怎么一步步操作,以及过程中容易踩到的坑。如果你希望先看看站内整理的相关工具信息,可以访问 DALL·E 3。

准备工作

在动手之前,需要先确认自己走哪条路径。DALL·E 3 的可用入口不止一个,不同入口对账号的要求差别很大,准备工作的重点也因此不同。

路径一:通过 ChatGPT 使用

这条路径要求你拥有 ChatGPT 的付费订阅身份。按素材所述,DALL·E 3 当时仅对 ChatGPT Plus 用户以及企业用户开放使用功能。也就是说,免费账号在这一入口下是拿不到 DALL·E 3 能力的。

除了订阅身份,还需要额外提交一次申请,功能才会在 ChatGPT 界面中显示出来。这一点容易被忽略:很多人以为订阅了 Plus 就自动能用,实际上还要走申请流程。申请时需要准备两项信息:

  • Discord 用户名:申请表中需要填写。
  • ChatGPT 账户邮箱:即你登录 ChatGPT 所用的邮箱。

如果你还没有 Discord 账户,需要先去 Discord 官网注册一个。注册过程很快,不复杂。建议在填申请表之前就把 Discord 账号准备好,避免填到一半卡住。

提交申请后,按素材的说法,大约一两个小时就能审核通过。这个时间仅供参考,实际快慢取决于当时的申请量,以你收到的实际结果为准。

路径二:通过 New Bing 使用

如果你没有升级 ChatGPT Plus,可以走这条路径。按素材所述,在 New Bing 中可以免费体验 DALL·E 3 的文生图功能。这条路径不需要付费订阅,也不需要提交申请,准备工作基本只剩下一个可正常访问的浏览器。

需要说明的是,各入口的开放范围、是否需要订阅、是否免费,都属于会随时间变化的政策。动手前请以 OpenAI 及相应平台的官网当前信息为准,不要以本教程的描述作为长期依据。

操作步骤

下面按入口分别说明操作流程。你可以只挑自己走得通的那一条看。

在 ChatGPT 中使用 DALL·E 3

  1. 确认订阅身份。登录你的 ChatGPT 账号,确认当前是 Plus 或企业用户身份。免费账号无法在这一入口使用 DALL·E 3。
  2. 准备 Discord 账号。如果还没有,先去 Discord 官网注册。记下你的 Discord 用户名,后面填表要用。
  3. 提交开通申请。打开申请页面,在申请表中填写你的 Discord 用户名和 ChatGPT 账户邮箱,然后提交。
  4. 等待审核。按素材描述,审核大约一两个小时出结果。等待期间不需要重复提交。
  5. 确认功能已出现。申请通过之后,在 GPT-4 模式下会多出一个 DALL·E 3 的选项。
  6. 勾选并开始生成。把这个选项勾选上,就可以在对话里用自然语言描述你想要的画面,让模型出图了。

整个流程里,第 3 步和第 5 步是最容易出问题的环节:前者漏填信息会导致审核不通过,后者如果没看到选项,通常说明申请还没通过或者身份不对。

在 New Bing 中使用 DALL·E 3

  1. 打开图像创建页面。在浏览器中访问 Bing 的图像创建(Image Creator)页面。
  2. 输入提示词或想法。在输入框中写下你想要的画面。可以是一句完整的描述,也可以只是一个粗略的想法,不必套用任何提示词模板。
  3. 点击「创建」按钮。提交后系统开始作画。
  4. 查看结果并保存。出图后可以直接查看,需要留存时使用页面上的下载按钮保存图片。

这条路径的操作只有四步,比 ChatGPT 那条简单得多,适合想先快速试一下效果的人。

关于额度不足时的表现

在 New Bing 这条路径上,有一个行为值得提前知道:当额度不够时,你仍然可以继续作画,只是出图的速度会比额度充足时慢一些。也就是说,额度耗尽不等于功能被锁死,只是体验下降。这一点在素材中有明确说明。

一个完整示例

下面用一个具体例子把流程串起来,方便你照着走一遍。

目标:把北京的地标建筑「中国尊」与青花瓷的元素融合在一张图里。

第一步,写下想法。不需要描绘具体画面,也不需要研究任何提示词技巧,直接把想法说出来即可,例如:

将北京的「中国尊」融入青花瓷的元素

第二步,提交生成。在 ChatGPT 中勾选 DALL·E 3 选项后发送这句话;在 New Bing 中则把这句话填进输入框,点击「创建」。

第三步,查看返回结果。按素材描述,这一次会生成 4 张图片。这里有一个很实际的现象值得注意:4 张图里,图 1、图 2、图 4 虽然融入了青花瓷的元素,但完全没有「中国尊」的影子;只有图 3 同时出现了「中国尊」并融入了青花瓷元素,效果尚可。

第四步,挑选并下载。从 4 张里挑出符合预期的那一张,点击下载按钮保存图片。

这个例子说明了两件事。第一,用自然语言描述确实能出图,不需要提示词功底。第二,一次生成多张、结果质量参差是常态,需要你自己筛选,而不是期待每张都可用。如果 4 张都不满意,可以调整描述再生成一轮。

注意事项

以下几点来自素材中的明确说明,动手前值得先看一遍。

  • ChatGPT 入口需要付费身份加申请两道门槛。仅对 ChatGPT Plus 用户以及企业用户开放,且必须提交申请后功能才会显示。订阅本身不等于自动开通。
  • 申请要填对两项信息。Discord 用户名和 ChatGPT 账户邮箱缺一不可。没有 Discord 账号要先注册。
  • 审核需要等待。按素材描述大约一两个小时,实际时长以你收到的结果为准,不要因为短时间没通过就反复提交。
  • 功能出现的位置在 GPT-4 下。申请通过后,DALL·E 3 会作为 GPT-4 下的一个选项出现,需要手动勾选。
  • New Bing 路径可以免费体验。没有升级 Plus 的用户可以走这条路径。
  • 额度不足仍可作画。只是出图速度会变慢,功能不会因此完全不可用。
  • 一次生成多张,质量不保证一致。示例中 4 张图只有 1 张同时满足两个元素要求,筛选是必要环节。
  • 自然语言描述降低了门槛,但不等于结果可控。模型会自行把你的想法转成提示词,你无法精确控制它如何理解。
  • 价格、配额、开放范围会变。本教程涉及的订阅要求、免费额度、审核时长等都属于易变信息,请以 OpenAI 及相关平台的官网当前信息为准。

把上面这些串起来看,DALL·E 3 的使用路径其实很短:确认自己走 ChatGPT 还是 New Bing,按对应流程开通或直接进入,然后用一句自然语言描述提交,从返回的多张图里挑出可用的下载。真正需要花心思的地方不在操作,而在于接受「多张里挑一张」这个常态,并把描述写得足够具体,让模型更容易抓住你真正想要的那个元素。