AB
AiBoss
project

GPT-image-1 - OpenAIの最新画像生成モデル

GPT-image-1は、OpenAIがリリースしたネイティブなマルチモーダル画像生成モデルで、開発者はAPIを通じて利用できます。このモデルは、テキストプロンプトと画像に基づいて高品質でプロフェッショナルな画像を生成し、さまざまなスタイルとカスタマイズオプションをサポートしています。

GPT-image-1とは何ですか?

GPT-image-1は、OpenAIが開発したネイティブなマルチモーダル画像生成モデルで、開発者はAPIを通じて利用できます。このモデルは、テキストプロンプトと画像に基づいて高品質でプロフェッショナルな画像を生成し、画質、サイズ、フォーマット、圧縮レベルなど、さまざまなスタイルとカスタマイズオプションをサポートしています。スケッチをグラフィックに変換したり、製品ディスプレイ画像を生成したり、ブランドのビジュアルアセットを作成したりするなど、クリエイティブデザイン、eコマース、教育、マーケティングなど幅広い分野で活用されています。AdobeやFigmaといった主要なクリエイティブプラットフォームにも既に採用されています。

GPT-image-1の主な機能

  • テキストを画像に変換テキストの説明に基づいて画像を生成します。
  • 画像編集既存の画像を修正または部分的に編集する。
  • 画像バリエーション生成された画像の異なるバージョンまたはスタイルのバリエーション。
  • カスタマイズ機能
    • サイズ1024×1024、1024×1536など、複数の解像度に対応しています。
    • 品質レンダリング品質は、低、中、高の3種類から選択できます。
    • 形式PNG、JPEG、WebPなどのフォーマットに対応しています。
    • 圧縮JPEGおよびWebP形式の場合、圧縮レベルは0%から100%まで設定できます。
    • 背景透明または不透明な背景に対応しています。
  • APIアクセス開発者が画像生成機能を自身のアプリケーションやサービスに統合できるようにするためのAPIインターフェースを提供し、バッチ画像生成をサポートします。

GPT-image-1モデルの特徴

  • 非常に強力な命令遵守力複雑な指示を正確に理解し実行することで、生成される画像の精度を確保します。
  • 数多くの芸術様式多様なアートスタイルに対応し、さまざまな創作ニーズに適しています。
  • 精密な画像編集強力な画像編集機能を備えており、テキストプロンプトに基づいて画像を細かく調整できます。
  • 豊富な実世界の知識現実世界に関連した画像コンテンツを生成し、画像の信頼性と使いやすさを向上させる。
  • テキストの一貫性生成画像生成時にテキストコンテンツの一貫性と整合性を維持するため、教育教材、絵本、その他の用途に適しています。

GPT-image-1 製品価格

  • トークンを入力してください(プロンプトテキスト)100万トークンあたり5ドル
  • 画像入力トークン(入力画像)100万トークンあたり10ドル
  • 画像出力トークン(生成された画像)100万トークンあたり40ドル

GPT-image-1 のプロジェクトアドレス

GPT-image-1の使い方

  • 準備OpenAIに質問する公式サイトアカウントを登録してください。登録後、アカウントにログインしてAPIキーを取得してください。
  • OpenAI PythonライブラリをインストールしますPython環境に公式のOpenAIライブラリをインストールしてください。ターミナルまたはコマンドプロンプトを開き、以下のコマンドを実行します。
pip install openai
  • APIキーの設定:コード内でOpenAI APIキーを設定してください。キーをコード内に直接記述することを避けるため、環境変数に格納することをお勧めします。
import os
import openai

# 设置API密钥
openai.api_key = os.getenv("OPENAI_API_KEY")
  • イメージを呼び出してAPを生成するI:
    • 画像生成テキストプロンプトに基づいて画像を生成します。以下に簡単なサンプルコードを示します。
import openai
import base64

# 初始化OpenAI客户端
client = openai.OpenAI()
# 调用图像生成API
result = client.images.generate(
 model="gpt-image-1",
# 指定模型
 prompt="A futuristic cityscape at sunset with flying cars and neon lights",
# 文本提示
 size="1024x1024",
# 图像尺寸
 quality="high",
# 图像质量
 background="transparent"
# 背景设置为透明
)
# 获取生成的图像数据
image_base64 = result.data[0].b64_json
image_bytes = base64.b64decode(image_base64)
# 保存图像到本地文件
with
open("futuristic_cityscape.png",
"wb")
as f:
 f.write(image_bytes)
    • 画像編集既存の画像を編集します。以下にサンプルコードを示します。
import openai

# 初始化OpenAI客户端
client = openai.OpenAI()
# 调用图像编辑API
result = client.images.edit(
 model="gpt-image-1",
# 指定模型
 image=open("input_image.png",
"rb"),
# 上传需要编辑的图像
 mask=open("mask.png",
"rb"),
# 上传蒙版图像
 prompt="Replace the sky with a starry night",
# 编辑提示
 size="1024x1024",
# 图像尺寸
 quality="high"
# 图像质量
)
# 获取生成的图像数据
image_base64 = result.data[0].b64_json
image_bytes = base64.b64decode(image_base64)
# 保存编辑后的图像到本地文件
with
open("edited_image.png",
"wb")
as f:
 f.write(image_bytes)
    • 参照画像を使用して新しい画像を生成する:複数の参照画像をアップロードして、新しい画像を生成します。以下にサンプルコードを示します。
import openai

# 初始化OpenAI客户端
client = openai.OpenAI()
# 调用参考图像生成API
result = client.images.edit(
 model="gpt-image-1",
# 指定模型
 image=[
open("body-lotion.png",
"rb"),
open("bath-bomb.png",
"rb"),
open("incense-kit.png",
"rb"),
open("soap.png",
"rb"),
],
# 上传参考图像
 prompt="Generate a photorealistic image of a gift basket on a white background labeled 'Relax & Unwind' with a ribbon and handwriting-like font, containing all the items in the reference pictures",
# 生成提示
 size="1024x1024",
# 图像尺寸
 quality="high"
# 图像质量
)
# 获取生成的图像数据
image_base64 = result.data[0].b64_json
image_bytes = base64.b64decode(image_base64)
# 保存生成的图像到本地文件
with
open("gift_basket.png",
"wb")
as f:
 f.write(image_bytes)

GPT-image-1の応用事例

  • AdobeFireflyおよびExpressアプリと統合され、さまざまな画像スタイルを提供します。
  • Figma簡単な指示に基づいて画像を生成・編集することで、デザイナーがアイデアを素早く得るのに役立ちます。
  • HeyGenアバターの作成および編集機能が強化されました。
  • Wixユーザーがアイデアを迅速に実現できるよう支援します。
  • Photoroomオンライン販売者が商品写真を基にスタジオ品質のビジュアルを作成するのに役立ちます。

GPT-image-1の応用シナリオ

  • クリエイティブデザインスケッチを高品質なグラフィック要素に素早く変換し、高精細なビジュアル編集をサポートします。
  • Eコマースとマーケティング商品の陳列画像、マーケティングポスター、ソーシャルメディア用画像を作成し、視覚的な魅力を高めます。
  • ブランドデザイン編集可能なロゴ、ブランドビジュアルアセット、プロフェッショナルなタイポグラフィを作成します。
  • 動画制作高品質なアバターやアニメーション効果を生成するための、強化されたビデオ編集機能。
  • 教育とコンテンツ制作教育と創作活動を支援するための教材イラストやクリエイティブコンテンツを作成する。