AB
AiBoss
チュートリアル

オンラインで最も包括的なナノバナナのチュートリアル。4つの無料使用方法も含まれています。

Googleが新たにリリースしたAI画像生成モデル、Google Gemini 2.5 Flash Image(Nano Banana)は、その安定性と驚異的な画像生成速度により、様々なプラットフォームで圧倒的な存在感を示し続けています。この記事では、Nano Bananaについて解説します。

グーグル最新のリリース済みAI画像生成モデル Google Gemini 2.5 Flash Image(ナノバナナ)は、その安定性と驚異的な画像生成速度で、様々なプラットフォームで圧倒的な存在感を示し続けています。

グループメンバーからは毎日、「K姉さん、ナノバナナの使い方を早く教えてください!すごいですよ!」といった更新を求めるリクエストが寄せられています。

この記事ではNano Bananaについて解説します。内容は主に3つの部分から構成されています。Nano Bananaコアチームによる技術的な説明、Nano Bananaの様々な活用方法、そして…無料ナノバナナの5つの活用法。

ご意見やご感想は、コメント欄にお気軽にお寄せください!

先日公開されたリリースノートのインタビューで、Nano Bananaチームの中核メンバー4名をお招きし、Nano Bananaの主要機能を支える技術についてより深く理解するお手伝いをいただきました。

ネイティブイメージ生成

Nano Bananaの核となる画期的な技術は、ネイティブな画像生成であり、生成プロセス中にコンテキストを継続的に参照することで、複雑なタスクを段階的に完了させていく。

従来のテキストベースの画像ツールとは異なり、Imagenは単一分野のエキスパートのような存在である一方、Nano Bananaは様々なモダリティに対応し、複雑なインタラクションをサポートできる万能ツールである。

これはチームの今後の発展の方向性にもなるだろう。将来のモデルは、単に美しく描かれているだけでなく、より高度な理解力と推論能力を備えているべきだ。

キャラクターとシーンの一貫性

Nano Bananaのもう一つの特長は、その安定性です。以前のモデルでは、画像編集時にクラッシュすることがよくありました。例えば、カーテンだけを変更しようとしたのに、ベッドやソファまで変わってしまったり、人物画像の角度を変えただけで顔が変わってしまったりといった具合です。

チームは現場で事例研究を実演し、ホストの顔のクローズアップ画像を使って、巨大なバナナの着ぐるみを着たホストの全身画像を生成する様子を示した。

prompt:zoom out and show him wearing a giant banana costume.keep his face visble.

プロンプトワード彼が巨大なバナナの着ぐるみを着ている様子が映るように、画面をズームアウトしてください。彼の顔がはっきりと見えるようにしてください。

Nano Bananaは優れた一貫性を維持しています。顔は同じままですが、背景や服装は完全に変わっていても、画像は非常に自然に見えます。生成プロセス全体は約10秒で完了します。

もう一つの詳細は、Gemini 弊社チームとImagenチームの連携により、より自然な仕上がりの画像が実現しました。以前は、画像が「貼り付けた」ように見えることがありましたが、今では全体的に統一感のある効果が得られます。

テキストレンダリング

多くの人は「画像に数文字を書き込む」ことは大したことではないと思うかもしれないが、Nano Bananaはテキストレンダリングを長期的な重要な指標と考えている。彼らは、テキストは構造化されたコンテンツであり、モデルがテキストの処理方法を学習できれば、画像内のテクスチャなど、より複雑な構造も理解できると考えている。

現在、ナノバナナはいくつかの用途に適しています...単純テキストのレンダリング効果は非常に優れているが、いくつかの欠点もある。

prompt:now write"Gemini nano"on the image.

プロンプトワード写真に「」と書いてくださいGemini nano”

数年前までは、ごく短いテキストでさえもうまく処理できるモデルはほとんどなかった。プロンプトワード頻繁にクラッシュが発生したため、Nano Bananaチームはこの指標を長期的に追跡することにしました。実施する実験内容に関わらず、継続的な監視によってパフォーマンスの低下を防ぐことができると考えたのです。その結果、一見無関係に見える多くの変更がテキストレンダリングの改善にもつながることを発見しました。

チームは実際には「モデルの欠点を見つけること」から始め、徐々に全体的な品質向上につながる道筋を探っていった。

理解力と創造性

ナノバナナは世界規模の知識を持ち、曖昧な指示も理解でき、さらには創造性を発揮することもできる。

チームはインタビューの中で、興味深い概念である「報告バイアス」について言及した。例えば、友人の家を訪れた際、後で他の人と話すときに、その家にあるごく普通のソファについて触れることはほとんどない。しかし、写真を見せれば、必ずそのソファが写っているはずだ。

したがって、世界を真に理解するためには、テキストによる詳細な説明が必要となる場合がある一方、視覚的な信号は世界を理解するための近道のようなもので、追加の説明を必要とせずに環境、物体、およびそれらの関係性を直接示すことができる。

理解と生成は相互補完的な関係にある。モデルが画像や言語を解釈するにつれて、世界に対する理解がより深まり、より安定した自然なコンテンツが生成される。時には、ユーザーの期待を超えるコンテンツを生成することさえある。

から人気のある単一画像、複数画像、動画生成など、様々なゲームプレイオプションを提供しています。ぜひご意見・ご提案をお寄せください!

人気のあるゲームプレイ

1. どんな画像でもフィギュアに変換します。

prompt:turn this photo into a character figure. Behind it, place a box with the character’s image printed on it, and a computer showing the Blender modeling process on its screen. In front of the box, add a round plastic base with the character figure standing on.

この写真をキャラクターに変換してください。キャラクターの背後に、キャラクターの画像を印刷した箱を置き、箱の上にあるコンピュータ画面にその画像を表示してください。Blenderモデリング工程。箱の前面に円形のプラスチック製の台座を取り付け、その上にキャラクターを立たせる。

2. 地図に基づいて実際の風景を描きなさい。

prompt:draw what the red arrow sees.

プロンプトワード赤い矢印が指している箇所を描いてください。

Draw a DEM with contour lines.

draw the real world view from the red circle in the direction of the arrow.

輪郭線で描くデジタル立面図

赤い円から矢印の方向に向かって、実際の風景を描いてください。

上記の事例研究はブロガーX(@Simon)によるものです。

3. アニメが現実になる

prompt:Depict as a live big budget costume test on set, shot on film.

Variant Prompt: For easier additional editing.Depict as a live big budget costume test on set, shot on film against green screen.

これは、フィルムで撮影された、撮影現場で行われる高額な衣装合わせの様子を描いた映像である。

別のヒント:編集作業を容易にするために、撮影現場でグリーンスクリーンを背景にフィルムを使って撮影された、高額な予算をかけた衣装テストとして描写すると良いでしょう。

上記の事例研究は、ブロガーの@Brent Lynch氏によるものです。

4. 360度製品展示

prompt:This exact car in this exact environment.

Change Perspective: Perfect side angle view.

この車とその正確な周辺環境。

視点を変える:完璧な横からの眺め

異なる視点から画像を生成した後、Keling 2.1を使用して、最初のフレームと最後のフレームからビデオを生成します。

上記の事例研究は、ブロガーX(@Rory Flynn)によるものです。

5. 古い写真の修復

prompt:Restore and colorize the picture without altering, removing, or adding any detail or element.

プロンプトワード画像の色を復元しますが、詳細や要素を変更、削除、または追加しないでください。

上記の事例研究は、ブロガーの@Rodrigo Bressane氏によるものです。

6. 等角投影3Dビュー

設計図面を3Dビューに変換します。

上記のケーススタディは、ブロガーX(@levelsio)によるものです。

2D図面から3Dモデルへの変換は非常に印象的です。しかし、現在のフィードバックによると、生成された画像は十分な精度を備えていないようです。例えば、画像がややぼやけていたり、ウィンドウの位置が不正確だったりします。

7. 視点を変える

prompt:aerial perspective of a camera behind the blurry ceiling fan looking down at the girl sitting in an hospital waiting room.

病院の待合室に座っている少女を、天井の扇風機の後ろからカメラで撮影した、俯瞰的な視点からの写真。

単一画像編集

プロンプトワード画像内のテキストを「ジェミニ、神様に聞いてみたらどう?」に変更してください。

プロンプトワードキャラクターの服をダウンジャケットに変更してください。

3. キャラクター生成シナリオを参照してください。

プロンプトワードこの画像は、スポンジ・ボブと夕食を共にしているキャラクターたちを描いています。

プロンプトワード画像左側の人物を削除してください。

5. 要素を変更する

プロンプトワード画像の背景にある古いTwitterロゴを、現在のX字型のロゴに置き換えてください。

6. あいまいな指示の理解

プロンプトワード写真に写っている人々をネイティブアメリカンのように見せるため。

最初のステップは、背景をグリーンスクリーンに置き換えることです。その後、背景を置き換えていくことで、より良い結果が得られます。

prompt:Replace the background with a solid color green screen

プロンプトワード背景を単色の緑色のスクリーンに置き換えてください。

prompt:replace the background with the attached image.  Make sure [subject] is lit to match the image;

replace the background with [describe your scene].  Make sure [subject] is lit to match the scene.

プロンプトワード背景を別の画像に置き換えてください。被写体の照明が画像と一致していることを確認してください。

背景を[シーンの説明]に置き換えてください。[被写体]の照明がシーンに合っていることを確認してください。

8. ナノバナナをインテリアデザインに活用する

「リニューアル」後のナノバナナ:

9. 現実世界の風景がゲームのアセットになる

prompt:Concisely name the key entity in this image (e.g. person, object, building). Create 3d pixel art of the isolated key entity in isometric perspective, 8-bit sprite on a white background. No drop shadow.

プロンプトワード画像内の主要な要素(人物、物体、建物など)には簡潔な名前を付けてください。均一な視点、8ビットの透明画像、影なしの独立した3Dピクセル要素を作成してください。

10. 都市の建物を3Dに変換する

【】の内容は実際の都市に応じて変更される場合があります。

prompt:Turn this photograph of a 【Parisian building】 into a isometric tile, in the style of the five other 3D.

プロンプトワードこの画像に写っているパリの建物を3Dアイソメトリックモデルに変換してください。

上記の事例研究は、ブロガーX(@Emm | scenario.com)によるものです。

複数画像編集

1. 態度参照

Prompt: take the anime man and woman in the first image and put them in the poses of the stick man in blue and stick woman in red. erase the stick figures.
プロンプトワード最初の画像にあるアニメ風の男性と女性のキャラクターを、青い小さな男性と赤い小さな女性のポーズに配置し、その後、小さなキャラクターを消去してください。

上記の事例研究は、ブロガーX(@Justine Moore)によるものです。

prompt:Model pose like the sketch.

プロンプトワードモデルのポーズはまるでスケッチのようだった。

2. 画像位置参照

Nano Bananaは、グラフ上に位置をマークするだけで、正確な画像を生成できます。

図に追加プロンプトワードコミックを生成する:

上記の事例はXブロガー@けいすけ/さんからのものです。 AIマリンカ&カイリ

prompt:A model is posing and leaning against a pink bmw. She is wearing the following items, the scene is against a light grey background. The green alien is a keychain and it's attached to the pink handbag. The model also has a pink parrot on her shoulder. There is a pug sitting next to her wearing a pink collar and gold headphones.

プロンプトワードモデルが薄灰色の背景の前でピンクのBMWにもたれかかっている。彼女はピンクのハンドバッグから緑色のエイリアンのキーホルダーをぶら下げ、肩にはピンクのオウムを乗せている。彼女の隣には、ピンクの首輪と金のヘッドホンをつけたプードルがいる。

この事例研究は、ブロガーの@Travis Davids氏によるものです。

シリーズIP/アニメキャラクター

例えば、このようなキャラクター画像があります。

prompt:First, please set up the basic color palette and the shadows and saturation.

プロンプトワードまず、基本的なカラーパレット、影、彩度を設定します。

prompt:Next, please do the character model sheet.

次に、キャラクターモデルテーブルを作成してください。

prompt:Next, please provide the [basic action set].

次に、基本的な動作セットを提供してください。

prompt:Please give me the costume design set.

プロンプトワード服飾デザインキットをください。

prompt:Please make an expression sheet.

プロンプトワード絵文字セットを作成してください。

画像を線画に変換し、ブランドカラーを使って着色してください。

ステップ:

– Prepare the original image

– Convert to line art

– Color the line art with a color palette

– Change the character to brand colors

– オリジナル画像を準備する

– 線画に変換

– カラーパレットを使用して線画に色を付ける

キャラクターの色をブランドカラーに変更する

動画(絵コンテ)作成

1. 20世紀を馬に乗って旅する一人称視点の物語。

まず、Nano Bananaを使って様々なシーンを生成します。

prompt:dashcam google street view shot | Hobbiton streets | hobbits carrying out daily tasks like gardening and smoking pipes | sunny day.

プロンプトワードGoogleストリートビューのドライブレコーダー映像|ホビット村の街並み|庭仕事や喫煙など、日常的な作業をするホビットたち|晴れた日

prompt:dashcam google street view shot | Seat of Seeing on Amon Hen | Ruined pavilion atop the hill, a hobbit-like figure from behind climbing the steps, the winding path down visible overlooking the river and lands beyond | panoramic view under emerging stars at dusk.

プロンプトワードGoogleストリートビューのドライブレコーダー映像|アモン・ヘンの展望台:山頂にある老朽化した東屋の後ろから、ホビットのような人物が階段を登り、川と遠くの土地を見下ろす曲がりくねった小道が現れ、夕暮れ時の初星の下でパノラマビューが広がります。

使用プロンプトワード乗馬の様子を一人称視点で描いた画像を作成してください。

prompt:dashcam google street view shot

プロンプトワード一人称視点:牧草地を馬で駆け抜ける様子。12世紀。

Keling 2.1の最初と最後のフレームのアニメーションを使用して、ビデオクリップを生成します。

prompt:"scene_description": "The rider gallops out from the ruins of the ivy-covered statues, leaving the storm-lit plains behind. The path winds through rugged terrain as the pace remains fast. Ahead, a towering dark castle glows with eerie green light atop jagged cliffs, its spires piercing the stormy sky. Cloaked figures march steadily toward the fortress across a massive stone bridge.",  "visual_style": "dark epic fantasy, cinematic, continuous POV",  "camera_movement": "smooth forward gallop, first-person view without cuts, transitioning naturally from the ruined statues across the plains to the castle bridge",  "main_subject": "the white horse’s head and rider’s gloved hands, centered as they race toward the looming fortress",  "background_setting": "storm-darkened mountains and cliffs, a vast stone bridge spanning a deep chasm, leading to the glowing green-lit castle",  "lighting_mood": "ominous twilight with green highlights from the fortress and flashes of distant lightning"

prompt:"scene_description": "The rider gallops out from the ruins of the ivy-covered statues, leaving the storm-lit plains behind. The path winds through rugged terrain as the pace remains fast. Ahead, a towering dark castle glows with eerie green light atop jagged cliffs, its spires piercing the stormy sky. Cloaked figures march steadily toward the fortress across a massive stone bridge.",  "visual_style": "dark epic fantasy, cinematic, continuous POV",  "camera_movement": "smooth forward gallop, first-person view without cuts, transitioning naturally from the ruined statues across the plains to the castle bridge",  "main_subject": "the white horse’s head and rider’s gloved hands, centered as they race toward the looming fortress",  "background_setting": "storm-darkened mountains and cliffs, a vast stone bridge spanning a deep chasm, leading to the glowing green-lit castle",  "lighting_mood": "ominous twilight with green highlights from the fortress and flashes of distant lightning

これらの動画を編集してつなぎ合わせることで、この長編タイムトラベル動画が完成しました。

この事例研究は、ブロガーの@TechHallaによるものです。

2. 落書き - 3D画像 - 動画

この事例はブロガーの@Alex Patrascu氏から寄せられたものです。

3. 有名な絵画に描かれた人物たちを現実世界で出会わせよう。

この事例はブロガーの@Alex Patrascu氏から寄せられたものです。

4.AI漫画

この事例はブロガーの@Framerさんからのものです。

グーグルGemini(プロ会員登録が必要です)

存在する Gemini 公式サイトのホームページで、 Gemini 2.5 Proモデルの場合は、ダイアログボックスの「ツール」の下にある「画像の作成」を選択してください。

現時点では、デフォルトでナノバナナモデルが使用されます。

画像をアップロードして、プロンプトワードすぐに使用できます。

グーグル AI Studio(無料

オープンジオグル AI Studioのウェブサイトで、右上隅にある設定をクリックしてください。

設定で「ナノバナナ」を選択してください。

画像をアップロードして入力してください...プロンプトワードそれはいいです。

LMArena(無料

LMArenaホームページ上部の「ダイレクトチャット」モードを選択してください。

続いて、gemini-2.5-flash-image-preview (nano-banana) モデルを選択すると、そのまま使用できます。

ロバート(期間限定オファー)無料

Lovartのホームページにある「Nano Banana」モデルの項目をクリックしてください。

その後、Nano Bananaモデルを直接使用することもできますが…無料締め切りは9月2日です。

Freepik

公式サイト:Freepik

ナノバナナモデルを選択してください。無料毎日使用してください。無料画像を10枚生成します。

従来、高品質で一貫性のある図面一式を作成するには、専門的なスキルと相当な時間が必要だった。

Nano Bananaを使えば、短いコマンドを入力するだけで、数秒以内にあなたの発言を予測して再現できます。

コンテンツ業界は最も大きな打撃を受けている。今それを使おうとする者は… AI 広告クリエイティブを手がける企業はまだ多くないが、これを機に状況は劇的に変わるかもしれない。

ブランド側からの指示さえあれば、数時間以内に数十種類の広告クリエイティブを生成できる。

アニメーションや短編ドラマにも同じことが言えます。かつてはチーム全体で何ヶ月もかけて取り組んでいた細部まで、今では一人で修正を加えながら完成させることができます。

将来的には、ストーリーは「オンデマンド」で生成されるようになるかもしれない。視聴者がコメントを残すとすぐに、モデルはストーリーの生成を再開する。

コンテンツ制作は、全く新しい制作モードへと移行するだろう。