Blog›Guides

ナノバナナとGemini Imageのプロンプトの書き方

GoogleのNano BananaおよびGemini Imageモデル向けのプロンプト作成をマスターする。構造、スタイル、反復を実際の例で学ぶ。

ナノバナナとGemini Imageのプロンプトの書き方

ナノバナナとGemini Imageのプロンプトの書き方

Googleの画像生成モデル、愛称ナノバナナ(Geminiの実験的モデル)と本番用のGemini Imageモデルは、非常に強力です。しかし、その出力品質はほぼ完全にプロンプトの書き方に依存します。曖昧なプロンプトは平凡な画像を生み出し、構造化されたプロンプトは傑作を生み出します。

このガイドでは、Googleの公式ドキュメントとプロンプトエンジニアリングコミュニティ全体からベストプラクティスを抽出し、これらの画像モデルに特化して調整しています。優れたプロンプトの構造、前後の例、すぐに使えるチェックリストを学べます。

ナノバナナとGemini Imageが異なるプロンプトを必要とする理由

テキストのみのLLMとは異なり、画像モデルはあなたの言葉を視覚的な指示として解釈します。文法について推論するのではなく、ピクセルについて推論します。特にナノバナナはフォトリアリズムと創造的な構図に優れており、Gemini Imageはより幅広いスタイルを処理します。両方とも以下の要素に良く反応します:

  • 具体的な視覚的詳細(照明、カメラアングル、レンズタイプ)
  • スタイル記述子(フォトリアリスティック、シネマティック、水彩)
  • 構図の手がかり(被写体の配置、背景、被写界深度)
  • よくある間違いは「公園の犬」のようなプロンプトを書くことです。これではモデルに自由度を与えすぎます。代わりに、シーンを制約する必要があります:「日差しの降り注ぐ公園の木製ベンチに座るゴールデンレトリバー、浅い被写界深度、85mmレンズ、暖かい午後の光」

    高性能な画像プロンプトの構造

    Googleのプロンプティング戦略とプロンプトエンジニアリングガイドに基づくと、ナノバナナやGemini Imageの強力なプロンプトには通常以下の要素が含まれます:

  • 被写体 - 焦点は誰か、何か?
  • アクション/ポーズ - 何が起こっているか?
  • 環境 - どこで起こっているか?
  • 照明 - 自然光、劇的、ネオン、ゴールデンアワー?
  • カメラ/レンズ - リアリズム用:35mm、85mm、ドローンショット、マクロ?
  • スタイル - フォトリアリスティック、シネマティック、アニメ、油絵?
  • ムード/カラーパレット - 暗くてムーディー、明るくて風通しの良い、パステル?
  • 構図 - クローズアップ、ワイドショット、三分割法、対称性?
  • これを実際に見てみましょう。以下の2つのプロンプトを比較してください:

  • 弱い:「夜のビーチの女性」
  • 強い:「夜のビーチで流れるような生物発光ドレスを着て踊る女性、光る青い波、満月、シネマティックな照明、ワイドショット、フォトリアリスティック、幻想的なムード」
  • この強いプロンプトは、まさにwikipromptの生物発光ビーチダンスプロンプトにあるものです。モデルに明確な被写体、アクション、環境、照明、スタイル、ムードを与えています。

    ステップバイステップのプロンプト作成プロセス

    ステップ1:コアとなる被写体を定義する

    明確な名詞から始めましょう。「年老いた男性」よりも「風化した漁師」の方が具体的です。アップロードした写真を使用する場合、エディトリアル雑誌スプレッドポートレートのように、被写体はすでに定義されていますが、希望する変換を指定する必要があります。

    ステップ2:視覚的なコンテキストを追加する

    自問してみてください:このシーンを面白くしているものは何か?環境の詳細を追加しましょう。例えば、「テーブルの上の製品」ではなく、「反射する黒い表面の上に浮かぶ香水瓶、渦巻く霧に囲まれ、劇的なスタジオ照明」を試してみてください。これはファントムプロトコル浮遊製品プロンプトの本質です。

    ステップ3:スタイルとメディアを指定する

    ナノバナナは特に写真スタイルの模倣に優れています。以下のような用語を使用してください:

  • 「フォトリアリスティック、85mmレンズ、f/1.8」
  • 「シネマティック、アナモルフィック、ティールアンドオレンジ」
  • 「マクロ撮影、極端なディテール」
  • 「水彩イラスト、柔らかいエッジ」
  • シュールな外観には、「ウルトラシュールレアリスト、ガラスとネオンの変容」と言うかもしれません。このウルトラシュールレアリストプロンプトで見られるように。

    ステップ4:照明とムードを定義する

    照明は画像品質の大きな要素です。「ゴールデンアワー」「ネオンの輝き」「柔らかい拡散光」「高コントラスト」などの言葉は出力を劇的に変えます。「神秘的」「喜びに満ちた」「憂鬱な」などのムードの言葉も役立ちます。

    ステップ5:反復して洗練させる

    最初のプロンプトが完璧である必要はありません。モデルの出力をフィードバックとして使用してください。画像が忙しすぎる場合は簡素化し、あまりにも平凡な場合はスタイル記述子を追加します。OpenAIプロンプトエンジニアリングガイドは反復を強調しており、画像モデルにも同じことが当てはまります。

    ナノバナナの高度なテクニック

    ナノバナナ(実験的モデル)は、複雑な複数被写体のシーンやテキストレンダリングの処理で定評があります。以下は高度なヒントです:

  • ネガティブプロンプトを使用する(サポートされている場合):不要な要素を除外します。例:「テキストなし、ウォーターマークなし、余分な指なし」
  • プロンプトチェーン:ベース画像を生成し、バリエーションを要求します。例えば、ポートレートから始めて、「シネマティックな濡れたルックにする」と言います。濡れたシネマティッククローズアップビューティーポートレートのように。
  • 参照画像:写真をアップロードしてスタイル変換を要求します。巨大な目のマクロコンポジットは、マクロショットと小さな人物を組み合わせてシュールなコンポジットを作成する方法を示しています。
  • よくある間違いとその回避方法

  • プロンプトの過負荷:詳細が多すぎるとモデルが混乱します。上位3〜5つの要素を優先してください。
  • 曖昧すぎる:「美しい風景」は役に立ちません。山、森、湖、夕日を指定してください。
  • アスペクト比を無視する:特定の形状(例:16:9)が必要な場合は、プロンプトで言及してください。
  • スタイルの一貫性を忘れる:シリーズが必要な場合は、スタイル記述子を同一に保ってください。
  • 例:悪いものから素晴らしいものへ

    弱いプロンプトを段階的に変換してみましょう。

    悪い:「猫」

    より良い:「窓辺に座って外を見ているふわふわの白い猫、柔らかな朝の光」

    素晴らしい:「木製の窓辺に座って、雨の降る通りを外に見ているふわふわの白い猫、柔らかな拡散した朝の光、浅い被写界深度、50mmレンズ、フォトリアリスティック、居心地の良いムード」

    素晴らしいプロンプトは、モデルが必要とするすべての視覚的手がかりを与えます。

    既存のプロンプトをテンプレートとして使用する

    学ぶ最良の方法の1つは、よく作られたプロンプトを研究することです。wikipromptライブラリにはクリエイティブプロンプトのカテゴリがあり、多くの例があります。例えば、エディトリアル雑誌スプレッドポートレートプロンプトは、シンプルな写真をハイファッションのスプレッドに変換する方法を示しています。これらのテンプレートを自分のニーズに合わせて適応できます。

    ネガティブプロンプトとパラメータの役割

    ナノバナナとGemini ImageはStable Diffusionと比較してパラメータ制御が限られていますが、「人物なし」「テキストなし」「ウォーターマークなし」などのフレーズで出力に影響を与えることができます。また、「高解像度」や「8k」を指定することも役立ちますが、関連性がない場合はモデルが無視する可能性があります。

    さらなる読み物とリソース

    より深く掘り下げたい場合は、以下のリソースが優れています:

  • Google Geminiプロンプティング戦略 - Google公式ガイド。
  • Anthropicプロンプトエンジニアリング概要 - テキスト用ですが、明確さと構造の原則は適用されます。
  • Learn Prompting - 初心者向けコース。
  • プロンプトエンジニアリングガイド - 包括的なテクニック。
  • Google Vertex AIプロンプトデザイン - エンタープライズ向け。
  • 次のプロンプトのチェックリスト

    生成を押す前に、このチェックリストを確認してください:

  • [ ] 被写体を明確に指定しましたか?
  • [ ] 少なくとも1つの環境の詳細を追加しましたか?
  • [ ] 照明の記述子を含めましたか?
  • [ ] スタイル(フォトリアリスティック、シネマティックなど)を選択しましたか?
  • [ ] 構図(クローズアップ、ワイドショット、マクロ)に言及しましたか?
  • [ ] 要素を過剰に追加していませんか?
  • [ ] 必要に応じてネガティブな制約を含めましたか?
  • 結論

    ナノバナナとGemini Imageのプロンプトを書くことは、練習で習得できるスキルです。シンプルに始め、視覚的な詳細の層を追加し、出力に基づいて反復してください。このガイドの例とwikipromptのナノプロンプト検索を使用してインスピレーションを得てください。モデルは協力者であり、心を読む人ではないことを忘れないでください。あなたがより正確であればあるほど、結果はより見事になります。

    ハッピープロンプティング!

    Tags
    nano-banana·gemini-image·prompt-engineering·ai-image·google-ai·creative·tutorial