Skip to main content
Google Gemini は、Google が開発した強力な AI モデルであり、対話およびテキスト生成機能をサポートしています。現在、ComfyUI には Google Gemini API が統合されており、ComfyUI で関連ノードを直接使用して対話機能を実行できます。

Google Gemini が得意なこと

  • 対話とテキスト生成: ComfyUI ワークフロー内で Google のマルチモーダル AI と直接チャットできます。
  • マルチモーダル推論: Gemini の推論機能を使用して画像を解釈できます。
  • 画像からプロンプトへの変換: 公式テンプレートには、画像を対応する描画プロンプトに変換するプロンプトが同梱されています。
  • 複数画像の入力: Batch Images を使用して、1 回の実行で複数の画像を AI に送信して解釈させることができます。

ComfyUI で使用する

Google Gemini ワークフロー

ComfyUI で Gemini 対話ワークフローを実行します。ローカルまたは Comfy Cloud で。