Google Geminiにtext2editが登場!プロンプトで画像を編集しよう!
記事の内容を聴きたい方はこちら!
Google AI Studioでtext2edit(プロンプトで指示して画像編集)が可能になりました。これを可能にしているのは、新たに追加されたモデル「Gemini 2.0 Flash Experimental」です。ここでは、text2editでできることを調査してみました。
Gemini 2.0 Flash (Image Generation) Experimental
Googleが提供する最新のAIモデル「Gemini 2.0 Flash」の実験的画像生成機能は、2025年3月にGoogle AI Studioを通じて開発者向けに公開されました。この機能は、テキストと画像を組み合わせた出力を生成できる画期的な技術で、多くの注目を集めています。
主な特徴
マルチモーダル入出力:Gemini 2.0 Flashは画像、動画、音声などの入力を理解するだけでなく、テキストとインライン画像を組み合わせた出力を生成できます。
キャラクターの一貫性:複数の画像を生成する際、キャラクターやシーンの一貫性を保ちながら異なるポーズや角度の画像を作成できます。
対話的な画像編集:ユーザーとの自然な対話を通じて画像を編集し、完璧な画像に向けて反復的に改良することができます。
高度な推論能力:世界知識と強化された推論能力を活用して、適切な画像を生成します。これにより、レシピの詳細なイラストなど、現実的で正確な画像を作成できます。
テキストレンダリング:多くの画像生成モデルが苦手とする長いテキストシーケンスの正確なレンダリングが可能です。
応用例
ストーリーテリング:キャラクターや設定の一貫性を保ちながら、物語を挿絵付きで生成できます。
画像編集:テキスト指示だけで背景の構図を変更したり、キャラクターを回転させたりすることが可能です。
レシピの視覚化:料理のレシピをステップごとに視覚的に表現できます。
広告・ソーシャルポスト:テキストと画像を組み合わせた広告やソーシャルメディア投稿の作成に適しています。
利用方法
Gemini 2.0 Flash (Image Generation) Experimentalは、Google AI Studioで無料で利用することができます。または、API経由で有料で利用できます。
※ Google AI Studioに入力した内容は、学習に利用される可能性があります。機密情報の入力には気をつけてください。
様々な画像生成を試してみる
取り急ぎ、何ができるかを調査してみました。基本的には、以下の画像に対して編集を進めます。

ゼロから画像生成
編集対象の画像なしで画像生成できるか試してみました。
あなたはゼロから画像生成できますか?もしできるなら生成してください。
テキストが挿入されていますが、テキストのみで画像を生成することも可能なようです。
スタイル変換
この画像を線画にしてください
線画の画像に対してアニメ塗りをしてください。
この画像をdepthで表現してください
この画像をnomarl mapで表現してください
テキストを挿入する
この画像に「最強」というテキストを挿入してください。
この画像に「わたし」というテキストを挿入してください。
この画像に「Integrity」というテキストを挿入してください。
色を変える
この男性のスーツを黄色に変えてください。
この男性のネクタイを黄色にしてください
この男性のワイシャツの色を黄色にしてください。スーツではなく、ワイシャツです。
この男性の肌色を緑色にしてください。
この男性を金髪にしてください
背景を変える
この画像の背景を空港にしてください。
この画像の背景をビーチにしてください。この時、男性の照明の当たり具合も背景に合わせて調整してください。
服装を変更する
この男性の服をセーラー服にしてください。
この男性の上着を脱がせてください。
装飾する
この男性に黒縁メガネを掛けさせてください。
この男性に黒のハットを被させてください。
表情を変える
この男性を笑顔にしてください。
この男性を泣いている表情にしてください。
この男性を怒っている表情にしてください。
照明を明るくする
この男性の照度を上げてください
この画像の照明をスポットライトにしてください。
向きを変える
この男性を後ろに振り向かせてください。
この男性の顔を下に向かせてください。
カメラのアングルを上から撮影するように変更してください。
Youtubeのカバーアートを作成する
この画像にテキストを挿入したり、デザインを整えて、Youtubeのカバーアートにしてください。はい、承知いたしました。この画像を元に、YouTubeのカバーアートを作成します。どのようなテキストやデザインをご希望ですか?いくつかの提案をさせてください。
**提案1:ビジネス・自己啓発系チャンネル向け**
* **テキスト例:** 「成功への道筋」「人生を変える3つの秘訣」「一流の思考法」
* **デザイン:**
* テキストを画像の上下、または左右の空いているスペースに配置します。
* テキストの色は、背景とのコントラストを意識して白や明るい色を使用します。
* フォントは、力強く、洗練された印象を与えるゴシック体や明朝体などがおすすめです。
* 必要に応じて、チャンネルのロゴやアイコンを小さく配置します。
**提案2:ファッション・ライフスタイル系チャンネル向け**
* **テキスト例:** 「大人のメンズスタイル」「30代からの格上げファッション」「今日のコーデ」
* **デザイン:**
* テキストを画像の一部に重ねるように配置し、スタイリッシュな印象を与えます。
* テキストの色は、落ち着いた色味や、ファッションに合うような色を使用します。
* フォントは、おしゃれでモダンな印象を与えるサンセリフ体などがおすすめです。
* 必要に応じて、関連するアイコンやイラストをさりげなく配置します。
**提案3:シンプルなチャンネル向け**
* **テキスト例:** チャンネル名や短いキャッチフレーズ
* **デザイン:**
* テキストを中央付近にシンプルに配置します。
* テキストの色は、目立つ色を使用し、視認性を高めます。
* フォントは、チャンネルの雰囲気に合ったものを選びます。
**ご希望のテキストやデザインのイメージがあれば、ぜひお聞かせください。** 具体的な指示があれば、よりご希望に沿ったカバーアートを作成できます。
例えば、
* チャンネルのジャンル
* 入れたいテキスト
* テキストの色やフォントのイメージ
* その他に入れたい要素(ロゴ、アイコンなど)
* 全体的なイメージ(スタイリッシュ、シンプル、力強いなど)
これらの情報があると、より的確なご提案ができます。
もし特にご希望がなければ、提案1のビジネス・自己啓発系のイメージで、汎用性の高いデザインを作成してみますがいかがでしょうか?提案2でお願いします。承知いたしました。提案2のファッション・ライフスタイル系チャンネル向けのイメージで、カバーアートを作成します。
**作成するカバーアートのイメージ:**
* **テキスト配置:** 画像の一部に重ねるように配置し、スタイリッシュな印象を与えます。
* **テキストの色:** 落ち着いた色味や、ファッションに合うような色を使用します(例:白、グレー、ベージュなど)。
* **フォント:** おしゃれでモダンな印象を与えるサンセリフ体などを検討します。
* **その他の要素:** 必要に応じて、関連するアイコンやイラストをさりげなく配置します。
**いくつかの具体的なテキスト例とデザインのパターンを提案させてください。**
**パターンA:シンプルモダン**
* **テキスト:** 「NEW STYLE」を画像の左上または右上に配置(白または薄いグレーのサンセリフ体)。
* **デザイン:** テキスト以外は特に装飾せず、モデルのスタイリッシュさを際立たせる。
**パターンB:トレンド感強調**
* **テキスト:** 「2024 最新トレンド」を画像の下部に少し大きめのフォントで配置(トレンド感のあるサンセリフ体)。
* **デザイン:** 小さなアイコン(例:洋服のタグ、ハッシュタグ)をテキストの近くに配置しても良い。
**パターンC:パーソナルスタイル**
* **テキスト:** 「Kenji's Fashion Diary」を画像の左中央あたりに斜めに配置(手書き風の要素を取り入れたサンセリフ体)。
* **デザイン:** チャンネルのアイコンや、さりげないラインなどの装飾を加える。
**パターンD:今日のコーデ**
* **テキスト:** 「Today's Outfit」を画像の上部中央に配置し、下部に小さく日付を入れる(シンプルで見やすいサンセリフ体)。
* **デザイン:** 背景色を若干暗くしたり、フィルターをかけたりしてテキストを際立たせる。
**どちらのパターンがお好みですか?** もし具体的なテキストやイメージがあれば、ぜひ教えてください。それに基づいてカバーアートを作成いたします。パターンBでお願いします。承知いたしました。「パターンB:トレンド感強調」でYouTubeカバーアートを作成します。
**作成イメージ:**
* **テキスト:** 「2024 最新トレンド」
* **配置:** 画像の下部に少し大きめのフォントで配置
* **フォント:** トレンド感のあるサンセリフ体
* **色:** 白または、背景のグレーとコントラストがつきやすい明るめの色
* **装飾:** 必要に応じて、小さなアイコン(例:洋服のタグ、ハッシュタグの記号 # など)をテキストの近くに配置
**完成したカバーアートはこちらです。**
顔が写るようにしてください。
テクノロジーで、あなたのビジネスに革新を

この記事をお読みいただき、ありがとうございます。AIの可能性を感じながらも、「導入コストが高そう」「自社に合った活用法がわからない」とお悩みではありませんか?
✨ テクノロジーで、あなたのビジネスを次のステージへ
私たちポノテク株式会社は、最先端技術の実装と補助金活用の両方に精通した唯一無二のパートナーです。AI導入からシステム開発まで、あらゆるデジタル化の課題に対して革新的なソリューションを提供します。
💰 補助金活用でシステム開発コスト最大66%削減
経済産業省認定のIT導入支援事業者として、私たちは以下のサービスをワンストップで提供しています:
補助金診断・申請サポート: 採択率82.8%の実績で、最適な補助金をご提案
要件定義から開発まで一貫支援: 補助金要件に100%準拠した開発体制
省力化補助金・ものづくり補助金など: 最大8,000万円の補助金活用をサポート
📚 最新刊『ComfyUIマスターガイド』5月9日発売!
さらに、AI技術に関する深い知見を持つ私たちの代表・早野康寛が共著者として参加した画像生成AI書籍『ComfyUIマスターガイド』が、2025年5月9日にSBクリエイティブ社より発売されます。AI画像生成の最前線を理解したい方は、ぜひご覧ください。
📈 こんな課題をお持ちの企業様に最適です
「最新技術を取り入れたいが、コストが気になる」
「補助金を活用したいが、申請方法がわからない」
「システム開発とAI導入を一気に進めたい」
「自社のデジタル化を加速させたい」
🌟 二つの強みで、確かな未来を共に創る
補助金活用による低コストシステム開発の詳細はこちらから。ComfyUIマスターガイドについてはこちらで詳しくご紹介しています。
ぜひ初回無料相談をご利用ください。技術と経営の両面から、貴社の成長戦略を共に考えましょう。
― 技術で未来を創る。コストを削減する。ポノテク株式会社
