【完全攻略】Gemini 3.1 Flash TTSを極める。Google AI StudioのTTS設定を出力する「Gem」の運用マニュアル。
「AIの音声は、もう『機械』ではない。それは『人格』だ」

Googleから発表された
Google AI Studioで使える「Gemini 3.1 Flash TTS Preview」
これまでのTTS(Text-to-Speech)は、
どれだけ滑らかでもどこかなんとなく「違和感」がありました。。
しかし、「Gemini 3.1 Flash TTS Preview」は違います。
話し手の「笑顔」、言葉の裏にある「熱量」、そして聴き手を引き込む「間」。これらすべてを、コントロールできる時代が到来したのです。
しかし、この強力なツールには大きなハードルがあります。
「Google AI Studioのインターフェースが専門的すぎること」
「最高の声を引き出すための設定やプロンプトスキルが必要であること」
です。

このnoteでは、AI Studioの入力項目を一つずつ解剖し、
それらすべてを
「Gem」(下記で全文を公開!)に丸投げ
して生成させる、運用メソッドを公開します。

こんな感じ↓のGemです。
私のnote記事のURLでナレーション生成してもらったもの
noteの内容をベースナレーション生成しました。(音楽は別途追加しました)https://t.co/aA6EqXePhq pic.twitter.com/U3XOThLBLu
— TEAM 今から使えるAI。 (@chillnary) May 7, 2026
まずは、Gemにテキスト・URLを入力し処理を開始します。
(処理は、Gemini3のProで処理をしています)

分数や、内容などのヒアリングに回答すると、
ナレーターを3パターン提案を出してくれます。
今回は、3パターンのうちAを選択↓します。

すると↓こんな感じで
GoogleAIStudioの入力する設定とナレーション台本が出力されます。

ナレーション台本
これらをそのままGoogleAIStudioのTTSに
入力すればナレーション音声のできあがり!!

Google AI Studioの「TTS入力画面」完全解剖
「Gemini 3.1 Flash TTS Preview」は、
2026年5月上旬現在、Google AI Studioにおいて「無料」で利用可能です。
AI Studioを開き、モデルを「Gemini 3.1 Flash TTS Preview」に切り替えると、普段のチャット画面とは異なる項目が並びます。
それぞれの項目が「声」の何を決めているのか、
初心者の方にもわかりやすく説明します。

ナレーション生成へのアクセス方法
ここから先は
¥ 480
「いいかも」と思ったら、応援して頂けると励みになります!
