Gemini 3.6 Flash API の使い方

Gemini 3.6 Flash API の使い方

Gemini 3.6 Flash API の使い方Akira

Google Gemini APIでモデルID gemini-3.6-flash を指定し、Gemini 3.6...

Google Gemini APIでモデルID gemini-3.6-flash を指定し、Gemini 3.6 Flashを呼び出す手順を解説します。Googleは2026年7月21日にFlashの刷新版をリリースしました。3.6 Flashは主力となる階層で、3.5 Flashより出力コストが低く、最大1Mトークンのコンテキストウィンドウを持ちます。テキスト、画像、動画、音声、PDFを入力でき、このガイドではAPIキーの取得、curlとPythonでの初回リクエスト、主要パラメータ、回帰テストの設定までを実装します。

今すぐApidogを試す

Gemini 3.6 Flash APIの概要

始める前に必要なもの

開始に必要なものは次の3つです。

  • Googleアカウント
  • Gemini APIキー
  • HTTPリクエストを送信するツール
    • ターミナルなら curl
    • アプリへ組み込むならPython
    • リクエストの保存・テスト・デバッグまで行うならAPIクライアントのApidog

AI Studio経由の無料枠を使う場合、事前の課金設定は不要です。ただしレート制限があるため、学習・検証用途から始めてください。

Gemini APIキーを取得する

  1. Google AI Studio を開き、Googleアカウントでサインインします。
  2. APIキーを取得 を選択します。
  3. APIキーを作成 をクリックします。
  4. 発行されたキーをコピーし、安全な場所に保存します。

APIキーはパスワードと同様に扱ってください。キーを取得したユーザーは、そのキーに紐づくアカウントに対して費用を発生させる可能性があります。

Google AI StudioでのAPIキー作成画面

キーをソースコードへ直接書き込んだり、Gitリポジトリにコミットしたりしないでください。環境変数として設定します。

export GEMINI_API_KEY="your_key_here"
Enter fullscreen mode Exit fullscreen mode

正式な設定方法や認証方法は、GoogleのGemini APIドキュメントで確認してください。

最初のAPI呼び出しを行う

Gemini APIでは、モデルの generateContent メソッドへPOSTリクエストを送信します。

curlで呼び出す

以下のコマンドを実行してください。YOUR_API_KEY を実際のキーに置き換えます。

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
  -H "x-goog-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -X POST \
  -d '{
    "contents": [
      {
        "parts": [
          {"text": "Explain how APIs work"}
        ]
      }
    ]
  }'
Enter fullscreen mode Exit fullscreen mode

実装上のポイントは次のとおりです。

  • APIキーは x-goog-api-key ヘッダーに指定します。
  • リクエスト本文は contents 配列です。
  • contents 要素には parts 配列を指定します。
  • 今回は text パートだけを送信しています。

この形式は単純なテキスト入力では少し冗長に見えますが、後からテキストと画像・ファイルを同じリクエストに混在させる場合にもそのまま使えます。

Python SDKで呼び出す

まずSDKをインストールします。

pip install google-genai
Enter fullscreen mode Exit fullscreen mode

次に、環境変数 GEMINI_API_KEY を設定した状態で以下を実行します。

from google import genai

client = genai.Client()  # GEMINI_API_KEY を環境変数から読み取る

resp = client.models.generate_content(
    model="gemini-3.6-flash",
    contents="Explain how APIs work",
)

print(resp.text)
Enter fullscreen mode Exit fullscreen mode

genai.Client()GEMINI_API_KEY を自動で読み取るため、コード中にキーを含める必要はありません。生成結果は resp.text で取得できます。

REST APIの応答はJSONです。生成テキストは通常、次のパスで取得できます。

candidates[0].content.parts[0].text
Enter fullscreen mode Exit fullscreen mode

後述するAPIテストでは、このフィールドが存在し、空でないことを確認します。

知っておくべき主要パラメータ

基本リクエストが動作したら、用途に応じて生成設定を調整します。

  • システム命令

    ユーザープロンプトとは別に、会話全体へ適用するルールや役割を指定します。たとえば「JSON形式だけで回答してください」「簡潔なコードレビュー担当者として回答してください」といった指示に使います。

  • 最大出力トークン

    応答の長さを制限します。3.6 Flashは最大64kの出力トークンを生成できます。長文生成には上限を上げ、コストとレイテンシーを抑えたい場合は下げてください。

  • マルチモーダル入力

    テキスト、画像、動画、音声、PDFを同じリクエストで扱えます。テキストと同様に parts 配列へ追加します。出力はテキストのみです。最大1M入力トークンのコンテキストウィンドウにより、長いPDFや動画トランスクリプトも扱えます。

  • 思考と推論

    3.6 Flashは、複雑なプロンプトに対して回答前に推論を行います。多段階のタスクに有効ですが、思考トークンも出力料金に含まれます。速度と推論の深さを調整したい場合は、推論に関する設定を確認してください。

利用可能なフィールド名や最新の仕様は、推測せずにGemini APIドキュメントで確認してください。

料金と無料枠

Gemini 3.6 Flashの料金は、入力トークン1Mあたり1.50ドル、出力トークン1Mあたり7.50ドルです。

出力料金は3.5 Flashの9.00ドルから下がっています。また、3.6 Flashは同じタスクで約17%少ない出力トークンを生成する傾向があるため、実際のコスト削減につながる可能性があります。

注意点として、出力料金には思考トークンが含まれます。画面に表示される回答が短くても、推論負荷の高いプロンプトでは想定よりコストが高くなる場合があります。詳細な計算はGemini 3.6 Flashの料金ガイドを参照してください。

無料枠はAI Studio経由で利用できますが、1分あたり・1日あたりのリクエスト数に上限があります。また、Googleが無料枠のデータを製品改善に使用する可能性があります。

無料枠はプロトタイプ、学習、初期検証向けです。本番トラフィックを扱う場合は課金を有効にしてください。詳しくはGemini 3.6 Flashを無料で利用する方法を確認してください。

ApidogでGemini APIをテスト・デバッグする

curlでの実行は「一度成功した」ことを確認するには便利です。しかし、デプロイ後にリクエスト形式が壊れた場合、APIレスポンスの構造が変わった場合、キーが無効になった場合までは検出できません。

継続的に確認するには、保存して繰り返し実行できるAPIテストが必要です。Apidogでは、Gemini APIリクエストを保存し、アサーションと回帰テストを設定できます。

1. POSTリクエストを作成する

新しいHTTPリクエストを作成し、以下を設定します。

  • メソッド: POST
  • URL:
https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent
Enter fullscreen mode Exit fullscreen mode

リクエスト本文には、先ほどのJSONを貼り付けます。

{
  "contents": [
    {
      "parts": [
        {
          "text": "Explain how APIs work"
        }
      ]
    }
  ]
}
Enter fullscreen mode Exit fullscreen mode

2. APIキーを環境変数へ保存する

Apidogの環境設定に GEMINI_API_KEY を追加します。リクエストヘッダーでは次のように参照します。

x-goog-api-key: {{GEMINI_API_KEY}}
Enter fullscreen mode Exit fullscreen mode

この形にすると、キーを共有リクエストから分離できます。また、開発・ステージング・本番など、環境ごとにキーを切り替えられます。

3. 応答アサーションを追加する

リクエスト実行後、最低限次の条件を検証します。

  • HTTPステータスが 200
  • candidates[0].content.parts[0].text が存在する
  • 生成テキストが空文字列ではない

これにより、単にHTTP応答を受け取っただけでなく、Gemini APIが期待どおりに生成結果を返していることを確認できます。

4. 保存して回帰テストをスケジュールする

リクエストをコレクションへ保存し、回帰テストとしてスケジュール設定します。

定期実行またはCI内で実行すれば、Gemini API呼び出しの失敗をユーザーより先に検出できます。

Apidogをダウンロードして、このテストを作成してください。Apidog自体がモデルを実行するわけではなく、アプリケーションが依存するAPIが期待どおりに応答し続けることを検証するために使用します。

よくあるエラーと解決策

401 Unauthorized: 無効なキー

原因は通常、キーの誤り、キーの取り消し、またはヘッダーの不足です。

確認する項目:

  • x-goog-api-key ヘッダーがあるか
  • AI Studioで発行したキーと一致しているか
  • 環境変数が実際に展開されているか
  • キーの前後に空白が入っていないか
  • {{GEMINI_API_KEY}} が未展開のまま送信されていないか

429 Too Many Requests: レート制限

無料枠の1分あたり、または1日あたりの上限に達している可能性があります。

対処方法:

  • リクエスト送信レートを下げる
  • バックオフ付きリトライを実装する
  • 本番利用では課金を有効にして上限を引き上げる

短い間隔でAPIテストを繰り返す場合は、特に発生しやすいエラーです。

404 Not Found: モデルが見つからない

多くの場合、モデルIDの入力ミスです。正しいIDは次のとおりです。

gemini-3.6-flash
Enter fullscreen mode Exit fullscreen mode

以下のようなIDではありません。

gemini-3.5-flash
gemini-flash-3.6
Enter fullscreen mode Exit fullscreen mode

同じリリースに含まれるLiteティアは gemini-3.5-flash-lite です。3.6 Flashとは別の3.5系モデルなので、混同しないようにしてください。

よくある質問

Gemini 3.6 Flashの正確なモデルIDは何ですか?

gemini-3.6-flash です。SDKではモデル名として、REST APIでは :generateContent の直前に指定します。

Gemini 3.6 Flash APIは無料で利用できますか?

AI Studio経由の無料枠がありますが、レート制限があります。プロトタイピングや学習には利用できます。本番環境のトラフィックには課金を有効にしてください。詳細は無料で利用する方法を参照してください。

モデルには何を送信できますか?

テキスト、画像、動画、音声、PDFを送信できます。コンテキストウィンドウは最大1Mトークンで、出力はテキストのみです。

表示された回答より請求額が高いのはなぜですか?

出力トークン料金には、モデルの思考トークンが含まれます。推論負荷の高いプロンプトでは、表示される回答の長さより多くのトークンが消費される場合があります。

古いGemini 3.5 Flash APIと同じ形式ですか?

呼び出し形式は同じです。Gemini 3.5 APIを使用していた場合は、モデルIDを置き換えるだけで利用できます。3.6 Flashでは出力価格が下がり、同じ作業で使用する出力トークンも少なくなる傾向があります。

curl、Python、Apidogで同じキーを使えますか?

はい。同じAI StudioのAPIキーを使用できます。ただし、キーはハードコードせず、各ツールで環境変数として管理してください。キーのローテーションや取り消しを一元的に行いやすくなります。

次のステップ

まずは無料枠で、以下の順番で実装してください。

  1. AI StudioでAPIキーを作成する
  2. GEMINI_API_KEY を環境変数へ設定する
  3. curlで generateContent を実行する
  4. Python SDKから同じモデルを呼び出す
  5. Apidogでリクエストとアサーションを保存する
  6. 回帰テストをスケジュールまたはCIに組み込む

パラメータや最新仕様は公式ドキュメントを参照してください。Gemini API呼び出しがアプリケーションの依存関係になったら、Apidogでテストを継続し、APIの変更や認証エラーを早期に検出できる状態にしておきましょう。