Gemini 3.6 Flash 最新事情 - 3.5 Flash-Lite / Flash Cyber 同時発表と Gemini 4 予告

Gemini 3.6 Flash 最新事情 - 3.5 Flash-Lite / Flash Cyber 同時発表と Gemini 4 予告

作成日:
読了:14
更新日:
この記事を読む人におすすめPR / Amazonアソシエイト

当サイトは Amazon.co.jp を宣伝しリンクすることで紹介料を得る手段を提供する、Amazonアソシエイト・プログラムの参加者です。価格・在庫はリンク先の最新情報をご確認ください。

Google が2026年7月21日、Gemini の Flash 系列を一度に更新しました。発表されたのは Gemini 3.6 FlashGemini 3.5 Flash-LiteGemini 3.5 Flash Cyber の3モデルです。話題の Gemini 3.5 Pro は今回も含まれず、代わりに Gemini 4 の事前学習を開始したことが予告されました。この記事では、Google 公式ブログ・モデルカード・API 価格ドキュメント・GitHub Changelog を一次〜準一次ソースに、確認できた事実だけを断定し、値が割れるものには留保を付けて整理します。前世代の位置づけはGemini 3.5 Flash の解説もあわせてどうぞ。

3モデル同時発表の全体像

今回のリリースは「速くて安い Flash を、さらに安く・賢く」という方向で3つの派生を一気に出したのが特徴です。おおまかな棲み分けは次のとおりです。

  • Gemini 3.6 Flash: 汎用ワークホース。速度と知能のバランス型で、コーディングとエージェント用途を強化
  • Gemini 3.5 Flash-Lite: 最速・最安のスループット特化。高頻度実行向け
  • Gemini 3.5 Flash Cyber: 脆弱性の発見・検証・修正に特化した限定提供モデル

命名が少しややこしい点に注意してください。汎用ワークホースだけが「3.6」に上がり、Flash-Lite と Flash Cyber は「3.5」系のままです。世代番号が揃っていないので、モデル選択時は番号ではなく用途で見るのが安全です。

NOTE

前世代からの流れを追いたい方は、Gemini 3.1 Flash(Live / TTS)や、5月の発表をまとめたGoogle I/O 2026 開発者向けハイライトも参考になります。

Gemini 3.6 Flash の中身

主役の 3.6 Flash から見ていきます。モデルカードと API 価格ドキュメントで確認できた主要スペックは次のとおりです。

項目
モデルIDgemini-3.6-flash
入力コンテキスト最大約1Mトークン(1,048,576)
最大出力64Kトークン(65,536)
入力モダリティテキスト・画像・音声・動画
ナレッジカットオフ2026年3月
入力価格$1.50 / 1Mトークン
出力価格$7.50 / 1Mトークン

ポイントは3つあります。1つ目は ナレッジカットオフが2026年3月まで前進したこと。3.5 Flash 系の2025年1月から1年以上新しくなり、比較的最近の情報を前提にした回答が期待できます。2つ目は 価格が下がったこと。入力は3.5 Flash と同じ$1.50ですが、出力は $9.00 から $7.50 に下がっています。3つ目は トークン効率です。公式は Artificial Analysis Index の測定で「3.5 Flash より出力トークンが約17%少ない」としており、単価の低下と合わせて実効コストが下がる方向です。

機能面では、GitHub の告知にあるとおり reasoning effort(推論の深さ)の設定並列ツール呼び出し(parallel tool use)に対応し、Web/アプリ開発や長時間のエージェントタスクを想定した作りになっています。

NOTE

API での reasoning effort の具体的なパラメータ名や取り得る値は、モデルにより更新されることがあるため、最新は公式ドキュメントで確認してください(本記事では正確な文字列は要確認とします)。

公式モデルカードのベンチマークは単一モデルの実測値として、以下のような数値が掲載されています(測定条件付きの公式値で、他社との横並び比較ではありません)。

ベンチGemini 3.6 Flash
SWE-Bench Pro58.7%
Terminal-bench 2.178.0%
OSWorld-Verified83.0%
MLE-Bench63.9%

ベンチは測定条件で振れます。数値は「公式が示した条件下の値」として受け取り、自分の実タスクで再確認するのが安全です。

最小の呼び出しはモデルID gemini-3.6-flash を指定するだけです。

curl "https://generativelanguage.googleapis.com/v1beta/models/gemini-3.6-flash:generateContent" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "contents": [
      { "parts": [ { "text": "この関数のバグを説明して修正案を出して" } ] }
    ]
  }'

3.5 Flash-Lite と Flash Cyber は何者か

Gemini 3.5 Flash-Lite は「最速・最安の 3.5 系」という位置づけです。価格は 入力$0.30 / 出力$2.50 / 1Mトークンで、公式は 毎秒350出力トークンのスループットを掲げています。ベンチでは Terminal-Bench 2.1 で前世代の31%に対し 54%へ改善したとしています。大量のリクエストを安く速くさばく用途、たとえば分類・抽出・整形のバッチ処理などに向きます。

Gemini 3.5 Flash Cyber は毛色が違います。DeepMind の説明では、これは 3.5 Flash をベースにサイバーセキュリティ用途へファインチューンしたモデルで、脆弱性の発見・検証・修正を素早く行うことを狙っています。V8 JavaScript エンジンでの検証では、固定回数の試行で 55件の一意な確認済み問題を発見し、mainline の 3.5 Flash(47件)や Claude Opus 4.6(36件)を上回ったと報告されています。

WARNING

Flash Cyber は一般提供ではありません。DeepMind は「デュアルユース(攻撃にも防御にも使える両義的な技術)」であることを踏まえ、CodeMender を通じて政府や信頼できるパートナーに限定した試験提供にとどめています。単体の公開 API・価格・一般提供日はいずれも未公表です。一方で、CodeMender の機能自体は一般提供の Gemini モデルを用いて Gemini Enterprise Agent Platform 経由でも順次提供されるとしています。

セキュリティAIの動向は、当ブログの脆弱性スキャン系の記事群ともつながります。攻撃と防御の両面を持つツールをどう運用に組み込むかは、今後の実務課題になりそうです。

どこで使えるか(提供面)

公式ブログによれば、初日から使える主な提供面は以下です。

  • Google AI Studio
  • Gemini API
  • Gemini アプリ
  • Android Studio
  • Google Antigravity
  • Gemini Enterprise Agent Platform
  • Google 検索(3.5 Flash-Lite が順次ロールアウト)

加えて、GitHub の Changelog によると Gemini 3.6 Flash は GitHub Copilot でも利用可能になりました。対象は Copilot Pro / Pro+ / Max / Business / Enterprise で、Visual Studio Code・Visual Studio・Copilot CLI・Copilot cloud agent・Copilot アプリ・JetBrains・Xcode・Eclipse から選べます。ロールアウトは段階的で、Business / Enterprise の管理者は設定で「Gemini 3.6 Flash Preview」ポリシーを有効化する必要があります。Copilot 側のエージェント運用はGitHub Copilot コーディングエージェントも参照してください。

Antigravity をコマンドラインから使う流れはGemini CLI から Antigravity CLI への移行にまとめています。

NOTE

Vertex AI の通常モデルピッカーでの提供時期など、上記に明示されていない面の詳細は公式ドキュメントで要確認です。本記事では公式ブログが挙げた提供面のみを確定として扱っています。

3.5 Pro が無い意味と Gemini 4 予告

今回の発表で注目されたのは、フラッグシップの Gemini 3.5 Pro が含まれなかった点です。TechCrunch は「3モデルを出したが 3.5 Pro は無し」という角度で報じ、Google 側は Pro について「パートナーとテスト中で、準備でき次第の提供」という趣旨の説明にとどめています。Bloomberg は、社内の性能目標を満たせず 3.5 Pro のローンチに遅れが生じていると報じました(この背景は報道ベースの情報です)。

一方で Google は前を向いています。DeepMind のプロダクトリードである Logan Kilpatrick 氏は、「これまでで最も野心的な事前学習を Gemini 4 に向けて開始した」と述べています。つまり現時点の構図は「Pro は足踏み、しかし次世代 Gemini 4 の仕込みは始まっている」というものです。5月の発表からの流れはGoogle I/O 2026 のハイライトも参考になります。

WARNING

Gemini 4 は事前学習の開始が予告された段階で、リリース日・スペック・価格は一切未発表です。「Gemini 4 が出た」という記述は現時点では誤りなので注意してください。

実務でどう向き合うか

Flash 系の更新は、地味ですが実務インパクトが大きいところです。向き合い方を3点にまとめます。

  1. 安いワークホースの入れ替えを検討する。3.6 Flash は出力単価が下がり、出力トークンも約17%少ないとされます。既存の 3.5 Flash パイプラインを 3.6 Flash に差し替えるだけで、品質を保ちつつコストが下がる可能性があります。まずは代表的なプロンプトで A/B を取り、コストと品質の両方を計測してから切り替えましょう。
  2. 価格改定に追従する運用にしておく。Flash 系は世代ごとに価格も出力単価も動きます。モデルIDや単価をコードに直書きせず、設定で切り替えられるようにしておくと、次の改定にも素早く追従できます。API 実装のベースはVercel AI SDK の解説のような抽象化層も選択肢です。
  3. ベンチは条件付きで見る。公式ベンチは測定条件で振れます。他社モデル、たとえばClaude Sonnet 5などと比べる際も、自分の実タスクでの再評価を前提にしてください。数値の大小だけで乗り換えを決めないのが安全です。

用途別には、大量・安価に回すなら Flash-Lite、コーディングやエージェントのバランス型なら 3.6 Flash、脆弱性対応は(対象であれば)Flash Cyber、という整理になります。

まとめ

  • 2026年7月21日、Gemini 3.6 Flash / 3.5 Flash-Lite / 3.5 Flash Cyber の3モデルを同時発表。3.5 Pro は今回無しGemini 4 の事前学習開始を予告
  • 3.6 Flash は gemini-3.6-flash、約1Mコンテキスト、最大出力64Kトークン、ナレッジカットオフ2026年3月、入力$1.50 / 出力$7.50、出力トークン約17%削減reasoning effort と並列ツールに対応
  • Flash-Lite は入力$0.30 / 出力$2.50 で毎秒350トークンの最安・最速枠。Flash Cyber は限定提供(CodeMender 経由、政府・信頼パートナー向け)
  • 提供面は AI Studio / Gemini API / Gemini アプリ / Android Studio / Antigravity / Gemini Enterprise / Google 検索、加えて GitHub Copilot

派手な Pro の代わりに、日々のワークロードを支える Flash が静かに安く・賢くなった、というのが今回の実像です。まずは 3.6 Flash を実タスクで計測し、コスト効果を確かめるところから始めるのが現実的です。

参考リンク

Gemini 3.5 Flash - 高速・低価格でコーディングとエージェントを強化(Pro はプレビュー)

Gemini 3.5 Flash - 高速・低価格でコーディングとエージェントを強化(Pro はプレビュー)

7

Google が2026年5月19日の I/O で一般提供を開始した Gemini 3.5 Flash を、公式情報を一次ソースに整理します。1Mトークンのコンテキスト、4段階の thinking、入力 $1.50 / 出力 $9.00 という価格、Terminal-Bench 2.1 や MCP Atlas などコーディング・エージェント系での向上、そして「3.1 Flash の3倍の価格」という注意点まで。あわせて、まだ GA していない Gemini 3.5 Pro(2Mコンテキスト・Deep Think、プレビュー段階)の現状も正確に区別して解説します。

Google DiffusionGemma - 拡散モデルでテキストを「並列生成」する実験的オープンモデル

Google DiffusionGemma - 拡散モデルでテキストを「並列生成」する実験的オープンモデル

8

Google DeepMind が2026年6月10日に公開した DiffusionGemma は、テキストを1トークンずつ左から右へ生成する従来の自己回帰(autoregressive)方式ではなく、ノイズから複数トークンを並列にデノイズして生成する「拡散(diffusion)」方式のオープンウェイトモデルです。仕組み(Uniform State Diffusion・双方向アテンション・256トークンの並列デノイズ)、H100で1,000トークン/秒超という速度、Gemma 4 比での品質トレードオフ、実験的という位置づけまで、Google 公式情報を一次ソースに整理します。

Google I/O 2026 開発者視点まとめ - Antigravity 2.0、Gemini 3.5 Flash、Managed Agents、AI Studio の Android 対応

Google I/O 2026 開発者視点まとめ - Antigravity 2.0、Gemini 3.5 Flash、Managed Agents、AI Studio の Android 対応

10

2026年5月19日のGoogle I/O 2026から、開発者に効く発表を整理。エージェント開発プラットフォーム Antigravity 2.0、Gemini 3.5 Flash、API1コールのManaged Agents、AI Studioのネイティブ Android(Kotlin)対応、そして Gemini CLI 統合の意味を解説します。