Gemini 3.5 Flash - 高速・低価格でコーディングとエージェントを強化(Pro はプレビュー)

Gemini 3.5 Flash - 高速・低価格でコーディングとエージェントを強化(Pro はプレビュー)

作成日:
読了:約8分
更新日:
この記事を読む人におすすめPR / Amazonアソシエイト

当サイトは Amazon.co.jp を宣伝しリンクすることで紹介料を得る手段を提供する、Amazonアソシエイト・プログラムの参加者です。価格・在庫はリンク先の最新情報をご確認ください。

Google の高速モデル系列に Gemini 3.5 Flash が加わりました(2026年5月19日 I/O で一般提供開始)。速くて安く、コーディングとエージェントで前世代を伸ばしたのが要点です。一方で話題の Gemini 3.5 Pro はまだ GA していません。この記事では、Google 公式情報を一次ソースに、Flash の実力と Pro の現状を正確に整理します。

Gemini 3.5 Flash とは

  • 2026年5月19日に GA(Gemini アプリ / Gemini API / AI Studio / Vertex AI / Android Studio など)
  • モデルID は gemini-3.5-flash(サフィックス無し=安定版)
  • 1Mトークン(1,048,576)の入力コンテキスト、最大出力 65,536 トークン
  • 入力はテキスト・画像・動画・音声・PDFに対応(出力はテキスト)
  • thinking(推論)は4段階(minimal / low / medium / high、既定 medium)
  • 知識カットオフは 2025年1月

スペックと価格

項目値
GA日2026年5月19日
入力コンテキスト約1Mトークン
最大出力65,536トークン
thinking4段階(既定 medium)
入力価格$1.50 / 1Mトークン
出力価格$9.00 / 1Mトークン

WARNING

価格は前世代 Gemini 3 Flash の3倍です。 Gemini 3 Flash(Preview)は入力 $0.50 / 出力 $3.00 です。性能は上がっていますが、コスト最重視なら Gemini 3 Flash や Flash-Lite 系も依然選択肢です。用途に対して「速度・品質・価格」のどれを取るかで選びましょう。

何が伸びたのか(コーディング・エージェント)

公式は「出力トークン/秒が他のフロンティアモデル比で4倍速」(比較表現で、絶対値は非公開)とし、難しいコーディング/エージェント系ベンチで前世代を上回るとしています。

ベンチ3.5 Flash3 Flash(前世代)
Terminal-Bench 2.176.2%58.0%
MCP Atlas(エージェント)83.6%62.0%
SWE-Bench Pro55.1%49.6%

NOTE

モデルカードの比較は主に Gemini 3 Flash(前世代)に対するものです。「3.1 Pro を上回る」という主張は MCP Atlas や Finance Agent などコーディング/エージェント系の一部ベンチに限った話で、あらゆる性能で上回るという意味ではありません。前世代の Flash 系はGemini 3.1 Flash(Live / TTS)も参照。

ツール利用(function calling・code execution・file search・structured outputs・search grounding・URL context など)に対応し、エージェント用途を意識した構成です。

Gemini 3.5 Pro の現状(GA ではない)

ここは取り違えやすいので明確に。

WARNING

Gemini 3.5 Pro はまだ一般提供(GA)されていません(2026年6月24日時点)。 I/O で「翌月(6月)にロールアウト予定」と予告され、現在は Vertex AI のエンタープライズ向け限定プレビューのみ。一般 API・AI Studio の通常モデルピッカー・消費者向けアプリには未提供です。

NOTE

追記(2026-10-07): 本追記時点でも、Gemini API の料金ページと changelog に Gemini 3.5 Pro は掲載されておらず、一般提供は確認できません。一方で9月30日には次世代の Gemini 4 Argon が発表されています(一般提供は未定)。

予告されている特長は 2Mトークンのコンテキストと Deep Think 推論。具体的な GA 日・モデルID・価格は公式未発表です(流れている価格は二次情報の推定)。「Pro が出た」という記述は現時点では誤りなので注意してください。

使い方

API ではモデルID gemini-3.5-flash を指定するだけです。AI Studio(Antigravity)や Vertex AI からも利用できます。バッチ(50%割引)・キャッシング・thinking レベル指定にも対応します。

オープンウェイト系と比べたい場合は、コーディング特化のGLM-5.2や、軽量・拡散方式のDiffusionGemmaも合わせてどうぞ。

その後の動き(2026年10月時点)

3.5 Flash の後、Flash 系は短い間隔で更新され、価格はむしろ下がる方向に動いています(Gemini API changelog、料金ページ)。

  • 7月21日: Gemini 3.6 Flash(入力 $1.50 / 出力 $7.50)と最安枠の Gemini 3.5 Flash-Lite(入力 $0.30 / 出力 $2.50)が GA。詳細は Gemini 3.6 Flash の記事
  • 8月13日: Gemini 3.7 Flash が GA。導入価格は2026年12月31日まで入力 $0.75 / 出力 $3.75 で、3.6 Flash にも同じ導入価格が適用
  • 9月2日: Gemini 3.8 Flash が GA(価格は 3.7 Flash と同じ導入価格)
  • 9月30日: Gemini 4 Argon を発表(一般提供は未定)

3.5 Flash 自体は引き続き GA モデルとして入力 $1.50 / 出力 $9.00 で提供されていますが、年内は後継の 3.6〜3.8 Flash のほうが単価は安くなっています。新規に組むなら後継モデルとの比較から始めるのが現実的です。

まとめ

  • Gemini 3.5 Flash は2026年5月19日に GA。gemini-3.5-flash、1Mコンテキスト、4段階 thinking、知識カットオフ2025年1月
  • コーディング/エージェント系ベンチで前世代を大きく改善(Terminal-Bench・MCP Atlas など)。「4倍速」は対フロンティアの比較表現
  • 価格は 入力$1.50 / 出力$9.00。ただし 前世代 Gemini 3 Flash の3倍なので、コスト重視は下位 Flash も検討
  • Gemini 3.5 Pro は未 GA(限定プレビュー)。2Mコンテキスト・Deep Think は予告段階で、GA日・価格は未発表

速くて賢い Flash が一段強くなり、エージェント用途の選択肢が増えました。ただし値上げと Pro 未提供は要注意。まずは Flash を実タスクで試し、Pro は GA を待つ、が現実的な構えです。

参考リンク

Gemini 4 Argon 最新事情 - サイバー防御者から段階公開される Google の新フロンティアモデル

Gemini 4 Argon 最新事情 - サイバー防御者から段階公開される Google の新フロンティアモデル

約12分

Google が2026年9月30日(米国時間)に発表した Gemini 4 Argon を公式ブログで整理します。出力上限は64Kから1Mトークンへ、DeepSWE v1.1 で77.9%、導入価格は入力$2・出力$10。一般公開は未定で、まず Fairwind Program のサイバー防御者へ配られる理由、安全対策、社内でのRust移行事例、開発者が今できることまでまとめます。

Gemini 3.6 Flash 最新事情 - 3.5 Flash-Lite / Flash Cyber 同時発表と Gemini 4 予告

Gemini 3.6 Flash 最新事情 - 3.5 Flash-Lite / Flash Cyber 同時発表と Gemini 4 予告

約17分

Google が2026年7月21日に発表した Gemini 3.6 Flash / 3.5 Flash-Lite / 3.5 Flash Cyber の3モデルを一次ソースで整理します。今回 3.5 Pro は無し、Gemini 4 の事前学習開始を予告。約1Mコンテキスト、入力$1.50・出力$7.50、ナレッジカットオフ2026年3月、出力トークン約17%削減、reasoning effort と並列ツール、提供面までまとめます。

Google ToolGrad とは何か - 「答えから先に作る」ツール利用データ生成の仕組みと実力

Google ToolGrad とは何か - 「答えから先に作る」ツール利用データ生成の仕組みと実力

約16分

Google Research が2026年9月10日にブログで紹介した ToolGrad は、LLM にツール呼び出しを学習させるためのデータを「実際に動くツール呼び出しの連鎖を先に組み立て、あとから質問文を付ける」answer-first 方式で生成するフレームワークです。TextGrad 由来の「テキストの勾配」という考え方、Proposer / Executor / Selector / Updater の4ステップ、生成成功率 99.8%、Gemma 3 ベースの ToolGrad-12B が BFCL で Gemini 2.5 Pro に 0.1 差まで迫った結果、公開されているコード・データ・モデル、著者が認める限界までを論文と公式ブログを一次ソースに整理します。