メインコンテンツへスキップ
AI News 20分で読める

Gemini 3.8 Flash 完全解説|価格据え置きでも実コスト4割増の思考トークン問題

この記事はこんな人におすすめ
  • Gemini APIを業務で使うエンジニア・プロダクトマネージャー
  • 3.7 Flashから3.8 Flashへの乗り換えコストを試算したい開発者
  • コーディングエージェントのインフラコスト最適化を担当するチームリード
  • セキュリティ研究者でGemini 3.8 Flash Cyberへのアクセスを検討している方

「出力トークンの73%が思考ぶんだった」。2026年9月3日、Qiitaに投稿されたこの記事がX(旧Twitter)で急速に拡散した。投稿者はGemini 3.8 FlashのAPIを翌日に実測し、課金対象となる出力トークンの大半が人間には見えない内部推論に消えていた事実を確認した(出典:Qiita「Gemini 3.8 Flash を GA 翌日に実測、課金される出力トークンの73%が思考ぶんだった」、2026年9月3日)。

表面上の価格は前世代の3.7 Flashと同額だ。しかしモデルが「考えるほど」課金が増える構造で、Googleが「6週間で3度目のFlashリリース」を行った今回の実態は、単純な価格比較では測れない。

3分でわかる結論

Gemini 3.8 Flashは、DeepSWEやValS Finance Agentなど特定の専門タスクでClaude Opus 5を上回るコーディング・エージェント向けモデルだ。価格は3.7 Flashと同額($0.75/$3.75、1Mトークンあたり)だが、思考トークンが出力の73%を占めるため実コストは体感で3〜4割増になりやすい。さらに2027年1月1日から価格は2倍になる。Gemini 3.8 Flash Cyberは脆弱性発見特化の招待制バリアントで一般利用不可。

6週間で3度目の更新、何が変わったのか

2026年8月13日にGemini 3.7 Flashがリリースされて3週間後、Googleは3.8 Flashを投入した。英国メディアThe Registerはこれを「4か月で4本目のFlash」と表現し、「ブレークスルーではなく反復的な改良」と評した(出典:The Register「With Gemini 3.8 Flash, Google reminds everyone it’s still in the race」、2026年9月2日)。

Googleが公式に認めている事実がある。3.8 Flashは「Gemini 3.7 Flashをベースにしたモデル」であり、基盤アーキテクチャは同じだ。今回の向上はファインチューニングと推論最適化による(出典:Google Blog「Introducing Gemini 3.8 Flash and 3.8 Flash Cyber」、2026年9月2日)。

並行して、Hacker News(HN)のスレッドではコミュニティの反応が割れた。「もうProモデルを待つ気力がない、Flashだけが走り続けている」「Googleが内部でGemini 3.5 Proを断念したという噂が出て以来、更新ペースへの信頼が揺らいでいる」という冷めたコメントが上位に並んだ(出典:Hacker News「Gemini 3.8 Flash and 3.8 Flash Cyber」、2026年9月2日)。

ベンチマーク: 本当にフロンティア級か

では数字は何を語るか。Googleが公表したベンチマーク結果と、Vellum.aiやEmergent.shによる第三者集計を突き合わせた(出典:Vellum.ai「GPT-6 Astra Benchmarks Explained」、Emergent.sh「Gemini 3.8 Flash Benchmarks」、2026年9月)。

ベンチマークGemini 3.8 FlashGemini 3.7 FlashClaude Opus 5
DeepSWE v1.173.7%65.3%74.0%
Terminal-Bench 2.189.4%85.8%—
Terminal-Bench 4.019.1%11.2%51.8%
Vals Finance Agent v261.4%—劣後
Harvey Legal Agent10.0%—劣後
HLE-Verified54.9%—劣後

コーディングと専門タスクでは3.7 Flashから大幅に向上し、一部でClaude Opus 5に迫る数字が出ている。一方でTerminal-Bench 4.0(より難しいCLI操作の精度)ではOpus 5の51.8%に対して19.1%と大きな差がある。「専門タスクで尖っている、万能ではない」というのが正確な見立てだ。

注目すべきはDeepSWE v1.1のスコアだ。この73.7%はClaude Opus 5の74.0%にわずか0.3ポイント差まで迫っている。にもかかわらず価格差は約6.7倍(3.8 Flashが$0.75/$3.75、Opus 5が$5.00/$25.00)だ。コーディングエージェントの文脈では、コスト効率の観点からGemini 3.8 Flashを選ぶ合理的な理由がある(出典:OpenRouter 比較「Claude Opus 5 vs Gemini 3.8 Flash」)。

「価格据え置き」の落とし穴:思考トークンの罠

ここが今回の核心だ。Gemini 3.8 Flashは「推論を強化したモデル」であり、デフォルトで中程度の思考量(medium thinking)が有効になっている。その結果、出力トークンの大部分が「thinking tokens」と呼ばれる内部推論トークンになる。

Qiitaの実測によれば、出力の約73%が思考トークンだった(出典:Qiita「Gemini 3.8 Flash を GA 翌日に実測」、2026年9月3日)。これはAPIのレスポンスボディには含まれず、ユーザーの目には届かない。しかし課金は発生する。

ai-revolution.co.jpの試算では「価格据え置きでも実コスト約4割増」との結論が出ている(出典:AI革命メディア「Gemini 3.8 Flashとは?価格据え置きでも実コスト約4割増」、2026年9月)。Artificial Analysisのインデックスでは、3.8 Flashは中央値モデルが71Mトークンを使うタスクで120Mトークンを消費したというデータもある(出典:CloudZero「Gemini pricing in 2026: every model, every plan, and the thinking tokens nobody budgeted for」)。

思考トークンへの対処法

APIリクエスト時に thinkingConfig.budgetTokens を明示的に設定することで思考トークンの最大量を制限できる。コスト効率を優先する用途では、budgetTokensを小さく設定するか、3.7 Flashを継続利用する判断も合理的だ。思考を完全にオフにするオプションは現時点では確認されていない(2026年9月時点、公式ドキュメント要確認)。

Gemini 3.8 Flash Cyber:Fairwindプログラムの全容

Gemini 3.8 Flash Cyberは、脆弱性発見と自動パッチ生成に特化したセキュリティ特化バリアントだ。Google ChromeのバグフィックスでGoogleの内部計測では競合比2.6倍の精度を示したという(出典:Tech-Insider.org「Gemini 3.8 Flash Cyber Beats Rivals 2.6x on Chrome Bugs」、2026年9月)。

ただし、このモデルには一般ユーザーはアクセスできない。アクセスは「Fairwindプログラム」経由の招待制で、2026年9月時点で承認されているのは約650アカウントのみだ(出典:Security Boulevard「Google Launches Fairwind Program for Gemini 3.8 Flash Cyber Access」、2026年9月)。

Fairwindプログラムの優先対象は次のとおりだ(出典:deepmind.google Fairwind Program)。

  1. 政府機関・サイバー当局
  2. 医療・通信・エネルギー・金融の重要インフラ事業者
  3. 主要テクノロジープラットフォーム(OS・ブラウザ等のメンテナー)
  4. 承認済みセキュリティチーム(ペネトレーションテスト、インシデント対応)

参加には利用状況の記録・管理義務があり、「承認済み脅威シミュレーション・リバースエンジニアリング・防衛目的のマルウェア分析のみ」という用途制限も設けられている。これはOpenAIが同様の制限をCyberSec向けモデルに課した設計と同じ方向性だ。

X(旧Twitter)のセキュリティコミュニティでは「企業のペンテスターとして申請したが審査が長い」という声が複数上がっており、承認プロセスの不透明さへの不満も見られる(出典:Memeburn「Gemini 3.8 Flash Is Live, and the Community Is Not Impressed」、2026年9月)。

価格:2027年1月の崖を見据えた判断

Gemini 3.8 Flashの料金は次のスケジュールで変化する(出典:Google 公式Gemini API価格表、eesel AI「Gemini 3.8 Flash pricing 2026」)。

期間入力(/1Mトークン)出力(/1Mトークン)
〜2026年12月31日$0.75$3.75
2027年1月1日〜$1.50$7.50

値上げ幅は入出力ともに2倍だ。プロモーション価格の終了は前世代でも行われており、Gemini 3.5 FlashもGAから数か月で価格が変動した。大量APIコールのサービスを運営している場合、2027年1月の変更前に予算計画を見直すことを推奨する。

比較対象として、AIモデル価格戦争の解説記事でも整理しているが、2026年秋時点でFlash系モデルは「コスト効率最優先」の定番になりつつある。ただし、思考トークンが課金に乗るモデルでは単純な価格比較では判断を誤るリスクがある点を再強調しておく。

Gemini 3.8 Flash vs 3.7 Flash:用途別の使い分け

以下の基準で選択を整理した。

Gemini 3.8 Flashが向いている用途

  • コーディングエージェントのバックエンド(DeepSWE 73.7%という数字が示す精度重視の場合)
  • 金融・法務ドメインの専門タスク(Vals Finance 61.4%、Harvey Legal 10.0%のスコアが参照値)
  • 音声・動画入力を含むマルチモーダルパイプライン(Claude Opus 5は2026年9月時点で音声・動画入力に対応していないとされる)
  • 長大なコンテキスト処理(1Mトークン窓)

Gemini 3.7 Flashのままで十分な用途

  • 大量の短いシンプルなAPI呼び出し(思考トークンのオーバーヘッドが不利になる)
  • レイテンシが最優先で、推論精度よりスループットが重要なケース

Claude Fable 5.1を選ぶべき用途

  • Terminal-Bench 4.0(51.8% vs 3.8 Flashの19.1%)に象徴される、複雑なマルチステップCLI操作
  • 長文の高品質な文書生成(出力上限が64KのFlashより128KのOpus系が有利)

Gemini 3.5 Flashレビュー記事でも触れたが、Google Flashシリーズは「専門タスクの精度」でフラッグシップに追いつきながら価格を抑えるという戦略を一貫している。3.8 Flashはその延長線上にある。

3.7 Flashとの現実的な使い分け

3.8 Flashの優位性はコーディング・金融・法務の特定ベンチマークに集中している。「とりあえず全部3.8に乗り換える」より、コスト計測と合わせて段階的な移行を推奨する。budgetTokens設定で思考量を制御しながら、実際のユースケースでのコスト対効果を測定してから本番環境への適用を判断するのが現実的だ。

AIモデルの価格戦争 2026年版

Gemini・Claude・GPT-6のAPI価格を徹底比較。コスト最適化のモデル選定指針を整理した解説記事。

価格比較記事を読む

Gemini 3.8 Flash まとめ:乗り換えチェックリスト

Gemini 3.8 Flashは、「価格は据え置き、でもコストは上がる」というトレードオフを内包したモデルだ。DeepSWEやVals Finance AgentでのClaude Opus 5との僅差の戦いは本物だが、それはデフォルトで有効になっている思考機能がトークンを大量に消費することで実現されている。

表面的な価格だけを見てコスト試算すると予算を超える可能性がある。budgetTokens制御、用途別の選定、2027年1月の価格変更を組み合わせて計画を立てるのが、このモデルと正しく付き合う方法だ。

Gemini 3.8 Flash Cyberは脆弱性発見で実測スコアを出しているが、650アカウント限定のFairwindプログラムを通じる限り、大多数の開発者には今しばらく縁遠い存在だ。


関連記事


本記事の情報は2026年9月11日時点のものです。料金・仕様は予告なく変更される場合があります。投資・業務判断は公式情報と最新ドキュメントを必ずご確認ください。

Share