この記事について海外で公開された情報をもとにAIが要約・解説した記事です。原文の翻訳ではありません。正確な内容は記事末尾の出典元をご確認ください。
この記事の要点
  • 6週間で3つ目。通常版と脆弱性検知特化版の2モデルを発表
  • コーディング課題のDeepSWEで首位。3.7 Flashからも向上
  • APIは導入価格が年末まで。通常版はAI Studioで無料試用可

発表された2つのモデル

Googleは2026年9月2日、Gemini Flashシリーズの新モデルとして「Gemini 3.8 Flash」と、同じ基盤を脆弱性検知向けに調整した「Gemini 3.8 Flash Cyber」を発表した。標準版はエージェント的なタスクからソフトウェア開発まで幅広く扱える「働き者」的な位置づけとされる。一方、Cyber版は脆弱性の発見と対策に特化しており、現段階では信頼済みテスターと政府機関向けに限定されている。

今回の発表は、6週間の間に行われた3回目のFlashモデルリリースとなる。Googleは以前から上位モデルのGemini 3.5 Proに言及していたが、今回の発表により、Proを待たずにFlashの改良を続ける姿勢が鮮明になったとみられる。Google自身はGemini 3.8 Flashを「これまでで最高の推論・コーディングモデル」と説明している。

コーディング性能と評価

Googleが公表したベンチマークによると、Gemini 3.8 Flashは前モデルのGemini 3.7 Flashから、多くのテストでわずかな改善を示し、コーディング系の評価では改善幅が大きい。具体的には、複雑なソフトウェアエンジニアリング課題を解くDeepSWEのリーダーボードで首位に立ったとされる。しかも、現在の割引価格ではより低いコストでその結果を達成している。

一方、コンピューター操作エージェントの性能を測るOSWorld-2.0では、3.7 Flashからは改善したものの、市場リーダーとされるClaude Opusには依然として差がある。同じテストではGPTもあまり良い成績ではないとされており、コンピューター操作の分野はGoogleにとって課題が残る領域のようだ。

API料金と提供条件

開発者向けのAPI料金は、前回の3.7 Flashと同じ構成だ。年末までは導入価格として、入力トークン100万個あたり0.75ドル、出力トークン100万個あたり3.75ドルで提供される。通常価格はそれぞれ1.50ドルと7.50ドルで、値上がりが予定されている。ただし、記事ではその前に新しいモデルが登場する可能性も示唆されている。今回の価格設定は、他社がトークン価格を引き下げている流れを踏まえた措置とみられる。

利用方法については、Gemini 3.8 Flashは発表当日からGoogleの各サービスで利用できる。Geminiアプリで使うにはProまたはUltraのサブスクリプションが必要だが、AI Studioなら無料で試せる。Cyber版については現状、一般向けではなく、信頼済みテスターと政府機関に限定されている。

サイバー特化版の実力と限界

Gemini 3.8 Flash Cyberは、前モデルに当たるCyber 3.5を置き換えるものだ。Googleの内部テストでは、従来モデルより多くの脆弱性を検出し、動作するパッチを高い頻度で発行できたとされる。Chromeのセキュリティチームではパッチの正確さが2.6倍に向上し、Cloudチームは新モデルが2時間で重大な脆弱性を発見したと報告している。WizやPalo Alto Networksも能力を評価しているという。

ただし、こうした結果は主にGoogleや提携先の報告によるものであり、記事では「この数字が現実を反映しているかどうか」に注意を促す向きがある。Cyber版は現時点で信頼されたテスターと政府に限定されており、一般の開発者がすぐに試せる状況にはない。

Gemini 3.8 Flash APIの料金体系
項目導入価格通常価格
入力トークン100万個あたり0.75ドル100万個あたり1.50ドル
出力トークン100万個あたり3.75ドル100万個あたり7.50ドル
適用期間今年末までその後
原文からの引用
There’s the standard Flash, which Google describes as a “workhorse” model that’s good for anything from agentic tasks to software development.

標準版のFlashは、Googleが「働き者」モデルだと説明するもので、エージェント的なタスクからソフトウェア開発まで何にでも使える。

今後の見通し

今回の発表で、Gemini 3.5 Proがすぐに出る可能性は低くなったとみられる。Flashシリーズのコーディング能力がDeepSWEで上位を示したことで、上位モデルなしでも一定の競争力を保てるかが焦点になるだろう。今後は、Gemini 3.8 Flashのベンチマーク結果が第三者による検証で再現されるかどうか、通常価格への移行時期までに後継モデルが登場するかが判断材料になる。また、OSWorld-2.0の結果に見えるように、コンピューター操作のエージェント分野でClaude Opusなどとの差をどこまで詰められるかも注目点だ。

日本の開発者・IT企業にとっての意味

日本のIT企業にとっては、APIの導入価格が下がり、コーディング性能が高いモデルを低コストで試せるようになった点が実務上の意味を持つ。開発支援ツールや社内業務の自動化、コードレビューの補助などに組み込む際の選択肢が広がる。Flashシリーズは比較的軽量・高速なモデルとされ、コスト重視のPoCなどにも向くとみられる。ただし、ベンチマークの結果が実際の開発現場で再現されるかは別問題であり、導入前に自社のコードベースで評価することが重要だ。Cyber版は一般提供が限定的だが、セキュリティ診断や脆弱性対応の自動化に関心がある企業は、特定分野での活用可能性を注視するとよい。

気になる点

Gemini 3.8 Flashは誰でも使えるのか?
一般向けには、AI Studioで無料で試せる。Geminiアプリで使うにはProまたはUltraのサブスクリプションが必要。Cyber版は信頼済みテスターと政府機関に限定されており、一般の開発者はまだ対象外だ。
APIの料金はいくらか?
年末までは入力100万トークンあたり0.75ドル、出力100万トークンあたり3.75ドルの導入価格。通常価格はそれぞれ1.50ドルと7.50ドル。円換算額は為替によって異なるため、実際の費用は公式情報での確認が望ましい。
Gemini 3.7 Flashと何が違うのか?
公表されたベンチマークでは、全体的な性能は小幅な改善で、コーディング課題の評価で改善幅が大きいとされる。DeepSWEでは首位に立った一方、OSWorld-2.0では改善したもののClaude Opusには届いていない。

用語解説

フロンティアモデル
AIの能力で最先端を目指す大規模モデル。汎用性や推論性能が特に高いとされる。
トークン
AIがテキストを処理する際の単位。英語なら1単語が約1〜数トークンになる。
DeepSWE
複雑なソフトウェアエンジニアリング課題をAIが解決できるかを測るベンチマーク。
OSWorld-2.0
AIエージェントが実際のコンピューターやブラウザを操作できるかを評価する環境。
脆弱性
ソフトウェアやシステムに存在するセキュリティ上の弱点。攻撃に悪用される恐れがある。

出典

Google releases Gemini 3.8 Flash, its third Flash model in six weeks

Ars Technica / Ryan Whitwam / 2026年9月3日

https://arstechnica.com/ai/2026/09/google-releases-gemini-3-8-flash-its-third-flash-model-in-six-weeks

AI導入も顧問も、お任せください

何から手をつけるか、どこまでAIに任せるか。自社の業務に合わせて整理し、導入から運用まで伴走します。相談だけでも構いません。

AI導入について相談する