本文へスキップ
AIZOME
ニュース ・ ニュース速報

Google、Gemini 3.6 Flashなど新モデル群を発表 コスト重視の実装に影響

Google DeepMindが2026年7月21日、Gemini 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberの新モデル群を発表した。軽量・高速モデルの刷新は、AIを業務に組み込む際のコストと運用に直結する。

文: AIZOME編集部4分で読めます

30秒でわかる記事要約

  • Google DeepMindが2026年7月21日、高速・軽量な生成AI新モデル3種を発表した。
  • 汎用のGemini 3.6 Flashは出力トークンを17%削減しつつ品質を向上させた。
  • 3.5 Flash-Liteは入力0.30ドル/出力2.50ドル(100万トークン)と大幅低価格を実現。
  • セキュリティ特化の3.5 Flash Cyberは政府機関や信頼パートナー限定の提供とされた。
  • 最新モデル採用より、用途ごとにモデルを使い分ける設計力と運用体制が競争優位を左右する。

Google DeepMindは2026年7月21日、生成AI生成AI(Generative AI)生成AIとは、テキスト・画像・音声・コードなどのコンテンツを人間の指示(プロンプト)に応じて新しく生み出すAIの総称です。大量のデータから学習したパターンをもとに、質問への回答や文章作成、要約、翻訳などを自動で行います。ClaudeやChatGPT、Geminiが代表例です。詳しく見る →の新モデル群としてGeminiGemini(ジェミニ)GeminiはGoogle(Google DeepMind)が開発した生成AI・大規模言語モデル。テキストだけでなく画像・音声・動画なども扱えるマルチモーダル対応が特徴で、Googleの各種サービスや業務ツールと連携して利用できる。経営者にとってはChatGPTなどと並ぶ主要な選択肢の一つとなる。詳しく見る → 3.6 Flash、3.5 Flash-Lite、3.5 Flash Cyberを発表した。いずれも高速・軽量な用途を想定したモデルで、AIを日常業務に組み込む企業のコストと処理速度に直接影響する可能性がある。

何が起きたのか

Google DeepMindは公式ブログで、3つの新モデルを発表した。なお、その約3週間後の2026年8月前後には、上位版となるGemini 3.7 Flashも発表されている。

Gemini 3.6 Flash は3.5 Flashの後継にあたる汎用の高速モデルで、第三者評価機関Artificial Analysis Indexの指標によると、出力トークントークン(Token)トークンとは、AIが文章を処理する際の最小単位で、単語や文字の一部を指す。生成AIの利用料金はこのトークン数で計算されることが多く、入力・出力の文章量に応じてコストが変動する。詳しく見る →の使用量を17%削減しながら品質を高めたという。標準の価格は入力100万トークンあたり1.50ドル、出力100万トークンあたり7.50ドル。ただし、後述するGemini 3.7 Flashの発表に伴い、2026年12月31日までは3.6 Flashにも期間限定価格(入力0.75ドル/出力3.75ドル、100万トークンあたり)が適用されている。この期間限定価格の終了後、2027年以降は標準の1.50ドル/7.50ドルに戻る予定だ。

Gemini 3.5 Flash-Lite はさらに軽量・低価格なモデルで、前版の3.1系と比べてコード生成や長文処理の性能が向上したとされる。処理速度は出力350トークン/秒、価格は入力100万トークンあたり0.30ドル、出力100万トークンあたり2.50ドルと、3.6 Flashよりさらに低コストな設定になっている。

Gemini 3.5 Flash Cyber はセキュリティ用途に特化したモデルで、脆弱性の検出・修正を担う複数のCyberエージェントが協調して1件のレポートを作成する仕組みを持ち、セキュリティ関連ベンチマークベンチマーク(Benchmark)AIモデルの性能を共通の基準やテストで測定・比較する評価手法や指標のこと。推論力や言語理解など特定能力をスコア化し、モデル選定の判断材料になる。ただしスコアが高いことと自社業務での実用性が一致するとは限らず、経営者は数値を鵜呑みにせず自社の用途で検証する視点が求められる。詳しく見る →「CyberGym」で高い性能を示したという。ただし攻撃・防御の両方に転用しうる技術であることから、Google DeepMindは提供対象を政府機関および同社が信頼するパートナーに限定し、脆弱性修正ツール「CodeMender」経由の限定パイロット提供とする方針を明らかにしている。

3モデルとも発表当日の2026年7月21日から、開発者向け(Google AI Studio、Android Studio)、エンタープライズ向け(Gemini Enterprise Agent Platform)、一般ユーザー向け(Geminiアプリ、Google検索)に順次提供が始まっている。

経営者が押さえるべきポイント

第一に、コスト構造への影響だ。Flash系のような軽量モデルは、大量の問い合わせ処理や社内文書検索など、高頻度・大量処理の業務でコストを抑えやすい。3.5 Flash-Liteの価格(入力0.30ドル/出力2.50ドル、100万トークンあたり)は、汎用の高性能モデルと比べて大幅に安い水準であり、自社のAI利用が高性能モデル一択になっていないか、用途ごとにモデルを使い分ける設計を見直す契機になる。

第二に、モデルの多層化が進んでいる点である。用途別に複数モデルが提供される流れは、AI導入の判断を「どのモデルを使うか」から「どの業務にどのモデルを割り当てるか」へと変えつつある。選定の巧拙が運用コストを左右する。

第三に、3.5 Flash Cyberが示すセキュリティ領域への広がりだ。ただし提供対象は政府機関や特定パートナーに限定されており、一般企業がすぐに利用できるものではない。自社のセキュリティ運用に直接関わる話ではないが、AIがセキュリティの守り・攻めの両面に組み込まれていく流れとして注視する価値がある。

Gemini 3.6 Flashは、Geminiアプリ経由では国・地域を問わず(日本を含む)すべてのユーザーに提供されており、日本のユーザーもGeminiアプリから利用できる。ただし、Google AI StudioやEnterprise版など、各チャネル別の日本国内での提供開始日といった詳細は現時点では確認できていない。日本語での性能に関する詳細な情報も限られており、公式仕様の続報を確認すべきだ。

関連用語

関連する記事

日本企業78%がAI投資拡大、成果実感は世界に見劣り

アクセンチュアの2026年調査によると、日本企業の78%がAI投資拡大を予定する一方、全社的な成果の実感は13%と世界23%を下回る。投資意欲は世界並みでも、成果への転換と現場定着に課題が残る実態を経営者向けに解説する。

AIZOME編集部·

AIZOME Newsletter

世界のAIと、日本企業が考えるべきことを届けます。

AI経営に関する実践ログ・ノウハウ・ニュースの解釈を、不定期でメールにお届けします。