Gemini 3.6 FlashとAI値下げ競争

AI最新動向

この記事のポイントをスライドでも解説しています

別ウィンドウで開く

Gemini 3.6 Flashとは?トークン消費17%減の新モデル登場

携帯電話, スマートフォン, hohenzollern城, 城, メタバース, バーチャルリアリティ
Photo by FunkyFocus on Pixabay

Gemini 3.6 Flashとは、Googleが2026年7月21日に発表した、AIエージェントの業務処理を効率化する新しい生成AIモデルです。

今回のアップデートの主役は「賢さ」よりも「効率」です。Googleは前モデルの3.5 Flashと比べて出力トークン数を17%削減し、コーディングやエージェント作業に必要な思考ステップやツール呼び出しの回数も減らしたと発表しました。つまり、同じ作業をより少ないコストと時間でこなせるようになった、ということです。

具体的な数値を見てみましょう。コーディング性能を測るDeepSWEベンチマークでは37%→49%(ベンチマークによっては最大65%減という報告も)、知識労働タスクを測るGDPval-AAでは1349→1421、コンピュータ操作の精度を測るOSWorld-Verifiedでは78.4%→83%まで向上しています(Google公式発表より)。価格も、出力トークン100万あたり9ドルから7.5ドルに引き下げられました。

  • Gemini 3.6 Flash:コーディング・エージェント向けの主力モデル。出力トークン17%削減、価格は入力1.50ドル/出力7.50ドル(100万トークンあたり)
  • Gemini 3.5 Flash-Lite:高速・低コスト特化。出力速度は350トークン/秒
  • Gemini 3.5 Flash Cyber:サイバーセキュリティ特化、コード修正エージェント「CodeMender」と連携

ちなみに本命とされる3.5 Proはまだパートナー企業とのテスト中で、正式公開は先送りが続いています。その裏で、次世代のGemini 4の事前学習はすでに始まっているそうです。開発の手を止めずに「今出せるものから磨いて出す」姿勢、私は好きです。

現場太郎

トークン消費が減るって言われても、正直ピンとこないんですけど…結局、何がお得になるんですか?

よしなか

ええ質問やね。トークンいうのはAIが処理する文字の単位やから、それが減るいうことは、単純に「同じ仕事をより安く・より速くできる」いうことやで。

現場太郎

なるほど、時間もお金も両方浮くってことですね。

よしなか

そういうこと。しかもGeminiは考える回数、つまりツール呼び出し自体も減らしてるから、待ち時間も短くなる。地味やけど実務ではめちゃくちゃ効くポイントやで。

AIの値下げ競争は何を意味する?GPT-5.6 Lunaが3週間で80%オフに

携帯電話, スマートフォン, キーボード, アプリ, インターネット, 通信網, 社会的ネットワーク, ロゴ, フェイスブック, マーケティング, 分析, 概念, ソーシャルネットワーキング, ネットワーキング, 社会的なメディア, アイコン, webサイト, マルチメディア, スマートフォン, スマートフォン, スマートフォン, スマートフォン, スマートフォン, アプリ, インターネット, インターネット, インターネット
Photo by geralt on Pixabay

OpenAIは2026年7月30日、GPT-5.6シリーズの廉価版モデル「Luna」の価格を、わずか3週間で80%も引き下げました。これは単なる値下げではなく、AI業界全体で「性能より効率」の競争が始まった証拠だと私は見ています。

モデル

位置づけ

価格改定

Luna

Solの85%程度の品質

80%値下げ(1/6ドル→0.20/1.20ドル)

Terra

中間グレード

20%値下げ(→2/12ドル)

Sol

最上位フラッグシップ

据え置き(5/30ドル)

背景には中国発モデルの台頭があります。2026年7月7日のCNBCの調査によると、OpenRouter上の米企業のトークン利用のうち46%が中国モデルに流れているとのことです。DeepSeek V4 Proは100万トークンあたり0.435ドル/0.87ドル(期間限定75%割引込み)、Kimi K3も3ドル/15ドルと、OpenAIより大幅に安い価格で攻勢をかけています(Yahoo Finance記事より)。

正直、このニュースを見て「時代が変わったな」と思いました。数ヶ月前まで「どのAIが一番賢いか」で語られていた業界が、今は「同じ品質をどれだけ安く出せるか」の勝負になっている。これは、これから導入する私たちにとっては間違いなく追い風です。

現場太郎

値下げって聞くと、逆に不安になります…安かろう悪かろうなんじゃないですか?

よしなか

その気持ち、めっちゃ分かるわ。でもこれは「性能落として安くした」んやなくて、「同じ性能をより効率的に出せるようになったから安くできた」いう話やねん。

現場太郎

じゃあ、単純にお得になっただけってことですか。

よしなか

そういうこと。しかも競争が激しいから、この流れはまだまだ続くで。今まで「AIはコストが心配で…」言うてた会社さんも、そろそろ本気で検討するタイミングやと思うわ。

で、私たちは何をすればいいのか

サムスン, 電話, 音楽, 再生, イヤホン, 音楽を聴く, 聞く, google, デザイン, デジタル, モバイル, アンドロイド, テクノロジー, デバイス, ガジェット, 音楽, 音楽, 音楽, 音楽, 音楽, イヤホン, イヤホン
Photo by Firmbee on Pixabay

私は実際に、ブログ記事のリサーチや下書き作成の一部をエージェント的なワークフローで回しています。以前は複数のツールを行ったり来たりしながら10ステップ近くかかっていた作業が、効率化されたモデルに切り替えてから6〜7ステップで完了するようになりました。体感で、作業時間はおよそ半分です。大げさな話ではなく、モデルの「効率」が上がったことのシンプルな効果だと思います。

こういうニュースを見るたびに思うのは、AIが安く・速くなるほど、私たちが「作業」に費やす時間はどんどん減っていくということです。だったら、その空いた時間で何をしますか。請求書の入力や議事録の整理はAIに任せて、あなたにしかできない仕事、あなたが本当に得意なことに時間を使う。それが、つむぎやが目指す「好きと得意で社会貢献する」働き方です。あなたの得意なことは何でしょうか。一度、立ち止まって考えてみてください。

「どのモデルを、どう使い分ければいいか分からない」という方には、実践的な使い方を体系的に学べる研修もご用意しています。

GeminiやGPTの値下げ競争は、AI導入のハードルがどんどん下がっているサインです。この波に乗り遅れないよう、自社の業務でどこから自動化できるか、一緒に考えてみませんか。ご相談はつむぎや株式会社まで、お気軽にどうぞ。

無料相談