Googleは、すでに急激に進展している市場に、新たに2つのAIモデルを投入しました。Gemini 3.6 Flashと3.5 Flash-Liteは2026年7月21日、Gemini API、Google AI Studio、および関連プラットフォームを通じてリリースされ、開発者にAIスタックの見直しをさらに促すきっかけとなりました。
Gemini 3.6 Flashは、Googleが前任モデルと同等の知能を提供すると説明する一方で、著しく高速化され、コストも削減されています。特定のベンチマークでは、出力トークンが3.5 Flashモデルと比較して17%削減されています。英語版では、このモデルは同じタスクをより少ない計算リソースで完了するため、開発者のAPI利用料が直接的に安くなります。
3.5 Flash-Liteモデルは異なるアプローチを採用しています。このモデルは純粋なスループットを目的として設計されており、最大毎秒350トークンを出力可能です。これにより、3.5ファミリー全体で最も高速なモデルとなっています。その代償として、価格が高くなります。特定の構成では、Flash-LiteはベースのFlashモデルよりもコストが高く、速度がボトルネックであり、コストが問題ではないエージェント型および高ボリュームの使用ケースをターゲットとしています。
価格の参考として、2026年5月19日現在の3.5 Flashモデルは、入力トークン100万トークンあたり$1.50、出力トークン100万トークンあたり$9です。Flash-Liteバージョンは、一部のシナリオでその価格を上回り、汎用的な代替ではなく専門的なツールとして位置づけられています。
トークン使用量の17%削減は、ベンチマークスライド上の良い数値にとどまらない。1日に数百万回のAPIコールを実行して自動取引エージェントやリアルタイムリスク監視システムを動かす暗号資産プロジェクトにとって、これは運用コストの有意な削減を意味する。
Flash-Liteの秒間350トークンのスループットは、エージェント型AIの使用ケースに特に重要です。これらはプロンプトに反応するだけでなく、流動性プールを監視し、市場状況を分析し、取引を実行するような一連のアクションを自動で実行するシステムです。ここでは速度が非常に重要です。より速く思考できるモデルはより速く行動でき、暗号資産市場では、行動の速さが利益を得るか、フロントランニングに遭うかの違いとなります。
GoogleのFlash層に対する戦略は、高ボリュームでコストに敏感な市場セグメントを捉えることを目的としている。3.6 Flashは、最適なパフォーマンス対価比を求める開発者をターゲットにしている。一方、3.5 Flash-Liteは、純粋なスピードを必要とし、それに見合ったコストを支払う意欲のあるユーザーを対象としている。これら2つは、Googleのより強力で高価なモデル製品との競合を避けながら、幅広いユースケースをカバーしている。
