Google DeepMind、Geminiモデルの3つのアップグレードを発表し、Gemini 4の事前学習を開始

iconMetaEra
共有
AI summary icon概要
Google DeepMindは、コスト、速度、パフォーマンスに最適化された3つの新しいGeminiモデルのアップグレード——Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber——を発表しました。Gemini 3.6 Flashはコーディングタスクでのトークン使用量を65%削減し、価格を引き下げます。Flash-Liteは低コストで毎秒350トークンを処理します。Flash Cyberはサイバーセキュリティに焦点を当て、脆弱性ニュースを対象にし、システムの欠陥を検出・修復します。また、Googleは次期Gemini 4モデルのためのこれまでで最大規模の事前学習を開始し、新たなAI駆動ツールによってオンチェーンニュースに影響を与える可能性があります。
Google DeepMindが3つのGeminiモデルの更新を発表:主力モデルGemini 3.6 Flashはコーディングタスクで最大65%のトークン削減を実現し、入力1.5ドル、出力7.5ドル/百万トークンと価格がより安価になり、DeepSWEなどのテストで性能が大幅に向上。軽量モデルGemini 3.5 Flash-Liteは出力速度が秒間350トークンに達し、入力0.3ドル、出力2.5ドルと価格がさらに低く、複数のテストでより大規模なGemini 3 Flashを上回った。セキュリティモデルGemini 3.5 Flash Cyberは脆弱性修正に特化。Googleは同時に「過去最激進」とされる事前学習を開始し、目標はGemini 4の実現である。ユーザーにとっての核心的なメリットは、価格、トークン消費量、Agentの実行コストの全面的な低下である。

記事執筆者、出典:新智元

真金銭を投じてトークンを購入し、エージェントを構築する私たちにとって、今日の発表で最も実感できるのは一つの文字だけだ——値下げ。

一気に三連、グーグルは今回本当に本気を出した。

本日、Google DeepMindが一気に三枚の王牌を披露しました:

  • Gemini 3.6 Flash
  • Gemini 3.5 Flash-Lite
  • Gemini 3.5 Flash Cyber

より強力なマス、より高速な軽量版、専門のセキュリティスペシャリスト。

Geminiの3つの製品はすべて同じことを目指しています:本番環境で動作するAIエージェントを、より速く、より賢く、より安価にすること。

そして、同じ日に、グーグルはさらに大きな雷を落とした——

Google DeepMind「史上最激進なプリトレーニングが開始されました」、目標は次世代モデルGemini 4です。

一方でGeminiが三連発、他方でGemini 4がスタート。

グーグルが示したシグナルははっきりしている。AIという最終的なカードゲームは、いまだ始まったばかりだ。

グーグルが深夜に大攻勢、3種類のGeminiを一斉発表

ガーミニを3種類、順に解説します。

Gemini 3.6 Flash、トークンを65%削減

まず今回の真正的な「C位」であるGemini 3.6 Flashを見てみましょう。

今回の主な目玉は、巨省Tokenです。

Artificial Analysis Indexの計算によると、前世代の3.5 Flashと比較して、出力トークンが17%削減されています。

DeepSWEなどのコーディングベンチマークで、最大65%の削減が可能です。

発話が少ないだけでなく、複数ステップのタスクを完了するために必要な推論ステップやツール呼び出しも少なく、迂回する道が短いため、より速く、より節約できます。

さらに、Gemini 3.6 Flashはトークンを節約しながら、価格もさらに低くなりました:

入力1.5ドル、出力7.5ドル每百万トークン、3.5 Flashより安価。

より省力で、より安価で、さらにパフォーマンスも向上。これが真の诚意です。3.6 Flashは複数の主要テストで前世代を大きく上回りました——

  • DeepSWE:プログラミングテスト 37% ➔ 49%
  • MLE Bench:機械学習研究テスト 49.7% ➔ 63.9%
  • OSWorld-Verified:モデルがコンピューターを直接操作してテストした結果、78.4% ➔ 83%に向上
  • GDPVal-AA v2:知識型タスクが1,421件を完了し、前世代より70点以上高いです

以下のデモでは、3.6 Flashがマルチエージェント編成の優れた技術を発揮し、複雑なコード移行タスクを容易に完了するとともに、応答速度とコード品質において3.5 Flashを圧倒しています。

Gemini Canvasにより、3.6 Flashは3Dワークフローを統合し、すぐにプロフェッショナルな写真級テクスチャ抽出ツールを「手作業で作成」しました。

また「AIインタラクティブデザイナー」として、没入感たっぷりのテーマスタジオを簡単に構築できます。

3.5 Flash-Lite、老舗を上回る

第二款Gemini 3.5 Flash-Liteは別の道を歩み、スピードと低コストを強調します。

3.5 Flash-Liteの出力速度は毎秒350トークンに達し、3.5シリーズ中最速です。

価格も驚異的に低く、100万トークンあたり入力は$0.3、出力は$2.5です。

速く、安価で、大量のドキュメント処理やAgent検索のような高頻度・大量処理のシナリオに最適です。

最も驚異的なのは、自社の「大物」を逆に圧倒したことです。

複数のプログラミングおよびAgentテストで、この軽量なモデルはより大規模なGemini 3 Flashを上回りました——

  • SWE-Bench Pro:54.2%対49.6%
  • OSWorld認証:74.0% 対 65.1%

3.6 Flashが「主脳」としてタスクを分解し、Flash-Liteが「分身」として一括して作業を実行。

考えるのは一人、実行するのは多数で、高並列負荷を簡単に軽減します。

公式デモでは、Flash-Liteが一気に25の高可用性ウェブデザイン案を一括生成し、その速度は「考えた瞬間に一括出力」するほどです。

Flash-LiteはすでにGeminiアプリでリリースされ、今後Google検索にも順次追加されます。

Flash Cyber:脆弱性を修正できるが、誰でも使えるわけではない

Gemini 3.5 Flash Cyber、ネットセキュリティに特化したハードコアモデル。

その任務は一つだけです:脆弱性を見つけて修正すること。

現在の現実として、AIが脆弱性を見つける速度が、既存のシステムが脆弱性を修正する速度を上回っている。

GoogleはこのモデルをコードセキュリティエージェントCodeMenderに組み込み、複数のCyberエージェントが協力して、セキュリティベンチマークCyberGymでSOTAを更新し、より大きなモデルよりもコストを削減しました——

より軽量なモデルで、最も精度が求められるタスクをこなす。

ただし、このモデルは一般のユーザーには現在アクセスできません。

Gemini 4がスタート 史上最も激進的な事前学習

Gemini 3.5 Proはまだ手に入れていないが、Gemini 4のトレーニングも始まっている。

今回の三連発はあくまで前菜に過ぎませんが、最終的に発表された一文が本当のメインイベントです。

Googleは、内部で史上最も積極的な事前学習を開始し、目標はGemini 4であることを確認しました。

大物は、Googleの通常の6か月トレーニングペースに従えば、今年の年末にはGemini 4が登場している可能性があると述べた。

真金銭を投じてトークンを購入し、エージェントを構築する私たちにとって、今日の発表で最も実感できるのは一つの文字だけだ——値下げ。

価格が下がり、トークン消費量が減り、エージェントを実行するコストが低下しました。

遅れてくる旗舰と、剛剛啟動的Gemini 4,都還是「期貨」。

今日あなたのウォレットに詰め込めるのは、使える上に安いものだけです。フラッグシップがどれほど強力でも、まずは実現しなければなりません。

免責事項: 本ページの情報はサードパーティからのものであり、必ずしもKuCoinの見解や意見を反映しているわけではありません。この内容は一般的な情報提供のみを目的として提供されており、いかなる種類の表明や保証もなく、金融または投資助言として解釈されるものでもありません。KuCoinは誤記や脱落、またはこの情報の使用に起因するいかなる結果に対しても責任を負いません。 デジタル資産への投資にはリスクが伴います。商品のリスクとリスク許容度をご自身の財務状況に基づいて慎重に評価してください。詳しくは利用規約およびリスク開示を参照してください。