AI推論市場は静かに根底から再編されつつある。2つの分散型プラットフォーム、ChutesとSurplus Intelligenceは、AIモデルを実行するコストを下げることで、オンチェーン推論リクエストのより大きなシェアを獲得している。
Bittensorのサブネット64上に構築されたChutesは、累計で34兆トークン以上を処理し、1日あたりのピークは1200億トークンを超えています。2か月前にリリースされたSurplus Intelligenceは、すでに250万件のリクエストと1070億トークンの入力トークンを記録しています。これらは、本質的にはコモディティ計算であるものを、中央集権的なAIプロバイダーが高額で提供しているという、拡大する思想を表しています。
どのようにしてChutesがデフォルトになったか
チャーツは2025年1月下旬に、分散型サーバーレス推論プラットフォームとして一般公開されました。余剰のグラフィックカードを持つ独立したマイナーが、オンデマンドでオープンソースのAIモデルを提供し、ユーザーは処理されたトークンごとに料金を支払います。
価格が物語を語っています。Chutesは、特定のモデルについて、100万トークンあたり単数桁のセントで料金を設定しており、同等のワークロードに対して中央集権的な代替品が通常請求する料金の一部です。
ローンチ後のマネタイズ開始後、日次トークンスループットは1200億の数字まで上昇しました。プラットフォームは許可不要なGPUマイナーを使用し、容量、速度、可用性に基づいてスコアリングを行い、最もパフォーマンスの高いハードウェアがより多くのジョブを獲得できる競争的なマーケットプレイスを実現しています。
セキュリティは、信頼できる実行環境(TEE)を通じて処理されます。これらは、ハッシュを処理するマイナーからでもデータを保護するハードウェアレベルの隔離領域です。ハードウェアの検証は、GraValテクノロジーと呼ばれる仕組みを通じて実行され、マイナーが実際に主張するGPUを実行していることを確認します。
すべての決済はUSDCでオンチェーンで行われ、請求サイクルや支払条件は一切ありません。
Surplus Intelligenceの爆発的な2か月
Surplus Intelligenceは2026年5月下旬に、未使用のAI推論能力のマーケットプレイスとしてデビューし、計算リソースの買い手と売り手が直接やり取りする注文板です。
2026年5月下旬、Surplusは47,000件のリクエストと17億個の入力トークンを処理しました。2026年7月下旬には、これらの数値は250万件のリクエストと1,070億個のトークンに急増し、2か月で約50倍の増加となりました。
Surplusは、従来の推論プロバイダーと比較してユーザーの貯蓄が40〜60%増加すると報告しています。マーケットプレイスモデルにより、実際の需給に基づいて価格が調整される動的価格発見が可能になります。Chutesと同様に、SurplusはオンチェーンでUSDCで決済されます。
両プラットフォームの違いは、供給へのアプローチにあります。Chutesは、パフォーマンス指標で評価される無許可ネットワークにGPUマイナーを募集します。Surplusは、過剰な推論能力を持つエージェントとそれを必要とするエージェントを結びつける、より二次市場に似た仕組みを採用しています。
これはAIコンピューティング市場にどのような意味を持つのか
ビットテンソルのエコシステムにおいて、チャーツのSubnet 64に対する保有資産は、TAOの実用性を強化しています。サブネットが1日1200億トークンを処理している場合、トークン経済は将来の採用に関する推測ではなく、実際のスループットに基づいています。
分散型インフラのリスクは信頼性です。集中型プロバイダーはSLA、専用サポート、保証されたアップタイムを提供します。無許可のマイナーネットワークは低価格と検閲耐性を提供しますが、マイナーが推論中にオフラインになることは、AWSリージョンがダウンするのとは異なる失敗モードです。
これらのプラットフォームは主にオープンソースモデルを対象としています。OpenAIやAnthropicのプロプライエタリなフロンティアモデルを必要とするワークロードの場合、分散推論はまだ選択肢ではありません。

