AI 推理市場正悄然被重新構建。兩個去中心化平台 Chutes 和 Surplus Intelligence 正透過一種看似簡單的做法,逐漸佔據越來越多的鏈上推理請求:降低 AI 模型的運行成本。
Chutes 建立在 Bittensor 的 Subnet 64 上,累計已處理超過 34 兆個代幣,日峰值超過 1200 億個代幣。僅兩個月前上線的 Surplus Intelligence,已迅速攀升至 250 萬次請求和 1070 億個輸入代幣。它們共同體現了一個日益增長的觀點:中心化 AI 提供商對本質上屬於基礎算力的服務收取了過高的費用。
Chutes 如何成為預設
Chutes 於 2025 年 1 月下旬公開推出,作為一個去中心化的無伺服器推論平台。擁有閒置顯卡的獨立礦工按需提供開源 AI 模型,用戶按處理的代幣數量付費。
定價說明一切。Chutes 對某些模型的收費僅為每百萬代幣數分錢,遠低於中心化替代方案對等工作負載的通常收費。
在上線後啟動貨幣化機制,每日代幣吞吐量攀升至 120 億的水平。該平台使用無許可的 GPU 挖礦機,並根據容量、速度和可用性進行評分,打造了一個競爭性的市場,讓表現最佳的硬體贏得更多任務。
安全性透過可信執行環境(TEE)來處理。這些是硬體層級的隔離區域,即使在處理資料的礦工面前也能保持資料私密。硬體驗證透過一種稱為 GraVal 技術的系統進行,以確認礦工實際上正在運行其聲稱的 GPU。
所有結算均於鏈上以 USDC 進行,無發票週期或期限。
Surplus Intelligence 的爆發性兩個月
Surplus Intelligence 於 2026 年 5 月下旬推出,作為一個用於閒置 AI 推理算力的市場,一個買方與賣方直接對接的買賣盤。
2026 年 5 月下旬,Surplus 處理了 47,000 個請求和 17 億個輸入代幣。到 2026 年 7 月下旬,這些數字已暴增至 250 萬個請求和 1,070 億個代幣——短短兩個月內增長了約 50 倍。
Surplus 報告其使用者的儲蓄比傳統推論供應商高出 40-60%。市場平台模式實現了動態定價,意味著價格會根據實際供需進行調整。與 Chutes 類似,Surplus 在鏈上以 USDC 設定結算。
兩大平台的差異在於它們對供應的處理方式。Chutes 將 GPU 挖礦者納入一個以性能指標評分的無許可網路。Surplus 則更像一個二級市場,將擁有剩餘推理能力的實體與需要該能力的用戶連接起來。
這對人工智慧運算市場意味著什麼
針對 Bittensor 生態系統而言,Chutes 對 Subnet 64 的持倉強化了 TAO 的實用性敘事。當一個子網每日處理 120 億個代幣時,代幣經濟學便建立在真實的吞吐量上,而非對未來採用的猜測。
去中心化基礎設施的風險在於可靠性。集中式供應商提供服務級別協議、專屬支援和保證的正常運行時間。無許可的礦工網絡提供更低的價格和審查抵抗能力,但礦工在推理過程中離線的故障模式,與 AWS 區域停機的故障模式不同。
這些平台主要服務於開源模型。如果您的工作負載需要來自 OpenAI 或 Anthropic 的專有前沿模型,則目前還無法使用去中心化推理。

