Les chutes et les demandes d'inférence AI sur chaîne dominent

iconCryptoBriefing
Partager
AI summary iconRésumé
Les actualités sur l’IA et la crypto affichent une forte dynamique, avec Chutes et Surplus Intelligence en tête des nouvelles on-chain dans le domaine de l’inférence IA. Chutes, construit sur le Subnet 64 de Bittensor, a traité plus de 34 billions de jetons, avec des pics quotidiens dépassant 120 milliards. Surplus Intelligence, lancé à la fin mai 2026, a atteint 2,5 millions de requêtes et 107 milliards de jetons d’entrée d’ici juillet. Les deux plateformes utilisent une infrastructure décentralisée et règlent en USDC sur la chaîne.

Le marché de l'inférence IA est en train d'être silencieusement réorganisé de fond en comble. Deux plateformes décentralisées, Chutes et Surplus Intelligence, attirent une part croissante des demandes d'inférence onchain en faisant quelque chose apparemment simple : rendre l'exécution des modèles IA moins chère.

Chutes, construit sur le Subnet 64 de Bittensor, a traité plus de 34 billions de jetons au total, avec des pics quotidiens dépassant 120 milliards de jetons. Surplus Intelligence, lancé il y a seulement deux mois, a déjà atteint 2,5 millions de requêtes et 107 milliards de jetons d'entrée. Ensemble, ils illustrent une thèse croissante selon laquelle les fournisseurs d'IA centralisés facturent trop cher ce qui est, au fond, un calcul de base.

Comment Chutes est devenu la valeur par défaut

Chutes a été lancé publiquement à la fin janvier 2025 en tant que plateforme d'inférence décentralisée et sans serveur. Des mineurs indépendants disposant de cartes graphiques inutilisées servent des modèles d'IA open source sur demande, et les utilisateurs paient par token traité.

Le prix en dit long. Chutes facture des centimes à chiffre unique par million de jetons pour certains modèles, une fraction de ce que réclament habituellement les alternatives centralisées pour des charges de travail équivalentes.

Après la mise en place de la monétisation après le lancement, le débit quotidien de jetons a atteint ce chiffre de 120 milliards. La plateforme utilise des mineurs GPU sans autorisation, évalués selon leur capacité, leur vitesse et leur disponibilité, créant un marché compétitif où les matérielles les plus performants obtiennent plus de travaux.

Publicité

La sécurité est gérée via des environnements d'exécution fiables, ou TEE. Il s'agit de zones d'isolation au niveau du matériel qui préservent la confidentialité des données, même vis-à-vis des mineurs qui les traitent. La vérification matérielle est effectuée à l'aide d'une technologie appelée GraVal, qui confirme que les mineurs exécutent bien les GPU qu'ils prétendent utiliser.

Tous les règlements ont lieu sur la chaîne en USDC, sans cycles de facturation ni conditions de paiement.

Les deux mois explosifs de Surplus Intelligence

Surplus Intelligence a fait ses débuts à la fin mai 2026 en tant que marché pour la capacité d'inférence AI inutilisée, un carnet d'ordres où acheteurs et vendeurs de calcul se rencontrent directement.

À la fin mai 2026, Surplus a géré 47 000 demandes et 1,7 milliard de jetons d'entrée. À la fin juillet 2026, ces chiffres avaient bondi à 2,5 millions de demandes et 107 milliards de jetons — une augmentation d'environ 50 fois en deux mois.

Surplus indique que les économies des utilisateurs s'élèvent à 40 à 60 % par rapport aux fournisseurs traditionnels d'inférence. Le modèle de marché permet une découverte dynamique des prix, ce qui signifie que les prix s'ajustent en fonction de l'offre et de la demande réelles. Comme Chutes, Surplus règle les transactions en USDC sur chaîne.

La différence entre les deux plateformes réside dans leur approche de l'offre. Chutes recrute des mineurs GPU dans un réseau sans autorisation évalué selon des métriques de performance. Surplus fonctionne davantage comme un marché secondaire, reliant les entités disposant d'une capacité d'inférence excédentaire à celles qui en ont besoin.

Ce que cela signifie pour le marché du calcul IA

Pour l’écosystème Bittensor spécifiquement, la position de Chutes sur le Subnet 64 renforce le récit d’utilité de TAO. Lorsqu’un subnet traite 120 milliards de jetons par jour, l’économie du jeton s’appuie sur un débit réel plutôt que sur des spéculations concernant son adoption future.

Le risque avec les infrastructures décentralisées est la fiabilité. Les fournisseurs centralisés offrent des SLA, un support dédié et un temps de fonctionnement garanti. Les réseaux de mineurs sans autorisation proposent des prix plus bas et une résistance à la censure, mais un mineur hors ligne pendant une inférence est un mode de défaillance différent d'une région AWS en panne.

Ces plateformes servent également principalement des modèles open source. Si votre charge de travail nécessite des modèles de pointe propriétaires de OpenAI ou Anthropic, l'inférence décentralisée n'est pas encore une option.

Clause de non-responsabilité : les informations sur cette page peuvent avoir été obtenues auprès de tiers et ne reflètent pas nécessairement les points de vue ou opinions de KuCoin. Ce contenu est fourni à titre informatif uniquement, sans aucune représentation ou garantie d’aucune sorte, et ne doit pas être interprété comme un conseil en investissement. KuCoin ne sera pas responsable des erreurs ou omissions, ni des résultats résultant de l’utilisation de ces informations. Les investissements dans les actifs numériques peuvent être risqués. Veuillez évaluer soigneusement les risques d’un produit et votre tolérance au risque en fonction de votre propre situation financière. Pour plus d’informations, veuillez consulter nos conditions d’utilisation et divulgation des risques.