Message de ChainThink, le 3 septembre : selon l'annonce de fal, la plateforme d'inférence AI fal lance une version Turbo une semaine après le déploiement du MiniMax H3 Max, réduisant la latence de génération d'environ 2,5 fois et divisant les prix par deux.
La version Turbo est fine-tunée sur MiniMax H3 et optimisée pour le système d'inférence fal. Lors de tests officiels de vidéos 768p de 5 secondes, la latence de génération est passée de 3,49 secondes pour H3 Max à 1,40 seconde.
En termes de qualité, Fal a auto-évalué son Turbo à 97 % de la version originale H3 Max, affirmant que la compréhension des invites, l'esthétique et la qualité globale sont largement préservées, et restent supérieures à la version originale MiniMax H3 et aux autres modèles testés.
En termes de prix, Turbo est facturé 0,04 $ par seconde au tarif normal, soit la moitié du tarif normal de H3 Max (0,08 $). Pendant la promotion de lancement, le prix est de 0,01 $ par seconde, soit environ 0,6 $ pour générer une vidéo d'une minute.
