Mensaje de ChainThink, 3 de septiembre: según el anuncio de fal, la plataforma de inferencia de IA fal lanzó una versión Turbo solo una semana después del lanzamiento de MiniMax H3 Max, reduciendo la latencia de generación aproximadamente 2.5 veces y reduciendo a la mitad el precio.
La versión Turbo se basa en el entrenamiento posterior de MiniMax H3 y está optimizada para el sistema de inferencia fal. En pruebas oficiales de video de 5 segundos y 768p, la latencia de generación se redujo de 3.49 segundos en H3 Max a 1.40 segundos.
En cuanto a la calidad, fal autoevaluó su Turbo como el 97% de la versión original H3 Max, afirmando que la comprensión de los prompts, el criterio estético y la calidad general se mantienen básicamente, superando aún a la versión original MiniMax H3 y otros modelos evaluados.
En cuanto a precios, Turbo tiene un precio normal de 0.04 dólares por segundo, solo la mitad del precio normal de H3 Max (0.08 dólares). Durante la promoción de lanzamiento, es de 0.01 dólares por segundo, lo que equivale a aproximadamente 0.6 dólares para generar un video de 1 minuto.
