Google y Meta lanzaron modelos de IA frontera rivales dentro de unas horas el miércoles. Google lanzó Gemini 3.8 Flash y una variante de ciberseguridad. Meta lanzó Muse Spark 1.3. Pruebas independientes realizadas por Artificial Analysis otorgaron a Meta una ventaja en trabajo agente de conocimiento y razonamiento científico. Google lideró en recuperación factual y codificación en terminal. Gemini 3.8 Flash es la tercera versión Flash de Google en seis semanas. El modelo cuesta $0.75 por 1 millón de tokens de entrada. El modelo cuesta $3.75 por 1 millón de tokens de salida. Las tarifas introductorias vigentes hasta el 31 de diciembre de 2026. Luego, los precios aumentarán a $1.50 por 1 millón de tokens de entrada. El precio de salida aumentará a $7.50 por 1 millón de tokens. Google puso a disposición de defensores confiables Gemini 3.8 Flash Cyber. La variante obtuvo un 86.2% en CyberGym. La variante obtuvo un 47.2% en CWE-Bench. Google afirmó que el modelo produjo 2.6 veces más parches correctos para vulnerabilidades de Chrome que modelos comerciales más grandes. El Programa Fairwind limita el acceso a autoridades gubernamentales y operadores de infraestructura crítica. OpenAI estableció un límite similar para Astra un día antes. Meta lanzó Muse Spark 1.3 a través de Muse Code y la API de Modelos de Meta. Los ingenieros de la empresa midieron aproximadamente un 20% menos de llamadas a herramientas que en la versión 1.2. Muse Spark 1.3 en modo max obtuvo 1,754 Elo en GDPval-AA v2. Gemini 3.8 Flash en modo high obtuvo 1,545. Muse Spark 1.3 lideró la prueba de agente bancario de Sierra Research. Muse Spark 1.3 obtuvo un 52.4% en esa prueba. Gemini 3.8 Flash obtuvo un 44.9%. Meta también lideró el razonamiento físico CritPt. Gemini 3.8 Flash lideró Terminal-Bench 2.1 con un 87.6%. Gemini 3.8 Flash lideró AA-LCR de contexto largo con un 81%. Gemini 3.8 Flash lideró la precisión AA-Omniscience con un 55%. Gemini 3.8 Flash registró la puntuación más alta en GPQA Diamond entre los modelos probados: 95%. Los modelos terminaron dentro de un punto entre sí en Humanity's Last Exam. Meta dijo que el razonamiento max para Muse Spark 1.3 estará disponible tras pruebas adicionales de seguridad. La variante xhigh está actualmente disponible. La variante xhigh obtuvo un 61 en el Índice de Inteligencia de Artificial Analysis. Esa puntuación fue cuatro puntos por encima de Muse Spark 1.2. La puntuación quedó por debajo de Claude Fable 5.1 con 66. También quedó por debajo de Claude Opus 5 con 63. Elon Musk ha dicho que Grok 4.7 llegará pronto.
Google y Meta lanzan modelos de IA rivales Gemini 3.8 Flash y Muse Spark 1.3
NS3Compartir
Google y Meta lanzaron modelos de IA rivales Gemini 3.8 Flash y Muse Spark 1.3, con Meta liderando en trabajo de conocimiento agente y razonamiento científico. El análisis en cadena muestra un fuerte interés en los modelos, reflejando cambios en el índice de miedo y codicia. Gemini 3.8 Flash tiene un precio de $0.75 por 1 millón de tokens de entrada y $3.75 por 1 millón de tokens de salida. Muse Spark 1.3 obtuvo 1.754 Elo en GDPval-AA v2 y lideró la prueba de agente bancario de Sierra Research con un 52.4%.
Fuente:Mostrar original
Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información.
Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.