Google lanza tres nuevos modelos de Gemini para mejorar la eficiencia y la velocidad de los agentes de IA

iconTechFlow
Compartir
AI summary iconResumen
Google ha lanzado tres nuevos modelos de Gemini: 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber, para mejorar el rendimiento de los agentes de IA. El modelo 3.6 Flash reduce el uso de tokens en un 17% y mejora las tareas de codificación y conocimiento. El 3.5 Flash-Lite alcanza 350 tokens por segundo, el más rápido de su serie. El 3.5 Flash Cyber se enfoca en identificar y resolver problemas de ciberseguridad en el código. Estas actualizaciones se alinean con las noticias de IA + cripto y podrían influir en nuevos listados de tokens en el espacio.

Autor: Google DeepMind

Compilado por Deep潮 TechFlow

Guía de Shenchao: Los tres modelos lanzados por Google se centran en resolver los verdaderos desafíos comerciales de los Agentes de IA: costo y velocidad. El 3.6 Flash reduce un 17% los tokens en comparación con la generación anterior, a un precio más bajo pero con mejor calidad; el 3.5 Flash-Lite alcanza una velocidad de 350 tokens/segundo, siendo el modelo más rápido de la serie 3.5; y el modelo especializado en ciberseguridad, Flash Cyber, se enfoca en el mercado necesario de la corrección de vulnerabilidades de código. Esto no es un juego de puntuaciones de rendimiento, sino una preparación para la implementación a gran escala de Agentes de IA.

Google DeepMind lanza hoy tres nuevos modelos Gemini: 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber. Estos modelos están diseñados específicamente para la eficiencia, latencia y confiabilidad necesarias para construir agentes de IA a gran escala.

Gemini 3.6 Flash: más eficiente, de mayor calidad

3.6 Flash se mejora directamente sobre la retroalimentación de los desarrolladores sobre 3.5 Flash. No solo avanza en codificación y trabajo de conocimiento, sino que también mejora significativamente la eficiencia de los tokens. Según el Artificial Analysis Index, 3.6 Flash reduce el consumo de tokens de salida un 17% en comparación con 3.5 Flash. En algunas pruebas de referencia, como DeepSWE de Datacurve, la reducción alcanza hasta un 65%. También requiere menos pasos de razonamiento y llamadas a herramientas para completar flujos de trabajo multietapa.

Este aumento de eficiencia también se acompaña de precios más bajos. Con un precio de 1,5 dólares por millón de tokens de entrada y 7,5 dólares por millón de tokens de salida, 3.6 Flash reduce el costo total por tarea de Agent, haciendo que la construcción y ejecución de Agentes sea más económica.

Aunque sea más eficiente, 3.6 Flash ofrece un rendimiento superior a 3.5 Flash en diversos casos de uso:

La edición de código es más precisa, reduciendo modificaciones y ciclos de ejecución innecesarios, alcanzando un 49% en DeepSWE (3.5 Flash: 37%) y mejorando significativamente hasta un 63,9% en el benchmark de investigación de machine learning MLE Bench (3.5 Flash: 49,7%).

Mejora en la capacidad de operación de computadora, puntuación OSWorld-Verified del 83.0% (3.5 Flash es del 78.4%). La operación de computadora ahora está disponible a través de Gemini API y Gemini Enterprise como herramienta integrada del cliente.

El trabajo de conocimiento se desempeña mejor, como lo demuestra la puntuación del benchmark GDPval-AA v2 de 1421 (1349 para 3.5 Flash). Clientes como Hebbia y Harvey han encontrado que destaca en tareas multimodales como la interpretación de documentos, análisis de gráficos y datos, y redacción de informes.

El feedback del cliente indica que 3.6 Flash representa un avance en costo y calidad, equilibrando eficiencia en tokens, precisión y velocidad en flujos de trabajo complejos y tareas basadas en conocimiento.

Diseño de seguridad

3.6 Flash cuenta con medidas mejoradas de protección avanzada contra amenazas químicas, biológicas, radiológicas, nucleares (CBRN) y abusos en ataques cibernéticos. Estas protecciones aumentan significativamente la resistencia del modelo a los ataques de escape. Al mismo tiempo, el modelo ha sido entrenado para minimizar la negación de usos beneficiosos.

Gemini 3.5 Flash-Lite: diseñado para escalar flujos de trabajo de Agent

3.5 Flash-Lite está diseñado para tareas de baja latencia y escenarios de desarrollo que requieren alto rendimiento, como búsqueda de agentes y procesamiento de documentos.

3.5 Flash-Lite es el modelo más rápido de la serie 3.5. Según mediciones de Artificial Analysis, alcanza una velocidad de 350 tokens de salida por segundo. Con un precio de $0.3 por millón de tokens de entrada y $2.5 por millón de tokens de salida, ofrece una calidad significativamente superior a 3.1 Flash-Lite, proporcionando una excelente relación calidad-precio para desarrolladores y clientes que ejecutan tareas de producción con alto volumen.

3.5 Flash-Lite admite la expansión eficiente del sistema de Agentes. En todos los niveles de pensamiento, este modelo supera significativamente a 3.1 Flash-Lite. Los desarrolladores pueden configurar el modelo según la carga de trabajo: utilizar niveles de pensamiento mínimos y bajos para tareas en gran volumen, priorizando baja latencia y ejecución de bajo costo; o activar niveles de pensamiento más altos para manejar cargas de trabajo de Agentes con múltiples pasos. Este modelo ahora también incluye la operación de computadora como herramienta integrada, brindando soporte confiable para tareas de Agentes a través de interfaces.

Tiene mejoras significativas en codificación y tareas de Agentes, como una puntuación de 54% en Terminal-Bench 2.1 (3.1 Flash-Lite: 31%), contextos largos como GDM-MRCR v2 con una puntuación de 72.2% (3.1 Flash-Lite: 60.1%) y ejecución de tareas reales como GDPval-AA v2 con una puntuación de 1140 (3.1 Flash-Lite: 642).

De hecho, en muchas evaluaciones de agentes y codificación, 3.5 Flash-Lite supera incluso a 3 Flash, incluyendo SWE-Bench Pro (54.2% vs 49.6%) y OSWorld-Verified (74.0% vs 65.1%), convirtiéndose en la opción más rápida y potente para cargas de trabajo de 2.5 y 3 Flash.

Los clientes iniciales destacaron la combinación única de velocidad, inteligencia y eficiencia de costos de 3.5 Flash-Lite en la expansión de flujos de trabajo de Agent y tareas de procesamiento de datos.

Gemini 3.5 Flash Cyber en CodeMender: descubra y arregle vulnerabilidades de forma eficiente

Los modelos de IA están descubriendo vulnerabilidades de seguridad más rápido de lo que los sistemas actuales pueden repararlas. Abordar esta amenaza creciente requiere un enfoque de seguridad de software que sea tanto eficiente como potente.

El rendimiento y la eficiencia de Flash lo convierten en la base ideal para la detección, validación y corrección a gran escala de problemas de seguridad en el código. Gemini 3.5 Flash Cyber se construye sobre Flash 3.5, está afinado específicamente para descubrir y corregir vulnerabilidades de ciberseguridad, y tiene un precio por token inferior al de los modelos grandes.

In CodeMender, multiple 3.5 Flash Cyber Agents work together to generate a single comprehensive report, achieving state-of-the-art competitive performance on the popular benchmark CyberGym.

Dada la naturaleza de doble uso de esta tecnología, hemos adoptado un enfoque cauteloso en su implementación. El modelo se proporcionará pronto a través de CodeMender en un proyecto piloto con acceso restringido a gobiernos y socios confiables. Esto permitirá a los defensores en la primera línea detectar y corregir vulnerabilidades críticas antes de que sean explotadas, al tiempo que se mitigan los riesgos de abuso más amplios.

Comienza ahora

3.6 Flash y 3.5 Flash-Lite están disponibles desde hoy:

Los desarrolladores pueden utilizarlo a través de la API de Gemini en Google AI Studio y Android Studio. 3.6 Flash también está disponible en Google Antigravity.

Los empresarios pueden utilizarlo en la plataforma Gemini Enterprise Agent. 3.6 Flash también está disponible en la aplicación Gemini Enterprise.

Está disponible para todos a través de la aplicación Gemini. 3.5 Flash-Lite también se está lanzando en Google Search.

Bienvenido a proporcionar comentarios para mejorar los futuros modelos Gemini; esperamos lanzar el 3.5 Pro pronto.

Descargo de responsabilidad: La información contenida en esta página puede proceder de terceros y no refleja necesariamente los puntos de vista u opiniones de KuCoin. Este contenido se proporciona solo con fines informativos generales, sin ninguna representación o garantía de ningún tipo, y tampoco debe interpretarse como asesoramiento financiero o de inversión. KuCoin no es responsable de ningún error u omisión, ni de ningún resultado derivado del uso de esta información. Las inversiones en activos digitales pueden ser arriesgadas. Evalúa con cuidado los riesgos de un producto y tu tolerancia al riesgo en función de tus propias circunstancias financieras. Para más información, consulta nuestras Condiciones de uso y la Declaración de riesgos.