Modelos de IA

Google lanza Gemini 3.8 Flash y una versión Cyber para defensores confiables

Google presentó Gemini 3.8 Flash y Gemini 3.8 Flash Cyber, combinando mejor codificación y razonamiento con un modelo restringido para detectar y parchear vulnerabilidades.

Publicado Actualizado
Google DeepMindGeminiModelos de IA

Google presentó el 2 de septiembre Gemini 3.8 Flash y Gemini 3.8 Flash Cyber, describiendo el lanzamiento como un avance para programación de largo horizonte, flujos de trabajo agénticos y ciberseguridad defensiva. La actualización llega pocas semanas después de Gemini 3.7 Flash y mantiene el mismo precio introductorio para el modelo Flash general: 0,75 dólares por millón de tokens de entrada y 3,75 dólares por millón de tokens de salida hasta finales de 2026. Google sostiene que el nuevo modelo mejora razonamiento y programación sin perder el perfil de velocidad y costo que hizo atractivo a Flash para producción.

Gemini 3.8 Flash está dirigido a desarrolladores y empresas que necesitan un modelo de menor costo capaz de usar herramientas de forma sostenida. Google afirma que supera a Gemini 3.7 Flash en ingeniería de software, tareas agénticas y razonamiento especializado de varios pasos. La compañía cita mejoras en DeepSWE v1.1, Vals Finance Agent V2, Harvey’s Legal Agent Benchmark y HLE-Verified, donde reporta un 54,9%. El mensaje es que no se trata solo de un asistente rápido para preguntas cortas, sino de un sistema diseñado para seguir trabajando en tareas complejas, llamar herramientas repetidamente y dedicar más esfuerzo de razonamiento cuando sea necesario.

La segunda versión, Gemini 3.8 Flash Cyber, está más controlada. Google la describe como su modelo de ciberseguridad más capaz y dice que estará disponible para defensores confiables a través del nuevo Fairwind Program. Comparte la misma inteligencia base que Gemini 3.8 Flash, pero está ajustada para descubrimiento de vulnerabilidades y parcheo automatizado. En CyberGym, Google dice que alcanza rendimiento de frontera en descubrimiento autónomo de vulnerabilidades. En un benchmark interno con bases de código complejas en 20 lenguajes, la compañía reporta una tasa de éxito superior al 70%.

Google subraya la defensa por encima de la explotación ofensiva. Gemini 3.8 Flash Cyber fue diseñado para ayudar a defensores a encontrar, verificar y corregir vulnerabilidades rápidamente. En CWE-Bench, un benchmark externo de parcheo administrado por Collinear, Google reporta un pass@1 del 47,2%, cerca del 47,8% de un modelo de frontera líder más grande, pero a un costo bastante menor. También afirma que el equipo de seguridad de Chrome obtuvo 2,6 veces más parches correctos para vulnerabilidades de Chrome que con modelos comerciales mayores, mientras Wiz midió más recall a menor costo en un benchmark interno de pruebas de penetración.

El lanzamiento muestra que los grandes laboratorios de IA tratan las capacidades cibernéticas como una categoría especial de despliegue. Gemini 3.8 Flash incluye salvaguardas contra mal uso químico, biológico, radiológico, nuclear y de ciberofensiva. Gemini 3.8 Flash Cyber es más permisivo para trabajos de seguridad, pero está restringido a organizaciones que Google considera defensores confiables. La empresa también dice que los modelos mejoraron mucho en robustez ante inyección de prompts según mediciones de Gray Swan, un punto clave para agentes que leen documentos, sitios y código no confiables.

Para el mercado, el anuncio presiona a competidores a disputar no solo puntajes, sino costos, controles de acceso y empaquetado operativo. Desarrolladores pueden usar Gemini 3.8 Flash en Google AI Studio, Gemini API, Android Studio, Google Antigravity, Gemini Enterprise y productos de consumo como la app Gemini y AI Mode en Search. El modelo Cyber, en cambio, se trata como una capacidad más sensible. Esa división podría volverse común: acceso amplio a modelos generales de razonamiento y versiones especializadas de alto impacto distribuidas mediante canales verificados.