Los nuevos modelos Gemini Flash de Google están diseñados para una IA que se ejecuta por sí sola
Los modelos 3.6 Flash y 3.5 Flash-Lite de Google DeepMind prometen agentes de IA más baratos y rápidos. Esto es lo que significa para las aplicaciones y juegos que realmente usas.

Puntos clave
- Google DeepMind anunció Gemini 3.6 Flash y Gemini 3.5 Flash-Lite el día de su lanzamiento, dirigidos a ejecutar agentes de IA a escala.
- Google asegura que 3.6 Flash utiliza un 17% menos de tokens de salida que 3.5 Flash según el Índice de Análisis Artificial, a $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida.
- Gemini 3.5 Flash-Lite funciona a 350 tokens de salida por segundo, con un precio de $0.30 por millón de tokens de entrada y $2.50 por millón de tokens de salida.
- En la prueba OSWorld-Verified, que evalúa la capacidad de una IA para usar una computadora real, 3.6 Flash obtuvo un 83.0% frente al 78.4% de 3.5 Flash.
- Google DeepMind confirmó que el preentrenamiento ha comenzado en Gemini 4, su próximo modelo insignia.
Google acaba de cambiar silenciosamente las matemáticas para quien está desarrollando una IA que hace cosas por ti.
El día del lanzamiento, Google DeepMind presentó dos nuevas versiones de su familia Gemini: Gemini 3.6 Flash y Gemini 3.5 Flash-Lite. Gemini es la línea de modelos de IA de Google, el cerebro de software detrás de chatbots y, cada vez más, agentes de IA (programas que realizan tareas de múltiples pasos en tu nombre, como reservar viajes o corregir código).
El titular no es un modelo monstruo más grande e inteligente. Es lo opuesto. Estos son los caballos de batalla.
¿Por qué debería importarle a una persona normal un modelo de IA más barato?
Porque el precio y la velocidad son lo que decide si la demostración inteligente que viste el año pasado finalmente aparece en las aplicaciones que usas.
Ejecutar un modelo de IA grande cuesta dinero cada vez que responde. Ese costo se mide en tokens, que son simplemente fragmentos de texto que el modelo lee y escribe. Google dice que Gemini 3.6 Flash utiliza un 17% menos de tokens de salida que el anterior 3.5 Flash para hacer el mismo trabajo, según el Índice de Análisis Artificial independiente. En una prueba de codificación llamada DeepSWE, el ahorro alcanzó el 65%.
En palabras simples: el modelo se extiende menos en divagaciones y va al grano más rápido. Esto reduce la factura de la empresa que desarrolla tu aplicación, que es cómo características como un compañero de IA en el juego o un bot de atención al cliente inteligente se vuelven económicamente viables.
El precio se sitúa en $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida. Un millón de tokens es aproximadamente 750,000 palabras.
El hermano pequeño podría ser la verdadera historia
Gemini 3.5 Flash-Lite es el pequeño y rápido. Google lo cifra en 350 tokens de salida por segundo, con un precio de $0.30 por millón de tokens de entrada y $2.50 por millón de tokens de salida.
Esa velocidad importa para cualquier cosa que necesite parecer instantánea. Piensa en un oponente de IA en un juego que tenga que reaccionar en tiempo real, o una herramienta de procesamiento de documentos que procese miles de facturas durante la noche.
En Terminal-Bench 2.1, una prueba que mide qué tan bien una IA puede controlar una línea de comandos de computadora, Flash-Lite saltó del 31% al 54%. En OSWorld-Verified, que le pide a la IA que realmente opere un escritorio como lo haría un humano, alcanzó el 74%.
Ambos modelos nuevos ahora incluyen "computer use" como una herramienta integrada. Esto significa que la IA puede hacer clic en botones, rellenar formularios y mover un cursor sin que un desarrollador lo conecte manualmente.
¿Qué hay sobre la seguridad?
Google dice que 3.6 Flash se envía con protecciones más fuertes contra el mal uso en escenarios químicos, biológicos, radiológicos, nucleares y de ciberdelito. También ha sido entrenado para rechazar menos solicitudes inofensivas, una queja común con versiones anteriores de Gemini que a veces decían no a preguntas aburridas y cotidianas.
También hay un primo especialista. Gemini 3.5 Flash Cyber potencia CodeMender, el agente de Google que busca agujeros de seguridad en el código de software.
¿Qué sucede a continuación?
Gemini 3.5 Pro, el modelo insignia más grande, aún se está probando con socios. Y Google confirmó lo interesante al final: el preentrenamiento ha comenzado en Gemini 4.
Para jugadores, desarrolladores y cualquiera que espere características de IA que no cuesten una fortuna ejecutar, la dirección es clara. La frontera obtiene los titulares. Los modelos Flash se envían.



