Google lleva su línea Flash por dos caminos. Gemini 3.8 Flash es el modelo de trabajo para programación y análisis, y Gemini 3.5 Flash Lite el modelo rápido para tareas sencillas. En ChatX están disponibles los dos, y Flash Lite también para invitados. La tabla muestra en qué se diferencian. Debajo explicamos cuándo conviene cada uno.
Gemini 3.8 Flash y 3.5 Flash Lite de un vistazo
| Gemini 3.8 Flash | Gemini 3.5 Flash Lite | |
|---|---|---|
| Orientación | programación, análisis de varios pasos, preguntas técnicas | velocidad y volumen en tareas sencillas |
| Ventana de contexto | 1 millón de tokens | 1 millón de tokens |
| Profundidad de razonamiento | seleccionable desde «Baja», no se puede apagar | fija, no seleccionable |
| Entiende imágenes / búsqueda web | sí / sí | sí / sí |
| Precio por token según el proveedor | ≈ 1,5× Flash Lite, ≈ ⅕ de GPT-5.6 Sol | uno de los modelos más baratos |
| Disponible para | usuarios registrados | invitados y usuarios registrados |
Qué distingue a 3.8 Flash de 3.7 Flash
Google lo describe así: en tareas complejas, 3.8 Flash da pasos de razonamiento adicionales y vuelve a llamar herramientas como la búsqueda web en lugar de parar tras el primer intento. Se nota en las pruebas. En DeepSWE, una prueba de tareas de software resueltas de forma autónoma, 3.8 Flash queda por delante de la mayoría de los grandes modelos de referencia. En HLE-Verified, una prueba amplia de conocimiento y análisis, llega al 54,9 por ciento. En tareas financieras y jurídicas (Vals Finance Agent, Harvey Legal Agent) mejora claramente a 3.7 Flash.
La otra cara: más pasos de razonamiento significan más tokens por respuesta. Quien solo quiere un dato corto paga una minuciosidad que no necesitaba. La profundidad se puede bajar a «Baja», pero en 3.8 Flash no se apaga del todo. Y un detalle de precio: 3.8 Flash funciona con tarifa de lanzamiento hasta finales de diciembre, después Google duplica el precio de este modelo. Flash Lite no se ve afectado.
Qué puede y qué no puede Flash Lite
Gemini 3.5 Flash Lite está hecho para respuestas rápidas a bajo coste. Lee imágenes y documentos, acepta hasta un millón de tokens de entrada y responde con muy poca espera. En ChatX es el modelo más rápido que pueden usar los invitados sin registrarse. Para capturas, traducciones, resúmenes y explicaciones breves es más que suficiente.
Su límite está en todo lo que requiere varios pasos de razonamiento: cálculos encadenados, código con dependencias, textos con fuentes contradictorias. Ahí da respuestas plausibles pero a menudo incorrectas. No porque sea malo, sino porque no se construyó para eso.
Nuestra recomendación
- Flash Lite por defecto: para todo lo que se responde en una frase. Quien empieza como invitado obtiene así la mejor relación entre velocidad y calidad.
- 3.8 Flash en «Baja»: para programación, análisis largos y preguntas técnicas. Da resultados por una fracción de lo que cuesta Sol, resultados que hace poco exigían un modelo de primera línea.
- Ninguno de los dos: cuando lo que cuenta es la máxima precisión, es decir contratos, cifras que se van a revisar y documentos que sirven para decidir. Ahí son mejor opción Opus 5.5, Sol o Astra, aunque cuesten más.
Una prueba sencilla para ver el límite entre ambos: si Flash Lite responde dos veces de forma distinta a la misma pregunta, es tarea para 3.8 Flash.
