Google DeepMind lanza Gemini 3.1 Flash-Lite, su modelo más rápido y barato
La nueva versión ultraligera de Gemini promete llevar inteligencia artificial a escala masiva sin disparar costes ni tiempos de respuesta
Google DeepMind presentó Gemini 3.1 Flash-Lite, un modelo de lenguaje (sistema de IA que entiende y genera texto) diseñado para ser el más rápido y económico de la familia Gemini 3. Está pensado para aplicaciones que necesitan procesar millones de consultas al día sin disparar costes ni sacrificar velocidad de respuesta.

Google DeepMind presentó Gemini 3.1 Flash-Lite, el modelo más rápido y económico de toda la familia Gemini 3, según informó la compañía en su blog oficial. El nuevo modelo se posiciona como una alternativa pensada para aplicaciones que requieren procesar millones de consultas al día sin comprometer velocidad ni presupuesto.
Flash-Lite pertenece a la serie Gemini 3, la tercera generación de modelos de lenguaje grandes (LLM, sistemas de inteligencia artificial entrenados con enormes cantidades de texto para entender y generar lenguaje natural) de Google. A diferencia de versiones anteriores como Gemini 3.1 Pro, Flash-Lite sacrifica parte de su capacidad de razonamiento complejo a cambio de tiempos de respuesta mucho menores y un coste por consulta reducido, una estrategia habitual en la industria para servir casos de uso que priorizan la escala sobre la sofisticación.
Aunque Google no detalló cifras concretas de velocidad o precio, la denominación "Flash" en la familia Gemini históricamente ha indicado modelos optimizados para inferencia rápida (el proceso de generar una respuesta a partir de un modelo ya entrenado), mientras que "Lite" sugiere un tamaño reducido, probablemente con menos parámetros (los valores numéricos internos que determinan el comportamiento del modelo) que sus hermanos mayores.
El lanzamiento responde a la creciente demanda de modelos que puedan integrarse en aplicaciones de consumo masivo, chatbots corporativos o asistentes virtuales sin generar costes prohibitivos por cada interacción. En un mercado donde empresas como Anthropic, OpenAI y Meta compiten por ofrecer las mejores relaciones calidad-precio-velocidad, Gemini 3.1 Flash-Lite busca consolidar la presencia de Google en el segmento de modelos ultraeficientes.
La compañía no especificó fecha de disponibilidad general ni confirmó si el modelo estará accesible a través de su plataforma Google AI Studio (la herramienta web de Google para probar y ajustar modelos sin escribir código) o exclusivamente mediante su API comercial (la interfaz de programación que permite a desarrolladores integrar el modelo en sus propias aplicaciones).


