Un modelo chino de IA compite con los líderes del sector a una séptima parte del coste, y sin chips Nvidia
Z.ai lanza GLM-5.3-Flash, un modelo de código abierto que rinde casi como su hermano mayor pero es siete veces más barato de ejecutar, y funciona íntegramente sobre chips de IA fabricados en China.
Z.ai lanzó GLM-5.3-Flash, un modelo de inteligencia artificial de código abierto con 320.000 millones de parámetros (los valores internos que determinan cómo responde) que obtiene resultados casi idénticos al modelo GLM-5.3 pero cuesta una séptima parte de ejecutar, y funciona íntegramente sobre chips de IA fabricados en China, sin usar hardware de Nvidia.

La empresa china Z.ai acaba de lanzar GLM-5.3-Flash, un modelo de inteligencia artificial de código abierto (es decir, disponible para que cualquiera lo descargue y use) con 320.000 millones de parámetros (los valores numéricos internos que determinan cómo responde el modelo). Según el índice de inteligencia de Artificial Analysis (una plataforma independiente que evalúa y compara modelos de IA), GLM-5.3-Flash queda apenas tres puntos por debajo de GLM-5.3, su hermano mayor y más caro, pero cuesta una séptima parte de ejecutarlo.
Lo más llamativo no es solo su eficiencia económica, sino dónde se ejecutó: todo el tráfico de inferencia (el proceso de usar un modelo ya entrenado para generar respuestas) corrió sobre chips de IA fabricados en China, sin depender en ningún momento de hardware de Nvidia, el fabricante estadounidense que domina el mercado de GPU (procesadores gráficos especializados) para inteligencia artificial.
Este lanzamiento llega en un momento en que las restricciones de exportación de Estados Unidos limitan el acceso de empresas chinas a los chips más avanzados de Nvidia. El hecho de que GLM-5.3-Flash consiga un rendimiento competitivo sin esa tecnología sugiere que la industria china está desarrollando alternativas viables, aunque aún queda por ver si pueden escalar estos sistemas para competir con los modelos más grandes de OpenAI o Google.
Para contexto, 320.000 millones de parámetros sitúan a GLM-5.3-Flash en la categoría de modelos grandes pero no gigantescos: GPT-4, por ejemplo, se estima que tiene más de un billón de parámetros. Aun así, la combinación de rendimiento, coste reducido y ejecución sobre chips no estadounidenses convierte este lanzamiento en un hito técnico y geopolítico.
Z.ai no ha detallado qué chips chinos utilizó exactamente ni cuánto costó entrenar el modelo, pero según informó The Decoder, la empresa confirma que toda la infraestructura de inferencia corre sobre hardware local. El modelo ya está disponible para descarga y pruebas.


