Modelo chinês GLM-5.3-Flash rivaliza com gigantes da IA custando sete vezes menos — e roda sem chips da Nvidia
A Z.ai lançou um modelo de código aberto com 320 bilhões de parâmetros que ficou apenas três pontos atrás do GLM-5.3 completo em desempenho, mas custa uma fração do preço e funciona inteiramente em chips chineses.
A Z.ai lançou o GLM-5.3-Flash, um modelo de IA de código aberto (cujo funcionamento pode ser estudado por qualquer desenvolvedor) com 320 bilhões de parâmetros que ficou três pontos atrás do GLM-5.3 completo em desempenho, mas custa um sétimo do preço e roda inteiramente em chips chineses, sem usar hardware da Nvidia.

A empresa chinesa Z.ai divulgou o GLM-5.3-Flash, um modelo de inteligência artificial de código aberto (cujo funcionamento interno pode ser estudado e modificado por qualquer desenvolvedor) que consegue resultados próximos aos dos principais modelos do mercado gastando muito menos. Com 320 bilhões de parâmetros (os valores numéricos que definem como um modelo de IA responde), o GLM-5.3-Flash ficou apenas três pontos atrás da versão completa do GLM-5.3 no Índice de Inteligência da Artificial Analysis (uma referência que compara a qualidade das respostas de diferentes modelos), mas custa um sétimo do preço para operar, segundo informou o site The Decoder.
O que torna o lançamento ainda mais significativo é que todo o tráfego de inferência (o processo de usar o modelo treinado para gerar respostas em tempo real) rodou em chips de IA fabricados na China, sem depender de hardware da Nvidia. A gigante americana domina o mercado global de GPUs (processadores gráficos especializados em cálculos de IA) e enfrenta restrições impostas pelos Estados Unidos para exportar seus chips mais avançados para a China — uma medida que visa limitar o avanço tecnológico chinês em áreas estratégicas.
A combinação de desempenho competitivo, custo reduzido e independência de tecnologia americana marca um passo importante para a indústria chinesa de IA. Enquanto empresas ocidentais como OpenAI, Anthropic e Google dependem fortemente de chips Nvidia para treinar e rodar seus modelos, a Z.ai demonstrou que é possível construir alternativas viáveis com componentes locais. Isso pode acelerar o desenvolvimento de uma cadeia de fornecimento de IA mais autônoma na China.
Modelos de código aberto como o GLM-5.3-Flash também permitem que desenvolvedores e empresas ao redor do mundo adaptem a tecnologia às suas necessidades específicas, sem depender de APIs pagas (interfaces que cobram por cada requisição) de grandes empresas. Com custo operacional mais baixo, esses modelos se tornam acessíveis para aplicações em países em desenvolvimento e para startups com orçamento limitado, democratizando o acesso a ferramentas de IA de ponta.


