Falcon-H1: a nova família de modelos de IA dos Emirados Árabes que promete ser mais rápida e barata
O TII, instituto de pesquisa dos Emirados Árabes Unidos, lançou o Falcon-H1, uma família de modelos de linguagem que usa uma arquitetura híbrida para acelerar respostas e reduzir custos de infraestrutura, competindo com modelos ocidentais de código aberto.
O Falcon-H1 é uma família de modelos de linguagem (sistemas de IA que entendem e geram texto) criada pelo TII, dos Emirados Árabes. Usa uma arquitetura híbrida que combina dois métodos de processamento de texto, tornando-o mais rápido e barato de rodar que modelos tradicionais do mesmo tamanho. Está disponível gratuitamente em três tamanhos diferentes.

O Technology Innovation Institute (um centro de pesquisa financiado pelo governo dos Emirados Árabes Unidos) acaba de lançar o Falcon-H1, uma nova família de modelos de linguagem de grande escala (LLMs, sigla em inglês para os sistemas de IA que entendem e geram texto, como o ChatGPT). A novidade está na arquitetura: em vez de usar apenas o método tradicional de atenção (um mecanismo que permite ao modelo relacionar palavras distantes em uma frase), o Falcon-H1 combina atenção com algo chamado RWKV (uma técnica alternativa que processa texto de forma mais rápida e eficiente, palavra por palavra, sem precisar analisar tudo de uma vez). Por isso, ele é chamado de modelo de "cabeça híbrida".
Na prática, essa mistura traz duas vantagens principais: o modelo gera respostas mais rápido (até três vezes mais, segundo os testes do TII) e consome menos memória de GPU (o tipo de processador usado para rodar esses sistemas), o que reduz custos. O Falcon-H1 está disponível em três tamanhos — 0,5 bilhão, 1,5 bilhão e 7 bilhões de parâmetros (os "parâmetros" são os ajustes internos que o modelo aprende durante o treinamento; quanto mais parâmetros, mais complexo ele é) — e foi treinado com 2 trilhões de tokens (unidades de texto, grosso modo equivalentes a palavras ou pedaços de palavras).
Nos testes de desempenho, o Falcon-H1 se saiu bem em comparação com outros modelos de código aberto do mesmo tamanho, como o Llama 3.2 (da Meta) e o Qwen 2.5 (da empresa chinesa Alibaba). Ele foi testado em tarefas de raciocínio, matemática, compreensão de texto e programação, usando benchmarks padrão da indústria (conjuntos de testes que medem a qualidade dos modelos de IA). O TII também disponibilizou versões ajustadas por instrução (ou seja, treinadas especificamente para seguir comandos de usuários, como responder perguntas ou redigir textos) e versões quantizadas (compactadas para rodar em hardware mais simples, como computadores pessoais, sem perder muita qualidade).
Todos os pesos do modelo (os valores numéricos que armazenam o que ele aprendeu) foram liberados de forma aberta na plataforma Hugging Face (um repositório onde desenvolvedores compartilham e baixam modelos de IA), sob a licença Apache 2.0 (que permite uso comercial sem restrições). O TII, que já havia lançado a família Falcon original em 2023, segue investindo em alternativas aos grandes modelos ocidentais — parte de uma estratégia dos Emirados de se posicionar como polo de IA no Oriente Médio. Para quem desenvolve aplicações de IA ou quer rodar modelos localmente, o Falcon-H1 pode ser uma opção mais leve e rápida, especialmente em tarefas que exigem respostas em tempo real.


