Hugging Face libera nova versão do Open R1 com melhorias no raciocínio
A segunda atualização do modelo de código aberto traz ajustes que melhoram a capacidade de resolver problemas complexos de matemática e programação.

A Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) divulgou a segunda atualização do Open R1, um modelo de linguagem de código aberto (ou seja, qualquer pessoa pode baixar, estudar e modificar) criado para competir com sistemas de raciocínio como o o1 da OpenAI. A nova versão traz melhorias significativas na forma como o modelo explica seu processo de pensamento antes de chegar a uma resposta, especialmente em tarefas de matemática e programação.
O Open R1 foi treinado usando uma técnica chamada GRPO (Group Relative Policy Optimization, um método que ensina o modelo a melhorar suas respostas comparando diferentes tentativas de resolver o mesmo problema). Segundo informou a Hugging Face em seu blog oficial, a atualização incluiu ajustes nos pesos do modelo (os parâmetros internos que determinam como ele responde) e no conjunto de dados usado para treinamento, resultando em raciocínios mais claros e precisos.
Uma das mudanças mais visíveis está na capacidade do modelo de mostrar seu trabalho passo a passo. Em vez de apenas dar uma resposta final, o Open R1 agora detalha o caminho lógico que seguiu, o que facilita identificar onde ele acerta ou erra. Isso é especialmente útil para quem quer usar o modelo em educação ou em aplicações onde é preciso auditar as decisões da IA.
A Hugging Face disponibilizou a nova versão gratuitamente para download, mantendo a estratégia de desenvolvimento colaborativo que marca o projeto. Qualquer desenvolvedor pode pegar o modelo, testá-lo em seus próprios dados e até contribuir com melhorias. A empresa também publicou os logs de treinamento (registros detalhados do processo de aprendizado do modelo), algo raro no setor e que permite à comunidade estudar exatamente como o sistema foi construído.
O lançamento reforça a competição entre modelos abertos e fechados no campo do raciocínio artificial. Enquanto empresas como a OpenAI mantêm seus sistemas proprietários e cobram pelo acesso, a Hugging Face aposta que abrir o código acelera a inovação e distribui o poder de desenvolver IA para além das big techs. A segunda atualização do Open R1 mostra que essa estratégia está gerando resultados concretos em pouco tempo.


