Ao vivo
[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog3 min

Hugging Face avança no Open-R1, seu modelo de raciocínio aberto que desafia o o1 da OpenAI

A plataforma publicou a primeira atualização do projeto que quer criar uma alternativa de código aberto ao o1, modelo de raciocínio da OpenAI, e já tem quase 8 mil exemplos de raciocínio humano coletados pela comunidade

Por Redação3 min
Em resumo

A Hugging Face publicou a primeira atualização do Open-R1, projeto para criar uma alternativa aberta ao o1 da OpenAI. A comunidade já contribuiu com quase 8 mil exemplos de raciocínio humano, e a empresa lançou o OpenR1-Math-7B, um modelo experimental de 7 bilhões de parâmetros especializado em matemática, disponível para download.

Compartilhar
Hugging Face avança no Open-R1, seu modelo de raciocínio aberto que desafia o o1 da OpenAI
Modelos de IA · Hugging Face Blog

A Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados) publicou nesta semana a primeira atualização do Open-R1, projeto lançado há duas semanas para criar uma alternativa de código aberto ao o1 — o modelo de raciocínio (um tipo de IA que mostra o passo a passo do próprio raciocínio antes de dar uma resposta) da OpenAI. Segundo informou a empresa no blog oficial, a comunidade já contribuiu com 7.871 exemplos de raciocínio humano anotados, ultrapassando a meta inicial de 5 mil.

Esses exemplos são fundamentais porque ensinam o modelo a pensar em voz alta. Voluntários recebem perguntas de matemática, lógica ou ciência e escrevem não apenas a resposta, mas todo o raciocínio — como se estivessem resolvendo o problema no papel. A Hugging Face está usando esses dados para fazer fine-tuning (o ajuste fino de um modelo já treinado com novos exemplos) em modelos abertos como o Qwen (uma família de LLMs, ou grandes modelos de linguagem, criada pela chinesa Alibaba) e o DeepSeek-R1 (um modelo de raciocínio de pesos abertos lançado pela startup chinesa DeepSeek).

A novidade mais concreta desta atualização é o lançamento do OpenR1-Math-7B, um modelo experimental de 7 bilhões de parâmetros (os parâmetros são os valores ajustáveis que o modelo aprende durante o treinamento — quanto mais parâmetros, mais complexo e, em geral, mais capaz é o modelo) especializado em matemática. Ele foi treinado a partir do Qwen2.5-Math-7B e já está disponível para download. Nos primeiros testes internos, segundo a Hugging Face, ele mostrou capacidade de resolver problemas de competições matemáticas de nível universitário, embora ainda cometa erros em questões mais simples.

A empresa também compartilhou os primeiros resultados de benchmarks (testes padronizados usados para comparar o desempenho de diferentes modelos de IA). No AIME 2024 (um exame de matemática avançada para estudantes do ensino médio nos Estados Unidos), o OpenR1-Math-7B acertou 10% das questões — um desempenho modesto, mas notável para um modelo pequeno rodando inteiramente em um computador pessoal, sem precisar de servidores na nuvem. Para comparação, o o1 da OpenAI acerta 79,2% das mesmas questões, mas é fechado, muito maior e roda apenas nos servidores da empresa.

A Hugging Face deixou claro que o Open-R1 ainda está em estágio inicial. A interface para coletar raciocínios humanos está sendo redesenhada para facilitar contribuições, e a empresa promete publicar atualizações semanais com novos modelos, datasets (conjuntos de dados usados para treinar ou testar modelos de IA) e resultados. O objetivo declarado é criar não um único modelo, mas uma infraestrutura pública — dados, código e técnicas de treinamento — para que qualquer pessoa possa treinar modelos de raciocínio sem depender de empresas privadas.

O projeto é parte de um movimento maior na comunidade de IA aberta, impulsionado pelo lançamento do DeepSeek-R1 no mês passado. Aquele modelo mostrou que era possível replicar capacidades de raciocínio semelhantes às do o1 com orçamentos muito menores e usando hardware menos potente, desde que os pesos (os valores dos parâmetros treinados, que determinam como o modelo responde) fossem abertos. O Open-R1 leva essa lógica adiante, tentando abrir também o processo de criação dos dados de treinamento.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA