Ao vivo
[Ferramentas]Como adicionar marcas d'água em imagens de IA com uma linha de código[Ferramentas]LeRobot lança formato de dataset que facilita treinar robôs com milhões de exemplos[Ferramentas]Três truques da OpenAI para rodar modelos de IA muito mais rápido (que você pode usar hoje)[Modelos de IA]Writer lança modelos de IA compactos que raciocinam sem precisar de servidores potentes[Ferramentas]Hugging Face e Together AI facilitam o ajuste fino de qualquer modelo de linguagem[Ferramentas]ServiceNow cria framework que gera dados de treino para qualquer modelo de IA[Pesquisa]Hugging Face lança ferramentas para qualquer um estudar agentes de IA[Ferramentas]Hugging Face passa a oferecer servidores franceses da Scaleway para rodar modelos de IA[Regulação]Mulher acusa padrasto de usar Grok para criar imagem sexual a partir de foto de infância[Modelos de IA]Anthropic detalha como vão funcionar as marcas d'água do Claude[Ferramentas]Como adicionar marcas d'água em imagens de IA com uma linha de código[Ferramentas]LeRobot lança formato de dataset que facilita treinar robôs com milhões de exemplos[Ferramentas]Três truques da OpenAI para rodar modelos de IA muito mais rápido (que você pode usar hoje)[Modelos de IA]Writer lança modelos de IA compactos que raciocinam sem precisar de servidores potentes[Ferramentas]Hugging Face e Together AI facilitam o ajuste fino de qualquer modelo de linguagem[Ferramentas]ServiceNow cria framework que gera dados de treino para qualquer modelo de IA[Pesquisa]Hugging Face lança ferramentas para qualquer um estudar agentes de IA[Ferramentas]Hugging Face passa a oferecer servidores franceses da Scaleway para rodar modelos de IA[Regulação]Mulher acusa padrasto de usar Grok para criar imagem sexual a partir de foto de infância[Modelos de IA]Anthropic detalha como vão funcionar as marcas d'água do Claude
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog1 min

IBM abre código de nova família de modelos de IA e explica como foram treinados

A série Granite 4.1 traz modelos de linguagem com pesos abertos otimizados para empresas, e a IBM detalhou pela primeira vez todo o processo de construção.

Por Redação1 min
Compartilhar
IBM abre código de nova família de modelos de IA e explica como foram treinados
Modelos de IA · Hugging Face Blog

A IBM lançou a família Granite 4.1, uma nova geração de modelos de linguagem (LLMs, os sistemas de IA que entendem e geram texto) com código aberto e voltados para uso empresarial. Diferente de versões anteriores, a empresa publicou um artigo técnico detalhando cada etapa do treinamento — desde a seleção de dados até os ajustes finais — e disponibilizou os modelos no Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados).

Os novos modelos variam de 1 bilhão a 128 bilhões de parâmetros (valores ajustáveis que determinam como o modelo processa informação). A IBM treinou tudo do zero usando 12 trilhões de tokens (unidades de texto que o modelo lê durante o aprendizado) em múltiplos idiomas, com foco em dados corporativos, jurídicos e técnicos. A arquitetura é baseada em transformers (a tecnologia por trás do ChatGPT e similares), mas inclui melhorias como atenção por janelas deslizantes e embedding rotacional, técnicas que tornam o processamento mais eficiente.

Um dos destaques é o Granite Guardian, um modelo menor treinado especificamente para detectar riscos em conversas de IA — como conteúdo nocivo, jailbreaks (tentativas de burlar as proteções do sistema) ou respostas alucinadas (informações inventadas pelo modelo). Segundo a IBM, ele superou modelos concorrentes da Meta em testes de segurança, mesmo sendo menor.

A empresa também liberou versões instruct (ajustadas para seguir comandos de usuários) e chat (otimizadas para diálogo), além de ferramentas de fine-tuning (personalização do modelo com dados próprios) e quantização (técnica que reduz o tamanho do modelo para rodar em hardware mais simples). Todos os modelos estão sob licença Apache 2.0, que permite uso comercial sem restrições. A IBM afirma que a transparência no processo de treinamento é essencial para empresas que precisam auditar sistemas de IA antes de colocá-los em produção.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA