Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog1 min

IBM abre código de nova família de modelos de IA e explica como foram treinados

A série Granite 4.1 traz modelos de linguagem com pesos abertos otimizados para empresas, e a IBM detalhou pela primeira vez todo o processo de construção.

Por Redação1 min
Compartilhar
IBM abre código de nova família de modelos de IA e explica como foram treinados
Modelos de IA · Hugging Face Blog

A IBM lançou a família Granite 4.1, uma nova geração de modelos de linguagem (LLMs, os sistemas de IA que entendem e geram texto) com código aberto e voltados para uso empresarial. Diferente de versões anteriores, a empresa publicou um artigo técnico detalhando cada etapa do treinamento — desde a seleção de dados até os ajustes finais — e disponibilizou os modelos no Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados).

Os novos modelos variam de 1 bilhão a 128 bilhões de parâmetros (valores ajustáveis que determinam como o modelo processa informação). A IBM treinou tudo do zero usando 12 trilhões de tokens (unidades de texto que o modelo lê durante o aprendizado) em múltiplos idiomas, com foco em dados corporativos, jurídicos e técnicos. A arquitetura é baseada em transformers (a tecnologia por trás do ChatGPT e similares), mas inclui melhorias como atenção por janelas deslizantes e embedding rotacional, técnicas que tornam o processamento mais eficiente.

Um dos destaques é o Granite Guardian, um modelo menor treinado especificamente para detectar riscos em conversas de IA — como conteúdo nocivo, jailbreaks (tentativas de burlar as proteções do sistema) ou respostas alucinadas (informações inventadas pelo modelo). Segundo a IBM, ele superou modelos concorrentes da Meta em testes de segurança, mesmo sendo menor.

A empresa também liberou versões instruct (ajustadas para seguir comandos de usuários) e chat (otimizadas para diálogo), além de ferramentas de fine-tuning (personalização do modelo com dados próprios) e quantização (técnica que reduz o tamanho do modelo para rodar em hardware mais simples). Todos os modelos estão sob licença Apache 2.0, que permite uso comercial sem restrições. A IBM afirma que a transparência no processo de treinamento é essencial para empresas que precisam auditar sistemas de IA antes de colocá-los em produção.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA