Ao vivo
[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas[Pesquisa]Como o Ai2 resolveu a briga por GPUs com orçamentos em vez de fila de prioridade[Ferramentas]Como criar modelos de IA personalizados por menos de US$ 20 usando um agente automatizado[Modelos de IA]Liquid AI lança modelos de IA que tomam decisões em milissegundos — e funcionam em celulares[Modelos de IA]TII lança Falcon ASR, modelo de transcrição de áudio aberto que roda em hardware comum[Modelos de IA]Nvidia mostra que um único modelo de IA pode chegar ao pódio tanto em programação quanto em matemática avançada[Modelos de IA]Falcon-Emirati: o modelo de IA que aprendeu a falar árabe como um emiradense de verdade[Ferramentas]Hugging Face cria repositório central para ambientes de IA que aprendem por tentativa e erro[Ferramentas]O agente de IA disse que terminou. O banco de dados discordou.[Modelos de IA]Instituto Allen lança modelo de IA aberto para escrever relatórios científicos em segundos[Pesquisa]Como a ServiceNow cria dados de treino que ensinam agentes de IA a funcionar dentro de empresas
Transmitindo · —

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog2 min

DeepSeek-V4 processa um milhão de tokens e agentes de IA finalmente conseguem usar tudo isso

Novo modelo chinês de código aberto promete contexto gigante que funciona de verdade — e pode rodar até em computadores comuns.

Por Redação2 min
Compartilhar
DeepSeek-V4 processa um milhão de tokens e agentes de IA finalmente conseguem usar tudo isso
Modelos de IA · Hugging Face Blog

A DeepSeek, empresa chinesa que vem ganhando destaque no cenário global de inteligência artificial, lançou o DeepSeek-V4, um modelo de linguagem (LLM, tipo de IA treinada para entender e gerar texto) que consegue processar até um milhão de tokens de uma vez — o equivalente a cerca de 750 mil palavras, ou um livro inteiro. Mas a novidade real não é só o tamanho: segundo informou a Hugging Face (plataforma onde desenvolvedores compartilham modelos de IA), o V4 é o primeiro modelo com contexto tão grande que agentes de IA (programas autônomos que tomam decisões e executam tarefas sozinhos) conseguem de fato aproveitar essa capacidade sem se perder ou travar no meio do caminho.

Modelos anteriores com contexto longo costumavam falhar quando recebiam muita informação de uma vez: esqueciam detalhes do início, misturavam dados ou simplesmente ignoravam partes do texto. O DeepSeek-V4 usa uma arquitetura chamada MLA (Multi-head Latent Attention, um jeito mais eficiente de a IA prestar atenção em diferentes partes do texto ao mesmo tempo) que reduz o custo computacional — ou seja, ele processa mais informação gastando menos memória e energia. Isso é essencial para que agentes consigam trabalhar com documentos extensos, bases de código inteiras ou longas conversas sem perder o fio da meada.

Outro ponto de destaque é que a DeepSeek liberou o modelo com pesos abertos (os parâmetros internos que definem como a IA funciona estão disponíveis para qualquer um baixar e modificar), o que significa que empresas e desenvolvedores podem rodar o V4 em seus próprios servidores, adaptá-lo para casos específicos ou até usá-lo em dispositivos locais, sem depender da nuvem. A companhia também oferece uma versão menor, chamada DeepSeek-V4-Lite, que roda em hardware mais modesto — incluindo GPUs de consumo (placas de vídeo como as que gamers usam) e até em chips como o Jetson Nano (um computador pequeno e barato feito para rodar IA sem precisar de internet).

Nos testes de benchmark (conjuntos de tarefas padronizadas usadas para comparar modelos), o DeepSeek-V4 ficou próximo ou superou concorrentes como o GPT-4 e o Claude 3.5 em várias categorias, especialmente em raciocínio matemático e geração de código. A empresa não divulgou o custo total de treinamento, mas afirmou que usou uma técnica chamada MoE (Mixture of Experts, em que apenas parte dos neurônios artificiais é ativada para cada tarefa), o que torna o modelo mais barato de treinar e mais rápido de rodar do que os gigantes ocidentais. Para o mercado brasileiro e outros países fora do eixo EUA-China, a chegada de modelos potentes e abertos como o V4 pode representar uma alternativa real para quem quer desenvolver soluções de IA sem depender de APIs pagas ou de infraestrutura proprietária de grandes empresas.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA