Ao vivo
[Negócios]Startup de robótica Generalist atinge avaliação de US$ 3 bilhões[Negócios]OpenAI perde mais um executivo sênior em meio a onda de saídas[Modelos de IA]Hugging Face e Protect AI já varreram 4 milhões de modelos de IA em busca de falhas de segurança[Negócios]Como a OpenAI planeja entregar IA mais barata e poderosa ao mesmo tempo[Pesquisa]Sistema de IA do Google DeepMind agora planeja experimentos, opera equipamentos e escreve artigos científicos[Regulação]OpenAI barra campanha russa que usava IA para fingir ser think tank israelense[Negócios]Velha fábrica de alumínio no Kentucky vira megacentro de IA para a Anthropic por US$ 14 bilhões[Pesquisa]Modelo de IA da OpenAI ajuda a diagnosticar 18 doenças raras em crianças que médicos não conseguiam identificar[Pesquisa]OpenAI lança teste que avalia se a IA realmente entende pesquisa científica[Regulação]Anthropic quer criar padrão para IA controlando máquinas no mundo real[Negócios]Startup de robótica Generalist atinge avaliação de US$ 3 bilhões[Negócios]OpenAI perde mais um executivo sênior em meio a onda de saídas[Modelos de IA]Hugging Face e Protect AI já varreram 4 milhões de modelos de IA em busca de falhas de segurança[Negócios]Como a OpenAI planeja entregar IA mais barata e poderosa ao mesmo tempo[Pesquisa]Sistema de IA do Google DeepMind agora planeja experimentos, opera equipamentos e escreve artigos científicos[Regulação]OpenAI barra campanha russa que usava IA para fingir ser think tank israelense[Negócios]Velha fábrica de alumínio no Kentucky vira megacentro de IA para a Anthropic por US$ 14 bilhões[Pesquisa]Modelo de IA da OpenAI ajuda a diagnosticar 18 doenças raras em crianças que médicos não conseguiam identificar[Pesquisa]OpenAI lança teste que avalia se a IA realmente entende pesquisa científica[Regulação]Anthropic quer criar padrão para IA controlando máquinas no mundo real
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

NegóciosXataka — Inteligencia Artificial2 min

OpenAI apresenta seu primeiro chip próprio e supera Nvidia em testes de eficiência

O Jalapeño, chip de inferência da OpenAI, mostrou ser mais eficiente que o Blackwell da Nvidia em latência e consumo de energia ao executar modelos de linguagem como o DeepSeek R1

Por Redação2 min
Em resumo

A OpenAI criou o Jalapeño, um chip especializado em rodar modelos de linguagem já treinados (a etapa chamada inferência, quando a IA responde perguntas). Em testes independentes, ele se mostrou até 3,6 vezes mais rápido e quase duas vezes mais eficiente em consumo de energia que o Blackwell da Nvidia ao executar modelos como o DeepSeek R1

Compartilhar
OpenAI apresenta seu primeiro chip próprio e supera Nvidia em testes de eficiência
Negócios · Xataka — Inteligencia Artificial

A OpenAI revelou o Jalapeño, seu primeiro chip dedicado a inferência de inteligência artificial (a etapa em que um modelo já treinado processa uma pergunta e gera uma resposta). Segundo análise da SemiAnalysis (uma consultoria especializada em semicondutores), o componente conseguiu superar os chips Blackwell da Nvidia em várias métricas importantes ao rodar modelos de linguagem de grande porte (LLMs, os modelos que entendem e geram texto).

Os testes usaram modelos de pesos abertos (modelos cujos arquivos internos podem ser baixados e rodados por qualquer pessoa) como o GPT-OSS 120B, o DeepSeek R1 670B e o Kimi K2.5 1T. O Jalapeño mostrou até 3,6 vezes menos latência (o tempo que leva para começar a gerar a resposta) e entre 1,5 e 1,9 vezes mais eficiência energética — medida em quanto trabalho o chip faz por watt consumido — do que o Blackwell, dependendo do modelo testado.

O desempenho impressiona ainda mais porque o Jalapeño não estava usando a técnica de Multi-Token Prediction (MTP, um método que gera várias palavras de uma vez de forma especulativa para acelerar as respostas), enquanto os chips da Nvidia nos testes sim. Os analistas estimam que, quando a OpenAI ativar essa otimização, o Jalapeño pode se aproximar até do Vera Rubin, a próxima geração de chips de IA da Nvidia, em custo total de propriedade (TCO, a soma de todos os gastos para comprar, operar e manter o equipamento ao longo do tempo).

É importante destacar que o Jalapeño foi desenhado para uma tarefa muito específica. A Nvidia ainda domina o treinamento de modelos (a etapa em que a IA aprende, que exige chips muito mais flexíveis) e conta com o CUDA (uma plataforma de software que facilita programar para as GPUs da empresa), construído ao longo de quase duas décadas. A OpenAI continuará dependendo das GPUs da Nvidia para treinar seus modelos.

Mas a inferência é onde está o gasto contínuo: treinar um modelo custa uma fortuna uma única vez, mas servi-lo custa dinheiro cada vez que alguém usa o ChatGPT ou chama a API (a interface que permite outros aplicativos conversarem com os modelos da OpenAI). Com o crescimento dos agentes de IA (sistemas que executam tarefas complexas fazendo dezenas ou centenas de chamadas ao modelo), reduzir o custo por token (cada pedaço de texto processado) se tornou estratégico. O Jalapeño não será vendido para outras empresas por enquanto — a OpenAI quer usá-lo internamente para reduzir custos e depender menos da Nvidia.

A OpenAI se junta a Google (que usa TPUs, chips próprios para IA, há anos), Amazon (com os chips Trainium e Inferentia), Microsoft e Meta na corrida pelos chips de inferência. A Nvidia ainda domina o mercado de treinamento, mas enfrenta competição crescente na inferência — embora tenha recentemente comprado a Groq (uma startup que desenvolveu chips extremamente rápidos para rodar modelos de linguagem), o que pode ser sua resposta a esse desafio.

Mais em · Negócios