En directo
[Negocios]Generalist, la startup de robots con IA, alcanza una valoración de 3.000 millones de dólares[Herramientas]Cuatro millones de modelos de IA escaneados en busca de vulnerabilidades[Negocios]OpenAI pierde a otro alto cargo: se va el responsable de sus centros de datos[Regulación]OpenAI desactiva cuentas rusas que usaban IA para difundir propaganda pro-Kremlin[Negocios]OpenAI explica cómo reduce los costes de su IA mientras mejora su rendimiento[Investigación]Co-Scientist, la IA de Google que ya diseña experimentos y redacta artículos científicos[Negocios]Una antigua fundición de aluminio en Kentucky será el próximo gran centro de datos de Anthropic[Negocios]La inteligencia artificial ahorra tres horas de trabajo a la semana, pero solo a la mitad de los empleados[Investigación]Una IA de OpenAI ayuda a diagnosticar 18 enfermedades raras infantiles que llevaban años sin identificar[Investigación]OpenAI presenta un examen de biología avanzada para medir qué tan bien razonan sus modelos de IA[Negocios]Generalist, la startup de robots con IA, alcanza una valoración de 3.000 millones de dólares[Herramientas]Cuatro millones de modelos de IA escaneados en busca de vulnerabilidades[Negocios]OpenAI pierde a otro alto cargo: se va el responsable de sus centros de datos[Regulación]OpenAI desactiva cuentas rusas que usaban IA para difundir propaganda pro-Kremlin[Negocios]OpenAI explica cómo reduce los costes de su IA mientras mejora su rendimiento[Investigación]Co-Scientist, la IA de Google que ya diseña experimentos y redacta artículos científicos[Negocios]Una antigua fundición de aluminio en Kentucky será el próximo gran centro de datos de Anthropic[Negocios]La inteligencia artificial ahorra tres horas de trabajo a la semana, pero solo a la mitad de los empleados[Investigación]Una IA de OpenAI ayuda a diagnosticar 18 enfermedades raras infantiles que llevaban años sin identificar[Investigación]OpenAI presenta un examen de biología avanzada para medir qué tan bien razonan sus modelos de IA
Transmitiendo ·

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

NegociosXataka — Inteligencia Artificial2 min

OpenAI presenta Jalapeño, su primer chip propio que supera a Nvidia en eficiencia energética

El chip de inferencia de OpenAI consume menos energía que los Blackwell de Nvidia al ejecutar modelos de lenguaje, aunque la empresa de Jensen Huang sigue dominando el entrenamiento de IA

Por Redacción2 min
En resumen

OpenAI presentó Jalapeño, su primer chip diseñado para inferencia (ejecutar modelos de IA ya entrenados y generar respuestas). Según análisis independientes, supera a los chips Blackwell de Nvidia en latencia (velocidad de respuesta) y eficiencia energética al ejecutar modelos de lenguaje, aunque Nvidia sigue dominando el entrenamiento de modelos.

Compartir
OpenAI presenta Jalapeño, su primer chip propio que supera a Nvidia en eficiencia energética
Negocios · Xataka — Inteligencia Artificial

OpenAI acaba de presentar Jalapeño, su primer chip diseñado específicamente para inferencia (la parte del proceso donde un modelo de IA ya entrenado genera respuestas cuando alguien lo usa, como al escribir en ChatGPT). Según el análisis de SemiAnalysis, una firma especializada en semiconductores, este chip supera a los Blackwell de Nvidia en dos aspectos clave: latencia (el tiempo que tarda en responder) y rendimiento por vatio (cuánta energía consume para hacer el mismo trabajo). Dependiendo del modelo probado, OpenAI habla de hasta 3,6 veces menos latencia y entre 1,5 y 1,9 veces más eficiencia energética.

Lo más llamativo es que Jalapeño consigue estos resultados sin usar Multi-Token Prediction o MTP (una técnica que genera varios tokens de forma especulativa para acelerar las respuestas), mientras que los chips de Nvidia sí la empleaban en las pruebas. Los analistas probaron el chip con modelos de pesos abiertos (modelos cuyos parámetros internos están disponibles públicamente) como GPT-OSS 120B, DeepSeek R1 670B y Kimi K2.5 1T. Según SemiAnalysis, cuando OpenAI active MTP en Jalapeño, el rendimiento mejorará aún más, acercándose al de Vera Rubin, la próxima generación de chips de IA de Nvidia.

Esta ventaja tiene trampa: Jalapeño está diseñado para hacer una sola cosa muy bien, ejecutar los modelos de lenguaje de OpenAI, mientras que las GPU (procesadores gráficos que también sirven para entrenar y ejecutar IA) de Nvidia están pensadas para tareas mucho más variadas. De hecho, OpenAI seguirá necesitando miles de GPU de Nvidia para entrenar sus modelos, donde la empresa del chip verde sigue sin rival gracias a CUDA (un ecosistema de software que lleva casi dos décadas facilitando la programación en sus procesadores). Pero cuando hablamos de inferencia, tener un chip a medida marca la diferencia: OpenAI conoce mejor que nadie cómo funcionan sus propios modelos.

La razón detrás de Jalapeño es económica. Entrenar un modelo de IA cuesta una fortuna, pero se hace una sola vez. Ejecutarlo (servir las respuestas a millones de usuarios) cuesta dinero cada vez que alguien lo usa, y esa factura crece exponencialmente con los agentes de IA (sistemas que realizan tareas complejas haciendo múltiples consultas al modelo). Al diseñar su propio chip, OpenAI reduce lo que le cuesta generar cada token (la unidad mínima de texto que produce un modelo) y, de paso, depende menos de Nvidia. Por ahora, la compañía no planea vender Jalapeño a terceros: lo usará en sus propios centros de datos.

OpenAI no está sola en esta carrera. Google lleva años usando sus TPU (procesadores diseñados específicamente para IA), Amazon tiene sus chips Trainium e Inferentia, y Microsoft y Meta también desarrollan hardware propio. Nvidia sigue dominando el entrenamiento de modelos, pero en inferencia la competencia aprieta cada vez más. Aunque la empresa de Jensen Huang tiene un as en la manga: según informó Xataka, recientemente pagó 20.000 millones de dólares por la tecnología de Groq, una empresa especializada precisamente en chips de inferencia ultrarrápidos.

Más en · Negocios