IBM lanza su familia Granite 4.2, modelos de IA con licencia abierta que aprenden solos a usar herramientas
La compañía publica tres modelos de lenguaje de pesos abiertos entrenados con 15 billones de datos, y los mayores incorporan una técnica de aprendizaje que les permite ejecutar código y utilizar herramientas por iniciativa propia
IBM ha lanzado Granite 4.2, tres modelos de lenguaje (sistemas de IA que entienden y generan texto) de 3.000, 8.000 y 30.000 millones de parámetros, disponibles bajo licencia Apache 2.0. Los dos mayores incorporan aprendizaje reforzado agéntico, una técnica que les permite aprender por sí mismos a ejecutar código y usar herramientas externas sin programación adicional.

IBM ha lanzado su familia Granite 4.2, una serie de modelos de lenguaje (sistemas de IA capaces de entender y generar texto) que cualquiera puede descargar, modificar y usar comercialmente sin restricciones, según informó The Decoder. Los modelos llegan en tres tamaños: 3.000 millones, 8.000 millones y 30.000 millones de parámetros (los valores numéricos que determinan cómo responde el modelo), y han sido entrenados con aproximadamente 15 billones de fragmentos de texto.
Una de las características más llamativas de estos modelos es su ventana de contexto (la cantidad de información que pueden procesar de una sola vez) de hasta 512.000 tokens, una cifra equivalente a unas 384.000 palabras o varios libros completos. Esto permite que el modelo trabaje con documentos extensos sin perder el hilo de la conversación o el análisis.
Los modelos más grandes de la familia incorporan una técnica de entrenamiento llamada "aprendizaje reforzado agéntico" (agentic RL, un método que enseña al modelo a tomar decisiones y ejecutar acciones por su cuenta, como si fuera un agente autónomo). Gracias a este enfoque, los modelos Granite 4.2 de 8.000 y 30.000 millones de parámetros han aprendido por sí mismos a utilizar herramientas externas y ejecutar código, sin necesidad de programación adicional por parte del usuario.
La distinción de "pesos abiertos" significa que IBM publica los parámetros internos del modelo, no solo el código para ejecutarlo. Esto permite a desarrolladores y empresas ajustar el comportamiento del modelo según sus necesidades específicas, ejecutarlo en sus propios servidores sin depender de servicios en la nube, o incluso entrenarlo con datos adicionales.
Los tres modelos están disponibles bajo licencia Apache 2.0, una de las más permisivas del código abierto, que permite uso comercial sin obligación de compartir las modificaciones. Esta decisión contrasta con la tendencia de otras empresas tecnológicas de limitar el acceso a sus modelos más avanzados mediante APIs de pago (servicios que cobran por cada consulta al modelo) o licencias restrictivas.


