En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Holo2, el modelo de IA que traduce interfaces de aplicaciones mejor que GPT-4

H Company lanza un modelo especializado en localización de menús, botones y textos de apps que supera a los grandes modelos generalistas.

Por Redacción2 min
Compartir
Holo2, el modelo de IA que traduce interfaces de aplicaciones mejor que GPT-4
Modelos de IA · Hugging Face Blog

Una startup llamada H Company acaba de publicar Holo2 (un modelo de inteligencia artificial especializado en traducir interfaces de usuario de aplicaciones móviles y web), que según sus propias pruebas supera a GPT-4o y Claude 3.5 Sonnet en esta tarea concreta. El modelo, disponible en Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados), está diseñado para entender el contexto visual de una app —botones, menús, formularios— y traducir esos textos de forma que tengan sentido en el idioma de destino sin romper el diseño ni el significado.

Holo2 tiene 235.000 millones de parámetros (los valores internos que un modelo ajusta durante su entrenamiento para aprender patrones), lo que lo sitúa en la categoría de modelos grandes, pero su ventaja no está solo en el tamaño: H Company lo entrenó con capturas de pantalla reales de aplicaciones y traducciones hechas por humanos, en lugar de usar únicamente texto plano como hacen los LLM generalistas (modelos de lenguaje capaces de responder preguntas, redactar textos o traducir, pero sin especialización en un área concreta). Esto le permite detectar cuándo un botón dice "OK" en inglés pero debería traducirse como "Aceptar" en español, o cuándo "Settings" es más natural como "Ajustes" que como "Configuración", dependiendo del tipo de app.

Según informó H Company en su blog oficial, Holo2 obtiene mejores resultados que GPT-4o en métricas como BLEU y COMET (medidas automáticas que comparan traducciones generadas por máquina con traducciones de referencia hechas por humanos) cuando se evalúa en datasets de localización de UI. La empresa también publicó una versión de 22.000 millones de parámetros, pensada para empresas que necesitan ejecutar el modelo en sus propios servidores sin depender de APIs externas (servicios en la nube que cobran por cada traducción).

El lanzamiento llega en un momento en que muchas compañías buscan alternativas a los modelos generalistas para tareas específicas: traducir una app no es lo mismo que redactar un correo o resumir un artículo, y un modelo entrenado específicamente para eso puede ser más preciso y más barato de ejecutar. H Company no ha revelado públicamente quiénes son sus primeros clientes, pero asegura que varias empresas de videojuegos y redes sociales ya están probando Holo2 en producción.

Los pesos del modelo (los parámetros entrenados que permiten a cualquiera descargarlo y usarlo) están disponibles bajo una licencia abierta con restricciones comerciales para la versión grande, mientras que la versión pequeña es de uso completamente libre. Esto significa que desarrolladores individuales o startups pueden experimentar con Holo2 sin coste, pero empresas grandes que quieran usarlo en sus productos tendrán que negociar una licencia con H Company.

Fuente original
Hugging Face Blog
Más en · Modelos de IA