En directo
[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA[Investigación]Cómo dar prioridad a la investigación más valiosa sin dejar GPUs sin usar[Herramientas]Seis modelos de IA en una semana, sin escribir código: así funciona ML Intern[Modelos de IA]Liquid AI lanza dos modelos de IA que toman decisiones en 16 milisegundos[Investigación]Nvidia logra medalla de oro en dos olimpiadas científicas con el mismo modelo de IA[Modelos de IA]Un modelo de IA que habla árabe emiratí como un local[Herramientas]Hugging Face convierte su plataforma en un catálogo unificado de entornos para entrenar agentes de IA[Herramientas]Un benchmark de Microsoft exige que los agentes de IA funcionen bien veinte veces seguidas[Modelos de IA]Allen AI publica AstaBrief, un modelo abierto que redacta informes científicos con citas en un minuto[Investigación]ServiceNow crea un sistema que genera automáticamente tareas para entrenar agentes de IA empresariales[Investigación]Allen Institute publica Olmo-core 3, su infraestructura abierta para entrenar modelos gigantes de IA
Transmitiendo · —

Noticias.
Inteligencia Artificial

Inteligencia Artificial para Gente Real · ES / PT-BR

InvestigaciónHugging Face Blog2 min

Entrenar modelos de IA para estudiar ARN mensajero cuesta menos que una cena: 165 dólares

Un equipo ha creado modelos de lenguaje especializados en ARN de 25 especies animales gastando solo el precio de un portátil básico, demostrando que la ciencia ya no necesita superordenadores.

Por Redacción2 min
Compartir
Entrenar modelos de IA para estudiar ARN mensajero cuesta menos que una cena: 165 dólares
Investigación · Hugging Face Blog

Un grupo de investigadores acaba de demostrar que entrenar modelos de inteligencia artificial para analizar ARN mensajero (el tipo de molécula que lleva las instrucciones genéticas dentro de nuestras células, y que se hizo famoso con las vacunas de Moderna y Pfizer) puede costar apenas 165 dólares. El equipo, liderado por OpenMed en colaboración con Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados), entrenó modelos capaces de procesar secuencias genéticas de 25 especies animales distintas, desde ratones hasta primates, según explicaron en su blog oficial.

Lo llamativo no es solo el precio ridículamente bajo, sino que lo lograron usando una Nvidia RTX 4090 (una tarjeta gráfica de gama alta pensada para videojuegos, no para ciencia) y técnicas de entrenamiento optimizadas. El modelo principal, llamado mRNA-1.3B, tiene 1.300 millones de parámetros (los valores internos que ajusta el modelo para aprender patrones) y fue entrenado en apenas 24 horas. Otros modelos más pequeños, como uno de 150 millones de parámetros, costaron solo 15 dólares y tardaron dos horas y media.

El truco está en una técnica llamada LoRA (Low-Rank Adaptation, un método que permite ajustar modelos grandes modificando solo una pequeña parte de sus parámetros internos en lugar de reentrenar todo desde cero). Esto reduce drásticamente la cantidad de cálculos necesarios y, por tanto, el coste. Los modelos resultantes superan en precisión a otros especializados en biología molecular como CodonBERT y NT-v2-250M en tareas como predecir la estabilidad del ARN o identificar regiones reguladoras de genes, según las métricas que publicaron.

¿Por qué importa? Porque hasta hace poco, entrenar este tipo de modelos requería acceso a clústeres de servidores caros y meses de trabajo. Ahora, un laboratorio universitario con presupuesto ajustado puede hacerlo en un fin de semana con hardware de consumo. Los modelos están publicados bajo licencia Apache 2.0 (una licencia de software libre que permite usar, modificar y distribuir el código sin restricciones) en Hugging Face, lo que significa que cualquiera puede descargarlos y usarlos gratis para investigar nuevas terapias génicas, optimizar vacunas de ARN o estudiar enfermedades genéticas.

El proyecto también incluyó modelos multiespecie, entrenados con datos de humanos, ratones, cerdos y primates simultáneamente, lo que permite comparar cómo funciona el ARN mensajero en distintos organismos. Esto es útil para prever si un tratamiento que funciona en ratones podría funcionar en humanos. El coste total de entrenar todos los modelos del estudio, incluyendo experimentos fallidos, fue de 750 dólares, menos que un iPhone.

Fuente original
Hugging Face Blog
Más en · Investigación