
Richard Sutton cree que los datos sintéticos son «un gran error» para entrenar inteligencia artificial
El pionero de la IA rechaza usar simulaciones para escalar modelos de lenguaje y apuesta por agentes que aprendan continuamente de la realidad.
Noticias.
Inteligencia Artificial
Inteligencia Artificial para Gente Real · ES / PT-BR

El pionero de la IA rechaza usar simulaciones para escalar modelos de lenguaje y apuesta por agentes que aprendan continuamente de la realidad.

Los nuevos modelos chinos rivalizan con los mejores de OpenAI y Google, y los laboratorios occidentales acusan destilación ilegal, pero admiten que la ventaja técnica ya no se puede defender.

Un equipo de seguridad ha creado prototipos de malware que usan modelos de lenguaje para atacar sistemas de forma autónoma y adaptativa.

La empresa ha publicado en código abierto un framework que permite generar ejemplos sintéticos de alta calidad para entrenar modelos de lenguaje, sin necesidad de usar GPT-4 ni otros modelos de pago.

La empresa especializada en IA para empresas ha adaptado un modelo abierto de Zhipu AI para ofrecer capacidades similares a las de sistemas más caros, pero con una factura mucho menor.

La nueva generación de procesadores Xeon permite entrenar y ejecutar LLMs sin depender de GPUs, según pruebas de Hugging Face.

Un equipo de investigadores ha desarrollado una técnica que reduce hasta 30 veces el coste de entrenar modelos pequeños y eficientes a partir de modelos gigantes.

La técnica de 'continuous batching' permite que servidores de IA atiendan varias peticiones a la vez sin esperar a que todas terminen, algo clave para que ChatGPT y servicios similares funcionen de forma eficiente.

La startup ha desarrollado Deep Research, una herramienta que navega por internet, sintetiza información de decenas de fuentes y genera informes completos en minutos.

RapidFire AI permite ajustar modelos de lenguaje en minutos en lugar de horas, reduciendo costes y democratizando el acceso al fine-tuning.

La compañía lanza DGX Spark, un sistema que permite entrenar agentes de inteligencia artificial en robots humanoides sin necesidad de millones de ejemplos previos.

La nueva biblioteca permite diseñar flujos complejos con modelos de lenguaje de forma visual, facilitando depurar y compartir proyectos de IA generativa.

La nueva versión facilita afinar y alinear LLMs localmente, con soporte para técnicas avanzadas y hardware desde GPUs de consumo hasta clusters de servidores.

Una nueva aplicación usa modelos de lenguaje para narrar la historia oculta de cualquier lugar mientras caminas, sin necesidad de auriculares ni tours programados.

La plataforma de inferencia ahora permite a los desarrolladores desplegar modelos desde Hugging Face con un solo clic, sin necesidad de gestionar servidores propios.

AWS da acceso a Superblocks, una herramienta de programación asistida por IA, dentro de entornos corporativos cerrados — una señal de cómo la industria está separando las aplicaciones de los modelos que las alimentan.

Hugging Face ha desarrollado una técnica que permite a los modelos de lenguaje procesar varias peticiones a la vez de forma más eficiente, reduciendo los tiempos de espera hasta un 50%.

La plataforma adapta su CLI para que los modelos de inteligencia artificial puedan usarla de forma autónoma, sin intervención humana.

NeMo AutoModel automatiza el proceso de adaptar modelos de lenguaje a tareas específicas, reduciendo el tiempo y el coste de entrenamiento para empresas y desarrolladores.

La compañía ha acelerado la detección y corrección de errores de seguridad en su navegador usando modelos de lenguaje, confirmando una tendencia que expertos llevan anticipando desde hace tiempo.
Usamos cookies de análisis (Google Analytics) para entender qué artículos interesan. Solo se activan si lo aceptás. Más información sobre privacidad