Hugging Face y Cloudflare lanzan FastRTC para ejecutar videollamadas con IA sin retrasos
La alianza entre ambas empresas permite que cualquier desarrollador integre modelos de inteligencia artificial en aplicaciones de voz y vídeo en tiempo real, sin necesidad de servidores propios ni conocimientos avanzados de infraestructura.
Hugging Face y Cloudflare presentaron FastRTC, una herramienta que permite a desarrolladores integrar modelos de inteligencia artificial en videollamadas y aplicaciones de voz sin montar infraestructura propia. Usa WebRTC (un estándar para comunicación entre navegadores) y la red de servidores de Cloudflare para procesar voz y vídeo con menos de 100 milisegundos de retraso, compatible con modelos como Llama y Whisper.

Hugging Face (una plataforma donde desarrolladores comparten y descargan modelos de IA ya entrenados) y Cloudflare (una empresa que ofrece servicios de red y seguridad en internet) han presentado FastRTC, una herramienta que permite integrar modelos de inteligencia artificial en videollamadas y aplicaciones de voz en tiempo real. Hasta ahora, añadir funciones como traducción simultánea o asistentes virtuales a una videollamada requería montar infraestructura compleja y gestionar servidores capaces de procesar vídeo y audio sin retrasos perceptibles. FastRTC elimina esa barrera: los desarrolladores pueden conectar sus aplicaciones directamente a los modelos alojados en Hugging Face, y Cloudflare se encarga de distribuir el procesamiento a través de su red global de servidores.
La clave está en la arquitectura. FastRTC utiliza WebRTC (un estándar abierto que permite la comunicación de audio y vídeo entre navegadores sin necesidad de plugins) combinado con la red de servidores perimetrales de Cloudflare, lo que reduce la latencia (el tiempo que tarda la señal en viajar de un punto a otro) a menos de 100 milisegundos en la mayoría de casos. Eso significa que una persona puede hablar con un agente de IA (un modelo que responde y actúa de forma autónoma) y recibir una respuesta casi instantánea, como si estuviera hablando con otra persona.
Según informó Hugging Face en su blog oficial, la herramienta ya es compatible con varios modelos de código abierto populares, incluidos Llama (la familia de modelos de lenguaje de Meta), Whisper (el sistema de transcripción de voz de OpenAI) y modelos de síntesis de voz como Parler-TTS. Los desarrolladores pueden elegir el modelo que necesiten y FastRTC gestiona automáticamente la conexión, el escalado (la capacidad de atender a más usuarios simultáneamente sin caídas) y la distribución geográfica del tráfico.
La alianza apunta directamente a casos de uso empresariales: centros de atención al cliente con asistentes virtuales que entienden y responden en varios idiomas, plataformas educativas con tutores de IA que corrigen pronunciación en tiempo real, o herramientas de accesibilidad que transcriben y traducen conversaciones al instante. Hasta ahora, este tipo de aplicaciones solían depender de servicios propietarios de grandes tecnológicas como Google o Microsoft. FastRTC democratiza el acceso: cualquier equipo con conocimientos básicos de programación web puede integrar IA conversacional sin pagar por infraestructura dedicada ni depender de un único proveedor.
El servicio está disponible desde hoy en versión beta (una fase de pruebas públicas antes del lanzamiento definitivo) y Cloudflare ofrece un plan gratuito para proyectos pequeños, con tarifas por uso para aplicaciones de mayor escala. La documentación técnica y ejemplos de código están publicados en el repositorio oficial de Hugging Face, y la empresa asegura que seguirá añadiendo compatibilidad con más modelos en las próximas semanas.


