Ao vivo
[Ferramentas]Como adicionar marcas d'água em imagens de IA com uma linha de código[Ferramentas]LeRobot lança formato de dataset que facilita treinar robôs com milhões de exemplos[Ferramentas]Três truques da OpenAI para rodar modelos de IA muito mais rápido (que você pode usar hoje)[Modelos de IA]Writer lança modelos de IA compactos que raciocinam sem precisar de servidores potentes[Ferramentas]Hugging Face e Together AI facilitam o ajuste fino de qualquer modelo de linguagem[Ferramentas]ServiceNow cria framework que gera dados de treino para qualquer modelo de IA[Pesquisa]Hugging Face lança ferramentas para qualquer um estudar agentes de IA[Ferramentas]Hugging Face passa a oferecer servidores franceses da Scaleway para rodar modelos de IA[Regulação]Mulher acusa padrasto de usar Grok para criar imagem sexual a partir de foto de infância[Modelos de IA]Anthropic detalha como vão funcionar as marcas d'água do Claude[Ferramentas]Como adicionar marcas d'água em imagens de IA com uma linha de código[Ferramentas]LeRobot lança formato de dataset que facilita treinar robôs com milhões de exemplos[Ferramentas]Três truques da OpenAI para rodar modelos de IA muito mais rápido (que você pode usar hoje)[Modelos de IA]Writer lança modelos de IA compactos que raciocinam sem precisar de servidores potentes[Ferramentas]Hugging Face e Together AI facilitam o ajuste fino de qualquer modelo de linguagem[Ferramentas]ServiceNow cria framework que gera dados de treino para qualquer modelo de IA[Pesquisa]Hugging Face lança ferramentas para qualquer um estudar agentes de IA[Ferramentas]Hugging Face passa a oferecer servidores franceses da Scaleway para rodar modelos de IA[Regulação]Mulher acusa padrasto de usar Grok para criar imagem sexual a partir de foto de infância[Modelos de IA]Anthropic detalha como vão funcionar as marcas d'água do Claude
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Overworld lança modelo de IA que gera vídeos interativos em tempo real

O Waypoint-1 permite controlar cenas de vídeo geradas por inteligência artificial enquanto elas acontecem, sem precisar renderizar tudo antes.

Por Redação2 min
Compartilhar
Overworld lança modelo de IA que gera vídeos interativos em tempo real
Modelos de IA · Hugging Face Blog

A Overworld, uma startup focada em inteligência artificial para games, acaba de apresentar o Waypoint-1 — um modelo de difusão de vídeo (um tipo de IA que cria imagens em movimento a partir de ruído aleatório) capaz de gerar cenas interativas em tempo real. Segundo informou a empresa no blog da Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados), o grande diferencial do Waypoint-1 é que ele responde a comandos do usuário enquanto o vídeo está sendo criado, algo inédito para modelos de difusão de vídeo.

Na prática, isso significa que você pode controlar elementos da cena — como o movimento de uma câmera virtual ou a ação de um personagem — e ver o resultado imediatamente, como em um videogame. Modelos anteriores de geração de vídeo por IA exigiam que você descrevesse o que queria em texto e esperasse vários segundos ou minutos para ver o resultado final, sem poder intervir no meio do caminho. O Waypoint-1 muda essa dinâmica ao processar entradas do usuário frame a frame (quadro a quadro), permitindo ajustes instantâneos.

A Overworld treinou o modelo especificamente para ambientes tridimensionais típicos de jogos, usando grandes volumes de dados sintéticos (imagens geradas por computador, não fotografadas no mundo real). O objetivo declarado da empresa é criar ferramentas que permitam a desenvolvedores independentes e pequenos estúdios construir mundos de jogo complexos sem precisar de equipes enormes nem orçamentos milionários. A ideia é que, no futuro, um designer possa 'pintar' cenários interativos só descrevendo o que quer ou movendo controles virtuais, enquanto a IA gera os gráficos em tempo real.

Por enquanto, o Waypoint-1 ainda é um protótipo e a Overworld não informou quando ele estará disponível para uso público ou se será lançado como código aberto (isto é, com o código-fonte liberado para qualquer pessoa estudar e modificar). A empresa também não divulgou detalhes técnicos completos sobre a arquitetura do modelo nem sobre o hardware necessário para rodá-lo — o que será decisivo para saber se a tecnologia poderá funcionar em computadores comuns ou se exigirá servidores potentes na nuvem.

Fonte original
Hugging Face Blog
Etiquetas
Mais em · Modelos de IA