Ao vivo
[Ferramentas]Como treinar IA em máquinas separadas sem perder velocidade[Pesquisa]Seu agente de IA acertou uma vez — mas vai acertar de novo?[Pesquisa]Instituto britânico de segurança em IA adota sistema que torna testes de modelos reproduzíveis[Ferramentas]Hugging Face reconstrói interface do AUTOMATIC1111 como um grafo visual de 73 nós[Pesquisa]Por que filtros de segurança em IA bloqueiam perguntas legítimas — e como consertar isso[Modelos de IA]Hugging Face lança NeoMME, modelo de IA que processa texto e imagem sem precisar de peças separadas[Ferramentas]Ferramenta dá memória permanente aos agentes de código que você já usa[Ferramentas]Hugging Face adiciona suporte nativo a modelos GGUF no Transformers[Pesquisa]Como ensinar um modelo pequeno de IA a gerar texto estruturado sem erros[Modelos de IA]Modelos de vídeo por IA começam a ficar acessíveis — mas ainda exigem hardware potente[Ferramentas]Como treinar IA em máquinas separadas sem perder velocidade[Pesquisa]Seu agente de IA acertou uma vez — mas vai acertar de novo?[Pesquisa]Instituto britânico de segurança em IA adota sistema que torna testes de modelos reproduzíveis[Ferramentas]Hugging Face reconstrói interface do AUTOMATIC1111 como um grafo visual de 73 nós[Pesquisa]Por que filtros de segurança em IA bloqueiam perguntas legítimas — e como consertar isso[Modelos de IA]Hugging Face lança NeoMME, modelo de IA que processa texto e imagem sem precisar de peças separadas[Ferramentas]Ferramenta dá memória permanente aos agentes de código que você já usa[Ferramentas]Hugging Face adiciona suporte nativo a modelos GGUF no Transformers[Pesquisa]Como ensinar um modelo pequeno de IA a gerar texto estruturado sem erros[Modelos de IA]Modelos de vídeo por IA começam a ficar acessíveis — mas ainda exigem hardware potente
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAGoogle DeepMind Blog2 min

Google lança Gemini 3.8 Live com raciocínio em tempo real e suporte a voz e imagem

Os novos modelos Gemini 3.8 Live e 3.8 Live Extended Thinking permitem conversas por voz mais naturais, processam imagens em tempo real e executam tarefas complexas enquanto mantêm o diálogo fluido

Por Redação2 min
Em resumo

O Google lançou o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking, dois modelos de IA especializados em conversas por voz que processam imagens em tempo real, executam tarefas complexas em segundo plano enquanto mantêm o diálogo fluido, detectam automaticamente 97 idiomas e usam raciocínio em múltiplas etapas para resolver problemas complexos de forma mais natural.

Compartilhar
Google lança Gemini 3.8 Live com raciocínio em tempo real e suporte a voz e imagem
Modelos de IA · Google DeepMind Blog

O Google DeepMind anunciou dois novos modelos de inteligência artificial projetados para conversas por voz: o Gemini 3.8 Live e o Gemini 3.8 Live Extended Thinking. Ambos representam avanços significativos na forma como sistemas de IA podem dialogar de maneira fluida e natural, processando comandos de voz e até mesmo imagens em tempo quase real — diferente dos chatbots tradicionais baseados em texto, esses modelos foram desenvolvidos especificamente para interações faladas, segundo informou a empresa em seu blog oficial.

O Gemini 3.8 Live foi construído pensando em escala e custo-benefício. Ele consegue processar entradas visuais enquanto conversa, enriquecendo as respostas com contexto visual, e detecta automaticamente transições entre 97 idiomas durante a mesma conversa. Uma característica importante é sua capacidade de executar ferramentas e chamadas de API (comandos que permitem ao modelo acessar informações externas ou acionar outras funções) em segundo plano: enquanto processa uma tarefa, o modelo continua conversando, reconhecendo pedidos e mantendo o diálogo ativo até a conclusão do trabalho solicitado.

Já o Gemini 3.8 Live Extended Thinking foi desenhado para tarefas mais complexas que exigem raciocínio aprofundado. Ele alcançou a primeira posição no Artificial Analysis Speech to Speech Quality Index (um ranking que mede a qualidade de sistemas de IA que conversam por voz) com pontuação de 82,6, além de liderar em conclusão de tarefas agênticas — ou seja, situações onde a IA precisa tomar decisões e executar múltiplas etapas de forma autônoma — com 68,6% de sucesso no benchmark τ-Voice e 35,1% no τ-Voice-banking da Sierra. Esse modelo raciocina e fala ao mesmo tempo: enquanto processa informações complexas internamente, usa pistas verbais naturais como "deixe-me verificar isso..." para manter o usuário engajado, narrando o progresso de tarefas em múltiplas etapas conforme elas acontecem.

Os modelos já estão sendo integrados em produtos do Google como Workspace (o conjunto de ferramentas de produtividade que inclui Docs, Gmail e Keep), Google Search e o aplicativo Gemini. Para desenvolvedores e empresas, ambos estão disponíveis através da API Gemini (a interface que permite integrar esses modelos em aplicações próprias) e do Google AI Studio (uma plataforma onde desenvolvedores podem testar e ajustar modelos de IA). Plataformas como Agora, LiveKit, LangChain e Vercel já habilitaram suporte aos novos modelos, facilitando a construção de interfaces controladas por voz sem que os desenvolvedores precisem gerenciar a infraestrutura complexa de transmissão de áudio em tempo real.

Todo áudio gerado pelos modelos recebe uma marca d'água digital imperceptível chamada SynthID, que permite identificar conteúdo criado por IA mesmo após edições ou compressão — uma medida para combater desinformação. O Gemini 3.8 Live está sendo liberado a partir de hoje para desenvolvedores, empresas em preview privado e usuários do Search Live, enquanto o 3.8 Live Extended Thinking chega também para assinantes do Google AI Pro e Ultra no Workspace.

Mais em · Modelos de IA
Seu agente de IA acertou uma vez — mas vai acertar de novo?
Hugging Face Blog

Seu agente de IA acertou uma vez — mas vai acertar de novo?

Pesquisadores da IBM descobriram que agentes de inteligência artificial podem ter desempenho variável na mesma tarefa e criaram uma ferramenta que reduz pela metade essa instabilidade sem perder precisão