Ao vivo
[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAGoogle DeepMind Blog1 min

Google lança T5Gemma, nova família de modelos de IA com arquitetura encoder-decoder

A coleção T5Gemma traz modelos de linguagem com uma estrutura diferente da maioria dos LLMs atuais, prometendo melhor desempenho em tarefas como tradução e resumo de textos.

Por Redação1 min
Em resumo

O Google DeepMind lançou o T5Gemma, uma coleção de modelos de linguagem de grande escala (LLMs, sistemas de IA que entendem e geram texto) com arquitetura encoder-decoder (estrutura em que o modelo processa toda a entrada antes de gerar resposta), mais eficiente para tradução e resumo que os modelos comuns.

Compartilhar
Google lança T5Gemma, nova família de modelos de IA com arquitetura encoder-decoder
Modelos de IA · Google DeepMind Blog

O Google DeepMind (a divisão de inteligência artificial do Google) anunciou o lançamento do T5Gemma, uma nova coleção de modelos de linguagem de grande escala (LLMs, os sistemas de IA que entendem e geram texto) com uma arquitetura chamada encoder-decoder (um tipo de estrutura em que o modelo primeiro processa a informação de entrada de forma completa antes de gerar a resposta, diferente dos modelos mais comuns que geram texto palavra por palavra).

A maioria dos LLMs populares hoje, como o GPT da OpenAI ou o próprio Gemini do Google, usa uma arquitetura chamada decoder-only (que gera texto prevendo a próxima palavra com base apenas nas anteriores). O T5Gemma recupera a abordagem encoder-decoder, considerada mais eficiente para tarefas específicas como tradução automática, resumo de documentos longos e resposta a perguntas com base em contextos extensos.

Os modelos T5Gemma herdam características da família Gemma, linha de modelos de pesos abertos (modelos cujos parâmetros internos podem ser baixados e usados livremente por desenvolvedores) que o Google vem desenvolvendo como alternativa mais acessível aos seus sistemas proprietários. A arquitetura T5 (sigla para Text-to-Text Transfer Transformer, um framework criado pelo Google em 2019) trata todas as tarefas de linguagem natural como problemas de conversão de texto em texto.

Segundo o Google, a nova coleção está disponível para download e uso por pesquisadores e desenvolvedores, mantendo a proposta de democratizar o acesso a tecnologias de IA avançadas. A empresa não divulgou os tamanhos específicos dos modelos nem detalhes sobre os dados usados no treinamento, informações que costumam ser importantes para avaliar capacidade e custos de operação de um LLM.

Mais em · Modelos de IA