Ao vivo
[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA[Modelos de IA]IBM e Confluent lançam modelos de IA para análise de séries temporais em tempo real[Pesquisa]Pesquisadores criam ferramenta que mostra o que os testes de IA medem de verdade[Ferramentas]Hugging Face integra dezenas de serviços de IA em uma única plataforma[Ferramentas]Hugging Face lança biblioteca com mais de 200 operações para rodar IA no navegador[Modelos de IA]Open-R1: a primeira cópia totalmente aberta do DeepSeek-R1[Pesquisa]AlphaFold completa cinco anos e já acelerou pesquisas em mais de 190 países[Modelos de IA]OpenAI apresenta GPT-Live, nova geração de vozes mais naturais para o ChatGPT[Regulação]Mercado paralelo vende acesso ao Claude na China por 10% do preço oficial[Pesquisa]Google DeepMind abre laboratório de pesquisa em Singapura[Pesquisa]Google DeepMind e governo dos EUA criam Genesis, projeto nacional para acelerar ciência com IA
Transmitindo ·

Notícias.
Inteligência Artificial

Inteligência Artificial para Gente de Verdade · ES / PT-BR

Modelos de IAHugging Face Blog2 min

Novos modelos de IA da Falcon rodam em qualquer celular e custam quase nada

A série Falcon-Edge traz modelos de linguagem compactados em 1,58 bits que funcionam até em smartphones antigos, consumindo pouquíssima memória e energia, sem depender de servidores na nuvem.

Por Redação2 min
Em resumo

A TII lançou a Falcon-Edge, uma série de modelos de linguagem que usam quantização extrema (compressão de parâmetros para 1,58 bits) e rodam localmente em celulares, tablets e dispositivos simples, sem precisar de internet ou servidores na nuvem. São modelos de pesos abertos, gratuitos e ajustáveis para diferentes tarefas.

Compartilhar
Novos modelos de IA da Falcon rodam em qualquer celular e custam quase nada
Modelos de IA · Hugging Face Blog

A TII (Instituto de Inovação Tecnológica dos Emirados Árabes Unidos) acaba de lançar a série Falcon-Edge, uma família de modelos de linguagem que promete rodar inteligência artificial diretamente no seu celular — mesmo que ele seja de alguns anos atrás. Segundo informou a Hugging Face (uma plataforma onde desenvolvedores compartilham e baixam modelos de IA já treinados), esses modelos usam uma técnica chamada quantização extrema, que comprime os parâmetros (os números que controlam o comportamento do modelo) para apenas 1,58 bits cada um. Na prática, isso significa que um modelo com bilhões de parâmetros ocupa menos memória do que um jogo de celular comum.

A novidade importa porque os modelos de linguagem tradicionais — os LLMs (large language models, ou modelos de linguagem grandes) como o GPT ou o Gemini — costumam rodar em servidores potentes na nuvem, consumindo muita energia e exigindo conexão constante à internet. Com o Falcon-Edge, a IA roda localmente, ou seja, tudo acontece dentro do próprio aparelho. Isso é especialmente útil em regiões com internet instável, em aplicações que exigem privacidade (já que os dados não saem do dispositivo) ou em dispositivos com pouca capacidade de processamento, como câmeras de segurança, drones ou assistentes de voz baratos.

A família inclui modelos de diferentes tamanhos — de 0,5 bilhão a 8 bilhões de parâmetros — todos com pesos abertos (ou seja, qualquer pessoa pode baixar, modificar e usar sem pagar royalties). Eles já vêm ajustados para tarefas comuns, mas também podem ser refinados (fine-tuning, o processo de retreinar um modelo em dados específicos) para necessidades particulares, como atendimento ao cliente ou análise de documentos médicos. Segundo a TII, os testes internos mostram que o desempenho em raciocínio, matemática e compreensão de texto é comparável ao de modelos muito maiores, mas com custo computacional até 10 vezes menor.

A aposta em modelos compactos e eficientes reflete uma tendência do setor: enquanto empresas como OpenAI e Google competem para criar os LLMs mais poderosos (e caros), outras exploram o caminho inverso — fazer mais com menos. A Falcon-Edge não vai substituir o GPT-4 em tarefas complexas, mas pode democratizar o acesso à IA funcional em lugares onde servidores na nuvem simplesmente não são viáveis. Os modelos já estão disponíveis para download na Hugging Face, gratuitamente.

Fonte original
Hugging Face Blog
Mais em · Modelos de IA