
Liquid AI lança modelo experimental que acelera respostas visuais em até 3x
A startup criou uma versão do LFM2.5-VL que usa decodificação especulativa para gerar respostas mais rápidas em celulares e GPUs, sem perder qualidade.
Notícias.
Inteligência Artificial
Inteligência Artificial para Gente de Verdade · ES / PT-BR
A família de modelos de inteligência artificial da Meta, distribuída como pesos abertos (o arquivo treinado do modelo, publicado para que outros possam usá-lo e modificá-lo).

A startup criou uma versão do LFM2.5-VL que usa decodificação especulativa para gerar respostas mais rápidas em celulares e GPUs, sem perder qualidade.

Pesquisadores mostram que ensinar modelos de linguagem a recusar apenas pedidos nocivos dentro de um tema, sem bloquear todo o assunto, exige medir os dois lados da fronteira ao mesmo tempo.

A biblioteca agora roda arquivos quantizados do llama.cpp direto no notebook, usando os mesmos kernels de desempenho e sem precisar descompactar os pesos do modelo.

Pesquisadores conseguiram triplicar a precisão de um modelo de linguagem de 350 milhões de parâmetros em tarefas de saída estruturada usando apenas 100 passos de treinamento e uma GPU gratuita.

A plataforma agora permite rodar modelos de inteligência artificial usando servidores de 17 empresas diferentes, comparar preços e trocar de fornecedor sem reescrever código.

A plataforma anuncia mudanças na biblioteca Transformers para que modelos de diferentes empresas sigam a mesma estrutura de código, facilitando o trabalho de quem desenvolve e usa IA

A Technology Innovation Institute dos Emirados Árabes lançou o Falcon-Arabic, uma família de modelos de linguagem treinada especialmente para árabe e que superou concorrentes como GPT-4 em testes de compreensão da língua.

Uma nova geração de modelos que entendem imagens e texto ao mesmo tempo está chegando a computadores comuns, celulares e até dispositivos offline, tornando a IA visual acessível para quem não tem acesso a servidores caros.

Ferramenta de código aberto detecta riscos em conversas com assistentes de IA e promete funcionar melhor em português e outros idiomas além do inglês

Pesquisadores criaram uma técnica que comprime modelos de linguagem em 75% do tamanho original e, ao mesmo tempo, melhora o desempenho — contrariando a lógica de que comprimir sempre piora a qualidade.

A empresa de Mark Zuckerberg prepara o lançamento de um assistente virtual por assinatura nas próximas semanas e anuncia um novo modelo de inteligência artificial para outubro de 2025

Pesquisadores do Barcelona Supercomputing Center lançaram um modelo de inteligência artificial treinado em catalão, espanhol e inglês, capaz de analisar tanto textos quanto imagens com desempenho competitivo.

Engenheiros da TNG Technology Consulting mostram que a forma como você organiza pedidos feitos a um modelo de linguagem pode reduzir o tempo de espera em até 30%, sem mexer no hardware.

A parceria integra os aceleradores de IA da Intel ao TGI, ferramenta popular para servir modelos de linguagem em produção, prometendo alternativa às GPUs da Nvidia

Plataforma enviou carta ao governo dos EUA defendendo que modelos de inteligência artificial com código e pesos abertos sejam tratados como infraestrutura pública e recebam incentivos federais

A nova família de modelos da Google consegue processar texto e imagem ao mesmo tempo, funciona em 100 idiomas e roda em computadores comuns — tudo com código livre para qualquer um modificar

A plataforma de modelos abertos publicou um guia para rastrear e avaliar o comportamento de agentes autônomos usando o Arize Phoenix, uma ferramenta de código aberto que permite entender cada passo da execução.

A colaboração facilita o acesso a milhares de modelos de código aberto diretamente na plataforma de nuvem da Microsoft, permitindo que desenvolvedores treinem e implementem IA com menos barreiras técnicas.

O TII, instituto de pesquisa dos Emirados Árabes Unidos, lançou o Falcon-H1, uma família de modelos de linguagem que usa uma arquitetura híbrida para acelerar respostas e reduzir custos de infraestrutura, competindo com modelos ocidentais de código aberto.

A técnica de quantização da Intel promete encolher modelos de linguagem grandes até quatro vezes, mantendo a precisão e facilitando o uso em dispositivos comuns
Usamos cookies de análise (Google Analytics) para entender quais artigos interessam. Só são ativadas se você aceitar. Saiba mais sobre privacidade