DeepSeek lança nova IA mais rápida e com custo reduzido

DeepSeek lança nova IA mais rápida e com custo reduzido

A DeepSeek lançou o V4.1-Flash, novo modelo de IA da empresa chinesa. A tecnologia foi apresentada como a menor da nova família de modelos da startup e promete respostas mais rápidas, maior capacidade de processamento e custos menores.

O lançamento acontece enquanto a DeepSeek começa a se preparar para uma oferta pública inicial de ações no mercado STAR, em Xangai, segundo a Reuters. A empresa também está substituindo modelos anteriores pelo V4.1-Flash.

DeepSeek AI chat bot interface visto na tela do smartphone
O novo modelo utiliza um quarto da memória HBM necessária pela geração anterior, segundo a DeepSeek. – Imagem: mundissima/Shutterstock

Modelo quer fazer mais gastando menos

Embora seja considerado o menor modelo da nova família, o V4.1-Flash reúne 552 bilhões de parâmetros, que são elementos usados pela inteligência artificial para processar informações e produzir respostas.

A tecnologia consegue usar apenas uma parte desses recursos durante cada tarefa. São 8 bilhões de parâmetros ativos para receber informações e 16 bilhões para gerar as respostas.

Para o usuário, a ideia é fazer o modelo funcionar com mais velocidade e atender um volume maior de solicitações sem exigir tantos recursos. A DeepSeek também afirma que o sistema foi preparado para facilitar a criação de modelos maiores no futuro.

“Apresentamos o menor modelo da nossa nova família de arquitetura, com compreensão visual nativa.”

O V4.1-Flash também consegue interpretar informações visuais, como imagens. Segundo a DeepSeek, testes feitos por diferentes partes colocaram o novo modelo à frente do V4-Pro em desempenho, custo, velocidade e tempo total de execução.

Menos espaço para guardar informações

Outra mudança importante está na forma como o modelo guarda informações durante uma tarefa. Isso pode pesar nos custos de serviços que utilizam inteligência artificial por longos períodos.

Na comparação com a geração anterior, a DeepSeek afirma que o V4.1-Flash precisa de:

  • um quarto da memória HBM;
  • um oitavo do espaço de armazenamento SSD;
  • menos espaço para manter informações das interações;
  • menos recursos para lidar com esses dados.

A empresa diz que essa redução pode diminuir significativamente os custos, especialmente em agentes de inteligência artificial, sistemas capazes de realizar tarefas com menor intervenção humana.

Aplicativos de IA em um smartphone
Segundo a DeepSeek, testes colocaram o V4.1-Flash à frente do V4-Pro em desempenho, custo e velocidade. – Imagem: Robert Way/iStock

Modelos antigos serão substituídos

O V4.1-Flash já está disponível na API da DeepSeek, serviço que permite que outras aplicações utilizem o modelo. Os modelos V4-Flash e V4-Flash-Vision-Exp foram retirados e, temporariamente, suas solicitações serão encaminhadas para o novo sistema.

Leia mais:

O V4-Pro também será retirado gradualmente. A partir de 14 de setembro de 2026, as solicitações feitas para ele serão direcionadas ao V4.1-Flash e terão a cobrança correspondente ao novo modelo. Isso continuará até o lançamento do V4.1-Pro.

Preços também mudam

Os novos preços da API entram em vigor em 10 de setembro. A DeepSeek mantém valores diferentes para períodos de maior e menor demanda. Fora do horário de pico, o preço será equivalente à metade da tarifa de pico.

“V4.1-Flash permite atender mais usuários a um custo menor. Estamos repassando essa economia para você.”

A DeepSeek também pretende trabalhar com a comunidade de código aberto para ampliar o suporte ao modelo e estudar outras formas de implantação.

O post DeepSeek lança nova IA mais rápida e com custo reduzido apareceu primeiro em Olhar Digital.