Tudo sobre Inteligência Artificial

ver mais

A DeepSeek lançou o V4.1-Flash, novo modelo de IA da empresa chinesa. A tecnologia foi apresentada como a menor da nova família de modelos da startup e promete respostas mais rápidas, maior capacidade de processamento e custos menores.

Continua após a publicidade

O lançamento acontece enquanto a DeepSeek começa a se preparar para uma oferta pública inicial de ações no mercado STAR, em Xangai, segundo a Reuters. A empresa também está substituindo modelos anteriores pelo V4.1-Flash.

O novo modelo utiliza um quarto da memória HBM necessária pela geração anterior, segundo a DeepSeek. – Imagem: mundissima/Shutterstock

Modelo quer fazer mais gastando menos

Embora seja considerado o menor modelo da nova família, o V4.1-Flash reúne 552 bilhões de parâmetros, que são elementos usados pela inteligência artificial para processar informações e produzir respostas.

A tecnologia consegue usar apenas uma parte desses recursos durante cada tarefa. São 8 bilhões de parâmetros ativos para receber informações e 16 bilhões para gerar as respostas.

Para o usuário, a ideia é fazer o modelo funcionar com mais velocidade e atender um volume maior de solicitações sem exigir tantos recursos. A DeepSeek também afirma que o sistema foi preparado para facilitar a criação de modelos maiores no futuro.

“Apresentamos o menor modelo da nossa nova família de arquitetura, com compreensão visual nativa.”

O V4.1-Flash também consegue interpretar informações visuais, como imagens. Segundo a DeepSeek, testes feitos por diferentes partes colocaram o novo modelo à frente do V4-Pro em desempenho, custo, velocidade e tempo total de execução.

Menos espaço para guardar informações

Outra mudança importante está na forma como o modelo guarda informações durante uma tarefa. Isso pode pesar nos custos de serviços que utilizam inteligência artificial por longos períodos.
Na comparação com a geração anterior, a DeepSeek afirma que o V4.1-Flash precisa de:
- um quarto da memória HBM;
- um oitavo do espaço de armazenamento SSD;
- menos espaço para manter informações das interações;
- menos recursos para lidar com esses dados.
A empresa diz que essa redução pode diminuir significativamente os custos, especialmente em agentes de inteligência artificial, sistemas capazes de realizar tarefas com menor intervenção humana.
Segundo a DeepSeek, testes colocaram o V4.1-Flash à frente do V4-Pro em desempenho, custo e velocidade. – Imagem: Robert Way/iStock
Modelos antigos serão substituídos
O V4.1-Flash já está disponível na API da DeepSeek, serviço que permite que outras aplicações utilizem o modelo. Os modelos V4-Flash e V4-Flash-Vision-Exp foram retirados e, temporariamente, suas solicitações serão encaminhadas para o novo sistema.
Leia mais:
- EUA acusam empresas chinesas de IA de copiar modelos avançados para reduzir custos
- DeepSeek lança IA que entende imagens e executa tarefas sozinha
- DeepSeek amplia corrida por IA com data center bilionário na China
O V4-Pro também será retirado gradualmente. A partir de 14 de setembro de 2026, as solicitações feitas para ele serão direcionadas ao V4.1-Flash e terão a cobrança correspondente ao novo modelo. Isso continuará até o lançamento do V4.1-Pro.
Continua após a publicidade
Preços também mudam
Os novos preços da API entram em vigor em 10 de setembro. A DeepSeek mantém valores diferentes para períodos de maior e menor demanda. Fora do horário de pico, o preço será equivalente à metade da tarifa de pico.
“V4.1-Flash permite atender mais usuários a um custo menor. Estamos repassando essa economia para você.”
A DeepSeek também pretende trabalhar com a comunidade de código aberto para ampliar o suporte ao modelo e estudar outras formas de implantação.
Valdir Antonelli
Valdir Antonelli é jornalista com especialização em marketing digital e consumo.
Ver todos os artigos →
Tags: DeepSeek IA generativa Inteligência Artificial modelos de IA


