🔥 Entre no nosso grupo e receba as melhores ofertas de tech Entrar agora →
MelhoresTech
Voltar
inteligencia-artificial

DeepSeek V4.1 Flash chega com 552 bilhões de parâmetros e mira Claude Opus 5 e GPT-5.6 com custo menor

Web Story
DeepSeek V4.1 Flash chega com 552 bilhões de parâmetros e mira Claude Opus 5 e GPT-5.6 com custo menor

A DeepSeek lançou na quarta-feira (9) o V4.1 Flash, um modelo de linguagem multimodal que passa a ser a base dos chatbots e agentes da empresa chinesa. A proposta é a mesma que colocou a companhia no mapa em 2025: entregar desempenho de topo de linha cobrando como modelo intermediário, e desta vez o alvo declarado são o Claude Opus 5, da Anthropic, e o GPT-5.6 Sol, da OpenAI.

Tecnicamente, o V4.1 Flash é o menor modelo da nova família, mas não é pequeno. Ele usa até 552 bilhões de parâmetros em arquitetura Mixture of Experts, em que só uma fração dos especialistas é acionada a cada resposta, e uma estrutura Causal Encoder-Decoder que, segundo a empresa, faz 8 bilhões de parâmetros na entrada renderem 16 bilhões ativos. O resultado prometido é inferência mais rápida e maior capacidade por unidade de custo, além de compreensão de imagens.

Gráfico de benchmarks divulgado pela DeepSeek comparando o V4.1 Flash com modelos rivais

Nos testes divulgados pela própria DeepSeek, o modelo é comparado a GPT-5.6 Sol, Claude Opus 5, GLM-5.3 e Kimi-K3 em benchmarks voltados a programação e agentes. O gráfico de destaque mostra o V4.1 Flash na frente em DeepSWE v1.1, CyberGym e Automation-Bench, mas a tabela completa é menos triunfal: no Terminal-Bench 3.0 ele fica atrás do Opus 5 e do GPT-5.6 Sol, e em provas de conhecimento geral, como GPQA Diamond e HLE, os modelos americanos continuam à frente. O ganho mais claro é sobre a própria família: o V4.1 Flash supera o V4 Pro na maior parte dos cenários, o que a empresa atribui a novos métodos de pré-treinamento e a aprendizado por reforço em escala maior. Como sempre nesses anúncios, vale esperar avaliações independentes.

Segundo gráfico da DeepSeek com resultados do V4.1 Flash em testes de agentes e código

A mudança tem efeito imediato para quem usa a API. O V4-Flash e o V4-Flash-Vision-Exp saíram de linha, e as chamadas já são redirecionadas ao V4.1 Flash. O V4 Pro segue o mesmo caminho a partir de 14 de setembro, e essa configuração vale até a chegada do V4.1 Pro. Na cobrança, a DeepSeek mantém o preço dinâmico: nos horários de pico, o valor base por token dobra.

Para desenvolvedores brasileiros, o apelo continua sendo a relação entre custo e capacidade, sobretudo em tarefas de código e automação. O outro lado é a dependência de uma infraestrutura chinesa e as restrições que órgãos públicos e empresas de setores regulados costumam impor a esses serviços. O lançamento também chega dias depois de a OpenAI liberar o GPT-6 Astra a assinantes, sinal de que a disputa por eficiência não vai desacelerar neste semestre.



Gostou deste artigo?

-- -- votos

Você pode gostar também