É a atualização mais recente da linha Flash da DeepSeek — a linha pensada para ser rápida e barata, não para ser a maior. O resultado desta versão é que a distinção deixou de fazer sentido: ela se aproxima dos modelos completos.
Segundo a fonte, fica um ponto abaixo do GLM 5.2, supera a versão V4 Pro anterior e sobe cerca de 10 pontos em relação ao Flash anterior. O ganho vem da arquitetura DSpark, a mesma da versão anterior, voltada a eficiência e vazão.
Por que isso importa
- Custa cerca de US$ 0,03 por milhão de tokens — a fonte estima algo como 100× mais barato que o Claude Opus.
- É 70% menor que o GLM 5.2 e entrega desempenho comparável.
- Está publicado: dá para rodar inteligência desse nível na sua própria máquina.
1.Onde ele ganha
3 minOs testes citados no vídeo são de três frentes, e são justamente as que interessam a quem constrói coisas:
- Codificação agêntica — o modelo operando ferramentas em várias etapas, não só escrevendo função solta.
- Engenharia de software — tarefas de repositório real.
- Segurança cibernética.
Ele supera com folga a versão V4 Pro anterior. Em alguns casos, chega a bater ou empatar com GLM 5.2 ou Opus 4.8.
O gráfico que mais importa é o de desempenho contra custo. DeepSeek V4 Flash fica num canto do gráfico praticamente sozinho; GPT 5.6, Claude Opus e Claude Fable ficam no extremo oposto. É a definição de melhor relação custo-benefício disponível hoje.
Ficha técnica
- Licença
- Aberto, disponível no Hugging Face
- Custo estimado
- ~US$ 0,03 / milhão de tokens
- Tamanho
- 167 GB (82,5 GB em GGUF de 1 bit)
- Arquitetura
- DSpark
- Comparável a
- GLM 5.2 e Claude Opus 4.8

Continue no microcurso completo
Você leu a primeira de 3 aulas
A versão detalhada traz o passo a passo completo, os critérios de escolha, onde a ferramenta falha e para quem ela realmente serve.
- Rodar por conta própria3 min
- Quando trocar o modelo pago por este2 min
De onde saiu este microcurso
Do capítulo “Deepseek V4 Flash 0731” (aos 04:08) do vídeo New Deepseek, Seedance 2.5, Minimax H3, Gemini Robotics, AMD models: AI NEWS, do canal AI Search. Transcrevemos, conferimos os nomes contra as páginas oficiais e reescrevemos em português.