É a atualização mais recente da linha Flash da DeepSeek — a linha pensada para ser rápida e barata, não para ser a maior. O resultado desta versão é que a distinção deixou de fazer sentido: ela se aproxima dos modelos completos.
Segundo a fonte, fica um ponto abaixo do GLM 5.2, supera a versão V4 Pro anterior e sobe cerca de 10 pontos em relação ao Flash anterior. O ganho vem da arquitetura DSpark, a mesma da versão anterior, voltada a eficiência e vazão.
Por que isso importa
- Custa cerca de US$ 0,03 por milhão de tokens — a fonte estima algo como 100× mais barato que o Claude Opus.
- É 70% menor que o GLM 5.2 e entrega desempenho comparável.
- Está publicado: dá para rodar inteligência desse nível na sua própria máquina.
1.Onde ele ganha
3 minOs testes citados no vídeo são de três frentes, e são justamente as que interessam a quem constrói coisas:
- Codificação agêntica — o modelo operando ferramentas em várias etapas, não só escrevendo função solta.
- Engenharia de software — tarefas de repositório real.
- Segurança cibernética.
Ficha técnica
- Licença
- Aberto, disponível no Hugging Face
- Custo estimado
- ~US$ 0,03 / milhão de tokens
- Tamanho
- 167 GB (82,5 GB em GGUF de 1 bit)

Continue no microcurso completo
Você leu a abertura de 3 aulas
O microcurso traz o passo a passo completo, os critérios de escolha, onde a ferramenta falha, para quem ela realmente serve — e, no Expert, o endereço oficial para começar hoje.
- Rodar por conta própria3 min
- Quando trocar o modelo pago por este2 min
Como apuramos
Acompanhamos os lançamentos direto nas fontes primárias, transcrevemos o que é demonstrado, conferimos cada nome e cada número contra a documentação oficial do fabricante e reescrevemos em português — com o que a ferramenta não faz junto, que é a parte que o anúncio omite.


