DeepSeek torna permanente o corte de 75% no preço do V4-Pro
O modelo V4-Pro fica a $0,87 por milhão de tokens de output — de forma permanente. A DeepSeek transformou uma promoção num compromisso estratégico que pressiona diretamente Anthropic e OpenAI a justificarem o diferencial de preço.
Resumo
A 25 de maio, a DeepSeek confirmou que o corte de 75% no preço do V4-Pro é permanente. O modelo passa a custar $0,435 por milhão de tokens de entrada (em cache) e $0,87 por milhão de saída. Para comparação: o Claude Opus 4.7 está a $5/$25 por milhão — 11 a 28 vezes mais caro nas mesmas categorias. É a primeira vez que um modelo frontier com arquitetura MoE de 1,6 biliões de parâmetros e contexto de 1M tokens fica permanentemente abaixo do piso de preço doméstico chinês.
Na prática
Para quem constrói com LLMs, a lógica de routing mudou. O DeepSeek V4-Pro passa a ser o candidato natural para workloads agênticos ou em batch que não estejam limitados por regras de residência de dados. A Anthropic e a OpenAI ficam numa posição incómoda: ou cortam os preços do Sonnet e do GPT-5.5 Mini, ou constroem um argumento de capacidades mais concreto para justificar o diferencial.
O que falta saber
O raciocínio por trás desta decisão é de hardware. A DeepSeek está a comprometer-se com uma estrutura de custos que assume a chegada dos supernós Huawei Ascend 950 em volume no segundo semestre de 2026 — uma aposta na soberania tecnológica chinesa. Se o hardware chegar a tempo, os custos de inferência caem mais. Se não chegar, as margens apertam. O que é claro já hoje: os laboratórios chineses comprimiram o ciclo de lançamentos de mensal para semanal, o que obriga as equipas a redesenhar a lógica de routing sem avaliações constantes.
Porque importa
- V4-Pro fica permanentemente a ~11–28× abaixo do Claude Opus 4.7 por milhão de tokens
- Primeiro modelo frontier MoE com 1M de contexto a ficar abaixo do piso de preço doméstico chinês de forma permanente
- Pressão direta sobre Anthropic e OpenAI para cortarem preços ou justificarem o diferencial com capacidades
- Aposta explícita na chegada do hardware Huawei Ascend 950 em volume no H2 2026