Saltar para o conteúdo
GOPPO

Notícias · IA resumida para perceber o essencial

Voltar às notícias

Negócios e Mercado

Publicado em

DeepSeek torna permanente o corte de 75% no preço do V4-Pro

O modelo V4-Pro fica a $0,87 por milhão de tokens de output — de forma permanente. A DeepSeek transformou uma promoção num compromisso estratégico que pressiona diretamente Anthropic e OpenAI a justificarem o diferencial de preço.

  • deepseek
  • llm
  • pricing
  • inference
  • mercado-ia

Resumo

A 25 de maio, a DeepSeek confirmou que o corte de 75% no preço do V4-Pro é permanente. O modelo passa a custar $0,435 por milhão de tokens de entrada (em cache) e $0,87 por milhão de saída. Para comparação: o Claude Opus 4.7 está a $5/$25 por milhão — 11 a 28 vezes mais caro nas mesmas categorias. É a primeira vez que um modelo frontier com arquitetura MoE de 1,6 biliões de parâmetros e contexto de 1M tokens fica permanentemente abaixo do piso de preço doméstico chinês.

Na prática

Para quem constrói com LLMs, a lógica de routing mudou. O DeepSeek V4-Pro passa a ser o candidato natural para workloads agênticos ou em batch que não estejam limitados por regras de residência de dados. A Anthropic e a OpenAI ficam numa posição incómoda: ou cortam os preços do Sonnet e do GPT-5.5 Mini, ou constroem um argumento de capacidades mais concreto para justificar o diferencial.

O que falta saber

O raciocínio por trás desta decisão é de hardware. A DeepSeek está a comprometer-se com uma estrutura de custos que assume a chegada dos supernós Huawei Ascend 950 em volume no segundo semestre de 2026 — uma aposta na soberania tecnológica chinesa. Se o hardware chegar a tempo, os custos de inferência caem mais. Se não chegar, as margens apertam. O que é claro já hoje: os laboratórios chineses comprimiram o ciclo de lançamentos de mensal para semanal, o que obriga as equipas a redesenhar a lógica de routing sem avaliações constantes.

Porque importa

  • V4-Pro fica permanentemente a ~11–28× abaixo do Claude Opus 4.7 por milhão de tokens
  • Primeiro modelo frontier MoE com 1M de contexto a ficar abaixo do piso de preço doméstico chinês de forma permanente
  • Pressão direta sobre Anthropic e OpenAI para cortarem preços ou justificarem o diferencial com capacidades
  • Aposta explícita na chegada do hardware Huawei Ascend 950 em volume no H2 2026