
DeepSeek lança V4-Pro-0813 a US$ 0,87 por milhão de tokens de saída
A DeepSeek lançou o modelo V4-Pro-0813, disponível via API e chat, com preços de US$ 0,435 por milhão de tokens de entrada e US$ 0,87 por milhão de tokens de saída. Segundo resultados preliminares divulgados no WeChat, o modelo supera o Anthropic Opus 4.8 em benchmarks como Terminal Bench 2.1, Cybergym, DeepSWE e AutomationBench.
Lançamento em meio à guerra de preços
O anúncio veio poucos dias depois de a OpenAI reduzir em até 80% os preços do GPT-5.6 Luna, derrubando os valores de entrada para US$ 0,20 por milhão de tokens. Horas depois dessa movimentação, a DeepSeek também lançou uma versão atualizada do modelo Flash, o V4-Flash-0731, com 284 bilhões de parâmetros e desempenho comparável ao Opus 4.8 - que, segundo estimativas, teria múltiplos trilhões de parâmetros. O modelo Flash foi precificado a US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída, anulando boa parte da vantagem competitiva buscada pela OpenAI.
Desempenho e escala
De acordo com a publicação, o V4-Pro-0813 tem 1,6 trilhão de parâmetros totais, 49 bilhões ativos e contexto de 1 milhão de tokens. Também foi citado um ganho de 15,8% no Terminal Bench em relação ao preview de abril, além de um custo estimado ~57 vezes menor em comparação com o Fable 5 em determinados cenários. Esses números, no entanto, ainda não foram verificados independentemente.
Demanda crescente e limite de infraestrutura
A DeepSeek foi a segunda colocada em volume total de tokens consumidos em julho, atrás apenas da Anthropic, e pode assumir a liderança em agosto com a chegada dos novos modelos. O aumento expressivo da demanda já provoca gargalos: há relatos de lentidão na inferência, algo atribuído à capacidade computacional limitada do laboratório, estimada em cerca de 20.000 GPUs NVIDIA H100.