DeepSeek V4 Pro reduz a distância de desempenho para o Claude
DeepSeek acaba de lembrar à indústria de IA que um modelo performático não precisa necessariamente custar uma fortuna. Sem comunicado ou anúncio espetacular, o laboratório chinês implantou discretamente a versão final de seu modelo principal. Por trás dessa atualização, há uma ruptura. A diferença de desempenho está diminuindo, enquanto a dos preços está aumentando. Para o Web3, os desenvolvedores de agentes autônomos e as empresas enfrentando o custo crescente da IA, essa nova equação pode mudar o jogo. DeepSeek não busca mais apenas competir, mas ataca onde seus concorrentes são mais vulneráveis, o preço.

Em resumo
- DeepSeek lança a versão comercial final DeepSeek-V4-Pro-0813 sem anúncio oficial, substituindo a versão preliminar de abril.
- Claude Fable 5 só supera o modelo chinês em 5,3% em média em nove benchmarks, uma superioridade que cai para 2,8% excluindo um teste específico.
- A API da Anthropic apresenta um custo 4.500% mais alto que a da DeepSeek, com uma fatura média de 30$ contra 0,65$ para o mesmo volume.
- Executar uma tarefa de agente custa mais de 31$ no Claude Fable 5, contra aproximadamente 0,04$ na arquitetura DeepSeek.
Uma transição discreta para a versão final e desempenhos mais próximos
Esta atualização realizada pela DeepSeek, que relança a corrida mundial à inteligência artificial, resultou em um ajuste discreto na tabela de preços do editor, onde a menção deepseek-v4-pro agora identifica a versão comercial final DeepSeek-V4-Pro-0813. Até aqui, os testes independentes publicados baseavam-se apenas em uma versão preliminar lançada em abril. A empresa chinesa lembrou disso em 31 de julho durante o lançamento do seu modelo V4-Flash, especificando então que sua API Pro permanecia inalterada e que o modelo definitivo chegaria em breve.
O ficha técnica no Hugging Face ainda mostra a série V4 como versão preliminar, significando que nenhum laboratório externo avaliou de forma independente esta versão 0813. Nos dez benchmarks de avaliação de agentes publicados pela empresa, o modelo concorrente Claude Fable 5 da Anthropic mantém apenas uma vantagem média de 5,3% em nove testes comparados.
A análise detalhada das avaliações revela nuances determinantes sobre o nível real dos desempenhos. A diferença geral de 5,3% se explica principalmente pelo teste “Humanity’s Last Exam” sem ferramentas, onde DeepSeek registra uma pontuação de 42,7 contra 53,3 do Claude Fable 5. Isolando este teste que apresenta uma diferença de 10,6%, a superioridade média do rival americano despenca para 2,8% nos demais testes. Deve-se destacar que DeepSeek mediu esses resultados em sua própria infraestrutura técnica, usando o modo mínimo de seu framework “DeepSeek Harness” configurado no nível máximo de esforço com criatividade alta. Dois dos dez testes, chamados “DSBench-FullStack” e “DSBench-Hard”, baseiam-se em conjuntos de testes internos sem classificação pública verificável.
Aqui está o resumo das métricas de desempenho publicadas pelo laboratório :
- Claude Fable 5 mantém uma vantagem média de 5,3% em nove benchmarks comparados ;
- A diferença cai para 2,8% excluindo o teste “Humanity’s Last Exam” sem ferramentas (42,7 contra 53,3) ;
- DeepSeek lidera diretamente em dois dos dez benchmarks de agentes apresentados ;
- Os testes baseiam-se no framework interno “DeepSeek Harness” mínimo, dos quais dois testes não têm classificação pública.
Um abismo de preços entre a alternativa chinesa DeepSeek e os modelos proprietários
No aspecto tarifário, o confronto se transforma em uma demonstração de força industrial ao avaliar os custos de acesso à API. DeepSeek mantém sua precificação de 0,435 dólar por milhão de tokens de entrada e 0,87 dólar por milhão de tokens de saída, com um custo de 0,003625 dólar para entrada em cache. Por sua vez, a Anthropic cobra pelo Claude Fable 5 o preço de 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída. Pesando esses números por ratios de uso padrão, a fatura total é aproximadamente 0,65 dólar para a fabricante chinesa contra 30 dólares para o gigante americano, um custo adicional massivo de 4.600%. Essa diferença financeira se acentua ainda mais na escala da tarefa executada, já que o modelo americano processa mais tempo e gera mais texto.
As medições realizadas pela Artificial Analysis quantificam a tarefa média em 3,15 dólares para o Fable 5 contra 3 centavos para o V4-Flash, um fator de 105. Clément Delangue, CEO da Hugging Face, avalia a fatura total em “mais de 31 dólares por tarefa” na Anthropic contra “aproximadamente 0,04 dólar” para seu concorrente.
Dentro do próprio catálogo da Anthropic, a presença do Claude Opus 5 complica a situação, este último superando o Fable 5 na maioria dos benchmarks pela metade do preço. Essa disparidade de preços começa a enfraquecer a coerência das linhas proprietárias americanas.
Rumo a uma redistribuição das cartas tecnológicas sob o impulso do open source
Essa dinâmica se integra a um movimento onde laboratórios chineses de pesos abertos, como Kimi cujo modelo K3 superou o Fable 5 e o GPT-5.6 Sol desde seu lançamento, reduzem drasticamente os custos de inferência.
A disponibilização do DeepSeek no Hugging Face sob licença livre MIT oferece aos desenvolvedores a possibilidade de verificar imediatamente esses desempenhos em seus próprios servidores. Essa transparência contrasta fortemente com os ecossistemas fechados dos gigantes do Vale do Silício, abrindo caminho para uma auditoria comunitária permanente. A longo prazo, essa democratização de uma potência computacional de baixo custo poderia transformar o ecossistema global de aplicativos.
Ela permitiria que infraestruturas Web3, protocolos DeFi e desenvolvedores de agentes autônomos integrassem capacidades de raciocínio avançado sem sofrer a renda imposta pelos gigantes proprietários americanos. Entretanto, a dependência de benchmarks internos convida a uma análise equilibrada. O futuro do mercado dependerá da capacidade dos atores open source de manterem esse nível de eficiência enquanto oferecem garantias de segurança e confiabilidade equivalentes a longo prazo.
Maximize sua experiência na Cointribune com nosso programa "Read to Earn"! Para cada artigo que você lê, ganhe pontos e acesse recompensas exclusivas. Inscreva-se agora e comece a acumular vantagens.
Diplômé de Sciences Po Toulouse et titulaire d'une certification consultant blockchain délivrée par Alyra, j'ai rejoint l'aventure Cointribune en 2019. Convaincu du potentiel de la blockchain pour transformer de nombreux secteurs de l'économie, j'ai pris l'engagement de sensibiliser et d'informer le grand public sur cet écosystème en constante évolution. Mon objectif est de permettre à chacun de mieux comprendre la blockchain et de saisir les opportunités qu'elle offre. Je m'efforce chaque jour de fournir une analyse objective de l'actualité, de décrypter les tendances du marché, de relayer les dernières innovations technologiques et de mettre en perspective les enjeux économiques et sociétaux de cette révolution en marche.
As opiniões e declarações expressas neste artigo são de responsabilidade exclusiva do autor e não devem ser consideradas como recomendações de investimento. Faça sua própria pesquisa antes de tomar qualquer decisão de investimento.