Em teste realizado em 27 de setembro de 2026, a consultoria The Call Center Doctors estimou que o trabalho modelado pela API DeepSeek custaria US$ 184–223 por dia, contra US$ 440,88 por dia pelo aluguel sob demanda de um servidor com quatro Nvidia H200. A execução durou cerca de três horas; o período de 1º a 27 de setembro usado para estimar a carga corresponde aos registros de atividade do Claude Code, não à duração do teste com as GPUs.

O custo diário: aluguel de GPU e API

O aluguel sob demanda custava US$ 18,37 por hora e era cobrado mesmo quando o servidor ficava ocioso. A modalidade spot saía por US$ 9,19 por hora, ou cerca de US$ 220 por dia, mas o provedor podia retomar a capacidade. Para o servidor totalmente ocupado, a consultoria estimou que o volume de trabalho correspondente custaria de US$ 184 a US$ 223 por dia pela API.

OpçãoCusto por diaBase de cálculoCondição
Servidor com quatro H200, sob demandaUS$ 440,88US$ 18,37 por hora de aluguelCobrança mesmo com o servidor ocioso
Servidor com quatro H200, spotCerca de US$ 220US$ 9,19 por hora de aluguelO provedor podia retomar a capacidade
API DeepSeekUS$ 184–223, estimadosVolume de trabalho modelado para um dia com o servidor totalmente ocupadoEstimativa da The Call Center Doctors

A comparação depende, portanto, de como a capacidade é cobrada: o aluguel sob demanda tem custo fixo por hora, enquanto a API cobra pelo uso. Na execução de cerca de três horas, a The Call Center Doctors calculou um custo aproximado de US$ 55 pela tarifa regular ou US$ 28 pela tarifa spot.

A tabela oficial da DeepSeek diferencia tokens de entrada sem cache, tokens de entrada em cache e tokens de saída. Para o DeepSeek V4.1 Flash, as tarifas fora do pico são de US$ 0,15 por milhão de tokens de entrada sem cache, US$ 0,003 por milhão com cache e US$ 0,60 por milhão de tokens de saída. Nos períodos de pico em dias úteis — das 01h às 04h e das 06h às 10h UTC — os valores dobram. A distinção entre entrada reutilizada e não reutilizada também é central na cobrança; veja como o cache define o custo da API do DeepSeek V4.1 Flash.

Releituras em cache marcaram a carga de trabalho

Os registros de Claude Code usados pela consultoria cobriram de 1º a 27 de setembro de 2026. Nesse período, a The Call Center Doctors contabilizou 388,5 bilhões de tokens lidos, dos quais 374,2 bilhões eram releituras em cache, e 393 milhões de tokens escritos.

A consultoria calculou que as releituras representaram cerca de 96,3% dos tokens lidos — aproximadamente 1.042 tokens antigos relidos para cada token escrito. Esse perfil ajuda a entender por que a tarifa de entrada em cache pesa na estimativa da API: grande parte do volume de entrada da carga era contexto reutilizado.

A DeepSeek foi usada para revisar, não para escrever código

Por preocupação com possíveis saídas do sandbox, a The Call Center Doctors manteve offline os agentes construtores e usou a DeepSeek apenas como revisora, em modo somente para leitura. Assim, o teste não substituiu os agentes de programação do Claude Code.

Segundo a consultoria, entre 48 e 64 agentes revisores leram 2.377 pastas e registraram 32 problemas. Esse resultado correspondeu a uma tarefa de revisão; os agentes da DeepSeek não escreveram código no teste.

O que significa «80 vezes mais barato»

A expressão «80 vezes mais barato» se refere a uma comparação de preços de lista por token. A conta da operação tinha outra base: a consultoria informou cerca de US$ 5.500 em assinaturas do Claude Code para o período de 1º a 27 de setembro e estimou de US$ 3.500 a US$ 7.000 para o uso correspondente da API DeepSeek, com média estimada de US$ 4.200.

Esses valores comparam uma assinatura com uma estimativa de cobrança por tokens; não medem o custo de concluir tarefas de programação equivalentes.