The Call Center Doctors calculó que, para la carga de programación de la consultora, alquilar bajo demanda un servidor con cuatro Nvidia H200 costaba 440,88 dólares al día. El trabajo equivalente mediante la API de DeepSeek V4.1 Flash se estimó en 184–223 dólares diarios, suponiendo que el servidor estuviera ocupado a pleno rendimiento. La prueba con GPU se realizó el 27 de septiembre de 2026 y duró unas tres horas.
Cuánto costaban el alquiler y el trabajo por API
Las cifras diarias corresponden a dos formas distintas de pagar: una tarifa fija por el servidor y un cálculo del coste de los tokens procesados por API. Los importes son los comunicados por The Call Center Doctors para su caso.
| Opción | Coste diario | Base de cálculo | Condición |
| Servidor con cuatro Nvidia H200, bajo demanda | 440,88 dólares | Alquiler a 18,37 dólares por hora | Se cobraba aunque el servidor estuviera inactivo. |
| Servidor con cuatro Nvidia H200, tarifa spot | Aproximadamente 220 dólares | Alquiler a 9,19 dólares por hora | El proveedor podía recuperar la capacidad. |
| Trabajo equivalente mediante la API de DeepSeek | 184–223 dólares | Estimación de la consultora para la carga modelada | Calculado para un servidor ocupado todo el día. |
La tarifa spot acercaba el coste del servidor al intervalo estimado para la API, pero no garantizaba que la capacidad siguiera disponible. En cambio, el alquiler bajo demanda superaba la estimación de la API en ese patrón de trabajo.
DeepSeek publica tarifas distintas para los tokens de entrada sin caché, los de entrada reutilizados y los de salida. En horario valle, DeepSeek V4.1 Flash cuesta 0,15 dólares por millón de tokens de entrada sin caché, 0,003 dólares por millón de tokens de entrada con caché y 0,60 dólares por millón de tokens de salida. En las franjas punta, los precios se duplican. La caché y el precio de la API de DeepSeek V4.1 Flash explican por qué el volumen de contexto reutilizado influye en la cuenta.
La carga de trabajo reutilizaba mucho contexto
Los cálculos se basaron en registros de Claude Code del 1 al 27 de septiembre de 2026, no en 27 días de funcionamiento del servidor H200. Para ese periodo, The Call Center Doctors contabilizó 388.500 millones de tokens leídos y 393 millones escritos. De los tokens leídos, 374.200 millones eran relecturas en caché: aproximadamente el 96,3 %.
Esa proporción importa porque las tarifas de entrada reutilizada y entrada nueva son muy diferentes. La estimación diaria de la API dependía, por tanto, de una carga con una cantidad muy elevada de contexto leído de nuevo, además de los tokens generados.
DeepSeek revisó código, pero no lo escribió
The Call Center Doctors mantuvo desconectados a los agentes constructores por preocupaciones sobre posibles salidas del entorno aislado (sandbox). Usó DeepSeek como revisor de solo lectura, con entre 48 y 64 agentes que leyeron 2.377 carpetas y presentaron 32 informes de errores. DeepSeek no escribió código en la prueba.
Por eso, la comparación de costes no demuestra que DeepSeek sustituyera a Claude Code como agente de programación ni que ambos produjeran la misma cantidad de código terminado. La consultora conservó su flujo de programación con Claude Code.
Qué significa la comparación de «80 veces más barato»
La expresión «80 veces más barato» se refiere a una comparación de precios de lista por token, no al coste de una suscripción equivalente ni al de completar la misma tarea de programación. Para el periodo del 1 al 27 de septiembre, The Call Center Doctors calculó que el uso equivalente de la API de DeepSeek costaría entre 3.500 y 7.000 dólares, con una media estimada de unos 4.200. Su factura de suscripción de Claude Code fue de aproximadamente 5.500 dólares. Son bases de facturación distintas, y el intervalo de la API abarca cifras tanto inferiores como superiores a esa factura.