La API de DeepSeek se factura por consumo. Para estimar una tarea, separa los tokens de entrada con caché, la entrada sin caché y la salida. Esta página se refiere a la API; las condiciones del chat de consumo son distintas.
Tarifas consultadas el 12 de septiembre de 2026
La tabla oficial de precios publica importes en dólares estadounidenses por un millón de tokens. Estas son las tarifas de hora punta consultadas:
| Modelo de la API | Entrada con caché | Entrada sin caché | Salida |
|---|---|---|---|
| deepseek-flash | 0,006 USD | 0,30 USD | 1,20 USD |
| deepseek-v4-pro | 0,044 USD | 1,32 USD | 3,96 USD |
Las horas punta son de lunes a viernes, de 01:00 a 04:00 y de 06:00 a 10:00 UTC. Fuera de esas franjas, las tarifas publicadas son la mitad. Confirma la tabla oficial antes de comprometer un presupuesto: los precios pueden cambiar.
La fórmula por petición
Estimación local · tarifas del 12-09-2026
Calcula una petición o un lote
Introduce cantidades de tokens; no pegues texto ni claves. Esta calculadora no envía peticiones a DeepSeek.
Con JavaScript activo se mostrará la estimación. También puedes usar la fórmula que aparece debajo.
Cantidades hipotéticas. La entrada con y sin caché son partidas separadas: no cuentes los mismos tokens dos veces. Las franjas punta son lunes a viernes, 01:00–04:00 y 06:00–10:00 UTC. Confirma las tarifas oficiales antes de presupuestar.
Utiliza tres cantidades y tres tarifas, expresadas en la misma moneda:
coste = (entrada_con_cache × tarifa_con_cache
+ entrada_sin_cache × tarifa_sin_cache
+ salida × tarifa_salida) / 1.000.000
La división es necesaria porque las tarifas están publicadas por millón de tokens. No multipliques el total de tokens por una sola tarifa cuando la entrada y la salida tienen precios diferentes.
Ejemplo numérico
Ejemplo hipotético · Tarifas consultadas el 12 de septiembre de 2026
Modelo
deepseek-flash en hora punta.
Entrada
1.000 tokens sin caché. El ejemplo no supone un acierto de caché.
Salida
300 tokens. Su tarifa se aplica por separado de la entrada.
Una estimación depende de las cantidades, la franja horaria y la tarifa elegidas. Los valores de este ejemplo no son una factura ni una medición de la aplicación.
Supongamos una petición a deepseek-flash en hora punta con 1.000 tokens de entrada sin caché y 300 de salida. Son cantidades hipotéticas para ilustrar el cálculo:
- Entrada: 1.000 × 0,30 / 1.000.000 = 0,00030 USD.
- Salida: 300 × 1,20 / 1.000.000 = 0,00036 USD.
- Total calculado: 0,00066 USD por petición.
Con esas mismas condiciones, 2.000 peticiones sumarían 1,32 USD. Esto no es una medición ni una previsión para tu aplicación: cambia las cantidades por el consumo observado de tus propias tareas.
Presupuesta tareas completas
Define primero qué incluye tu proceso. Si generar un resumen requiere una petición inicial, otra de revisión y una tercera para darle formato, registra las tres. Haz lo mismo con las peticiones repetidas después de un fallo. El presupuesto debe representar el trabajo que la aplicación realiza.
Prepara al menos dos escenarios: el volumen habitual que esperas y un periodo de uso elevado. Anota tus supuestos para poder revisarlos cuando tengas datos. No consideres una posible reducción por caché como ahorro asegurado; comprueba su efecto con la guía de caché de contexto.
Qué mirar antes de ampliar el uso
Revisa el coste por tarea terminada, cuántas salidas necesitan corrección y cuántas peticiones se repiten. Reducir texto innecesario puede ayudar a controlar el proceso, pero una respuesta demasiado corta puede obligarte a repetir la tarea. Compara ambos efectos.
Empieza con la configuración de la API o consulta los errores de saldo y acceso si aún no puedes realizar tu primera petición.
Documentación oficial consultada el 12 de septiembre de 2026. DEspañol es una publicación independiente; los ejemplos son educativos y no se han ejecutado contra la API.