DeepSeek API-Preise für V4-Modelle steigen

DeepSeek encarece claramente el acceso a la API para los modelos V4

DeepSeek cambia sus precios de la API para V4-Flash y V4-Pro a un modelo basado en la hora a partir del 16 de agosto de 2026 a las 16:00 UTC. Para los desarrolladores, los costes subirán de forma notable según el modelo, el tipo de token y la hora del día. El acceso a las entradas almacenadas en caché en V4-Pro será lo que más se encarezca.

Cómo funcionan los nuevos precios de DeepSeek

DeepSeek sustituye las tarifas uniformes de la API que aplicaba hasta ahora por precios para horas punta y tarifas más baratas para horas valle. Las horas punta serán cada día de 01:00 a 04:00 UTC y de 06:00 a 10:00 UTC. El resto de horas se considerarán horas valle.

Las tarifas valle costarán la mitad que las de hora punta. Con esto, DeepSeek intenta repartir mejor a lo largo del día las solicitudes que requieren más capacidad de cálculo. Para las aplicaciones con tareas planificables, la hora de procesamiento puede volverse mucho más importante.

Un token es la unidad mínima de texto que procesa un modelo de IA. Una palabra puede estar formada por uno o varios tokens. Los tokens de entrada proceden de la solicitud del usuario, y los tokens de salida, de la respuesta del modelo.

Cuánto suben los costes de la API

Las mayores subidas afectan a los tokens de entrada con acierto de caché en V4-Pro. Un acierto de caché se produce cuando se pueden reutilizar partes recurrentes de una solicitud. Estos tokens siguen siendo baratos en términos absolutos, pero son los que más suben en porcentaje.

Modelo Tipo de token Antes por 1 millón de tokens Hora valle Hora punta Mayor subida
V4-Flash Entrada con acierto de caché $0,0028 $0,007 $0,014 aprox. 400 %
V4-Flash Entrada sin acierto de caché $0,14 $0,22 $0,44 aprox. 214 %
V4-Flash Salida $0,28 $0,66 $1,32 aprox. 371 %
V4-Pro Entrada con acierto de caché $0,003625 $0,022 $0,044 aprox. 1.114 %
V4-Pro Entrada sin acierto de caché $0,435 $0,66 $1,32 aprox. 203 %
V4-Pro Salida $0,87 $1,98 $3,96 aprox. 355 %

En V4-Flash, los tokens de salida en horas punta pasan de $0,28 a $1,32 por millón de tokens. En V4-Pro, ese mismo concepto sube de $0,87 a $3,96. Esto encarece sobre todo las aplicaciones que generan respuestas largas.

Qué supone el cambio para los desarrolladores

La nueva estructura de precios no afectará por igual a todos los desarrolladores. Las aplicaciones con muchas solicitudes espontáneas de usuarios tienen poco margen para mover su carga. En cambio, los trabajos por lotes, los análisis o las evaluaciones automáticas sí pueden trasladarse más fácilmente a franjas más baratas.

  • Tareas planificables: Si no tenéis que procesar grandes volúmenes de datos al instante, podéis usar las horas valle y limitar así el sobrecoste.
  • Productos interactivos: Los chatbots, asistentes de programación o sistemas de atención al cliente suelen tener que responder cuando la demanda es alta. Ahí, los precios de hora punta pueden impactar directamente en los costes operativos.
  • Salidas largas: Las aplicaciones con respuestas extensas, informes o generación de código notarán especialmente la subida de los precios de los tokens de salida.
  • Uso de caché: Las entradas almacenadas en caché siguen siendo más baratas que enviar entradas nuevas completas. Aun así, estos costes también suben bastante.

Para los equipos, ahora será más importante medir con precisión vuestro uso de tokens. Una regla sencilla para decidir es esta: todo lo que no tenga que responderse de inmediato debería ir, siempre que se pueda, a horas valle.

Dónde encaja DeepSeek en el mercado

A pesar de la subida, DeepSeek sigue siendo más barato con las tarifas V4 mencionadas que algunos modelos premium de proveedores occidentales. Por ejemplo, Claude Fable 5 de Anthropic cuesta $50 por millón de tokens de salida.

Aun así, el ajuste de precios marca un cambio claro de estrategia. DeepSeek había posicionado antes V4-Flash con mucho peso en sus bajos costes operativos. V4-Pro llegó a ofrecerse durante un tiempo con descuentos importantes.

Con las nuevas tarifas, DeepSeek se acerca más a un modelo cloud basado en la carga. La potencia de cálculo ya no se cobra solo por volumen, sino también según el momento de la demanda. Por eso, para los desarrolladores ya no cuenta solo qué modelo eligen, sino también cuándo lo usan.


Publicado

en

,

por

Etiquetas: