La IA más barata del mundo va a subir de precio: DeepSeek avisa de una subida "significativa" seis días después de lanzarla


El 31 de julio DeepSeek publicó la versión definitiva de V4-Flash y se convirtió, según las mediciones independientes de Artificial Analysis, en el modelo de frontera más barato de operar del mercado. El 6 de agosto, seis días después, la compañía añadió un aviso a su propia documentación para desarrolladores: los precios de la API van a subir, la subida será "significativa" y conviene que planifiques en consecuencia.
No dio cifras. No dio fecha. El texto oficial dice literalmente que "el plan de precios concreto estará sujeto a un aviso oficial". Es la segunda vez en menos de un mes que DeepSeek toca su estructura de precios: a mediados de julio, con el lanzamiento de V4, ya introdujo por primera vez tarifas distintas según la hora del día.
Puede parecer un asunto de desarrolladores. No lo es del todo. DeepSeek es la empresa que en enero de 2025 hundió la cotización de Nvidia demostrando que se podía hacer IA de primer nivel por una fracción del coste, y buena parte de lo que hoy funciona en pequeñas empresas españolas —clasificadores de correo, resúmenes automáticos, chatbots internos, automatizaciones en Make o n8n— sale a cuenta precisamente porque alguien eligió el proveedor más barato. Ese proveedor acaba de anunciar que cambia el precio sin decir a cuánto.
Qué es una API de IA, y por qué el precio se mide en millones de tokens
Antes de seguir conviene aclararlo, porque es lo que separa entender la noticia de leerla por encima.
Cuando entras en la web de ChatGPT o de DeepSeek y escribes, estás usando un producto de consumo: pagas una cuota mensual fija o no pagas nada. Una API es la otra puerta de la misma casa. Es el punto de conexión por el que un programa —tu web, tu CRM, tu hoja de cálculo, tu automatización— habla directamente con el modelo sin que haya una persona delante. Le manda un texto, recibe una respuesta, y eso ocurre miles de veces al día sin que nadie lo vea.
Ahí no se paga por cuota, se paga por consumo, y la unidad es el token: un trozo de palabra. En español, la regla gruesa es que 1.000 tokens rondan las 700 u 800 palabras. Se cobra por separado lo que entra (tu pregunta, el documento que adjuntas, las instrucciones del sistema) y lo que sale (la respuesta), y lo que sale suele costar el doble o el triple.
Los precios se anuncian por millón de tokens porque en unidades pequeñas serían cifras ridículas. Estos son los que había en la página oficial de precios de DeepSeek en el momento del aviso:
| Modelo | Entrada (por millón) | Salida (por millón) |
|---|---|---|
| V4-Flash | 0,14 $ | 0,28 $ |
| V4-Pro | 0,435 $ | 0,87 $ |
| V4-Flash con caché | 0,0028 $ | — |
Para hacerse una idea: procesar mil correos electrónicos de longitud media y generar una respuesta corta para cada uno cuesta, con V4-Flash, del orden de unos pocos céntimos. Ese es exactamente el motivo por el que tanta automatización pequeña se ha vuelto viable en los últimos dieciocho meses. Si quieres el terreno completo, lo he explicado en qué son las APIs de IA.
Por qué sube quien nació de bajar
La explicación oficial no existe: DeepSeek no ha dado ninguna. Lo que sí hay son tres fuerzas que empujan en la misma dirección y que la propia cobertura de Bloomberg, el South China Morning Post y TechNode recogen.
La primera es el éxito. Precios ultrabajos atraen volumen, y el volumen se sirve con chips y con electricidad, que se pagan al contado. Cuando llevas dos años fijando precios por debajo de coste para ganar cuota, llega el día de la factura. DeepSeek está proyectando un centro de datos de un gigavatio en Mongolia Interior; eso son miles de millones de inversión que alguien tiene que devolver.
La segunda es que la guerra de precios china se ha vuelto insostenible para todos. Desde 2025, ByteDance, Alibaba y Baidu han estado recortando el precio de sus modelos y regalando servicios. El movimiento de DeepSeek se lee mejor dentro de un giro más amplio del sector chino: de la carrera por la cuota a modelos de ingresos que se sostengan solos. Alguien tenía que romper el equilibrio primero.
La tercera es que la ventaja de DeepSeek se ha estrechado. Ser radicalmente más barato dejó de ser una rareza china. OpenAI ha recortado precios de GPT-5.6 y Meta compite en la misma franja. Un desarrollador citado por el SCMP lo resumía con más gracia que ningún analista: subir precios justo ahora, con los americanos igualando la tarifa, "¿no es buscarse problemas?".
Conviene decir también lo que no es. Incluso con una subida agresiva, DeepSeek seguirá en la parte baja del mercado: su rival chino Moonshot cobra 3 y 15 dólares por millón de tokens con Kimi K3, entre veinte y cincuenta veces más. Lo que se acaba no es el precio bajo, es el precio irracionalmente bajo.
Lo que esto significa si construiste algo encima
Si tienes automatizaciones funcionando contra la API de DeepSeek, hoy tu coste unitario está literalmente indeterminado. No sabes cuánto vas a pagar el mes que viene por la misma operación. Esa es la noticia práctica, y no depende de cuánto acabe subiendo.
Lo que haría yo, en este orden.
Saca dos números antes de que publiquen tarifas. Cuántos tokens consumes al mes y cuánto te cuesta cada operación de negocio (cada correo clasificado, cada documento resumido, cada conversación atendida). Sin esa línea base no vas a poder decidir nada cuando salga el precio nuevo: solo vas a poder asustarte o no asustarte. Casi nadie tiene estos dos números, y es una hora de trabajo.
Comprueba cuánto cuesta cambiar de modelo. Aquí está la diferencia entre un susto y un problema. Si tu integración está montada sobre un formato compatible con OpenAI —y la de DeepSeek lo es—, cambiar de proveedor puede ser tocar dos líneas de configuración. Si en cambio tus prompts están afinados a mano para el comportamiento concreto de un modelo, o dependen de sus peculiaridades, el cambio significa reescribir y volver a probar. Averígualo ahora, con calma, no el día del anuncio.
Mira la caché de contexto. Es la optimización más ignorada y la más rentable: DeepSeek cobra 0,0028 $ por millón de tokens de entrada que ya estaban en caché frente a 0,14 $ si no lo estaban. Cincuenta veces menos. Si mandas el mismo bloque de instrucciones o el mismo documento largo en cada llamada, estructurar las peticiones para que esa parte se reutilice recorta la factura mucho más de lo que la va a subir DeepSeek.
Y revisa por qué elegiste el proveedor. Esta es la parte incómoda. Elegir por precio es elegir por la única variable que el vendedor puede mover cuando quiera y que tú no puedes negociar sin volumen. La dependencia que duele no es la técnica, es la contractual. Si la comparación te sirve, tengo el contraste con la alternativa más obvia en ChatGPT frente a DeepSeek.
Lo que de verdad se termina aquí
En enero de 2025, DeepSeek publicó R1 y en una sola sesión Nvidia perdió cerca de 590.000 millones de dólares de capitalización, la mayor caída diaria de la historia del mercado estadounidense. El mensaje que se llevó el mundo fue: la IA de frontera no tiene por qué costar una fortuna. Ese mensaje era cierto y sigue siéndolo en el entrenamiento de modelos.
Lo que este aviso corrige es una extrapolación distinta que hicimos todos: que servir IA a escala también iba a ser casi gratis para siempre. Servir cuesta chips, energía y refrigeración todos los días del año, y ese coste no baja con un truco de arquitectura. Fue una fase de guerra de precios financiada con capital de riesgo, y esas fases terminan siempre igual.
Para quien monta cosas con IA en una empresa pequeña, el aprendizaje no es "DeepSeek ya no vale". Es que el precio de la inteligencia artificial ha dejado de ser una constante y ha pasado a ser una variable de tu negocio, como el alquiler o la luz. Y las variables se miden, se revisan y se cubren con un plan B. El contexto completo de la compañía, en qué es DeepSeek.
Fuentes: aviso oficial en la documentación de precios de la API de DeepSeek; Bloomberg, South China Morning Post, TechNode y The Next Web; lanzamiento de V4-Flash en Caixin Global y Semafor.
Inteligencia Artificial aplicada a negocio
Sin humo. Solo experimentos reales, prompts que funcionan y estrategias de escalabilidad.
Escribo sobre inteligencia artificial intentando que se entienda y sin vender humo. Ver todas las noticias.


