DeepSeek saca su modelo más potente a 0,44 $ el millón de tokens: cinco veces menos que el Grok del mismo día


DeepSeek ha sacado de la fase de pruebas su modelo más capaz. Desde hoy, el punto de acceso deepseek-v4-pro de su API apunta a la versión definitiva, bautizada como V4-Pro-0813, que llevaba en vista previa desde el 24 de abril. El precio no ha cambiado: 0,435 dólares por millón de tokens de entrada y 0,87 por millón de salida, con un millón de tokens de contexto y hasta 384.000 tokens de respuesta.
El mismo día, xAI presentó Grok 4.6 a 2 dólares la entrada y 6 la salida. Es decir: casi cinco veces más caro a la entrada y siete a la salida que el modelo chino que se le acaba de poner a la par en varias pruebas de agentes. Ese es el titular real de la jornada, y no el lanzamiento en sí.
Hay además un detalle con gracia que casi nadie ha unido: hace una semana DeepSeek avisó en su propia documentación de que iba a subir los precios de forma "significativa". El aviso sigue ahí, palabra por palabra, en la misma página en la que acaba de publicar su modelo tope sin tocar la tarifa.
Qué trae la versión definitiva
Lo que DeepSeek ha reforzado en este salto es el trabajo agéntico: que el modelo no responda y ya, sino que ejecute cadenas largas de acciones —abrir una terminal, leer ficheros, llamar a herramientas, corregirse— sin perderse por el camino. Estas son las cifras que publica la compañía comparando la versión definitiva con la vista previa:
| Prueba | Vista previa | V4-Pro-0813 |
|---|---|---|
| Terminal-Bench 2.1 | 72,1 | 87,9 |
| CyberGym | 52,7 | 83,3 |
| DeepSWE | 12,8 | 62,7 |
| DSBench-Hard | 31,1 | 67,2 |
| AutomationBench | 12,8 | 31,8 |
Conviene leer esa tabla con la cabeza fría: son cifras de la propia DeepSeek en su propio banco de pruebas, no mediciones independientes. Los saltos de DeepSWE o DSBench son tan grandes que apuntan tanto a mejoras reales del modelo como a un montaje de evaluación distinto entre una versión y otra. Cuando Artificial Analysis y compañía pasen sus baterías, sabremos qué parte se sostiene.
Lo que sí es contrastable es la comparación que la propia empresa pone encima de la mesa: 87,9 en Terminal-Bench frente al 88 de Claude Fable 5. Sobre los diez bancos de pruebas de agentes que ha publicado, el modelo de Anthropic sigue por delante en nueve, con una ventaja media en el entorno del 5%. Traducido: DeepSeek no ha alcanzado a la frontera, se ha quedado a un palmo. Pero cuesta una fracción.
En lo técnico, la versión definitiva añade compatibilidad con la API de Responses y con Codex, y mantiene la compatibilidad con la API de Anthropic. Eso significa, en cristiano, que cambiar de proveedor en una integración que ya funciona suele reducirse a tocar la dirección del servidor y la clave.
El precio, en perspectiva
Aquí es donde esto deja de ser una noticia de laboratorios y empieza a afectar a quien monta cosas.
| Modelo | Entrada (por millón) | Salida (por millón) |
|---|---|---|
| DeepSeek V4-Flash | 0,14 $ | 0,28 $ |
| DeepSeek V4-Pro-0813 | 0,435 $ | 0,87 $ |
| DeepSeek V4-Pro con acierto de caché | 0,003625 $ | — |
| Grok 4.6 | 2 $ | 6 $ |
La línea de la caché es la que más gente ignora y la que más dinero mueve. Si repites la misma instrucción de sistema o el mismo documento largo en cada llamada —que es lo que hace cualquier asistente interno—, ese trozo se cobra a 0,003625 dólares el millón. Dos órdenes de magnitud por debajo. Un asistente que consulte el mismo manual de doscientas páginas cien veces al día cuesta céntimos, no euros.
Si estos conceptos te suenan a chino, la parte de fontanería la tengo explicada en qué son las APIs de IA: qué es un token, por qué se cobra distinto lo que entra y lo que sale, y cómo calcular lo que te va a costar de verdad.
La subida que no llega
El 6 de agosto DeepSeek añadió a su página de precios un aviso que sigue publicado hoy: tiene previsto subir el precio general de su API en un futuro cercano, la subida será "significativa" y el plan concreto queda pendiente de un anuncio oficial. Lo conté entonces en DeepSeek avisa de una subida significativa.
Una semana después ha lanzado su modelo tope manteniendo la tarifa. Caben dos lecturas y no son excluyentes: que la subida vaya a llegar de todos modos y este lanzamiento sea el último tramo barato, o que el aviso fuera un globo sonda para medir la reacción antes de mover ficha. La compañía no ha dado ni cifra ni fecha en ninguno de los dos momentos.
Lo práctico, si dependes de esto: los precios de una API no son un contrato, son una página web que alguien puede editar el martes. Si tienes una automatización cuyo coste solo cuadra con el proveedor más barato, no tienes un modelo de negocio, tienes una apuesta. Deja preparada la alternativa y mide cuánto te costaría el mismo trabajo con dos proveedores más.
El contexto: para qué sirve un millón de tokens
Un millón de tokens son unas 700.000 palabras. Toda la contabilidad de un ejercicio, un expediente judicial completo o el histórico de correo de un año caben en una sola petición, sin trocear nada.
Que eso sea posible no significa que sea buena idea. Meter un millón de tokens en cada llamada, aunque salga a 0,44 dólares, cuesta más y responde más despacio que buscar antes lo relevante y mandar solo eso. La ventana enorme es una red de seguridad para cuando no sabes qué parte del montón importa, no la forma por defecto de trabajar. El patrón sensato sigue siendo el de siempre: recuperar lo que hace falta y enviarlo.
Y una advertencia que toca repetir cada vez que hablo de precios chinos: barato no quiere decir apropiado para cualquier dato. Si vas a mandar información de clientes o de pacientes a una API alojada fuera del Espacio Económico Europeo, eso tiene consecuencias de protección de datos que no se arreglan con una tarifa buena. La conversación completa está en DeepSeek, la IA china.
Fuentes: la página oficial de precios de DeepSeek, la cobertura del lanzamiento en Global Times, el anuncio de Grok 4.6 de xAI y la ficha del modelo en OpenRouter.
Inteligencia Artificial aplicada a negocio
Sin humo. Solo experimentos reales, prompts que funcionan y estrategias de escalabilidad.
Escribo sobre inteligencia artificial intentando que se entienda y sin vender humo. Ver todas las noticias.


