DeepSeek publicó el 14 de agosto la disponibilidad general de V4-Pro, designada internamente DeepSeek-V4-Pro-0813, tras meses de preview desde abril. El titular técnico es real —1,6 billones de parámetros totales con solo 49.000 millones activos por token, licencia MIT de verdad, y benchmarks agénticos que compiten de tú a tú con los mejores del mercado— pero la letra pequeña del lanzamiento merece tanta atención como las cifras de la ficha técnica.
Un modelo pensado para agentes, no para conversación
DeepSeek ha sido explícita: V4-Pro apunta a tareas donde un sistema de IA usa herramientas, ejecuta código y completa flujos de varios pasos sin intervención humana, no a la conversación general. Los benchmarks publicados lo confirman —87,9 en Terminal-Bench 2.1, 62,7 en DeepSWE, 61,5 en NL2Repo— todos ellos pruebas de agente sobre terminal y repositorios reales, no exámenes de cultura general. Para quien ya construye flujos de agentes (revisión de código, triage de incidencias, automatización de tareas de sysadmin), es el terreno donde de verdad importa rendir bien.
La subida de precio que empaña el lanzamiento
Lo que más me ha descolocado de este lanzamiento no es técnico: DeepSeek ha anunciado que el precio de los tokens de salida en hora punta sube de 0,87 $ a 3,96 $ por millón —más de 4 veces— el 16 de agosto, solo dos días después de esta disponibilidad general.
Es un plazo demasiado corto para que nadie construya nada serio sobre el precio de lanzamiento antes de que cambie por completo. Si vienes a la API pensando en el precio de portada, confirma la tarifa vigente antes de comprometer nada a producción —la ventana de precio de lanzamiento habrá cerrado casi antes de que termines de leer esta review.
Lo que más me ha descolocado de este lanzamiento no es técnico: DeepSeek ha anunciado que el precio de los tokens de salida en hora punta sube de 0,87 $ a 3,96 $ por millón —más de 4 veces— el 16 de agosto, solo dos días después de esta disponibilidad general.
Licencia y pesos: la parte que sí convence sin matices
Lo que no tiene truco es la apertura: MIT de verdad, pesos publicados en Hugging Face tanto para V4-Pro como para la variante V4-Flash (284.000 millones totales, 13.000 millones activos), sin restricciones de uso comercial. Es el nivel de apertura que permite auditar el modelo de verdad, no solo consumirlo como caja negra a través de una API —aunque, como se explica en el tutorial que acompaña a esta review, autoalojar la versión Pro completa exige un clúster de GPUs que queda muy lejos de cualquier homelab, por generoso que sea el presupuesto.
Para quién tiene sentido ahora mismo
Si tu flujo de trabajo ya gira en torno a agentes que ejecutan código y herramientas de verdad, y tienes presupuesto de API para absorber el salto de precio que llega en 48 horas, V4-Pro merece una prueba seria. Si buscas algo que quepa ejecutar en tu propio hardware, la variante V4-Flash es la opción realista —y aun así, como se detalla en el tutorial de instalación, exige bastante más músculo de GPU que cualquier otro modelo cubierto hasta ahora en El Rack.



