DeepSeek GA'd DeepSeek-V4-Pro-0813 el 13 de agosto después de una fase de vista previa de cuatro meses, optimizando para tareas de IA agentic: uso de herramientas, ejecución de código y flujos de trabajo de varios pasos. El modelo logró 87,9 en Terminal Bench 2.1, 62,7 en DeepSWE (ingeniería de software) y 61,5 en NL2Repo. Admite contexto de 1M-token con salidas de hasta 384K-token, modos de pensamiento y no pensamiento duales y tres niveles de esfuerzo configurables (bajo/alto/máximo). El acceso a API está activo; los precios escalan desde la tasa plana de $0,87/M tokens de salida hasta $3,96/M en horas pico (16 de agosto), con descuentos fuera de pico del 50%.
El lanzamiento de disponibilidad general marca un cambio estratégico con respecto a la vista previa de abril, que fue superada por el propio modelo más barato DeepSeek V4-Flash en algunas pruebas independientes—un resultado inusual que creó un impulso inicial para Flash. Con el GA 0813, DeepSeek ahora está fijando el precio de V4-Pro en 14× el costo de salida de Flash ($3,96 vs $0,28) mientras afirma mejoras sustanciales de agentes en cargas de trabajo de producción. La empresa también anunció compatibilidad con formato de API OpenAI, integración de Codex y compatibilidad nativa con API de Respuestas, posicionando el modelo para flujos de trabajo agentic empresariales.
Para constructores, la relevancia está en el enrutamiento de costo versus capacidad: Together AI comparó la cascada (ejecute Pro primero, escale a GPT-5.6 Sol en falla de prueba) en $3,35 por tarea resuelta—superando a Sol solo (72,7% pass@1) por menos de la mitad del precio por tarea. A 1/35 del costo unitario de GPT-5.6 Sol y con cobertura fuerte de agente agentic en benchmarks abiertos (80,6% en SWE-Bench Verified), DeepSeek V4-Pro está forzando un repricing fundamental de la economía de coding-agent.