DeepSeek movió su modelo estrella V4 Pro a disponibilidad general el 12 de agosto de 2026, enviando la compilación oficial 0813 a su API y a todos los proveedores posteriores (OpenRouter, Vercel AI Gateway, Cloudflare, etc.). El modelo permaneció en vista previa desde abril de 2026; este lanzamiento GA marca el final de una ventana de vista previa de cuatro meses. La fijación de precios de la API permanece en $0,435 por millón de tokens de entrada y $0,87 por millón de tokens de salida, sin cambios de código necesarios para integraciones existentes.
La compilación 0813 es un modelo de mezcla de expertos de 1,6 billones de parámetros con 49 mil millones de parámetros activos, compatible con contexto de 1 millón de tokens y hasta 384K tokens de salida. Los pesos internos actualizados tienen como objetivo mejorar el rendimiento en razonamiento, codificación y tareas agentivas en comparación con la vista previa de abril. DeepSeek publicó puntos de referencia reclamando paridad competitiva con modelos de frontera cerrada en ingeniería de software (DeepSWE 62,7%, Terminal-Bench 87,9%), aunque la verificación independiente en LMSYS Chatbot Arena y otras plataformas aún está pendiente.
La columna vertebral arquitectónica permanece sin cambios: atención híbrida (Compressed Sparse Attention + Heavily Compressed Attention) reduce la inferencia de token único al 27% y el caché KV al 10% del costo de V3.2 en contexto de token de 1M. DeepSeek es compatible con tres modos de razonamiento (sin pensar, alto esfuerzo, esfuerzo máximo), llamadas de herramientas, salida JSON y ambos formatos de mensaje OpenAI y Anthropic. El modelo está disponible con licencia de código abierto MIT en Hugging Face (~865GB, escala de implementación de modelo individual).
Para arquitectos de canalización agentiva: V4 Pro 0813 apunta a cargas de trabajo de codificación y razonamiento sensibles al costo en las que 1,6T parámetros y contexto de 1M permiten análisis de base de código completa a aproximadamente 1/60 del precio de Claude Opus o GPT-5.6 Sol. Las tasas de acierto de caché en OpenRouter promedian 88-92%, reduciendo el precio de entrada efectivo a ~$0,05/M tokens. Observe el aumento de precio anunciado que DeepSeek ha señalado como próximo; la ventana de arbitraje en las tasas actuales puede cerrarse rápidamente.