aiexpert
Inicio / Noticias / Nota
Research · 18 ago 2026, 16:33 · 4 fuentes

DeepSeek lanza V4-Pro GA: optimizado para agentes, contexto 1M, precio de pico $3,96/M tokens de salida

DeepSeek GA'd DeepSeek-V4-Pro-0813 el 13 de agosto después de una fase de vista previa de cuatro meses, optimizando para tareas de IA agentic: uso de herramientas, ejecución de código y flujos de trabajo de varios pasos. El modelo logró 87,9 en Terminal Bench 2.1, 62,7 en DeepSWE (ingeniería de software) y 61,5 en NL2Repo. Admite contexto de 1M-token con salidas de hasta 384K-token, modos de pensamiento y no pensamiento duales y tres niveles de esfuerzo configurables (bajo/alto/máximo). El acceso a API está activo; los precios escalan desde la tasa plana de $0,87/M tokens de salida hasta $3,96/M en horas pico (16 de agosto), con descuentos fuera de pico del 50%.

El lanzamiento de disponibilidad general marca un cambio estratégico con respecto a la vista previa de abril, que fue superada por el propio modelo más barato DeepSeek V4-Flash en algunas pruebas independientes—un resultado inusual que creó un impulso inicial para Flash. Con el GA 0813, DeepSeek ahora está fijando el precio de V4-Pro en 14× el costo de salida de Flash ($3,96 vs $0,28) mientras afirma mejoras sustanciales de agentes en cargas de trabajo de producción. La empresa también anunció compatibilidad con formato de API OpenAI, integración de Codex y compatibilidad nativa con API de Respuestas, posicionando el modelo para flujos de trabajo agentic empresariales.

Para constructores, la relevancia está en el enrutamiento de costo versus capacidad: Together AI comparó la cascada (ejecute Pro primero, escale a GPT-5.6 Sol en falla de prueba) en $3,35 por tarea resuelta—superando a Sol solo (72,7% pass@1) por menos de la mitad del precio por tarea. A 1/35 del costo unitario de GPT-5.6 Sol y con cobertura fuerte de agente agentic en benchmarks abiertos (80,6% en SWE-Bench Verified), DeepSeek V4-Pro está forzando un repricing fundamental de la economía de coding-agent.

Fuentes

Todo lo que sostiene esta nota
  1. 01 Primary source qz.com
  2. 02 qz.com qz.com “DeepSeek-V4-Pro-0813 focuses on agent capabilities — tasks where AI systems use tools, execute code, and complete multi-step workflows. Benchmark results: 87.9 on Terminal Bench 2.1, 62.7 on DeepSWE, 61.5 on NL2Repo.”
  3. 03 qz.com qz.com “V4-Pro output tokens rising to $3.96 per million at peak hours from the current flat rate of $0.87 per million. Even at the new peak rates, DeepSeek's prices remain below Anthropic's Fable 5 at $50 per million output tokens.”
  4. 04 huggingface.co huggingface.co “Structera X (memory expansion) and Structera A (near-memory compute) are already shipping. The 1M-token context supports up to 384,000-token outputs with thinking/non-thinking modes.”