DeepSeek V4-Flash lanzado con descuento del 99%; modelos de IA corren hacia precios de commodity
DeepSeek lanzó V4-Flash (284B parámetros totales, 13B activos) el 31 de julio de 2026, con desempeño comparable al Claude Opus 4.8 de Anthropic en codificación compleja y tareas de software autónomas, mientras cobraba significativamente menos. V4-Flash cuesta aproximadamente 28 centavos por unidad de salida vs. $25 para lo mismo de Opus 4.8—una ventaja de precio del 99%. En el marcador de codificación front-end de multitudes de Arena.ai, V4-Flash debutó por delante de Opus 4.8 a pesar de su precio bargain, señalando que la economía de la inferencia de modelos se ha invertido: capacidad y precio se están desacoplando.
El lanzamiento de V4 sigue a un colapso de precios de escala completa en modelos de frontera en julio de 2026. OpenAI cortó el precio de GPT-5.6 Luna en un 80% solo tres semanas después del lanzamiento; Google lanzó tres nuevos modelos Gemini 'flash' enfocados en eficiencia; Meta revertía su estrategia de pesos abiertos con Muse Spark 1.1 de código cerrado con precios agresivos para desarrolladores. Solo Anthropic mantuvo precios premium en modelos Claude de nivel superior, apostando a que las empresas pagarán más por seguridad e interpretabilidad—una apuesta contraria en medio de la carrera por el liderazgo de costos.
Para equipos de infraestructura, esto señala el final de la economía de modelo como foso. Desde mediados de 2025, el precio del modelo fronterizo se ha comprimido de $0,50/M tokens a centavos de un solo dígito, y V4-Flash de parámetro activo de 13B de DeepSeek demuestra que la capacidad se escala eficientemente sin conteos de mega-parámetros. Los equipos que construyen pilas de inferencia de producción, sistemas RAG y flujos de trabajo agênticos ahora tienen apalancamiento de precios a medida que el locus de diferenciación se desplaza desde la concesión de modelos hacia la integración, la confiabilidad y el ajuste fino específ ico del dominio.
Fuentes
- Primary source
- axios.com
“Its newest model, V4 Flash, performs close to the level of Anthropic's Claude Opus 4.8, one of the industry's most capable systems, on tests of complex coding and autonomous software tasks.”
- axios.com
“The price gap is staggering: DeepSeek charges about 28 cents for the same amount of output that costs $25 on Opus 4.8 — a 99% discount.”
- axios.com
“With Chinese models like Kimi K3 bearing down on the U.S. market, July ushered in a full-scale price war across the AI landscape. OpenAI slashed the price of GPT-5.6 Luna — its fastest, cheapest model for high-volume tasks — by 80% on Thursday, only three weeks after its launch.”