SpaceXAI lanzó Grok 4.5 el 8-9 de julio de 2026 después de beta privado en SpaceX y Tesla. Elon Musk lo presentó como 'Opus-class, pero más rápido, más eficiente en tokens y menor costo', luego aclaró: 'aproximadamente comparable a Opus 4.7, pero mucho más rápido'. El modelo utiliza cimentación V9 de 1.5T parámetros entrenado en datos de sesión IDE Cursor. Precio: $2/millón tokens entrada, $6/millón salida (vs. Claude Opus 4.8 en $5/$25; OpenAI GPT-5.6 Sol en $5/$30).
Los benchmarks son mixtos. En DeepSWE 1.1 (tasa de cierre de bug real), Grok 4.5 puntuó 53% vs. Opus 4.8's 59%, GPT-5.5's 67% y Claude Fable 5's 70%. En SWE Bench Pro, Grok 4.5 postuló 64,7%, superando GPT-5.5's 58,6% pero rezagado en Opus 4.8's 69,2% y Fable 5's 80,4%. Musk reconoció que Fable es 'definitivamente mejor' pero alegó que la mayoría de tareas no requieren capacidad a nivel Fable.
El delta de eficiencia es donde Grok compite: en SWE Bench Pro, Grok 4.5 usó 15.954 tokens salida por tarea vs. Opus 4.8's 67.020—una brecha de 4.2x. A menor costo por token y masivamente menos tokens quemados por tarea, Grok apunta a equipos desarrolladores de alto volumen optimizando gasto total sobre cuadros de liderazgo de benchmark. Rendimiento: 80 tokens/seg (territorio de modelo rápido).
Para equipos empresariales que ejecutan sistemas multi-agentes en producción, este es un juego de disrupción clásico: Musk apuesta que 60% de capacidad Opus a 40% del costo y 4x menos tokens por tarea ganan cargas de trabajo sensibles al precio. Musk prometió mejoras semanales y reescritura de C/C++ esperada en ~3 meses para ganancias de velocidad de entrenamiento de 10x+ en GPUs GB300 de Colossus.