SpaceXAI lançou Grok 4.5 em 8-9 julho, 2026 após beta privada em SpaceX e Tesla. Elon Musk o apresentou como 'Opus-class, mas mais rápido, mais token-eficiente e menor custo', depois esclareceu: 'grosseiramente comparável a Opus 4.7, mas muito mais rápido'. O modelo usa V9 fundação de 1.5T-parâmetros treinado em dados sessão IDE Cursor. Preço: $2/milhão tokens input, $6/milhão output (vs. Claude Opus 4.8 em $5/$25; OpenAI GPT-5.6 Sol em $5/$30).
Benchmarks são mistos. Em DeepSWE 1.1 (taxa encerramento bug real), Grok 4.5 marcou 53% vs. Opus 4.8's 59%, GPT-5.5's 67%, e Claude Fable 5's 70%. Em SWE Bench Pro, Grok 4.5 postou 64,7%, batendo GPT-5.5's 58,6% mas atrasado em Opus 4.8's 69,2% e Fable 5's 80,4%. Musk reconheceu Fable é 'definitivamente melhor' mas alegou maioria tarefas não requer capacidade nível-Fable.
O delta eficiência é onde Grok compete: em SWE Bench Pro, Grok 4.5 usou 15.954 tokens output por job vs. Opus 4.8's 67.020—um gap 4.2x. Em menor custo por token e massivamente menos tokens queimados por tarefa, Grok visa times desenvolvedores alto-volume otimizando gasto total sobre quadros liderança benchmark. Throughput: 80 tokens/seg (território modelo-rápido).
Para times empresa rodando sistemas multi-agente produção, isso é uma jogada disrupção clássica: Musk aposta que 60% capacidade Opus em 40% custo e 4x menos tokens por tarefa vence cargas trabalho price-sensitive. Musk prometeu melhorias semanais e reescrita C/C++ esperada em ~3 meses para ganhos de velocidade treinamento 10x+ em GPUs GB300 de Colossus.