aiexpert
Início / Notícias / Nota
Research · 15 de ago. de 2026, 05:33 · 4 fontes

Grok 4.6 corresponde a nível Fable 5 em trabalho agentico com desconto de 85%; vitória eficiente em contexto

SpaceXAI lançou Grok 4.6 em 12 de agosto, posicionado como correspondente ao desempenho Fable 5 com um desconto dramático. No Artificial Analysis Intelligence Index—um benchmark composto—Grok 4.6 publica uma 61, nível com GPT-5.6 Sol Max e um ponto atrás de Fable 5 Max em 62. O modelo é precificado em $2/$6 por milhão de tokens de entrada/saída, 60%+ abaixo de Claude Opus 5 e GPT-5.6 Sol. A afirmação de paridade, porém, é mantida de forma restrita: em contagens de benchmark diretas, Grok 4.6 perde para Fable 5 Max em 7 de 10 testes compartilhados.

Em trabalho agentico de longo horizonte (AA-Briefcase), Grok 4.6 atinge nível Fable 5 com um Elo de 1577 enquanto usa 53 turnos e 500M tokens de entrada em média—metade dos turnos e um quarto dos tokens que Claude Opus 5 (máx.) requer (~103 turnos, ~2B tokens). Essa vantagem de eficiência se compõe no custo por tarefa: Grok 4.6 custa $0.84 por tarefa no mesmo benchmark, colocando-o na fronteira Pareto de eficiência de custos. Em métricas de inteligência pura (GDPVal-AA v2 em 1753), Grok 4.6 lidera tanto Fable 5 Max (1741) quanto Sol (1728).

Para arquitetos de produção e equipes de plataforma, o sinal é econômico: Grok 4.6 troca uma lacuna de inteligência marginal (vence 3/10 vs Fable, 6/9 vs Sol) por TCO dramaticamente menor em cargas de trabalho agenticas e de codificação. A vantagem de custo é maior em tarefas de longo prazo onde a queimadura de token importa mais do que a taxa por token. A janela de contexto permanece em 500K, mas o preço salta no limite de 200K tokens, criando um trade-off em escala.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source artificialanalysis.ai
  2. 02 artificialanalysis.ai artificialanalysis.ai “Grok 4.6 returns SpaceXAI to the intelligence frontier and leads on cost efficiency. Headline pricing is unchanged from Grok 4.5 at $2/$6 per 1M input/output tokens, 60%+ below Claude Opus 5 ($5/$25) and GPT-5.6 Sol ($5/$30).”
  3. 03 northdenvertribune.com northdenvertribune.com “On the Artificial Analysis Intelligence Index, a composite of benchmark results, Grok 4.6 scores 61, according to figures reported by xAI and Artificial Analysis — level with GPT-5.6 Sol Max at 61 and one point behind Fable 5 Max at 62. On that single composite number, parity is real. Almost everywhere else in the release data, it is not. In the head-to-head counts reported alongside the launch, Grok 4.6 loses to Fable 5 Max on 7 of the 10 shared benchmarks.”
  4. 04 thenewstack.io thenewstack.io “Grok 4.6 achieves a Fable 5 tier on AA-Briefcase benchmark and costs 85% less than Fable 5 Max for similar agentic performance.”