xAI lanzó Grok 4.6 el 12 de agosto de 2026, puntuando 61 en el Índice de Inteligencia de Análisis Artificial, un salto de +5 sobre Grok 4.5 y colocándolo al nivel de GPT-5.6 Sol mientras permanece justo detrás de Claude Opus 5 (63) y Claude Fable 5 (62). El modelo se envía con el mismo precio de API $2/$6 por millón de tokens que Grok 4.5—aproximadamente 60% más barato que Claude Opus 5 ($5/$25) y GPT-5.6 Sol ($5/$30)—pero el titular subestima la ventaja real.
La eficiencia de turno es la historia: Análisis Artificial midió Grok 4.6 resolviendo tareas complejas de trabajo de conocimiento en aproximadamente 53 turnos y 0,5 mil millones de tokens de entrada en promedio, mientras que Claude Opus 5 necesitaba aproximadamente 103 turnos y 2,0 mil millones de tokens para el mismo trabajo. Esta reducción del 50% en el recuento de turnos se agrava en cargas de trabajo agentísticas de alto volumen. Análisis Artificial calculó Grok 4.6 a $0,84 por tarea completada—idéntica a Kimi K3 pero con inteligencia medida más alta—colocándola en la frontera de Pareto para relación costo-capacidad. La ventana de contexto permanece en 500K (versus 1M de Claude), y el precio de contexto largo se duplica por encima de 200K tokens.
Para equipos evaluando estrategias de enrutamiento multimodelo en 2026, la economía de Grok 4.6 fuerza un recalcular: Claude Opus 5 sigue siendo el estándar para trabajo crítico en corrección, pero la eficiencia de turno de Grok 4.6 lo hace atractivo para agentes de fondo, tareas agentísticas de alto volumen y bucles de razonamiento donde la latencia y el costo por token de Claude serían prohibitivos. La implicación práctica es que los stacks de producción ejecutan cada vez más Claude para rutas críticas y Grok para subagentes de alto rendimiento, una divergencia que era prohibitiva en costo hace un mes.