aiexpert
Inicio / Noticias / Nota
Research · 16 ago 2026, 03:05 · 4 fuentes

Grok 4.6 debuta en 61 Índice de IA; 50% más eficiente en turnos vs Claude Opus 5

xAI lanzó Grok 4.6 el 12 de agosto de 2026, puntuando 61 en el Índice de Inteligencia de Análisis Artificial, un salto de +5 sobre Grok 4.5 y colocándolo al nivel de GPT-5.6 Sol mientras permanece justo detrás de Claude Opus 5 (63) y Claude Fable 5 (62). El modelo se envía con el mismo precio de API $2/$6 por millón de tokens que Grok 4.5—aproximadamente 60% más barato que Claude Opus 5 ($5/$25) y GPT-5.6 Sol ($5/$30)—pero el titular subestima la ventaja real.

La eficiencia de turno es la historia: Análisis Artificial midió Grok 4.6 resolviendo tareas complejas de trabajo de conocimiento en aproximadamente 53 turnos y 0,5 mil millones de tokens de entrada en promedio, mientras que Claude Opus 5 necesitaba aproximadamente 103 turnos y 2,0 mil millones de tokens para el mismo trabajo. Esta reducción del 50% en el recuento de turnos se agrava en cargas de trabajo agentísticas de alto volumen. Análisis Artificial calculó Grok 4.6 a $0,84 por tarea completada—idéntica a Kimi K3 pero con inteligencia medida más alta—colocándola en la frontera de Pareto para relación costo-capacidad. La ventana de contexto permanece en 500K (versus 1M de Claude), y el precio de contexto largo se duplica por encima de 200K tokens.

Para equipos evaluando estrategias de enrutamiento multimodelo en 2026, la economía de Grok 4.6 fuerza un recalcular: Claude Opus 5 sigue siendo el estándar para trabajo crítico en corrección, pero la eficiencia de turno de Grok 4.6 lo hace atractivo para agentes de fondo, tareas agentísticas de alto volumen y bucles de razonamiento donde la latencia y el costo por token de Claude serían prohibitivos. La implicación práctica es que los stacks de producción ejecutan cada vez más Claude para rutas críticas y Grok para subagentes de alto rendimiento, una divergencia que era prohibitiva en costo hace un mes.

Fuentes

Todo lo que sostiene esta nota
  1. 01 Primary source codersera.com
  2. 02 codersera.com codersera.com “Grok 4.6 scored 61 on the Artificial Analysis Intelligence Index, a composite of nine benchmarks. That's five points above Grok 4.5”
  3. 03 how2shout.com how2shout.com “Artificial Analysis measured Grok 4.6 completing knowledge-work tasks in roughly 53 turns using about 0.5 billion input tokens. Claude Opus 5 needed around 103 turns and 2 billion tokens for the same work”
  4. 04 artificialanalysis.ai artificialanalysis.ai “Grok 4.6 calculated $0.84 per task, the same as Kimi K3 with slightly higher intelligence, placing it on the Intelligence vs. Cost per Task Pareto frontier”