aiexpert
Início / Notícias / Nota
Research · 09 de jul. de 2026, 18:03 · 3 fontes

OpenAI lança GPT-5.6 Sol, Terra, Luna; Sol combina capacidade de Fable 5 a aproximadamente metade do custo

OpenAI lançou a família GPT-5.6 em 9 de julho em três níveis: Sol (flagship), Terra (trabalho equilibrado/diário) e Luna (otimizado por custo). No Agents' Last Exam (fluxos de trabalho agénticos em 55 campos profissionais), GPT-5.6 Sol marcou 53,6, eclipsando Claude Fable 5 em 13,1 pontos. Criticamente: Terra e Luna superam Fable 5 a aproximadamente um décimo sexto do custo estimado, enquanto Sol combina a inteligência de Fable 5 a aproximadamente metade do custo estimado por token.

No Índice de Inteligência de Análise Artificial (uma medida ampla abrangendo trabalho agéntico, codificação e ciência), GPT-5.6 Sol com raciocínio máximo fica a um ponto de Fable 5 enquanto completa tarefas 61% mais rápido a aproximadamente metade do custo estimado. Em codificação especificamente (Terminal-Bench 2.1), Sol estabelece o estado da arte em 88,8%, usando menos da metade dos tokens de saída e aproximadamente um terço do custo comparado a Fable 5. Luna supera Opus 4.8 a um quarto do custo estimado. Eficiência obtida a partir de engenharia de harness, não retreinamento de modelo.

Sol introduz dois novos níveis de raciocínio: máximo (mais tempo para raciocínio profundo) e ultra (coordena quatro agentes em paralelo em tarefas complexas). ChatGPT Work, alimentado por GPT-5.6, lança com capacidades de conclusão de tarefas agénticas, agora disponível para assinantes Pro, Enterprise e Edu. Sol está atualmente em visualização limitada para parceiros confiáveis por coordenação governamental; disponibilidade geral prometida nas próximas semanas. Parceria Cerebras envia Sol a até 750 tokens por segundo para clientes selecionados.

Para arquitetos: os níveis GPT-5.6 estratificam a curva custo-capacidade fronteiriça, tornando modelos menores viáveis para trabalho de alto throughput a margens previsíveis. A tese de eficiência—comparando o desempenho superior a metade do custo—aborda diretamente a crise de custo de token citada por Palo Alto e Palantir. Espere rápida adoção em sistemas de agentes em produção onde margem importa, particularmente em segmentos empresariais sensíveis a custos.

Fontes

Tudo que sustenta esta nota
  1. 01 Primary source openai.com
  2. 02 GPT-5.6: Frontier intelligence that scales with your ambition openai.com
  3. 03 Previewing GPT-5.6 Sol: a next-generation model openai.com