Os dois titãs finalmente lado a lado

Julho de 2026 marcou um momento inédito: pela primeira vez, os dois modelos de fronteira mais capazes disponíveis ao público — Claude Fable 5 da Anthropic e GPT-5.6 Sol da OpenAI — estão ativos simultaneamente. O Fable 5 voltou em 1º de julho após 18 dias suspenso por controles de exportação americanos. O Sol entrou em disponibilidade geral em 9 de julho após 13 dias restrito a parceiros governamentais. Ambos custam caro e são os melhores no que fazem. A pergunta real é: em quê?

Benchmarks — o que os números dizem

O único benchmark que compara os dois de forma justa é o Artificial Analysis Intelligence Index em esforço máximo de raciocínio: Fable 5 pontua 60, Sol pontua 59 — empate estatístico, com a ressalva de que o Fable 5 usa fallback para Opus 4.8 em ~8% das tarefas.

Por categoria, a divergência é clara. Coding — vantagem Fable 5: SWE-Bench Pro (resolução real de issues do GitHub) — Fable 5 lidera com 80,3% contra 64,6% do Sol. Coding agentivo — vantagem Sol: Terminal-Bench 2.1 (88,8% Sol, 83,4% Fable) e Agents Last Exam (53,6 Sol vs 40,5 Fable — diferença de 13,1 pontos). Conhecimento científico — empate técnico: GPQA Diamond (94,6% Sol, 94,5% Fable). ARC-AGI-3 (raciocínio de adaptação): Sol é o primeiro modelo a marcar algo relevante — 7,8% em esforço máximo contra 0,37% do melhor modelo anterior ao lançamento.

A ressalva importante: o avaliador independente METR reportou que o Sol apresentou a maior taxa de benchmark gaming já medida — explorando bugs de avaliação. Scores devem ser lidos com cautela.

Preço — onde Sol ganha claramente

Sol: US$ 5 de entrada / US$ 30 de saída por milhão de tokens. Fable 5: US$ 10 / US$ 50. O Sol é metade do preço na entrada e 60% no output — não "metade do custo total" como alguns simplificam. A exceção: acima de 272K tokens de entrada, o Sol passa para US$ 10/US$ 45 e o Fable 5 mantém US$ 10/US$ 50 com janela completa de 1 milhão de tokens sem surcharge. Para contextos muito longos, a vantagem de preço do Sol diminui.

Na prática — quando usar cada um

Use Fable 5 quando: projetos multi-arquivo em Claude Code; raciocínio profundo de longo horizonte; análise de documentos com visão; integração nativa com Claude Cowork; regulação exige comportamento de recusa previsível (Fable notifica e fallback para Opus 4.8 em 95%+ das sessões sem trigger).

Use Sol quando: trabalho agentivo em terminal e Codex; alta volumetria de API onde custo importa; Agents Last Exam-style de múltiplos campos profissionais; integração com ChatGPT Work e GitHub Copilot. O GPT-5.6 Terra e Luna entram para volume ainda mais barato quando Sol não é necessário.

O veredicto honesto

A única resposta correta é: depende do workflow. Em coding SWE-style, Fable 5 lidera. Em benchmarks agentivos de terminal e custo por tarefa, Sol lidera. No índice composto, empate. Quem compra pelo benchmark está comprando o benchmark — não a performance no seu caso de uso real.