Claude Opus 5 lidera em qualidade, enquanto GPT-5.6 Terra vence em economia de throughput
Claude Opus 5 lidera o índice de qualidade, mas GPT-5.6 Terra oferece a melhor combinação de throughput e preço para cargas de trabalho em produção.
Claude lidera em qualidade; Terra lidera no modelo operacional
Claude Opus 5 (Anthropic) é o líder em qualidade desta semana. GPT-5.6 Terra (OpenAI) é a opção mais forte para produção quando throughput e custo de inferência são mais importantes do que a qualidade máxima. GPT-5.6 Sol (OpenAI) continua sendo um meio-termo caro: mais rápido que Opus, mas atrás dele em qualidade.
Claude Opus 5 marca 60.7 no índice de qualidade, a US$ 10.00 por 1 milhão de tokens. <!-- fact:claude-opus-5|quality=60.7|price=10.00 -->
| Modelo | Qualidade | Preço | Velocidade |
|---|---|---|---|
| Claude Opus 5 | 60.7 | $10.00/M | 44 tok/s |
| Claude Fable 5 | 59.9 | $20.00/M | 58 tok/s |
| GPT-5.6 Sol | 58.9 | $11.25/M | 74 tok/s |
| GPT-5.6 Terra | 55.0 | $5.63/M | 128 tok/s |
O que mudou no ranking?
Opus 5 tem a melhor pontuação de qualidade do grupo atual, mas seus 44 tokens por segundo criam uma penalidade real de iteração em cargas de trabalho interativas. Ele é adequado para geração de alto valor, análises complexas e tarefas em que uma nova tentativa malsucedida custa mais do que uma latência de inferência adicional.
Fable 5 é a proposta mais fraca da semana. Ele fica atrás de Opus 5 em qualidade e custa o dobro por 1 milhão de tokens. A velocidade superior, de 58 tokens por segundo, não compensa quando a carga de trabalho é sensível a custos ou quando a qualidade é o principal motivo para escolher a Anthropic.
Terra é o ponto fora da curva operacional. Seus 128 tokens por segundo representam a maior taxa listada, e seu preço de $5.63 por 1 milhão de tokens facilita a expansão de inferência em lote, etapas de ranqueamento e pipelines com muitas tentativas. A contrapartida é significativa: sua pontuação de qualidade fica 5.7 pontos abaixo da de Opus 5. <!-- fact:gpt-5-6-terra|quality=55.0|price=5.63|speed=128 -->
A divisão prática
Use Opus 5 quando a qualidade da saída dominar o custo total de uma falha. Use Terra quando o sistema executar muitas chamadas e puder aceitar um teto de qualidade mais baixo. Sol é o meio-termo para equipes que querem mais tokens por segundo do que Opus sem descer tanto na curva de qualidade, mas seu preço de $11.25 por 1 milhão de tokens torna esse compromisso caro. <!-- fact:gpt-5-6-sol|quality=58.9|price=11.25|speed=74 -->
O que observar
- Se a liderança de qualidade do Opus 5 se mantém à medida que novas avaliações chegam.
- Se a vantagem de throughput do Terra se sustenta em cargas de trabalho de produção com saídas longas e novas tentativas.
- Se Fable 5 receberá uma mudança de preço; sua posição atual é difícil de defender.
Para uma lista inicial de opções para produção, comece com GPT-5.6 Terra para escala e Claude Opus 5 para fluxos críticos em qualidade; em seguida, valide essa divisão no LLM Selector.
Fique por dentro
Análises revisadas de LLMs quando uma nova edição estiver pronta. Sem spam.