Clawy / Guias / Qual modelo Claude
Opus 4.8, Sonnet 4.6 ou Haiku 4.5 — um guia prático de escolha por tarefa, não um despejo de benchmarks.
A maioria das equipes gasta demais ao mandar por padrão cada chamada ao maior modelo. Os três níveis atuais da Claude abrangem uma faixa de preço de 5×, e a resposta certa costuma ser "o mais barato que dá conta da tarefa". Eis a comparação e como decidir.
| Modelo | Preço (in / out por 1M) | Contexto | Melhor para |
|---|---|---|---|
| Haiku 4.5 | $1 / $5 | 200K | rápido, barato, alto volume: classificação, extração, roteamento, chat simples |
| Sonnet 4.6 | $3 / $15 | 1M | o cavalo de batalha equilibrado: a maioria das tarefas de produção, programação, sumarização, RAG |
| Opus 4.8 | $5 / $25 | 1M | o raciocínio mais difícil, agentes de longo horizonte, pesquisa profunda, depuração complicada |
(A Anthropic também oferece Claude Fable 5 — seu modelo mais capaz, com preço acima do Opus — para o trabalho de longo horizonte mais exigente. Para a produção do dia a dia, os três acima cobrem a grande maioria dos casos.)
A tarefa é simples e de alto volume (rotular isto, extrair aquilo, rotear, classificar)? → Haiku 4.5. É 5× mais barato que o Opus e esperto o bastante para isso.
É uma tarefa de produção normal — ajuda com código, resumir, responder sobre docs recuperados, um chatbot? → Sonnet 4.6. O melhor equilíbrio de inteligência, velocidade e custo.
Precisa de raciocínio genuíno de vários passos, uso de ferramentas agêntico de longo horizonte, ou é simplesmente difícil e acertar importa mais que o custo? → Opus 4.8.
Na dúvida? Comece um nível abaixo do seu instinto e só escale se a qualidade falhar. Você vai acertar mais do que espera — e mais barato.
No Sonnet 4.6 e no Opus 4.8 você pode ajustar a profundidade de raciocínio com o pensamento adaptativo e o parâmetro effort (low → max). Um modelo mais barato com effort maior às vezes supera um mais caro com effort baixo — e custa menos. O Haiku não suporta o parâmetro effort, parte do motivo de ser o nível de velocidade/custo e não o de raciocínio.
Como o output é cobrado 5× mais que o input, e modelos maiores tendem a ser usados em prompts maiores, a diferença real de conta entre Haiku e Opus na mesma carga costuma ser mais de 5×. Em volume sério, a decisão de seleção de modelo ofusca quase todas as outras alavancas de custo.
→ Veja os números reais. Coloque cada modelo na calculadora de custo / margem grátis com seus tamanhos de prompt reais e compare o custo por chamada lado a lado.Regra prática: Haiku para volume, Sonnet para a maioria das coisas, Opus para os 10% difíceis. Meça, depois escale deliberadamente.
→ Ou deixe o roteamento decidir. O nível auto de $0,04 da Clawy escolhe um modelo otimizado em custo por chamada via x402 — USDC por requisição, sem chaves de API. Início rápido de 5 minutos → → Garanta o Kit de preços de API de IA (19 €). Compare custos de modelos num modelo Excel real, mais códigomargin-guard pronto e uma calculadora offline — para que o modelo que você escolher nunca custe mais do que você cobra.