Clawy / Guías / Qué modelo de Claude
Opus 4.8, Sonnet 4.6 o Haiku 4.5 — una guía práctica de elección por tarea, no un volcado de benchmarks.
La mayoría de los equipos gastan de más al enviar por defecto cada llamada al modelo más grande. Los tres niveles actuales de Claude abarcan un rango de precio de 5×, y la respuesta correcta suele ser "el más barato que resuelva la tarea". Aquí está la comparación y cómo decidir.
| Modelo | Precio (in / out por 1M) | Contexto | Mejor para |
|---|---|---|---|
| Haiku 4.5 | $1 / $5 | 200K | rápido, barato, alto volumen: clasificación, extracción, enrutamiento, chat simple |
| Sonnet 4.6 | $3 / $15 | 1M | el caballo de batalla equilibrado: la mayoría de tareas de producción, programación, resumen, RAG |
| Opus 4.8 | $5 / $25 | 1M | el razonamiento más difícil, agentes de largo horizonte, investigación profunda, depuración complicada |
(Anthropic también ofrece Claude Fable 5 — su modelo más capaz, con precio por encima de Opus — para el trabajo de largo horizonte más exigente. Para la producción diaria, los tres de arriba cubren la gran mayoría de los casos.)
¿Es la tarea simple y de alto volumen (etiquetar esto, extraer aquello, enrutar, clasificar)? → Haiku 4.5. Es 5× más barato que Opus y de sobra inteligente para esto.
¿Es una tarea normal de producción — ayuda con código, resumir, responder sobre documentos recuperados, un chatbot? → Sonnet 4.6. La mejor balance de inteligencia, velocidad y coste.
¿Necesita razonamiento genuino de varios pasos, uso de herramientas agéntico de largo horizonte, o simplemente es difícil y acertar importa más que el coste? → Opus 4.8.
¿No estás seguro? Empieza un nivel por debajo de tu instinto y escala solo si la calidad falla. Acertarás más a menudo de lo que crees — y más barato.
En Sonnet 4.6 y Opus 4.8 puedes ajustar la profundidad de razonamiento con el pensamiento adaptativo y el parámetro effort (low → max). Un modelo más barato con más effort a veces supera a uno más caro con poco effort — y cuesta menos. Haiku no admite el parámetro effort, parte de por qué es el nivel de velocidad/coste y no el de razonamiento.
Como el output se factura 5× más que el input, y los modelos más grandes tienden a usarse con prompts más grandes, la diferencia real de factura entre Haiku y Opus en la misma carga suele ser más de 5×. Si manejas volumen serio, la decisión de selección de modelo eclipsa casi cualquier otra palanca de coste.
→ Mira los números reales. Mete cada modelo en la calculadora de coste / margen gratis con tus tamaños de prompt reales y compara el coste por llamada lado a lado.Regla práctica: Haiku para volumen, Sonnet para la mayoría de cosas, Opus para el 10% difícil. Mide, luego escala de forma deliberada.
→ O deja que decida el enrutamiento. El nivel auto de $0,04 de Clawy elige un modelo optimizado en coste por llamada sobre x402 — USDC por petición, sin claves API. Inicio rápido de 5 minutos → → Consigue el Kit de precios de API de IA (19 €). Compara costes de modelos en un modelo de Excel real, más códigomargin-guard listo y una calculadora offline — para que el modelo que elijas nunca cueste más de lo que cobras.