1. Los cuatro niveles de Anthropic: potencia y coste
Anthropic organiza sus modelos bajo una premisa clara: no todas las tareas necesitan el modelo más potente. Enrutar cada consulta al modelo adecuado reduce la factura de API sin sacrificar calidad en las tareas que de verdad la exigen.
Velocidad máxima
El modelo más rápido y económico. Diseñado para tareas de alto volumen y baja latencia: clasificación, extracción y enrutado.
Entrada: desde 0,10 $ / 1M tokens (prompts ≤100k tokens; 0,50 $ por encima)
Salida: desde 0,50 $ / 1M tokens (prompts ≤100k tokens; 2,50 $ por encima)
Contexto: 1M tokens
Equilibrio velocidad-inteligencia
La mejor combinación de velocidad e inteligencia para el trabajo diario de una empresa.
Entrada: 2,00 $ / 1M tokens
Salida: 10,00 $ / 1M tokens
Contexto: 1M tokens
Agentes y trabajo de conocimiento
El punto de partida recomendado por Anthropic para la mayoría de cargas. Pensado para agentes de larga duración, programación y trabajo de conocimiento complejo.
Entrada: 4,00 $ / 1M tokens
Salida: 20,00 $ / 1M tokens
Contexto: 1M tokens
Razonamiento máximo
El modelo más capaz disponible al público. Para razonamiento exigente y trabajo agéntico de largo recorrido, cuando Opus 5.5 no llega.
Entrada: 10,00 $ / 1M tokens
Salida: 50,00 $ / 1M tokens
Contexto: 1M tokens
Todos los modelos admiten texto e imagen, 1M tokens de contexto y hasta 128K tokens de salida. Los modelos 5.x usan un tokenizador nuevo: el mismo texto cuenta aprox. un 30% más de tokens que en generaciones anteriores, tenlo en cuenta al comparar costes. Batch API: 50% de descuento. Precios en USD, octubre 2026.
¿Quieres optimizar el consumo de tokens en tus integraciones?
En Matrits diseñamos routers inteligentes que derivan cada consulta al modelo óptimo (Haiku, Sonnet, Opus o Fable), reduciendo costes en las tareas que no necesitan el modelo más potente.
Consultar con un Ingeniero de Matrits