Respuesta corta
Para la mayoría del trabajo con la API, la opción razonable por defecto es Claude Sonnet 5.5: a 2026-10-10 cuesta $0.77 / $3.82 por millón de tokens de entrada / salida en APIVAI, frente a $2.00 / $10.00 en la tarifa oficial de Anthropic. Sube a Claude Opus 5.5 ($1.54 / $7.65) para programación agéntica de larga duración y razonamiento difícil, y baja a Claude Haiku 4.5 ($0.38 / $1.92) para clasificación, extracción y enrutamiento a gran volumen; Claude Fable 5.1 es el nivel de Claude más capaz y más caro, y solo compensa cuando Opus no alcanza. Del lado de OpenAI, GPT-6.1 Sol ($0.30 / $1.52) es la opción de precio medio y GPT-6 Luna ($0.0144 / $0.0768) el modelo más barato de la lista. Una sola clave de APIVAI sirve para todos, así que puedes elegir el modelo según la tarea en lugar de casarte con uno.
¿Qué diferencia hay entre Haiku, Sonnet, Opus y Fable?
Anthropic ofrece Claude en cuatro niveles. Las descripciones siguen la visión general de modelos de Anthropic y su guía para elegir modelo:
- Haiku: pensado para tareas de gran volumen y sensibles a la latencia, como clasificación, extracción y enrutamiento. Es el nivel más rápido y barato, y también funciona bien como subagente que resuelve pasos repetitivos para un modelo mayor.
- Sonnet: según Anthropic, la mejor combinación de velocidad e inteligencia. Cubre la generación de código diaria, el análisis de datos, la creación de contenido y el uso de herramientas en agentes.
- Opus: pensado para programación agéntica de larga duración y trabajo intelectual, como agentes de código que trabajan durante horas y refactorizaciones grandes. Es más lento que Sonnet. Si no estás seguro, la documentación de Anthropic sugiere empezar con Claude Opus 5.5.
- Fable: para razonamiento exigente y trabajo agéntico de largo horizonte, como sesiones de agente de varias horas e investigación en varios pasos. Es el nivel más lento y más caro.
Claude Sonnet 5.5, Claude Opus 5.5 y Claude Fable 5.1 tienen una ventana de contexto de 1M tokens y hasta 128K tokens de salida; Claude Haiku 4.5 tiene una ventana de 200K. En APIVAI el razonamiento está activado por defecto y los tokens de razonamiento se facturan como salida, así que una respuesta visible corta puede consumir bastante salida. Si las respuestas llegan vacías o cortadas, sube max_tokens a 4096 o más.
¿Cómo se comparan los modelos GPT?
La página de modelos actual de OpenAI muestra tres niveles: Astra («nuestro modelo más capaz para el trabajo más exigente»), Sol (GPT-6.1 Sol, «rendimiento cercano a Astra para trabajo complejo a menor costo») y Luna (GPT-6 Luna, «nuestro modelo más eficiente para tareas concretas de gran volumen»). Por precio oficial, Astra está junto a Fable, Sol junto a Sonnet y Luna por debajo de Haiku.
APIVAI también ofrece versiones anteriores de GPT: GPT-6 Sol, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna y GPT-5.5. La página de modelos actual de OpenAI no las describe, así que esta guía las compara solo por precio y contexto. Una diferencia práctica: en APIVAI los modelos Claude funcionan tanto en formato Anthropic como en formato OpenAI, mientras que los modelos GPT usan el formato OpenAI (/v1/chat/completions o /v1/responses).
¿Cuánto cuesta cada modelo por millón de tokens?
Precios por millón de tokens a 2026-10-10. La página de precios muestra todos los modelos y la lista de modelos tiene una página para cada uno.
| Modelo | APIVAI entrada / salida | Oficial entrada / salida | APIVAI lectura de caché | Contexto |
|---|---|---|---|---|
| Claude Fable 5.1 | $4.42 / $22.08 | $10.00 / $50.00 | $0.11 | 1M |
| Claude Opus 5.5 | $1.54 / $7.65 | $4.00 / $20.00 | $0.0768 | 1M |
| Claude Sonnet 5.5 | $0.77 / $3.82 | $2.00 / $10.00 | $0.0384 | 1M |
| Claude Sonnet 4.6 | $1.15 / $5.74 | $3.00 / $15.00 | $0.12 | 1M |
| Claude Haiku 4.5 | $0.38 / $1.92 | $1.00 / $5.00 | $0.0384 | 200K |
| GPT-6 Astra | $1.52 / $7.60 | $10.00 / $50.00 | $0.15 | 1M |
| GPT-6.1 Sol | $0.30 / $1.52 | $2.00 / $10.00 | $0.0144 | 1M |
| GPT-6 Sol | $0.30 / $1.52 | $2.00 / $10.00 | $0.0304 | 1M |
| GPT-5.5 | $0.77 / $4.56 | $5.00 / $30.00 | $0.0768 | 1M |
| GPT-6 Luna | $0.0144 / $0.0768 | $0.10 / $0.50 | $0.0016 | 1M |
En todos los modelos la salida cuesta varias veces más que la entrada, así que las respuestas largas y el razonamiento extenso pesan más en la factura que los prompts largos. Leer de la caché cuesta una pequeña fracción de la entrada normal; por eso la caché importa tanto en los agentes (ejemplo 1 más abajo). La comparación de precios de la API de Claude recoge todas las versiones de Claude, incluidos los precios de escritura en caché.
¿Por qué varios modelos Opus cuestan lo mismo?
Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7 y Claude Opus 4.6 comparten precio: $1.92 / $9.57 en APIVAI ($5.00 / $25.00 oficial). El Opus más nuevo, Claude Opus 5.5, es incluso más barato: $1.54 / $7.65. Con Sonnet ocurre lo mismo: Claude Sonnet 5.5 cuesta menos que Claude Sonnet 4.6, y Claude Sonnet 5 tiene el mismo precio de entrada y salida que Sonnet 5.5 pero una lectura de caché más cara. Claude Fable 5 y Claude Fable 5.1 comparten precio de entrada y salida, y 5.1 tiene la lectura de caché más barata.
A igual o menor precio, el modelo más nuevo suele ser la mejor opción. Quédate con una versión antigua solo si tus prompts están ajustados para ella y tus propias pruebas muestran que rinde mejor, o si una herramienta fija un ID concreto. Anthropic enumera algunos cambios incompatibles en Opus 5.5 (por ejemplo, forzar el uso de herramientas y desactivar el razonamiento), así que prueba antes de cambiar una integración en producción. Cada modelo anterior tiene su página: Opus 5, Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5, Fable 5.
¿Cuánto cuesta una sesión de agente de código con caché?
Supuestos: una sesión de dos horas en un agente de código como Claude Code o Cline hace 40 solicitudes. Cada solicitud reenvía unos 25.000 tokens de contexto (prompt de sistema, definiciones de herramientas, archivos abiertos, turnos anteriores) que se leen de la caché, así que la sesión lee 1.000.000 de tokens en caché. Además envía 60.000 tokens de entrada nuevos (archivos nuevos, resultados de herramientas) y recibe 30.000 tokens de salida, razonamiento incluido.
| Modelo | Lecturas de caché (1M tokens) | Entrada nueva + salida | Misma sesión sin caché (APIVAI) | Sin caché (oficial) |
|---|---|---|---|---|
| Claude Sonnet 5.5 | $0.0384 | $0.161 | $0.931 | $2.42 |
| Claude Sonnet 4.6 | $0.12 | $0.241 | $1.39 | $3.63 |
| Claude Opus 5.5 | $0.0768 | $0.322 | $1.86 | $4.84 |
| Claude Fable 5.1 | $0.11 | $0.928 | $5.35 | $12.10 |
| GPT-6.1 Sol | $0.0144 | $0.0636 | $0.364 | $2.42 |
Con caché, la sesión cuesta la suma de las dos primeras columnas de precios. La tercera y la cuarta muestran lo que costarían los mismos tokens sin caché. En Claude, escribir en caché cuesta algo más que la entrada normal ($0.96 frente a $0.77 por millón en Sonnet 5.5), así que el total real es un poco mayor que la suma. La caché solo funciona cuando la herramienta reenvía un prefijo idéntico; la mayoría de los agentes de código lo hacen. Para convertir el precio de una sesión en un presupuesto mensual y compararlo con editores por suscripción, consulta Claude Code vs Cursor: comparación de costos.
¿Cuánto cuesta un chatbot con 1.000 conversaciones al día?
Supuestos: un bot de soporte atiende 1.000 conversaciones al día, 30 días al mes. Una conversación promedia 2.500 tokens de entrada (instrucciones, algunos fragmentos de la base de conocimiento, el historial) y 350 tokens de salida con el razonamiento incluido.
| Modelo | Por día (APIVAI) | Por mes (APIVAI) | Por mes (oficial) |
|---|---|---|---|
| GPT-6 Luna | $0.0629 | $1.89 | $12.75 |
| Claude Haiku 4.5 | $1.62 | $48.66 | $128 |
| GPT-6.1 Sol | $1.28 | $38.46 | $255 |
| Claude Sonnet 5.5 | $3.26 | $97.86 | $255 |
Para preguntas rutinarias suele bastar un modelo de la clase Haiku o Luna, y muchos equipos envían a Sonnet solo los casos difíciles. Guardar en caché las instrucciones fijas reduce aún más estas cifras.
¿Cuánto cuesta resumir 2.000 documentos?
Supuestos: un trabajo puntual convierte 2.000 informes de unos 15.000 tokens cada uno en resúmenes de 800 tokens. Aquí domina la entrada, así que lo que más importa es el precio de entrada.
| Modelo | Total (APIVAI) | Total (oficial) |
|---|---|---|
| GPT-6 Luna | $0.555 | $3.80 |
| Claude Haiku 4.5 | $14.47 | $38.00 |
| GPT-6.1 Sol | $11.43 | $76.00 |
| Claude Sonnet 5.5 | $29.21 | $76.00 |
| Claude Opus 5.5 | $58.44 | $152 |
Antes de lanzar el lote completo, prueba una muestra de 20 documentos con dos o tres modelos y compara los resúmenes: el modelo correcto es el más barato que supere tu revisión. APIVAI procesa estos trabajos como solicitudes normales y no ofrece Batch API. La propia Batch API de Anthropic se factura por debajo de sus tarifas estándar para trabajos que pueden esperar, así que en trabajos offline muy grandes compara también ese precio.
¿Qué modelo usar para cada tarea?
| Tarea | Empieza con | Subir o bajar |
|---|---|---|
| Programación diaria en un agente o IDE | Claude Sonnet 5.5 | Claude Opus 5.5 para refactorizaciones grandes y ejecuciones autónomas largas |
| Razonamiento más difícil, agentes que trabajan horas | Claude Opus 5.5 | Claude Fable 5.1 o GPT-6 Astra cuando Opus no alcanza |
| Redacción y contenido | Claude Sonnet 5.5 o GPT-6.1 Sol | Claude Opus 5.5 para piezas largas y estructuradas |
Un buen hábito es probar tus propios prompts en dos niveles vecinos. Si el más barato aprueba, quédate con él; si necesita muchos reintentos, el modelo más fuerte suele salir más barato en total. Toma los ID de modelo de GET /v1/models o de la página de precios en lugar de copiar nombres antiguos, porque la lista cambia con el tiempo.
Preguntas frecuentes
¿Opus es mejor que Sonnet para programar?
Para ejecuciones autónomas largas, refactorizaciones grandes y depuración difícil, Opus es el nivel más fuerte. Para cambios cotidianos y tareas cortas de agente suele bastar Sonnet, a $0.77 / $3.82 frente a $1.54 / $7.65 de Opus, por eso muchos desarrolladores usan Sonnet por defecto y cambian a Opus según la tarea.
¿Cuándo basta Haiku en lugar de Sonnet?
Haiku está pensado para tareas simples de gran volumen: clasificación, extracción, enrutamiento, respuestas cortas de soporte y pasos de subagentes. Si necesitas razonamiento en varios pasos o código cuidadoso, prueba Sonnet.
¿Es más barato Claude o GPT a través de la API?
Depende del nivel. A 2026-10-10 en APIVAI, GPT-6 Luna cuesta $0.0144 / $0.0768 frente a $0.38 / $1.92 de Claude Haiku 4.5, y GPT-6.1 Sol cuesta $0.30 / $1.52 frente a $0.77 / $3.82 de Claude Sonnet 5.5. Compara la calidad con tus propios prompts, no solo el precio.
¿Los tokens de razonamiento cuestan aparte?
Se facturan como tokens de salida al precio de salida normal del modelo. En APIVAI el razonamiento está activado por defecto, así que presupuesta algo de salida además de la respuesta visible.
¿Puedo usar varios modelos con una sola clave?
Sí. Una clave de APIVAI sirve para todos los modelos Claude y GPT; solo cambias el ID del modelo en cada solicitud.
Crea una cuenta, recarga desde $10 y prueba cada modelo con una sola clave.