Resposta curta
Para a maior parte do trabalho com a API, a escolha padrão sensata é o Claude Sonnet 5.5: em 2026-10-10 ele custa $0.77 / $3.82 por milhão de tokens de entrada / saída na APIVAI, contra $2.00 / $10.00 no preço oficial da Anthropic. Suba para o Claude Opus 5.5 ($1.54 / $7.65) para programação agêntica de longa duração e raciocínio difícil, e desça para o Claude Haiku 4.5 ($0.38 / $1.92) para classificação, extração e roteamento em grande volume; o Claude Fable 5.1 é o nível mais capaz e mais caro do Claude e só compensa quando o Opus não dá conta. Do lado da OpenAI, o GPT-6.1 Sol ($0.30 / $1.52) é a opção de preço intermediário e o GPT-6 Luna ($0.0144 / $0.0768) é o modelo mais barato da lista. Uma única chave da APIVAI funciona com todos eles, então você pode escolher o modelo por tarefa em vez de se prender a um só.
Qual é a diferença entre Haiku, Sonnet, Opus e Fable?
A Anthropic oferece o Claude em quatro níveis. As descrições abaixo seguem a visão geral de modelos da Anthropic e o guia dela para escolher um modelo:
- Haiku: feito para tarefas de alto volume e sensíveis à latência, como classificação, extração e roteamento. É o nível mais rápido e barato e também funciona bem como subagente que executa etapas repetitivas para um modelo maior.
- Sonnet: segundo a Anthropic, a melhor combinação de velocidade e inteligência. Cobre geração de código no dia a dia, análise de dados, criação de conteúdo e uso de ferramentas por agentes.
- Opus: feito para programação agêntica de longa duração e trabalho intelectual, como agentes de código que rodam por horas e grandes refatorações. É mais lento que o Sonnet. Na dúvida, a documentação da Anthropic sugere começar pelo Claude Opus 5.5.
- Fable: para raciocínio exigente e trabalho agêntico de longo horizonte, como sessões de agente de várias horas e pesquisas em várias etapas. É o nível mais lento e mais caro.
Claude Sonnet 5.5, Claude Opus 5.5 e Claude Fable 5.1 têm janela de contexto de 1M tokens e até 128K tokens de saída; o Claude Haiku 4.5 tem janela de 200K. Na APIVAI o raciocínio vem ativado por padrão e os tokens de raciocínio são cobrados como saída, então uma resposta visível curta ainda pode consumir bastante saída. Se as respostas vierem vazias ou cortadas, aumente max_tokens para 4096 ou mais.
Como os modelos GPT se comparam?
A página de modelos atual da OpenAI lista três níveis: Astra ("nosso modelo mais capaz para o trabalho mais exigente"), Sol (GPT-6.1 Sol, "desempenho próximo ao do Astra para trabalho complexo a um custo menor") e Luna (GPT-6 Luna, "nosso modelo mais eficiente para tarefas focadas e de alto volume"). Pelo preço oficial, o Astra fica ao lado do Fable, o Sol ao lado do Sonnet e o Luna abaixo do Haiku.
A APIVAI também oferece versões anteriores do GPT: GPT-6 Sol, GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna e GPT-5.5. A página de modelos atual da OpenAI não as descreve, por isso este guia as compara apenas por preço e contexto. Uma diferença prática: na APIVAI os modelos Claude funcionam tanto no formato Anthropic quanto no formato OpenAI, enquanto os modelos GPT usam o formato OpenAI (/v1/chat/completions ou /v1/responses).
Quanto custa cada modelo por milhão de tokens?
Preços por milhão de tokens em 2026-10-10. A página de preços mostra todos os modelos e a lista de modelos tem uma página para cada um.
| Modelo | APIVAI entrada / saída | Oficial entrada / saída | APIVAI leitura de cache | Contexto |
|---|---|---|---|---|
| Claude Fable 5.1 | $4.42 / $22.08 | $10.00 / $50.00 | $0.11 | 1M |
| Claude Opus 5.5 | $1.54 / $7.65 | $4.00 / $20.00 | $0.0768 | 1M |
| Claude Sonnet 5.5 | $0.77 / $3.82 | $2.00 / $10.00 | $0.0384 | 1M |
| Claude Sonnet 4.6 | $1.15 / $5.74 | $3.00 / $15.00 | $0.12 | 1M |
| Claude Haiku 4.5 | $0.38 / $1.92 | $1.00 / $5.00 | $0.0384 | 200K |
| GPT-6 Astra | $1.52 / $7.60 | $10.00 / $50.00 | $0.15 | 1M |
| GPT-6.1 Sol | $0.30 / $1.52 | $2.00 / $10.00 | $0.0144 | 1M |
| GPT-6 Sol | $0.30 / $1.52 | $2.00 / $10.00 | $0.0304 | 1M |
| GPT-5.5 | $0.77 / $4.56 | $5.00 / $30.00 | $0.0768 | 1M |
| GPT-6 Luna | $0.0144 / $0.0768 | $0.10 / $0.50 | $0.0016 | 1M |
Em todos os modelos a saída custa várias vezes mais que a entrada, então respostas longas e raciocínio extenso pesam mais na conta do que prompts longos. A leitura de cache custa uma pequena fração da entrada normal, e é por isso que o cache importa tanto para agentes (exemplo 1 abaixo). A comparação de preços da API do Claude lista todas as versões do Claude, incluindo os preços de escrita em cache.
Por que vários modelos Opus custam o mesmo?
Claude Opus 5, Claude Opus 4.8, Claude Opus 4.7 e Claude Opus 4.6 têm o mesmo preço: $1.92 / $9.57 na APIVAI ($5.00 / $25.00 oficial). O Opus mais novo, Claude Opus 5.5, é até mais barato: $1.54 / $7.65. O mesmo vale para o Sonnet: o Claude Sonnet 5.5 custa menos que o Claude Sonnet 4.6, e o Claude Sonnet 5 tem o mesmo preço de entrada e saída do Sonnet 5.5, mas leitura de cache mais cara. Claude Fable 5 e Claude Fable 5.1 têm o mesmo preço de entrada e saída, e o 5.1 tem a leitura de cache mais barata.
Com preço igual ou menor, o modelo mais novo costuma ser a melhor escolha. Mantenha uma versão antiga só se os seus prompts foram ajustados para ela e os seus próprios testes mostram que ela se sai melhor, ou se alguma ferramenta fixa um ID específico. A Anthropic lista algumas mudanças incompatíveis no Opus 5.5 (por exemplo, uso forçado de ferramentas e desativar o raciocínio), então teste antes de trocar uma integração em produção. Cada modelo antigo tem a sua página: Opus 5, Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 5, Fable 5.
Quanto custa uma sessão de agente de código com cache?
Premissas: uma sessão de duas horas em um agente de código como Claude Code ou Cline faz 40 requisições. Cada requisição reenvia cerca de 25.000 tokens de contexto (prompt de sistema, definições de ferramentas, arquivos abertos, turnos anteriores) lidos do cache, então a sessão lê 1.000.000 de tokens em cache. Além disso, envia 60.000 tokens de entrada novos (arquivos novos, resultados de ferramentas) e recebe 30.000 tokens de saída, raciocínio incluído.
| Modelo | Leituras de cache (1M tokens) | Entrada nova + saída | Mesma sessão sem cache (APIVAI) | Sem cache (oficial) |
|---|---|---|---|---|
| Claude Sonnet 5.5 | $0.0384 | $0.161 | $0.931 | $2.42 |
| Claude Sonnet 4.6 | $0.12 | $0.241 | $1.39 | $3.63 |
| Claude Opus 5.5 | $0.0768 | $0.322 | $1.86 | $4.84 |
| Claude Fable 5.1 | $0.11 | $0.928 | $5.35 | $12.10 |
| GPT-6.1 Sol | $0.0144 | $0.0636 | $0.364 | $2.42 |
Com cache, a sessão custa a soma das duas primeiras colunas de preço. A terceira e a quarta mostram quanto custariam os mesmos tokens sem nenhum cache. No Claude, a escrita em cache custa um pouco mais que a entrada normal ($0.96 contra $0.77 por milhão no Sonnet 5.5), então o total real fica um pouco acima da soma. O cache só funciona quando a ferramenta reenvia um prefixo idêntico; a maioria dos agentes de código faz isso. Para transformar o preço de uma sessão em orçamento mensal e comparar com editores por assinatura, veja Claude Code vs Cursor: comparação de custos.
Quanto custa um chatbot com 1.000 conversas por dia?
Premissas: um bot de suporte atende 1.000 conversas por dia, 30 dias por mês. Uma conversa tem em média 2.500 tokens de entrada (instruções, alguns trechos da base de conhecimento, o histórico) e 350 tokens de saída, raciocínio incluído.
| Modelo | Por dia (APIVAI) | Por mês (APIVAI) | Por mês (oficial) |
|---|---|---|---|
| GPT-6 Luna | $0.0629 | $1.89 | $12.75 |
| Claude Haiku 4.5 | $1.62 | $48.66 | $128 |
| GPT-6.1 Sol | $1.28 | $38.46 | $255 |
| Claude Sonnet 5.5 | $3.26 | $97.86 | $255 |
Para perguntas de rotina, um modelo da classe Haiku ou Luna costuma bastar, e muitas equipes mandam para o Sonnet só os casos difíceis. Colocar as instruções fixas em cache reduz ainda mais esses valores.
Quanto custa resumir 2.000 documentos?
Premissas: um trabalho pontual transforma 2.000 relatórios de cerca de 15.000 tokens cada em resumos de 800 tokens. Aqui a entrada domina, então o preço de entrada é o que mais importa.
| Modelo | Total (APIVAI) | Total (oficial) |
|---|---|---|
| GPT-6 Luna | $0.555 | $3.80 |
| Claude Haiku 4.5 | $14.47 | $38.00 |
| GPT-6.1 Sol | $11.43 | $76.00 |
| Claude Sonnet 5.5 | $29.21 | $76.00 |
| Claude Opus 5.5 | $58.44 | $152 |
Antes de rodar o lote inteiro, teste uma amostra de 20 documentos em dois ou três modelos e compare os resumos: o modelo certo é o mais barato que passar na sua verificação. A APIVAI processa esses trabalhos como requisições normais e não oferece Batch API. A Batch API da própria Anthropic é cobrada abaixo das tarifas padrão para trabalhos que podem esperar, então, em trabalhos offline muito grandes, compare esse preço também.
Qual modelo usar para cada tarefa?
| Tarefa | Comece com | Subir ou descer |
|---|---|---|
| Programação do dia a dia em agente ou IDE | Claude Sonnet 5.5 | Claude Opus 5.5 para grandes refatorações e execuções autônomas longas |
| Raciocínio mais difícil, agentes rodando por horas | Claude Opus 5.5 | Claude Fable 5.1 ou GPT-6 Astra quando o Opus não dá conta |
| Redação e conteúdo | Claude Sonnet 5.5 ou GPT-6.1 Sol | Claude Opus 5.5 para textos longos e estruturados |
Um bom hábito é testar os seus próprios prompts em dois níveis vizinhos. Se o mais barato passar, fique com ele; se ele precisar de muitas novas tentativas, o modelo mais forte muitas vezes sai mais barato no total. Pegue os IDs de modelo em GET /v1/models ou na página de preços em vez de copiar nomes antigos, porque a lista muda com o tempo.
Perguntas frequentes
O Opus é melhor que o Sonnet para programar?
Para execuções autônomas longas, grandes refatorações e depuração difícil, o Opus é o nível mais forte. Para edições do dia a dia e tarefas curtas de agente, o Sonnet costuma bastar, a $0.77 / $3.82 contra $1.54 / $7.65 do Opus, por isso muitos desenvolvedores usam o Sonnet por padrão e mudam para o Opus conforme a tarefa.
Quando o Haiku basta em vez do Sonnet?
O Haiku foi feito para tarefas simples de alto volume: classificação, extração, roteamento, respostas curtas de suporte e etapas de subagentes. Se você precisa de raciocínio em várias etapas ou de código cuidadoso, teste o Sonnet.
Claude ou GPT: qual é mais barato pela API?
Depende do nível. Em 2026-10-10 na APIVAI, o GPT-6 Luna custa $0.0144 / $0.0768 contra $0.38 / $1.92 do Claude Haiku 4.5, e o GPT-6.1 Sol custa $0.30 / $1.52 contra $0.77 / $3.82 do Claude Sonnet 5.5. Compare a qualidade com os seus próprios prompts, não só o preço.
Os tokens de raciocínio custam à parte?
Eles são cobrados como tokens de saída, pelo preço de saída normal do modelo. Na APIVAI o raciocínio vem ativado por padrão, então reserve no orçamento alguma saída além da resposta visível.
Posso usar vários modelos com uma só chave?
Sim. Uma chave da APIVAI funciona com todos os modelos Claude e GPT; você só troca o ID do modelo em cada requisição.
Crie uma conta, recarregue a partir de $10 e teste cada modelo com uma só chave.