Resposta curta
Para usar o Continue com a APIVAI, abra o config.yaml do Continue (~/.continue/config.yaml, ou %USERPROFILE%\.continue\config.yaml no Windows) e adicione um modelo com provider: openai, apiBase: https://api.apivai.com/v1 e a sua chave da APIVAI em apiKey. Em model, coloque um ID de modelo da APIVAI, como claude-sonnet-4-6 ou gpt-5.5; a mesma chave e a mesma base URL servem para Claude e GPT. Para o Claude, você também pode usar provider: anthropic com o mesmo apiBase, incluindo /v1, porque o Continue acrescenta só messages a ele. Em 2026-10-07, o Claude Sonnet 4.6 custa $1.04 / $5.22 por milhão de tokens de entrada / saída pela APIVAI, contra $3.00 / $15.00 no preço oficial.
O que é o Continue?
O Continue é um assistente de programação com IA open source para o VS Code e as IDEs da JetBrains. Ele adiciona um painel de chat, edições direto no código, um modo agente que lê e altera arquivos e autocompletar com Tab. O Continue é configurado por um arquivo YAML, o config.yaml; o formato antigo config.json está descontinuado. Qualquer modelo pode apontar para o seu próprio endpoint, e é assim que você o conecta à APIVAI e paga por token a partir de um saldo pré-pago em vez de uma assinatura.
Qual provider usar no Continue?
provider | apiBase | Modelos | Quando usar |
|---|---|---|---|
openai (recomendado) | https://api.apivai.com/v1 | Claude e GPT | Uma configuração para todos os modelos |
anthropic | https://api.apivai.com/v1 | Só Claude | Formato nativo do Claude e cache de prompts |
A regra do /v1 no Continue é diferente da de outras ferramentas. O Continue junta o apiBase com o nome do endpoint: chat/completions ou responses no provider openai, e messages no provider anthropic. O padrão do próprio Continue para o provider Anthropic é https://api.anthropic.com/v1/. Por isso, no Continue os dois providers precisam de um apiBase terminado em /v1. Já no Claude Code ou na opção Anthropic do Cline, você digita https://api.apivai.com sem /v1. Os detalhes dos dois formatos estão nas páginas API compatível com OpenAI e proxy da API do Claude.
Para modelos GPT, o provider openai do Continue envia os nomes de GPT-5 em diante para a Responses API (/v1/responses), que a APIVAI suporta. Se mesmo assim um modelo GPT falhar, adicione useResponsesApi: false à entrada dele e o Continue passa a usar /v1/chat/completions.
Como configurar o Continue com a APIVAI passo a passo?
Passo 1: obtenha uma chave da APIVAI
- Cadastre-se em apivai.com
- Recarregue o saldo a partir de $10 com cartão, cripto, Alipay ou WeChat Pay
- Crie uma chave no Dashboard (você pode dar a ela um limite de orçamento próprio) e copie
Passo 2: instale o Continue
Instale a extensão Continue pelo marketplace do VS Code, ou o plugin Continue pelo marketplace da JetBrains. Os dois usam o mesmo config.yaml.
Passo 3: abra o config.yaml
No painel do Continue, abra o menu suspenso de configurações no canto superior direito do campo de chat e clique no ícone de engrenagem ao lado de Local Config. O config.yaml local será aberto. Você também pode abrir o arquivo diretamente: ~/.continue/config.yaml no macOS e Linux, %USERPROFILE%\.continue\config.yaml no Windows.
Passo 4: adicione os modelos da APIVAI
Cole o trecho abaixo, trocando your-apivai-key pela sua chave. Se o arquivo já tiver name, version e schema no início, mantenha-os e adicione só as entradas em models.
name: My Config
version: 0.0.1
schema: v1
models:
- name: Claude Sonnet 4.6 (APIVAI)
provider: openai
model: claude-sonnet-4-6
apiBase: https://api.apivai.com/v1
apiKey: your-apivai-key
roles:
- chat
- edit
- apply
defaultCompletionOptions:
maxTokens: 8192
- name: GPT-5.5 (APIVAI)
provider: openai
model: gpt-5.5
apiBase: https://api.apivai.com/v1
apiKey: your-apivai-key
roles:
- chat
- edit
defaultCompletionOptions:
maxTokens: 8192
- name: Claude Haiku 4.5 (APIVAI)
provider: openai
model: claude-haiku-4-5
apiBase: https://api.apivai.com/v1
apiKey: your-apivai-key
roles:
- chat
- apply
- summarizename é só o rótulo que aparece no Continue; model deve ser o ID exato da APIVAI. maxTokens deixa espaço para os tokens de raciocínio (thinking), ativados por padrão.
Passo 5: salve e escolha o modelo
Salve o arquivo; o Continue recarrega a configuração. Escolha um dos novos modelos no menu suspenso de modelos do painel de chat e envie uma mensagem curta de teste. Se vier resposta, a configuração funciona. Se não, veja a seção de solução de problemas abaixo.
Opcional: o provider Anthropic para o Claude
- name: Claude Sonnet 4.6 (APIVAI, Anthropic)
provider: anthropic
model: claude-sonnet-4-6
apiBase: https://api.apivai.com/v1
apiKey: your-apivai-key
roles:
- chat
- edit
- apply
defaultCompletionOptions:
maxTokens: 8192
promptCaching: truepromptCaching: true permite que o Claude guarde em cache a mensagem de sistema e o histórico da conversa, e o contexto repetido é cobrado pelo preço mais barato de leitura de cache.
Resumo das configurações
| Campo | Valor |
|---|---|
provider | openai (Claude e GPT) ou anthropic (Claude) |
apiBase | https://api.apivai.com/v1 nos dois providers |
apiKey | sua chave da APIVAI |
model | um ID de GET /v1/models, ex.: claude-sonnet-4-6 |
roles | chat, edit, apply (não embed nem autocomplete) |
defaultCompletionOptions.maxTokens | 8192 |
Modo agente, autocompletar e embeddings
Se o Continue disser que um modelo não pode ser usado no modo agente porque não suporta ferramentas, adicione capabilities com - tool_use à entrada desse modelo; a chamada de ferramentas funciona pela APIVAI.
A APIVAI não oferece embeddings, então não dê o papel embed aos modelos da APIVAI. Recursos que precisam de um modelo de embeddings exigem um provedor de embeddings separado; chat, edições, apply e modo agente continuam passando pela APIVAI. O autocompletar com Tab funciona melhor com um modelo pequeno e rápido do tipo fill-in-the-middle, algo para o qual os modelos de chat Claude e GPT não foram feitos, por isso este guia deixa o papel autocomplete para outro modelo de sua escolha.
Qual modelo escolher no Continue?
Preços por 1M de tokens de entrada / saída em 2026-10-07. A lista de modelos muda com o tempo, então pegue os IDs em GET https://api.apivai.com/v1/models ou na página de preços em vez de copiar nomes antigos.
| Modelo | Valor de model | Entrada | Saída | Melhor para |
|---|---|---|---|---|
| Claude Sonnet 4.6 | claude-sonnet-4-6 | $1.04 | $5.22 | Chat diário e trabalho do agente |
| Claude Sonnet 5.5 | claude-sonnet-5-5 | $0.69 | $3.47 | Código do dia a dia, Sonnet mais novo |
| Claude Opus 5.5 | claude-opus-5-5 | $1.39 | $6.96 | Bugs difíceis, grandes refatorações |
| Claude Haiku 4.5 | claude-haiku-4-5 | $0.35 | $1.74 | Apply, resumos, perguntas rápidas |
| GPT-6 Sol | gpt-6-sol | $0.30 | $1.52 | Opção GPT forte |
| GPT-6 Luna | gpt-6-luna | $0.0144 | $0.0768 | Tarefas muito baratas |
Uma configuração prática: Claude Sonnet 4.6 para o chat e o modo agente, Claude Haiku 4.5 para os papéis apply e summarize, e Claude Opus 5.5 como entrada extra para trocar nos problemas difíceis. Adicione GPT-5.5 ou GPT-6 Sol quando quiser uma segunda opinião de outra família de modelos.
Quanto custa o Continue com a APIVAI?
Premissas: um turno de chat envia cerca de 5.000 tokens de entrada (sua pergunta, o código selecionado e as mensagens anteriores) e recebe cerca de 1.000 de saída. Uma tarefa do agente faz cerca de 12 requisições de 30.000 tokens de entrada e 1.500 de saída cada, porque a cada passo os arquivos e a conversa são reenviados. Tokens de raciocínio contam como saída. Com o Claude Sonnet 4.6:
- Um turno de chat: $0.0104 ($0.03 no preço oficial).
- Um mês de chat, 40 turnos por dia em 22 dias úteis (880 turnos): $9.17 ($26.40 no preço oficial).
- Uma tarefa do agente: $0.468 ($1.35 no preço oficial). Duas por dia útil durante um mês (528 requisições) somam $20.61.
O mesmo mês de chat com o Claude Haiku 4.5 sairia por $3.07, e com o GPT-6 Luna por $0.131. O Dashboard lista cada requisição com tokens e custo. Para comparar com outros editores, veja Cursor com sua própria chave de API e o guia da ferramenta de terminal Aider.
Como resolver os erros comuns do Continue?
- 401 Unauthorized: o
apiKeyestá errado, foi apagado ou ficou sem orçamento. Verifique se espaços ou aspas não foram copiados junto com a chave. - 404 Not Found: o
apiBaseestá errado. Ele deve ser exatamentehttps://api.apivai.com/v1nos dois providers. Sem/v1, o Continue chamahttps://api.apivai.com/chat/completionsouhttps://api.apivai.com/messages, que não existem; com/v1/v1o caminho fica duplicado. - Model not found:
modeldeve ser um ID exato deGET /v1/models, por exemploclaude-sonnet-4-6. O camponamenão importa. - Respostas vazias ou cortadas: os tokens de raciocínio esgotaram o limite de saída. Defina
maxTokenscomo 4096 ou mais (8192 nos exemplos acima). - Um modelo GPT falha e o Claude funciona: adicione
useResponsesApi: falsea essa entrada para o Continue usar/v1/chat/completions. - 429 Too Many Requests: o limite padrão é de 60 requisições por minuto por chave; o modo agente pode atingi-lo. Aguarde um pouco ou peça ao suporte um limite maior.
- Os modelos não aparecem: o YAML é inválido. Use espaços, não tabulações, mantenha a indentação do exemplo e deixe
name,versioneschemano início.
Mais detalhes da API na documentação.
Perguntas frequentes
Funciona também nas IDEs da JetBrains?
Sim. O plugin Continue para JetBrains lê o mesmo config.yaml, então as mesmas entradas funcionam no IntelliJ IDEA, PyCharm, WebStorm e outras IDEs da JetBrains.
Ainda tenho um config.json. O que faço?
O config.json está descontinuado, e a documentação do Continue traz um guia de migração para o config.yaml. Os valores continuam os mesmos: provider, modelo, apiBase e apiKey.
Uma só chave serve para Claude e GPT?
Sim. Uma chave da APIVAI funciona com todos os modelos, com o provider openai para todos ou com o provider anthropic para o Claude.
Posso usar a APIVAI para autocompletar ou embeddings?
A APIVAI não oferece embeddings, então use um provedor separado para os recursos que precisam deles. O autocompletar com Tab funciona melhor com um modelo de completação pequeno e dedicado; use os modelos da APIVAI para chat, edições, apply e modo agente.
A APIVAI armazena meu código?
Não. O conteúdo das requisições e respostas não é registrado; só dados de uso como modelo, tokens e custo são guardados para cobrança.
Crie uma conta, recarregue a partir de $10 e cole sua chave no Continue.