Resposta curta
Para usar o Dify com a APIVAI, instale o plugin de provedor de modelos OpenAI-API-compatible, clique em Add Model no card dele e informe Model Type LLM, um ID de modelo da APIVAI como claude-sonnet-4-6 ou gpt-5.5 em Model Name, sua chave da APIVAI em API Key e https://api.apivai.com/v1 em API Base URL. Adicione uma entrada por modelo e depois escolha os modelos nos seus aplicativos ou em Default Models. Só para Claude, você também pode usar o plugin Anthropic do Dify com API URL https://api.apivai.com e sem /v1, porque o cliente Anthropic do plugin acrescenta /v1/messages sozinho. Em 2026-10-07, o Claude Sonnet 4.6 custa $1.04 / $5.22 por milhão de tokens de entrada / saída pela APIVAI, contra os $3.00 / $15.00 oficiais.
O que é o Dify e como ele se conecta aos modelos?
O Dify é uma plataforma de código aberto para criar aplicativos com LLM: chatbots, agentes, workflows e aplicativos com base de conhecimento (RAG). Você pode usar o Dify Cloud ou hospedá-lo por conta própria com Docker.
O Dify acessa os modelos por meio de plugins de provedores de modelos instalados a partir do Dify Marketplace. Cada provedor guarda uma chave e um endereço para todo o espaço de trabalho, e só os proprietários e administradores do espaço podem alterá-los. Os provedores ficam na página Model Provider: no Dify Cloud atual, dentro de Integrations; em versões auto-hospedadas mais antigas, dentro de Settings no menu da conta. Os nomes de campo deste guia foram conferidos em outubro de 2026 na documentação do Dify e no código-fonte dos plugins oficiais openai_api_compatible (versão 0.0.68) e anthropic.
Qual provedor escolher: OpenAI-API-compatible ou Anthropic?
| Plugin de provedor | Campo de endereço | Modelos | Escolha quando |
|---|---|---|---|
| OpenAI-API-compatible | API Base URL: https://api.apivai.com/v1 | Claude e GPT | Você quer um provedor para todos os modelos e controle total dos IDs |
| Anthropic | API URL: https://api.apivai.com | Só Claude | Você usa só Claude e quer o formato nativo com cache de prompt |
Comece pelo OpenAI-API-compatible. Você mesmo digita cada ID de modelo, então modelos novos funcionam assim que aparecem na lista da APIVAI. Os detalhes gerais dos dois formatos estão em API compatível com OpenAI e proxy da API do Claude.
Como adicionar a APIVAI ao Dify passo a passo?
Passo 1: Obtenha uma chave de API
- Cadastre-se com seu e-mail
- Recarregue o saldo, a partir de $10, com cartão, cripto, Alipay ou WeChat Pay
- Crie uma chave no Painel e copie. Dê a ela um limite de orçamento se várias pessoas criam aplicativos no mesmo espaço de trabalho.
Passo 2: Instale o plugin do provedor
- Abra a página Model Provider.
- Na lista de provedores disponíveis para instalar (ou no Dify Marketplace), encontre OpenAI-API-compatible e clique em Install.
Passo 3: Adicione um modelo
No card OpenAI-API-compatible, clique em Add Model e preencha o formulário:
| Campo | Valor |
|---|---|
| Model Type | LLM |
| Model Name | claude-sonnet-4-6 (o ID exato na APIVAI) |
| Model display name | opcional, por exemplo "Claude Sonnet 4.6 (APIVAI)" |
| API Key | sua chave da APIVAI |
| API Base URL | https://api.apivai.com/v1 |
| model name for API endpoint | deixe em branco |
| Completion mode | Chat |
| Model context size | no máximo a janela de contexto indicada na página do modelo |
| Upper bound for max tokens | 8192 ou mais |
| Function Call Type | Tool Call |
| Stream function calling | Support |
| API Type | Chat Completions API (/chat/completions) |
Deixe os outros campos no padrão. Versões antigas do plugin chamam o campo de endereço de API endpoint URL; o valor é o mesmo.
Algumas observações sobre esses campos:
- Model Name é o que o Dify envia à API, então precisa ser o ID exato. O nome de exibição serve só para a interface.
- Model context size é o número que o Dify usa ao encaixar no prompt o histórico da conversa e o conhecimento recuperado. Um valor abaixo da janela real do modelo não tem problema e deixa conversas longas mais baratas.
- Upper bound for max tokens só define até onde o parâmetro Max Tokens pode ir nos seus aplicativos. O raciocínio (thinking) vem ligado por padrão e seus tokens contam como saída, então deixe folga acima de 4096.
- Function Call Type: Tool Call permite que aplicativos de agente usem chamadas de ferramentas nativas, que a APIVAI suporta.
Clique em Save. O Dify valida as credenciais com uma requisição de teste antes de salvar o modelo. Repita Add Model para cada modelo que quiser, por exemplo gpt-5.5 e claude-haiku-4-5, com a mesma chave e o mesmo endereço.
Passo 4: Use os modelos nos seus aplicativos
- Em um aplicativo, abra o seletor de modelo, escolha seu modelo em OpenAI-API-compatible e defina Max Tokens como 4096 ou mais nos parâmetros.
- Em um workflow, cada nó LLM tem o próprio modelo, então modelos baratos e fortes podem conviver no mesmo fluxo.
- Em Default Models, na página Model Provider, defina o System Reasoning Model, o modelo padrão do espaço de trabalho para tarefas gerais de LLM.
Alternativa: o plugin Anthropic para Claude
- Instale o plugin de provedor Anthropic e abra a configuração.
- Coloque sua chave da APIVAI em API Key e, em API URL:
https://api.apivai.com
Não acrescente /v1: o plugin passa esse endereço ao cliente Anthropic, que acrescenta /v1/messages. Deixe Enable request metadata em Disabled.
- O plugin vem com uma lista de modelos Claude. Alguns IDs coincidem com os da APIVAI, como
claude-sonnet-4-6; outros usam nomes diferentes ou com data. Se um modelo não aparecer ou retornar "model not found", use Add Model no card da Anthropic e digite o ID exato da lista da APIVAI, por exemploclaude-opus-5-5.
Qual modelo escolher para aplicativos do Dify?
Preços por 1M de tokens de entrada / saída em 2026-10-07:
| Modelo | APIVAI | Oficial | Bom para |
|---|---|---|---|
| Claude Haiku 4.5 | $0.35 / $1.74 | $1.00 / $5.00 | Nós Question Classifier, extração, bots com muito tráfego |
| Claude Sonnet 4.6 | $1.04 / $5.22 | $3.00 / $15.00 | Padrão para chatbots e agentes |
| Claude Sonnet 5.5 | $0.69 / $3.47 | $2.00 / $10.00 | Agentes com muitas ferramentas, documentos longos |
| Claude Opus 5.5 | $1.39 / $6.96 | $4.00 / $20.00 | As etapas de raciocínio mais difíceis |
| GPT-5.5 | $0.77 / $4.56 | $5.00 / $30.00 | Alternativa GPT para chat e agentes |
| GPT-6 Sol | $0.30 / $1.52 | $2.00 / $10.00 | GPT mais nova para workflows complexos |
| GPT-6 Luna | $0.0144 / $0.0768 | $0.10 / $0.50 | A opção mais barata para nós simples |
A lista de modelos muda com o tempo. Pegue os IDs na página de preços ou na API:
curl https://api.apivai.com/v1/models -H "Authorization: Bearer YOUR_KEY"
Quanto custa um aplicativo do Dify com a APIVAI?
Dois exemplos, com os tokens de raciocínio contados como saída:
- Chatbot de suporte: 300 mensagens por dia com o Claude Sonnet 4.6, cada uma com cerca de 3.000 tokens de entrada (prompt de sistema, histórico recente e conhecimento recuperado) e 600 de saída. Um mês de 9.000 mensagens custa $56.27, contra $162 a preços oficiais. O mesmo mês com o GPT-6 Luna custaria $0.804.
- Workflow de roteamento: um nó Question Classifier com o Claude Haiku 4.5 classifica 1.000 requisições por dia, cerca de 800 tokens de entrada e 300 de saída cada. Um mês de 30.000 chamadas custa $24.06, contra $69.00 a preços oficiais.
A recuperação de conhecimento aumenta cada requisição, então a quantidade de trechos recuperados pesa tanto quanto o modelo. Os logs do Dify e o Painel da APIVAI mostram os tokens de cada requisição. Para uma comparação de preços mais ampla, veja Preços da API do Claude em 2026.
Dá para usar a APIVAI no Knowledge (RAG) do Dify?
Só na parte da resposta. Uma base de conhecimento do Dify precisa de um Embedding Model para indexar e buscar documentos, e a APIVAI não oferece embeddings. Instale um provedor de embeddings separado e selecione-o em Default Models → Embedding Model (um Rerank Model é opcional e também vem de outro provedor). O LLM que escreve a resposta a partir do texto recuperado pode continuar sendo um modelo da APIVAI.
Solução de problemas
- A validação das credenciais falha ou dá 401: confira se a chave foi copiada inteira, se ainda existe e se ainda há saldo ou orçamento.
- 404: o
/v1está errado. API Base URL no OpenAI-API-compatible precisa serhttps://api.apivai.com/v1, com/v1uma única vez. API URL no plugin Anthropic precisa serhttps://api.apivai.com; com/v1, as requisições vão para/v1/v1/messages. - Model not found: Model Name precisa ser o ID exato, como
claude-sonnet-4-6, e não um nome de exibição. Confira em/v1/models. - Respostas vazias ou cortadas: aumente Max Tokens no aplicativo para 4096 ou mais e aumente Upper bound for max tokens na entrada do modelo se o controle deslizante parar cedo demais.
- O agente nunca chama ferramentas: edite a entrada do modelo e defina Function Call Type como Tool Call.
- O Dify auto-hospedado não conecta: os contêineres do Dify que executam plugins precisam de acesso de saída à internet para
api.apivai.com. - 429 Too Many Requests: o limite padrão é de 60 requisições por minuto por chave. Workflows em lote podem atingi-lo; diminua o ritmo ou peça ao suporte um limite maior.
Perguntas frequentes
Preciso de um provedor separado para cada modelo?
Não. Um único provedor OpenAI-API-compatible guarda todos os seus modelos; você adiciona uma entrada por ID de modelo com a mesma chave e o mesmo API Base URL.
Funciona no Dify Cloud e no Dify auto-hospedado?
Sim. Os dois usam os mesmos plugins de provedor e os mesmos campos. Uma instância auto-hospedada precisa de acesso de saída a api.apivai.com.
Um mesmo workflow pode usar Claude e GPT?
Sim. Cada nó LLM escolhe o próprio modelo, e uma chave da APIVAI cobre todos os modelos.
A APIVAI pode fornecer os embeddings da minha base de conhecimento?
Não. A APIVAI não oferece embeddings, então o Knowledge do Dify precisa de um provedor de embeddings separado. Chat, agentes e nós LLM dos workflows funcionam pela APIVAI.
A APIVAI guarda o que meus usuários digitam?
O conteúdo das requisições e respostas não é registrado. Só ficam guardados dados de uso, como modelo, tokens e custo, para a cobrança. Chaves e limites são explicados na documentação. Se você também automatiza com o n8n, veja n8n com Claude e GPT.
Crie uma conta, recarregue a partir de $10 e cole sua chave no Dify.