Resposta curta
Para usar o Open WebUI com a APIVAI, vá em Settings > Admin > Connections, adicione uma conexão à lista Manage OpenAI API Connections, coloque https://api.apivai.com/v1 em URL e cole sua chave da APIVAI em API Key. O Open WebUI lê a lista de modelos de /v1/models, então os modelos Claude e GPT aparecem no seletor sem configuração extra, e uma única chave serve para os dois. Em 2026-10-07, o Claude Sonnet 4.6 custa $1.04 / $5.22 por milhão de tokens de entrada / saída pela APIVAI, contra os $3.00 / $15.00 oficiais. O chat funciona na hora; a busca em documentos (RAG) precisa de um modelo de embeddings de outro provedor, porque a APIVAI não oferece embeddings.
O que é o Open WebUI?
O Open WebUI é uma interface de chat auto-hospedada, normalmente executada no Docker, com contas de usuário, histórico, predefinições de modelos e chat com documentos. Ele não traz modelos próprios na nuvem: conecta-se a qualquer servidor que fale o protocolo OpenAI Chat Completions, que é exatamente o que a APIVAI oferece em https://api.apivai.com/v1.
Este guia segue a documentação do Open WebUI de outubro de 2026. Se algum rótulo na sua versão estiver um pouco diferente, os campos continuam os mesmos: uma URL, uma chave de API e uma lista opcional de IDs de modelo.
Qual tipo de conexão usar?
O Open WebUI acessa modelos na nuvem por meio de conexões OpenAI. Ele não tem um campo para um endpoint próprio de Anthropic Messages; o suporte embutido à Anthropic só reconhece as URLs oficiais da Anthropic. Por isso, a escolha certa é o formato OpenAI:
- URL:
https://api.apivai.com/v1(com/v1, uma única vez) - Modelos: Claude e GPT funcionam nesse formato, então uma conexão atende todos os modelos da página de preços
O endereço da APIVAI no formato Anthropic (https://api.apivai.com, sem /v1) é para ferramentas baseadas no SDK da Anthropic, como o Claude Code. No Open WebUI você não precisa dele. A página API compatível com OpenAI explica o formato em mais detalhes.
Como obter uma chave da APIVAI?
- Crie uma conta com seu e-mail.
- Adicione saldo a partir de $10 com cartão, cripto, Alipay ou WeChat Pay. Não há assinatura; você paga por token.
- No Painel, crie uma chave e copie. Você pode dar à chave um limite de orçamento próprio, o que ajuda quando muitas pessoas compartilham uma instância do Open WebUI.
Como adicionar a APIVAI ao Open WebUI passo a passo?
- Entre no Open WebUI com uma conta de administrador.
- Abra Settings > Admin > Connections e encontre a lista Manage OpenAI API Connections.
- Clique em + Add Connection.
- Preencha URL e API Key com os valores da tabela abaixo. Deixe Connection Type em External.
- Clique em Verify Connection, ao lado do campo URL. O Open WebUI chama
/modelscom sua chave e deve mostrar Server connection verified. - Opcional: abra Advanced. Em Model IDs, digite os IDs que quer oferecer (por exemplo
claude-sonnet-4-6) e clique em + depois de cada um. Se ficar vazio, aparecem todos os modelos que sua chave enxerga. Prefix ID coloca um rótulo comoapivai.na frente de cada modelo; o Open WebUI remove esse rótulo antes de enviar a requisição. Deixe Provider em Default. - Clique em Save. Os modelos aparecem no seletor no topo de um novo chat.
| Campo | Valor |
|---|---|
| Connection Type | External |
| URL | https://api.apivai.com/v1 |
| API Key | Sua chave da APIVAI |
| Model IDs (Advanced) | Vazio para todos os modelos, ou p. ex. claude-sonnet-4-6, claude-haiku-4-5, gpt-5.5 |
| Prefix ID (Advanced) | Opcional, p. ex. apivai |
| Provider (Advanced) | Default |
Como configurar com variáveis de ambiente do Docker?
Se você faz o deploy com Docker, pode passar os mesmos valores como variáveis de ambiente ao criar o contêiner:
docker run -d -p 3000:8080 \ -v open-webui:/app/backend/data \ -e WEBUI_SECRET_KEY=your-secret-key \ -e OPENAI_API_BASE_URL=https://api.apivai.com/v1 \ -e OPENAI_API_KEY=sua-chave-apivai \ --name open-webui --restart always \ ghcr.io/open-webui/open-webui:main
Se você não usa Ollama, adicione -e ENABLE_OLLAMA_API=False para o Open WebUI parar de tentar se conectar a ele. Para limitar a lista de modelos pelo ambiente, use OPENAI_API_CONFIGS, um objeto JSON indexado pelo número da conexão, com campos como model_ids e prefix_id.
Um detalhe: essas variáveis são do tipo ConfigVar. Com o padrão ENABLE_PERSISTENT_CONFIG=True, o que foi salvo no banco pelo painel de administração vale mais que o ambiente. Se depois você mudar OPENAI_API_BASE_URL e nada acontecer, edite a conexão em Settings > Admin > Connections.
Qual modelo escolher?
Preços por milhão de tokens em 2026-10-07. A lista de modelos muda com o tempo, então pegue os IDs em GET https://api.apivai.com/v1/models ou na página de preços em vez de copiar nomes antigos.
| Modelo | Entrada | Saída | Indicado para |
|---|---|---|---|
| Claude Sonnet 4.6 | $1.04 | $5.22 | Modelo padrão para a maioria das equipes |
| Claude Sonnet 5.5 | $0.69 | $3.47 | Sonnet mais novo, forte em código e documentos longos |
| Claude Opus 5.5 | $1.39 | $6.96 | As perguntas mais difíceis |
| Claude Haiku 4.5 | $0.35 | $1.74 | Respostas rápidas e tarefas em segundo plano |
| GPT-5.5 | $0.77 | $4.56 | Alternativa GPT |
| GPT-6 Luna | $0.0144 | $0.0768 | A opção mais barata |
Se você mantém o Open WebUI para uma equipe, use a lista Model IDs para oferecer só os modelos que quer pagar. Esconder o Opus dos usuários do dia a dia é o jeito mais simples de manter uma conta compartilhada previsível.
Defina um modelo de tarefas barato
O Open WebUI faz pequenas chamadas em segundo plano para escrever títulos de chat, gerar tags, sugerir perguntas de acompanhamento e autocompletar. Por padrão elas usam o modelo do chat atual, então um chat com um modelo caro também paga seus títulos nesse preço. Em Settings > Admin > Interface, defina External Task Model como claude-haiku-4-5 ou gpt-6-luna.
As chamadas em segundo plano recebem 1.000 tokens de saída se você não definir mais, e os tokens de raciocínio contam nesse limite. Se os títulos vierem vazios ou cortados, abra Task Model Parameters > Configure na mesma seção e defina max_tokens como 4096.
Quanto custa?
A APIVAI cobra por token a partir de um saldo pré-pago. O tamanho real de cada requisição depende do tamanho da conversa, porque o Open WebUI envia o histórico com cada mensagem.
Exemplo 1: uma pessoa. Considere 40 mensagens por dia durante 30 dias, cada uma com cerca de 3.000 tokens de entrada (pergunta mais histórico) e 800 de saída, no Claude Sonnet 4.6. São 1.200 mensagens por $8.76, contra $25.20 nos preços oficiais.
Exemplo 2: uma equipe de dez. Dez pessoas com 40 mensagens cada por dia útil, ao longo de 22 dias úteis, somam 8.800 mensagens: $64.20 no Claude Sonnet 4.6 ($185 no preço oficial), ou $21.49 se todos usarem o Claude Haiku 4.5. Se o modelo de tarefas for o Claude Haiku 4.5, com cerca de duas chamadas em segundo plano por mensagem de 1.500 tokens de entrada e 300 de saída, somam-se aproximadamente $18.43.
O Painel lista cada requisição com tokens e custo, então em poucos dias você troca essas suposições pelos seus números reais. Para uma comparação de preços mais ampla, veja Preços da API do Claude em 2026.
Documentos e bases de conhecimento funcionam?
O chat com Claude e GPT funciona totalmente pela APIVAI. A busca em documentos (RAG) é diferente: ela precisa de um modelo de embeddings para indexar arquivos, e a APIVAI não oferece embeddings.
Por padrão, o Open WebUI usa um modelo local do SentenceTransformers para embeddings (RAG_EMBEDDING_ENGINE vazio), então os documentos enviados continuam funcionando sem mudanças. Só não troque o mecanismo de embeddings para OpenAI com a URL da APIVAI. Se quiser embeddings na nuvem, configure um provedor de embeddings separado com RAG_OPENAI_API_BASE_URL e RAG_OPENAI_API_KEY, ou em Settings > Admin > Documents. As respostas continuam vindo do seu modelo de chat na APIVAI. Geração de imagens e recursos de voz também precisam de um provedor próprio.
Solução de problemas
- Verify Connection retorna 401: a chave está errada ou incompleta. Copie de novo no Painel, confira se ela não foi excluída e se o orçamento da chave e o seu saldo não acabaram.
- 404: a URL está errada. Ela deve ser
https://api.apivai.com/v1: nãohttps://api.apivai.comsem/v1, não/v1/v1, não um caminho completo como/v1/chat/completionse sem barra no final. - Modelo não encontrado: algum ID em Model IDs não existe (geralmente um nome antigo ou um nome de exibição). Compare com
GET /v1/models. Um modelo exibido comoapivai.claude-sonnet-4-6está certo: é o seu Prefix ID. - Respostas vazias ou cortadas: o raciocínio vem ativado por padrão e seus tokens contam como saída. Defina
max_tokenscomo 4096 ou mais em Advanced Params, por chat em Chat Controls ou para todos no modelo em Workspace > Models. - Variáveis de ambiente parecem ignoradas: um valor salvo no painel de administração tem prioridade sobre elas (veja a seção do Docker acima).
- 429 Too Many Requests: o limite padrão é de 60 requisições por minuto por chave, e as tarefas em segundo plano também contam. Uma equipe com muito uso pode dar chaves separadas aos usuários ou pedir ao suporte para aumentar o limite.
Perguntas frequentes
O Open WebUI consegue usar o Claude sem o formato Anthropic?
Sim. A APIVAI serve os modelos Claude no formato OpenAI em https://api.apivai.com/v1, então uma conexão OpenAI comum no Open WebUI basta. O formato Anthropic só é necessário em ferramentas baseadas no SDK da Anthropic; veja o guia de configuração do Claude Code.
Posso oferecer modelos Claude e GPT com uma única chave?
Sim. Uma chave da APIVAI funciona com todos os modelos da página de preços. Os usuários trocam de modelo no seletor no topo do chat.
A APIVAI guarda nossas conversas?
A APIVAI não registra o conteúdo das requisições e respostas. O Open WebUI guarda o histórico de chat no próprio banco de dados, no seu servidor.
Cada usuário pode ter a própria chave?
O Open WebUI também tem Direct Connections pessoais, que cada usuário adiciona nas próprias configurações, com a mesma URL e uma chave da APIVAI própria. A alternativa é manter uma única conexão de administrador e definir um limite de orçamento para essa chave no Painel.
Existe teste grátis?
Não. A APIVAI é pré-paga e sem assinatura; a recarga mínima é de $10 e você paga só pelos tokens usados. A configuração de outras ferramentas está na documentação e no nosso guia do LobeChat.
Crie uma conta, adicione saldo a partir de $10 e cole sua chave no Open WebUI.