Respuesta corta
Para usar Open WebUI con APIVAI, ve a Settings > Admin > Connections, añade una conexión a la lista Manage OpenAI API Connections, escribe https://api.apivai.com/v1 en URL y pega tu clave de APIVAI en API Key. Open WebUI lee la lista de modelos de /v1/models, así que los modelos Claude y GPT aparecen en el selector sin más ajustes, y una sola clave sirve para ambos. A fecha de 2026-10-07, Claude Sonnet 4.6 cuesta $1.04 / $5.22 por millón de tokens de entrada / salida a través de APIVAI, frente a los $3.00 / $15.00 oficiales. El chat funciona de inmediato; la búsqueda en documentos (RAG) necesita un modelo de embeddings de otro proveedor, porque APIVAI no ofrece embeddings.
¿Qué es Open WebUI?
Open WebUI es una interfaz de chat autoalojada, que normalmente se ejecuta en Docker, con cuentas de usuario, historial, preajustes de modelos y chat con documentos. No incluye modelos en la nube propios: se conecta a cualquier servidor que hable el protocolo OpenAI Chat Completions, que es justo lo que APIVAI ofrece en https://api.apivai.com/v1.
Esta guía sigue la documentación de Open WebUI de octubre de 2026. Si alguna etiqueta de tu versión es ligeramente distinta, los campos siguen siendo los mismos: una URL, una clave de API y una lista opcional de IDs de modelo.
¿Qué tipo de conexión debes usar?
Open WebUI accede a los modelos en la nube mediante conexiones OpenAI. No tiene un campo para un endpoint propio de Anthropic Messages; su soporte integrado de Anthropic solo reconoce las URL oficiales de Anthropic. Por eso la opción correcta es el formato OpenAI:
- URL:
https://api.apivai.com/v1(con/v1, una sola vez) - Modelos: Claude y GPT funcionan en este formato, así que una conexión cubre todos los modelos de la página de precios
La dirección de APIVAI en formato Anthropic (https://api.apivai.com, sin /v1) es para herramientas basadas en el SDK de Anthropic, como Claude Code. En Open WebUI no la necesitas. La página API compatible con OpenAI explica el formato con más detalle.
¿Cómo consigues una clave de APIVAI?
- Crea una cuenta con tu correo.
- Recarga saldo desde $10 con tarjeta, criptomonedas, Alipay o WeChat Pay. No hay suscripción; pagas por token.
- En el Panel, crea una clave y cópiala. Puedes asignarle su propio límite de presupuesto, algo útil cuando mucha gente comparte una instancia de Open WebUI.
¿Cómo añades APIVAI a Open WebUI paso a paso?
- Inicia sesión en Open WebUI con una cuenta de administrador.
- Abre Settings > Admin > Connections y busca la lista Manage OpenAI API Connections.
- Haz clic en + Add Connection.
- Rellena URL y API Key con los valores de la tabla. Deja Connection Type en External.
- Haz clic en Verify Connection, junto al campo URL. Open WebUI llama a
/modelscon tu clave y debería mostrar Server connection verified. - Opcional: abre Advanced. En Model IDs, escribe los IDs que quieras ofrecer (por ejemplo
claude-sonnet-4-6) y pulsa + después de cada uno. Si lo dejas vacío, se listan todos los modelos que ve tu clave. Prefix ID añade una etiqueta comoapivai.delante de cada modelo; Open WebUI la quita antes de enviar la petición. Deja Provider en Default. - Haz clic en Save. Los modelos aparecerán en el selector de la parte superior de un chat nuevo.
| Campo | Valor |
|---|---|
| Connection Type | External |
| URL | https://api.apivai.com/v1 |
| API Key | Tu clave de APIVAI |
| Model IDs (Advanced) | Vacío para todos los modelos, o p. ej. claude-sonnet-4-6, claude-haiku-4-5, gpt-5.5 |
| Prefix ID (Advanced) | Opcional, p. ej. apivai |
| Provider (Advanced) | Default |
¿Cómo se configura con variables de entorno de Docker?
Si despliegas con Docker, puedes pasar los mismos valores como variables de entorno al crear el contenedor:
docker run -d -p 3000:8080 \ -v open-webui:/app/backend/data \ -e WEBUI_SECRET_KEY=your-secret-key \ -e OPENAI_API_BASE_URL=https://api.apivai.com/v1 \ -e OPENAI_API_KEY=tu-clave-apivai \ --name open-webui --restart always \ ghcr.io/open-webui/open-webui:main
Si no usas Ollama, añade -e ENABLE_OLLAMA_API=False para que Open WebUI deje de intentar conectarse. Para limitar la lista de modelos desde el entorno, usa OPENAI_API_CONFIGS, un objeto JSON indexado por número de conexión con campos como model_ids y prefix_id.
Un detalle: estas variables son de tipo ConfigVar. Con el valor por defecto ENABLE_PERSISTENT_CONFIG=True, lo que se guarda en la base de datos desde el panel de administración tiene prioridad sobre el entorno. Si más adelante cambias OPENAI_API_BASE_URL y no pasa nada, edita la conexión en Settings > Admin > Connections.
¿Qué modelo conviene elegir?
Precios por millón de tokens a fecha de 2026-10-07. La lista de modelos cambia con el tiempo, así que toma los IDs de GET https://api.apivai.com/v1/models o de la página de precios en lugar de copiar nombres antiguos.
| Modelo | Entrada | Salida | Para qué |
|---|---|---|---|
| Claude Sonnet 4.6 | $1.04 | $5.22 | Modelo por defecto para la mayoría de equipos |
| Claude Sonnet 5.5 | $0.69 | $3.47 | Sonnet más reciente, fuerte en código y documentos largos |
| Claude Opus 5.5 | $1.39 | $6.96 | Las preguntas más difíciles |
| Claude Haiku 4.5 | $0.35 | $1.74 | Respuestas rápidas y tareas en segundo plano |
| GPT-5.5 | $0.77 | $4.56 | Alternativa GPT |
| GPT-6 Luna | $0.0144 | $0.0768 | La opción más barata |
Si gestionas Open WebUI para un equipo, usa la lista Model IDs para ofrecer solo los modelos que quieres pagar. Ocultar Opus a los usuarios del día a día es la forma más sencilla de mantener una factura compartida predecible.
Configura un modelo de tareas barato
Open WebUI hace pequeñas llamadas en segundo plano para escribir títulos de chat, generar etiquetas, sugerir preguntas de seguimiento y autocompletar. Por defecto usan el modelo del chat actual, así que un chat con un modelo caro también paga sus títulos a ese precio. En Settings > Admin > Interface, pon External Task Model en claude-haiku-4-5 o gpt-6-luna.
Las llamadas en segundo plano reciben 1.000 tokens de salida si no indicas más, y los tokens de razonamiento cuentan contra ese límite. Si los títulos llegan vacíos o cortados, abre Task Model Parameters > Configure en la misma sección y fija max_tokens en 4096.
¿Cuánto cuesta?
APIVAI cobra por token desde un saldo prepago. El tamaño real de cada petición depende de la longitud de la conversación, porque Open WebUI envía el historial con cada mensaje.
Ejemplo 1: una persona. Supongamos 40 mensajes al día durante 30 días, cada uno de unos 3.000 tokens de entrada (pregunta más historial) y 800 de salida, con Claude Sonnet 4.6. Son 1.200 mensajes por $8.76, frente a $25.20 a precios oficiales.
Ejemplo 2: un equipo de diez. Diez personas con 40 mensajes cada una por día laborable durante 22 días suman 8.800 mensajes: $64.20 con Claude Sonnet 4.6 ($185 oficial), o $21.49 si todos usan Claude Haiku 4.5. Si el modelo de tareas es Claude Haiku 4.5 y hay unas dos llamadas en segundo plano por mensaje, de 1.500 tokens de entrada y 300 de salida, se suman aproximadamente $18.43.
El Panel muestra cada petición con sus tokens y su coste, así que en pocos días puedes cambiar estas suposiciones por tus propios números. Para una comparación de precios más amplia, consulta Precios de la API de Claude en 2026.
¿Funcionan los documentos y las bases de conocimiento?
El chat con Claude y GPT funciona por completo a través de APIVAI. La búsqueda en documentos (RAG) es otra cosa: necesita un modelo de embeddings para indexar archivos, y APIVAI no ofrece embeddings.
De serie, Open WebUI usa un modelo local de SentenceTransformers para los embeddings (RAG_EMBEDDING_ENGINE vacío), así que los documentos subidos siguen funcionando sin cambios. Simplemente no cambies el motor de embeddings a OpenAI con la URL de APIVAI. Si quieres embeddings en la nube, configura un proveedor de embeddings aparte con RAG_OPENAI_API_BASE_URL y RAG_OPENAI_API_KEY, o en Settings > Admin > Documents. Las respuestas siguen viniendo de tu modelo de chat en APIVAI. La generación de imágenes y las funciones de voz también necesitan su propio proveedor.
Solución de problemas
- Verify Connection devuelve 401: la clave es incorrecta o está incompleta. Cópiala de nuevo desde el Panel, comprueba que no se haya eliminado y que ni el presupuesto de la clave ni tu saldo se hayan agotado.
- 404: la URL es incorrecta. Debe ser
https://api.apivai.com/v1: nohttps://api.apivai.comsin/v1, no/v1/v1, no una ruta completa como/v1/chat/completionsy sin barra final. - Modelo no encontrado: un ID de Model IDs no existe (suele ser un nombre antiguo o un nombre visible). Compáralo con
GET /v1/models. Un modelo que aparece comoapivai.claude-sonnet-4-6está bien: es tu Prefix ID. - Respuestas vacías o cortadas: el razonamiento está activado por defecto y sus tokens cuentan como salida. Fija
max_tokensen 4096 o más en Advanced Params, por chat en Chat Controls o para todos en el modelo desde Workspace > Models. - Las variables de entorno parecen ignoradas: un valor guardado en el panel de administración las anula (consulta la sección de Docker).
- 429 Too Many Requests: el límite por defecto es de 60 peticiones por minuto por clave, y las tareas en segundo plano también cuentan. Un equipo con mucho uso puede dar claves separadas a los usuarios o pedir a soporte que suba el límite.
Preguntas frecuentes
¿Puede Open WebUI usar Claude sin el formato Anthropic?
Sí. APIVAI sirve los modelos Claude en formato OpenAI en https://api.apivai.com/v1, así que basta con una conexión OpenAI normal en Open WebUI. El formato Anthropic solo hace falta en herramientas basadas en el SDK de Anthropic; consulta la guía de configuración de Claude Code.
¿Puedo ofrecer modelos Claude y GPT con una sola clave?
Sí. Una clave de APIVAI funciona con todos los modelos de la página de precios. Los usuarios cambian de modelo en el selector de la parte superior del chat.
¿APIVAI guarda nuestras conversaciones?
APIVAI no registra el contenido de las peticiones ni de las respuestas. Open WebUI guarda el historial de chat en su propia base de datos, en tu servidor.
¿Puede cada usuario tener su propia clave?
Open WebUI también tiene Direct Connections personales que cada usuario añade en su propia configuración, con la misma URL y su propia clave de APIVAI. La alternativa es mantener una sola conexión de administrador y poner un límite de presupuesto a esa clave en el Panel.
¿Hay prueba gratuita?
No. APIVAI es prepago y sin suscripción; la recarga mínima es de $10 y solo pagas los tokens que usas. La configuración de otras herramientas está en la documentación y en nuestra guía de LobeChat.
Crea una cuenta, recarga desde $10 y pega tu clave en Open WebUI.