Respuesta corta
Para usar Dify con APIVAI, instala el plugin de proveedor de modelos OpenAI-API-compatible, haz clic en Add Model en su tarjeta e indica Model Type LLM, un ID de modelo de APIVAI como claude-sonnet-4-6 o gpt-5.5 en Model Name, tu clave de APIVAI en API Key y https://api.apivai.com/v1 en API Base URL. Añade una entrada por modelo y después elige los modelos en tus aplicaciones o en Default Models. Solo para Claude, también puedes usar el plugin Anthropic de Dify con API URL https://api.apivai.com y sin /v1, porque el cliente de Anthropic del plugin añade /v1/messages por su cuenta. A fecha de 2026-10-07, Claude Sonnet 4.6 cuesta $1.04 / $5.22 por millón de tokens de entrada / salida a través de APIVAI, frente a los $3.00 / $15.00 oficiales.
¿Qué es Dify y cómo se conecta a los modelos?
Dify es una plataforma de código abierto para crear aplicaciones con LLM: chatbots, agentes, workflows y aplicaciones con base de conocimiento (RAG). Puedes usar Dify Cloud o alojarlo tú mismo con Docker.
Dify llega a los modelos mediante plugins de proveedores de modelos que se instalan desde el Dify Marketplace. Cada proveedor guarda una clave y una dirección para todo el espacio de trabajo, y solo los propietarios y administradores del espacio pueden cambiarlas. Los proveedores están en la página Model Provider: en el Dify Cloud actual está dentro de Integrations; en versiones autoalojadas más antiguas, dentro de Settings en el menú de la cuenta. Los nombres de campo de esta guía se comprobaron en octubre de 2026 con la documentación de Dify y el código fuente de los plugins oficiales openai_api_compatible (versión 0.0.68) y anthropic.
¿Qué proveedor elegir: OpenAI-API-compatible o Anthropic?
| Plugin de proveedor | Campo de dirección | Modelos | Elígelo cuando |
|---|---|---|---|
| OpenAI-API-compatible | API Base URL: https://api.apivai.com/v1 | Claude y GPT | Quieres un solo proveedor para todos los modelos y control total de los ID |
| Anthropic | API URL: https://api.apivai.com | Solo Claude | Solo usas Claude y quieres el formato nativo con su caché de prompts |
Empieza con OpenAI-API-compatible. Escribes tú cada ID de modelo, así que los modelos nuevos funcionan en cuanto aparecen en la lista de APIVAI. Los detalles generales de ambos formatos están en API compatible con OpenAI y proxy de la API de Claude.
¿Cómo añadir APIVAI a Dify paso a paso?
Paso 1: Consigue una clave de API
- Regístrate con tu correo electrónico
- Recarga saldo, desde $10, con tarjeta, criptomonedas, Alipay o WeChat Pay
- Crea una clave en el Panel y cópiala. Ponle un límite de presupuesto si varias personas crean aplicaciones en el mismo espacio de trabajo.
Paso 2: Instala el plugin del proveedor
- Abre la página Model Provider.
- En la lista de proveedores que puedes instalar (o en el Dify Marketplace), busca OpenAI-API-compatible y haz clic en Install.
Paso 3: Añade un modelo
En la tarjeta OpenAI-API-compatible, haz clic en Add Model y rellena el formulario:
| Campo | Valor |
|---|---|
| Model Type | LLM |
| Model Name | claude-sonnet-4-6 (el ID exacto de APIVAI) |
| Model display name | opcional, por ejemplo "Claude Sonnet 4.6 (APIVAI)" |
| API Key | tu clave de APIVAI |
| API Base URL | https://api.apivai.com/v1 |
| model name for API endpoint | déjalo vacío |
| Completion mode | Chat |
| Model context size | no mayor que la ventana de contexto indicada en la página del modelo |
| Upper bound for max tokens | 8192 o más |
| Function Call Type | Tool Call |
| Stream function calling | Support |
| API Type | Chat Completions API (/chat/completions) |
Deja los demás campos con sus valores por defecto. Las versiones antiguas del plugin llaman al campo de dirección API endpoint URL; el valor es el mismo.
Algunas notas sobre estos campos:
- Model Name es lo que Dify envía a la API, así que debe ser el ID exacto. El nombre visible solo sirve para la interfaz.
- Model context size es el número que Dify usa al meter en el prompt el historial de la conversación y el conocimiento recuperado. Un valor menor que la ventana real del modelo está bien y abarata las conversaciones largas.
- Upper bound for max tokens solo fija hasta dónde puede llegar el parámetro Max Tokens en tus aplicaciones. El razonamiento (thinking) está activado por defecto y sus tokens cuentan como salida, así que deja margen por encima de 4096.
- Function Call Type: Tool Call permite que las aplicaciones de agente usen llamadas a herramientas nativas, que APIVAI admite.
Haz clic en Save. Dify comprueba las credenciales con una petición de prueba antes de guardar el modelo. Repite Add Model para cada modelo que quieras, por ejemplo gpt-5.5 y claude-haiku-4-5, con la misma clave y dirección.
Paso 4: Usa los modelos en tus aplicaciones
- En una aplicación, abre el selector de modelo, elige tu modelo dentro de OpenAI-API-compatible y pon Max Tokens en 4096 o más en sus parámetros.
- En un workflow, cada nodo LLM tiene su propio modelo, así que modelos baratos y potentes pueden convivir en el mismo flujo.
- En Default Models, en la página Model Provider, define el System Reasoning Model, el modelo por defecto del espacio de trabajo para tareas generales de LLM.
Alternativa: el plugin Anthropic para Claude
- Instala el plugin de proveedor Anthropic y abre su configuración.
- Pon tu clave de APIVAI en API Key y en API URL:
https://api.apivai.com
No añadas /v1: el plugin pasa esta dirección al cliente de Anthropic, que añade /v1/messages. Deja Enable request metadata en Disabled.
- El plugin trae una lista de modelos Claude. Algunos ID coinciden con los de APIVAI, como
claude-sonnet-4-6; otros usan nombres distintos o con fecha. Si un modelo no aparece o devuelve "model not found", usa Add Model en la tarjeta de Anthropic y escribe el ID exacto de la lista de APIVAI, por ejemploclaude-opus-5-5.
¿Qué modelo elegir para las aplicaciones de Dify?
Precios por 1M de tokens de entrada / salida a fecha de 2026-10-07:
| Modelo | APIVAI | Oficial | Ideal para |
|---|---|---|---|
| Claude Haiku 4.5 | $0.35 / $1.74 | $1.00 / $5.00 | Nodos Question Classifier, extracción, bots con mucho tráfico |
| Claude Sonnet 4.6 | $1.04 / $5.22 | $3.00 / $15.00 | Opción por defecto para chatbots y agentes |
| Claude Sonnet 5.5 | $0.69 / $3.47 | $2.00 / $10.00 | Agentes con muchas herramientas, documentos largos |
| Claude Opus 5.5 | $1.39 / $6.96 | $4.00 / $20.00 | Los pasos de razonamiento más difíciles |
| GPT-5.5 | $0.77 / $4.56 | $5.00 / $30.00 | Alternativa GPT para chat y agentes |
| GPT-6 Sol | $0.30 / $1.52 | $2.00 / $10.00 | GPT más reciente para workflows complejos |
| GPT-6 Luna | $0.0144 / $0.0768 | $0.10 / $0.50 | La opción más barata para nodos simples |
La lista de modelos cambia con el tiempo. Toma los ID de la página de precios o de la API:
curl https://api.apivai.com/v1/models -H "Authorization: Bearer YOUR_KEY"
¿Cuánto cuesta una aplicación de Dify con APIVAI?
Dos ejemplos, con los tokens de razonamiento contados como salida:
- Chatbot de soporte: 300 mensajes al día con Claude Sonnet 4.6, cada uno con unos 3.000 tokens de entrada (prompt de sistema, historial reciente y conocimiento recuperado) y 600 de salida. Un mes de 9.000 mensajes cuesta $56.27, frente a $162 a precios oficiales. El mismo mes con GPT-6 Luna costaría $0.804.
- Workflow de enrutamiento: un nodo Question Classifier con Claude Haiku 4.5 clasifica 1.000 peticiones al día, unos 800 tokens de entrada y 300 de salida cada una. Un mes de 30.000 llamadas cuesta $24.06, frente a $69.00 a precios oficiales.
La recuperación de conocimiento agranda cada petición, así que el número de fragmentos recuperados pesa tanto como el modelo. Los registros de Dify y el Panel de APIVAI muestran los tokens de cada petición. Para una comparación de precios más amplia, consulta Precios de la API de Claude en 2026.
¿Se puede usar APIVAI para Knowledge (RAG) en Dify?
Solo para la parte de la respuesta. Una base de conocimiento de Dify necesita un Embedding Model para indexar y buscar documentos, y APIVAI no ofrece embeddings. Instala un proveedor de embeddings aparte y selecciónalo en Default Models → Embedding Model (un Rerank Model es opcional y también viene de otro proveedor). El LLM que redacta la respuesta a partir del texto recuperado puede seguir siendo un modelo de APIVAI.
Solución de problemas
- La validación de credenciales falla o da 401: comprueba que la clave se copió completa, que sigue existiendo y que le queda saldo o presupuesto.
- 404: el
/v1está mal. API Base URL en OpenAI-API-compatible debe serhttps://api.apivai.com/v1, con/v1una sola vez. API URL en el plugin Anthropic debe serhttps://api.apivai.com; con/v1, las peticiones van a/v1/v1/messages. - Model not found: Model Name debe ser el ID exacto, como
claude-sonnet-4-6, no un nombre visible. Compruébalo con/v1/models. - Respuestas vacías o cortadas: sube Max Tokens en la aplicación a 4096 o más, y sube Upper bound for max tokens en la entrada del modelo si el control deslizante se queda corto.
- El agente nunca llama a herramientas: edita la entrada del modelo y pon Function Call Type en Tool Call.
- Dify autoalojado no se conecta: los contenedores de Dify que ejecutan plugins necesitan acceso saliente a internet hacia
api.apivai.com. - 429 Too Many Requests: el límite por defecto es de 60 peticiones por minuto por clave. Los workflows por lotes pueden alcanzarlo; ralentízalos o pide a soporte un límite mayor.
Preguntas frecuentes
¿Necesito un proveedor distinto para cada modelo?
No. Un solo proveedor OpenAI-API-compatible guarda todos tus modelos; añades una entrada por ID de modelo con la misma clave y API Base URL.
¿Funciona en Dify Cloud y en Dify autoalojado?
Sí. Ambos usan los mismos plugins de proveedor y los mismos campos. Una instancia autoalojada necesita acceso saliente a api.apivai.com.
¿Un mismo workflow puede usar Claude y GPT?
Sí. Cada nodo LLM elige su propio modelo, y una clave de APIVAI cubre todos los modelos.
¿APIVAI puede dar los embeddings para mi base de conocimiento?
No. APIVAI no ofrece embeddings, así que Knowledge en Dify necesita un proveedor de embeddings aparte. El chat, los agentes y los nodos LLM de los workflows funcionan a través de APIVAI.
¿APIVAI guarda lo que escriben mis usuarios?
El contenido de las peticiones y respuestas no se registra. Solo se guardan datos de uso, como modelo, tokens y coste, para la facturación. Las claves y los límites se explican en la documentación. Si también automatizas con n8n, consulta n8n con Claude y GPT.
Crea una cuenta, recarga desde $10 y pega tu clave en Dify.