Коротко
Чтобы использовать Dify с APIVAI, установите плагин провайдера моделей OpenAI-API-compatible, нажмите Add Model на его карточке и укажите Model Type LLM, в Model Name — ID модели APIVAI, например claude-sonnet-4-6 или gpt-5.5, в API Key — ваш ключ APIVAI, а в API Base URL — https://api.apivai.com/v1. Добавьте по одной записи на каждую модель, затем выберите модели в своих приложениях или в разделе Default Models. Только для Claude можно также использовать плагин Anthropic с API URL https://api.apivai.com без /v1: клиент Anthropic внутри плагина сам добавляет /v1/messages. На 2026-10-07 Claude Sonnet 4.6 через APIVAI стоит $1.04 / $5.22 за миллион входных / выходных токенов против официальных $3.00 / $15.00.
Что такое Dify и как он подключается к моделям?
Dify — платформа с открытым исходным кодом для создания LLM-приложений: чат-ботов, агентов, workflow и приложений с базой знаний (RAG). Можно пользоваться Dify Cloud или развернуть Dify у себя через Docker.
Dify обращается к моделям через плагины провайдеров моделей, которые устанавливаются из Dify Marketplace. Каждый провайдер хранит ключ и адрес для всего рабочего пространства, а менять их могут только владельцы и администраторы пространства. Провайдеры находятся на странице Model Provider: в текущем Dify Cloud — в разделе Integrations, в старых self-hosted версиях — в Settings в меню аккаунта. Названия полей ниже проверены в октябре 2026 года по документации Dify и исходному коду официальных плагинов openai_api_compatible (версия 0.0.68) и anthropic.
Какого провайдера выбрать: OpenAI-API-compatible или Anthropic?
| Плагин провайдера | Поле адреса | Модели | Когда выбирать |
|---|---|---|---|
| OpenAI-API-compatible | API Base URL: https://api.apivai.com/v1 | Claude и GPT | Нужен один провайдер для всех моделей и полный контроль над ID |
| Anthropic | API URL: https://api.apivai.com | Только Claude | Вы используете только Claude и хотите нативный формат с кэшированием промптов |
Начните с OpenAI-API-compatible. ID каждой модели вы вводите сами, поэтому новые модели работают сразу, как только появляются в списке APIVAI. Общие сведения об обоих форматах — на страницах OpenAI-совместимый API и прокси Claude API.
Как пошагово подключить APIVAI к Dify?
Шаг 1: Получите API-ключ
- Зарегистрируйтесь по email
- Пополните баланс от $10 картой, криптовалютой, через Alipay или WeChat Pay
- Создайте ключ в Панели и скопируйте его. Задайте ему лимит бюджета, если в одном пространстве приложения создают несколько человек.
Шаг 2: Установите плагин провайдера
- Откройте страницу Model Provider.
- В списке провайдеров, доступных для установки (или на Dify Marketplace), найдите OpenAI-API-compatible и нажмите Install.
Шаг 3: Добавьте модель
На карточке OpenAI-API-compatible нажмите Add Model и заполните форму:
| Поле | Значение |
|---|---|
| Model Type | LLM |
| Model Name | claude-sonnet-4-6 (точный ID в APIVAI) |
| Model display name | по желанию, например «Claude Sonnet 4.6 (APIVAI)» |
| API Key | ваш ключ APIVAI |
| API Base URL | https://api.apivai.com/v1 |
| model name for API endpoint | оставьте пустым |
| Completion mode | Chat |
| Model context size | не больше контекстного окна со страницы модели |
| Upper bound for max tokens | 8192 или больше |
| Function Call Type | Tool Call |
| Stream function calling | Support |
| API Type | Chat Completions API (/chat/completions) |
Остальные поля оставьте по умолчанию. В старых версиях плагина поле адреса называется API endpoint URL; значение то же.
Несколько пояснений к полям:
- Model Name — то, что Dify отправляет в API, поэтому здесь нужен точный ID. Отображаемое имя нужно только для интерфейса.
- Model context size — число, на которое Dify ориентируется, когда помещает в промпт историю диалога и найденные фрагменты знаний. Значение меньше реального окна модели допустимо и делает длинные диалоги дешевле.
- Upper bound for max tokens задаёт лишь верхнюю границу параметра Max Tokens в ваших приложениях. Размышление (thinking) включено по умолчанию, и его токены считаются выходными, поэтому оставьте запас выше 4096.
- Function Call Type: Tool Call позволяет приложениям-агентам использовать нативный вызов инструментов, который APIVAI поддерживает.
Нажмите Save. Перед сохранением модели Dify проверяет учётные данные тестовым запросом. Повторите Add Model для каждой нужной модели, например gpt-5.5 и claude-haiku-4-5, с тем же ключом и адресом.
Шаг 4: Используйте модели в приложениях
- В приложении откройте выбор модели, выберите свою модель в группе OpenAI-API-compatible и задайте в её параметрах Max Tokens 4096 или больше.
- В workflow у каждого узла LLM своя модель, поэтому дешёвые и сильные модели могут работать в одном процессе.
- В разделе Default Models на странице Model Provider задайте System Reasoning Model — модель по умолчанию для общих LLM-задач пространства.
Альтернатива: плагин Anthropic для Claude
- Установите плагин провайдера Anthropic и откройте его настройку.
- В API Key вставьте ключ APIVAI, в API URL укажите:
https://api.apivai.com
Не добавляйте /v1: плагин передаёт этот адрес клиенту Anthropic, который сам добавляет /v1/messages. Параметр Enable request metadata оставьте в положении Disabled.
- В плагине есть встроенный список моделей Claude. Часть ID в нём совпадает с ID в APIVAI, например
claude-sonnet-4-6; другие названы иначе или с датой. Если модели нет в списке или она возвращает «model not found», нажмите Add Model на карточке Anthropic и введите точный ID из списка APIVAI, напримерclaude-opus-5-5.
Какую модель выбрать для приложений Dify?
Цены за 1M входных / выходных токенов на 2026-10-07:
| Модель | APIVAI | Официально | Подходит для |
|---|---|---|---|
| Claude Haiku 4.5 | $0.35 / $1.74 | $1.00 / $5.00 | Узлы Question Classifier, извлечение данных, боты с большим трафиком |
| Claude Sonnet 4.6 | $1.04 / $5.22 | $3.00 / $15.00 | Выбор по умолчанию для чат-ботов и агентов |
| Claude Sonnet 5.5 | $0.69 / $3.47 | $2.00 / $10.00 | Агенты с множеством инструментов, длинные документы |
| Claude Opus 5.5 | $1.39 / $6.96 | $4.00 / $20.00 | Самые сложные шаги рассуждения |
| GPT-5.5 | $0.77 / $4.56 | $5.00 / $30.00 | Альтернатива на GPT для чата и агентов |
| GPT-6 Sol | $0.30 / $1.52 | $2.00 / $10.00 | Более новая GPT для сложных workflow |
| GPT-6 Luna | $0.0144 / $0.0768 | $0.10 / $0.50 | Самый дешёвый вариант для простых узлов |
Список моделей со временем меняется. Берите ID со страницы цен или из API:
curl https://api.apivai.com/v1/models -H "Authorization: Bearer YOUR_KEY"
Сколько стоит приложение Dify с APIVAI?
Два примера, токены размышления учтены как выходные:
- Чат-бот поддержки: 300 сообщений в день на Claude Sonnet 4.6, каждое примерно 3 000 входных токенов (системный промпт, недавняя история и найденные знания) и 600 выходных. Месяц, 9 000 сообщений, обойдётся в $56.27 против $162 по официальным ценам. Тот же месяц на GPT-6 Luna стоил бы $0.804.
- Маршрутизирующий workflow: узел Question Classifier на Claude Haiku 4.5 сортирует 1 000 запросов в день, примерно по 800 входных и 300 выходных токенов. Месяц, 30 000 вызовов, стоит $24.06 против $69.00 по официальным ценам.
Поиск по базе знаний увеличивает каждый запрос, поэтому количество извлекаемых фрагментов влияет на цену не меньше, чем выбор модели. Токены по каждому запросу видны и в логах Dify, и в Панели APIVAI. Более широкое сравнение цен — в статье Цены Claude API в 2026 году.
Можно ли использовать APIVAI для Knowledge (RAG) в Dify?
Только для генерации ответа. Базе знаний Dify нужна Embedding Model для индексации и поиска документов, а APIVAI не предоставляет эмбеддинги. Установите отдельного провайдера эмбеддингов и выберите его в Default Models → Embedding Model (Rerank Model необязательна и тоже берётся у другого провайдера). LLM, которая пишет ответ по найденному тексту, по-прежнему может быть моделью APIVAI.
Решение проблем
- Проверка учётных данных не проходит или 401: убедитесь, что ключ скопирован целиком, не удалён и на балансе или в бюджете ключа остались средства.
- 404: неверно указан
/v1. API Base URL в OpenAI-API-compatible должен бытьhttps://api.apivai.com/v1, с/v1один раз. API URL в плагине Anthropic должен бытьhttps://api.apivai.com; с/v1запросы уходят на/v1/v1/messages. - Model not found: в Model Name должен быть точный ID, например
claude-sonnet-4-6, а не отображаемое название. Сверьтесь с/v1/models. - Пустые или обрезанные ответы: увеличьте Max Tokens в приложении до 4096 или больше, а если ползунок упирается в предел — поднимите Upper bound for max tokens в записи модели.
- Агент не вызывает инструменты: отредактируйте запись модели и задайте Function Call Type = Tool Call.
- Self-hosted Dify не может подключиться: контейнерам Dify, в которых работают плагины, нужен исходящий доступ в интернет к
api.apivai.com. - 429 Too Many Requests: по умолчанию лимит — 60 запросов в минуту на ключ. Пакетные workflow могут в него упереться; замедлите их или попросите поддержку поднять лимит.
Частые вопросы
Нужен ли отдельный провайдер для каждой модели?
Нет. Один провайдер OpenAI-API-compatible хранит все ваши модели: вы добавляете по одной записи на каждый ID с тем же ключом и API Base URL.
Это работает в Dify Cloud и в self-hosted Dify?
Да. В обоих используются одни и те же плагины провайдеров и поля. Self-hosted экземпляру нужен исходящий доступ к api.apivai.com.
Может ли один workflow использовать и Claude, и GPT?
Да. Каждый узел LLM выбирает свою модель, а один ключ APIVAI подходит для всех моделей.
Может ли APIVAI дать эмбеддинги для базы знаний?
Нет. APIVAI не предоставляет эмбеддинги, поэтому Knowledge в Dify нужен отдельный провайдер эмбеддингов. Чат, агенты и узлы LLM в workflow работают через APIVAI.
Хранит ли APIVAI то, что пишут мои пользователи?
Содержимое запросов и ответов не логируется. Для биллинга хранятся только данные об использовании: модель, токены и стоимость. О ключах и лимитах — в документации. Если вы также автоматизируете процессы в n8n, см. n8n с Claude и GPT.
Создайте аккаунт, пополните баланс от $10 и вставьте ключ в Dify.