简短回答
在 Dify 中使用 APIVAI:安装 OpenAI-API-compatible 模型供应商插件,在它的卡片上点击 Add Model,Model Type 选 LLM,Model Name 填 APIVAI 的模型 ID(如 claude-sonnet-4-6 或 gpt-5.5),API Key 填 APIVAI 密钥,API Base URL 填 https://api.apivai.com/v1。每个模型添加一条,然后在应用里或 Default Models 中选择这些模型。如果只用 Claude,也可以用 Dify 的 Anthropic 插件,API URL 填 https://api.apivai.com,不带 /v1,因为插件内的 Anthropic 客户端会自己加上 /v1/messages。截至 2026-10-07,通过 APIVAI 使用 Claude Sonnet 4.6 每百万输入 / 输出 token 为 $1.04 / $5.22,官方价格为 $3.00 / $15.00。
Dify 是什么,它如何连接模型?
Dify 是一个开源的 LLM 应用开发平台,可以搭建聊天机器人、Agent、工作流和知识库(RAG)应用。可以使用 Dify Cloud,也可以用 Docker 自行部署。
Dify 通过从 Dify Marketplace 安装的模型供应商插件调用模型。每个供应商为整个工作空间保存一组密钥和地址,只有工作空间的所有者和管理员可以修改。供应商都在 Model Provider 页面:当前的 Dify Cloud 中位于 Integrations 下,较旧的自部署版本中位于账户菜单的 Settings 下。下文的字段名称已于 2026 年 10 月对照 Dify 文档以及官方插件 openai_api_compatible(0.0.68 版)和 anthropic 的源码核实。
选哪个供应商:OpenAI-API-compatible 还是 Anthropic?
| 供应商插件 | 地址字段 | 模型 | 适用场景 |
|---|---|---|---|
| OpenAI-API-compatible | API Base URL:https://api.apivai.com/v1 | Claude 和 GPT | 想用一个供应商管理所有模型,并完全掌控模型 ID |
| Anthropic | API URL:https://api.apivai.com | 仅 Claude | 只用 Claude,想要原生格式和提示词缓存 |
建议从 OpenAI-API-compatible 开始。模型 ID 由你自己填写,所以新模型一出现在 APIVAI 列表里就能用。两种格式的通用说明见 OpenAI 兼容 API 和 Claude API 代理。
如何一步步把 APIVAI 接入 Dify?
第 1 步:获取 API 密钥
- 用邮箱注册
- 充值,$10 起,支持银行卡、加密货币、支付宝和微信支付
- 在控制台创建密钥并复制。如果同一工作空间里有多人搭建应用,建议给密钥设置预算上限。
第 2 步:安装供应商插件
- 打开 Model Provider 页面。
- 在可安装的供应商列表中(或在 Dify Marketplace 上)找到 OpenAI-API-compatible,点击 Install。
第 3 步:添加模型
在 OpenAI-API-compatible 卡片上点击 Add Model,按下表填写:
| 字段 | 值 |
|---|---|
| Model Type | LLM |
| Model Name | claude-sonnet-4-6(APIVAI 中的准确 ID) |
| Model display name | 可选,例如“Claude Sonnet 4.6 (APIVAI)” |
| API Key | 你的 APIVAI 密钥 |
| API Base URL | https://api.apivai.com/v1 |
| model name for API endpoint | 留空 |
| Completion mode | Chat |
| Model context size | 不超过模型页面上标注的上下文窗口 |
| Upper bound for max tokens | 8192 或更高 |
| Function Call Type | Tool Call |
| Stream function calling | Support |
| API Type | Chat Completions API (/chat/completions) |
其余字段保持默认。旧版插件中地址字段名为 API endpoint URL,填写的值相同。
关于这些字段的几点说明:
- Model Name 是 Dify 实际发送给 API 的名称,必须是准确的 ID。显示名称只用于界面。
- Model context size 是 Dify 把对话历史和检索到的知识放进提示词时参考的数值。设得比模型实际窗口小没有问题,还能让长对话更省钱。
- Upper bound for max tokens 只决定应用中 Max Tokens 参数最高能调到多少。思考(thinking)默认开启,其 token 按输出计算,所以要留出 4096 以上的空间。
- Function Call Type: Tool Call 让 Agent 应用使用原生工具调用,APIVAI 支持这一功能。
点击 Save。Dify 会先发一次测试请求校验凭据,再保存模型。对每个需要的模型重复 Add Model,例如 gpt-5.5 和 claude-haiku-4-5,密钥和地址相同。
第 4 步:在应用中使用模型
- 在应用中打开模型选择器,在 OpenAI-API-compatible 下选择你的模型,并在参数中把 Max Tokens 设为 4096 或更高。
- 在工作流中,每个 LLM 节点都有自己的模型,便宜的和强大的模型可以放在同一个流程里。
- 在 Model Provider 页面的 Default Models 中设置 System Reasoning Model,即工作空间处理通用 LLM 任务的默认模型。
另一种方式:用 Anthropic 插件接 Claude
- 安装 Anthropic 供应商插件并打开设置。
- API Key 填 APIVAI 密钥,API URL 填:
https://api.apivai.com
不要加 /v1:插件把这个地址交给 Anthropic 客户端,由客户端拼接 /v1/messages。Enable request metadata 保持 Disabled。
- 插件自带一份 Claude 模型列表。其中部分 ID 与 APIVAI 一致,例如
claude-sonnet-4-6;另一些名称不同或带日期。如果模型不在列表中,或返回“model not found”,请在 Anthropic 卡片上点击 Add Model,填入 APIVAI 列表中的准确 ID,例如claude-opus-5-5。
Dify 应用该选哪个模型?
每 1M 输入 / 输出 token 价格,截至 2026-10-07:
| 模型 | APIVAI | 官方 | 适合 |
|---|---|---|---|
| Claude Haiku 4.5 | $0.35 / $1.74 | $1.00 / $5.00 | Question Classifier 节点、信息提取、高流量机器人 |
| Claude Sonnet 4.6 | $1.04 / $5.22 | $3.00 / $15.00 | 聊天机器人和 Agent 的默认首选 |
| Claude Sonnet 5.5 | $0.69 / $3.47 | $2.00 / $10.00 | 工具较多的 Agent、长文档 |
| Claude Opus 5.5 | $1.39 / $6.96 | $4.00 / $20.00 | 最难的推理步骤 |
| GPT-5.5 | $0.77 / $4.56 | $5.00 / $30.00 | 聊天和 Agent 的 GPT 替代方案 |
| GPT-6 Sol | $0.30 / $1.52 | $2.00 / $10.00 | 较新的 GPT,适合复杂工作流 |
| GPT-6 Luna | $0.0144 / $0.0768 | $0.10 / $0.50 | 最便宜,适合简单节点 |
模型列表会随时间变化。请从价格页或 API 获取 ID:
curl https://api.apivai.com/v1/models -H "Authorization: Bearer YOUR_KEY"
Dify 应用通过 APIVAI 要花多少钱?
下面两个例子中,思考 token 按输出计算:
- 客服聊天机器人: 每天 300 条消息,使用 Claude Sonnet 4.6,每条约 3,000 输入 token(系统提示词、近期历史和检索到的知识)和 600 输出 token。一个月 9,000 条消息费用为 $56.27,按官方价格为 $162。同样一个月换成 GPT-6 Luna 则为 $0.804。
- 分流工作流: 一个基于 Claude Haiku 4.5 的 Question Classifier 节点每天分拣 1,000 个请求,每次约 800 输入、300 输出 token。一个月 30,000 次调用费用为 $24.06,按官方价格为 $69.00。
知识检索会让每次请求变大,所以检索的分段数量和模型选择一样影响费用。Dify 日志和 APIVAI 控制台都能看到每次请求的 token 数。更全面的价格对比见 2026 年 Claude API 价格。
Dify 知识库(RAG)能用 APIVAI 吗?
只有生成回答的部分可以。Dify 知识库需要 Embedding Model 来索引和检索文档,而 APIVAI 不提供 embeddings(向量嵌入)。请另外安装一个嵌入服务商,并在 Default Models → Embedding Model 中设置(Rerank Model 可选,同样来自其他服务商)。根据检索结果撰写回答的 LLM 仍然可以使用 APIVAI 的模型。
故障排查
- 凭据校验失败或 401: 检查密钥是否完整复制、是否已被删除、余额或密钥预算是否还有剩余。
- 404:
/v1写错了。OpenAI-API-compatible 中的 API Base URL 必须是https://api.apivai.com/v1,/v1只出现一次。Anthropic 插件中的 API URL 必须是https://api.apivai.com;带了/v1的话请求会发到/v1/v1/messages。 - Model not found: Model Name 必须是准确的 ID,例如
claude-sonnet-4-6,不能填显示名称。请对照/v1/models核对。 - 回答为空或被截断: 把应用中的 Max Tokens 提高到 4096 或更高;如果滑块到顶仍不够,就在模型条目中调高 Upper bound for max tokens。
- Agent 从不调用工具: 编辑模型条目,把 Function Call Type 设为 Tool Call。
- 自部署的 Dify 连接不上: 运行插件的 Dify 容器需要能访问外网上的
api.apivai.com。 - 429 Too Many Requests: 默认限制为每个密钥每分钟 60 次请求。批量运行的工作流可能触发该限制,可以放慢节奏或联系客服提高限额。
常见问题
每个模型都需要单独的供应商吗?
不需要。一个 OpenAI-API-compatible 供应商可以容纳所有模型,每个模型 ID 添加一条,密钥和 API Base URL 相同。
Dify Cloud 和自部署的 Dify 都能用吗?
都能用。两者使用相同的供应商插件和字段。自部署实例需要能访问 api.apivai.com。
一个工作流能同时用 Claude 和 GPT 吗?
能。每个 LLM 节点各自选择模型,一个 APIVAI 密钥适用于所有模型。
APIVAI 能为知识库提供 embeddings 吗?
不能。APIVAI 不提供 embeddings,所以 Dify 知识库需要单独的嵌入服务商。对话、Agent 和工作流中的 LLM 节点都可以通过 APIVAI 运行。
APIVAI 会保存我的用户输入的内容吗?
请求和响应的内容不会被记录。只保留模型、token 数和费用等用量数据用于计费。密钥和限额的说明见文档。如果你也用 n8n 做自动化,见 n8n 接入 Claude 和 GPT。
创建账户,充值 $10 起,然后把密钥填入 Dify。