Skip to content

Dify 接入 OpenAI 兼容模型 ​

四步接入: 在 Dify 的「集成(或设置)→ 模型供应商」里安装 OpenAI-API-compatible 插件;点「添加模型」,模型类型选 LLM,模型名称填 gpt-5.5,API Base URL 填 https://hivegpt.cn/v1,API Key 填你的 HiveGPT Key;按下表填好上下文长度和函数调用;保存后在「默认模型」里把它设为系统推理模型,应用和工作流就能用了。

更新于 2026-10,基于 Dify 1.x 和 OpenAI-API-compatible 插件。不同版本里菜单可能叫「集成 → 模型供应商」或「设置 → 模型供应商」。

准备 ​

  • 一个 Dify 工作空间:Dify 云端 或私有部署的 Dify 1.x,用管理员账号登录。
  • 一个 HiveGPT 的 API Key:在 API 密钥 页创建,分组选 GPT 类分组。还没有账号先 注册。

第一步:安装 OpenAI-API-compatible 插件 ​

  1. 点右上角头像,进入 集成(旧版本是 设置),选 模型供应商。
  2. 在插件市场里搜索 OpenAI-API-compatible,安装官方的那个(作者 langgenius)。

也可以用 OpenAI 插件

官方的 OpenAI 插件有一个可选的 API Base URL,填 https://hivegpt.cn 也能用(它会自动补 /v1)。但它内置的模型列表里不一定有你要的模型,接第三方接口用 OpenAI-API-compatible 更省事。

第二步:添加模型 ​

在 OpenAI-API-compatible 卡片上点 添加模型,按下表填:

字段填什么
模型类型LLM
模型名称gpt-5.5
模型显示名称可选,如 HiveGPT gpt-5.5
API Key你的 HiveGPT Key(sk- 开头)
API Base URLhttps://hivegpt.cn/v1(要带 /v1)
对话类型对话(Chat)
模型上下文长度128000
最大 token 上限16384
函数调用类型Tool Call
流式函数调用支持
视觉支持支持(gpt-5.5 能看图)
结构化输出支持
API 类型Chat Completions API(默认)
token 参数名自动,或选「使用 max_completion_tokens」

这个插件不会自动补 /v1,API Base URL 必须写成 https://hivegpt.cn/v1。保存时 Dify 会真的发一条测试消息验证,通过了才会保存。

上下文长度和最大 token 上限是 Dify 用来截断对话和限制输出的,填大一些更不容易截断,但每次请求可能更贵。其他模型的上限看 模型广场。

第三步:设为默认模型 ​

  1. 在模型供应商页右上角点 默认模型(有的版本叫「系统模型设置」)。
  2. 系统推理模型 选刚添加的 gpt-5.5,保存。

没有单独选模型的应用和节点会用这个默认模型。

第四步:在应用和工作流里使用 ​

  • 聊天助手 / Agent:在应用的编排页右上角的模型选择里,选 OpenAI-API-compatible 下的 gpt-5.5。
  • 工作流:在 LLM 节点里选择模型;用到工具调用的 Agent 节点,需要第二步里把函数调用类型设为 Tool Call。

嵌入模型(知识库) ​

做知识库需要嵌入模型。先用 /v1/models 确认你的分组里有嵌入模型(名字里带 embedding),有的话在同一个插件里再添加一个,模型类型选 Text Embedding,填模型名称、API Base URL、上下文长度,「每批最大分块数」可以先填 1。没有的话,知识库的嵌入部分用其他服务商。

私有部署(Docker)的常见问题 ​

现象原因处理
保存时报 Credentials validation failed,状态码 404API Base URL 少了 /v1改成 https://hivegpt.cn/v1
状态码 401 / 403Key 不对,或请求被 Dify 的 SSRF 代理拦截先用 curl 命令 确认 Key 能用;再看 ssrf_proxy 容器日志里有没有 TCP_DENIED,有的话在 docker/ssrf_proxy/squid.conf.template 里放行 hivegpt.cn 并重启 ssrf_proxy
安装插件一直转圈服务器下载 Python 依赖太慢在 .env 里设置 PIP_MIRROR_URL 为国内镜像,并适当调大 PLUGIN_PYTHON_ENV_INIT_TIMEOUT
长回答或工作流中途超时插件执行超时调大 .env 里的 PLUGIN_MAX_EXECUTION_TIMEOUT 和 PLUGIN_DAEMON_TIMEOUT(两者保持一致),重启
提示分组「不支持模型」模型名称不在你的分组里见 模型不存在
429并发太高,比如批量跑工作流见 429 报错

更多报错看 报错速查。

常见问题 ​

Dify 云端版也要这样配吗? 是的,步骤一样;云端没有上面那些 Docker 配置问题。

费用怎么算? 每次调用按 HiveGPT 的标价从你的余额或订阅里扣,Dify 里显示的价格只是估算。工作流和 Agent 一次可能调用好几次模型,用量以 使用记录 为准,见 token 怎么算钱。

代码示例在页面里运行时使用 HiveGPT 的模型接口。延伸阅读来自 JavaGuide(Apache-2.0),版权归原作者。