在 Dify 中使用 BeatAPI

在 Dify 中使用 BeatAPI

Dify 是一个用来搭建对话应用、智能体与工作流的大模型平台。BeatAPI 添加一次之后,工作区内所有应用都能选到它。

准备工作

  1. 一个 Dify 工作区 —— 云端版或自部署版。
  2. 一把 BeatAPI 密钥 —— 在控制台 → API 密钥创建。

第一步:打开模型设置

点右上角头像,选择设置,再在左侧菜单选择模型供应商

第二步:添加 BeatAPI

两条路径结果相同。第一条更快,第二条能把 BeatAPI 与其他供应商分开管理。

方案一:复用 OpenAI 供应商

  1. 找到 OpenAI 供应商,点配置
  2. 填写:
字段
API Key你的 BeatAPI 密钥
API Base URLhttps://api.beatapi.io/v1
  1. 保存后,在模型列表里启用你打算使用的模型。

Dify 的 OpenAI 模型列表是 Dify 自己维护的,不是从接口读回来的。启用一个 BeatAPI 不提供的模型,会在运行时才返回 not_found —— 而那时它已经在你搭好的应用里了。请只启用下表或价目页中的编号。

方案二:添加自定义模型供应商

  1. 滚动到自定义模型区域,点 + 添加模型
  2. 填写:
字段
模型名称BeatAPI 或任意标签
模型类型LLM
API Key你的 BeatAPI 密钥
API 端点地址https://api.beatapi.io/v1
端点模型名称准确的模型编号,例如 claude-sonnet-5

每个要用的模型重复一次。这条路要多打点字,但列表里永远只有真正能用的模型。

第三步:模型

模型编号上下文适用场景
claude-fable-5-1最新一代,适合高要求应用
claude-sonnet-5质量与成本均衡
claude-haiku-4-5-20251001分类、路由等廉价步骤
gpt-6-astra最新一代 GPT,单一价格
gemini-3.7-flash快速便宜
deepseek-v4-pro-0813低价强推理
minimax-m3超长超出常规上下文上限的文档

详情见文本 API 各页,价格见价目页

少数模型的价格会随负载或上下文长度变化:DeepSeek 系列在北京时间工作日高峰时段翻倍,混元 hy3 有自己的每日高峰窗口,GPT-5.6 与 Grok 系列在上下文超过阈值后按更高档位计费。定时运行的 Dify 工作流可能整个落在高峰窗口里而无人察觉。 具体时段见价目页脚注。

第四步:搭建与发布

  1. 创建应用 —— 聊天助手、文本生成、Agent 或工作流。
  2. 模型设置中选择 BeatAPI 的模型。
  3. 编写系统提示词,用 {{变量名}} 表示用户输入、{{context}} 表示知识库内容。
  4. 在右侧预览面板测试,然后发布 —— 可作为 API、嵌入网页或分享链接。

值得设置的参数

参数作用建议值
Temperature输出随机性0.7 偏创意 / 0.3 偏精确
Max Tokens输出长度上限2000–4000
Top P核采样0.9

常见问题

Dify 连不上

  1. Base URL 必须是 https://api.beatapi.io/v1 —— 带 /v1,结尾不加斜杠。
  2. 控制台 → API 密钥确认密钥仍然可用。
  3. 自部署版:要确认 Dify 服务端能访问 api.beatapi.io,而不只是你的浏览器能访问。

某个模型只在运行时失败

说明它在 Dify 列表里被启用了,但账户并不提供。对照价目页核对编号。

402 insufficient_credits

余额已用尽,在控制台充值。余额为空期间,已发布的应用对它的用户来说是坏的 —— 这一项值得配告警。

429 rate_limit_exceeded

该密钥超出请求频率上限,通常是工作流并发扇出造成的。降低工作流并发度,或提升额度;每分钟额度随累计充值提升,当前值在控制台可见。

怎么控制花费

  • 每个应用发一把独立密钥,GET /v1/usageby_api_key 就能按应用归集成本。
  • 分类、路由、抽取这类廉价步骤走便宜模型,只把最终作答留给强模型。
  • 给每个节点都设 Max Tokens;工作流节点的默认上限相当宽松。

获取支持

控制台提交工单,并附上失败响应里的 request_id