模型与能力

模型与能力

BeatAPI 提供什么

类别涵盖内容
文本十一个模型家族,一把密钥全部可达 —— 见文本 API
图片异步生成与编辑 —— 见图片 API
视频异步生成,含运镜控制 —— 见视频 API
工作流音乐视频、电商视频、视频分析 —— 见工作流 API
特效已发布的一次性特效 —— 见特效 API
实时基于 WebRTC 的实时生成视频 —— 见实时 API

GET /v1/models 返回你的账户可用的文本模型。价目页列出全部内容与当前价格。

支持哪些请求格式

四种,且每个文本模型都支持全部四种

格式端点
OpenAI Chat CompletionsPOST /v1/chat/completions
OpenAI ResponsesPOST /v1/responses
Anthropic MessagesPOST /v1/messages
Gemini 兼容POST /v1beta/models/{model}:{action}

用你现有代码已经在说的那种即可。用 OpenAI 格式调 Claude 模型、用 Anthropic 格式调 GPT 模型,都是可以的 —— 格式决定的是传输结构,不是你能访问哪些模型。

哪些接口刻意不提供

/v1/embeddings/v1/rerank/v1/moderations/v1/audio/* 返回 404。它们不是「计划中还没做」,而是本来就不在公开范围内

实际影响是:如果某个工具在对话模型之外还要一个嵌入模型 —— AnythingLLM 是最常见的情况 —— 它的嵌入器需要指向别处,通常用它自带的本地那个。

图片和视频生成是 OpenAI 兼容的吗

不是,而且是刻意的。 BeatAPI 的生成接口是异步、任务式的:

POST /v1/images/tasks -> 201, { "data": { "id": "..." } }
GET /v1/tasks/{id} -> 轮询到 succeeded 或 failed

没有同步的 /v1/images/generations 一个要跑几分钟的模型,无法在一个 HTTP 请求内作答而不谎报进度或直接超时,所以这里立刻返回任务编号,等结果存在了再去取。而且失败任务会退款 —— 这件事同步调用没有干净的表达方式。

生命周期见开发指南,想省掉轮询见 Webhook 回调

为什么 API 的回答和对话产品不一样

对话产品是围绕模型搭起来的一个应用;API 给你的是模型本身。

产品替你做了、而 API 不会白送的部分:

  • 联网搜索等实时工具
  • 跨会话的对话记忆
  • 代码执行沙箱
  • 调校过的系统提示词
  • 对你上传文件的检索

通过 API,对话历史由你自己管理、系统提示词由你自己设定、工具调用由你自己接。什么都不缺,只是组装工作归你。

模型支持图片、工具调用和流式吗

流式:所有文本模型都支持,通过 stream: true 开启。

视觉与工具调用因模型而异。deepseek-v4-flash-vision-exp 接受图像输入,价格与纯文本 Flash 相同;Claude、GPT、Gemini 家族普遍支持多模态。围绕某项能力做设计前,请先看文本 API 下对应模型的页面。

怎么选模型

需求从这些开始
智能体编程claude-fable-5-1gpt-5.6-solkimi-k2.7-code
高难推理claude-opus-5gpt-6-astradeepseek-v4-pro-0813
日常对话claude-sonnet-5gpt-5.6-terraglm-5.3
大批量、低成本claude-haiku-4-5-20251001gemini-3.7-flashglm-5.3-flash
超长上下文minimax-m3grok-4.6kimi-k3
中文任务qwen3.8-maxglm-5.3hy4-preview

模型编号是稳定的。 一个家族出新代时会给新编号,已有编号不会在你不知情的情况下被指向另一份权重。

价格会随时间或上下文变吗

部分模型会,且都是公开的:

  • 高峰时段 —— DeepSeek 系列在北京时间工作日高峰时段翻倍;混元 hy3 有自己的每日窗口。
  • 上下文档位 —— GPT-5.6 与 Grok 系列在超过阈值后按更高档位计费。

具体时段与阈值见价目页脚注。每次响应的用量记录会显示实际适用的档位。

能用我在别处已经付费的模型吗

BeatAPI 是一个账户、一份余额,不支持挂载你在其他厂商持有的密钥