模型与能力
模型与能力
模型与能力
BeatAPI 提供什么
GET /v1/models 返回你的账户可用的文本模型。价目页列出全部内容与当前价格。
支持哪些请求格式
四种,且每个文本模型都支持全部四种:
用你现有代码已经在说的那种即可。用 OpenAI 格式调 Claude 模型、用 Anthropic 格式调 GPT 模型,都是可以的 —— 格式决定的是传输结构,不是你能访问哪些模型。
哪些接口刻意不提供
/v1/embeddings、/v1/rerank、/v1/moderations 与 /v1/audio/* 返回 404。它们不是「计划中还没做」,而是本来就不在公开范围内。
实际影响是:如果某个工具在对话模型之外还要一个嵌入模型 —— AnythingLLM 是最常见的情况 —— 它的嵌入器需要指向别处,通常用它自带的本地那个。
图片和视频生成是 OpenAI 兼容的吗
不是,而且是刻意的。 BeatAPI 的生成接口是异步、任务式的:
没有同步的 /v1/images/generations。 一个要跑几分钟的模型,无法在一个 HTTP 请求内作答而不谎报进度或直接超时,所以这里立刻返回任务编号,等结果存在了再去取。而且失败任务会退款 —— 这件事同步调用没有干净的表达方式。
生命周期见开发指南,想省掉轮询见 Webhook 回调。
为什么 API 的回答和对话产品不一样
对话产品是围绕模型搭起来的一个应用;API 给你的是模型本身。
产品替你做了、而 API 不会白送的部分:
- 联网搜索等实时工具
- 跨会话的对话记忆
- 代码执行沙箱
- 调校过的系统提示词
- 对你上传文件的检索
通过 API,对话历史由你自己管理、系统提示词由你自己设定、工具调用由你自己接。什么都不缺,只是组装工作归你。
模型支持图片、工具调用和流式吗
流式:所有文本模型都支持,通过 stream: true 开启。
视觉与工具调用因模型而异。deepseek-v4-flash-vision-exp 接受图像输入,价格与纯文本 Flash 相同;Claude、GPT、Gemini 家族普遍支持多模态。围绕某项能力做设计前,请先看文本 API 下对应模型的页面。
怎么选模型
模型编号是稳定的。 一个家族出新代时会给新编号,已有编号不会在你不知情的情况下被指向另一份权重。
价格会随时间或上下文变吗
部分模型会,且都是公开的:
- 高峰时段 —— DeepSeek 系列在北京时间工作日高峰时段翻倍;混元
hy3有自己的每日窗口。 - 上下文档位 —— GPT-5.6 与 Grok 系列在超过阈值后按更高档位计费。
具体时段与阈值见价目页脚注。每次响应的用量记录会显示实际适用的档位。
能用我在别处已经付费的模型吗
BeatAPI 是一个账户、一份余额,不支持挂载你在其他厂商持有的密钥。

