Grok API
Grok API
两个 Grok 模型走与其余文本 API 相同的透传通道,四种请求格式都支持。
两个模型都默认推理,思考预算记在 usage.completion_tokens_details.reasoning_tokens,已包含在 completion_tokens 里并按输出计费。
OpenAI Chat Completions
POST https://api.beatapi.io/v1/chat/completions
长上下文计费
当 prompt 达到 20 万 token 时 Grok 切到更高档,且该档对这次请求的全部 token 生效 —— 输入、缓存命中输入、输出全部翻倍。低于阈值时整次请求按标准价。
这个阈值是 200K,不是 GPT-5.6 家族的 272K。按错的阈值裁剪 prompt 会让账单翻倍。
其他 SDK 格式
OpenAI Responses
POST https://api.beatapi.io/v1/responses
Anthropic Messages
POST https://api.beatapi.io/v1/messages
Gemini 兼容格式
POST https://api.beatapi.io/v1beta/models/{model}:generateContent
认证与可用性
上线前先列出当前已启用的文本模型:
同一把 API 密钥和同一份美元余额在文本、图片、视频、工作流、特效与实时 API 之间共用。按真实 token 用量计费;请求 ID、模型、token 总量、状态与结算金额都可在控制台用量日志中查看。
上线检查清单
- 输出预算要把推理算进去,不能只按回答长度给。
- 盯住 200K 的 prompt 阈值 —— 越过去整次请求都翻倍。
- API 密钥只放在可信服务端,并从日志中脱敏。
- 记录响应中的请求 ID,便于支持与账单核对。
- 把
401、402、429、502、503当作各自不同的运维场景分别处理。
继续接入媒体模型
同一个 BeatAPI 账户可以直接调用 GPT-5.6、Claude、Gemini 以及图片和视频 API,不需要再引入一套计费或认证体系。

