Grok API

Grok API

两个 Grok 模型走与其余文本 API 相同的透传通道,四种请求格式都支持。

模型适合场景
grok-4.6当前旗舰 —— 推理与工具调用的默认选择
grok-4.5上一代,适合已按它调好的管线

两个模型都默认推理,思考预算记在 usage.completion_tokens_details.reasoning_tokens,已包含在 completion_tokens 里并按输出计费。

OpenAI Chat Completions

POST https://api.beatapi.io/v1/chat/completions

1import OpenAI from "openai";
2
3const client = new OpenAI({
4 apiKey: process.env.BEATAPI_API_KEY,
5 baseURL: "https://api.beatapi.io/v1"
6});
7
8const completion = await client.chat.completions.create({
9 model: "grok-4.6",
10 max_tokens: 2000,
11 messages: [
12 { role: "user", content: "为支付 API 设计一套稳健的 Webhook 重试策略。" }
13 ]
14});
15
16console.log(completion.choices[0].message.content);
$curl --request POST \
> --url https://api.beatapi.io/v1/chat/completions \
> --header 'Authorization: Bearer <BEATAPI_API_KEY>' \
> --header 'Content-Type: application/json' \
> --data '{
> "model": "grok-4.6",
> "messages": [
> {
> "role": "user",
> "content": "Design a resilient webhook retry strategy for a payments API."
> }
> ]
>}'

长上下文计费

当 prompt 达到 20 万 token 时 Grok 切到更高档,且该档对这次请求的全部 token 生效 —— 输入、缓存命中输入、输出全部翻倍。低于阈值时整次请求按标准价。

这个阈值是 200K,不是 GPT-5.6 家族的 272K。按错的阈值裁剪 prompt 会让账单翻倍。

其他 SDK 格式

OpenAI Responses

POST https://api.beatapi.io/v1/responses

$curl --request POST \
> --url https://api.beatapi.io/v1/responses \
> --header 'Authorization: Bearer <BEATAPI_API_KEY>' \
> --header 'Content-Type: application/json' \
> --data '{
> "model": "grok-4.6",
> "input": "Design a resilient webhook retry strategy for a payments API.",
> "reasoning": {
> "effort": "medium"
> }
>}'

Anthropic Messages

POST https://api.beatapi.io/v1/messages

$curl --request POST \
> --url https://api.beatapi.io/v1/messages \
> --header 'Authorization: Bearer <BEATAPI_API_KEY>' \
> --header 'Content-Type: application/json' \
> --data '{
> "model": "grok-4.6",
> "max_tokens": 1024,
> "messages": [
> {
> "role": "user",
> "content": "Design a resilient webhook retry strategy for a payments API."
> }
> ]
>}'

Gemini 兼容格式

POST https://api.beatapi.io/v1beta/models/{model}:generateContent

$curl --request POST \
> --url 'https://api.beatapi.io/v1beta/models/grok-4.6:generateContent' \
> --header 'Authorization: Bearer <BEATAPI_API_KEY>' \
> --header 'Content-Type: application/json' \
> --data '{
> "contents": [
> {
> "role": "user",
> "parts": [
> {
> "text": "Design a resilient webhook retry strategy for a payments API."
> }
> ]
> }
> ]
>}'

认证与可用性

上线前先列出当前已启用的文本模型:

$curl https://api.beatapi.io/v1/models \
> -H "Authorization: Bearer $BEATAPI_API_KEY"
1{
2 "object": "list",
3 "data": [
4 { "id": "grok-4.6", "object": "model", "owned_by": "beatapi" }
5 ]
6}

同一把 API 密钥和同一份美元余额在文本、图片、视频、工作流、特效与实时 API 之间共用。按真实 token 用量计费;请求 ID、模型、token 总量、状态与结算金额都可在控制台用量日志中查看。

上线检查清单

  • 输出预算要把推理算进去,不能只按回答长度给。
  • 盯住 200K 的 prompt 阈值 —— 越过去整次请求都翻倍。
  • API 密钥只放在可信服务端,并从日志中脱敏。
  • 记录响应中的请求 ID,便于支持与账单核对。
  • 401402429502503 当作各自不同的运维场景分别处理。

继续接入媒体模型

同一个 BeatAPI 账户可以直接调用 GPT-5.6ClaudeGemini 以及图片和视频 API,不需要再引入一套计费或认证体系。