Kimi API

Kimi API

三个月之暗面模型,走标准文本 API 透传通道,均支持文本 API 的全部四种请求格式。

模型适用场景
kimi-k3旗舰模型 —— 100 万 token 上下文,全窗口单一价格
kimi-k2.7-code代码特化模型,价格与通用的 K2.6 相同
kimi-k2.6上一代通用模型

OpenAI Chat Completions

POST https://api.beatapi.io/v1/chat/completions

1import OpenAI from "openai";
2
3const client = new OpenAI({
4 apiKey: process.env.BEATAPI_API_KEY,
5 baseURL: "https://api.beatapi.io/v1"
6});
7
8const completion = await client.chat.completions.create({
9 model: "kimi-k3",
10 max_tokens: 2000,
11 messages: [
12 { role: "user", content: "重构这个服务,让它的重试策略可被测试,并说明你引入了哪个接缝。" }
13 ]
14});
15
16console.log(completion.choices[0].message.content);
$curl --request POST \
> --url https://api.beatapi.io/v1/chat/completions \
> --header 'Authorization: Bearer <BEATAPI_API_KEY>' \
> --header 'Content-Type: application/json' \
> --data '{
> "model": "kimi-k3",
> "messages": [
> {
> "role": "user",
> "content": "重构这个服务,让它的重试策略可被测试,并说明你引入了哪个接缝。"
> }
> ]
>}'

kimi-k2.6 每次请求都会附带一笔固定的提示词开销,因此短对话在它上面的实际花费远高于标价所暗示的水平。短轮次或高频场景下,kimi-k2.7-codekimi-k3 没有这笔开销,尽管标价更高,实际反而更便宜。

K3 与 K2.7 Code 默认进行推理,思考预算记在 usage.completion_tokens_details.reasoning_tokens,按输出计费。

其他 SDK 格式

同样的模型也支持 /v1/responses/v1/messages 以及 Gemini 兼容端点。所有文本模型的请求与响应结构完全一致,因此统一记录在文本 API 页面,此处不再重复。

鉴权与可用性

一把 BeatAPI 密钥即可访问本页全部模型 —— 无需按厂商申请密钥,无需切换地址,也不需要单独注册。向 https://api.beatapi.io 发送 Authorization: Bearer <BEATAPI_API_KEY> 即可。