Qwen API

Qwen API

三个阿里云模型,走标准文本 API 透传通道,各自在 100 万 token 窗口内单一价格。均支持文本 API 的全部四种请求格式。

模型适用场景
qwen3.8-max当前旗舰
qwen3.8-flash快速低价档,适合大批量任务
qwen3.7-max上一代旗舰,供已按它调校过的管线继续使用

OpenAI Chat Completions

POST https://api.beatapi.io/v1/chat/completions

1import OpenAI from "openai";
2
3const client = new OpenAI({
4 apiKey: process.env.BEATAPI_API_KEY,
5 baseURL: "https://api.beatapi.io/v1"
6});
7
8const completion = await client.chat.completions.create({
9 model: "qwen3.8-max",
10 max_tokens: 2000,
11 messages: [
12 { role: "user", content: "在分布式日志中,向量时钟相比墙上时钟时间戳究竟带来了什么?" }
13 ]
14});
15
16console.log(completion.choices[0].message.content);
$curl --request POST \
> --url https://api.beatapi.io/v1/chat/completions \
> --header 'Authorization: Bearer <BEATAPI_API_KEY>' \
> --header 'Content-Type: application/json' \
> --data '{
> "model": "qwen3.8-max",
> "messages": [
> {
> "role": "user",
> "content": "在分布式日志中,向量时钟相比墙上时钟时间戳究竟带来了什么?"
> }
> ]
>}'

三者的缓存输入与新鲜输入分开计价;重复的提示词前缀会自动按缓存价计费,无需调用任何缓存接口。

其他 SDK 格式

同样的模型也支持 /v1/responses/v1/messages 以及 Gemini 兼容端点。所有文本模型的请求与响应结构完全一致,因此统一记录在文本 API 页面,此处不再重复。

鉴权与可用性

一把 BeatAPI 密钥即可访问本页全部模型 —— 无需按厂商申请密钥,无需切换地址,也不需要单独注册。向 https://api.beatapi.io 发送 Authorization: Bearer <BEATAPI_API_KEY> 即可。