qwen3.6-27b — 价格、上下文与性能

qwen3.6-27b 是 Alibaba 的模型,上下文 262.1K,支持 Reasoning, Tools, Files, Open Weights, Vision, Audio。输入 $0.60,输出 $3.60,均为每百万 tokens。

概览

厂商Alibaba
上下文262.1K
能力Reasoning, Tools, Files, Open Weights, Vision, Audio
API 格式openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search
计费方式p * 0.6 + c * 3.6
Qwen vision-language model for visual reasoning, documents, and agent tasks

价格

套餐倍率输入输出说明
基准价1×$0.60$3.60
Max4×$2.40$14.40Premium — max reasoning & stability.

仅列出该模型已开放的套餐。

性能实测

API 端点https://api.airai.cc/v1
OpenAI 兼容OpenAI-compatible

常见问题

qwen3.6-27b 的价格是多少?
输入 $0.60,输出 $3.60,均为每百万 tokens。
qwen3.6-27b 的上下文窗口有多大?
qwen3.6-27b 的上下文窗口为 262.1K,即单次请求中输入与输出合计的 token 上限。
如何在代码中调用 qwen3.6-27b?
把 base_url 指向 https://api.airai.cc/v1,model 填 qwen3.6-27b 即可,接口与 OpenAI 完全兼容。
qwen3.6-27b 为什么会返回 429?
429 是限流响应。降低并发、加退避重试,或切换到配额更高的套餐即可。

模型对比

Model厂商输入输出上下文
qwen3.6-27bAlibaba$0.60$3.60262.1K
qwen3-coder-30b-a3b-instructAlibaba$0.45$2.25262.1K
qwen3.8-flashAlibaba$0.15$0.471M
happyhorse-1.1-t2vAlibaba-—未标注
qwen3-8bAlibaba$0.18$2.10131.1K
qwen3-235b-a22bAlibaba$0.70$8.40131.1K
qwen3-14bAlibaba$0.35$4.20131.1K
qwen3-coder-480b-a35b-instructAlibaba$1.50$7.50262.1K
wan2.7-image-proAlibaba-—8.2K
qwen3.7-plusAlibaba$0.40$1.601M
qwen3.8-maxAlibaba$2.00$6.001M
qwen3.5-plusAlibaba$0.40$2.401M
qwq-plusAlibaba$0.80$2.40131.1K

错误排查

429 是限流响应。降低并发、加退避重试,或切换到配额更高的套餐即可。

常见原因

  • 并发请求过多
  • 当前套餐配额已用完
  • 失败后立即重试没有退避

解决办法

  • 限制并发并用指数退避重试
  • 切换到配额更高的套餐
  • 对重复请求做缓存

如何接入

curl https://api.airai.cc/v1/chat/completions \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-27b",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
from openai import OpenAI

client = OpenAI(
    api_key="<YOUR_API_KEY>",
    base_url="https://api.airai.cc/v1"
)

response = client.chat.completions.create(
    model="qwen3.6-27b",
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

const response = await client.chat.completions.create({
  model: "qwen3.6-27b",
  messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);
const OpenAI = require("openai");

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

client.chat.completions.create({
  model: "qwen3.6-27b",
  messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));

将 <YOUR_API_KEY> 替换为令牌设置中的 API Key。

兼容端点

openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search

Gemini SDK · TypeScript

import { GoogleGenerativeAI } from "@google/generative-ai";

const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "qwen3.6-27b" });

const result = await model.generateContent(
  "Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());

身份验证

所有请求必须携带 Authorization: Bearer <TOKEN> 请求头;Anthropic 格式端点也接受 x-api-key 请求头。在「令牌」页面生成 API Key,可按模型、分组、IP、速率等维度精细化授权。

支持的参数

参数类型默认值范围说明
temperaturefloat10–2采样温度;越低越稳定
top_pfloat10–1核采样累计概率
max_tokensinteger——响应中最大 token 数
frequency_penaltyfloat0−2–2惩罚高频 token 的重复出现
presence_penaltyfloat0−2–2鼓励引入新话题
stopstring[]null≤ 4最多 4 个停止生成的字符串
seedintegernull—尽量保证可复现的采样种子
ninteger1—生成的候选条数
streambooleanfalse—通过 SSE 流式返回 token
response_formatobject——强制输出 JSON 对象或符合 Schema 的结果
toolsarray——模型可调用的工具 / 函数声明
tool_choicestring | objectauto—工具选择策略或具体工具名
logprobsbooleanfalse—返回每个 token 的对数概率
top_logprobsintegernull0–20每个 token 返回的 top 概率数量
logit_biasmap——按 token 的 logit 偏置映射
userstring——用于风险审计的终端用户标识

速率限制

分组RPMTPMRPD
Eco990398K20K
Test980393K20K

数据更新于: 2026-10-10 08:15

技术支持在线客服
返回顶部