qwen3.6-35b-a3b — giá, ngữ cảnh và hiệu năng

qwen3.6-35b-a3b là mô hình của Alibaba, ngữ cảnh 262.1K, hỗ trợ Reasoning, Tools, Files, Open Weights, Vision, Audio. Đầu vào $0.25, đầu ra $1.49 mỗi 1 triệu token.

Tổng quan

Nhà cung cấpAlibaba
Ngữ cảnh262.1K
Khả năngReasoning, Tools, Files, Open Weights, Vision, Audio
Định dạng APIopenai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search
Công thức tính phíp * 0.248 + c * 1.485
Open multimodal Qwen MoE for local agents that need vision, audio, and code

Giá

GóiHệ sốĐầu vàoĐầu raGhi chú
Giá cơ bản1×$0.25$1.49
Max4×$0.99$5.94Premium — max reasoning & stability.

Chỉ liệt kê các nhóm được bật cho mô hình này.

Hiệu năng

Điểm cuối APIhttps://api.airai.cc/v1
Tương thích OpenAIOpenAI-compatible

Câu hỏi thường gặp

qwen3.6-35b-a3b có giá bao nhiêu?
Đầu vào $0.25, đầu ra $1.49 mỗi 1 triệu token.
Cửa sổ ngữ cảnh của qwen3.6-35b-a3b là bao nhiêu?
qwen3.6-35b-a3b có cửa sổ ngữ cảnh 262.1K: giới hạn token tổng cộng của đầu vào và đầu ra trong một yêu cầu.
Gọi qwen3.6-35b-a3b từ mã như thế nào?
Đặt base_url là https://api.airai.cc/v1 và model là qwen3.6-35b-a3b. API tương thích hoàn toàn với OpenAI.
Tại sao qwen3.6-35b-a3b trả về lỗi 429?
429 là phản hồi giới hạn tốc độ. Giảm đồng thời, thử lại có chờ, hoặc chuyển sang gói có hạn ngạch lớn hơn.

So sánh mô hình

ModelNhà cung cấpĐầu vàoĐầu raNgữ cảnh
qwen3.6-35b-a3bAlibaba$0.25$1.49262.1K
qwen3-coder-flashAlibaba$0.30$1.501M
qwen3-235b-a22bAlibaba$0.70$8.40131.1K
qwen3.8-maxAlibaba$2.00$6.001M
qwen3.5-397b-a17bAlibaba$0.60$3.60262.1K
qwen3.7-maxAlibaba$2.50$7.501M
qwen3-vl-plusAlibaba$0.20$4.80262.1K
qwen3.5-plusAlibaba$0.40$2.401M
happyhorse-1.1-r2vAlibaba-—không xác định
qwen3.7-plusAlibaba$0.40$1.601M
qwen-vl-maxAlibaba$0.80$3.20131.1K
happyhorse-1.1-t2vAlibaba-—không xác định
qwen3.8-flashAlibaba$0.15$0.471M

Xử lý lỗi

429 là phản hồi giới hạn tốc độ. Giảm đồng thời, thử lại có chờ, hoặc chuyển sang gói có hạn ngạch lớn hơn.

Nguyên nhân thường gặp

  • Quá nhiều yêu cầu đồng thời
  • Hết hạn ngạch của gói hiện tại
  • Thử lại ngay không chờ

Cách khắc phục

  • Giới hạn đồng thời và thử lại với thời gian chờ tăng dần
  • Chuyển sang gói hạn ngạch lớn hơn
  • Lưu cache các yêu cầu lặp lại

Cách kết nối

curl https://api.airai.cc/v1/chat/completions \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.6-35b-a3b",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
from openai import OpenAI

client = OpenAI(
    api_key="<YOUR_API_KEY>",
    base_url="https://api.airai.cc/v1"
)

response = client.chat.completions.create(
    model="qwen3.6-35b-a3b",
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

const response = await client.chat.completions.create({
  model: "qwen3.6-35b-a3b",
  messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);
const OpenAI = require("openai");

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

client.chat.completions.create({
  model: "qwen3.6-35b-a3b",
  messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));

Thay <YOUR_API_KEY> bằng API Key trong cài đặt token của bạn.

Endpoint tương thích

openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search

Gemini SDK · TypeScript

import { GoogleGenerativeAI } from "@google/generative-ai";

const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "qwen3.6-35b-a3b" });

const result = await model.generateContent(
  "Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());

Xác thực

Mọi yêu cầu phải mang header Authorization: Bearer <TOKEN>. Các endpoint định dạng Anthropic cũng chấp nhận header x-api-key. Tạo API Key tại trang Token, nơi bạn có thể giới hạn theo mô hình, nhóm, IP và tốc độ.

Tham số được hỗ trợ

Tham sốKiểuMặc địnhPhạm viMô tả
temperaturefloat10–2Nhiệt độ lấy mẫu; thấp hơn thì ổn định hơn
top_pfloat10–1Xác suất tích lũy của nucleus sampling
max_tokensinteger——Số token tối đa trong phản hồi
frequency_penaltyfloat0−2–2Phạt việc lặp lại token tần suất cao
presence_penaltyfloat0−2–2Khuyến khích đưa vào chủ đề mới
stopstring[]null≤ 4Tối đa 4 chuỗi dừng sinh
seedintegernull—Hạt giống để lấy mẫu có thể tái tạo hơn
ninteger1—Số ứng viên được tạo
streambooleanfalse—Truyền token qua SSE
response_formatobject——Buộc đầu ra JSON hoặc kết quả khớp schema
toolsarray——Khai báo công cụ / hàm mà mô hình có thể gọi
tool_choicestring | objectauto—Chiến lược chọn công cụ hoặc tên công cụ cụ thể
logprobsbooleanfalse—Trả về log-xác suất của từng token
top_logprobsintegernull0–20Số xác suất cao nhất trả về mỗi token
logit_biasmap——Ánh xạ logit bias theo token
userstring——Định danh người dùng cuối để kiểm toán rủi ro

Giới hạn tốc độ

CấpRPMTPMRPD
Eco990398K20K
Test980393K20K

Dữ liệu cập nhật: 2026-10-10 15:45

Hỗ trợ kỹ thuậtHỗ trợ trực tuyến
Về đầu trang