qwen-image-max — giá, ngữ cảnh và hiệu năng

qwen-image-max là mô hình của 阿里巴巴, tính phí theo mỗi yêu cầu: $0.08.

Tổng quan

Nhà cung cấp阿里巴巴
Định dạng APIimage-generation, openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search

Giá

Mỗi yêu cầu$0.08

Hiệu năng

Điểm cuối APIhttps://api.airai.cc/v1
Tương thích OpenAIOpenAI-compatible

Câu hỏi thường gặp

qwen-image-max có giá bao nhiêu?
qwen-image-max tính phí theo mỗi yêu cầu: $0.08.
Cửa sổ ngữ cảnh của qwen-image-max là bao nhiêu?
qwen-image-max có cửa sổ ngữ cảnh không xác định: giới hạn token tổng cộng của đầu vào và đầu ra trong một yêu cầu.
Gọi qwen-image-max từ mã như thế nào?
Đặt base_url là https://api.airai.cc/v1 và model là qwen-image-max. API tương thích hoàn toàn với OpenAI.
Tại sao qwen-image-max trả về lỗi 429?
429 là phản hồi giới hạn tốc độ. Giảm đồng thời, thử lại có chờ, hoặc chuyển sang gói có hạn ngạch lớn hơn.

So sánh mô hình

ModelNhà cung cấpĐầu vàoĐầu raNgữ cảnh
qwen-image-max阿里巴巴Mỗi yêu cầu $0.08—không xác định
qwen-image-max-2025-12-30阿里巴巴Mỗi yêu cầu $0.08—không xác định
qwen3-tts-flash阿里巴巴Mỗi yêu cầu $0.80—không xác định
qwq-32b阿里巴巴$0.29$0.86131.1K
qwen3-vl-flash阿里巴巴$0.05$0.40không xác định
qwen3-vl-32b-thinking阿里巴巴$0.16$0.64không xác định
qwen3-vl-30b-a3b-thinking阿里巴巴$0.20$2.40không xác định
qwen3-max-preview阿里巴巴Chưa công bố giá—không xác định
qwen-plus-2025-12-01阿里巴巴$0.40$1.20không xác định
qwen-image-3.0阿里巴巴Mỗi yêu cầu $0.001471—không xác định
qwen3.8-omni-flash阿里巴巴$0.15$0.47không xác định
qwen3-vl-32b-instruct阿里巴巴$0.16$0.64không xác định
qwen3-30b-a3b-thinking-2507阿里巴巴$0.20$2.40không xác định

Xử lý lỗi

429 là phản hồi giới hạn tốc độ. Giảm đồng thời, thử lại có chờ, hoặc chuyển sang gói có hạn ngạch lớn hơn.

Nguyên nhân thường gặp

  • Quá nhiều yêu cầu đồng thời
  • Hết hạn ngạch của gói hiện tại
  • Thử lại ngay không chờ

Cách khắc phục

  • Giới hạn đồng thời và thử lại với thời gian chờ tăng dần
  • Chuyển sang gói hạn ngạch lớn hơn
  • Lưu cache các yêu cầu lặp lại

Cách kết nối

curl https://api.airai.cc/v1/chat/completions \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen-image-max",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
from openai import OpenAI

client = OpenAI(
    api_key="<YOUR_API_KEY>",
    base_url="https://api.airai.cc/v1"
)

response = client.chat.completions.create(
    model="qwen-image-max",
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

const response = await client.chat.completions.create({
  model: "qwen-image-max",
  messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);
const OpenAI = require("openai");

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

client.chat.completions.create({
  model: "qwen-image-max",
  messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));

Thay <YOUR_API_KEY> bằng API Key trong cài đặt token của bạn.

Endpoint tương thích

openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search

Gemini SDK · TypeScript

import { GoogleGenerativeAI } from "@google/generative-ai";

const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "qwen-image-max" });

const result = await model.generateContent(
  "Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());

Xác thực

Mọi yêu cầu phải mang header Authorization: Bearer <TOKEN>. Các endpoint định dạng Anthropic cũng chấp nhận header x-api-key. Tạo API Key tại trang Token, nơi bạn có thể giới hạn theo mô hình, nhóm, IP và tốc độ.

Tham số được hỗ trợ

Tham sốKiểuMặc địnhPhạm viMô tả
temperaturefloat10–2Nhiệt độ lấy mẫu; thấp hơn thì ổn định hơn
top_pfloat10–1Xác suất tích lũy của nucleus sampling
max_tokensinteger——Số token tối đa trong phản hồi
frequency_penaltyfloat0−2–2Phạt việc lặp lại token tần suất cao
presence_penaltyfloat0−2–2Khuyến khích đưa vào chủ đề mới
stopstring[]null≤ 4Tối đa 4 chuỗi dừng sinh
seedintegernull—Hạt giống để lấy mẫu có thể tái tạo hơn
ninteger1—Số ứng viên được tạo
streambooleanfalse—Truyền token qua SSE
response_formatobject——Buộc đầu ra JSON hoặc kết quả khớp schema
toolsarray——Khai báo công cụ / hàm mà mô hình có thể gọi
tool_choicestring | objectauto—Chiến lược chọn công cụ hoặc tên công cụ cụ thể
logprobsbooleanfalse—Trả về log-xác suất của từng token
top_logprobsintegernull0–20Số xác suất cao nhất trả về mỗi token
logit_biasmap——Ánh xạ logit bias theo token
userstring——Định danh người dùng cuối để kiểm toán rủi ro

Giới hạn tốc độ

CấpRPMTPMRPD
Eco990398K20K
Test980393K20K

Dữ liệu cập nhật: 2026-10-10 12:10

Hỗ trợ kỹ thuậtHỗ trợ trực tuyến
Về đầu trang