gpt-4.1-2025-04-14 — giá, ngữ cảnh và hiệu năng
gpt-4.1-2025-04-14 là mô hình của OpenAI, dùng được trên AirAI. Đầu vào $2.00, đầu ra $8.00 mỗi 1 triệu token.
Tổng quan
| Nhà cung cấp | OpenAI |
|---|---|
| Định dạng API | openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search |
| Giảm giá cache | 0.25× |
Giá
| Gói | Hệ số | Đầu vào | Đầu ra | Cache (đầu vào) | Ghi chú |
|---|---|---|---|---|---|
| Giá cơ bản | 1× | $2.00 | $8.00 | $0.50 | |
| Eco | 0.3× | $0.60 | $2.40 | $0.15 | Standard — standard reasoning, moderate stability. |
| default | 0.6× | $1.20 | $4.80 | $0.30 | Standard — standard reasoning, moderate stability. |
| Plus | 1× | $2.00 | $8.00 | $0.50 | High — strong reasoning, stable. |
| Pro | 2× | $4.00 | $16.00 | $1.00 | Enterprise — full reasoning, high stability. |
| Max | 4× | $8.00 | $32.00 | $2.00 | Premium — max reasoning & stability. |
Chỉ liệt kê các nhóm được bật cho mô hình này.
Hiệu năng
| Điểm cuối API | https://api.airai.cc/v1 |
|---|---|
| Tương thích OpenAI | OpenAI-compatible |
Câu hỏi thường gặp
gpt-4.1-2025-04-14 có giá bao nhiêu?
Đầu vào $2.00, đầu ra $8.00 mỗi 1 triệu token.
Cửa sổ ngữ cảnh của gpt-4.1-2025-04-14 là bao nhiêu?
gpt-4.1-2025-04-14 có cửa sổ ngữ cảnh không xác định: giới hạn token tổng cộng của đầu vào và đầu ra trong một yêu cầu.
Gọi gpt-4.1-2025-04-14 từ mã như thế nào?
Đặt base_url là https://api.airai.cc/v1 và model là gpt-4.1-2025-04-14. API tương thích hoàn toàn với OpenAI.
Tại sao gpt-4.1-2025-04-14 trả về lỗi 429?
429 là phản hồi giới hạn tốc độ. Giảm đồng thời, thử lại có chờ, hoặc chuyển sang gói có hạn ngạch lớn hơn.
So sánh mô hình
| Model | Nhà cung cấp | Đầu vào | Đầu ra | Ngữ cảnh |
|---|---|---|---|---|
| gpt-4.1-2025-04-14 | OpenAI | $2.00 | $8.00 | không xác định |
| gpt-5-nano | OpenAI | $0.05 | $0.40 | 400K |
| gpt-4.1-nano | OpenAI | $0.10 | $0.40 | 1M |
| gpt-image-1 | OpenAI | $5.00 | $40.00 | không xác định |
| gpt-5-chat-latest | OpenAI | $1.13 | $9.00 | không xác định |
| gpt-3.5-turbo-1106 | OpenAI | $1.00 | $2.00 | không xác định |
| gpt-5.4-mini-2026-03-17 | OpenAI | $0.75 | $4.50 | không xác định |
| o3-mini-2025-01-31 | OpenAI | $1.10 | $4.40 | không xác định |
| gpt-5.6-terra | OpenAI | $2.00 | $12.00 | 1.1M |
| gpt-4o-mini-2024-07-18 | OpenAI | $0.15 | $0.60 | không xác định |
| gpt-5-pro | OpenAI | $15.00 | $120.00 | 400K |
| gpt-4.1-nano-2025-04-14 | OpenAI | $0.10 | $0.40 | không xác định |
| o3-2025-04-16 | OpenAI | $2.00 | $8.00 | không xác định |
Xử lý lỗi
429 là phản hồi giới hạn tốc độ. Giảm đồng thời, thử lại có chờ, hoặc chuyển sang gói có hạn ngạch lớn hơn.
Nguyên nhân thường gặp
- Quá nhiều yêu cầu đồng thời
- Hết hạn ngạch của gói hiện tại
- Thử lại ngay không chờ
Cách khắc phục
- Giới hạn đồng thời và thử lại với thời gian chờ tăng dần
- Chuyển sang gói hạn ngạch lớn hơn
- Lưu cache các yêu cầu lặp lại
Cách kết nối
curl https://api.airai.cc/v1/chat/completions \
-H "Authorization: Bearer <YOUR_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-4.1-2025-04-14",
"messages": [{"role": "user", "content": "Hello"}]
}'from openai import OpenAI
client = OpenAI(
api_key="<YOUR_API_KEY>",
base_url="https://api.airai.cc/v1"
)
response = client.chat.completions.create(
model="gpt-4.1-2025-04-14",
messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
apiKey: "<YOUR_API_KEY>",
baseURL: "https://api.airai.cc/v1"
});
const response = await client.chat.completions.create({
model: "gpt-4.1-2025-04-14",
messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);const OpenAI = require("openai");
const client = new OpenAI({
apiKey: "<YOUR_API_KEY>",
baseURL: "https://api.airai.cc/v1"
});
client.chat.completions.create({
model: "gpt-4.1-2025-04-14",
messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));Thay <YOUR_API_KEY> bằng API Key trong cài đặt token của bạn.
Endpoint tương thích
openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search
Gemini SDK · TypeScript
import { GoogleGenerativeAI } from "@google/generative-ai";
const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "gpt-4.1-2025-04-14" });
const result = await model.generateContent(
"Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());Xác thực
Mọi yêu cầu phải mang header Authorization: Bearer <TOKEN>. Các endpoint định dạng Anthropic cũng chấp nhận header x-api-key. Tạo API Key tại trang Token, nơi bạn có thể giới hạn theo mô hình, nhóm, IP và tốc độ.
Tham số được hỗ trợ
| Tham số | Kiểu | Mặc định | Phạm vi | Mô tả |
|---|---|---|---|---|
temperature | float | 1 | 0–2 | Nhiệt độ lấy mẫu; thấp hơn thì ổn định hơn |
top_p | float | 1 | 0–1 | Xác suất tích lũy của nucleus sampling |
max_tokens | integer | — | — | Số token tối đa trong phản hồi |
frequency_penalty | float | 0 | −2–2 | Phạt việc lặp lại token tần suất cao |
presence_penalty | float | 0 | −2–2 | Khuyến khích đưa vào chủ đề mới |
stop | string[] | null | ≤ 4 | Tối đa 4 chuỗi dừng sinh |
seed | integer | null | — | Hạt giống để lấy mẫu có thể tái tạo hơn |
n | integer | 1 | — | Số ứng viên được tạo |
stream | boolean | false | — | Truyền token qua SSE |
response_format | object | — | — | Buộc đầu ra JSON hoặc kết quả khớp schema |
tools | array | — | — | Khai báo công cụ / hàm mà mô hình có thể gọi |
tool_choice | string | object | auto | — | Chiến lược chọn công cụ hoặc tên công cụ cụ thể |
logprobs | boolean | false | — | Trả về log-xác suất của từng token |
top_logprobs | integer | null | 0–20 | Số xác suất cao nhất trả về mỗi token |
logit_bias | map | — | — | Ánh xạ logit bias theo token |
user | string | — | — | Định danh người dùng cuối để kiểm toán rủi ro |
Giới hạn tốc độ
| Cấp | RPM | TPM | RPD |
|---|---|---|---|
| Eco | 990 | 398K | 20K |
| Test | 980 | 393K | 20K |
Dữ liệu cập nhật: 2026-10-10 15:50