o1 — harga, konteks dan performa
o1 adalah model OpenAI dengan konteks 200K dan dukungan Reasoning, Tools, Files, Vision. Input $15.00, output $60.00 per 1 juta token.
Ringkasan
| Vendor | OpenAI |
|---|---|
| Konteks | 200K |
| Kemampuan | Reasoning, Tools, Files, Vision |
| Format API | openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search |
| Rumus penagihan | p * 15 + cr * 7.5 + c * 60 |
O-series reasoning model for hard analysis, math, coding, and planningHarga
| Paket | Pengali | Input | Output | Cache (input) | Catatan |
|---|---|---|---|---|---|
| Harga dasar | 1× | $15.00 | $60.00 | $7.50 | |
| Eco | 0.3× | $4.50 | $18.00 | $2.25 | Standard — standard reasoning, moderate stability. |
| default | 0.6× | $9.00 | $36.00 | $4.50 | Standard — standard reasoning, moderate stability. |
| Plus | 1× | $15.00 | $60.00 | $7.50 | High — strong reasoning, stable. |
| Pro | 2× | $30.00 | $120.00 | $15.00 | Enterprise — full reasoning, high stability. |
| Max | 4× | $60.00 | $240.00 | $30.00 | Premium — max reasoning & stability. |
Hanya grup yang diaktifkan untuk model ini yang dicantumkan.
Performa
| Endpoint API | https://api.airai.cc/v1 |
|---|---|
| Kompatibel OpenAI | OpenAI-compatible |
FAQ
Berapa harga o1?
Input $15.00, output $60.00 per 1 juta token.
Berapa jendela konteks o1?
o1 memiliki jendela konteks 200K: batas gabungan token input dan output dalam satu permintaan.
Bagaimana memanggil o1 dari kode?
Arahkan base_url ke https://api.airai.cc/v1 dan set model ke o1. API sepenuhnya kompatibel dengan OpenAI.
Mengapa o1 mengembalikan error 429?
429 adalah respons pembatasan laju. Kurangi konkurensi, coba lagi dengan jeda, atau beralih ke paket dengan kuota lebih besar.
Perbandingan model
| Model | Vendor | Input | Output | Konteks |
|---|---|---|---|---|
| o1 | OpenAI | $15.00 | $60.00 | 200K |
| gpt-5.1-2025-11-13 | OpenAI | $1.25 | $10.00 | tidak dicantumkan |
| gpt-3.5-turbo-instruct | OpenAI | $1.50 | $2.00 | tidak dicantumkan |
| gpt-5.4-mini-2026-03-17 | OpenAI | $0.75 | $4.50 | tidak dicantumkan |
| gpt-4o-mini | OpenAI | $0.15 | $0.60 | 128K |
| gpt-5.3-codex-spark | OpenAI | $1.75 | $14.00 | 128K |
| gpt-4o-mini-2024-07-18 | OpenAI | $0.15 | $0.60 | tidak dicantumkan |
| gpt-4.1-mini-2025-04-14 | OpenAI | $0.40 | $1.60 | tidak dicantumkan |
| gpt-image-2 | OpenAI | $5.00 | $30.00 | tidak dicantumkan |
| gpt-3.5-turbo-1106 | OpenAI | $1.00 | $2.00 | tidak dicantumkan |
| gpt-4-1106-preview | OpenAI | $10.00 | $30.00 | tidak dicantumkan |
| gpt-6-sol | OpenAI | $2.00 | $10.00 | tidak dicantumkan |
| text-embedding-ada-002 | OpenAI | $0.10 | — | 8.2K |
Pemecahan masalah
429 adalah respons pembatasan laju. Kurangi konkurensi, coba lagi dengan jeda, atau beralih ke paket dengan kuota lebih besar.
Penyebab umum
- Terlalu banyak permintaan bersamaan
- Kuota paket saat ini habis
- Mencoba ulang tanpa jeda
Cara mengatasi
- Batasi konkurensi dan coba ulang dengan jeda eksponensial
- Beralih ke paket dengan kuota lebih besar
- Simpan cache permintaan yang berulang
Cara menghubungkan
curl https://api.airai.cc/v1/chat/completions \
-H "Authorization: Bearer <YOUR_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "o1",
"messages": [{"role": "user", "content": "Hello"}]
}'from openai import OpenAI
client = OpenAI(
api_key="<YOUR_API_KEY>",
base_url="https://api.airai.cc/v1"
)
response = client.chat.completions.create(
model="o1",
messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
apiKey: "<YOUR_API_KEY>",
baseURL: "https://api.airai.cc/v1"
});
const response = await client.chat.completions.create({
model: "o1",
messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);const OpenAI = require("openai");
const client = new OpenAI({
apiKey: "<YOUR_API_KEY>",
baseURL: "https://api.airai.cc/v1"
});
client.chat.completions.create({
model: "o1",
messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));Ganti <YOUR_API_KEY> dengan API Key dari pengaturan token Anda.
Endpoint kompatibel
openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search
Gemini SDK · TypeScript
import { GoogleGenerativeAI } from "@google/generative-ai";
const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "o1" });
const result = await model.generateContent(
"Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());Autentikasi
Semua permintaan harus menyertakan header Authorization: Bearer <TOKEN>. Endpoint format Anthropic juga menerima header x-api-key. Buat API Key Anda di halaman Token, tempat Anda dapat membatasinya berdasarkan model, grup, IP, dan laju.
Parameter yang didukung
| Parameter | Tipe | Bawaan | Rentang | Deskripsi |
|---|---|---|---|---|
temperature | float | 1 | 0–2 | Suhu sampling; lebih rendah lebih stabil |
top_p | float | 1 | 0–1 | Probabilitas kumulatif nucleus sampling |
max_tokens | integer | — | — | Token maksimum dalam respons |
frequency_penalty | float | 0 | −2–2 | Hukuman pengulangan token frekuensi tinggi |
presence_penalty | float | 0 | −2–2 | Mendorong topik baru |
stop | string[] | null | ≤ 4 | Hingga 4 string penghentian |
seed | integer | null | — | Seed untuk sampling lebih dapat direproduksi |
n | integer | 1 | — | Jumlah kandidat yang dihasilkan |
stream | boolean | false | — | Streaming token via SSE |
response_format | object | — | — | Memaksa output JSON atau hasil sesuai skema |
tools | array | — | — | Deklarasi alat / fungsi yang dapat dipanggil model |
tool_choice | string | object | auto | — | Strategi pemilihan alat atau nama alat tertentu |
logprobs | boolean | false | — | Mengembalikan log-probabilitas tiap token |
top_logprobs | integer | null | 0–20 | Jumlah probabilitas teratas per token |
logit_bias | map | — | — | Pemetaan logit bias per token |
user | string | — | — | Identitas pengguna akhir untuk audit risiko |
Batas laju
| Tingkat | RPM | TPM | RPD |
|---|---|---|---|
| Eco | 990 | 398K | 20K |
| Test | 980 | 393K | 20K |
Data diperbarui: 2026-10-10 15:55