o1 — harga, konteks dan performa

o1 adalah model OpenAI dengan konteks 200K dan dukungan Reasoning, Tools, Files, Vision. Input $15.00, output $60.00 per 1 juta token.

Ringkasan

VendorOpenAI
Konteks200K
KemampuanReasoning, Tools, Files, Vision
Format APIopenai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search
Rumus penagihanp * 15 + cr * 7.5 + c * 60
O-series reasoning model for hard analysis, math, coding, and planning

Harga

PaketPengaliInputOutputCache (input)Catatan
Harga dasar1×$15.00$60.00$7.50
Eco0.3×$4.50$18.00$2.25Standard — standard reasoning, moderate stability.
default0.6×$9.00$36.00$4.50Standard — standard reasoning, moderate stability.
Plus1×$15.00$60.00$7.50High — strong reasoning, stable.
Pro2×$30.00$120.00$15.00Enterprise — full reasoning, high stability.
Max4×$60.00$240.00$30.00Premium — max reasoning & stability.

Hanya grup yang diaktifkan untuk model ini yang dicantumkan.

Performa

Endpoint APIhttps://api.airai.cc/v1
Kompatibel OpenAIOpenAI-compatible

FAQ

Berapa harga o1?
Input $15.00, output $60.00 per 1 juta token.
Berapa jendela konteks o1?
o1 memiliki jendela konteks 200K: batas gabungan token input dan output dalam satu permintaan.
Bagaimana memanggil o1 dari kode?
Arahkan base_url ke https://api.airai.cc/v1 dan set model ke o1. API sepenuhnya kompatibel dengan OpenAI.
Mengapa o1 mengembalikan error 429?
429 adalah respons pembatasan laju. Kurangi konkurensi, coba lagi dengan jeda, atau beralih ke paket dengan kuota lebih besar.

Perbandingan model

ModelVendorInputOutputKonteks
o1OpenAI$15.00$60.00200K
gpt-5.1-2025-11-13OpenAI$1.25$10.00tidak dicantumkan
gpt-3.5-turbo-instructOpenAI$1.50$2.00tidak dicantumkan
gpt-5.4-mini-2026-03-17OpenAI$0.75$4.50tidak dicantumkan
gpt-4o-miniOpenAI$0.15$0.60128K
gpt-5.3-codex-sparkOpenAI$1.75$14.00128K
gpt-4o-mini-2024-07-18OpenAI$0.15$0.60tidak dicantumkan
gpt-4.1-mini-2025-04-14OpenAI$0.40$1.60tidak dicantumkan
gpt-image-2OpenAI$5.00$30.00tidak dicantumkan
gpt-3.5-turbo-1106OpenAI$1.00$2.00tidak dicantumkan
gpt-4-1106-previewOpenAI$10.00$30.00tidak dicantumkan
gpt-6-solOpenAI$2.00$10.00tidak dicantumkan
text-embedding-ada-002OpenAI$0.10—8.2K

Pemecahan masalah

429 adalah respons pembatasan laju. Kurangi konkurensi, coba lagi dengan jeda, atau beralih ke paket dengan kuota lebih besar.

Penyebab umum

  • Terlalu banyak permintaan bersamaan
  • Kuota paket saat ini habis
  • Mencoba ulang tanpa jeda

Cara mengatasi

  • Batasi konkurensi dan coba ulang dengan jeda eksponensial
  • Beralih ke paket dengan kuota lebih besar
  • Simpan cache permintaan yang berulang

Cara menghubungkan

curl https://api.airai.cc/v1/chat/completions \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "o1",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
from openai import OpenAI

client = OpenAI(
    api_key="<YOUR_API_KEY>",
    base_url="https://api.airai.cc/v1"
)

response = client.chat.completions.create(
    model="o1",
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

const response = await client.chat.completions.create({
  model: "o1",
  messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);
const OpenAI = require("openai");

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

client.chat.completions.create({
  model: "o1",
  messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));

Ganti <YOUR_API_KEY> dengan API Key dari pengaturan token Anda.

Endpoint kompatibel

openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search

Gemini SDK · TypeScript

import { GoogleGenerativeAI } from "@google/generative-ai";

const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "o1" });

const result = await model.generateContent(
  "Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());

Autentikasi

Semua permintaan harus menyertakan header Authorization: Bearer <TOKEN>. Endpoint format Anthropic juga menerima header x-api-key. Buat API Key Anda di halaman Token, tempat Anda dapat membatasinya berdasarkan model, grup, IP, dan laju.

Parameter yang didukung

ParameterTipeBawaanRentangDeskripsi
temperaturefloat10–2Suhu sampling; lebih rendah lebih stabil
top_pfloat10–1Probabilitas kumulatif nucleus sampling
max_tokensinteger——Token maksimum dalam respons
frequency_penaltyfloat0−2–2Hukuman pengulangan token frekuensi tinggi
presence_penaltyfloat0−2–2Mendorong topik baru
stopstring[]null≤ 4Hingga 4 string penghentian
seedintegernull—Seed untuk sampling lebih dapat direproduksi
ninteger1—Jumlah kandidat yang dihasilkan
streambooleanfalse—Streaming token via SSE
response_formatobject——Memaksa output JSON atau hasil sesuai skema
toolsarray——Deklarasi alat / fungsi yang dapat dipanggil model
tool_choicestring | objectauto—Strategi pemilihan alat atau nama alat tertentu
logprobsbooleanfalse—Mengembalikan log-probabilitas tiap token
top_logprobsintegernull0–20Jumlah probabilitas teratas per token
logit_biasmap——Pemetaan logit bias per token
userstring——Identitas pengguna akhir untuk audit risiko

Batas laju

TingkatRPMTPMRPD
Eco990398K20K
Test980393K20K

Data diperbarui: 2026-10-10 15:55

Dukungan teknisDukungan langsung
Kembali ke atas