o3 — precio, contexto y rendimiento
o3 es un modelo de OpenAI con contexto de 200K y compatibilidad con Reasoning, Tools, Files, Vision. Entrada $2.00, salida $8.00 por 1 M de tokens.
Resumen
| Proveedor | OpenAI |
|---|---|
| Contexto | 200K |
| Capacidades | Reasoning, Tools, Files, Vision |
| Formatos de API | openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search |
| Fórmula de facturación | p * 2 + cr * 0.5 + c * 8 |
Deliberate o-series reasoner for hard math, coding, and multi-step analysisPrecios
| Plan | Multiplicador | Entrada | Salida | Caché (entrada) | Nota |
|---|---|---|---|---|---|
| Precio base | 1× | $2.00 | $8.00 | $0.50 | |
| Eco | 0.3× | $0.60 | $2.40 | $0.15 | Standard — standard reasoning, moderate stability. |
| default | 0.6× | $1.20 | $4.80 | $0.30 | Standard — standard reasoning, moderate stability. |
| Plus | 1× | $2.00 | $8.00 | $0.50 | High — strong reasoning, stable. |
| Pro | 2× | $4.00 | $16.00 | $1.00 | Enterprise — full reasoning, high stability. |
| Max | 4× | $8.00 | $32.00 | $2.00 | Premium — max reasoning & stability. |
Solo se enumeran los grupos habilitados para este modelo.
Rendimiento
| Endpoint de API | https://api.airai.cc/v1 |
|---|---|
| Compatible con OpenAI | OpenAI-compatible |
Preguntas frecuentes
¿Cuánto cuesta o3?
Entrada $2.00, salida $8.00 por 1 M de tokens.
¿Cuál es la ventana de contexto de o3?
o3 tiene una ventana de contexto de 200K: el límite combinado de tokens de entrada y salida por solicitud.
¿Cómo llamo a o3 desde el código?
Apunta base_url a https://api.airai.cc/v1 y usa model o3. La API es totalmente compatible con OpenAI.
¿Por qué o3 devuelve el error 429?
429 es una respuesta de límite de tasa. Reduce la concurrencia, reintenta con espera o cambia a un plan con más cuota.
Comparación de modelos
| Model | Proveedor | Entrada | Salida | Contexto |
|---|---|---|---|---|
| o3 | OpenAI | $2.00 | $8.00 | 200K |
| gpt-4.1-nano-2025-04-14 | OpenAI | $0.10 | $0.40 | no especificado |
| gpt-4.1-nano | OpenAI | $0.10 | $0.40 | 1M |
| gpt-audio-2025-08-28 | OpenAI | $2.50 | $5.00 | no especificado |
| gpt-image-2-c | OpenAI | Por solicitud $0.12 | — | no especificado |
| gpt-4o-realtime-preview-2024-10-01 | OpenAI | $5.00 | $20.00 | no especificado |
| gpt-5.2-codex | OpenAI | $0.14 | $1.14 | no especificado |
| gpt-3.5-turbo-16k | OpenAI | $3.00 | $6.00 | no especificado |
| text-embedding-3-small | OpenAI | $0.02 | — | 8.2K |
| gpt-5-mini | OpenAI | $0.25 | $2.00 | 400K |
| o3-pro | OpenAI | $20.00 | $80.00 | 200K |
| gpt-4-1106-preview | OpenAI | $10.00 | $30.00 | no especificado |
| gpt-5.6-sol | OpenAI | $4.00 | $20.00 | 1.1M |
Solución de errores
429 es una respuesta de límite de tasa. Reduce la concurrencia, reintenta con espera o cambia a un plan con más cuota.
Causas habituales
- Demasiadas solicitudes simultáneas
- Cuota del plan actual agotada
- Reintentar sin espera
Cómo solucionarlo
- Limitar la concurrencia y reintentar con espera exponencial
- Cambiar a un plan con más cuota
- Almacenar en caché las solicitudes repetidas
Cómo conectar
curl https://api.airai.cc/v1/chat/completions \
-H "Authorization: Bearer <YOUR_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "o3",
"messages": [{"role": "user", "content": "Hello"}]
}'from openai import OpenAI
client = OpenAI(
api_key="<YOUR_API_KEY>",
base_url="https://api.airai.cc/v1"
)
response = client.chat.completions.create(
model="o3",
messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
apiKey: "<YOUR_API_KEY>",
baseURL: "https://api.airai.cc/v1"
});
const response = await client.chat.completions.create({
model: "o3",
messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);const OpenAI = require("openai");
const client = new OpenAI({
apiKey: "<YOUR_API_KEY>",
baseURL: "https://api.airai.cc/v1"
});
client.chat.completions.create({
model: "o3",
messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));Reemplace <YOUR_API_KEY> con la API Key de su configuración de token.
Puntos finales compatibles
openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search
Gemini SDK · TypeScript
import { GoogleGenerativeAI } from "@google/generative-ai";
const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "o3" });
const result = await model.generateContent(
"Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());Autenticación
Todas las solicitudes deben incluir la cabecera Authorization: Bearer <TOKEN>. Los puntos finales en formato Anthropic también aceptan la cabecera x-api-key. Genere su API Key en la página de Tokens, donde puede limitarla por modelo, grupo, IP y tasa.
Parámetros admitidos
| Parámetro | Tipo | Predeterminado | Rango | Descripción |
|---|---|---|---|---|
temperature | float | 1 | 0–2 | Temperatura de muestreo; menor es más estable |
top_p | float | 1 | 0–1 | Probabilidad acumulada del muestreo nucleus |
max_tokens | integer | — | — | Número máximo de tokens en la respuesta |
frequency_penalty | float | 0 | −2–2 | Penaliza la repetición de tokens frecuentes |
presence_penalty | float | 0 | −2–2 | Favorece la introducción de nuevos temas |
stop | string[] | null | ≤ 4 | Hasta 4 cadenas de parada |
seed | integer | null | — | Semilla para un muestreo más reproducible |
n | integer | 1 | — | Número de candidatos generados |
stream | boolean | false | — | Transmite tokens vía SSE |
response_format | object | — | — | Fuerza salida JSON o resultados conformes al esquema |
tools | array | — | — | Declaraciones de herramientas / funciones que el modelo puede llamar |
tool_choice | string | object | auto | — | Estrategia de selección de herramienta o nombre concreto |
logprobs | boolean | false | — | Devuelve la log-probabilidad de cada token |
top_logprobs | integer | null | 0–20 | Número de probabilidades superiores devueltas por token |
logit_bias | map | — | — | Mapa de sesgo logit por token |
user | string | — | — | Identificador de usuario final para auditoría de riesgos |
Límites de tasa
| Nivel | RPM | TPM | RPD |
|---|---|---|---|
| Eco | 990 | 398K | 20K |
| Test | 980 | 393K | 20K |
Datos actualizados: 2026-10-10 08:15