viduq1 — precio, contexto y rendimiento
viduq1 es un modelo de Vidu con facturación por solicitud: $0.001471 por solicitud.
Resumen
| Proveedor | Vidu |
|---|---|
| Formatos de API | openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search |
Precios
| Por solicitud | $0.001471 |
|---|
Rendimiento
| Endpoint de API | https://api.airai.cc/v1 |
|---|---|
| Compatible con OpenAI | OpenAI-compatible |
Preguntas frecuentes
¿Cuánto cuesta viduq1?
viduq1 se factura por solicitud: $0.001471 por solicitud.
¿Cuál es la ventana de contexto de viduq1?
viduq1 tiene una ventana de contexto de no especificado: el límite combinado de tokens de entrada y salida por solicitud.
¿Cómo llamo a viduq1 desde el código?
Apunta base_url a https://api.airai.cc/v1 y usa model viduq1. La API es totalmente compatible con OpenAI.
¿Por qué viduq1 devuelve el error 429?
429 es una respuesta de límite de tasa. Reduce la concurrencia, reintenta con espera o cambia a un plan con más cuota.
Comparación de modelos
| Model | Proveedor | Entrada | Salida | Contexto |
|---|---|---|---|---|
| viduq1 | Vidu | Por solicitud $0.001471 | — | no especificado |
| viduq1-classic | Vidu | Por solicitud $0.001471 | — | no especificado |
| viduq2-pro | Vidu | Por solicitud $0.001471 | — | no especificado |
| vidu-tts | Vidu | Por solicitud $0.001471 | — | no especificado |
| viduq3-mix | Vidu | Por solicitud $0.001471 | — | no especificado |
| viduq3 | Vidu | Por solicitud $0.001471 | — | no especificado |
| viduq2-turbo | Vidu | Por solicitud $0.001471 | — | no especificado |
| vidu-image-q2 | Vidu | Precio no publicado | — | no especificado |
| viduq3-turbo | Vidu | Por solicitud $0.001471 | — | no especificado |
| viduq3-pro | Vidu | Por solicitud $0.001471 | — | no especificado |
| vidu2.0 | Vidu | Por solicitud $0.001471 | — | no especificado |
| viduq2 | Vidu | Por solicitud $0.001471 | — | no especificado |
Solución de errores
429 es una respuesta de límite de tasa. Reduce la concurrencia, reintenta con espera o cambia a un plan con más cuota.
Causas habituales
- Demasiadas solicitudes simultáneas
- Cuota del plan actual agotada
- Reintentar sin espera
Cómo solucionarlo
- Limitar la concurrencia y reintentar con espera exponencial
- Cambiar a un plan con más cuota
- Almacenar en caché las solicitudes repetidas
Cómo conectar
curl https://api.airai.cc/v1/chat/completions \
-H "Authorization: Bearer <YOUR_API_KEY>" \
-H "Content-Type: application/json" \
-d '{
"model": "viduq1",
"messages": [{"role": "user", "content": "Hello"}]
}'from openai import OpenAI
client = OpenAI(
api_key="<YOUR_API_KEY>",
base_url="https://api.airai.cc/v1"
)
response = client.chat.completions.create(
model="viduq1",
messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
apiKey: "<YOUR_API_KEY>",
baseURL: "https://api.airai.cc/v1"
});
const response = await client.chat.completions.create({
model: "viduq1",
messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);const OpenAI = require("openai");
const client = new OpenAI({
apiKey: "<YOUR_API_KEY>",
baseURL: "https://api.airai.cc/v1"
});
client.chat.completions.create({
model: "viduq1",
messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));Reemplace <YOUR_API_KEY> con la API Key de su configuración de token.
Puntos finales compatibles
openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search
Gemini SDK · TypeScript
import { GoogleGenerativeAI } from "@google/generative-ai";
const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "viduq1" });
const result = await model.generateContent(
"Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());Autenticación
Todas las solicitudes deben incluir la cabecera Authorization: Bearer <TOKEN>. Los puntos finales en formato Anthropic también aceptan la cabecera x-api-key. Genere su API Key en la página de Tokens, donde puede limitarla por modelo, grupo, IP y tasa.
Parámetros admitidos
| Parámetro | Tipo | Predeterminado | Rango | Descripción |
|---|---|---|---|---|
temperature | float | 1 | 0–2 | Temperatura de muestreo; menor es más estable |
top_p | float | 1 | 0–1 | Probabilidad acumulada del muestreo nucleus |
max_tokens | integer | — | — | Número máximo de tokens en la respuesta |
frequency_penalty | float | 0 | −2–2 | Penaliza la repetición de tokens frecuentes |
presence_penalty | float | 0 | −2–2 | Favorece la introducción de nuevos temas |
stop | string[] | null | ≤ 4 | Hasta 4 cadenas de parada |
seed | integer | null | — | Semilla para un muestreo más reproducible |
n | integer | 1 | — | Número de candidatos generados |
stream | boolean | false | — | Transmite tokens vía SSE |
response_format | object | — | — | Fuerza salida JSON o resultados conformes al esquema |
tools | array | — | — | Declaraciones de herramientas / funciones que el modelo puede llamar |
tool_choice | string | object | auto | — | Estrategia de selección de herramienta o nombre concreto |
logprobs | boolean | false | — | Devuelve la log-probabilidad de cada token |
top_logprobs | integer | null | 0–20 | Número de probabilidades superiores devueltas por token |
logit_bias | map | — | — | Mapa de sesgo logit por token |
user | string | — | — | Identificador de usuario final para auditoría de riesgos |
Límites de tasa
| Nivel | RPM | TPM | RPD |
|---|---|---|---|
| Eco | 990 | 398K | 20K |
| Test | 980 | 393K | 20K |
Datos actualizados: 2026-10-10 08:15