vidu2.0 — precio, contexto y rendimiento

vidu2.0 es un modelo de Vidu con facturación por solicitud: $0.001471 por solicitud.

Resumen

ProveedorVidu
Formatos de APIopenai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search

Precios

Por solicitud$0.001471

Rendimiento

Endpoint de APIhttps://api.airai.cc/v1
Compatible con OpenAIOpenAI-compatible

Preguntas frecuentes

¿Cuánto cuesta vidu2.0?
vidu2.0 se factura por solicitud: $0.001471 por solicitud.
¿Cuál es la ventana de contexto de vidu2.0?
vidu2.0 tiene una ventana de contexto de no especificado: el límite combinado de tokens de entrada y salida por solicitud.
¿Cómo llamo a vidu2.0 desde el código?
Apunta base_url a https://api.airai.cc/v1 y usa model vidu2.0. La API es totalmente compatible con OpenAI.
¿Por qué vidu2.0 devuelve el error 429?
429 es una respuesta de límite de tasa. Reduce la concurrencia, reintenta con espera o cambia a un plan con más cuota.

Comparación de modelos

ModelProveedorEntradaSalidaContexto
vidu2.0ViduPor solicitud $0.001471—no especificado
viduq3-proViduPor solicitud $0.001471—no especificado
viduq2ViduPor solicitud $0.001471—no especificado
viduq1ViduPor solicitud $0.001471—no especificado
viduq3ViduPor solicitud $0.001471—no especificado
viduq1-classicViduPor solicitud $0.001471—no especificado
viduq2-proViduPor solicitud $0.001471—no especificado
viduq2-turboViduPor solicitud $0.001471—no especificado
vidu-ttsViduPor solicitud $0.001471—no especificado
viduq3-mixViduPor solicitud $0.001471—no especificado
vidu-image-q2ViduPrecio no publicado—no especificado
viduq3-turboViduPor solicitud $0.001471—no especificado

Solución de errores

429 es una respuesta de límite de tasa. Reduce la concurrencia, reintenta con espera o cambia a un plan con más cuota.

Causas habituales

  • Demasiadas solicitudes simultáneas
  • Cuota del plan actual agotada
  • Reintentar sin espera

Cómo solucionarlo

  • Limitar la concurrencia y reintentar con espera exponencial
  • Cambiar a un plan con más cuota
  • Almacenar en caché las solicitudes repetidas

Cómo conectar

curl https://api.airai.cc/v1/chat/completions \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "vidu2.0",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
from openai import OpenAI

client = OpenAI(
    api_key="<YOUR_API_KEY>",
    base_url="https://api.airai.cc/v1"
)

response = client.chat.completions.create(
    model="vidu2.0",
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

const response = await client.chat.completions.create({
  model: "vidu2.0",
  messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);
const OpenAI = require("openai");

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

client.chat.completions.create({
  model: "vidu2.0",
  messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));

Reemplace <YOUR_API_KEY> con la API Key de su configuración de token.

Puntos finales compatibles

openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search

Gemini SDK · TypeScript

import { GoogleGenerativeAI } from "@google/generative-ai";

const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "vidu2.0" });

const result = await model.generateContent(
  "Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());

Autenticación

Todas las solicitudes deben incluir la cabecera Authorization: Bearer <TOKEN>. Los puntos finales en formato Anthropic también aceptan la cabecera x-api-key. Genere su API Key en la página de Tokens, donde puede limitarla por modelo, grupo, IP y tasa.

Parámetros admitidos

ParámetroTipoPredeterminadoRangoDescripción
temperaturefloat10–2Temperatura de muestreo; menor es más estable
top_pfloat10–1Probabilidad acumulada del muestreo nucleus
max_tokensinteger——Número máximo de tokens en la respuesta
frequency_penaltyfloat0−2–2Penaliza la repetición de tokens frecuentes
presence_penaltyfloat0−2–2Favorece la introducción de nuevos temas
stopstring[]null≤ 4Hasta 4 cadenas de parada
seedintegernull—Semilla para un muestreo más reproducible
ninteger1—Número de candidatos generados
streambooleanfalse—Transmite tokens vía SSE
response_formatobject——Fuerza salida JSON o resultados conformes al esquema
toolsarray——Declaraciones de herramientas / funciones que el modelo puede llamar
tool_choicestring | objectauto—Estrategia de selección de herramienta o nombre concreto
logprobsbooleanfalse—Devuelve la log-probabilidad de cada token
top_logprobsintegernull0–20Número de probabilidades superiores devueltas por token
logit_biasmap——Mapa de sesgo logit por token
userstring——Identificador de usuario final para auditoría de riesgos

Límites de tasa

NivelRPMTPMRPD
Eco990398K20K
Test980393K20K

Datos actualizados: 2026-10-10 18:30

Soporte técnicoSoporte en línea
Volver arriba