claude-sonnet-5-thinking — prix, contexte et performances

claude-sonnet-5-thinking est un modèle Anthropic disponible sur AirAI via une API compatible OpenAI. Le prix exact est indiqué lors de la commande.

Aperçu

FournisseurAnthropic
Formats d’APIanthropic, openai

Tarifs

Prix non publiéCe fournisseur ne publie pas de prix unitaire. Le coût final est calculé lors de la commande.

Performances

Point de terminaison APIhttps://api.airai.cc/v1
Compatible OpenAIOpenAI-compatible

Questions fréquentes

Combien coûte claude-sonnet-5-thinking ?
claude-sonnet-5-thinking ne publie pas de prix unitaire ; le coût final est calculé lors de la commande.
Quelle est la fenêtre de contexte de claude-sonnet-5-thinking ?
claude-sonnet-5-thinking dispose d’une fenêtre de contexte de non spécifié : la limite combinée de tokens en entrée et en sortie par requête.
Comment appeler claude-sonnet-5-thinking depuis le code ?
Pointez base_url vers https://api.airai.cc/v1 et définissez model sur claude-sonnet-5-thinking. L’API est entièrement compatible OpenAI.
Pourquoi claude-sonnet-5-thinking renvoie-t-il l’erreur 429 ?
429 est une réponse de limitation de débit. Réduisez la concurrence, réessayez avec temporisation ou passez à une offre avec plus de quota.

Comparaison des modèles

ModelFournisseurEntréeSortieContexte
claude-sonnet-5-thinkingAnthropicPrix non publié—non spécifié
claude-haiku-4-5-20251001Anthropic$1.00$5.00200K
claude-sonnet-5Anthropic$2.00$10.001M
claude-3-5-haiku-20241022Anthropic$0.80$4.00non spécifié
claude-opus-4-1-20250805Anthropic$13.50$67.50non spécifié
claude-haiku-4-5Anthropic$1.00$5.00200K
claude-sonnet-4-20250514Anthropic$2.70$13.50non spécifié
claude-sonnet-4-6-thinkingAnthropic$3.00$15.00non spécifié
claude-sonnet-5-5Anthropic$2.00$10.00non spécifié
claude-fable-5.1Anthropic$10.00$50.00non spécifié
claude-sonnet-4-5-20250929Anthropic$3.00$15.001M
claude-opus-4-5-20251101-thinkingAnthropic$5.00$25.00non spécifié
claude-opus-4-6Anthropic$5.00$25.001M

Dépannage

429 est une réponse de limitation de débit. Réduisez la concurrence, réessayez avec temporisation ou passez à une offre avec plus de quota.

Causes fréquentes

  • Trop de requêtes simultanées
  • Quota de l’offre actuelle épuisé
  • Nouvelle tentative sans délai

Comment corriger

  • Limiter la concurrence et réessayer avec un délai exponentiel
  • Passer à une offre avec plus de quota
  • Mettre en cache les requêtes répétées

Comment connecter

curl https://api.airai.cc/v1/chat/completions \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-thinking",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
from openai import OpenAI

client = OpenAI(
    api_key="<YOUR_API_KEY>",
    base_url="https://api.airai.cc/v1"
)

response = client.chat.completions.create(
    model="claude-sonnet-5-thinking",
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

const response = await client.chat.completions.create({
  model: "claude-sonnet-5-thinking",
  messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);
const OpenAI = require("openai");

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

client.chat.completions.create({
  model: "claude-sonnet-5-thinking",
  messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));

Remplacez <YOUR_API_KEY> par l'API Key de vos paramètres de jeton.

Points de terminaison compatibles

openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search

Gemini SDK · TypeScript

import { GoogleGenerativeAI } from "@google/generative-ai";

const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "claude-sonnet-5-thinking" });

const result = await model.generateContent(
  "Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());

Authentification

Toutes les requêtes doivent inclure l'en-tête Authorization: Bearer <TOKEN>. Les points de terminaison au format Anthropic acceptent aussi l'en-tête x-api-key. Générez votre API Key sur la page Jetons, où vous pouvez la limiter par modèle, groupe, IP et débit.

Paramètres pris en charge

ParamètreTypeDéfautPlageDescription
temperaturefloat10–2Température d'échantillonnage ; plus bas est plus stable
top_pfloat10–1Probabilité cumulée de l'échantillonnage nucleus
max_tokensinteger——Nombre maximal de tokens dans la réponse
frequency_penaltyfloat0−2–2Pénalise la répétition des tokens fréquents
presence_penaltyfloat0−2–2Encourage l'introduction de nouveaux sujets
stopstring[]null≤ 4Jusqu'à 4 chaînes d'arrêt
seedintegernull—Graine pour un échantillonnage plus reproductible
ninteger1—Nombre de candidats générés
streambooleanfalse—Diffuse les tokens via SSE
response_formatobject——Force la sortie JSON ou un résultat conforme au schéma
toolsarray——Déclarations d'outils / fonctions appelables par le modèle
tool_choicestring | objectauto—Stratégie de sélection d'outil ou nom d'outil
logprobsbooleanfalse—Renvoie la log-probabilité de chaque token
top_logprobsintegernull0–20Nombre de probabilités supérieures renvoyées par token
logit_biasmap——Correspondance de biais logit par token
userstring——Identifiant de l'utilisateur final pour l'audit des risques

Limites de débit

NiveauRPMTPMRPD
Eco990398K20K
Test980393K20K

Données mises à jour: 2026-10-10 18:35

Support techniqueAssistance en ligne
Haut de page