claude-sonnet-5-thinking — prezzo, contesto e prestazioni

claude-sonnet-5-thinking è un modello Anthropic disponibile su AirAI tramite una API compatibile OpenAI. Il prezzo esatto è indicato in fase di conferma.

Panoramica

FornitoreAnthropic
Formati APIanthropic, openai

Prezzi

Prezzo non pubblicatoQuesto fornitore non pubblica un prezzo unitario. Il costo finale viene calcolato in fase di conferma.

Prestazioni

Endpoint APIhttps://api.airai.cc/v1
Compatibile con OpenAIOpenAI-compatible

Domande frequenti

Quanto costa claude-sonnet-5-thinking?
claude-sonnet-5-thinking non pubblica un prezzo unitario; il costo finale viene calcolato in fase di conferma.
Qual è la finestra di contesto di claude-sonnet-5-thinking?
claude-sonnet-5-thinking ha una finestra di contesto di non specificato: il limite combinato di token in input e output per richiesta.
Come chiamare claude-sonnet-5-thinking dal codice?
Imposta base_url su https://api.airai.cc/v1 e model su claude-sonnet-5-thinking. L’API è completamente compatibile con OpenAI.
Perché claude-sonnet-5-thinking restituisce l’errore 429?
429 è una risposta di limite di richieste. Riduci la concorrenza, ritenta con backoff o passa a un piano con quota maggiore.

Confronto modelli

ModelFornitoreInputOutputContesto
claude-sonnet-5-thinkingAnthropicPrezzo non pubblicato—non specificato
claude-sonnet-5Anthropic$2.00$10.001M
claude-sonnet-4-5-20250929Anthropic$3.00$15.001M
claude-fable-5-1Anthropic$10.00$50.001M
claude-sonnet-4-20250514Anthropic$2.70$13.50non specificato
claude-opus-4-5-20251101Anthropic$5.00$25.00200K
claude-opus-4-5-20251101-thinkingAnthropic$5.00$25.00non specificato
claude-opus-5-thinkingAnthropic$5.00$25.00non specificato
claude-sonnet-4-5Anthropic$3.00$15.001M
claude-opus-5Anthropic$5.00$25.001M
claude-haiku-4-5-20251001Anthropic$1.00$5.00200K
claude-opus-4-20250514Anthropic$13.50$67.50non specificato
claude-sonnet-4-5-thinkingAnthropic$3.00$15.00non specificato

Risoluzione errori

429 è una risposta di limite di richieste. Riduci la concorrenza, ritenta con backoff o passa a un piano con quota maggiore.

Cause comuni

  • Troppe richieste simultanee
  • Quota del piano attuale esaurita
  • Nuovo tentativo senza attesa

Come risolvere

  • Limitare la concorrenza e ritentare con backoff esponenziale
  • Passare a un piano con quota maggiore
  • Mettere in cache le richieste ripetute

Come collegare

curl https://api.airai.cc/v1/chat/completions \
  -H "Authorization: Bearer <YOUR_API_KEY>" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "claude-sonnet-5-thinking",
    "messages": [{"role": "user", "content": "Hello"}]
  }'
from openai import OpenAI

client = OpenAI(
    api_key="<YOUR_API_KEY>",
    base_url="https://api.airai.cc/v1"
)

response = client.chat.completions.create(
    model="claude-sonnet-5-thinking",
    messages=[{"role": "user", "content": "Hello"}]
)
print(response.choices[0].message.content)
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

const response = await client.chat.completions.create({
  model: "claude-sonnet-5-thinking",
  messages: [{ role: "user", content: "Hello" }]
});
console.log(response.choices[0].message.content);
const OpenAI = require("openai");

const client = new OpenAI({
  apiKey: "<YOUR_API_KEY>",
  baseURL: "https://api.airai.cc/v1"
});

client.chat.completions.create({
  model: "claude-sonnet-5-thinking",
  messages: [{ role: "user", content: "Hello" }]
}).then((r) => console.log(r.choices[0].message.content));

Sostituisci <YOUR_API_KEY> con l'API Key delle impostazioni token.

Endpoint compatibili

openaiopenai-responseopenai-response-compactanthropicgeminiopenai-alpha-search

Gemini SDK · TypeScript

import { GoogleGenerativeAI } from "@google/generative-ai";

const genAI = new GoogleGenerativeAI("<YOUR_API_KEY>");
const model = genAI.getGenerativeModel({ model: "claude-sonnet-5-thinking" });

const result = await model.generateContent(
  "Explain quantum entanglement in one paragraph."
);
console.log(result.response.text());

Autenticazione

Tutte le richieste devono includere l'intestazione Authorization: Bearer <TOKEN>. Gli endpoint in formato Anthropic accettano anche l'intestazione x-api-key. Genera la tua API Key nella pagina Token, dove puoi limitarla per modello, gruppo, IP e frequenza.

Parametri supportati

ParametroTipoPredefinitoIntervalloDescrizione
temperaturefloat10–2Temperatura di campionamento; più bassa è più stabile
top_pfloat10–1Probabilità cumulativa del campionamento nucleus
max_tokensinteger——Numero massimo di token nella risposta
frequency_penaltyfloat0−2–2Punisce la ripetizione di token frequenti
presence_penaltyfloat0−2–2Incoraggia l'introduzione di nuovi argomenti
stopstring[]null≤ 4Fino a 4 stringhe di arresto
seedintegernull—Seme per un campionamento più riproducibile
ninteger1—Numero di candidati generati
streambooleanfalse—Streaming dei token via SSE
response_formatobject——Forza output JSON o risultati conformi allo schema
toolsarray——Dichiarazioni di strumenti / funzioni richiamabili dal modello
tool_choicestring | objectauto—Strategia di selezione dello strumento o nome specifico
logprobsbooleanfalse—Restituisce il log-probabilità di ogni token
top_logprobsintegernull0–20Numero di probabilità principali restituite per token
logit_biasmap——Mappatura del logit bias per token
userstring——Identificativo dell'utente finale per audit di rischio

Limiti di frequenza

LivelloRPMTPMRPD
Eco990398K20K
Test980393K20K

Dati aggiornati: 2026-10-10 08:15

Supporto tecnicoAssistenza online
Torna in alto