Fehler 502: was tun, wenn gpt-5-nano fehlschlägt
Ein 502 bedeutet, dass das Gateway eine ungültige Antwort vom vorgelagerten Modelldienst erhalten hat: Die Anfrage erreichte das Gateway, aber der Sprung zum vorgelagerten Dienst ist fehlgeschlagen.
502 Bad Gateway bedeutet, dass das Gateway eine ungültige Antwort vom Upstream-Modellservice erhalten hat. Die Anfrage erreichte das Gateway; der Fehler passierte auf dem Hop vom Gateway zum Upstream, meist durch einen Neustart oder eine getrennte Verbindung.
gpt-5-nano wird von OpenAI bereitgestellt. Alles auf dieser Seite — Ursachen, Lösungen und gemessene Daten — basiert auf dem tatsächlichen Laufzeitverhalten dieses Modells auf der Gatewayschicht.
An diesem Gateway ist die häufigste Ursache: Der vorgelagerte Modelldienst ist nicht verfügbar oder antwortet fehlerhaft. Empfohlene erste Maßnahme: Versuchen Sie es einmal erneut — 502 sind meist vorübergehend.
Häufige Ursachen
- Der vorgelagerte Modelldienst ist nicht verfügbar oder antwortet fehlerhaft
- Ein vorgelagerter Knoten startet neu
- Die Verbindung vom Gateway zum vorgelagerten Dienst wurde unterbrochen
- Das Modell wurde vorübergehend offline genommen
So beheben Sie es
- Versuchen Sie es einmal erneut — 502 sind meist vorübergehend
- Wechseln Sie zu einem gleichwertigen Modell eines anderen Anbieters
- Tritt 502 nur bei einem Modell auf, ist dessen vorgelagerter Dienst gestört
- Versuchen Sie es später erneut oder kontaktieren Sie uns
Wiederholung mit exponentiellem Backoff
Der folgende Code wiederholt den Aufruf, wenn gpt-5-nano 502 liefert: bis zu 5 Versuche, mit wachsender Wartezeit und zufälligem Jitter, damit parallele Anfragen nicht gleichzeitig wiederholen. Base-URL und API-Key werden aus Umgebungsvariablen gelesen — nicht hart codieren.
import os, time, random
import requests
BASE = os.getenv("OPENAI_BASE_URL") # e.g. https://<your-gateway>/v1
KEY = os.getenv("OPENAI_API_KEY")
MODEL = 'gpt-5-nano'
def chat(messages, retries=5):
"""Retry with exponential backoff + jitter."""
for i in range(retries):
try:
r = requests.post(
BASE + "/chat/completions",
headers={"Authorization": "Bearer " + KEY},
json={"model": MODEL, "messages": messages, "stream": True},
timeout=60,
)
if r.status_code == 429 or r.status_code >= 500:
time.sleep(min(2 ** i + random.uniform(0, 1), 30))
continue
r.raise_for_status()
return r.json()
except requests.exceptions.Timeout:
time.sleep(min(2 ** i + random.uniform(0, 1), 30))
raise RuntimeError("gave up after " + str(retries) + " retries")
print(chat([{"role": "user", "content": "hello"}]))Wichtige Daten zu diesem Modell
| API-Endpunkt | https://api.airai.cc/v1 |
|---|---|
| OpenAI-kompatibel | OpenAI-compatible |
| Anbieter | OpenAI |
|---|---|
| Kontext | 400K |
| Funktionen | Reasoning, Tools, Files, Vision |
| API-Formate | openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search |
| Abrechnungsformel | p * 0.05 + cr * 0.005 + c * 0.4 |
Häufige Fragen
Zählen fehlgeschlagene Anfragen zum Rate-Limit-Kontingent?
Berechnet wird nur der bereits erzeugte Output, der fehlgeschlagene Teil nicht. Die Abrechnung folgt p * 0.05 + cr * 0.005 + c * 0.4, ohne Ausgabe also keine Kosten. Bei der Abrechnung p * 0.05 + cr * 0.005 + c * 0.4 werden fehlgeschlagene Anfragen nicht angerechnet. Prüfen Sie zuerst Guthaben und Rate-Limits in der Konsole, dann den Code. Wenn Sie Kosten nach p * 0.05 + cr * 0.005 + c * 0.4 schätzen, rechnen Sie das Retry-Budget mit ein.
Wechselt das Gateway bei mehreren Upstream-Knoten bei 502 automatisch?
Dieser Fehler hängt nicht mit der Modellfähigkeit zusammen, er liegt auf Gateway-Ebene. Die Fähigkeits-Tags dieses Modells sind Reasoning, Tools, Files, Vision. Besteht der Fehler mehrere Minuten, kontaktieren Sie den Plattform-Support zum Upstream-Status. Klären Sie zuerst Account-Ebene oder Modell-Ebene; beides wird völlig unterschiedlich behandelt.
Lässt sich 502 bei gpt-5-nano durch ein anderes Modell umgehen?
Halten Sie zusätzlich ein Ausweichmodell bereit. Ein Fallback in der Architektur ist verlässlicher als jede Fehlermeldung einzeln zu flicken. Dieses Modell von OpenAI hat mehrere Upstream-Knoten, zwischen denen das Gateway wechseln kann. Legen Sie den Modellnamen in die Konfiguration, dann braucht ein Upstream-Wechsel keine Codeänderung.
Das offizielle SDK retryt bereits — brauche ich eigene Logik?
Business-Code muss meist nicht geändert werden, nur der Aufruftakt. Ein Retry ist der wirksamste erste Schritt. Bei der Abrechnung p * 0.05 + cr * 0.005 + c * 0.4 werden fehlgeschlagene Anfragen nicht angerechnet. Wiederholbare Fehler mit exponentiellem Backoff, der Rest sofort als Fehler zurückgeben.
Weitere Fehler bei diesem Modell
- gpt-5-nano: Fehler 429 — Ursachen und Lösungen
- gpt-5-nano: Fehler timeout — Ursachen und Lösungen
- gpt-5-nano: Fehler 500 — Ursachen und Lösungen
- gpt-5-nano: Fehler 503 — Ursachen und Lösungen
- gpt-5-nano: Fehler 504 — Ursachen und Lösungen
- gpt-5-nano: Fehler 401 — Ursachen und Lösungen
- gpt-5-nano: Fehler 403 — Ursachen und Lösungen
- gpt-5-nano: Fehler 400 — Ursachen und Lösungen
Andere Modelle mit demselben Fehler
- gpt-5
- claude-opus-5
- gemini-2.5-pro
- deepseek-v4-pro
- grok-4.3
- llama-3.3-70b-instruct
- qvq-max
- qwq-32b
- glm-5
- MiniMax-M3
- kimi-k3
- hy3
- doubao-seed-evolving
- mimo-v2.5
- gpt-4o
- claude-opus-4-6
Daten aktualisiert: 2026-10-10 18:35