Fehler 403: was tun, wenn qvq-max fehlschlägt

Ein 403 bedeutet, dass Sie authentifiziert sind, aber keine Berechtigung haben: Der Key ist gültig, darf dieses Modell oder diese Gruppe jedoch nicht aufrufen.

403 Forbidden bedeutet, dass die Identität erkannt wurde, der Zugriff aber verweigert ist. Der Unterschied zu 401: 401 fragt wer du bist, 403 sagt dir fehlen die Rechte. Meist muss das Modell in die Allowed-Liste oder Gruppe des Schlüssels aufgenommen werden.

qvq-max wird von Alibaba bereitgestellt. Alles auf dieser Seite — Ursachen, Lösungen und gemessene Daten — basiert auf dem tatsächlichen Laufzeitverhalten dieses Modells auf der Gatewayschicht.

An diesem Gateway ist die häufigste Ursache: Dieser Key ist für dieses Modell nicht freigegeben. Empfohlene erste Maßnahme: Fügen Sie dieses Modell auf der Tokens-Seite zur Allowlist des Keys hinzu.

Häufige Ursachen

  • Dieser Key ist für dieses Modell nicht freigegeben
  • Das Modell liegt nicht in der Gruppe, an die der Key gebunden ist
  • Der Key hat eine IP-Allowlist, die Ihre aktuelle IP ausschließt
  • Das Modell wurde eingestellt oder erfordert höhere Rechte

So beheben Sie es

  • Fügen Sie dieses Modell auf der Tokens-Seite zur Allowlist des Keys hinzu
  • Prüfen Sie, ob die Gruppe des Keys dieses Modell enthält
  • Überprüfen Sie die Einstellungen der IP-Allowlist
  • Wechseln Sie zu einem Modell, das Sie aufrufen dürfen

Wiederholung mit exponentiellem Backoff

Der folgende Code wiederholt den Aufruf, wenn qvq-max 403 liefert: bis zu 5 Versuche, mit wachsender Wartezeit und zufälligem Jitter, damit parallele Anfragen nicht gleichzeitig wiederholen. Base-URL und API-Key werden aus Umgebungsvariablen gelesen — nicht hart codieren.

import os, time, random
import requests

BASE  = os.getenv("OPENAI_BASE_URL")   # e.g. https://<your-gateway>/v1
KEY   = os.getenv("OPENAI_API_KEY")
MODEL = 'qvq-max'


def chat(messages, retries=5):
    """Retry with exponential backoff + jitter."""
    for i in range(retries):
        try:
            r = requests.post(
                BASE + "/chat/completions",
                headers={"Authorization": "Bearer " + KEY},
                json={"model": MODEL, "messages": messages, "stream": True},
                timeout=60,
            )
            if r.status_code == 429 or r.status_code >= 500:
                time.sleep(min(2 ** i + random.uniform(0, 1), 30))
                continue
            r.raise_for_status()
            return r.json()
        except requests.exceptions.Timeout:
            time.sleep(min(2 ** i + random.uniform(0, 1), 30))
    raise RuntimeError("gave up after " + str(retries) + " retries")


print(chat([{"role": "user", "content": "hello"}]))

Wichtige Daten zu diesem Modell

API-Endpunkthttps://api.airai.cc/v1
OpenAI-kompatibelOpenAI-compatible
AnbieterAlibaba
Kontext131.1K
FunktionenReasoning, Tools, Vision
API-Formateopenai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search
Abrechnungsformelp * 1.2 + c * 4.8

Häufige Fragen

Wie nutze ich den Retry-After-Header in der Antwort?

Business-Code muss meist nicht geändert werden, nur der Aufruftakt. Ein Retry ist der wirksamste erste Schritt. Bei der Abrechnung p * 1.2 + c * 4.8 werden fehlgeschlagene Anfragen nicht angerechnet. Setzen Sie die Obergrenze auf 3–5 Versuche und ergänzen Sie Jitter. Wiederholbare Fehler mit exponentiellem Backoff, der Rest sofort als Fehler zurückgeben.

Tritt 403 eher bei direkten Frontend-Aufrufen oder über einen Backend-Proxy auf?

Halten Sie zusätzlich ein Ausweichmodell bereit. Dieses Modell von Alibaba hat mehrere Upstream-Knoten, zwischen denen das Gateway wechseln kann. Halten Sie ein leichteres Ersatzmodell bereit, damit der Hauptfluss nicht abbricht. Legen Sie den Modellnamen in die Konfiguration, dann braucht ein Upstream-Wechsel keine Codeänderung.

Betrifft 403 bereits an qvq-max gesendete Anfragen?

Dieser Fehler hängt nicht mit der Modellfähigkeit zusammen, er liegt auf Gateway-Ebene. Meist ist es ein kurzzeitiges Problem, das von selbst verschwindet. Die Fähigkeits-Tags dieses Modells sind Reasoning, Tools, Vision. Besteht der Fehler mehrere Minuten, kontaktieren Sie den Plattform-Support zum Upstream-Status.

Macht ein langer Kontext 403 wahrscheinlicher?

Die Request-Parameter müssen geändert werden; Retry allein hilft nicht. Die Fähigkeits-Tags sind Reasoning, Tools, Vision, daraus ergeben sich die Parameter-Obergrenzen. Kürzen oder verdichten Sie lange Eingaben — das senkt 403 deutlich.

Weitere Fehler bei diesem Modell

Andere Modelle mit demselben Fehler

Daten aktualisiert: 2026-10-10 12:10

Technischer SupportLive-Support
Nach oben