الخطأ timeout: ماذا تفعل عندما يفشل glm-5.1
انتهاء المهلة يعني أن العميل استسلم قبل وصول الاستجابة. طلبات البث إلى نماذج اللغة هي الأكثر عرضة لذلك، لأن النموذج يفكر قبل الرمز الأول وتلك المرحلة لا تنتج أي بايت.
انتهاء المهلة ليس رمز حالة HTTP، بل حد انتظار من جانب العميل. عادةً ما يصل الطلب إلى البوابة ويُحوّل إلى المورّد، لكن النموذج لم يُنتج نتيجة خلال الوقت الذي حددته. السياق الطويل، والمخرجات الطويلة، والاستدعاء بدون بث مباشر هي الأسباب الثلاثة الأكثر شيوعاً.
glm-5.1 مقدمة من Z.AI. كل ما في هذه الصفحة — الأسباب والحلول والبيانات المقاسة — مستقى من السلوك التشغيلي الفعلي لهذا النموذج على مستوى البوابة.
في هذه البوابة، السبب الأكثر شيوعًا هو: مهلة العميل مضبوطة على قيمة صغيرة جداً. والإجراء الأول الموصى به هو: ارفع مهلة العميل إلى 300 ثانية أو أكثر.
الأسباب الشائعة
- مهلة العميل مضبوطة على قيمة صغيرة جداً
- طُول النص التوجيهي أو السياق يرفع زمن الرمز الأول
- النموذج يعالج مهمة استدلال طويلة
- تذبذب الشبكة
كيفية الإصلاح
- ارفع مهلة العميل إلى 300 ثانية أو أكثر
- فعّل البث حتى لا تنتظر الاستجابة كاملة
- قصّر السياق أو استخدم نموذجاً أسرع
- قلّل max_tokens
مثال على إعادة المحاولة مع تأخير أُسّي
الكود أدناه يعيد المحاولة عندما يُرجع glm-5.1 الخطأ timeout، حتى 5 محاولات، مع وقت انتظار متزايد وتشويش عشوائي حتى لا تُعيد الطلبات المتوازية المحاولة في اللحظة نفسها. اقرأ base URL ومفتاح API من متغيرات البيئة ولا تثبّتها داخل الكود.
import os, time, random
import requests
BASE = os.getenv("OPENAI_BASE_URL") # e.g. https://<your-gateway>/v1
KEY = os.getenv("OPENAI_API_KEY")
MODEL = 'glm-5.1'
def chat(messages, retries=5):
"""Retry with exponential backoff + jitter."""
for i in range(retries):
try:
r = requests.post(
BASE + "/chat/completions",
headers={"Authorization": "Bearer " + KEY},
json={"model": MODEL, "messages": messages, "stream": True},
timeout=60,
)
if r.status_code == 429 or r.status_code >= 500:
time.sleep(min(2 ** i + random.uniform(0, 1), 30))
continue
r.raise_for_status()
return r.json()
except requests.exceptions.Timeout:
time.sleep(min(2 ** i + random.uniform(0, 1), 30))
raise RuntimeError("gave up after " + str(retries) + " retries")
print(chat([{"role": "user", "content": "hello"}]))بيانات أساسية لهذا النموذج
| نقطة نهاية API | https://api.airai.cc/v1 |
|---|---|
| متوافق مع OpenAI | OpenAI-compatible |
| المزوّد | Z.AI |
|---|---|
| السياق | 200K |
| القدرات | Reasoning, Tools, Open Weights |
| صيغ API | openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search |
| صيغة الفوترة | p * 1.4 + cr * 0.26 + cc * 0 + c * 4.4 |
الأسئلة الشائعة
هل يرتبط timeout بطريقة فوترة glm-5.1؟
لا توجد رسوم، فالمخرجات التي أُنتجت فعلياً فقط هي ما يُحتسب ضمن الاستخدام. مع الفوترة p * 1.4 + cr * 0.26 + cc * 0 + c * 4.4، تأتي تكلفة المخرجات الطويلة أساساً من رموز الإخراج. مع احتساب التكلفة بـ p * 1.4 + cr * 0.26 + cc * 0 + c * 4.4، لا تُحسب الطلبات الفاشلة ضمن الاستخدام. تحقق من الرصيد وحدود المعدل في لوحة التحكم أولاً، ثم افحص الكود. عند تقدير التكلفة من p * 1.4 + cr * 0.26 + cc * 0 + c * 4.4، أدخل ميزانية إعادة المحاولة أيضاً.
عند ظهور timeout هل أنتقل إلى نموذج احتياطي؟
احتفظ أيضاً بنموذج احتياطي جاهز. لهذا النموذج من Z.AI عدة عقد upstream يمكن للبوابة التبديل بينها. جهّز نموذجاً احتياطياً أخفّ حتى لا ينقطع المسار الرئيسي.
ما مقدار التزامن الآمن؟
المتغيّران الحقيقيان هنا هما التزامن والمهلة، وليس النموذج نفسه. خفّض التزامن أولاً — معظم مشاكل معدل النقل تختفي بعدها. نافذة السياق لهذا النموذج 200K وهو من Z.AI. سياق 200K يعني أن المدخلات الطويلة تزيد زمن أول رمز بشكل ملحوظ. ابدأ بتزامن منخفض، وراقب لدقائق، ثم زد تدريجياً. أضف طبقة تخزين مؤقت حتى لا تصل الطلبات المتكررة كلها إلى النموذج.
كيف أستخدم ترويسة Retry-After في الاستجابة؟
إعادة المحاولة هي الخطوة الأولى الأكثر فعالية. مع احتساب التكلفة بـ p * 1.4 + cr * 0.26 + cc * 0 + c * 4.4، لا تُحسب الطلبات الفاشلة ضمن الاستخدام. استخدم تراجعاً أُسّياً للأخطاء القابلة لإعادة المحاولة، وأرجع الخطأ فوراً للباقي.
أخطاء أخرى في هذا النموذج
- glm-5.1: خطأ 429 — الأسباب والحلول
- glm-5.1: خطأ 500 — الأسباب والحلول
- glm-5.1: خطأ 502 — الأسباب والحلول
- glm-5.1: خطأ 503 — الأسباب والحلول
- glm-5.1: خطأ 504 — الأسباب والحلول
- glm-5.1: خطأ 401 — الأسباب والحلول
- glm-5.1: خطأ 403 — الأسباب والحلول
- glm-5.1: خطأ 400 — الأسباب والحلول
نماذج أخرى تواجه الخطأ نفسه
- gpt-5
- claude-opus-5
- gemini-2.5-pro
- deepseek-v4-pro
- grok-4.3
- llama-3.3-70b-instruct
- qvq-max
- qwq-32b
- glm-5
- MiniMax-M3
- kimi-k3
- hy3
- doubao-seed-evolving
- mimo-v2.5
- gpt-4o
- claude-opus-4-6
تحديث البيانات: 2026-10-10 12:10