الخطأ timeout: ماذا تفعل عندما يفشل gemini-3.1-pro-preview
انتهاء المهلة يعني أن العميل استسلم قبل وصول الاستجابة. طلبات البث إلى نماذج اللغة هي الأكثر عرضة لذلك، لأن النموذج يفكر قبل الرمز الأول وتلك المرحلة لا تنتج أي بايت.
انتهاء المهلة ليس رمز حالة HTTP، بل حد انتظار من جانب العميل. عادةً ما يصل الطلب إلى البوابة ويُحوّل إلى المورّد، لكن النموذج لم يُنتج نتيجة خلال الوقت الذي حددته. السياق الطويل، والمخرجات الطويلة، والاستدعاء بدون بث مباشر هي الأسباب الثلاثة الأكثر شيوعاً.
gemini-3.1-pro-preview مقدمة من Google. كل ما في هذه الصفحة — الأسباب والحلول والبيانات المقاسة — مستقى من السلوك التشغيلي الفعلي لهذا النموذج على مستوى البوابة.
في هذه البوابة، السبب الأكثر شيوعًا هو: مهلة العميل مضبوطة على قيمة صغيرة جداً. والإجراء الأول الموصى به هو: ارفع مهلة العميل إلى 300 ثانية أو أكثر.
الأسباب الشائعة
- مهلة العميل مضبوطة على قيمة صغيرة جداً
- طُول النص التوجيهي أو السياق يرفع زمن الرمز الأول
- النموذج يعالج مهمة استدلال طويلة
- تذبذب الشبكة
كيفية الإصلاح
- ارفع مهلة العميل إلى 300 ثانية أو أكثر
- فعّل البث حتى لا تنتظر الاستجابة كاملة
- قصّر السياق أو استخدم نموذجاً أسرع
- قلّل max_tokens
مثال على إعادة المحاولة مع تأخير أُسّي
الكود أدناه يعيد المحاولة عندما يُرجع gemini-3.1-pro-preview الخطأ timeout، حتى 5 محاولات، مع وقت انتظار متزايد وتشويش عشوائي حتى لا تُعيد الطلبات المتوازية المحاولة في اللحظة نفسها. اقرأ base URL ومفتاح API من متغيرات البيئة ولا تثبّتها داخل الكود.
import os, time, random
import requests
BASE = os.getenv("OPENAI_BASE_URL") # e.g. https://<your-gateway>/v1
KEY = os.getenv("OPENAI_API_KEY")
MODEL = 'gemini-3.1-pro-preview'
def chat(messages, retries=5):
"""Retry with exponential backoff + jitter."""
for i in range(retries):
try:
r = requests.post(
BASE + "/chat/completions",
headers={"Authorization": "Bearer " + KEY},
json={"model": MODEL, "messages": messages, "stream": True},
timeout=60,
)
if r.status_code == 429 or r.status_code >= 500:
time.sleep(min(2 ** i + random.uniform(0, 1), 30))
continue
r.raise_for_status()
return r.json()
except requests.exceptions.Timeout:
time.sleep(min(2 ** i + random.uniform(0, 1), 30))
raise RuntimeError("gave up after " + str(retries) + " retries")
print(chat([{"role": "user", "content": "hello"}]))بيانات أساسية لهذا النموذج
| TPS | 3738.12 |
|---|---|
| متوسط التأخير | 26006 مللي ثانية |
| معدل النجاح | 100% |
| نقطة نهاية API | https://api.airai.cc/v1 |
| متوافق مع OpenAI | OpenAI-compatible |
| المزوّد | |
|---|---|
| السياق | 1M |
| القدرات | Reasoning, Tools, Files, Vision, Audio |
| صيغ API | openai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search |
| صيغة الفوترة | p * 2 + cr * 0.2 + c * 12) : tier("200k_plus", p * 4 + cr * 0.4 + c * 18 |
الأسئلة الشائعة
مع وجود عدة عقد upstream، هل تبدّل البوابة تلقائياً عند timeout؟
هذا الخطأ لا علاقة له بقدرة النموذج، بل هو على مستوى البوابة. في أغلب الحالات هو أمر مؤقت ويعود من تلقاء نفسه. وسوم قدرات هذا النموذج هي Reasoning, Tools, Files, Vision, Audio. إذا استمر الخطأ عدة دقائق، تواصل مع دعم المنصة للتأكد من حالة المصدر.
حزمة SDK الرسمية تعيد المحاولة تلقائياً، هل أحتاج منطقاً خاصاً بي؟
عادةً لا حاجة لتعديل كود العمل، يكفي ضبط وتيرة الاستدعاء. إعادة المحاولة هي الخطوة الأولى الأكثر فعالية. مع احتساب التكلفة بـ p * 2 + cr * 0.2 + c * 12) : tier("200k_plus", p * 4 + cr * 0.4 + c * 18، لا تُحسب الطلبات الفاشلة ضمن الاستخدام. اجعل حد المحاولات من 3 إلى 5 وأضف تشويشاً عشوائياً. استخدم تراجعاً أُسّياً للأخطاء القابلة لإعادة المحاولة، وأرجع الخطأ فوراً للباقي.
هل يمكن تجاوز timeout على gemini-3.1-pro-preview بالانتقال إلى نموذج آخر؟
احتفظ أيضاً بنموذج احتياطي جاهز. لهذا النموذج من Google عدة عقد upstream يمكن للبوابة التبديل بينها. ضع اسم النموذج في الإعدادات، فلا يحتاج تغيير المصدر إلى تعديل الكود.
هل يحدث timeout أكثر في المحادثات متعددة الأدوار مع gemini-3.1-pro-preview؟
يجب تعديل معاملات الطلب، فإعادة المحاولة وحدها لن تفيد. نافذة السياق 1M تحدد أقصى إدخال لكل طلب، وما يتجاوزها يُرفض مباشرة. بالنسبة لأخطاء المعاملات، أفشل بسرعة بدل إهدار المحاولات. قصّر المدخلات الطويلة أو لخّصها — ذلك يقلل timeout بشكل ملحوظ.
أخطاء أخرى في هذا النموذج
- gemini-3.1-pro-preview: خطأ 429 — الأسباب والحلول
- gemini-3.1-pro-preview: خطأ 500 — الأسباب والحلول
- gemini-3.1-pro-preview: خطأ 502 — الأسباب والحلول
- gemini-3.1-pro-preview: خطأ 503 — الأسباب والحلول
- gemini-3.1-pro-preview: خطأ 504 — الأسباب والحلول
- gemini-3.1-pro-preview: خطأ 401 — الأسباب والحلول
- gemini-3.1-pro-preview: خطأ 403 — الأسباب والحلول
- gemini-3.1-pro-preview: خطأ 400 — الأسباب والحلول
نماذج أخرى تواجه الخطأ نفسه
- gpt-5
- claude-opus-5
- gemini-2.5-pro
- deepseek-v4-pro
- grok-4.3
- llama-3.3-70b-instruct
- qvq-max
- qwq-32b
- glm-5
- MiniMax-M3
- kimi-k3
- hy3
- doubao-seed-evolving
- mimo-v2.5
- gpt-4o
- claude-opus-4-6
تحديث البيانات: 2026-10-10 18:30