الخطأ 429: ماذا تفعل عندما يفشل gemini-3.5-flash-lite

يعني الرمز 429 أنك وصلت إلى حد المعدل: تجاوز عدد الطلبات أو الرموز في نافذة زمنية حصة خطتك الحالية.

رمز 429 Too Many Requests هو استجابة تحديد معدل، وليس خطأ. يعني أن الطلب نفسه صالح لكنه تجاوز معدل الطلبات أو عدد الطلبات المتزامنة المسموح به في خطتك الحالية. يكفي الانتظار ضمن النافذة الزمنية الموضحة في ترويسة الاستجابة ثم إعادة المحاولة، دون الحاجة لتعديل جسم الطلب.

gemini-3.5-flash-lite مقدمة من Google. كل ما في هذه الصفحة — الأسباب والحلول والبيانات المقاسة — مستقى من السلوك التشغيلي الفعلي لهذا النموذج على مستوى البوابة.

في هذه البوابة، السبب الأكثر شيوعًا هو: طلبات متزامنة كثيرة جداً. والإجراء الأول الموصى به هو: تقليل التزامن وإعادة المحاولة بتأخير متزايد.

الأسباب الشائعة

  • طلبات متزامنة كثيرة جداً
  • نفدت حصة الخطة الحالية
  • إعادة المحاولة دون تأخير

كيفية الإصلاح

  • تقليل التزامن وإعادة المحاولة بتأخير متزايد
  • الانتقال إلى خطة بحصة أكبر
  • تخزين الطلبات المتكررة مؤقتاً

مثال على إعادة المحاولة مع تأخير أُسّي

الكود أدناه يعيد المحاولة عندما يُرجع gemini-3.5-flash-lite الخطأ 429، حتى 5 محاولات، مع وقت انتظار متزايد وتشويش عشوائي حتى لا تُعيد الطلبات المتوازية المحاولة في اللحظة نفسها. اقرأ base URL ومفتاح API من متغيرات البيئة ولا تثبّتها داخل الكود.

import os, time, random
import requests

BASE  = os.getenv("OPENAI_BASE_URL")   # e.g. https://<your-gateway>/v1
KEY   = os.getenv("OPENAI_API_KEY")
MODEL = 'gemini-3.5-flash-lite'


def chat(messages, retries=5):
    """Retry with exponential backoff + jitter."""
    for i in range(retries):
        try:
            r = requests.post(
                BASE + "/chat/completions",
                headers={"Authorization": "Bearer " + KEY},
                json={"model": MODEL, "messages": messages, "stream": True},
                timeout=60,
            )
            if r.status_code == 429 or r.status_code >= 500:
                time.sleep(min(2 ** i + random.uniform(0, 1), 30))
                continue
            r.raise_for_status()
            return r.json()
        except requests.exceptions.Timeout:
            time.sleep(min(2 ** i + random.uniform(0, 1), 30))
    raise RuntimeError("gave up after " + str(retries) + " retries")


print(chat([{"role": "user", "content": "hello"}]))

بيانات أساسية لهذا النموذج

نقطة نهاية APIhttps://api.airai.cc/v1
متوافق مع OpenAIOpenAI-compatible
المزوّدGoogle
السياق1M
القدراتReasoning, Tools, Files, Vision, Audio
صيغ APIopenai, openai-response, openai-response-compact, anthropic, gemini, openai-alpha-search
صيغة الفوترةp * 0.3 + cr * 0.03 + c * 2.5

الأسئلة الشائعة

حزمة SDK الرسمية تعيد المحاولة تلقائياً، هل أحتاج منطقاً خاصاً بي؟

عادةً لا حاجة لتعديل كود العمل، يكفي ضبط وتيرة الاستدعاء. إعادة المحاولة هي الخطوة الأولى الأكثر فعالية. مع احتساب التكلفة بـ p * 0.3 + cr * 0.03 + c * 2.5، لا تُحسب الطلبات الفاشلة ضمن الاستخدام. اجعل حد المحاولات من 3 إلى 5 وأضف تشويشاً عشوائياً.

هل يقلل تخزين النتائج مؤقتاً من 429؟

المتغيّران الحقيقيان هنا هما التزامن والمهلة، وليس النموذج نفسه. خفّض التزامن أولاً — معظم مشاكل معدل النقل تختفي بعدها. نافذة السياق لهذا النموذج 1M وهو من Google. ابدأ بتزامن منخفض، وراقب لدقائق، ثم زد تدريجياً. سوّي قمم الحمل بالدفعات أو الطوابير — أكثر استقراراً من رفع التزامن أثناء التشغيل.

هل يرتبط 429 بقدرة النموذج نفسه؟

هذا الخطأ لا علاقة له بقدرة النموذج، بل هو على مستوى البوابة. وسوم قدرات هذا النموذج هي Reasoning, Tools, Files, Vision, Audio. حدّد أولاً إن كان على مستوى الحساب أم مستوى النموذج؛ التعامل معهما مختلف تماماً.

هل تُحتسب الطلبات الفاشلة ضمن حصة تحديد المعدل؟

لا توجد رسوم، فالمخرجات التي أُنتجت فعلياً فقط هي ما يُحتسب ضمن الاستخدام. الفوترة تتبع p * 0.3 + cr * 0.03 + c * 2.5، فلا رسوم بدون مخرجات. سعر الإدخال نحو $0.30 لكل مليون رمز. تحقق من الرصيد وحدود المعدل في لوحة التحكم أولاً، ثم افحص الكود.

أخطاء أخرى في هذا النموذج

نماذج أخرى تواجه الخطأ نفسه

تحديث البيانات: 2026-10-10 15:45

الدعم الفنيالدعم المباشر
العودة إلى الأعلى