> ## Documentation Index
> Fetch the complete documentation index at: https://docs.jiekou.ai/llms.txt
> Use this file to discover all available pages before exploring further.

# Limitation du débit d’appels (Rate Limits)

export const DynamicRPMList = () => {
  if (typeof document === "undefined") {
    return null;
  } else {
    let attempts = 0;
    const maxAttempts = 50;
    const formatAmount = num => {
      if (typeof num === "number") {
        return num.toLocaleString();
      }
      return num || "-";
    };
    const interval = setInterval(() => {
      const clientComponent = document.getElementById("dynamic-rpm-list");
      if (clientComponent && window.jiekouRemoteData.llmModels.status === 'loaded') {
        const modelList = window.jiekouRemoteData.llmModels.data.filter(model => {
          return Boolean(model.rpm);
        });
        const allModels = modelList.map(model => {
          const t1 = (model.quota_items || []).find(item => item.tier === "T1") || ({});
          const t2 = (model.quota_items || []).find(item => item.tier === "T2") || ({});
          const t3 = (model.quota_items || []).find(item => item.tier === "T3") || ({});
          const t4 = (model.quota_items || []).find(item => item.tier === "T4") || ({});
          const t5 = (model.quota_items || []).find(item => item.tier === "T5") || ({});
          return `
            <tr>
              <td rowspan="2" style="vertical-align: middle; max-width: 230px">${model.id}</td>
              <td>RPM</td>
              <td>${formatAmount(t1.rpm)}</td>
              <td>${formatAmount(t2.rpm)}</td>
              <td>${formatAmount(t3.rpm)}</td>
              <td>${formatAmount(t4.rpm)}</td>
              <td>${formatAmount(t5.rpm)}</td>
            </tr>
            <tr>
              <td>TPM</td>
              <td>${formatAmount(t1.tpm)}</td>
              <td>${formatAmount(t2.tpm)}</td>
              <td>${formatAmount(t3.tpm)}</td>
              <td>${formatAmount(t4.tpm)}</td>
              <td>${formatAmount(t5.tpm)}</td>
            </tr>
          `;
        }).join('');
        clientComponent.innerHTML = `
          <table class="table table-big">
            <thead>
              <tr>
                <th>模型</th>
                <th></th>
                <th>T1</th>
                <th>T2</th>
                <th>T3</th>
                <th>T4</th>
                <th>T5</th>
              </tr>
            </thead>
            <tbody>
              ${allModels}
            </tbody>
          </table>
        `;
        clearInterval(interval);
      }
      attempts++;
      if (attempts >= maxAttempts) {
        clearInterval(interval);
      }
    }, 200);
    return <div id="dynamic-rpm-list"></div>;
  }
};

## Comprendre la limitation du débit d’appels

La limitation du débit d’appels définit le nombre de requêtes API pouvant être envoyées pendant une période donnée, ce qui permet d’optimiser l’utilisation de l’API.

* Empêcher l’abus et la mauvaise utilisation de l’API
* Garantir une répartition équitable des ressources
* Maintenir les performances et la fiabilité de l’API
* Protéger la stabilité du service

## Limitation du débit d’appels par défaut

Chaque compte dispose de limites de débit par défaut lors de l’appel des modèles. Elles sont mesurées en RPM (nombre de requêtes par modèle et par minute) et en TPM (nombre de tokens par modèle et par minute). Les limites de débit varient selon le niveau du compte ; les critères détaillés sont indiqués dans le tableau ci-dessous.

<table class="table table-big">
  <thead>
    <tr>
      <th class="min-w-10">Niveau de quota</th>
      <th>Éligibilité (unité : dollars américains)</th>
    </tr>
  </thead>

  <tbody>
    <tr>
      <td>T1</td>
      <td>Montant total de recharge mensuel le plus élevé au cours des 3 derniers mois calendaires \< \$50</td>
    </tr>

    <tr>
      <td>T2</td>
      <td>\$50 ≤ Montant total de recharge mensuel le plus élevé au cours des 3 derniers mois calendaires \< \$500</td>
    </tr>

    <tr>
      <td>T3</td>
      <td>\$500 ≤ Montant total de recharge mensuel le plus élevé au cours des 3 derniers mois calendaires \< \$3000</td>
    </tr>

    <tr>
      <td>T4</td>
      <td>\$3000 ≤ Montant total de recharge mensuel le plus élevé au cours des 3 derniers mois calendaires \< \$10000</td>
    </tr>

    <tr>
      <td>T5</td>
      <td>\$10000 ≤ Montant total de recharge mensuel le plus élevé au cours des 3 derniers mois calendaires</td>
    </tr>
  </tbody>
</table>

Limites de débit par défaut pour chaque niveau (RPM / TPM) :

<DynamicRPMList />

## Éviter de déclencher la limitation du débit d’appels

Si le nombre de vos requêtes API dépasse la limite de débit, l’API renverra :

* Code d’état HTTP : 429 (trop de requêtes).
* Le corps de la réponse contiendra des informations indiquant que la limite de débit a été dépassée.

Pour éviter de déclencher la limitation du débit d’appels, vous pouvez prendre les mesures suivantes :

* Implémenter une limitation des requêtes dans votre application.
* Utiliser un mécanisme de backoff exponentiel lors des nouvelles tentatives.
* Surveiller votre utilisation de l’API.

## Gérer les erreurs 429

Si vous recevez une erreur 429, vous pouvez essayer les actions suivantes :

* **Réessayer plus tard** : attendez un certain temps avant de réessayer votre requête.
* **Optimiser les requêtes** : réduisez la fréquence des requêtes.
* **Augmenter la limite de débit d’appels** : si vous avez besoin d’une limite de débit plus élevée, vous pouvez nous contacter.
