1. レート制限の理解
レート制限とは、特定の時間枠内でユーザーの API が当社プラットフォームサービスにアクセスできる頻度を管理するルールのことです。その目的は次のとおりです。- API の乱用や誤用の防止: リクエスト頻度に上限を設定することで、異常または意図しないトラフィックを制限します。
- 公平なリソース配分の確保: 少数のユーザーがシステムリソースを独占することを防ぎ、すべてのユーザーが公平な条件でサービスにアクセスできるようにします。
- API のパフォーマンスと信頼性の維持: トラフィックの急増を平準化することで、応答時間を安定させ、過負荷による失敗率を低減し、全体的なサービス品質を向上させます。
- システム安定性の保護: レート制限は突然のトラフィック急増を吸収し、高い同時実行数のスパイクによってインフラストラクチャが圧迫されることを防ぎます。
2. レート制限の指標
当社の画像モデルおよび動画モデルでは、主に 2 つのレート制限指標を使用しています。- IPM (Images Per Minute): 画像モデルが 1 分あたりに生成できる画像数。
- RPM (Requests Per Minute): 動画モデルが 1 分あたりに処理できる API リクエスト数。
3. デフォルトのレート制限
モデルごとに、当社プラットフォームでは各モデルの計算リソース消費量に基づいて、異なるレート制限戦略を適用しています。IPM
IPM (Images Per Minute) 制限は、1 分あたりに生成できる画像数を制御します。各モデルのデフォルト IPM 値は以下の表に示されています。RPM
RPM (Requests Per Minute) 制限は、1 分あたりに許可される API リクエスト数を制御します。各モデルのデフォルト RPM 値は以下の表に示されています。4. レート制限への対応
レート制限を監視する方法
API リクエストが許可されたレートを超えた場合、API は次を返します。- HTTP ステータスコード: 429 Too Many Requests
- レスポンス本文: レート制限を超過したことを示すメッセージ。
ベストプラクティス
レート制限の発生を避けるには、次のことができます。- クライアント側のリクエストスロットリングを実装する: アプリケーションのリクエストレートを制御し、短時間に大量の呼び出しを送信しないようにすることで、プラットフォームのレート制限を尊重します。
- リトライ時に指数バックオフを使用する: レート制限レスポンス(例: HTTP 429)を受け取った場合、すぐに再試行するのではなく、再試行間隔を段階的に長くして、サービスへの負荷を軽減します。
- API 使用状況を監視する: リクエスト数、頻度、エラーレスポンスを継続的に追跡およびログ記録し、利用パターンを事前に調整できるようにします。
レート制限に達した場合
HTTP 429 (“Too Many Requests”) レスポンスを受け取った場合、次のことができます。- 後で再試行する: リクエストを再送信する前に、短時間待機します。
- リクエストを最適化する: 呼び出し頻度を減らし、プラットフォームのレート制限内に収まるようにします。
- より高いレート制限をリクエストする: より高いレート制限が必要な場合は、Quotas&Limits のお問い合わせフォームに入力して、当社までご連絡ください。