Skip to main content
L’API Batch pour les grands modèles de langage permet le traitement asynchrone de nombreuses requêtes d’inférence et est entièrement compatible avec le standard de l’API OpenAI. L’API Batch est une solution économique lorsque des résultats d’inférence immédiats ne sont pas nécessaires. Elle offre des limites de débit plus élevées que les appels en ligne, garantissant que les résultats sont livrés dans un délai raisonnable de 24 heures. Cette API est idéale pour :
  • Réaliser des évaluations et des analyses de données.
  • Classer de vastes ensembles de données.
  • Générer des résumés de documents en mode hors ligne.
Modèles pris en charge :

Démarrage rapide

1. Préparer les fichiers batch

L’API Batch utilise des fichiers au format .jsonl comme entrée, chaque ligne représentant les détails d’une requête d’inférence API. Les endpoints disponibles incluent /v1/chat/completions et /v1/completions.
Définissez le paramètre endpoint sur /v1/chat/completions ou /v1/completions pour la compatibilité avec l’API OpenAI.
Chaque requête doit inclure un custom_id unique afin de localiser les résultats d’inférence dans le fichier de sortie une fois le batch terminé. Les paramètres du champ body de chaque ligne sont envoyés comme paramètres réels de requête d’inférence à l’endpoint.
Toutes les requêtes d’un même fichier JSONL de batch doivent cibler le même modèle. Ne mélangez pas des requêtes destinées à différents modèles dans un même batch.
Voici un exemple de fichier d’entrée contenant 2 requêtes :

2. Téléverser le fichier d’entrée du batch

Téléversez le fichier d’entrée du batch afin qu’il puisse être référencé avec précision lors de la création d’un batch. Utilisez la Files API pour téléverser votre fichier .jsonl et définissez le purpose sur batch. Notez que le fichier sera conservé pendant 15 jours.
Pour savoir comment obtenir une clé API, consultez la section Gestion des clés API.
Exemple de code Python
Curl
Exemple de réponse après un téléversement de fichier réussi :

3. Créer un batch

Une fois le fichier d’entrée téléversé avec succès, vous pouvez lancer un batch en utilisant l’ID de l’objet File téléversé. La fenêtre de complétion est fixée à 24h et n’est actuellement pas modifiable. Exemple de code Python
Curl
Cette requête renverra un objet Batch qui inclut des métadonnées sur votre batch, comme illustré dans l’exemple ci-dessous :

4. Vérifier le statut d’un batch

Vous pouvez vérifier le statut d’un batch à tout moment afin d’obtenir les informations les plus récentes sur celui-ci. Les valeurs d’énumération du statut de l’objet Batch sont les suivantes :
StatutDescription
VALIDATINGLe fichier d’entrée est en cours de validation avant que le batch puisse commencer
PROGRESSLe batch est en cours
COMPLETEDLe traitement du batch s’est terminé avec succès
FAILEDLe traitement du batch a échoué
EXPIREDLe batch a dépassé l’échéance
CANCELLINGLe batch est en cours d’annulation
CANCELLEDLe batch a été annulé
Exemple de code Python
Curl

5. Récupérer les résultats

Une fois l’inférence par batch terminée, vous pouvez télécharger le fichier de sortie des résultats à l’aide du champ output_file_id de l’objet Batch. Le fichier de sortie des résultats sera supprimé 30 jours après la fin de l’inférence par batch ; veuillez donc le récupérer rapidement via l’interface. Exemple de code Python
Curl
La réponse renvoie le contenu brut du fichier. Pour les fichiers de sortie de batch, chaque ligne contient une réponse comme celle-ci :

Instructions

Limitations

  1. Chaque batch peut contenir jusqu’à 50 000 requêtes.
  2. La taille maximale du fichier d’entrée par batch est de 100MB.

Gestion des erreurs

Les erreurs rencontrées lors du traitement du batch sont enregistrées dans un fichier d’erreurs séparé, accessible via le champ error_file_id. Les codes d’erreur courants incluent :
Code d’erreurDescriptionSolution
400Format de requête non valideVérifiez la syntaxe JSONL et les champs requis
401Échec de l’authentificationVérifiez la clé API
404Batch introuvableVérifiez l’ID du batch
429Limite de débit dépasséeRéduisez la fréquence des requêtes
500Erreur serveurContactez-nous

Expiration des batchs

Les batchs qui ne sont pas terminés dans les 24 heures passeront à l’état EXPIRED. Les requêtes non terminées seront annulées, tandis que les requêtes terminées seront fournies via un fichier de sortie. Vous ne payez que les tokens consommés par les requêtes terminées. Le batch fait tout son possible pour se terminer dans les 24 heures.

Toutes les API Batch

  1. Créer un batch
  2. Récupérer un batch
  3. Annuler un batch
  4. Lister les batchs
  5. Téléverser un fichier
  6. Lister les fichiers
  7. Récupérer un fichier
  8. Supprimer un fichier
  9. Récupérer le contenu d’un fichier
Dernière modification le 15 mai 2026