Skip to main content
De Batch API voor Large Language Models maakt asynchrone verwerking van talrijke inferentieverzoeken mogelijk en is volledig compatibel met de OpenAI API-standaard. De Batch API is een kosteneffectieve oplossing wanneer directe inferentieresultaten niet nodig zijn. Deze biedt hogere snelheidslimieten dan online aanroepen en zorgt ervoor dat resultaten binnen een redelijke termijn van 24 uur worden geleverd. Deze API is ideaal voor:
  • Het uitvoeren van evaluaties en data-analyse.
  • Het classificeren van uitgebreide datasets.
  • Het genereren van documentsamenvattingen in een offline modus.
Ondersteunde modellen:

Snelstart

1. Batchbestanden voorbereiden

De Batch API gebruikt bestanden in .jsonl-indeling als invoer, waarbij elke regel de details van een API-inferentieverzoek vertegenwoordigt. Beschikbare endpoints zijn /v1/chat/completions en /v1/completions.
Stel de parameter endpoint in op /v1/chat/completions of /v1/completions voor compatibiliteit met de OpenAI API.
Elk verzoek moet een unieke custom_id bevatten om inferentieresultaten na voltooiing van de batch in het uitvoerbestand te kunnen lokaliseren. Parameters in het veld body van elke regel worden als daadwerkelijke inferentieverzoekparameters naar het endpoint verzonden.
Alle verzoeken binnen één batch-JSONL-bestand moeten op hetzelfde model zijn gericht. Meng geen verzoeken voor verschillende modellen in één batch.
Hieronder staat een voorbeeldinvoerbestand met 2 verzoeken:

2. Batchinvoerbestand uploaden

Upload het batchinvoerbestand om ervoor te zorgen dat er nauwkeurig naar kan worden verwezen bij het maken van een batch. Gebruik de Files API om uw .jsonl-bestand te uploaden en stel het doel in op batch. Houd er rekening mee dat het bestand 15 dagen wordt bewaard.
Raadpleeg voor informatie over het verkrijgen van een API key API Key Management.
Codevoorbeeld Python
Curl
Voorbeeldrespons na een succesvolle bestandsupload:

3. Een batch maken

Zodra het invoerbestand succesvol is geüpload, kunt u een batch starten met behulp van de ID van het geüploade File-object. Het voltooiingsvenster is vast ingesteld op 24h en kan momenteel niet worden aangepast. Codevoorbeeld Python
Curl
Dit verzoek levert een Batch-object op dat metadata over uw batch bevat, zoals geïllustreerd in het onderstaande voorbeeld:

4. De status van een batch controleren

U kunt op elk moment de status van een batch controleren om de nieuwste batchinformatie te ontvangen. De status-enumeratiewaarden van het Batch-object zijn als volgt:
StatusBeschrijving
VALIDATINGHet invoerbestand wordt gevalideerd voordat de batch kan beginnen
PROGRESSBatch wordt uitgevoerd
COMPLETEDBatchverwerking succesvol voltooid
FAILEDBatchverwerking mislukt
EXPIREDBatch heeft de deadline overschreden
CANCELLINGBatch wordt geannuleerd
CANCELLEDBatch is geannuleerd
Codevoorbeeld Python
Curl

5. De resultaten ophalen

Zodra de batch-inferentie is voltooid, kunt u het uitvoerbestand met resultaten downloaden met behulp van het veld output_file_id uit het Batch-object. Het uitvoerbestand met resultaten wordt 30 dagen na afloop van de batch-inferentie verwijderd, dus haal het tijdig op via de interface. Codevoorbeeld Python
Curl
De respons retourneert de ruwe bestandsinhoud. Voor batchuitvoerbestanden bevat elke regel een respons zoals deze:

Instructies

Beperkingen

  1. Elke batch kan maximaal 50.000 verzoeken bevatten.
  2. De maximale invoerbestandsgrootte per batch is 100MB.

Foutafhandeling

Fouten die tijdens batchverwerking optreden, worden vastgelegd in een afzonderlijk foutbestand, dat toegankelijk is via het veld error_file_id. Veelvoorkomende foutcodes zijn:
FoutcodeBeschrijvingOplossing
400Ongeldige verzoekindelingControleer de JSONL-syntaxis en vereiste velden
401Authenticatie misluktControleer API key
404Batch niet gevondenControleer batch-ID
429Snelheidslimiet overschredenVerlaag de verzoekfrequentie
500ServerfoutNeem contact met ons op

Vervallen van batches

Batches die niet binnen 24 uur zijn voltooid, gaan over naar de status EXPIRED. Niet-voltooide verzoeken worden geannuleerd, terwijl voltooide verzoeken via een uitvoerbestand worden geleverd. U betaalt alleen voor tokens die zijn verbruikt door voltooide verzoeken. De batch doet er alles aan om binnen 24 uur te voltooien.

Alle Batch API’s

  1. Batch maken
  2. Batch ophalen
  3. Batch annuleren
  4. Batches weergeven
  5. Bestand uploaden
  6. Bestanden weergeven
  7. Bestand ophalen
  8. Bestand verwijderen
  9. Bestandsinhoud ophalen
Laatst gewijzigd op 10 augustus 2026