> ## Documentation Index
> Fetch the complete documentation index at: https://novita.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# LLM API-facturering

> Begrijp hoe de facturering van de novita AI LLM API werkt, inclusief tokengebaseerde prijzen, factureringsregels voor HTTP-statuscodes en het factureringsbeleid voor 499-clientverbindingen die worden verbroken.

## Prijzen

novita AI LLM API wordt per token gefactureerd. Voor elk verzoek worden kosten in rekening gebracht voor:

* **Inputtokens** — tokens die door de prompt worden verbruikt
* **Outputtokens** — tokens die door het model worden gegenereerd

Totale kosten = Inputtokens × Inputtarief + Outputtokens × Outputtarief

<Info>
  Tarieven verschillen per model. Raadpleeg de [Prijspagina](https://novita.ai/pricing) voor details.
</Info>

## HTTP-statuscodes

| HTTP-status | Naam                  | Beschrijving                                        | Gefactureerd |
| :---------- | :-------------------- | :-------------------------------------------------- | :----------- |
| 200         | Succes                | Verzoek succesvol voltooid                          | **Ja**       |
| 400         | Bad Request           | Ongeldige verzoekparameters                         | Nee          |
| 401         | Unauthorized          | Ongeldige of ontbrekende API-sleutel                | Nee          |
| 403         | Forbidden             | Onvoldoende machtigingen                            | Nee          |
| 429         | Rate Limited          | TPM- of RPM-limiet overschreden                     | Nee          |
| 499         | Client Disconnected   | Client heeft de verbinding gesloten vóór voltooiing | **Ja**       |
| 500         | Internal Server Error | Server-side fout                                    | Nee          |
| 503         | Service Unavailable   | Service tijdelijk niet beschikbaar                  | Nee          |
| 504         | Gateway Timeout       | Time-out van upstream-respons                       | Nee          |

**Factureringsprincipe:**

* Verzoeken die worden geweigerd voordat ze het model bereiken (400/401/403/429): niet gefactureerd
* Fout door platformproblemen (500/503/504): niet gefactureerd
* Verzoeken waarbij het model met inferentie is begonnen (200/499): gefactureerd

## 499 — Clientverbinding verbroken

Zodra een verzoek het model bereikt, begint inferentie onmiddellijk aan de serverzijde. Als de client de verbinding verbreekt voordat de volledige respons is ontvangen, zijn er al rekenresources verbruikt. Het verzoek wordt gefactureerd op basis van het daadwerkelijke tokengebruik.

| Verzoekmodus  | Facturering                                                                     |
| :------------ | :------------------------------------------------------------------------------ |
| Non-Streaming | Gefactureerd voor daadwerkelijk tokengebruik, ongeacht het moment van verbreken |
| Streaming     | Gefactureerd voor daadwerkelijk tokengebruik, ongeacht het moment van verbreken |

<Tip>
  **Aanbevelingen**

  * Gebruik `max_tokens` om de outputlengte op verzoekniveau te beperken
  * Stel de client-time-out in op ≥ 60s om onbedoelde verbrekingen te voorkomen
  * Geef de voorkeur aan het regelen van generatie via `max_tokens` in plaats van de verbinding te sluiten
</Tip>

## FAQ

<AccordionGroup>
  <Accordion title="Waarom worden er kosten in rekening gebracht nadat ik de verbinding heb verbroken?">
    Inferentie begint zodra het verzoek het model bereikt. Het verbreken van de verbinding stopt berekeningen die al bezig zijn niet.
  </Accordion>

  <Accordion title="Hoe kan ik 499-kosten vermijden?">
    Stel de parameter `max_tokens` in om de outputlengte te regelen voordat u het verzoek verzendt.
  </Accordion>

  <Accordion title="Waar verschijnen 499-kosten?">
    In uw gebruiksdashboard, naast standaardverzoeken, met het daadwerkelijke tokenverbruik geregistreerd.
  </Accordion>
</AccordionGroup>
