Prijzen
novita AI LLM API wordt per token gefactureerd. Voor elk verzoek worden kosten in rekening gebracht voor:- Inputtokens — tokens die door de prompt worden verbruikt
- Outputtokens — tokens die door het model worden gegenereerd
Tarieven verschillen per model. Raadpleeg de Prijspagina voor details.
HTTP-statuscodes
Factureringsprincipe:
- Verzoeken die worden geweigerd voordat ze het model bereiken (400/401/403/429): niet gefactureerd
- Fout door platformproblemen (500/503/504): niet gefactureerd
- Verzoeken waarbij het model met inferentie is begonnen (200/499): gefactureerd
499 — Clientverbinding verbroken
Zodra een verzoek het model bereikt, begint inferentie onmiddellijk aan de serverzijde. Als de client de verbinding verbreekt voordat de volledige respons is ontvangen, zijn er al rekenresources verbruikt. Het verzoek wordt gefactureerd op basis van het daadwerkelijke tokengebruik.FAQ
Waarom worden er kosten in rekening gebracht nadat ik de verbinding heb verbroken?
Waarom worden er kosten in rekening gebracht nadat ik de verbinding heb verbroken?
Inferentie begint zodra het verzoek het model bereikt. Het verbreken van de verbinding stopt berekeningen die al bezig zijn niet.
Hoe kan ik 499-kosten vermijden?
Hoe kan ik 499-kosten vermijden?
Stel de parameter
max_tokens in om de outputlengte te regelen voordat u het verzoek verzendt.Waar verschijnen 499-kosten?
Waar verschijnen 499-kosten?
In uw gebruiksdashboard, naast standaardverzoeken, met het daadwerkelijke tokenverbruik geregistreerd.