Preços
A API de LLM da novita AI é cobrada por token. Cada solicitação gera cobranças por:- Tokens de Entrada — tokens consumidos pelo prompt
- Tokens de Saída — tokens gerados pelo modelo
As taxas variam de acordo com o modelo. Consulte a Página de Preços para obter detalhes.
Códigos de Status HTTP
Princípio de cobrança:
- Solicitações rejeitadas antes de chegarem ao modelo (400/401/403/429): não são cobradas
- Erro devido a problemas da plataforma (500/503/504): não é cobrado
- Solicitações em que o modelo já iniciou a inferência (200/499): são cobradas
499 — Cliente Desconectado
Depois que uma solicitação chega ao modelo, a inferência começa imediatamente no lado do servidor. Se o cliente se desconectar antes de receber a resposta completa, recursos computacionais já terão sido consumidos. A solicitação é cobrada com base no uso real de tokens.Perguntas Frequentes
Por que sou cobrado após me desconectar?
Por que sou cobrado após me desconectar?
A inferência começa assim que a solicitação chega ao modelo. Desconectar não interrompe a computação já em andamento.
Como posso evitar cobranças 499?
Como posso evitar cobranças 499?
Defina o parâmetro
max_tokens para controlar o tamanho da saída antes de enviar a solicitação.Onde as cobranças 499 aparecem?
Onde as cobranças 499 aparecem?
No seu painel de uso, junto com as solicitações padrão, com o consumo real de tokens registrado.