Precios
La API LLM de novita AI se factura por token. Cada solicitud genera cargos por:- Tokens de entrada — tokens consumidos por el prompt
- Tokens de salida — tokens generados por el modelo
Las tarifas varían según el modelo. Consulta la página de precios para obtener más detalles.
Códigos de estado HTTP
Principio de facturación:
- Solicitudes rechazadas antes de llegar al modelo (400/401/403/429): no se cobran
- Error debido a problemas de la plataforma (500/503/504): no se cobra
- Solicitudes en las que el modelo ha comenzado la inferencia (200/499): se cobran
499 — Cliente desconectado
Una vez que una solicitud llega al modelo, la inferencia comienza inmediatamente en el lado del servidor. Si el cliente se desconecta antes de recibir la respuesta completa, los recursos de cómputo ya se han consumido. La solicitud se cobra según el uso real de tokens.Preguntas frecuentes
¿Por qué se me cobra después de desconectarme?
¿Por qué se me cobra después de desconectarme?
La inferencia comienza en cuanto la solicitud llega al modelo. Desconectarse no detiene el cómputo que ya está en curso.
¿Cómo puedo evitar cargos 499?
¿Cómo puedo evitar cargos 499?
Establece el parámetro
max_tokens para controlar la longitud de salida antes de enviar la solicitud.¿Dónde aparecen los cargos 499?
¿Dónde aparecen los cargos 499?
En tu panel de uso, junto con las solicitudes estándar, con el consumo real de tokens registrado.