Skip to main content

Precios

La API LLM de novita AI se factura por token. Cada solicitud genera cargos por:
  • Tokens de entrada — tokens consumidos por el prompt
  • Tokens de salida — tokens generados por el modelo
Costo total = Tokens de entrada × Tarifa de entrada + Tokens de salida × Tarifa de salida
Las tarifas varían según el modelo. Consulta la página de precios para obtener más detalles.

Códigos de estado HTTP

Principio de facturación:
  • Solicitudes rechazadas antes de llegar al modelo (400/401/403/429): no se cobran
  • Error debido a problemas de la plataforma (500/503/504): no se cobra
  • Solicitudes en las que el modelo ha comenzado la inferencia (200/499): se cobran

499 — Cliente desconectado

Una vez que una solicitud llega al modelo, la inferencia comienza inmediatamente en el lado del servidor. Si el cliente se desconecta antes de recibir la respuesta completa, los recursos de cómputo ya se han consumido. La solicitud se cobra según el uso real de tokens.
Recomendaciones
  • Usa max_tokens para limitar la longitud de salida a nivel de solicitud
  • Establece el timeout del cliente en ≥ 60s para evitar desconexiones no previstas
  • Prefiere controlar la generación mediante max_tokens en lugar de cerrar la conexión

Preguntas frecuentes

La inferencia comienza en cuanto la solicitud llega al modelo. Desconectarse no detiene el cómputo que ya está en curso.
Establece el parámetro max_tokens para controlar la longitud de salida antes de enviar la solicitud.
En tu panel de uso, junto con las solicitudes estándar, con el consumo real de tokens registrado.
Última modificación el 15 de mayo de 2026