> ## Documentation Index
> Fetch the complete documentation index at: https://novita.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Facturación de la API LLM

> Comprende cómo funciona la facturación de la API LLM de novita AI, incluidos los precios basados en tokens, las reglas de facturación por códigos de estado HTTP y la política de facturación por desconexión del cliente 499.

## Precios

La API LLM de novita AI se factura por token. Cada solicitud genera cargos por:

* **Tokens de entrada** — tokens consumidos por el prompt
* **Tokens de salida** — tokens generados por el modelo

Costo total = Tokens de entrada × Tarifa de entrada + Tokens de salida × Tarifa de salida

<Info>
  Las tarifas varían según el modelo. Consulta la [página de precios](https://novita.ai/pricing) para obtener más detalles.
</Info>

## Códigos de estado HTTP

| Estado HTTP | Nombre                              | Descripción                                           | Se cobra |
| :---------- | :---------------------------------- | :---------------------------------------------------- | :------- |
| 200         | Correcto                            | La solicitud se completó correctamente                | **Sí**   |
| 400         | Solicitud incorrecta                | Parámetros de solicitud no válidos                    | No       |
| 401         | No autorizado                       | API key no válida o faltante                          | No       |
| 403         | Prohibido                           | Permisos insuficientes                                | No       |
| 429         | Límite de tasa alcanzado            | Se superó el límite de TPM o RPM                      | No       |
| 499         | Cliente desconectado                | El cliente cerró la conexión antes de completarse     | **Sí**   |
| 500         | Error interno del servidor          | Error del lado del servidor                           | No       |
| 503         | Servicio no disponible              | Servicio temporalmente no disponible                  | No       |
| 504         | Tiempo de espera de gateway agotado | Se agotó el tiempo de espera de la respuesta upstream | No       |

**Principio de facturación:**

* Solicitudes rechazadas antes de llegar al modelo (400/401/403/429): no se cobran
* Error debido a problemas de la plataforma (500/503/504): no se cobra
* Solicitudes en las que el modelo ha comenzado la inferencia (200/499): se cobran

## 499 — Cliente desconectado

Una vez que una solicitud llega al modelo, la inferencia comienza inmediatamente en el lado del servidor. Si el cliente se desconecta antes de recibir la respuesta completa, los recursos de cómputo ya se han consumido. La solicitud se cobra según el uso real de tokens.

| Modo de solicitud | Facturación                                                                          |
| :---------------- | :----------------------------------------------------------------------------------- |
| Sin streaming     | Se cobra por el uso real de tokens, independientemente del momento de la desconexión |
| Streaming         | Se cobra por el uso real de tokens, independientemente del momento de la desconexión |

<Tip>
  **Recomendaciones**

  * Usa `max_tokens` para limitar la longitud de salida a nivel de solicitud
  * Establece el timeout del cliente en ≥ 60s para evitar desconexiones no previstas
  * Prefiere controlar la generación mediante `max_tokens` en lugar de cerrar la conexión
</Tip>

## Preguntas frecuentes

<AccordionGroup>
  <Accordion title="¿Por qué se me cobra después de desconectarme?">
    La inferencia comienza en cuanto la solicitud llega al modelo. Desconectarse no detiene el cómputo que ya está en curso.
  </Accordion>

  <Accordion title="¿Cómo puedo evitar cargos 499?">
    Establece el parámetro `max_tokens` para controlar la longitud de salida antes de enviar la solicitud.
  </Accordion>

  <Accordion title="¿Dónde aparecen los cargos 499?">
    En tu panel de uso, junto con las solicitudes estándar, con el consumo real de tokens registrado.
  </Accordion>
</AccordionGroup>
