> ## Documentation Index
> Fetch the complete documentation index at: https://novita.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Perguntas frequentes sobre LLM

## Guia de uso de cupons

### Que tipos de cupom a Novita oferece?

Atualmente, a Novita oferece os seguintes tipos de cupons para ajudar os usuários a experimentar os serviços da plataforma:

* **Cupom de novo usuário**: Disponível para usuários registrados pela primeira vez, para testar serviços de vários tipos de modelos.
* **Cupom de indicação**: Obtido ao convidar outras pessoas para se registrar e concluir tarefas na plataforma.

## Limites de taxa para uso de modelos

### Quais são os limites de RPM para diferentes usuários?

Os limites de RPM (Requests Per Minute) variam de acordo com o nível de verificação e o status da conta do usuário. Para limites detalhados, consulte a documentação oficial:

<Tip>
  👉 Para obter mais assistência, [agende uma chamada com nossa equipe de vendas](https://meet.brevo.com/novita-ai/contact-sales)
</Tip>

## Política de ajuste e upgrade de RPM

### Os usuários podem solicitar aumento dos limites de RPM?

Sim. A Novita permite upgrades flexíveis de RPM com base nas necessidades de uso. As regras estão listadas abaixo:

* **Modelos DeepSeek**: A plataforma se esforçará para atender a necessidades razoáveis de escalabilidade.
* **Outros modelos**: Aumentos de RPM são avaliados com base no custo do modelo e no comportamento real do usuário, sujeitos à disponibilidade de capacidade.

### **Processo de solicitação:**

Usuário → Gerente de Conta / Suporte Técnico → Análise e aprovação da Equipe de Produto

### **O que acontece se o uso real ficar abaixo do RPM comprometido?**

Se o RPM real do usuário permanecer abaixo do nível comprometido por uma semana consecutiva, a plataforma ajustará a política de limites de taxa da seguinte forma:

* Reduzir o limite para o pico de RPM da semana anterior, ou
* Reverter para o limite de taxa padrão do modelo (o que for menor).

### **O upgrade de RPM via autoatendimento é compatível?**

Sim. A Novita planeja lançar um **Pacote de Upgrade de RPM**, permitindo que os usuários gerenciem e aumentem os limites de RPM de forma independente, sem aprovação manual.

Para obter mais assistência, [agende uma chamada com nossa equipe de vendas](https://meet.brevo.com/novita-ai/contact-sales).

### Como controlar a função de pensamento de Zai-org/GLM-4.5 ao chamar sua API?

Ao chamar a API zai-org/glm-4.5,, sempre existem algumas situações em que a função de pensamento não é necessária. Nesses casos, se você quiser desativar a função de pensamento, basta adicionar uma frase fixa chamada:

```python theme={"system"}
"enable_thinking": false 
```

na parte inferior, por exemplo:

```python theme={"system"}
{
  "model": "zai-org/glm-4.5",
  "messages": [
  {
   "role": "user",
   "content": "How is the weather in New York?"
  }
 ],
 "temperature": 0.7,
 "stream": false,
 "max_tokens": 500,
 "tool_choice": "auto",
 "enable_thinking": false
}
```

## Cobrança

### Qual é a prioridade de cobrança ao usar o Coding Plan?

O sistema deduz primeiro da sua **cota do Coding Plan**. Somente após a cota do Coding Plan ser totalmente esgotada, as cobranças serão aplicadas ao saldo da sua conta de API.

### Como os 50M tokens do Coding Plan são calculados?

Os tokens são calculados com base em contagens de tokens equivalentes à taxa base. Diferentes modelos têm pesos de preço variados, proporcionais às suas relações de custo. Tanto tokens de entrada quanto tokens de saída contam para o seu uso total.

### Como os tokens em cache são cobrados?

Tokens de leitura em cache são cobrados a uma taxa reduzida, aproximadamente **1/10th do preço padrão do token de entrada** (as taxas exatas variam conforme o modelo). Operações de gravação em cache são cobradas pela taxa normal de token de entrada.

## Modo de pensamento

### Como desativo o modo de pensamento para modelos de raciocínio?

O comportamento varia conforme o modelo:

* **moonshotai/Kimi-K2-Instruct** e **zai-org/GLM-4.5**: Adicione `"enable_thinking": false` ao corpo da sua requisição.
* **MiniMax-M1**: No momento, o modo de pensamento **não pode ser desativado** para este modelo.

```python theme={"system"}
{
  "model": "moonshotai/Kimi-K2-Instruct",
  "messages": [
    {
      "role": "user",
      "content": "What is the capital of France?"
    }
  ],
  "enable_thinking": false
}
```

## Suporte a recursos

### O parâmetro `top_logprobs` é compatível?

Atualmente, o parâmetro `top_logprobs` **não é compatível**.

### A saída estruturada (`response_format`) é compatível?

Atualmente, apenas `"type": "json_object"` é compatível. `"type": "json_schema"` (com uma definição de schema estrita) ainda não está disponível.

## Solução de problemas

### Por que estou recebendo erros 403 ao chamar um modelo?

Causas comuns incluem:

1. **Saldo insuficiente na conta** — adicione saldo à sua conta e tente novamente.
2. **O modelo exige acesso por whitelist** — determinados modelos são restritos. Veja [Como solicito acesso à whitelist de modelos?](#how-do-i-apply-for-model-whitelist-access) abaixo.
3. **Restrição do plano** — o modelo pode não estar incluído no seu plano de assinatura atual.

### Por que estou recebendo erros 400?

Causas comuns incluem:

* O comprimento da entrada excede o limite da janela de contexto do modelo.
* Tipos de parâmetros ou formatação incorretos.
* Campos obrigatórios ausentes no corpo da requisição.

Forneça seu `trace_id` à nossa equipe de suporte para uma investigação detalhada.

### O que devo fazer se a API retornar um erro de "server overload"?

Isso indica pressão temporária de recursos na plataforma. Tente novamente após um breve atraso (recomendamos backoff exponencial). Se o problema persistir, <a href="https://discord.gg/YyPRAzwp7P" target="_blank">entre em contato conosco</a> para confirmação de status.

## Acesso a modelos

### Como solicito acesso à whitelist de modelos?

Entre em contato com nossa equipe de suporte via <a href="https://discord.gg/YyPRAzwp7P" target="_blank">Discord</a> ou pelo chat dentro da plataforma com as informações da sua conta e o(s) nome(s) específico(s) do(s) modelo(s) de que você precisa. Nossa equipe analisará e processará sua solicitação.
