Skip to main content

Guia de uso de cupons

Que tipos de cupom a Novita oferece?

Atualmente, a Novita oferece os seguintes tipos de cupons para ajudar os usuários a experimentar os serviços da plataforma:
  • Cupom de novo usuário: Disponível para usuários registrados pela primeira vez, para testar serviços de vários tipos de modelos.
  • Cupom de indicação: Obtido ao convidar outras pessoas para se registrar e concluir tarefas na plataforma.

Limites de taxa para uso de modelos

Quais são os limites de RPM para diferentes usuários?

Os limites de RPM (Requests Per Minute) variam de acordo com o nível de verificação e o status da conta do usuário. Para limites detalhados, consulte a documentação oficial:
👉 Para obter mais assistência, agende uma chamada com nossa equipe de vendas

Política de ajuste e upgrade de RPM

Os usuários podem solicitar aumento dos limites de RPM?

Sim. A Novita permite upgrades flexíveis de RPM com base nas necessidades de uso. As regras estão listadas abaixo:
  • Modelos DeepSeek: A plataforma se esforçará para atender a necessidades razoáveis de escalabilidade.
  • Outros modelos: Aumentos de RPM são avaliados com base no custo do modelo e no comportamento real do usuário, sujeitos à disponibilidade de capacidade.

Processo de solicitação:

Usuário → Gerente de Conta / Suporte Técnico → Análise e aprovação da Equipe de Produto

O que acontece se o uso real ficar abaixo do RPM comprometido?

Se o RPM real do usuário permanecer abaixo do nível comprometido por uma semana consecutiva, a plataforma ajustará a política de limites de taxa da seguinte forma:
  • Reduzir o limite para o pico de RPM da semana anterior, ou
  • Reverter para o limite de taxa padrão do modelo (o que for menor).

O upgrade de RPM via autoatendimento é compatível?

Sim. A Novita planeja lançar um Pacote de Upgrade de RPM, permitindo que os usuários gerenciem e aumentem os limites de RPM de forma independente, sem aprovação manual. Para obter mais assistência, agende uma chamada com nossa equipe de vendas.

Como controlar a função de pensamento de Zai-org/GLM-4.5 ao chamar sua API?

Ao chamar a API zai-org/glm-4.5,, sempre existem algumas situações em que a função de pensamento não é necessária. Nesses casos, se você quiser desativar a função de pensamento, basta adicionar uma frase fixa chamada:
na parte inferior, por exemplo:

Cobrança

Qual é a prioridade de cobrança ao usar o Coding Plan?

O sistema deduz primeiro da sua cota do Coding Plan. Somente após a cota do Coding Plan ser totalmente esgotada, as cobranças serão aplicadas ao saldo da sua conta de API.

Como os 50M tokens do Coding Plan são calculados?

Os tokens são calculados com base em contagens de tokens equivalentes à taxa base. Diferentes modelos têm pesos de preço variados, proporcionais às suas relações de custo. Tanto tokens de entrada quanto tokens de saída contam para o seu uso total.

Como os tokens em cache são cobrados?

Tokens de leitura em cache são cobrados a uma taxa reduzida, aproximadamente 1/10th do preço padrão do token de entrada (as taxas exatas variam conforme o modelo). Operações de gravação em cache são cobradas pela taxa normal de token de entrada.

Modo de pensamento

Como desativo o modo de pensamento para modelos de raciocínio?

O comportamento varia conforme o modelo:
  • moonshotai/Kimi-K2-Instruct e zai-org/GLM-4.5: Adicione "enable_thinking": false ao corpo da sua requisição.
  • MiniMax-M1: No momento, o modo de pensamento não pode ser desativado para este modelo.

Suporte a recursos

O parâmetro top_logprobs é compatível?

Atualmente, o parâmetro top_logprobs não é compatível.

A saída estruturada (response_format) é compatível?

Atualmente, apenas "type": "json_object" é compatível. "type": "json_schema" (com uma definição de schema estrita) ainda não está disponível.

Solução de problemas

Por que estou recebendo erros 403 ao chamar um modelo?

Causas comuns incluem:
  1. Saldo insuficiente na conta — adicione saldo à sua conta e tente novamente.
  2. O modelo exige acesso por whitelist — determinados modelos são restritos. Veja Como solicito acesso à whitelist de modelos? abaixo.
  3. Restrição do plano — o modelo pode não estar incluído no seu plano de assinatura atual.

Por que estou recebendo erros 400?

Causas comuns incluem:
  • O comprimento da entrada excede o limite da janela de contexto do modelo.
  • Tipos de parâmetros ou formatação incorretos.
  • Campos obrigatórios ausentes no corpo da requisição.
Forneça seu trace_id à nossa equipe de suporte para uma investigação detalhada.

O que devo fazer se a API retornar um erro de “server overload”?

Isso indica pressão temporária de recursos na plataforma. Tente novamente após um breve atraso (recomendamos backoff exponencial). Se o problema persistir, entre em contato conosco para confirmação de status.

Acesso a modelos

Como solicito acesso à whitelist de modelos?

Entre em contato com nossa equipe de suporte via Discord ou pelo chat dentro da plataforma com as informações da sua conta e o(s) nome(s) específico(s) do(s) modelo(s) de que você precisa. Nossa equipe analisará e processará sua solicitação.
Última modificação em 15 de maio de 2026