Skip to main content

Guide d’utilisation des bons

Quels types de bons Novita propose-t-il ?

Novita propose actuellement les types de bons suivants pour aider les utilisateurs à découvrir les services de la plateforme :
  • Bon pour nouvel utilisateur : disponible pour les utilisateurs inscrits pour la première fois afin d’essayer des services associés à différents types de modèles.
  • Bon de parrainage : obtenu en invitant d’autres personnes à s’inscrire et à effectuer des tâches sur la plateforme.

Limites de débit pour l’utilisation des modèles

Quelles sont les limites RPM pour les différents utilisateurs ?

Les limites RPM (Requests Per Minute, requêtes par minute) varient selon le niveau de vérification et le statut du compte de l’utilisateur. Pour connaître les limites détaillées, veuillez consulter la documentation officielle :
👉 Pour obtenir de l’aide supplémentaire, veuillez réserver un appel avec notre équipe commerciale

Politique d’ajustement et de mise à niveau du RPM

Les utilisateurs peuvent-ils demander une augmentation des limites RPM ?

Oui. Novita permet des mises à niveau RPM flexibles en fonction des besoins d’utilisation. Les règles sont indiquées ci-dessous :
  • Modèles DeepSeek : la plateforme s’efforcera de répondre aux besoins raisonnables de montée en charge.
  • Autres modèles : les augmentations de RPM sont évaluées en fonction du coût du modèle et du comportement réel de l’utilisateur, sous réserve de la capacité disponible.

Processus de demande :

Utilisateur → Customer Manager / Tech Support → Examen et approbation par l’équipe produit

Que se passe-t-il si l’utilisation réelle est inférieure au RPM engagé ?

Si le RPM réel de l’utilisateur reste inférieur au niveau engagé pendant une semaine consécutive, la plateforme ajustera la politique de limites de débit comme suit :
  • Réduire la limite au pic de RPM observé au cours de la semaine précédente, ou
  • Revenir à la limite de débit par défaut du modèle (selon la valeur la plus basse).

La mise à niveau RPM en libre-service est-elle prise en charge ?

Oui. Novita prévoit de lancer un package de mise à niveau RPM, permettant aux utilisateurs de gérer et d’augmenter leurs limites RPM de manière autonome, sans approbation manuelle. Pour obtenir de l’aide supplémentaire, veuillez réserver un appel avec notre équipe commerciale.

Comment contrôler la fonction de réflexion de Zai-org/GLM-4.5 lors de l’appel à son API ?

Lors de l’appel à l’API zai-org/glm-4.5,, il existe toujours des situations où la fonction de réflexion n’est pas nécessaire. Dans ces cas, si vous souhaitez désactiver la fonction de réflexion, vous pouvez simplement ajouter une phrase fixe appelée :
à la fin, par exemple :

Facturation

Quelle est la priorité de facturation lors de l’utilisation du Coding Plan ?

Le système déduit d’abord votre quota Coding Plan. Ce n’est qu’une fois le quota du Coding Plan entièrement épuisé que les frais seront appliqués au solde de votre compte API.

Comment les 50 M de tokens du Coding Plan sont-ils calculés ?

Les tokens sont calculés sur la base de nombres de tokens équivalents au tarif de base. Les différents modèles ont des pondérations tarifaires variables, proportionnelles à leurs ratios de coût. Les tokens d’entrée comme les tokens de sortie sont comptabilisés dans votre utilisation totale.

Comment les tokens mis en cache sont-ils facturés ?

Les tokens de lecture mis en cache sont facturés à un tarif réduit, environ 1/10th du prix standard des tokens d’entrée (les tarifs exacts varient selon le modèle). Les opérations d’écriture dans le cache sont facturées au tarif normal des tokens d’entrée.

Mode de réflexion

Comment désactiver le mode de réflexion pour les modèles de raisonnement ?

Le comportement varie selon le modèle :
  • moonshotai/Kimi-K2-Instruct et zai-org/GLM-4.5 : ajoutez "enable_thinking": false au corps de votre requête.
  • MiniMax-M1 : le mode de réflexion ne peut actuellement pas être désactivé pour ce modèle.

Prise en charge des fonctionnalités

Le paramètre top_logprobs est-il pris en charge ?

Le paramètre top_logprobs n’est actuellement pas pris en charge.

La sortie structurée (response_format) est-elle prise en charge ?

Actuellement, seul "type": "json_object" est pris en charge. "type": "json_schema" (avec une définition de schéma stricte) n’est pas encore disponible.

Dépannage

Pourquoi est-ce que je reçois des erreurs 403 lors de l’appel à un modèle ?

Les causes courantes incluent :
  1. Solde de compte insuffisant — rechargez votre compte et réessayez.
  2. Le modèle nécessite un accès via liste blanche — certains modèles sont restreints. Consultez Comment demander l’accès à un modèle via liste blanche ? ci-dessous.
  3. Restriction liée au plan — le modèle peut ne pas être inclus dans votre plan d’abonnement actuel.

Pourquoi est-ce que je reçois des erreurs 400 ?

Les causes courantes incluent :
  • La longueur d’entrée dépasse la limite de fenêtre de contexte du modèle.
  • Types de paramètres ou formatage incorrects.
  • Champs obligatoires manquants dans le corps de la requête.
Veuillez fournir votre trace_id à notre équipe d’assistance pour une investigation détaillée.

Que dois-je faire si l’API renvoie une erreur “server overload” ?

Cela indique une pression temporaire sur les ressources de la plateforme. Réessayez votre requête après un court délai (nous recommandons un backoff exponentiel). Si le problème persiste, contactez-nous pour confirmer le statut.

Accès aux modèles

Comment demander l’accès à un modèle via liste blanche ?

Contactez notre équipe d’assistance via Discord ou le chat intégré à la plateforme avec les informations de votre compte et le(s) nom(s) de modèle spécifique(s) dont vous avez besoin. Notre équipe examinera et traitera votre demande.
Dernière modification le 15 mai 2026