Model Library/qwen/qwen3-vl-30b-a3b-thinking

qwen/qwen3-vl-30b-a3b-thinking

Fonctionnalités

API sans serveur

Documentation

qwen/qwen3-vl-30b-a3b-thinking is available via Novita's serverless API, where you pay per token. There are several ways to call the API, including OpenAI-compatible endpoints with exceptional reasoning performance.

Déploiements à la demande

Documentation

On-demand deployments allow you to use qwen/qwen3-vl-30b-a3b-thinking on dedicated GPUs with high-performance serving stack with high reliability and no rate limits.

Sans serveur disponible

Exécutez des requêtes immédiatement, ne payez que pour l’utilisation

Entrée$0.2 / M Tokens

Sortie$1 / M Tokens

Utilisez les exemples de code suivants pour intégrer notre API :

1from openai import OpenAI
2
3client = OpenAI(
4    api_key="<Your API Key>",
5    base_url="https://api.novita.ai/openai"
6)
7
8response = client.chat.completions.create(
9    model="qwen/qwen3-vl-30b-a3b-thinking",
10    messages=[
11        {"role": "system", "content": "You are a helpful assistant."},
12        {"role": "user", "content": "Hello, how are you?"}
13    ],
14    max_tokens=32768,
15    temperature=0.7
16)
17
18print(response.choices[0].message.content)

Infos

Fournisseur

Qwen

Quantification

fp16

Fonctionnalités prises en charge

Longueur du contexte

131072

Sortie maximale

32768

Serverless

Pris en charge

Function Calling

Pris en charge

Structured Output

Pris en charge

Capacités d’entrée

text, image, video

Capacités de sortie

text

Tout ce dont vous avez besoin pour créer une IA de production.

Plus de 200 modèles, des GPUs à la demande et des environnements d’exécution d’agents sécurisés — unifiés sous une seule API. Gratuit pour commencer, évolutif à mesure que vous grandissez.