Model Library/Llama 3.3 70B Instruct
meta-llama/llama-3.3-70b-instruct

Llama 3.3 70B Instruct

meta-llama/llama-3.3-70b-instruct
The Meta Llama 3.3 multilingual large language model (LLM) is a pretrained and instruction tuned generative model in 70B (text in/text out). The Llama 3.3 instruction tuned text only model is optimized for multilingual dialogue use cases and outperforms many of the available open source and closed chat models on common industry benchmarks. Supported languages: English, German, French, Italian, Portuguese, Hindi, Spanish, and Thai.

Fonctionnalités

API sans serveur

Documentation

meta-llama/llama-3.3-70b-instruct is available via Novita's serverless API, where you pay per token. There are several ways to call the API, including OpenAI-compatible endpoints with exceptional reasoning performance.

Déploiements à la demande

Documentation

On-demand deployments allow you to use meta-llama/llama-3.3-70b-instruct on dedicated GPUs with high-performance serving stack with high reliability and no rate limits.

Sans serveur disponible

Exécutez des requêtes immédiatement, ne payez que pour l’utilisation

Entrée$0.135 / M Tokens
Sortie$0.4 / M Tokens

Utilisez les exemples de code suivants pour intégrer notre API :

1from openai import OpenAI
2
3client = OpenAI(
4    api_key="<Your API Key>",
5    base_url="https://api.novita.ai/openai"
6)
7
8response = client.chat.completions.create(
9    model="meta-llama/llama-3.3-70b-instruct",
10    messages=[
11        {"role": "system", "content": "You are a helpful assistant."},
12        {"role": "user", "content": "Hello, how are you?"}
13    ],
14    max_tokens=120000,
15    temperature=0.7
16)
17
18print(response.choices[0].message.content)

Infos

Fournisseur
Llama
Quantification
bf16

Fonctionnalités prises en charge

Longueur du contexte
131072
Sortie maximale
120000
Serverless
Pris en charge
Function Calling
Pris en charge
Structured Output
Pris en charge
Capacités d’entrée
text
Capacités de sortie
text

Tout ce dont vous avez besoin pour créer une IA de production.

Plus de 200 modèles, des GPUs à la demande et des environnements d’exécution d’agents sécurisés — unifiés sous une seule API. Gratuit pour commencer, évolutif à mesure que vous grandissez.