Model Library/Llama3 70B Instruct
Llama

Llama3 70B Instruct

meta-llama/llama-3-70b-instruct
Meta's latest class of model (Llama 3) launched with a variety of sizes & flavors. This 70B instruct-tuned version was optimized for high quality dialogue usecases. It has demonstrated strong performance compared to leading closed-source models in human evaluations.

Características

API serverless

Documentación

meta-llama/llama-3-70b-instruct is available via Novita's serverless API, where you pay per token. There are several ways to call the API, including OpenAI-compatible endpoints with exceptional reasoning performance.

Implementaciones bajo demanda

Documentación

On-demand deployments allow you to use meta-llama/llama-3-70b-instruct on dedicated GPUs with high-performance serving stack with high reliability and no rate limits.

Serverless disponible

Ejecuta consultas de inmediato, paga solo por el uso

Entrada$0.51 / M Tokens
Salida$0.74 / M Tokens

Usa los siguientes ejemplos de código para integrarte con nuestra API:

1from openai import OpenAI
2
3client = OpenAI(
4    api_key="<Your API Key>",
5    base_url="https://api.novita.ai/openai"
6)
7
8response = client.chat.completions.create(
9    model="meta-llama/llama-3-70b-instruct",
10    messages=[
11        {"role": "system", "content": "You are a helpful assistant."},
12        {"role": "user", "content": "Hello, how are you?"}
13    ],
14    max_tokens=8000,
15    temperature=0.7
16)
17
18print(response.choices[0].message.content)

Información

Proveedor
Llama
Cuantización
fp8

Funcionalidad compatible

Longitud del contexto
8192
Salida máxima
8000
Serverless
Compatible
Structured Output
Compatible
Capacidades de entrada
text
Capacidades de salida
text

Todo lo que necesitas para crear IA de producción.

Más de 200 modelos, GPUs bajo demanda y entornos de ejecución seguros para agentes, unificados bajo una API. Gratis para empezar, escala a medida que creces.