Model Library/Nemotron 3 Nano 30B A3B

Nemotron 3 Nano 30B A3B

nvidia/nemotron-3-nano-30b-a3b

Nemotron-3-Nano-30B-A3B is NVIDIA's compute-efficient, open-weight reasoning model built for agentic AI. Its Mixture-of-Experts design (30B total / 3.5B active) with a hybrid Mamba-2 + Transformer architecture delivers strong reasoning and tool use at a fraction of the compute required by comparable dense models. It supports a 256K context window, toggleable chain-of-thought reasoning, function calling, and structured (JSON) outputs — making it well-suited for long-context agents, coding, and math. Released under the NVIDIA Nemotron Open Model License and ready for commercial use.

Características

API serverless

Documentación

nvidia/nemotron-3-nano-30b-a3b is available via Novita's serverless API, where you pay per token. There are several ways to call the API, including OpenAI-compatible endpoints with exceptional reasoning performance.

Serverless disponible

Ejecuta consultas de inmediato, paga solo por el uso

Entrada$0.05 / M Tokens

Salida$0.2 / M Tokens

Usa los siguientes ejemplos de código para integrarte con nuestra API:

1from openai import OpenAI
2
3client = OpenAI(
4    api_key="<Your API Key>",
5    base_url="https://api.novita.ai/openai"
6)
7
8response = client.chat.completions.create(
9    model="nvidia/nemotron-3-nano-30b-a3b",
10    messages=[
11        {"role": "system", "content": "You are a helpful assistant."},
12        {"role": "user", "content": "Hello, how are you?"}
13    ],
14    max_tokens=32768,
15    temperature=0.7
16)
17
18print(response.choices[0].message.content)

Información

Proveedor

Nvidia

Cuantización

fp4

Funcionalidad compatible

Longitud del contexto

262144

Salida máxima

32768

Serverless

Compatible

Function Calling

Compatible

Structured Output

Compatible

Reasoning

Compatible

Capacidades de entrada

text

Capacidades de salida

text

Todo lo que necesitas para crear IA de producción.

Más de 200 modelos, GPUs bajo demanda y entornos de ejecución seguros para agentes, unificados bajo una API. Gratis para empezar, escala a medida que creces.