GLM-5.1

zai-org/glm-5.1

GLM-5.1 is Z.AI's latest flagship model, meticulously engineered for long-horizon autonomous tasks. Capable of working continuously on a single assignment for up to 8 hours, it autonomously manages the entire workflow—from initial planning and execution to iterative optimization and the delivery of production-grade results. While its general capabilities and coding proficiency are on par with Claude Opus 4.6, GLM-5.1 excels particularly in sustained execution, complex engineering optimization, and real-world development scenarios. This makes it the ideal foundational model for powering advanced autonomous agents and long-horizon coding assistants.

Fonctionnalités

API sans serveur

Documentation

zai-org/glm-5.1 is available via Novita's serverless API, where you pay per token. There are several ways to call the API, including OpenAI-compatible endpoints with exceptional reasoning performance.

Sans serveur disponible

Exécutez des requêtes immédiatement, ne payez que pour l’utilisation

Entrée$1.38 / M Tokens

Lecture du cache$0.26 / M Tokens

Sortie$4.4 / M Tokens

Utilisez les exemples de code suivants pour intégrer notre API :

1from openai import OpenAI
2
3client = OpenAI(
4    api_key="<Your API Key>",
5    base_url="https://api.novita.ai/openai"
6)
7
8response = client.chat.completions.create(
9    model="zai-org/glm-5.1",
10    messages=[
11        {"role": "system", "content": "You are a helpful assistant."},
12        {"role": "user", "content": "Hello, how are you?"}
13    ],
14    max_tokens=131072,
15    temperature=0.7
16)
17
18print(response.choices[0].message.content)

Infos

Fournisseur

Zai-org

Quantification

fp8

Fonctionnalités prises en charge

Longueur du contexte

204800

Sortie maximale

131072

Serverless

Pris en charge

Function Calling

Pris en charge

Structured Output

Pris en charge

Reasoning

Pris en charge

API Anthropic

Pris en charge

Capacités d’entrée

text

Capacités de sortie

text

Tout ce dont vous avez besoin pour créer une IA de production.

Plus de 200 modèles, des GPUs à la demande et des environnements d’exécution d’agents sécurisés — unifiés sous une seule API. Gratuit pour commencer, évolutif à mesure que vous grandissez.