Model Library/Macaron V1 Tall
Mind Lab

Macaron V1 Tall

mindai/macaron-v1-tall
Macaron-V1-Tall is the efficient model of the Macaron-V1 family, built on Qwen3.6-35B-A3B with four specialist LoRA adapters for Chat, Agent, Coding, and GenUI. It follows the same routed Mixture of LoRA (MoL) design as Macaron-V1-Venti, bringing Macaron’s personal-intelligence, coding, tool-use, and code-native Generative UI capabilities to a smaller and more accessible deployment profile.

Fonctionnalités

API sans serveur

Documentation

mindai/macaron-v1-tall is available via Novita's serverless API, where you pay per token. There are several ways to call the API, including OpenAI-compatible endpoints with exceptional reasoning performance.

Sans serveur disponible

Exécutez des requêtes immédiatement, ne payez que pour l’utilisation

Entrée$0 / M Tokens
Sortie$0 / M Tokens

Utilisez les exemples de code suivants pour intégrer notre API :

1from openai import OpenAI
2
3client = OpenAI(
4    api_key="<Your API Key>",
5    base_url="https://api.novita.ai/openai"
6)
7
8response = client.chat.completions.create(
9    model="mindai/macaron-v1-tall",
10    messages=[
11        {"role": "system", "content": "You are a helpful assistant."},
12        {"role": "user", "content": "Hello, how are you?"}
13    ],
14    max_tokens=32768,
15    temperature=0.7
16)
17
18print(response.choices[0].message.content)

Infos

Fournisseur
Mind Lab
Quantification
-

Fonctionnalités prises en charge

Longueur du contexte
262144
Sortie maximale
32768
Serverless
Pris en charge
Function Calling
Pris en charge
Reasoning
Pris en charge
API Anthropic
Pris en charge
Capacités d’entrée
text
Capacités de sortie
text

Tout ce dont vous avez besoin pour créer une IA de production.

Plus de 200 modèles, des GPUs à la demande et des environnements d’exécution d’agents sécurisés — unifiés sous une seule API. Gratuit pour commencer, évolutif à mesure que vous grandissez.