Model Library/MiMo V2.6 Flash
MiMo V2.6 Flash

MiMo V2.6 Flash

xiaomimimo/mimo-v2.6-flash
MiMo V2.6 Flash is Xiaomi's cost-efficient open-source reasoning model for high-frequency calls and large-scale professional workflows. It combines native text, image, video, and audio understanding with a 1M-token context window and up to 128K output tokens, while supporting controllable deep thinking, tool calling, JSON mode, streaming, and prompt caching.

Características

API serverless

Documentación

xiaomimimo/mimo-v2.6-flash is available via Novita's serverless API, where you pay per token. There are several ways to call the API, including OpenAI-compatible endpoints with exceptional reasoning performance.

Serverless disponible

Ejecuta consultas de inmediato, paga solo por el uso

Entrada$0.14 / M Tokens
Lectura de caché$0.0028 / M Tokens
Salida$0.28 / M Tokens

Usa los siguientes ejemplos de código para integrarte con nuestra API:

1from openai import OpenAI
2
3client = OpenAI(
4    api_key="<Your API Key>",
5    base_url="https://api.novita.ai/openai"
6)
7
8response = client.chat.completions.create(
9    model="xiaomimimo/mimo-v2.6-flash",
10    messages=[
11        {"role": "system", "content": "You are a helpful assistant."},
12        {"role": "user", "content": "Hello, how are you?"}
13    ],
14    max_tokens=131072,
15    temperature=0.7
16)
17
18print(response.choices[0].message.content)

Información

Proveedor
Xiaomi
Cuantización
fp8

Funcionalidad compatible

Longitud del contexto
1M
Salida máxima
128K
Serverless
Compatible
Function Calling
Compatible
Structured Output
Compatible
Reasoning
Compatible
API de Anthropic
Compatible
Capacidades de entrada
text, image, video, audio
Capacidades de salida
text

Todo lo que necesitas para crear IA de producción.

Más de 200 modelos, GPUs bajo demanda y entornos de ejecución seguros para agentes, unificados bajo una API. Gratis para empezar, escala a medida que creces.