- Context
- 1M
- Input
- $1.32 /Mt· Cache Read $0.132 /Mt
- Output
- $3.96 /Mt
Explore pricing for our Model APIs and GPU resources. Find the right plan to match your needs with transparent rates and flexible options.
Batch inference is available at an introductory 50% discount on input and output tokens for supported models. Learn More
Modelos de IA avanzados de DeepSeek, que ofrecen capacidades de razonamiento de vanguardia y precios competitivos para aplicaciones empresariales y de investigación.
Modelos de IA avanzados de DeepSeek, que ofrecen capacidades de razonamiento de vanguardia y precios competitivos para aplicaciones empresariales y de investigación.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| DeepSeek V4 Pro 0813 | 1M | $1.32 /Mt· Cache Read $0.132 /Mt | $3.96 /Mt | More |
| DeepSeek V4 Flash Vision Exp | 1M | $0.44 /Mt· Cache Read $0.028 /Mt | $1.32 /Mt | More |
| DeepSeek V4 Flash 0731 | 1M | $0.44 /Mt· Cache Read $0.028 /Mt | $1.32 /Mt | More |
| DeepSeek V4 Flash | 1M | $0.14 /Mt· Cache Read $0.028 /Mt | $0.28 /Mt | More |
| DeepSeek V4 Pro | 1M | $1.6 /Mt· Cache Read $0.135 /Mt | $3.2 /Mt | More |
| DeepSeek V3.2 | 160K | $0.269 /Mt· Cache Read $0.1345 /Mt | $0.4 /Mt | More |
| DeepSeek OCR 2 | 8K | $0.03 /Mt | $0.03 /Mt | More |
| DeepSeek V3.2 Exp | 160K | $0.27 /Mt | $0.41 /Mt | More |
| DeepSeek V3.1 Terminus | 128K | $0.27 /Mt· Cache Read $0.135 /Mt | $1 /Mt | More |
| DeepSeek V3.1 | 128K | $0.27 /Mt· Cache Read $0.135 /Mt | $1 /Mt | More |
| DeepSeek R1 0528 | 160K | $0.7 /Mt· Cache Read $0.35 /Mt | $2.5 /Mt | More |
| DeepSeek R1 Distill Llama 70B | 8K | $0.8 /Mt | $0.8 /Mt | More |
| DeepSeek R1 Turbo | 63K | $0.7 /Mt | $2.5 /Mt | More |
Modelos Llama de Meta que proporcionan comprensión del lenguaje de última generación con una arquitectura abierta diseñada para diversas aplicaciones.
Modelos Llama de Meta que proporcionan comprensión del lenguaje de última generación con una arquitectura abierta diseñada para diversas aplicaciones.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Llama 3.1 8B Instruct | 16K | $0.02 /Mt | $0.05 /Mt | More |
| Llama 3.3 70B Instruct | 12K | $0.135 /Mt | $0.4 /Mt | More |
| Llama 4 Maverick Instruct | 1M | $0.27 /Mt | $0.85 /Mt | More |
| Llama 4 Scout Instruct | 128K | $0.18 /Mt | $0.59 /Mt | More |
Modelos de la serie Qwen que ofrecen procesamiento de lenguaje eficiente con varios tamaños de parámetros, desde soluciones ligeras hasta soluciones de nivel empresarial.
Modelos de la serie Qwen que ofrecen procesamiento de lenguaje eficiente con varios tamaños de parámetros, desde soluciones ligeras hasta soluciones de nivel empresarial.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Qwen3.8 Flash | 977K | $0.15 /Mt· Cache Read $0.016 /Mt | $0.47 /Mt | More |
| Qwen3.8 27B | 977K | $0.42 /Mt· Cache Read $0.085 /Mt | $3 /Mt | More |
| Qwen3.8 2.4T A95B | 977K | $2 /Mt· Cache Read $0.25 /Mt | $6 /Mt | More |
| Qwen3.8 Max | 977K | $2 /Mt· Cache Read $0.25 /Mt | $6 /Mt | More |
| Qwen3.7 Max | 977K | $1.25 /Mt· Cache Read $0.25 /Mt | $3.75 /Mt | More |
| Qwen3.6 27B | 256K | $0.6 /Mt | $3.6 /Mt | More |
| Qwen3.5 27B | 256K | $0.3 /Mt | $2.4 /Mt | More |
| Qwen3.5 122B A10B | 256K | $0.4 /Mt | $3.2 /Mt | More |
| Qwen3.5 35B A3B | 256K | $0.25 /Mt | $2 /Mt | More |
| Qwen3.5 397B A17B | 256K | $0.6 /Mt | $3.6 /Mt | More |
| Qwen3 Coder Next | 256K | $0.2 /Mt | $1.5 /Mt | More |
| Qwen3 VL 235B A22B Thinking | 128K | $0.98 /Mt | $3.95 /Mt | More |
| Qwen3.6 35B A3B | 256K | $0.248 /Mt | $1.485 /Mt | More |
| Qwen3 Next 80B A3B Instruct | 128K | $0.15 /Mt | $1.5 /Mt | More |
| Qwen3 VL 235B A22B Instruct | 128K | $0.3 /Mt | $1.5 /Mt | More |
| Qwen3 Max | 256K | - | More | |
| Qwen3 Coder 480B A35B Instruct | 256K | $0.38 /Mt | $1.55 /Mt | More |
| Qwen3 Coder 30B A3B Instruct | 156K | $0.07 /Mt | $0.27 /Mt | More |
| Qwen3 235B A22B Thinking 2507 | 128K | $0.3 /Mt | $3 /Mt | More |
| Qwen3 235B A22B Instruct 2507 | 128K | $0.09 /Mt | $0.58 /Mt | More |
| Qwen2.5 72B Instruct | 31K | $0.38 /Mt | $0.4 /Mt | More |
| Qwen3 235B A22B | 40K | $0.2 /Mt | $0.8 /Mt | More |
| Qwen3 VL 30B A3B Instruct | 128K | $0.2 /Mt | $0.7 /Mt | More |
| Qwen3 Omni 30B A3B Thinking | 64K | - | More | |
| Qwen3 Omni 30B A3B Instruct | 64K | - | More | |
| Qwen MT Plus | 16K | $0.25 /Mt | $0.75 /Mt | More |
Modelos ERNIE de Baidu que proporcionan comprensión avanzada del idioma chino y capacidades multimodales, optimizados para aplicaciones en chino con precios competitivos.
Modelos ERNIE de Baidu que proporcionan comprensión avanzada del idioma chino y capacidades multimodales, optimizados para aplicaciones en chino con precios competitivos.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| CoBuddy | 128K | $0.28 /Mt· Cache Read $0.07 /Mt | $1.13 /Mt | More |
| ERNIE 4.5 VL 424B A47B | 120K | $0.42 /Mt | $1.25 /Mt | More |
| ERNIE 4.5 21B A3B | 117K | $0.07 /Mt | $0.28 /Mt | More |
Modelos Gemma de Google que ofrecen procesamiento de lenguaje de alta calidad con un rendimiento excelente para diversas tareas de NLP.
Modelos Gemma de Google que ofrecen procesamiento de lenguaje de alta calidad con un rendimiento excelente para diversas tareas de NLP.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Gemma 4 26B A4B | 256K | $0.13 /Mt | $0.4 /Mt | More |
| Gemma 4 31B | 256K | $0.14 /Mt | $0.4 /Mt | More |
| Gemma 3 27B | 96K | $0.119 /Mt | $0.2 /Mt | More |
Modelos de la serie GLM de la Universidad de Tsinghua, con capacidades avanzadas de comprensión y generación del idioma chino.
Modelos de la serie GLM de la Universidad de Tsinghua, con capacidades avanzadas de comprensión y generación del idioma chino.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| GLM 5.3 Flash | 1M | $0.075 /Mt · Cache Read $0.015 /Mt$0.15 /Mt · Cache Read $0.03 /Mt | $0.25 /Mt$0.5 /Mt | More |
| GLM 5.3 | 1M | $1.4 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5.2 | 1M | $1.4 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5.1 | 200K | $1.38 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5 | 198K | $1 /Mt· Cache Read $0.2 /Mt | $3.2 /Mt | More |
| GLM 4.7 Flash | 195K | $0.07 /Mt· Cache Read $0.01 /Mt | $0.4 /Mt | More |
| GLM 4.7 | 200K | $0.6 /Mt· Cache Read $0.11 /Mt | $2.2 /Mt | More |
| AutoGLM Phone 9B Multilingual | 64K | $0.035 /Mt | $0.138 /Mt | More |
| GLM 4.6V | 128K | $0.3 /Mt· Cache Read $0.055 /Mt | $0.9 /Mt | More |
| GLM 4.6 | 200K | $0.55 /Mt· Cache Read $0.11 /Mt | $2.2 /Mt | More |
| GLM 4.5V | 64K | $0.6 /Mt· Cache Read $0.11 /Mt | $1.8 /Mt | More |
| GLM 4.5 Air | 128K | $0.13 /Mt· Cache Read $0.025 /Mt | $0.85 /Mt | More |
Modelos especializados ajustados finamente, optimizados para aplicaciones creativas y de rol con capacidades mejoradas de narración.
Modelos especializados ajustados finamente, optimizados para aplicaciones creativas y de rol con capacidades mejoradas de narración.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Llama 3 8B Lunaris | 8K | $0.05 /Mt | $0.05 /Mt | More |
| Llama 3 8B Stheno V3.2 | 8K | $0.05 /Mt | $0.05 /Mt | More |
| Llama 3.1 70B Euryale V2.2 | 8K | $1.48 /Mt | $1.48 /Mt | More |
Modelos de lenguaje eficientes y potentes de Mistral AI, diseñados tanto para aplicaciones comerciales como de código abierto.
Modelos de lenguaje eficientes y potentes de Mistral AI, diseñados tanto para aplicaciones comerciales como de código abierto.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Mistral Nemo | 59K | $0.04 /Mt | $0.17 /Mt | More |
Los modelos de Microsoft ofrecen capacidades multilingües de última generación con seguridad de nivel empresarial, integradas perfectamente en el ecosistema de la nube de Azure. Optimizados para la colaboración multiplataforma y la inteligencia empresarial, estos modelos destacan en la comprensión y generación de documentos, fortalezas clave para los flujos de trabajo de Microsoft 365.
Los modelos de Microsoft ofrecen capacidades multilingües de última generación con seguridad de nivel empresarial, integradas perfectamente en el ecosistema de la nube de Azure. Optimizados para la colaboración multiplataforma y la inteligencia empresarial, estos modelos destacan en la comprensión y generación de documentos, fortalezas clave para los flujos de trabajo de Microsoft 365.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| WizardLM 2 8x22B | 64K | $0.62 /Mt | $0.62 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Ling 3.0 Flash Fin | 256K | Free | Free | More |
| Ling 3.0 Flash Sante | 256K | Free | Free | More |
| Ling 3.0 Flash | 256K | $0.06 /Mt· Cache Read $0.012 /Mt | $0.18 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Macaron V1 Venti | 1M | $0.825 /Mt· Cache Read $0.165 /Mt | $2.475 /Mt | More |
| Macaron V1 Tall | 256K | $0.2475 /Mt· Cache Read $0.044 /Mt | $1.43 /Mt | More |
Los modelos de lenguaje avanzados de Minimax AI ofrecen sólidas capacidades de IA conversacional con rendimiento optimizado para atención al cliente, generación de contenido y aplicaciones creativas, con sólido soporte multilingüe y escalabilidad lista para empresas.
Los modelos de lenguaje avanzados de Minimax AI ofrecen sólidas capacidades de IA conversacional con rendimiento optimizado para atención al cliente, generación de contenido y aplicaciones creativas, con sólido soporte multilingüe y escalabilidad lista para empresas.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| MiniMax M3 | 977K | - | More | |
| MiniMax M2.7 | 200K | $0.3 /Mt· Cache Read $0.06 /Mt | $1.2 /Mt | More |
| MiniMax M2.5 Highspeed | 200K | $0.6 /Mt· Cache Read $0.03 /Mt | $2.4 /Mt | More |
| MiniMax M2.5 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M2.1 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M2 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M1 | 977K | $0.55 /Mt | $2.2 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Kimi K3 | 1M | $3 /Mt· Cache Read $0.3 /Mt | $15 /Mt | More |
| Kimi K2.7 Code | 256K | $0.95 /Mt· Cache Read $0.19 /Mt | $4 /Mt | More |
| Kimi K2.6 | 256K | $0.8 /Mt· Cache Read $0.16 /Mt | $3.4 /Mt | More |
| Kimi K2.5 | 256K | $0.6 /Mt· Cache Read $0.1 /Mt | $3 /Mt | More |
| Kimi K2 Thinking | 256K | $0.6 /Mt· Cache Read $0.15 /Mt | $2.5 /Mt | More |
| Kimi K2 Instruct 0905 | 256K | $0.6 /Mt | $2.5 /Mt | More |
| Kimi K2 Instruct | 128K | $0.57 /Mt | $2.3 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| NVIDIA Nemotron 3 Nano 30B A3B | 256K | $0.05 /Mt | $0.2 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| OpenAI GPT OSS 120B | 128K | $0.05 /Mt | $0.25 /Mt | More |
| OpenAI GPT OSS 20B | 128K | $0.04 /Mt | $0.15 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Step 3.7 Flash | 256K | $0.2 /Mt· Cache Read $0.04 /Mt | $1.15 /Mt | More |
| Model Name | Context | Input |
|---|---|---|
qwen/qwen3-embedding-0.6b | 32K | $0.07 /Mt |
Qwen3 Embedding 8B | 32K | $0.07 /Mt |
BAAI:BGE-M3 | 8K | $0.01 /Mt |
Pricing may vary based on image dimensions, inference steps, and upscaling factors. Use thePricing Calculatorfor an estimate.
| API Name | Mode | Width&Height | Pricing |
|---|---|---|---|
Qwen-Image Edit | - | - | $0.02 /image |
Qwen-Image Text to Image | - | - | $0.02 /image |
Pricing may vary based on the number of frames, chosen model, and inference steps. Use thePricing Calculatorfor an estimate.
| API Name | Mode | Duration | Resolution | Pricing |
|---|---|---|---|---|
Kling v3.0 Pro Image-to-Video | No Audio | - | $0.112 /s | |
| Audio | - | $0.168 /s | ||
Kling v3.0 Pro Text-to-Video | No Audio | - | $0.112 /s | |
| Audio | - | $0.168 /s | ||
Kling v3.0 Standard Image-to-Video | No Audio | - | $0.084 /s | |
| Audio | - | $0.126 /s | ||
Kling v3.0 Standard Text-to-Video | No Audio | - | $0.084 /s | |
| Audio | - | $0.126 /s | ||
Minimax Hailuo 2.3 Fast Image to Video | - | 6s | 768P | $0.19 /video |
| - | 10s | 768P | $0.32 /video | |
| - | 6s | 1080P | $0.33 /video | |
Minimax Hailuo 2.3 Image to Video | - | 6s | 768P | $0.28 /video |
| - | 10s | 768P | $0.56 /video | |
| - | 6s | 1080P | $0.49 /video | |
Minimax Hailuo 2.3 Text to Video | - | 6s | 768P | $0.28 /video |
| - | 10s | 768P | $0.56 /video | |
| - | 6s | 1080P | $0.49 /video | |
Wan 2.5 Image to Video | - | 5s | 480P | $0.25 /video |
| - | 10s | 480P | $0.50 /video | |
| - | 5s | 720P | $0.50 /video | |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.5 Text to Video | - | 5s | 480P | $0.25 /video |
| - | 10s | 480P | $0.50 /video | |
| - | 5s | 720P | $0.50 /video | |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.6 Image to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 15s | 720P | $1.50 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
| - | 15s | 1080P | $2.25 /video | |
Wan 2.6 Reference to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.6 Text to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 15s | 720P | $1.50 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
| - | 15s | 1080P | $2.25 /video |
| API Name | Model | Steps | Pricing |
|---|---|---|---|
Image to Video | SVD-XT | 20 | $0.024 /video |
| SVD | 20 | $0.0134 /video |
| API Name | Mode | Pricing |
|---|---|---|
Fish Audio Text to Speech | - | $15 /1M characters |
Fish Audio Voice Cloning | - | $0.1 /voice |
MiniMax Voice-Cloning | - | $1.5 /voice |
Text to Speech | - | $15 /1M characters |
| API Name | Mode | Pricing |
|---|---|---|
| EXA | neuralSearch | $0.007/request |
| deepSearch | $0.012/request | |
| deepReasoningSearch | $0.015/request | |
| additional_result | $0.001/result (beyond 10 results) | |
| answer | $0.005/request | |
| contentText | $0.001/item | |
| contentHighlight | $0.001/item | |
| contentSummary | $0.001/item | |
| Tavily | basicSearch | $0.008/request |
| advancedSearch | $0.016/request | |
| basicExtract | $0.0016/url | |
| advancedExtract | $0.0032/url | |
| regularMapping | $0.0008/page | |
| instructedMapping | $0.0016/page | |
| Crawl | Extract + Mapping Cost |
200+ models, on-demand GPUs, and secure agent runtimes — unified under one API. Free to start, scales as you grow.