- Context
- 1M
- Input
- $1.32 /Mt· Cache Read $0.132 /Mt
- Output
- $3.96 /Mt
Explore pricing for our Model APIs and GPU resources. Find the right plan to match your needs with transparent rates and flexible options.
Batch inference is available at an introductory 50% discount on input and output tokens for supported models. Learn More
Modelos avançados de IA da DeepSeek, oferecendo recursos de raciocínio de ponta e preços competitivos para aplicações empresariais e de pesquisa.
Modelos avançados de IA da DeepSeek, oferecendo recursos de raciocínio de ponta e preços competitivos para aplicações empresariais e de pesquisa.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| DeepSeek V4 Pro 0813 | 1M | $1.32 /Mt· Cache Read $0.132 /Mt | $3.96 /Mt | More |
| DeepSeek V4 Flash Vision Exp | 1M | $0.44 /Mt· Cache Read $0.028 /Mt | $1.32 /Mt | More |
| DeepSeek V4 Flash 0731 | 1M | $0.44 /Mt· Cache Read $0.028 /Mt | $1.32 /Mt | More |
| DeepSeek V4 Flash | 1M | $0.14 /Mt· Cache Read $0.028 /Mt | $0.28 /Mt | More |
| DeepSeek V4 Pro | 1M | $1.6 /Mt· Cache Read $0.135 /Mt | $3.2 /Mt | More |
| DeepSeek V3.2 | 160K | $0.269 /Mt· Cache Read $0.1345 /Mt | $0.4 /Mt | More |
| DeepSeek OCR 2 | 8K | $0.03 /Mt | $0.03 /Mt | More |
| DeepSeek V3.2 Exp | 160K | $0.27 /Mt | $0.41 /Mt | More |
| DeepSeek V3.1 Terminus | 128K | $0.27 /Mt· Cache Read $0.135 /Mt | $1 /Mt | More |
| DeepSeek V3.1 | 128K | $0.27 /Mt· Cache Read $0.135 /Mt | $1 /Mt | More |
| DeepSeek R1 0528 | 160K | $0.7 /Mt· Cache Read $0.35 /Mt | $2.5 /Mt | More |
| DeepSeek R1 Distill Llama 70B | 8K | $0.8 /Mt | $0.8 /Mt | More |
| DeepSeek R1 Turbo | 63K | $0.7 /Mt | $2.5 /Mt | More |
Modelos Llama da Meta que oferecem compreensão de linguagem de última geração com arquitetura aberta, projetada para diversas aplicações.
Modelos Llama da Meta que oferecem compreensão de linguagem de última geração com arquitetura aberta, projetada para diversas aplicações.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Llama 3.1 8B Instruct | 16K | $0.02 /Mt | $0.05 /Mt | More |
| Llama 3.3 70B Instruct | 12K | $0.135 /Mt | $0.4 /Mt | More |
| Llama 4 Maverick Instruct | 1M | $0.27 /Mt | $0.85 /Mt | More |
| Llama 4 Scout Instruct | 128K | $0.18 /Mt | $0.59 /Mt | More |
Modelos da série Qwen que oferecem processamento de linguagem eficiente com vários tamanhos de parâmetros, desde soluções leves até soluções de nível empresarial.
Modelos da série Qwen que oferecem processamento de linguagem eficiente com vários tamanhos de parâmetros, desde soluções leves até soluções de nível empresarial.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Qwen3.8 Flash | 977K | $0.15 /Mt· Cache Read $0.016 /Mt | $0.47 /Mt | More |
| Qwen3.8 27B | 977K | $0.42 /Mt· Cache Read $0.085 /Mt | $3 /Mt | More |
| Qwen3.8 2.4T A95B | 977K | $2 /Mt· Cache Read $0.25 /Mt | $6 /Mt | More |
| Qwen3.8 Max | 977K | $2 /Mt· Cache Read $0.25 /Mt | $6 /Mt | More |
| Qwen3.7 Max | 977K | $1.25 /Mt· Cache Read $0.25 /Mt | $3.75 /Mt | More |
| Qwen3.6 27B | 256K | $0.6 /Mt | $3.6 /Mt | More |
| Qwen3.5 27B | 256K | $0.3 /Mt | $2.4 /Mt | More |
| Qwen3.5 122B A10B | 256K | $0.4 /Mt | $3.2 /Mt | More |
| Qwen3.5 35B A3B | 256K | $0.25 /Mt | $2 /Mt | More |
| Qwen3.5 397B A17B | 256K | $0.6 /Mt | $3.6 /Mt | More |
| Qwen3 Coder Next | 256K | $0.2 /Mt | $1.5 /Mt | More |
| Qwen3 VL 235B A22B Thinking | 128K | $0.98 /Mt | $3.95 /Mt | More |
| Qwen3.6 35B A3B | 256K | $0.248 /Mt | $1.485 /Mt | More |
| Qwen3 Next 80B A3B Instruct | 128K | $0.15 /Mt | $1.5 /Mt | More |
| Qwen3 VL 235B A22B Instruct | 128K | $0.3 /Mt | $1.5 /Mt | More |
| Qwen3 Max | 256K | - | More | |
| Qwen3 Coder 480B A35B Instruct | 256K | $0.38 /Mt | $1.55 /Mt | More |
| Qwen3 Coder 30B A3B Instruct | 156K | $0.07 /Mt | $0.27 /Mt | More |
| Qwen3 235B A22B Thinking 2507 | 128K | $0.3 /Mt | $3 /Mt | More |
| Qwen3 235B A22B Instruct 2507 | 128K | $0.09 /Mt | $0.58 /Mt | More |
| Qwen2.5 72B Instruct | 31K | $0.38 /Mt | $0.4 /Mt | More |
| Qwen3 235B A22B | 40K | $0.2 /Mt | $0.8 /Mt | More |
| Qwen3 VL 30B A3B Instruct | 128K | $0.2 /Mt | $0.7 /Mt | More |
| Qwen3 Omni 30B A3B Thinking | 64K | - | More | |
| Qwen3 Omni 30B A3B Instruct | 64K | - | More | |
| Qwen MT Plus | 16K | $0.25 /Mt | $0.75 /Mt | More |
Modelos ERNIE da Baidu que oferecem compreensão avançada da língua chinesa e recursos multimodais, otimizados para aplicações em chinês com preços competitivos.
Modelos ERNIE da Baidu que oferecem compreensão avançada da língua chinesa e recursos multimodais, otimizados para aplicações em chinês com preços competitivos.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| CoBuddy | 128K | $0.28 /Mt· Cache Read $0.07 /Mt | $1.13 /Mt | More |
| ERNIE 4.5 VL 424B A47B | 120K | $0.42 /Mt | $1.25 /Mt | More |
| ERNIE 4.5 21B A3B | 117K | $0.07 /Mt | $0.28 /Mt | More |
Modelos Gemma do Google que oferecem processamento de linguagem de alta qualidade com excelente desempenho para diversas tarefas de NLP.
Modelos Gemma do Google que oferecem processamento de linguagem de alta qualidade com excelente desempenho para diversas tarefas de NLP.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Gemma 4 26B A4B | 256K | $0.13 /Mt | $0.4 /Mt | More |
| Gemma 4 31B | 256K | $0.14 /Mt | $0.4 /Mt | More |
| Gemma 3 27B | 96K | $0.119 /Mt | $0.2 /Mt | More |
Modelos da série GLM da Universidade Tsinghua, com compreensão avançada da língua chinesa e recursos de geração.
Modelos da série GLM da Universidade Tsinghua, com compreensão avançada da língua chinesa e recursos de geração.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| GLM 5.3 Flash | 1M | $0.075 /Mt · Cache Read $0.015 /Mt$0.15 /Mt · Cache Read $0.03 /Mt | $0.25 /Mt$0.5 /Mt | More |
| GLM 5.3 | 1M | $1.4 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5.2 | 1M | $1.4 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5.1 | 200K | $1.38 /Mt· Cache Read $0.26 /Mt | $4.4 /Mt | More |
| GLM 5 | 198K | $1 /Mt· Cache Read $0.2 /Mt | $3.2 /Mt | More |
| GLM 4.7 Flash | 195K | $0.07 /Mt· Cache Read $0.01 /Mt | $0.4 /Mt | More |
| GLM 4.7 | 200K | $0.6 /Mt· Cache Read $0.11 /Mt | $2.2 /Mt | More |
| AutoGLM Phone 9B Multilingual | 64K | $0.035 /Mt | $0.138 /Mt | More |
| GLM 4.6V | 128K | $0.3 /Mt· Cache Read $0.055 /Mt | $0.9 /Mt | More |
| GLM 4.6 | 200K | $0.55 /Mt· Cache Read $0.11 /Mt | $2.2 /Mt | More |
| GLM 4.5V | 64K | $0.6 /Mt· Cache Read $0.11 /Mt | $1.8 /Mt | More |
| GLM 4.5 Air | 128K | $0.13 /Mt· Cache Read $0.025 /Mt | $0.85 /Mt | More |
Modelos especializados ajustados finamente, otimizados para aplicações criativas e de roleplay, com capacidades aprimoradas de narrativa.
Modelos especializados ajustados finamente, otimizados para aplicações criativas e de roleplay, com capacidades aprimoradas de narrativa.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Llama 3 8B Lunaris | 8K | $0.05 /Mt | $0.05 /Mt | More |
| Llama 3 8B Stheno V3.2 | 8K | $0.05 /Mt | $0.05 /Mt | More |
| Llama 3.1 70B Euryale V2.2 | 8K | $1.48 /Mt | $1.48 /Mt | More |
Modelos de linguagem eficientes e poderosos da Mistral AI, projetados para aplicações comerciais e de código aberto.
Modelos de linguagem eficientes e poderosos da Mistral AI, projetados para aplicações comerciais e de código aberto.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Mistral Nemo | 59K | $0.04 /Mt | $0.17 /Mt | More |
Os modelos da Microsoft oferecem recursos multilíngues de última geração com segurança de nível empresarial, perfeitamente integrados ao ecossistema de nuvem Azure. Otimizados para colaboração multiplataforma e inteligência de negócios, esses modelos se destacam na compreensão e geração de documentos — pontos fortes essenciais para fluxos de trabalho do Microsoft 365.
Os modelos da Microsoft oferecem recursos multilíngues de última geração com segurança de nível empresarial, perfeitamente integrados ao ecossistema de nuvem Azure. Otimizados para colaboração multiplataforma e inteligência de negócios, esses modelos se destacam na compreensão e geração de documentos — pontos fortes essenciais para fluxos de trabalho do Microsoft 365.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| WizardLM 2 8x22B | 64K | $0.62 /Mt | $0.62 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Ling 3.0 Flash Fin | 256K | Free | Free | More |
| Ling 3.0 Flash Sante | 256K | Free | Free | More |
| Ling 3.0 Flash | 256K | $0.06 /Mt· Cache Read $0.012 /Mt | $0.18 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Macaron V1 Venti | 1M | $0.825 /Mt· Cache Read $0.165 /Mt | $2.475 /Mt | More |
| Macaron V1 Tall | 256K | $0.2475 /Mt· Cache Read $0.044 /Mt | $1.43 /Mt | More |
Modelos de linguagem avançados da Minimax AI que oferecem recursos robustos de IA conversacional com desempenho otimizado para atendimento ao cliente, geração de conteúdo e aplicações criativas, com forte suporte multilíngue e escalabilidade pronta para empresas.
Modelos de linguagem avançados da Minimax AI que oferecem recursos robustos de IA conversacional com desempenho otimizado para atendimento ao cliente, geração de conteúdo e aplicações criativas, com forte suporte multilíngue e escalabilidade pronta para empresas.
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| MiniMax M3 | 977K | - | More | |
| MiniMax M2.7 | 200K | $0.3 /Mt· Cache Read $0.06 /Mt | $1.2 /Mt | More |
| MiniMax M2.5 Highspeed | 200K | $0.6 /Mt· Cache Read $0.03 /Mt | $2.4 /Mt | More |
| MiniMax M2.5 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M2.1 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M2 | 200K | $0.3 /Mt· Cache Read $0.03 /Mt | $1.2 /Mt | More |
| MiniMax M1 | 977K | $0.55 /Mt | $2.2 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Kimi K3 | 1M | $3 /Mt· Cache Read $0.3 /Mt | $15 /Mt | More |
| Kimi K2.7 Code | 256K | $0.95 /Mt· Cache Read $0.19 /Mt | $4 /Mt | More |
| Kimi K2.6 | 256K | $0.8 /Mt· Cache Read $0.16 /Mt | $3.4 /Mt | More |
| Kimi K2.5 | 256K | $0.6 /Mt· Cache Read $0.1 /Mt | $3 /Mt | More |
| Kimi K2 Thinking | 256K | $0.6 /Mt· Cache Read $0.15 /Mt | $2.5 /Mt | More |
| Kimi K2 Instruct 0905 | 256K | $0.6 /Mt | $2.5 /Mt | More |
| Kimi K2 Instruct | 128K | $0.57 /Mt | $2.3 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| NVIDIA Nemotron 3 Nano 30B A3B | 256K | $0.05 /Mt | $0.2 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| OpenAI GPT OSS 120B | 128K | $0.05 /Mt | $0.25 /Mt | More |
| OpenAI GPT OSS 20B | 128K | $0.04 /Mt | $0.15 /Mt | More |
--
--
| Model Name | Context | Input | Output | Actions |
|---|---|---|---|---|
| Step 3.7 Flash | 256K | $0.2 /Mt· Cache Read $0.04 /Mt | $1.15 /Mt | More |
| Model Name | Context | Input |
|---|---|---|
qwen/qwen3-embedding-0.6b | 32K | $0.07 /Mt |
Qwen3 Embedding 8B | 32K | $0.07 /Mt |
BAAI:BGE-M3 | 8K | $0.01 /Mt |
Pricing may vary based on image dimensions, inference steps, and upscaling factors. Use thePricing Calculatorfor an estimate.
| API Name | Mode | Width&Height | Pricing |
|---|---|---|---|
Qwen-Image Edit | - | - | $0.02 /image |
Qwen-Image Text to Image | - | - | $0.02 /image |
Pricing may vary based on the number of frames, chosen model, and inference steps. Use thePricing Calculatorfor an estimate.
| API Name | Mode | Duration | Resolution | Pricing |
|---|---|---|---|---|
Kling v3.0 Pro Image-to-Video | No Audio | - | $0.112 /s | |
| Audio | - | $0.168 /s | ||
Kling v3.0 Pro Text-to-Video | No Audio | - | $0.112 /s | |
| Audio | - | $0.168 /s | ||
Kling v3.0 Standard Image-to-Video | No Audio | - | $0.084 /s | |
| Audio | - | $0.126 /s | ||
Kling v3.0 Standard Text-to-Video | No Audio | - | $0.084 /s | |
| Audio | - | $0.126 /s | ||
Minimax Hailuo 2.3 Fast Image to Video | - | 6s | 768P | $0.19 /video |
| - | 10s | 768P | $0.32 /video | |
| - | 6s | 1080P | $0.33 /video | |
Minimax Hailuo 2.3 Image to Video | - | 6s | 768P | $0.28 /video |
| - | 10s | 768P | $0.56 /video | |
| - | 6s | 1080P | $0.49 /video | |
Minimax Hailuo 2.3 Text to Video | - | 6s | 768P | $0.28 /video |
| - | 10s | 768P | $0.56 /video | |
| - | 6s | 1080P | $0.49 /video | |
Wan 2.5 Image to Video | - | 5s | 480P | $0.25 /video |
| - | 10s | 480P | $0.50 /video | |
| - | 5s | 720P | $0.50 /video | |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.5 Text to Video | - | 5s | 480P | $0.25 /video |
| - | 10s | 480P | $0.50 /video | |
| - | 5s | 720P | $0.50 /video | |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.6 Image to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 15s | 720P | $1.50 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
| - | 15s | 1080P | $2.25 /video | |
Wan 2.6 Reference to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.6 Text to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 15s | 720P | $1.50 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
| - | 15s | 1080P | $2.25 /video |
| API Name | Model | Steps | Pricing |
|---|---|---|---|
Image to Video | SVD-XT | 20 | $0.024 /video |
| SVD | 20 | $0.0134 /video |
| API Name | Mode | Pricing |
|---|---|---|
Fish Audio Text to Speech | - | $15 /1M characters |
Fish Audio Voice Cloning | - | $0.1 /voice |
MiniMax Voice-Cloning | - | $1.5 /voice |
Text to Speech | - | $15 /1M characters |
| API Name | Mode | Pricing |
|---|---|---|
| EXA | neuralSearch | $0.007/request |
| deepSearch | $0.012/request | |
| deepReasoningSearch | $0.015/request | |
| additional_result | $0.001/result (beyond 10 results) | |
| answer | $0.005/request | |
| contentText | $0.001/item | |
| contentHighlight | $0.001/item | |
| contentSummary | $0.001/item | |
| Tavily | basicSearch | $0.008/request |
| advancedSearch | $0.016/request | |
| basicExtract | $0.0016/url | |
| advancedExtract | $0.0032/url | |
| regularMapping | $0.0008/page | |
| instructedMapping | $0.0016/page | |
| Crawl | Extract + Mapping Cost |
200+ models, on-demand GPUs, and secure agent runtimes — unified under one API. Free to start, scales as you grow.