- Kontext
- 1M
- Eingabe
- $1.32 /Mt· · Cache-Lesen $0.044 /Mt
- Ausgabe
- $3.96 /Mt
Entdecken Sie die Preise für unsere Modell-APIs und GPU-Ressourcen. Finden Sie den passenden Tarif für Ihre Anforderungen – mit transparenten Preisen und flexiblen Optionen.
Batch-Inferenz ist für unterstützte Modelle zum Einführungspreis mit 50 % Rabatt auf Eingabe- und Ausgabetokens verfügbar. Mehr erfahren
Modelos avançados de IA da DeepSeek, oferecendo recursos de raciocínio de ponta e preços competitivos para aplicações empresariais e de pesquisa.
Modelos avançados de IA da DeepSeek, oferecendo recursos de raciocínio de ponta e preços competitivos para aplicações empresariais e de pesquisa.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| DeepSeek V4 Pro 0813 | 1M | $1.32 /Mt· · Cache-Lesen $0.044 /Mt | $3.96 /Mt | Mehr |
| DeepSeek V4 Flash Vision Exp | 1M | $0.44 /Mt· · Cache-Lesen $0.028 /Mt | $1.32 /Mt | Mehr |
| DeepSeek V4 Flash 0731 | 1M | $0.44 /Mt· · Cache-Lesen $0.028 /Mt | $1.32 /Mt | Mehr |
| DeepSeek V4 Flash | 1M | $0.14 /Mt· · Cache-Lesen $0.028 /Mt | $0.28 /Mt | Mehr |
| DeepSeek V4 Pro | 1M | $1.6 /Mt· · Cache-Lesen $0.135 /Mt | $3.2 /Mt | Mehr |
| DeepSeek V3.2 | 160K | $0.269 /Mt· · Cache-Lesen $0.1345 /Mt | $0.4 /Mt | Mehr |
| DeepSeek OCR 2 | 8K | $0.03 /Mt | $0.03 /Mt | Mehr |
| DeepSeek V3.2 Exp | 160K | $0.27 /Mt | $0.41 /Mt | Mehr |
| DeepSeek V3.1 Terminus | 128K | $0.27 /Mt· · Cache-Lesen $0.135 /Mt | $1 /Mt | Mehr |
| DeepSeek V3.1 | 128K | $0.27 /Mt· · Cache-Lesen $0.135 /Mt | $1 /Mt | Mehr |
| DeepSeek R1 0528 | 160K | $0.7 /Mt· · Cache-Lesen $0.35 /Mt | $2.5 /Mt | Mehr |
| DeepSeek R1 Distill Llama 70B | 8K | $0.8 /Mt | $0.8 /Mt | Mehr |
| DeepSeek R1 Turbo | 63K | $0.7 /Mt | $2.5 /Mt | Mehr |
Modelos Llama da Meta que oferecem compreensão de linguagem de última geração com arquitetura aberta, projetada para diversas aplicações.
Modelos Llama da Meta que oferecem compreensão de linguagem de última geração com arquitetura aberta, projetada para diversas aplicações.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Llama 3.1 8B Instruct | 16K | $0.02 /Mt | $0.05 /Mt | Mehr |
| Llama 3.3 70B Instruct | 12K | $0.135 /Mt | $0.4 /Mt | Mehr |
| Llama 4 Maverick Instruct | 1M | $0.27 /Mt | $0.85 /Mt | Mehr |
| Llama 4 Scout Instruct | 128K | $0.18 /Mt | $0.59 /Mt | Mehr |
Modelos da série Qwen que oferecem processamento de linguagem eficiente com vários tamanhos de parâmetros, desde soluções leves até soluções de nível empresarial.
Modelos da série Qwen que oferecem processamento de linguagem eficiente com vários tamanhos de parâmetros, desde soluções leves até soluções de nível empresarial.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Qwen3.8 Flash | 977K | $0.15 /Mt· · Cache-Lesen $0.016 /Mt | $0.47 /Mt | Mehr |
| Qwen3.8 27B | 977K | $0.42 /Mt· · Cache-Lesen $0.085 /Mt | $3 /Mt | Mehr |
| Qwen3.8 2.4T A95B | 977K | $2 /Mt· · Cache-Lesen $0.25 /Mt | $6 /Mt | Mehr |
| Qwen3.8 Max | 977K | $2 /Mt· · Cache-Lesen $0.25 /Mt | $6 /Mt | Mehr |
| Qwen3.7 Max | 977K | $1.25 /Mt· · Cache-Lesen $0.25 /Mt | $3.75 /Mt | Mehr |
| Qwen3.6 27B | 256K | $0.6 /Mt | $3.6 /Mt | Mehr |
| Qwen3.5 27B | 256K | $0.3 /Mt | $2.4 /Mt | Mehr |
| Qwen3.5 122B A10B | 256K | $0.4 /Mt | $3.2 /Mt | Mehr |
| Qwen3.5 35B A3B | 256K | $0.25 /Mt | $2 /Mt | Mehr |
| Qwen3.5 397B A17B | 256K | $0.6 /Mt | $3.6 /Mt | Mehr |
| Qwen3 Coder Next | 256K | $0.2 /Mt | $1.5 /Mt | Mehr |
| Qwen3 VL 235B A22B Thinking | 128K | $0.98 /Mt | $3.95 /Mt | Mehr |
| Qwen3.6 35B A3B | 256K | $0.248 /Mt | $1.485 /Mt | Mehr |
| Qwen3 Next 80B A3B Instruct | 128K | $0.15 /Mt | $1.5 /Mt | Mehr |
| Qwen3 VL 235B A22B Instruct | 128K | $0.3 /Mt | $1.5 /Mt | Mehr |
| Qwen3 Max | 256K | - | Mehr | |
| Qwen3 Coder 480B A35B Instruct | 256K | $0.38 /Mt | $1.55 /Mt | Mehr |
| Qwen3 Coder 30B A3B Instruct | 156K | $0.07 /Mt | $0.27 /Mt | Mehr |
| Qwen3 235B A22B Thinking 2507 | 128K | $0.3 /Mt | $3 /Mt | Mehr |
| Qwen3 235B A22B Instruct 2507 | 128K | $0.09 /Mt | $0.58 /Mt | Mehr |
| Qwen2.5 72B Instruct | 31K | $0.38 /Mt | $0.4 /Mt | Mehr |
| Qwen3 235B A22B | 40K | $0.2 /Mt | $0.8 /Mt | Mehr |
| Qwen3 VL 30B A3B Instruct | 128K | $0.2 /Mt | $0.7 /Mt | Mehr |
| Qwen3 Omni 30B A3B Thinking | 64K | - | Mehr | |
| Qwen3 Omni 30B A3B Instruct | 64K | - | Mehr | |
| Qwen MT Plus | 16K | $0.25 /Mt | $0.75 /Mt | Mehr |
Modelos ERNIE da Baidu que oferecem compreensão avançada da língua chinesa e recursos multimodais, otimizados para aplicações em chinês com preços competitivos.
Modelos ERNIE da Baidu que oferecem compreensão avançada da língua chinesa e recursos multimodais, otimizados para aplicações em chinês com preços competitivos.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| CoBuddy | 128K | $0.28 /Mt· · Cache-Lesen $0.07 /Mt | $1.13 /Mt | Mehr |
| ERNIE 4.5 VL 424B A47B | 120K | $0.42 /Mt | $1.25 /Mt | Mehr |
| ERNIE 4.5 21B A3B | 117K | $0.07 /Mt | $0.28 /Mt | Mehr |
Modelos Gemma do Google que oferecem processamento de linguagem de alta qualidade com excelente desempenho para diversas tarefas de NLP.
Modelos Gemma do Google que oferecem processamento de linguagem de alta qualidade com excelente desempenho para diversas tarefas de NLP.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Gemma 4 26B A4B | 256K | $0.13 /Mt | $0.4 /Mt | Mehr |
| Gemma 4 31B | 256K | $0.14 /Mt | $0.4 /Mt | Mehr |
| Gemma 3 27B | 96K | $0.119 /Mt | $0.2 /Mt | Mehr |
Modelos da série GLM da Universidade Tsinghua, com compreensão avançada da língua chinesa e recursos de geração.
Modelos da série GLM da Universidade Tsinghua, com compreensão avançada da língua chinesa e recursos de geração.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| GLM 5.3 Flash | 1M | $0.15 /Mt· · Cache-Lesen $0.03 /Mt | $0.5 /Mt | Mehr |
| GLM 5.3 | 1M | $1.4 /Mt· · Cache-Lesen $0.26 /Mt | $4.4 /Mt | Mehr |
| GLM 5.2 | 1M | $1.4 /Mt· · Cache-Lesen $0.26 /Mt | $4.4 /Mt | Mehr |
| GLM 5.1 | 200K | $1.38 /Mt· · Cache-Lesen $0.26 /Mt | $4.4 /Mt | Mehr |
| GLM 5 | 198K | $1 /Mt· · Cache-Lesen $0.2 /Mt | $3.2 /Mt | Mehr |
| GLM 4.7 Flash | 195K | $0.07 /Mt· · Cache-Lesen $0.01 /Mt | $0.4 /Mt | Mehr |
| GLM 4.7 | 200K | $0.6 /Mt· · Cache-Lesen $0.11 /Mt | $2.2 /Mt | Mehr |
| AutoGLM Phone 9B Multilingual | 64K | $0.035 /Mt | $0.138 /Mt | Mehr |
| GLM 4.6V | 128K | $0.3 /Mt· · Cache-Lesen $0.055 /Mt | $0.9 /Mt | Mehr |
| GLM 4.6 | 200K | $0.55 /Mt· · Cache-Lesen $0.11 /Mt | $2.2 /Mt | Mehr |
| GLM 4.5V | 64K | $0.6 /Mt· · Cache-Lesen $0.11 /Mt | $1.8 /Mt | Mehr |
| GLM 4.5 Air | 128K | $0.13 /Mt· · Cache-Lesen $0.025 /Mt | $0.85 /Mt | Mehr |
Modelos especializados ajustados finamente, otimizados para aplicações criativas e de roleplay, com capacidades aprimoradas de narrativa.
Modelos especializados ajustados finamente, otimizados para aplicações criativas e de roleplay, com capacidades aprimoradas de narrativa.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Llama 3 8B Lunaris | 8K | $0.05 /Mt | $0.05 /Mt | Mehr |
| Llama 3 8B Stheno V3.2 | 8K | $0.05 /Mt | $0.05 /Mt | Mehr |
| Llama 3.1 70B Euryale V2.2 | 8K | $1.48 /Mt | $1.48 /Mt | Mehr |
Modelos de linguagem eficientes e poderosos da Mistral AI, projetados para aplicações comerciais e de código aberto.
Modelos de linguagem eficientes e poderosos da Mistral AI, projetados para aplicações comerciais e de código aberto.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Mistral Nemo | 59K | $0.04 /Mt | $0.17 /Mt | Mehr |
Os modelos da Microsoft oferecem recursos multilíngues de última geração com segurança de nível empresarial, perfeitamente integrados ao ecossistema de nuvem Azure. Otimizados para colaboração multiplataforma e inteligência de negócios, esses modelos se destacam na compreensão e geração de documentos — pontos fortes essenciais para fluxos de trabalho do Microsoft 365.
Os modelos da Microsoft oferecem recursos multilíngues de última geração com segurança de nível empresarial, perfeitamente integrados ao ecossistema de nuvem Azure. Otimizados para colaboração multiplataforma e inteligência de negócios, esses modelos se destacam na compreensão e geração de documentos — pontos fortes essenciais para fluxos de trabalho do Microsoft 365.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| WizardLM 2 8x22B | 64K | $0.62 /Mt | $0.62 /Mt | Mehr |
--
--
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Ling 3.0 Flash Fin | 256K | Kostenlos | Kostenlos | Mehr |
| Ling 3.0 Flash VL | 256K | Kostenlos | Kostenlos | Mehr |
| Ling 3.0 Flash Sante | 256K | Kostenlos | Kostenlos | Mehr |
| Ling 3.0 Flash | 256K | $0.06 /Mt· · Cache-Lesen $0.012 /Mt | $0.18 /Mt | Mehr |
--
--
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Macaron V1 Venti | 1M | $0.825 /Mt· · Cache-Lesen $0.165 /Mt | $2.475 /Mt | Mehr |
| Macaron V1 Tall | 256K | $0.2475 /Mt· · Cache-Lesen $0.044 /Mt | $1.43 /Mt | Mehr |
Modelos de linguagem avançados da Minimax AI que oferecem recursos robustos de IA conversacional com desempenho otimizado para atendimento ao cliente, geração de conteúdo e aplicações criativas, com forte suporte multilíngue e escalabilidade pronta para empresas.
Modelos de linguagem avançados da Minimax AI que oferecem recursos robustos de IA conversacional com desempenho otimizado para atendimento ao cliente, geração de conteúdo e aplicações criativas, com forte suporte multilíngue e escalabilidade pronta para empresas.
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| MiniMax M3 | 977K | - | Mehr | |
| MiniMax M2.7 | 200K | $0.3 /Mt· · Cache-Lesen $0.06 /Mt | $1.2 /Mt | Mehr |
| MiniMax M2.5 Highspeed | 200K | $0.6 /Mt· · Cache-Lesen $0.03 /Mt | $2.4 /Mt | Mehr |
| MiniMax M2.5 | 200K | $0.3 /Mt· · Cache-Lesen $0.03 /Mt | $1.2 /Mt | Mehr |
| MiniMax M2.1 | 200K | $0.3 /Mt· · Cache-Lesen $0.03 /Mt | $1.2 /Mt | Mehr |
| MiniMax M2 | 200K | $0.3 /Mt· · Cache-Lesen $0.03 /Mt | $1.2 /Mt | Mehr |
| MiniMax M1 | 977K | $0.55 /Mt | $2.2 /Mt | Mehr |
--
--
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Kimi K3 | 1M | $3 /Mt· · Cache-Lesen $0.3 /Mt | $15 /Mt | Mehr |
| Kimi K2.7 Code | 256K | $0.95 /Mt· · Cache-Lesen $0.19 /Mt | $4 /Mt | Mehr |
| Kimi K2.6 | 256K | $0.8 /Mt· · Cache-Lesen $0.16 /Mt | $3.4 /Mt | Mehr |
| Kimi K2.5 | 256K | $0.6 /Mt· · Cache-Lesen $0.1 /Mt | $3 /Mt | Mehr |
| Kimi K2 Thinking | 256K | $0.6 /Mt· · Cache-Lesen $0.15 /Mt | $2.5 /Mt | Mehr |
| Kimi K2 Instruct 0905 | 256K | $0.6 /Mt | $2.5 /Mt | Mehr |
| Kimi K2 Instruct | 128K | $0.57 /Mt | $2.3 /Mt | Mehr |
--
--
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| NVIDIA Nemotron 3 Nano 30B A3B | 256K | $0.05 /Mt | $0.2 /Mt | Mehr |
--
--
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| OpenAI GPT OSS 120B | 128K | $0.05 /Mt | $0.25 /Mt | Mehr |
| OpenAI GPT OSS 20B | 128K | $0.04 /Mt | $0.15 /Mt | Mehr |
--
--
| Modellname | Kontext | Eingabe | Ausgabe | Aktionen |
|---|---|---|---|---|
| Step 3.7 Flash | 256K | $0.2 /Mt· · Cache-Lesen $0.04 /Mt | $1.15 /Mt | Mehr |
| Modellname | Kontext | Eingabe |
|---|---|---|
qwen/qwen3-embedding-0.6b | 32K | $0.07 /Mt |
Qwen3 Embedding 8B | 32K | $0.07 /Mt |
BAAI:BGE-M3 | 8K | $0.01 /Mt |
Pricing may vary based on image dimensions, inference steps, and upscaling factors. Use thePreisrechnerfor an estimate.
| API-Name | Modus | Breite&Höhe | Preise |
|---|---|---|---|
Qwen-Image Edit | - | - | $0.02 /image |
Qwen-Image Text to Image | - | - | $0.02 /image |
Pricing may vary based on the number of frames, chosen model, and inference steps. Use thePreisrechnerfor an estimate.
| API-Name | Modus | Dauer | Auflösung | Preise |
|---|---|---|---|---|
Kling v3.0 Pro Image-to-Video | No Audio | - | $0.112 /s | |
| Audio | - | $0.168 /s | ||
Kling v3.0 Pro Text-to-Video | No Audio | - | $0.112 /s | |
| Audio | - | $0.168 /s | ||
Kling v3.0 Standard Image-to-Video | No Audio | - | $0.084 /s | |
| Audio | - | $0.126 /s | ||
Kling v3.0 Standard Text-to-Video | No Audio | - | $0.084 /s | |
| Audio | - | $0.126 /s | ||
Minimax Hailuo 2.3 Fast Image to Video | - | 6s | 768P | $0.19 /video |
| - | 10s | 768P | $0.32 /video | |
| - | 6s | 1080P | $0.33 /video | |
Minimax Hailuo 2.3 Image to Video | - | 6s | 768P | $0.28 /video |
| - | 10s | 768P | $0.56 /video | |
| - | 6s | 1080P | $0.49 /video | |
Minimax Hailuo 2.3 Text to Video | - | 6s | 768P | $0.28 /video |
| - | 10s | 768P | $0.56 /video | |
| - | 6s | 1080P | $0.49 /video | |
Wan 2.5 Image to Video | - | 5s | 480P | $0.25 /video |
| - | 10s | 480P | $0.50 /video | |
| - | 5s | 720P | $0.50 /video | |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.5 Text to Video | - | 5s | 480P | $0.25 /video |
| - | 10s | 480P | $0.50 /video | |
| - | 5s | 720P | $0.50 /video | |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.6 Image to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 15s | 720P | $1.50 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
| - | 15s | 1080P | $2.25 /video | |
Wan 2.6 Reference to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
Wan 2.6 Text to Video | - | 5s | 720P | $0.50 /video |
| - | 10s | 720P | $1.00 /video | |
| - | 15s | 720P | $1.50 /video | |
| - | 5s | 1080P | $0.75 /video | |
| - | 10s | 1080P | $1.50 /video | |
| - | 15s | 1080P | $2.25 /video |
| API-Name | Modell | Schritte | Preise |
|---|---|---|---|
Image to Video | SVD-XT | 20 | $0.024 /video |
| SVD | 20 | $0.0134 /video |
| API-Name | Modus | Preise |
|---|---|---|
Fish Audio Text to Speech | - | $15 /1M characters |
Fish Audio Voice Cloning | - | $0.1 /voice |
MiniMax Voice-Cloning | - | $1.5 /voice |
Text to Speech | - | $15 /1M characters |
| API Name | Mode | Pricing |
|---|---|---|
| EXA | neuralSearch | $0.007/request |
| deepSearch | $0.012/request | |
| deepReasoningSearch | $0.015/request | |
| additional_result | $0.001/result (beyond 10 results) | |
| answer | $0.005/request | |
| contentText | $0.001/item | |
| contentHighlight | $0.001/item | |
| contentSummary | $0.001/item | |
| Tavily | basicSearch | $0.008/request |
| advancedSearch | $0.016/request | |
| basicExtract | $0.0016/url | |
| advancedExtract | $0.0032/url | |
| regularMapping | $0.0008/page | |
| instructedMapping | $0.0016/page | |
| Crawl | Extract + Mapping Cost |
Über 200 Modelle, GPUs auf Abruf und sichere Agent-Runtimes — vereint unter einer API. Kostenlos zum Einstieg, skaliert mit Ihrem Wachstum.