> ## Documentation Index
> Fetch the complete documentation index at: https://novita.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Empfohlene Modelle

Eine Liste empfohlener offener Modelle für gängige Anwendungsfälle.

## Welche offenen Modelle sollte ich verwenden?

Eigentlich gibt es nicht die eine richtige Antwort! Hier ist eine kuratierte Liste basierend auf internen Tests von Novita, Community-Feedback und externen Benchmarks. Wir empfehlen, sie als Ausgangspunkt zu verwenden, und werden sie regelmäßig aktualisieren, sobald neue Modelle erscheinen.

<Note>
  * Modellgrößen sind als Klein, Mittel oder Groß gekennzeichnet. Bei MoE-Modellen ist die Größe der aktivierten Parameter entscheidend für die Latenz.
  * Für die beste Latenz verwenden Sie kleine oder mittlere Modelle. Für die beste Qualität verwenden Sie große Modelle oder fine-tunen Sie mittlere bzw. kleine Modelle.
  * Die unten aufgeführten Modellnamen sind exakte Modell-IDs — kopieren Sie sie direkt in Ihre API-Aufrufe. Jede ID verlinkt auf die jeweilige Modellseite mit aktuellen Preisen und einem Playground.
  * Sie können alle Modelle in der [Novita Model Library](https://novita.ai/models/llm) erkunden.
</Note>

### Codegenerierung & Reasoning

| Modell-ID                                                                             | Größe / Hinweise | Kontextfenster |
| ------------------------------------------------------------------------------------- | ---------------- | -------------- |
| [`moonshotai/kimi-k2.7-code`](https://novita.ai/models/llm/moonshotai-kimi-k2.7-code) | Groß             | 262K           |
| [`zai-org/glm-5.2`](https://novita.ai/models/llm/zai-org-glm-5.2)                     | Groß             | 1M             |
| [`deepseek/deepseek-v4-pro`](https://novita.ai/models/llm/deepseek-deepseek-v4-pro)   | Groß             | 1M             |

### Allgemeines Reasoning & Planung

| Modell-ID                                                                           | Größe / Hinweise | Kontextfenster |
| ----------------------------------------------------------------------------------- | ---------------- | -------------- |
| [`deepseek/deepseek-v4-pro`](https://novita.ai/models/llm/deepseek-deepseek-v4-pro) | Groß             | 1M             |
| [`deepseek/deepseek-v3.2`](https://novita.ai/models/llm/deepseek-deepseek-v3.2)     | Groß             | 160K           |
| [`qwen/qwen3.5-397b-a17b`](https://novita.ai/models/llm/qwen-qwen3.5-397b-a17b)     | Groß, 17B aktiv  | 262K           |

### Agenten, Function Calling & Tool-Nutzung

| Modell-ID                                                                             | Größe / Hinweise | Kontextfenster |
| ------------------------------------------------------------------------------------- | ---------------- | -------------- |
| [`zai-org/glm-5.2`](https://novita.ai/models/llm/zai-org-glm-5.2)                     | Groß             | 1M             |
| [`moonshotai/kimi-k2.7-code`](https://novita.ai/models/llm/moonshotai-kimi-k2.7-code) | Groß             | 262K           |
| [`minimax/minimax-m3`](https://novita.ai/models/llm/minimax-minimax-m3)               | Groß             | 1M             |

### Langer Kontext & Zusammenfassung

| Modell-ID                                                                               | Größe / Hinweise      | Kontextfenster |
| --------------------------------------------------------------------------------------- | --------------------- | -------------- |
| [`zai-org/glm-5.2`](https://novita.ai/models/llm/zai-org-glm-5.2)                       | Groß                  | 1M             |
| [`deepseek/deepseek-v4-pro`](https://novita.ai/models/llm/deepseek-deepseek-v4-pro)     | Groß                  | 1M             |
| [`deepseek/deepseek-v4-flash`](https://novita.ai/models/llm/deepseek-deepseek-v4-flash) | Groß, kosteneffizient | 1M             |

### Vision & Dokumentverständnis

| Modell-ID                                                                       | Größe / Hinweise | Kontextfenster |
| ------------------------------------------------------------------------------- | ---------------- | -------------- |
| [`moonshotai/kimi-k2.5`](https://novita.ai/models/llm/moonshotai-kimi-k2.5)     | Groß             | 262K           |
| [`qwen/qwen3.5-397b-a17b`](https://novita.ai/models/llm/qwen-qwen3.5-397b-a17b) | Groß, 17B aktiv  | 262K           |
| [`google/gemma-4-31b-it`](https://novita.ai/models/llm/google-gemma-4-31b-it)   | Mittel           | 262K           |

### NLU & Extraktion mit niedriger Latenz

| Modell-ID                                                                                           | Größe / Hinweise        | Kontextfenster |
| --------------------------------------------------------------------------------------------------- | ----------------------- | -------------- |
| [`inclusionai/ling-2.6-flash`](https://novita.ai/models/llm/inclusionai-ling-2.6-flash)             | MoE, kleine Aktivierung | 262K           |
| [`meta-llama/llama-3.1-8b-instruct`](https://novita.ai/models/llm/meta-llama-llama-3.1-8b-instruct) | Klein                   | 128K           |
| [`google/gemma-4-26b-a4b-it`](https://novita.ai/models/llm/google-gemma-4-26b-a4b-it)               | Mittel, 4B aktiv        | 262K           |

## Migration von älteren Modellen

Wenn Sie noch eines der unten aufgeführten Modelle aufrufen, wechseln Sie zu seinem empfohlenen Ersatz:

| Wenn Sie verwenden                                                              | Wechseln Sie zu                                                                |
| ------------------------------------------------------------------------------- | ------------------------------------------------------------------------------ |
| `deepseek/deepseek-r1-0528`                                                     | `deepseek/deepseek-v4-pro`                                                     |
| `zai-org/glm-4.5`                                                               | `zai-org/glm-5.2`                                                              |
| `moonshotai/kimi-k2-instruct`                                                   | `moonshotai/kimi-k2.7-code`                                                    |
| `qwen/qwen3-coder-480b-a35b-instruct`                                           | `moonshotai/kimi-k2.7-code`                                                    |
| `meta-llama/llama-4-maverick` / `llama-4-scout`, `qwen/qwen2.5-vl-72b-instruct` | `moonshotai/kimi-k2.5`, `qwen/qwen3.5-397b-a17b`, oder `google/gemma-4-31b-it` |
