Welche KI-Modelle bei Ihnen laufen.
Auf der Appliance laufen Open-Weight-Modelle wie Qwen, Mistral und gpt-oss lokal, Ihre Daten bleiben auf dem Gerät. Im Hosting in Deutschland stehen zusätzlich größere Open-Weight-Modelle zur Verfügung. Externe Modelle stehen in On Demand je nach Plan zur Verfügung und werden in EU- und Zero-Data-Retention-Mandanten der Anbieter verarbeitet.
- Lokal oder offline mit Air-Gap
- Open-Weight-Modelle als Standard
- Eine Schnittstelle für alle Aufgaben
Modellkatalog
Ab Werk auf der Appliance
22
Mistral Small 4
Mistral AI
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarMinistral 3 8B
Mistral AI
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarDevstral Small 2
Mistral AI
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
CodeLokal verfügbarMagistral Small 1.2
Mistral AI
- Kontextfenster
- 128.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarQwen3.6-35B-A3B
Qwen (Alibaba)
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarQwen3.6-27B
Qwen (Alibaba)
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarQwen3-Coder-30B-A3B
Qwen (Alibaba)
- Kontextfenster
- 262.144 Tokens
- Max. Ausgabe
- –
CodeLokal verfügbarQwen3-30B-A3B-2507
Qwen (Alibaba)
- Kontextfenster
- 262.144 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarQwen3-14B
Qwen (Alibaba)
- Kontextfenster
- 32.768 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarQwen3-8B
Qwen (Alibaba)
- Kontextfenster
- 32.768 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarQwen3 Embedding 8B
Qwen (Alibaba)
- Kontextfenster
- –
- Max. Ausgabe
- –
EinbettungLokal verfügbarGemma 4
Google
- Kontextfenster
- 128.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarGemma 3 27B
Google
- Kontextfenster
- 128.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbargpt-oss-120b
OpenAI
- Kontextfenster
- 131.072 Tokens
- Max. Ausgabe
- 131.072 Tokens
ChatLokal verfügbargpt-oss-20b
OpenAI
- Kontextfenster
- 131.072 Tokens
- Max. Ausgabe
- 131.072 Tokens
ChatLokal verfügbarLlama 4 Scout
Meta
- Kontextfenster
- 10.000.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarLlama 3.3 70B
Meta
- Kontextfenster
- 128.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarLlama 3.1 8B
Meta
- Kontextfenster
- 128.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarPhi-4
Microsoft
- Kontextfenster
- 16.384 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarPhi-4-reasoning-plus
Microsoft
- Kontextfenster
- 32.768 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarLlama 3.3 Nemotron Super 49B
NVIDIA
- Kontextfenster
- 128.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbarNemotron Nano 9B v2
NVIDIA
- Kontextfenster
- 128.000 Tokens
- Max. Ausgabe
- –
ChatLokal verfügbar
Zusätzlich im Hosting in Deutschland
4
Mistral Large 3
Mistral AI
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
ChatEU-gehostetMistral Medium 3.5
Mistral AI
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
ChatEU-gehostetCodestral
Mistral AI
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
CodeEU-gehostetMistral Embed
Mistral AI
- Kontextfenster
- –
- Max. Ausgabe
- –
EinbettungEU-gehostet
Externe Modelle
25
Verfügbar in On Demand, über das KI-Guthaben. Bei On-Premise-Installationen optional zuschaltbar, mit Tokenkosten des jeweiligen Anbieters. Nicht bei Air-Gap Enterprise.
DeepSeek V4-Pro
DeepSeek
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- –
ChatExtern · EU/ZDRDeepSeek V4-Flash
DeepSeek
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- –
ChatExtern · EU/ZDRClaude Fable 5.1
Anthropic
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRClaude Fable 5
Anthropic
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRClaude Opus 5.5
Anthropic
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRClaude Opus 5
Anthropic
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRClaude Opus 4.8
Anthropic
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRClaude Sonnet 5
Anthropic
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRClaude Haiku 4.5
Anthropic
- Kontextfenster
- 200.000 Tokens
- Max. Ausgabe
- 64.000 Tokens
ChatExtern · EU/ZDRGemini 3.1 Pro
Google
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 64.000 Tokens
ChatExtern · EU/ZDRGemini 3.5 Flash
Google
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 64.000 Tokens
ChatExtern · EU/ZDRGemini 3.1 Flash-Lite
Google
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 64.000 Tokens
ChatExtern · EU/ZDRGemini Embedding 2
Google
- Kontextfenster
- –
- Max. Ausgabe
- –
EinbettungExtern · EU/ZDRGPT-5.6 Sol
OpenAI
- Kontextfenster
- 1.050.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRGPT-5.6 Terra
OpenAI
- Kontextfenster
- 1.050.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRGPT-5.6 Luna
OpenAI
- Kontextfenster
- 1.050.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRGPT-5.5
OpenAI
- Kontextfenster
- 1.050.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRGPT-5.4
OpenAI
- Kontextfenster
- 1.050.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRGPT-5.4 mini
OpenAI
- Kontextfenster
- 400.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRGPT-5.1
OpenAI
- Kontextfenster
- 400.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRGPT-5
OpenAI
- Kontextfenster
- 400.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRGPT Image 2
OpenAI
- Kontextfenster
- –
- Max. Ausgabe
- –
BildExtern · EU/ZDRGLM-5.2
Z.ai (GLM)
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- 128.000 Tokens
ChatExtern · EU/ZDRKimi K2.6
Moonshot AI (Kimi)
- Kontextfenster
- 256.000 Tokens
- Max. Ausgabe
- –
ChatExtern · EU/ZDRMiniMax-M3
MiniMax
- Kontextfenster
- 1.000.000 Tokens
- Max. Ausgabe
- –
ChatExtern · EU/ZDR
51 von 51 Modellen
Ab Werk laufen Open-Weight-Modelle auf der Appliance und in On Demand. Größere Open-Weight-Modelle gibt es zusätzlich im Hosting in Deutschland. Externe Modelle von OpenAI, Anthropic, Google, DeepSeek und weiteren Anbietern sind in On Demand über das KI-Guthaben verfügbar und On-Premise optional zuschaltbar, dort mit Tokenkosten des jeweiligen Anbieters. Externe Modelle werden in EU- und Zero-Data-Retention-Mandanten der Anbieter verarbeitet.
Wie Modelle bei souveraen.ai betrieben werden.
Feste Modellversionen, Modell und Verarbeitungsort zu jeder Antwort, Updates nur nach Ihrer Freigabe.
Betriebsarten
Betriebsart und verfügbare Modelle
Die Betriebsart legt fest, wo Ihre Anfragen verarbeitet werden und welche Modelle zur Verfügung stehen. Deshalb wählen Sie zuerst die Betriebsart und danach die Modelle.
Fragen zur Modellauswahl
Was Geschäftsführung, IT und Datenschutz vor dem Start wissen wollen.
Lieber persönlich sprechen?
Wir klären Einsatzfall, Datenschutz und Betriebsart in einem kurzen Gespräch, ohne Verkaufsdruck. Telefon (03744) 365 2202.