Zum Inhalt springen
souveraen.ai

Modelle

Alle Modelle in einer Plattform.

Offene Modelle wie Qwen, Mistral und gpt-oss laufen auf Ihrer Appliance, auf Wunsch vollständig offline. Spitzenmodelle von OpenAI und Anthropic nutzen Sie EU-gehostet, wenn Ihr Plan sie enthält.

  • Lokal oder vollständig offline
  • Offene und Spitzenmodelle
  • Eine Schnittstelle für alle Aufgaben

Modellkatalog

Mistral AI8
  • Mistral Large 3

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    ChatEU-gehostet
  • Mistral Medium 3.5

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    ChatEU-gehostet
  • Mistral Small 4

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Ministral 3 8B

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Devstral Small 2

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    CodeOffline verfügbar
  • Magistral Small 1.2

    Kontextfenster
    128.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Codestral

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    CodeEU-gehostet
  • Mistral Embed

    Kontextfenster
    –
    Max. Ausgabe
    –
    EinbettungEU-gehostet
Qwen (Alibaba)7
  • Qwen3.6-35B-A3B

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Qwen3.6-27B

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Qwen3-Coder-30B-A3B

    Kontextfenster
    262.144 Tokens
    Max. Ausgabe
    –
    CodeOffline verfügbar
  • Qwen3-30B-A3B-2507

    Kontextfenster
    262.144 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Qwen3-14B

    Kontextfenster
    32.768 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Qwen3-8B

    Kontextfenster
    32.768 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Qwen3 Embedding 8B

    Kontextfenster
    –
    Max. Ausgabe
    –
    EinbettungOffline verfügbar
DeepSeek2
  • DeepSeek V4-Pro

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    –
    ChatGlobal
  • DeepSeek V4-Flash

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    –
    ChatGlobal
Anthropic7
  • Claude Fable 5.1

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • Claude Fable 5

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • Claude Opus 5.5

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • Claude Opus 5

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • Claude Opus 4.8

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • Claude Sonnet 5

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • Claude Haiku 4.5

    Kontextfenster
    200.000 Tokens
    Max. Ausgabe
    64.000 Tokens
    ChatEU-gehostet
Google6
  • Gemini 3.1 Pro

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    64.000 Tokens
    ChatGlobal
  • Gemini 3.5 Flash

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    64.000 Tokens
    ChatGlobal
  • Gemini 3.1 Flash-Lite

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    64.000 Tokens
    ChatGlobal
  • Gemini Embedding 2

    Kontextfenster
    –
    Max. Ausgabe
    –
    EinbettungGlobal
  • Gemma 4

    Kontextfenster
    128.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Gemma 3 27B

    Kontextfenster
    128.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
OpenAI11
  • GPT-5.6 Sol

    Kontextfenster
    1.050.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • GPT-5.6 Terra

    Kontextfenster
    1.050.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • GPT-5.6 Luna

    Kontextfenster
    1.050.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • GPT-5.5

    Kontextfenster
    1.050.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • GPT-5.4

    Kontextfenster
    1.050.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • GPT-5.4 mini

    Kontextfenster
    400.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • GPT-5.1

    Kontextfenster
    400.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • GPT-5

    Kontextfenster
    400.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatEU-gehostet
  • GPT Image 2

    Kontextfenster
    –
    Max. Ausgabe
    –
    BildEU-gehostet
  • gpt-oss-120b

    Kontextfenster
    131.072 Tokens
    Max. Ausgabe
    131.072 Tokens
    ChatOffline verfügbar
  • gpt-oss-20b

    Kontextfenster
    131.072 Tokens
    Max. Ausgabe
    131.072 Tokens
    ChatOffline verfügbar
Meta3
  • Llama 4 Scout

    Kontextfenster
    10.000.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Llama 3.3 70B

    Kontextfenster
    128.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Llama 3.1 8B

    Kontextfenster
    128.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
Microsoft2
  • Phi-4

    Kontextfenster
    16.384 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Phi-4-reasoning-plus

    Kontextfenster
    32.768 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
NVIDIA2
  • Llama 3.3 Nemotron Super 49B

    Kontextfenster
    128.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
  • Nemotron Nano 9B v2

    Kontextfenster
    128.000 Tokens
    Max. Ausgabe
    –
    ChatOffline verfügbar
Z.ai (GLM)1
  • GLM-5.2

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    128.000 Tokens
    ChatGlobal
Moonshot AI (Kimi)1
  • Kimi K2.6

    Kontextfenster
    256.000 Tokens
    Max. Ausgabe
    –
    ChatGlobal
MiniMax1
  • MiniMax-M3

    Kontextfenster
    1.000.000 Tokens
    Max. Ausgabe
    –
    ChatGlobal

51 von 51 Modellen

Offline verfügbare Modelle laufen auch auf Ihrer Appliance, ohne Internet. OpenAI, Anthropic und Mistral AI rechnen in EU-Mandanten; globale Modelle nur nach Freigabe je Mandant. Welche Modelle Ihnen zur Verfügung stehen, halten Plan und Angebot fest.

Fehlt ein Modell?

Weitere offene Modelle nehmen wir nach einer Lizenz- und Qualitätsprüfung in Ihr Profil auf. Sagen Sie uns, welches Modell Sie brauchen.

Modell anfragen

Das passende Modell je Aufgabe

Chat, Code, Einbettung und Bild: Sie wählen je Aufgabe das Modell, das passt – offen oder Spitzenmodell, von zwölf Anbietern.

Sicher und datensouverän

Betrieb auf Ihrer Appliance, auf Wunsch vollständig offline, oder in europäischen Rechenzentren.

Einfach integriert

Ihre Anwendungen sprechen eine stabile Schnittstelle an. Welches Modell antwortet, ist konfiguriert und je Anfrage protokolliert.

Transparent

Kontextfenster, maximale Ausgabe und Betriebsweg liegen offen. Ein offenes Modell ändert seinen Stand erst, wenn Sie ein Update freigeben.

Betriebswege

Erst der Datenweg, dann das Modell.

Ein Modellname sagt nichts darüber, wo Ihre Anfrage verarbeitet wird. Deshalb wählen Sie zuerst den Betriebsweg; die passenden Modelle folgen daraus.

Lokal auf der Appliance

Offene Modelle wie Qwen3.6, Mistral Small 4, Gemma 4, Llama und gpt-oss laufen auf der DGX-Appliance in Ihrem Haus. Keine externe Modell-Schnittstelle.

  • Auch ohne Internet
  • Keine Tokenkosten
  • Fester monatlicher Preis
Private Spark ansehen

European On Demand

Dieselbe Plattform in europäischen Rechenzentren, ohne eigene Hardware. Dazu Modelle von OpenAI, Anthropic und Mistral AI in EU-Mandanten.

  • Auftragsverarbeitung nach DSGVO
  • Getrennter Mandant
  • Kostenlos starten
Pläne und Preise

Globale Modelle

Modelle, die weder offline noch in der EU laufen, etwa Gemini, DeepSeek, GLM, Kimi und MiniMax. Hat Ihre Administration sie freigeschaltet, entscheiden Ihre Nutzer selbst, ob sie diese Modelle verwenden.

  • Freischaltung durch die Administration
  • Nutzer entscheiden selbst
  • Jederzeit widerruflich
Ausnahme besprechen

Häufige Fragen

Was vor der Modellwahl am häufigsten gefragt wird.

Welches Modell beantwortet unsere Fragen?

Das legen Sie fest. Auf der Appliance arbeitet ein offenes Modell wie Qwen3.6 oder gpt-oss-120b; welches, hängt von Ihren Aufgaben und davon ab, wie viele Personen gleichzeitig arbeiten, und wird im Angebot festgehalten. In European On Demand wählen Sie zusätzlich Spitzenmodelle.

Werden unsere Daten zum Training der Modelle verwendet?

Nein. Die Modelle laufen als festgeschriebene Versionen und werden nicht mit Ihren Inhalten weitertrainiert. Was die Plattform aus Ihren Dokumenten lernt, liegt als belegtes Wissen in Ihrer Wissensschicht, nicht in Modellgewichten.

Können wir ein Modell ergänzen, das nicht im Katalog steht?

Ja, wenn es offene Gewichte und eine Lizenz hat, die kommerzielle Nutzung erlaubt. Wir prüfen Lizenz, Qualität und Speicherbedarf auf der Referenz-Appliance und nehmen es dann in Ihr Profil auf.

Können wir GPT-, Claude- oder Gemini-Modelle nutzen?

In European On Demand ja, je nach Plan. OpenAI- und Anthropic-Modelle laufen in EU-Mandanten der Anbieter; dorthin geht die einzelne Anfrage samt ausgewählter Textauszüge, nicht Ihr Bestand. Gemini rechnet global; nach Freischaltung durch Ihre Administration entscheiden Nutzer selbst, ob sie es verwenden. Auf der Appliance sind Spitzenmodelle eine freigegebene Ausnahme.

Wie kommen neue Modellversionen auf die Appliance?

Als geprüfte Pakete. Eine neue Version durchläuft dieselbe Qualifizierung wie das erste Modell und ersetzt den alten Stand erst nach Ihrer Freigabe. Automatisch nachgeladen wird nichts.

Das passende Profil

Welche Modelle gehören auf Ihre Appliance?

Nennen Sie uns Ihre Aufgaben und wie viele Personen gleichzeitig arbeiten. Wir schlagen das Modellprofil vor und halten es im Angebot fest.