Zum Inhalt springen
souveraen.ai
Private LLM · On-Premise

Ihr eigenes LLM. Fertig eingerichtet.

Offene Modelle wie gpt-oss-120b, Qwen und Mistral laufen auf einer NVIDIA DGX Spark in Ihrem Haus. Plattform, Modelle und Anbindungen kommen fertig konfiguriert. Sie bauen nichts selbst und zahlen nichts pro Token.

2.790 € netto / Monat inkl. Spark DGX Hardware · Laufzeit: 24 Monate

  • gpt-oss, Qwen & Mistral lokal
  • Keine Kosten pro Token
  • Fertig eingerichtet geliefert

souveraen.ai

Private Spark · Arbeitsbereich Entwicklung

Welche Schnittstellen hat das Steuergerät SG-40?

Fileserver Entwicklung · lokal

Das SG-40 hat zwei CAN-Schnittstellen und einmal Ethernet.1 Ab Hardwarestand C kommt eine RS-485-Schnittstelle dazu.2

  • 1Pflichtenheft_SG-40.pdfAbschnitt 2.4 · Seite 11
  • 2Änderungsmitteilung_2026-07.pdfPunkt 3 · Seite 1

Beispiel mit fiktiven Inhalten.

Mehr als ein Modell

Ein LLM allein beantwortet noch keine Frage zu Ihrem Unternehmen.

Zum Modell gehören Suche, Zugriffsrechte, Quellenangaben und eine Oberfläche für Ihr Team. Private Spark bringt alles zusammen auf einem Gerät.

Offene Modelle, lokal
gpt-oss-120b, Qwen und Mistral laufen auf der Appliance, ohne Schnittstelle zu einem Anbieter.
Modelle ansehen
Kein Eigenbau nötig
Hardware, Plattform und Modelle kommen fertig eingerichtet. Ein vierstündiger Workshop für Ihr Team ist enthalten.
Suche über Ihre Dokumente
Stichwortindex, Vektorindex und Wissensgraph liegen auf demselben Gerät. Jede Antwort nennt Dokument und Seite.
Rechte je Arbeitsbereich
Jede Abfrage prüft die Zugriffsrechte der Person, bevor das Modell einen Abschnitt zu sehen bekommt.
Keine Abrechnung pro Token
Sie zahlen einen festen Monatspreis. Lokale Anfragen kosten nichts extra, egal wie viel Ihr Team fragt.

Im Vergleich

LLM per API, Private Spark oder Eigenbau?

Drei Wege zu einem Sprachmodell für Ihr Unternehmen und was jeweils noch zu tun bleibt.

Im Vergleich

Modelle rechnen auf Ihrer Hardware
Offene Modelle vorinstalliert
Suche über Ihre Dokumente mit Quellenangabe
Zugriffsrechte je Arbeitsbereich
Oberfläche für das ganze Team
Abrechnung
Updates als geprüfte Pakete

LLM per API

Private Spark

Eigenbau mit GPU-Server

Nein
Ja
Ja
entfällt
Ja
Nein
Eigenentwicklung
Ja
Eigenentwicklung
Eigenentwicklung
Ja
Eigenentwicklung
Eigenentwicklung
Ja
Eigenentwicklung
je Token
fester Monatspreis
Hardware und Personal
durch den Anbieter
nach Ihrer Freigabe
in Eigenregie

Die Spalten beschreiben Betriebsarten, keine einzelnen Anbieter. Stand: Oktober 2026.

Vertraulichkeit

Ihre Daten bleiben in Ihrem Haus.

Alles auf einem Gerät
Modelle, Suchindex und Dokumente liegen auf der Appliance in Ihrem Netz. Für die Verwaltung besteht eine Verbindung zu souveraen.ai.
Rechte je Arbeitsbereich
Jede Abfrage prüft die Zugriffsrechte der Person. Gesperrte Dokumente erscheinen nie als Zitat.
Externe Modelle nur auf Wunsch
Größere Modelle externer Anbieter schalten Sie selbst zu oder lassen es. Ihr Dokumentenbestand bleibt in jedem Fall lokal.
Air-Gap auf Wunsch
Für höchste Anforderungen gibt es Air-Gap Enterprise: eine Installation ganz ohne Verbindung nach außen, nach Angebot.

Preis

Ein fester Monatspreis, Hardware inklusive.

Private Spark kommt fertig eingerichtet zu Ihnen. Lokale Anfragen kosten nichts extra, egal wie viel Ihr Team fragt.

Enthalten

  • NVIDIA DGX Spark im Preis enthalten
  • Plattform und lokale Modelle fertig eingerichtet
  • Onboarding-Workshop (4 h, remote)
  • Ersatzgerät innerhalb von fünf Werktagen
  • Keine Abrechnung pro Token für lokale Modelle

2.790 €

netto / Monat

inkl. Spark DGX Hardware

Laufzeit: 24 Monate

Bei Vorabkauf der DGX sinken die monatlichen Kosten auf 2.490 € / Monat

Alle Preise netto zzgl. Umsatzsteuer. Was in Ihrem Angebot steht, gilt.

Kostenlos starten oder Demo

Sprechen Sie mit uns über Ihr lokales LLM.

Sagen Sie uns, wie viele Personen arbeiten und welche Aufgaben anstehen. Die Oberfläche können Sie vorab kostenlos im Free-Plan kennenlernen.

Selbst starten

Konto anlegen, Datenquelle anbinden, erste Frage stellen. Kostenlos für bis zu 3 Nutzer.

Free-Plan für bis zu 3 Nutzer · keine Kreditkarte

Demo anfragen

Wir nutzen Ihre Angaben nur zur Terminabstimmung. Mehr in der Datenschutzerklärung.

Oder rufen Sie an: (03744) 365 2202

FAQ

Was IT-Teams vor der Entscheidung fragen.

Zu Modellen, Hardware und Betrieb.

Welches Modell passt zu Ihren Aufgaben?

Das klären wir in einem kurzen Gespräch anhand Ihrer Aufgaben und Ihrer Nutzerzahl. Telefon (03744) 365 2202.

Demo anfragen

Offene Modelle wie Qwen3.6, gpt-oss-120b oder Mistral Small 4. Welches Modell Ihre Fragen beantwortet, hängt von Ihren Aufgaben und der Zahl gleichzeitiger Nutzer ab und steht im Angebot.

Ihr LLM, in Ihrem Haus, ohne Eigenbau.

Sie bekommen ein Angebot mit Hardware, Modellen und Einrichtung. Die Konditionen stehen vor dem Abschluss fest.

0 €

Tokenkosten für lokale Modelle. Sie zahlen einen festen Monatspreis.

0 Werktage

bis zum Ersatzgerät, falls die Appliance ausfällt.

0 Monate

Laufzeit, monatlich abgerechnet, Einrichtung und Workshop inklusive.