Termin buchen
Leistung
Leistungen

Lokale KI für Unternehmen: die Modelle laufen im eigenen Netz

Manche Unterlagen dürfen das Haus nicht verlassen: Konstruktionszeichnungen, Verträge, alles, was unter eine Geheimhaltungsvereinbarung fällt. Und manche Anlage hat gar keine Verbindung nach außen, soll aber trotzdem antworten. Dann hilft kein Häkchen in den Einstellungen eines Anbieters, dann muss das Modell dort laufen, wo die Daten liegen. Das ist eine lokale KI im eigenen Netz: Wir bauen sie auf und übergeben sie Ihrer IT.

Preise

Planung

individuell

Was Sie haben, was Sie brauchen, was der Aufbau kostet

  • Wir sehen uns an, welche Daten das Haus nicht verlassen dürfen und welche schon
  • Am Ende steht die Liste Ihrer Fälle, die Zuordnung zu einer der drei Stufen und der Festpreis für den Aufbau
  • Das alles liegt Ihnen vor, bevor Sie sich für den Aufbau entscheiden

Aufbau

Festpreis

Nach der Planung, weil dann der Umfang feststeht

  • Server einrichten, Modelle aufsetzen, Anmeldung an Ihr Verzeichnis binden
  • Der Festpreis gilt für den Umfang, den die Planung festgelegt hat. Eine spätere Erweiterung ist ein eigenes Angebot
  • Alles läuft in Ihrem Netz und gehört Ihnen, einschließlich der Einrichtung

Betrieb

nach Vereinbarung

Wenn Sie ihn nicht selbst übernehmen wollen

  • Überwachung, Modellwechsel, Aktualisierungen und Sicherungen
  • Die Höhe hängt an der Stufe, an der Zahl der Nutzer und daran, wie viel Ihre IT selbst übernimmt
  • Oder wir schulen Ihre IT und sind nur noch im Hintergrund erreichbar

Wie ein Betrieb das im Alltag nutzt

Am Anfang steht kein Werkzeug, sondern ein Vorgang, der heute Zeit kostet. Drei Beispiele aus einem technischen Betrieb, für die ein Modell im eigenen Netz der richtige Ort ist.

Drei Fälle aus dem Tagesgeschäft

  • Die Konstruktion sucht eine alte Zeichnung und bekommt die Fundstelle im Original genannt, nicht nur einen Ordnernamen
  • Die Qualitätssicherung lässt einen Prüfbericht gegen eine Vorgabe abgleichen und bekommt die Abweichungen benannt
  • Ein Prüfschritt in der Fertigung läuft weiter, auch wenn die Leitung ins Internet ausfällt

Die Arbeit macht dabei ein Sprachmodell, im Fachwort LLM. Es liest Text, ordnet ihn ein und formuliert eine Antwort. Wo es dabei rechnet, ist eine eigene Entscheidung, und um die geht es auf dieser Seite.

Wann Modelle im eigenen Netz laufen müssen

Es gibt zwei Gründe, und nur einer davon ist der Datenschutz. Der erste steht in Ihren Vereinbarungen: Wer für Kunden aus Rüstung, Automobil oder Pharma arbeitet, hat Geheimhaltungsvereinbarungen unterschrieben, die eine Weitergabe an Dritte ausschließen. Ein Sprachmodell bei einem Anbieter ist ein Dritter, auch wenn er verspricht, nichts zu speichern. Was Sie für beide Wege belegen müssen, steht unter was Sie bei KI nachweisen müssen.

Der zweite ist praktisch: Wenn die Leitung ausfällt, steht ein zugekauftes Modell still. Für eine Chatoberfläche ist das ärgerlich, für eine Prüfung in der Fertigung ist es ein Produktionsstopp.

Diese Betriebsform heißt on premise. KI on premise bedeutet: Das Modell rechnet auf Ihrer eigenen Hardware, und die Unterlagen bleiben dort, wo sie ohnehin liegen.

Wenn keiner der beiden Gründe zutrifft, ist der eigene Betrieb der teurere Weg. Wann wir davon abraten, steht weiter unten.

Typische Anlässe

  • Geheimhaltungsvereinbarungen, die eine Weitergabe an Dritte ausschließen
  • Ein Betriebsrat, der einer Verarbeitung außer Haus nicht zustimmt (Mitbestimmung nach § 87 Abs. 1 Nr. 6 BetrVG, sobald ein System die Nutzung protokollieren kann; das gilt im eigenen Netz genauso, nur bleibt die Verarbeitung dann im Haus; mehr dazu unter was der Betriebsrat bei KI mitbestimmt)
  • Anlagen ohne Netzanbindung, in denen das System trotzdem antworten soll
  • Der Wunsch, nicht an einen Anbieter und seine Preisliste gebunden zu sein

Was lokal genau heißt, in drei Stufen

Der Begriff wird für drei verschiedene Dinge benutzt, und die Unterschiede entscheiden über Kosten und Aufwand. Wir klären das vor dem Angebot, damit niemand für Stufe drei bezahlt, wenn Stufe eins reicht.

In der ersten Stufe liegen Ihre Daten im Haus, das Modell wird zugekauft. In der zweiten läuft auch das Modell auf Ihrer Hardware, das System darf aber noch ins Internet, etwa für Aktualisierungen. In der dritten gibt es keinen Weg nach außen mehr. On premise KI ist also kein einzelner Zustand, sondern eine dieser drei Stufen.

Jede Stufe kostet mehr Hardware und mehr Betrieb als die vorige. Welche Sie brauchen, ergibt die Planung.
Daten im HausModell im HausOhne Verbindung nach außen
Stufe 1janeinnein
Stufe 2jajanein
Stufe 3jajaja

Der Sprung von zwei auf drei ist der teuerste. Ohne Verbindung nach außen muss jede Aktualisierung von Hand eingespielt werden, und ein Fehler lässt sich nicht eben aus der Ferne beheben. Das ist machbar und wir machen es, aber es sollte einen Grund haben.

Was brauche ich für eine lokale KI im eigenen Netz?

Wir rechnen vor dem Kauf aus, welche Modellgröße Ihre Fälle brauchen, und leiten daraus ab, ob eine einzelne Grafikkarte in einem vorhandenen Server reicht oder ein eigener Rechner nötig ist. Ein LLM on premise braucht Rechenleistung im Haus, und die richtet sich nach Ihren Fällen, nicht nach einem Datenblatt. Wie diese Rechnung geht, steht unter welche Hardware lokale KI braucht. Was ein eigener Rechner dafür kostet, steht unter was ein KI-Server kostet.

Die Anmeldung läuft über Ihr vorhandenes Verzeichnis, also über das Konto, mit dem Ihre Leute sich morgens ohnehin anmelden, etwa Microsoft Entra ID. Wer das Unternehmen verlässt, verliert den Zugang dort, wo Sie ihn ohnehin entziehen. Eine zweite Benutzerverwaltung entsteht nicht. Was Ihre IT-Leitung vor der Freigabe prüft, steht unter was die IT-Leitung bei lokaler KI prüft.

Für den Betrieb gibt es zwei Wege. Entweder wir übernehmen ihn, oder wir schulen Ihre IT und bleiben im Hintergrund erreichbar. Der zweite Weg ist der günstigere, und er ist der richtige, wenn bei Ihnen jemand Linux-Server verantwortet. Was alles dazugehört, steht unter was zum Betrieb im eigenen Haus gehört.

Was der eigene Betrieb an Arbeit erzeugt

Wie ein Aufbau abläuft

Wie lange der Aufbau dauert, legt die Planung fest. Der längste Posten ist selten die Technik, sondern der Termin mit Ihrer IT für die Anmeldung.

  1. Aufnahme Welche Daten dürfen nicht nach außen, welche Fälle sollen laufen, was steht an Hardware bereits da.
  2. Größe bestimmen Wir messen an Ihren echten Fällen, welche Modellgröße reicht. Daraus folgt die Hardware, nicht aus einem Datenblatt.
  3. Aufbau Server einrichten, Modelle aufsetzen, Oberfläche bereitstellen, Anmeldung an Ihr Verzeichnis binden.
  4. Testbetrieb Eine Abteilung arbeitet damit, bevor jemand über eine Erweiterung entscheidet.
  5. Übergabe Dokumentation, Zugänge, Einweisung. Danach können Sie es allein betreiben, auch ohne uns.

Was es kostet

Die Planung wird individuell veranschlagt. Der Aufbau ist ein Festpreis, und er steht nach der Planung fest. Der Betrieb läuft nach Vereinbarung.

Der Grund für diese Reihenfolge: Zwischen Stufe eins und Stufe drei liegt ein Vielfaches. Eine Zahl vorab würde mehr verschleiern als zeigen, weil sie für den einen zu hoch und für den anderen zu niedrig wäre.

Die Hardware kaufen Sie direkt beim Händler Ihrer Wahl. Wir stellen nur Arbeitszeit in Rechnung und verdienen an der Hardware nichts.

Ob sich der eigene Betrieb gegen ein zugekauftes Modell rechnet, hängt an der Zahl der Nutzer und an der Laufzeit. Diese Rechnung haben wir an anderer Stelle aufgemacht.

Was der eigene Betrieb gegen ein zugekauftes Modell kostet

Wann wir abraten

Wenn keine Geheimhaltungsvereinbarung und keine Anlage ohne Netz dahintersteht, ist ein zugekauftes Modell in einem europäischen Rechenzentrum meist der bessere Weg. Er ist schneller verfügbar, und die größten Modelle laufen nur dort. Was er gegen den eigenen Betrieb kostet, steht unter was der Betrieb im eigenen Haus kostet.

Auch dann raten wir ab, wenn niemand im Haus einen Server verantworten will und der Betrieb nicht dauerhaft eingekauft werden soll. Ein System, für das sich niemand zuständig fühlt, veraltet still.

Und die ehrlichste Grenze: Frei verfügbare Modelle mit offenen Gewichten, die auf einer Grafikkarte im Serverraum laufen, sind kleiner als das, was die großen Anbieter betreiben (Stand September 2026). Für Suche in eigenen Unterlagen, Zusammenfassungen und Prüfungen gegen Vorgaben reicht das. Für ein Angebot mit eigener Note oder eine lange technische Ausarbeitung von Grund auf bleibt der zugekaufte Weg besser. Welche Modelle dafür infrage kommen, steht unter welche lokalen KI-Modelle für Firmen taugen. Aufgabe für Aufgabe steht das unter ob ein lokales Sprachmodell so gut ist wie ChatGPT.

Alle Preise verstehen sich netto zuzüglich Umsatzsteuer. Der Festpreis für den Aufbau gilt für den Umfang, den die Planung festlegt; eine spätere Erweiterung ist ein eigenes Angebot. Der Hinweis auf § 87 Abs. 1 Nr. 6 BetrVG beschreibt die Rechtslage in Stichworten und ersetzt keine Rechtsberatung.

Der Punkt

Der Ort ist eine Entscheidung, keine Vertrauensfrage

Ob Ihre Unterlagen das Haus verlassen, sollte nicht davon abhängen, was in den Nutzungsbedingungen eines Anbieters steht und wie oft er sie ändert. Wenn das Modell auf Ihrer Hardware läuft, ist die Frage technisch beantwortet und bleibt beantwortet.

Das ist der einzige Grund, warum sich der Mehraufwand lohnt. Alles andere, größere Modelle, weniger Betrieb, niedrigere Kosten am Anfang, spricht für den zugekauften Weg.

1 2 3
Nicht das Vertrauen entscheidet, sondern was die Wand kreuzen darf.
Eckdaten
Ort
Ihr Serverraum, Ihr Rechenzentrum oder ein deutsches Rechenzentrum Ihrer Wahl
Verbindung
Im eigenen Netz, im Fachwort on premise. Auf Wunsch ohne jeden Weg ins Internet
Modelle
Frei verfügbare Modelle mit offenen Gewichten wie Llama, Mistral oder Qwen, austauschbar (Stand September 2026)
Anmeldung
Mit dem Konto, das Ihre Leute ohnehin haben (Ihr Verzeichnis, etwa Microsoft Entra ID, per OAuth und OIDC)
Hardware
Welche Grafikkarte und wie viel Speicher, rechnen wir vor dem Kauf an Ihren Fällen aus
Was Sie stellen
Die Fälle, die nicht nach außen dürfen, eine Ansprechperson im Fachbereich und einen Termin mit Ihrer IT
Wann nicht
Wenn ein zugekauftes Modell in einem europäischen Rechenzentrum reicht, sagen wir das
Übergabe
Dokumentation, Zugänge und eine Einweisung für Ihre IT
Belegter Fall
Bei einem Armaturenhersteller läuft ein System seit Dezember 2025 im eigenen Netz

Welche Daten dürfen bei Ihnen das Haus nicht verlassen, oder wo fehlt die Verbindung nach außen ganz?

Eine halbe Stunde. Sie erzählen, worum es geht und welche Fälle laufen sollen. Wir sagen Ihnen, welche der drei Stufen dazu passt. Auch dann, wenn es am Ende keine ist.

Lieber ohne Kalender? info@deep5.io oder +49 176 57703783.