Leistung · AI

KI im eigenen Haus. DSGVO-konform.

Lokale KI-Systeme ohne Cloud-Abhängigkeit. Datenschutzkonform, unter deiner Kontrolle und auf Hardware, die wir für deine Modelle auslegen.

Live-Schema · Lokale Inferenz

Prompt rein, Antwort raus – aber die Verarbeitung bleibt im On-Prem-Modell in Deutschland. Es gibt keine externen Aufrufe, deine Daten verlassen das Haus nicht.

Auf einen Blick. KI, die deine Daten nicht verlässt: Modelle laufen auf eigener Hardware in Deutschland, ohne dass sensible Inhalte in US-Clouds abfließen. DSGVO-konform, planbar in den Kosten, Einstieg ab 18.000 €. Richtkosten siehst du auf der Preise-Seite.
Kurz erklärt. Lokale KI = das Sprach- oder Bildmodell läuft auf deinem eigenen Server statt in einer fremden Cloud. Inferenz = der laufende Betrieb des Modells (Antworten erzeugen). VRAM = der schnelle Grafikkartenspeicher, der bestimmt, wie groß ein Modell sein darf.
local-ai · inference
model.loadedon-prem
data.residencyDE
external.calls0
gpu.readyyes
$ run --local --private
Was wir liefern

KI, die deine Daten nicht verlässt

  • Lokale ModelleSprach- und Spezialmodelle, die auf deiner eigenen Hardware laufen. Keine Daten, die an US-Clouds abfließen.
  • DatensouveränitätVolle Kontrolle darüber, wo Daten liegen und wer sie verarbeitet. Ein klarer Vorteil bei sensiblen Inhalten.
  • Passende HardwareGPU-Infrastruktur, die wir nach deinen Modellen und deinem Durchsatz dimensionieren, nicht umgekehrt.
  • IntegrationAnbindung an deine bestehenden Systeme und Pipelines, damit die KI im Alltag tatsächlich genutzt wird.
Preise & TCO

Was lokale KI kostet

DSGVO-konforme KI im eigenen Haus, mit klaren Einstiegspreisen. Den vollständigen TCO-Vergleich gegen Cloud-Inferenz samt interaktivem Rechner gibt es auf der Preise-Seite.

ab 18.000 €
Lokale KI, einmalig
96 GB VRAM, 8 TB Speicher, komplett on-premise, ideal für Inferenz und kleinere Trainings.
ab 750 € /Monat
Managed Service
Betrieb, Updates und Monitoring der lokalen KI-Infrastruktur.
+10.000 €
Ausbau auf 192 GB VRAM
Wenn Modelle und Durchsatz wachsen, skaliert die Hardware mit.
Leasing

Statt Kauf: monatlich leasen

Den lokalen KI-Server gibt es auch im Leasing, mit planbarer Monatsrate statt einmaligem Invest. Zwei Ausbaustufen, sechs Laufzeiten, alle Werte netto zur Orientierung.

Laufzeit 96 GB VRAM · Rate/Monat 96 GB VRAM · Gesamt 192 GB VRAM (+10.000 €) · Rate/Monat 192 GB VRAM (+10.000 €) · Gesamt
24 Monate902 €21.654 €1.378 €33.063 €
36 Monate607 €21.869 €935 €33.653 €
48 Monate468 €22.466 €716 €34.391 €
54 Monate422 €22.801 €646 €34.871 €
60 Monate382 €22.944 €587 €35.240 €
72 Monate329 €23.661 €501 €36.089 €
Hinweis. Monatsraten netto, zur Orientierung · Stand Juni 2026. Die Ausbau-Variante mit 192 GB VRAM kostet als Hardware 10.000 € Aufpreis; über die Laufzeit liegt der Leasing-Aufschlag finanzierungsbedingt bei rund 11.400 € (24 Monate) bis 12.400 € (72 Monate). Längere Laufzeit senkt die Monatsrate, erhöht aber die Gesamtkosten. Verbindliche Konditionen auf Anfrage.
Häufige Fragen

Was vor dem ersten KI-Server zu klären ist

Ist ein lokal betriebener KI-Server DSGVO-konform?+

Ein lokaler Server ist die technisch einfachste Variante, weil keine Daten an Dritte fließen und damit weder Auftragsverarbeitung noch Drittlandübermittlung entstehen. Konform wird er trotzdem erst durch Zugriffskontrolle, Protokollierung, Löschkonzept und dokumentierte technische und organisatorische Maßnahmen. Die Hardware allein ist Voraussetzung, aber kein Nachweis.

Wie viel VRAM braucht ein 70B-Modell in FP8?+

Rund 70 GB allein für die Gewichte, denn FP8 belegt ein Byte je Parameter. Dazu kommt der KV-Cache, der mit Kontextlänge und Batch-Größe wächst. Plane deshalb 90 bis 100 GB ein. In 4 Bit belegt dasselbe Modell rund 43 GB und passt auf eine 48-GB-Karte, solange der Kontext klein bleibt.

Entscheidet Rechenleistung oder Speicherbandbreite über die Geschwindigkeit?+

Bei Batch Size 1 die Bandbreite. Für jedes einzelne Token müssen die kompletten Modellgewichte einmal durch den Speicher. Die Obergrenze ist Bandbreite geteilt durch Modellgröße, mal etwa 70 Prozent erreichbarer Effizienz. 20 GB Gewichte an 120 GB/s ergeben so höchstens gut vier Tokens pro Sekunde.

Was kostet ein lokaler KI-Server?+

Ein schlüsselfertiger Einstieg mit 96 GB VRAM und 8 TB Speicher liegt bei 18.000 Euro netto. Die Erweiterung auf 192 GB VRAM kostet rund 10.000 Euro zusätzlich. Managed Betrieb beginnt bei 750 Euro im Monat. Auf vorhandener Hardware startet ein Proof of Concept ab etwa 10.000 Euro.

Können wir mit vorhandener Hardware anfangen?+

Ja. Wir bewerten bestehende Systeme in der Analyse und beziehen sie ein, wo es sinnvoll ist. Nicht jedes Vorhaben braucht neue Hardware. Ein Proof of Concept auf vorhandenen Servern kostet ab etwa 10.000 Euro für Einbau, Netzwerk und Software und zeigt belastbar, ob der Ansatz trägt.

Bereit für Infrastruktur, die hält?

Ob GPU Cluster, verteilter Storage, Proxmox Migration oder Cyber Resilience. Wir sprechen über dein System und zeigen konkrete Schritte.