Private AI – DSGVO-konform & souverän

SI-KI Plattform – Ihre GPU-Plattform für AI-Inference

Unsere GPU-Plattform für AI-Inference: 2× bis 6× High-End GPUs, genug VRAM für große KI-Modelle und eine betriebsfertige Completion-API – aufgebaut wie ein Kryptominer, betrieben in unseren eigenen Rechenzentrumsräumen in Karlsruhe. Sie greifen per API zu, die Hardware bleibt bei uns. Daten verlassen nie unsere Infrastruktur.

SI-KI Plattform – Ihre GPU-Plattform für AI-Inference
Was Sie bekommen

2× bis 6× High-End GPUs als betriebsfertige Box

Wir liefern keine abstrakte Cloud. Sie bekommen eine physisch bei uns betriebene GPU-Box mit bis zu sechs High-End GPUs, massig VRAM und modernster Inference-Software – direkt einsatzbereit inklusive API-Zugang.

2× bis 6× High-End GPUs
Genug VRAM für große KI-Modelle
Box-Aufbau wie bei Kryptominern
Modelle & Technologien automatisch aktualisiert
Eigene Server – selbst gebaut & betrieben
Completion-API – betriebsbereit in Tagen

Was es kann

10× Nutzer parallel

Schnell genug für 10 gleichzeitige Nutzer – ohne dass die Performance einbricht.

Echtzeit-Antworten

Antworten in Echtzeit – auch bei parallelen Anfragen und komplexen KI-Modellen.

100% DSGVO & souverän

Ihre Daten verlassen nie unsere Infrastruktur in Karlsruhe. Keine Cloud, kein Datenabfluss an Dritte, volle Kontrolle.

Fixkosten statt pro-Token

Einmalige Hardware + Strom oder Flatrate – kein pro-Token-Preis, keine überraschenden Rechnungen.

Der Status Quo in KMU

Warum klassische KI-Lösungen an ihre Grenzen stoßen

KI ist technisch längst bereit für autonome Prozesse, 24/7-Agenten und Wissensabfragen. Doch klassische Cloud-KI blockiert den Mittelstand – aus Kosten-, Datenschutz- und Integrationsgründen.

Cloud-Kosten eskalieren

Jeder Use-Case, jeder Token kostet extra. Die Rechnung wächst mit dem Geschäftsvolumen – unbegrenzt und schwer planbar.

Daten verlassen das Unternehmen

Cloud-KI verarbeitet sensible Daten auf fremden Servern. DSGVO-Risiko, keine Kontrolle über Datenflüsse, keine echte Souveränität.

Systemwechsel frisst Zeit

Mitarbeiter springen zwischen 5+ Systemen: CRM, Buchhaltung, E-Mail, DMS. Jeder Wechsel kostet Konzentration und Produktivität.

KI-Potenzial bleibt ungenutzt

Autonome Prozesse, 24/7-Agenten, Wissensabfrage – alles technisch möglich, aber Cloud-Abhängigkeit blockiert den Einsatz.

Unsere Lösung

Souveräne KI-Plattform, die alles verbindet

Daten verlassen unsere Server nie

Wettbewerbsschutz durch physische Kontrolle über alle KI-Komponenten in unserem Rechenzentrum. Ihre Daten bleiben in unserer Infrastruktur in Karlsruhe.

Digitale Souveränität

Keine Abhängigkeit von OpenAI, Anthropic, Google. Keine API-Sperren, keine Preiswillkür, keine fremde Infrastruktur.

DSGVO-konform

Keine Verarbeitung in Drittländern. Keine Datenübermittlung an Cloud-Anbieter. Volle Compliance aus Karlsruhe.

Rollenbasiert

Zugriff ausschließlich über Ihre Completion-API. Jeder Mitarbeiter sieht nur, was er darf. Auditierbar und nachvollziehbar.

Open-Source & Open-Weighted Modelle

Modelle und Software sind nachvollziehbar. Keine Blackbox, kein Vendor-Lock-in, volle Transparenz.

Audit-Log

Jede KI-Aktion wird protokolliert. Vollständige Nachvollziehbarkeit für Compliance und Sicherheit.

EU AI Act

Konformitäts-Check möglich. Vorbereitet auf kommende Regulierungen und regulatorische Anforderungen.

Cloud AI Kosten explodieren – Fixkosten statt variabel

Kostenfaktor Cloud (OpenAI & Co.) SI-KI Plattform

Preis pro Monat

~2.500–5.000 € (100 Nutzer, moderate Nutzung)

Token-basiert oder pauschal – Sie wählen

Kosten pro Jahr

30.000–60.000 €

Transparenter Fixkostenrahmen

Skalierung

Jeder Token kostet extra – unbegrenzt

Keine Angst vor steigenden Kosten: Modell A

Datensouveränität

Daten verlassen das Unternehmen

100% lokal & DSGVO-konform

Preismodelle

Modell A: B2B PaaS-Flatrates

Für Unternehmen, die große Kontexte und hohe Ausgabegeschwindigkeit in einem festen monatlichen Budget brauchen. Keine Überraschungen, keine Token-Abrechnung.

Starter

Tier 1: Starter

Für Einzelentwickler / kleine RAG-Setups

  • 30 Millionen Tokens / Monat
  • Max. 2 gleichzeitige Requests
  • ~1.800 Tokens/Sekunde Prefill
  • ~65 Tokens/Sekunde Generation
69 € / Monat (für 30 Millionen Tokens)
Parallelisierung 2 Requests
PP ~1.800 t/s
TG ~65 t/s
Starter anfragen
Business

Tier 2: Business

Für KMU mit Dokumentenanalyse und produktivem Team-Einsatz

  • 150 Millionen Tokens / Monat
  • Max. 3 gleichzeitige Requests
  • ~1.500 Tokens/Sekunde Prefill
  • ~60 Tokens/Sekunde Generation
299 € / Monat (für 150 Millionen Tokens)
Parallelisierung 3 Requests
PP ~1.500 t/s
TG ~60 t/s
Business anfragen
Enterprise

Tier 3: Enterprise

Heavy Duty / Batch-Verarbeitung mit Priorisierung

  • 500 Millionen Tokens / Monat
  • Priority Queue, fast dedizierte Bandbreite
  • ~2.000 Tokens/Sekunde Prefill
  • ~70 Tokens/Sekunde Generation
699 € / Monat (für 500 Millionen Tokens + Priority Queue)
Parallelisierung 1-2 Requests
PP ~2.000 t/s
TG ~70 t/s
Enterprise anfragen

Modell B: Pay-as-you-go (Token-basiert)

Komponente Details

Input Tokens (Prefill)

1,20 € pro 1 Million Tokens

Output Tokens (Generation)

2,20 € pro 1 Million Tokens – Premium-Aufschlag für Fast Generation

Maximale Parallelisierung

10 bis 15 gleichzeitige Requests systemweit

Geschätzte PP (Prefill)

~1.500 bis 2.000 Tokens/Sekunde

Geschätzte TG (Generation)

~60 bis 70 Tokens/Sekunde (bei 1-3 parallelen Nutzern; bei voller Auslastung ca. 45-50 t/s pro Nutzer)

Prozess

So starten Sie Ihre KI-Plattform

01

Anforderungsanalyse

Wir besprechen Ihre KI-Use-Cases, Modellgrößen, Datenvolumen und Latenzanforderungen. Dabei ermitteln wir die passende GPU-Konfiguration und das passende Preismodell.

02

Infrastruktur-Setup

Wir bauen Ihre GPU-Box auf, installieren CUDA, vLLM, sglang und setzen Tensorparallelisierung ein. Ihre Server werden in unserer eigenen Infrastruktur in Karlsruhe betrieben.

03

API-Integration

Wir richten die Completion-API für Sie ein und stellen Ihnen Zugangsdaten sowie Dokumentation bereit – betriebsbereit in Tagen, nicht in Wochen.

04

Go-Live & Monitoring

Nach dem Go-Live überwachen wir Performance, Auslastung und Stabilität. Modelle und Technologien werden regelmäßig aktualisiert – ohne dass Sie es merken.

Kundenstimmen

Das sagen Unternehmen über die SI-KI Plattform

Langfristige Partnerschaften sind das Herzstück unserer Arbeit. Hier erzählen Auftraggeber aus dem Mittelstand, wie sie unsere Private-AI-Infrastruktur erleben:

Endlich eine lokale KI-Infrastruktur, die wir kontrollieren. Die Kosten sind planbar, sensible Daten verlassen die Infrastruktur von sobek nicht – und der Support versteht wirklich KI.

Dr. Peter Lang
Leiter Digitale Transformation, Finanzdienstleister

Der Umzug unserer internen KI-Pipeline in die SI-KI Plattform hat uns Planbarkeit zurückgegeben. Keine überraschenden Cloud-Rechnungen mehr.

Lisa Hoffmann
CIO, mittelständisches Industrieunternehmen

Für unsere Patientendokumentation brauchten wir eine DSGVO-konforme KI. sobek innovations hat innerhalb weniger Tage eine API-basierte Lösung bereitgestellt.

Markus Weber
Leiter IT, Gesundheitsdienstleister
FAQ

Häufig gestellte Fragen zur SI-KI Plattform

Sie haben Fragen zur Private-AI-Plattform? Hier klären wir die wichtigsten Punkte zu Infrastruktur, API, Preisen und Datenschutz.

Was genau ist die SI-KI Plattform?
Die SI-KI Plattform ist eine physische GPU-Infrastruktur in unserem eigenen Rechenzentrum in Karlsruhe, die wir selbst betreiben. Sie bekommen Zugang über eine Completion-API und können große KI-Modelle für AI-Inference nutzen – DSGVO-konform und ohne Datenabfluss.
Wie funktioniert der API-Zugang?
Wir richten für Sie eine Completion-API ein, kompatibel zu gängigen OpenAI-ähnlichen Schnittstellen. Sie erhalten Zugangsdaten und Dokumentation und können die API innerhalb Ihrer Anwendungen oder Agenten nutzen – betriebsbereit in Tagen.
Wie unterscheidet sich Modell A von Modell B?
Modell A ist eine monatliche PaaS-Flatrate mit definierten Token-Volumina und Parallelisierung – ideal für planbare Kosten. Modell B ist token-basiertes Pay-as-you-go für flexible, schwankende Nutzung.
Sind die Kosten wirklich fix?
Bei Modell A ja: Sie zahlen die monatliche Flatrate, unabhängig davon, wie viele Nutzer parallel arbeiten. Bei Modell B zahlen Sie nur die tatsächlich verbrauchten Tokens zu festen Preisen pro Million – ohne versteckte Gebühren.
Wie wird die DSGVO-Einhaltung garantiert?
Alle Server stehen in unseren eigenen Räumen in Deutschland. Daten verlassen zu keinem Zeitpunkt unsere Infrastruktur oder werden an Cloud-Anbieter übermittelt. Zusätzlich bieten wir rollenbasierte Zugriffskontrolle, Audit-Logs und Unterstützung bei EU-AI-Act-Konformität.
Welche Modelle und Technologien kommen zum Einsatz?
Wir setzen auf moderne Open-Source und Open-Weighted Modelle sowie Inference-Engines wie vLLM und sglang mit Tensorparallelisierung. Modelle und Technologien werden regelmäßig aktualisiert, damit Sie von neuen Entwicklungen profitieren.
Kontakt

Lass uns über Ihre KI-Plattform sprechen

Schreiben Sie uns direkt – Rafael meldet sich bei Ihnen.

Rafael Sobek

Rafael Sobek

Dein Experte für digitale Lösungen

Mitgründer, Geschäftsführer und Stratege. Als Produkt- und Geschäftsstratege treibt er die Entwicklung neuer digitaler Dienstleistungen voran. Fachexperte für Softwarearchitekturen, KI und digitale Geschäftsprozesse.

Antwort innerhalb eines Werktags.

Deine Angaben werden verschlüsselt übertragen und ausschließlich zur Kontaktaufnahme verwendet.

Bereit für souveräne KI-Infrastruktur aus Karlsruhe?

Steigen Sie jetzt in die SI-KI Plattform ein: planbare Kosten, unsere eigene Hardware in Karlsruhe, keine Datenabflüsse. Starten Sie mit einem unverbindlichen Gespräch – wir finden gemeinsam das passende Modell.

Erreichbarkeit: Mo–Fr 9:00–17:00 Uhr | Antwort innerhalb von 24 Stunden