SI-KI Plattform – Ihre GPU-Plattform für AI-Inference
Unsere GPU-Plattform für AI-Inference: 2× bis 6× High-End GPUs, genug VRAM für große KI-Modelle und eine betriebsfertige Completion-API – aufgebaut wie ein Kryptominer, betrieben in unseren eigenen Rechenzentrumsräumen in Karlsruhe. Sie greifen per API zu, die Hardware bleibt bei uns. Daten verlassen nie unsere Infrastruktur.
2× bis 6× High-End GPUs als betriebsfertige Box
Wir liefern keine abstrakte Cloud. Sie bekommen eine physisch bei uns betriebene GPU-Box mit bis zu sechs High-End GPUs, massig VRAM und modernster Inference-Software – direkt einsatzbereit inklusive API-Zugang.
Was es kann
10× Nutzer parallel
Schnell genug für 10 gleichzeitige Nutzer – ohne dass die Performance einbricht.
Echtzeit-Antworten
Antworten in Echtzeit – auch bei parallelen Anfragen und komplexen KI-Modellen.
100% DSGVO & souverän
Ihre Daten verlassen nie unsere Infrastruktur in Karlsruhe. Keine Cloud, kein Datenabfluss an Dritte, volle Kontrolle.
Fixkosten statt pro-Token
Einmalige Hardware + Strom oder Flatrate – kein pro-Token-Preis, keine überraschenden Rechnungen.
Warum klassische KI-Lösungen an ihre Grenzen stoßen
KI ist technisch längst bereit für autonome Prozesse, 24/7-Agenten und Wissensabfragen. Doch klassische Cloud-KI blockiert den Mittelstand – aus Kosten-, Datenschutz- und Integrationsgründen.
Cloud-Kosten eskalieren
Jeder Use-Case, jeder Token kostet extra. Die Rechnung wächst mit dem Geschäftsvolumen – unbegrenzt und schwer planbar.
Daten verlassen das Unternehmen
Cloud-KI verarbeitet sensible Daten auf fremden Servern. DSGVO-Risiko, keine Kontrolle über Datenflüsse, keine echte Souveränität.
Systemwechsel frisst Zeit
Mitarbeiter springen zwischen 5+ Systemen: CRM, Buchhaltung, E-Mail, DMS. Jeder Wechsel kostet Konzentration und Produktivität.
KI-Potenzial bleibt ungenutzt
Autonome Prozesse, 24/7-Agenten, Wissensabfrage – alles technisch möglich, aber Cloud-Abhängigkeit blockiert den Einsatz.
Souveräne KI-Plattform, die alles verbindet
Daten verlassen unsere Server nie
Wettbewerbsschutz durch physische Kontrolle über alle KI-Komponenten in unserem Rechenzentrum. Ihre Daten bleiben in unserer Infrastruktur in Karlsruhe.
Digitale Souveränität
Keine Abhängigkeit von OpenAI, Anthropic, Google. Keine API-Sperren, keine Preiswillkür, keine fremde Infrastruktur.
DSGVO-konform
Keine Verarbeitung in Drittländern. Keine Datenübermittlung an Cloud-Anbieter. Volle Compliance aus Karlsruhe.
Rollenbasiert
Zugriff ausschließlich über Ihre Completion-API. Jeder Mitarbeiter sieht nur, was er darf. Auditierbar und nachvollziehbar.
Open-Source & Open-Weighted Modelle
Modelle und Software sind nachvollziehbar. Keine Blackbox, kein Vendor-Lock-in, volle Transparenz.
Audit-Log
Jede KI-Aktion wird protokolliert. Vollständige Nachvollziehbarkeit für Compliance und Sicherheit.
EU AI Act
Konformitäts-Check möglich. Vorbereitet auf kommende Regulierungen und regulatorische Anforderungen.
Cloud AI Kosten explodieren – Fixkosten statt variabel
| Kostenfaktor | Cloud (OpenAI & Co.) | SI-KI Plattform |
|---|---|---|
|
Preis pro Monat |
~2.500–5.000 € (100 Nutzer, moderate Nutzung) |
Token-basiert oder pauschal – Sie wählen |
|
Kosten pro Jahr |
30.000–60.000 € |
Transparenter Fixkostenrahmen |
|
Skalierung |
Jeder Token kostet extra – unbegrenzt |
Keine Angst vor steigenden Kosten: Modell A |
|
Datensouveränität |
Daten verlassen das Unternehmen |
100% lokal & DSGVO-konform |
Use Cases
Geschäftskritische Umgebungen, in denen Datensouveränität, Geschwindigkeit und Kontrolle entscheidend sind. Sie nutzen die KI über unsere Completion-API – wir betreiben die Hardware.
Banken & Finanzdienstleister
Verarbeitung von Finanzdaten, Kreditrisiken und Kundeninformationen auf unserer eigenen Hardware – ohne Datenabfluss in die Cloud.
Patientendaten & Gesundheitswesen
KI-gestützte Dokumentenanalyse, Befundauswertung und Wissensabfrage – alle Daten verbleiben in unserer Infrastruktur in Karlsruhe.
Personendaten & HR
Automatisierte Verarbeitung von Bewerbungen, Personalakten und internen Dokumenten über die API – mit rollenbasierter Kontrolle.
Passwörter & Credentials
Sichere Verarbeitung von Zugangsdaten, Credentials und Sicherheitsinformationen auf unserer eigenen Hardware mit API-Zugriff.
Modell A: B2B PaaS-Flatrates
Für Unternehmen, die große Kontexte und hohe Ausgabegeschwindigkeit in einem festen monatlichen Budget brauchen. Keine Überraschungen, keine Token-Abrechnung.
Tier 1: Starter
Für Einzelentwickler / kleine RAG-Setups
- 30 Millionen Tokens / Monat
- Max. 2 gleichzeitige Requests
- ~1.800 Tokens/Sekunde Prefill
- ~65 Tokens/Sekunde Generation
Tier 2: Business
Für KMU mit Dokumentenanalyse und produktivem Team-Einsatz
- 150 Millionen Tokens / Monat
- Max. 3 gleichzeitige Requests
- ~1.500 Tokens/Sekunde Prefill
- ~60 Tokens/Sekunde Generation
Tier 3: Enterprise
Heavy Duty / Batch-Verarbeitung mit Priorisierung
- 500 Millionen Tokens / Monat
- Priority Queue, fast dedizierte Bandbreite
- ~2.000 Tokens/Sekunde Prefill
- ~70 Tokens/Sekunde Generation
Modell B: Pay-as-you-go (Token-basiert)
| Komponente | Details |
|---|---|
|
Input Tokens (Prefill) |
1,20 € pro 1 Million Tokens |
|
Output Tokens (Generation) |
2,20 € pro 1 Million Tokens – Premium-Aufschlag für Fast Generation |
|
Maximale Parallelisierung |
10 bis 15 gleichzeitige Requests systemweit |
|
Geschätzte PP (Prefill) |
~1.500 bis 2.000 Tokens/Sekunde |
|
Geschätzte TG (Generation) |
~60 bis 70 Tokens/Sekunde (bei 1-3 parallelen Nutzern; bei voller Auslastung ca. 45-50 t/s pro Nutzer) |
So starten Sie Ihre KI-Plattform
Anforderungsanalyse
Wir besprechen Ihre KI-Use-Cases, Modellgrößen, Datenvolumen und Latenzanforderungen. Dabei ermitteln wir die passende GPU-Konfiguration und das passende Preismodell.
Infrastruktur-Setup
Wir bauen Ihre GPU-Box auf, installieren CUDA, vLLM, sglang und setzen Tensorparallelisierung ein. Ihre Server werden in unserer eigenen Infrastruktur in Karlsruhe betrieben.
API-Integration
Wir richten die Completion-API für Sie ein und stellen Ihnen Zugangsdaten sowie Dokumentation bereit – betriebsbereit in Tagen, nicht in Wochen.
Go-Live & Monitoring
Nach dem Go-Live überwachen wir Performance, Auslastung und Stabilität. Modelle und Technologien werden regelmäßig aktualisiert – ohne dass Sie es merken.
Häufig gestellte Fragen zur SI-KI Plattform
Sie haben Fragen zur Private-AI-Plattform? Hier klären wir die wichtigsten Punkte zu Infrastruktur, API, Preisen und Datenschutz.
Was genau ist die SI-KI Plattform?
Wie funktioniert der API-Zugang?
Wie unterscheidet sich Modell A von Modell B?
Sind die Kosten wirklich fix?
Wie wird die DSGVO-Einhaltung garantiert?
Welche Modelle und Technologien kommen zum Einsatz?
Lass uns über Ihre KI-Plattform sprechen
Schreiben Sie uns direkt – Rafael meldet sich bei Ihnen.
Bereit für souveräne KI-Infrastruktur aus Karlsruhe?
Steigen Sie jetzt in die SI-KI Plattform ein: planbare Kosten, unsere eigene Hardware in Karlsruhe, keine Datenabflüsse. Starten Sie mit einem unverbindlichen Gespräch – wir finden gemeinsam das passende Modell.
Erreichbarkeit: Mo–Fr 9:00–17:00 Uhr | Antwort innerhalb von 24 Stunden