SI-KI Plattform – Ihre GPU-Plattform für AI-Inference
Unsere GPU-Plattform für AI-Inference: 2× bis 6× High-End GPUs, genug VRAM für große KI-Modelle und eine betriebsfertige Completion-API – aufgebaut wie ein Kryptominer, betrieben in unseren eigenen Rechenzentrumsräumen in Karlsruhe. Sie greifen per API zu, die Hardware bleibt bei uns. Daten verlassen nie unsere Infrastruktur.
2× bis 6× High-End GPUs als betriebsfertige Box
Wir liefern keine abstrakte Cloud. Sie bekommen eine physisch bei uns betriebene GPU-Box mit bis zu sechs High-End GPUs, massig VRAM und modernster Inference-Software – direkt einsatzbereit inklusive API-Zugang.
Was es kann
10× Nutzer parallel
Schnell genug für 10 gleichzeitige Nutzer – ohne dass die Performance einbricht.
Echtzeit-Antworten
Antworten in Echtzeit – auch bei parallelen Anfragen und komplexen KI-Modellen.
100% DSGVO & souverän
Ihre Daten verlassen nie unsere Infrastruktur in Karlsruhe. Keine Cloud, kein Datenabfluss an Dritte, volle Kontrolle.
Fixkosten statt pro-Token
Einmalige Hardware + Strom oder Flatrate – kein pro-Token-Preis, keine überraschenden Rechnungen.
Warum klassische KI-Lösungen an ihre Grenzen stoßen
KI ist technisch längst bereit für autonome Prozesse, 24/7-Agenten und Wissensabfragen. Doch klassische Cloud-KI blockiert den Mittelstand – aus Kosten-, Datenschutz- und Integrationsgründen.
Cloud-Kosten eskalieren
Jeder Use-Case, jeder Token kostet extra. Die Rechnung wächst mit dem Geschäftsvolumen – unbegrenzt und schwer planbar.
Daten verlassen das Unternehmen
Cloud-KI verarbeitet sensible Daten auf fremden Servern. DSGVO-Risiko, keine Kontrolle über Datenflüsse, keine echte Souveränität.
Systemwechsel frisst Zeit
Mitarbeiter springen zwischen 5+ Systemen: CRM, Buchhaltung, E-Mail, DMS. Jeder Wechsel kostet Konzentration und Produktivität.
KI-Potenzial bleibt ungenutzt
Autonome Prozesse, 24/7-Agenten, Wissensabfrage – alles technisch möglich, aber Cloud-Abhängigkeit blockiert den Einsatz.
Souveräne KI-Plattform, die alles verbindet
Daten verlassen unsere Server nie
Wettbewerbsschutz durch physische Kontrolle über alle KI-Komponenten in unserem Rechenzentrum. Ihre Daten bleiben in unserer Infrastruktur in Karlsruhe.
Digitale Souveränität
Keine Abhängigkeit von OpenAI, Anthropic, Google. Keine API-Sperren, keine Preiswillkür, keine fremde Infrastruktur.
DSGVO-konform
Keine Verarbeitung in Drittländern. Keine Datenübermittlung an Cloud-Anbieter. Volle Compliance aus Karlsruhe.
Rollenbasiert
Zugriff ausschließlich über Ihre Completion-API. Jeder Mitarbeiter sieht nur, was er darf. Auditierbar und nachvollziehbar.
Open-Source & Open-Weighted Modelle
Modelle und Software sind nachvollziehbar. Keine Blackbox, kein Vendor-Lock-in, volle Transparenz.
Audit-Log
Jede KI-Aktion wird protokolliert. Vollständige Nachvollziehbarkeit für Compliance und Sicherheit.
EU AI Act
Konformitäts-Check möglich. Vorbereitet auf kommende Regulierungen und regulatorische Anforderungen.
Use Cases
Geschäftskritische Umgebungen, in denen Datensouveränität, Geschwindigkeit und Kontrolle entscheidend sind. Sie nutzen die KI über unsere Completion-API – wir betreiben die Hardware.
Banken & Finanzdienstleister
Verarbeitung von Finanzdaten, Kreditrisiken und Kundeninformationen auf unserer eigenen Hardware – ohne Datenabfluss in die Cloud.
Patientendaten & Gesundheitswesen
KI-gestützte Dokumentenanalyse, Befundauswertung und Wissensabfrage – alle Daten verbleiben in unserer Infrastruktur in Karlsruhe.
Personendaten & HR
Automatisierte Verarbeitung von Bewerbungen, Personalakten und internen Dokumenten über die API – mit rollenbasierter Kontrolle.
Passwörter & Credentials
Sichere Verarbeitung von Zugangsdaten, Credentials und Sicherheitsinformationen auf unserer eigenen Hardware mit API-Zugriff.
Cloud-KI-Kosten explodieren – Flatrate statt pro Token
| Kostenfaktor | Cloud (OpenAI & Co.) | SI-KI Plattform |
|---|---|---|
|
Preis pro Monat (100 Nutzer, moderat) |
~2.500–5.000 € |
79–719 € Flatrate – inkl. bis zu 300 Mio Output-Tokens |
|
Beispiel: 300 Mio Output-Tokens |
~2.700 € (GPT-4o Preisniveau) |
719 € (Tier 3: Agent Cluster Max) – ca. 73 % Ersparnis |
|
Kontextlänge pro Anfrage |
meist nur 128.000 Token |
262.144 Token – auf jeder Flatrate-Stufe |
|
Kostenplanung |
Jeder Token kostet extra – unbegrenzt und unberechenbar |
Feste Pauschale mit Token-Deckel, Überziehung nur 0,75 €/Mio |
|
Datensouveränität |
Daten verlassen das Unternehmen |
100 % lokal in Karlsruhe & DSGVO-konform |
|
Preisgarantie |
Preisänderungen jederzeit möglich |
Alle Preise zzgl. 19 % MwSt., keine versteckten Kosten |
PaaS-Flatrates
Monatliche Pauschale mit fester Token-Obergrenze – planbare Fixkosten statt pro-Token-Abrechnung. Jeder Tarif bietet bis zu 262.144 Token Kontext pro Anfrage – mehr Kontext als die meisten Cloud-APIs überhaupt anbieten. Alle Preise zzgl. 19 % MwSt. Zusätzliche Tokens über das Limit: 0,75 € pro 1 Mio Output-Tokens.
Tier 1: Agent Solo
Für Einzelentwickler & einen Agenten-Seat
- 30 Mio Output-Tokens / Monat (zzgl. 19 % MwSt.)
- 150 Mio Input-Tokens inklusive
- 1 gleichzeitige Session
- 262.144 Token Kontext pro Anfrage
- Bis ~130 Tokens/Sekunde Generation (Code & strukturierte Ausgaben)
Tier 2: Agent Team
Für Agenten- & Dev-Teams mit 3–5 Seats
- 100 Mio Output-Tokens / Monat (zzgl. 19 % MwSt.)
- 500 Mio Input-Tokens inklusive
- 2–3 gleichzeitige Sessions
- 262.144 Token Kontext pro Anfrage
- 2 Instanzen à bis ~130 Tokens/Sekunde
Tier 3: Agent Cluster Max
Agenten-Farmen, 24/7-Autonome & Batch-Verarbeitung
- 300 Mio Output-Tokens / Monat (zzgl. 19 % MwSt.)
- 1,5 Mrd Input-Tokens inklusive
- 4 gleichzeitige Sessions
- 262.144 Token Kontext je Session
- ~400–450 Tokens/Sekunde aggregiert
So starten Sie Ihre KI-Plattform
Anforderungsanalyse
Wir besprechen Ihre KI-Use-Cases, Modellgrößen, Datenvolumen und Latenzanforderungen. Dabei ermitteln wir die passende GPU-Konfiguration und das passende Preismodell.
Infrastruktur-Setup
Wir bauen Ihre GPU-Box auf, installieren CUDA, vLLM, sglang und setzen Tensorparallelisierung ein. Ihre Server werden in unserer eigenen Infrastruktur in Karlsruhe betrieben.
API-Integration
Wir richten die Completion-API für Sie ein und stellen Ihnen Zugangsdaten sowie Dokumentation bereit – betriebsbereit in Tagen, nicht in Wochen.
Go-Live & Monitoring
Nach dem Go-Live überwachen wir Performance, Auslastung und Stabilität. Modelle und Technologien werden regelmäßig aktualisiert – ohne dass Sie es merken.
Häufig gestellte Fragen zur SI-KI Plattform
Sie haben Fragen zur Private-AI-Plattform? Hier klären wir die wichtigsten Punkte zu Infrastruktur, API, Preisen und Datenschutz.
Was genau ist die SI-KI Plattform?
Wie funktioniert der API-Zugang?
Sind die Kosten wirklich fix – was passiert bei Überschreitung des Token-Limits?
Warum werden Output- und Input-Tokens getrennt behandelt?
Was bedeutet ‚Session' bei den Flatrate-Tiers?
Wie wird die DSGVO-Einhaltung garantiert?
Welche Modelle und Technologien kommen zum Einsatz?
Lass uns über Ihre KI-Plattform sprechen
Schreiben Sie uns direkt – Rafael meldet sich bei Ihnen.
Bereit für souveräne KI-Infrastruktur aus Karlsruhe?
Steigen Sie jetzt in die SI-KI Plattform ein: planbare Kosten, unsere eigene Hardware in Karlsruhe, keine Datenabflüsse. Starten Sie mit einem unverbindlichen Gespräch – wir finden gemeinsam das passende Modell.
Erreichbarkeit: Mo–Fr 9:00–17:00 Uhr | Antwort innerhalb von 24 Stunden