Leistungsbeschreibung
Stand: September 2026
Souveräne KI. Hyperscaler Convenience.
Diese Leistungsbeschreibung definiert den Leistungsumfang der im Order Form bestellten GEKI AI Factory.
1. Bereitgestellte Infrastruktur
GEKI stellt dem Kunden die im Order Form vereinbarte GPU-Kapazität bereit.
Maßgeblich sind insbesondere:
- Anzahl der GPUs
- GPU-Generation bzw. Leistungsklasse
- zugesicherter GPU-VRAM
- anteilige CPU- und RAM-Ressourcen gemäß Order Form
- vereinbartes Rechenzentrum
Die gebuchte GPU-Kapazität ist dem Kunden dediziert zugeordnet. Weitere Infrastrukturkomponenten können geteilt betrieben werden.
Zu jeder gebuchten GPU stehen dem Kunden anteilig CPU- und RAM-Ressourcen gemäß Order Form zur Verfügung (Standard: 8 CPU-Kerne und 96 GB RAM je GPU). Diese anteiligen Ressourcen sind für den Betrieb des Inference-Workloads auf der jeweiligen GPU-Kapazität bestimmt.
Im monatlichen Preis enthalten sind:
- GPU- und Server-Infrastruktur
- Rechenzentrum
- Strom und Kühlung
- Netzwerk
- Hardware Monitoring
- Hardware Operations
- Wartung und Hardwareaustausch
Hardwareaustausch
Bei einem Hardwaredefekt übernimmt GEKI die vollständige Abwicklung von Diagnose, Garantie, Reparatur und Austausch.
GEKI ersetzt defekte Hardware durch dieselbe oder eine vergleichbare Hardware. Vergleichbarkeit bemisst sich insbesondere an VRAM-Kapazität und Rechenleistung (FLOPs): Die Ersatzhardware ist mindestens gleichwertig, d. h. sie unterschreitet weder den im Order Form zugesicherten VRAM noch die vergleichbare Rechenleistung (FLOPs), und kann derselben oder einer neueren GPU-Generation angehören, sofern Kompatibilität gewährleistet bleibt.
Für den Kunden entstehen aus einem notwendigen Hardwareaustausch keine zusätzlichen Hardwarekosten.
2. Managed AI Stack
GEKI installiert und betreibt den notwendigen AI-Inference-Stack.
Enthalten sind insbesondere:
- Managed Inference Runtime
- OpenAI-kompatibler API Endpoint
- API-Key-Verwaltung
- Model Hosting
- Prompt / Prefix Caching
- KV-Cache- und VRAM-Optimierung
- Performance Tuning
- Monitoring
- Updates und Patch Management
Die Infrastruktur kann für Chats, Agents, RAG-Systeme und eigene Anwendungen genutzt werden.
Monitoring
Monitoring Standard (inklusive): Das enthaltene Monitoring erfasst ausschließlich Metadaten, insbesondere die Anzahl der Requests über die Zeit sowie die Anzahl der Input- und Output-Tokens. Die eigentlichen Prompt- und Output-Inhalte werden dabei nicht gespeichert (Stateless-Betrieb, siehe DPA / TOMs).
Monitoring Observability (optional, kostenpflichtig): Auf Wunsch kann das Modul Observability Monitoring bestellt werden, das die Gesamtrequests protokolliert. Bestellt der Kunde dieses Modul, werden Prompts, Inputs und Outputs gespeichert — zum Zweck der Nachvollziehbarkeit für den Kunden. Die Haltedauer legt der Kunde selbst fest, maximal jedoch 30 Tage; nach Ablauf der Haltedauer werden die Daten gelöscht. Die Vergütung dieses Moduls wird im Order Form vereinbart — entweder als Preis je Gigabyte und Monat (Ingest und Storage) oder als im Grundpreis inkludierte Leistung. Für die dabei gespeicherten Inhalte gelten die im DPA vorgesehenen Speicher- und Löschregeln.
3. Model Management
Die GEKI AI Factory kann mit einem Modell aus dem GEKI Modellkatalog oder mit einem eigenen Modell des Kunden betrieben werden. Das initiale Modell wird im Order Form festgelegt.
Modelle aus dem GEKI Modellkatalog
Der GEKI Modellkatalog umfasst von GEKI kuratierte und getestete Modelle (siehe modellkatalog). Für Katalogmodelle enthalten sind:
- initiales Model Deployment
- geeignete Modellvariante und Quantisierung
- Performance- und VRAM-Optimierung sowie Performance Tuning durch GEKI
- Funktionstest
- 1 Modellwechsel pro Kalendermonat inklusive
Ein einmal deploytes Katalogmodell bleibt dem Kunden verfügbar, solange es deployed ist — auch wenn es später aus dem Katalog genommen wird. Aus dem Katalog entfernte Modelle sind jedoch für neue Deployments bzw. eine Neuauswahl nicht mehr wählbar.
Eigene Modelle des Kunden
Der Kunde kann ein eigenes Modell betreiben, sofern es technisch, lizenzrechtlich und hinsichtlich seines Hardwarebedarfs mit der gebuchten AI Factory kompatibel ist. Bei eigenen Modellen liegt das Performance Tuning beim Kunden; GEKI stellt die Infrastruktur bereit, übernimmt jedoch kein modellspezifisches Performance Tuning.
Weitere Modellwechsel oder kundenspezifische Anpassungen können separat beauftragt werden; sie werden nach Zeitaufwand gemäß AGB Abschnitt 2.2 verrechnet, sofern nichts anderes vereinbart ist.
4. Setup & Onboarding
Setup und Onboarding sind inklusive.
GEKI übernimmt:
- Provisionierung der AI Factory
- Installation des AI Stacks
- initiales Model Deployment
- API Endpoint und API Keys
- Monitoring Setup
- technische Einführung und Unterstützung bei der ersten Integration: Videokonferenz, 2 Stunden
5. Betrieb, Störungen und Wiederherstellung
GEKI übernimmt den laufenden technischen Betrieb einschließlich Monitoring, Updates, Security Patches, Fehleranalyse und Hardware Operations.
Bei einem Ausfall der dedizierten Hardware arbeitet GEKI an der schnellstmöglichen Wiederherstellung des Services. Die Wiederherstellung erfolgt auf der dedizierten Infrastruktur nach Reparatur beziehungsweise Hardwareaustausch.
Support-, Reaktions- und Service-Level-Regelungen (SLAs) ergeben sich aus dem GEKI SLA.
Längerer vollständiger Serviceausfall
Für Zeiträume, in denen der vereinbarte Service aufgrund eines von GEKI zu verantwortenden Infrastruktur- oder Hardwareausfalls vollständig nicht verfügbar ist, wird die auf diesen Ausfallzeitraum entfallende monatliche Grundgebühr nicht verrechnet beziehungsweise gutgeschrieben.
6. Wartung
Geplante Wartungsarbeiten werden mindestens 3 Kalendertage im Voraus angekündigt und nach Möglichkeit außerhalb der üblichen produktiven Nutzung durchgeführt.
Geplante Wartungsarbeiten gelten nicht als Hardwareausfall im Sinne von Abschnitt 5.
Dringende Security-, Stabilitäts- oder Incident-Maßnahmen können ohne Einhaltung dieser Vorankündigungsfrist durchgeführt werden, sofern dies zum Schutz oder zur Wiederherstellung des Services erforderlich ist.
7. Kapazität und Performance
Die tatsächlich erreichbare Token-Produktion, Latenz und Parallelität hängen insbesondere ab von:
- Modell und Quantisierung
- Context-Länge
- Input-/Output-Verhältnis
- Parallelität
- Caching
- Workload
Auf Pricing Pages oder Angeboten genannte Token-Mengen sind, sofern nicht ausdrücklich anders vereinbart, unverbindliche Planungswerte und keine garantierten Mindestdurchsätze oder Kontingente.
Es bestehen keine zusätzlichen Gebühren pro internem Benutzer und kein fixes Token-Kontingent.
8. Peak Capacity
Peak Capacity ist ein optionaler Zusatzservice und steht nur zur Verfügung, wenn er im Bestellformular (Order Form) bestellt wurde.
Der Service greift, wenn die gebuchte AI Factory des Kunden ausgelastet ist und die Anfragen die Kapazität der KI-Fabrik überschreiten. In diesem Fall wird zusätzliche Inference-Kapazität über einen europäischen Router für KI-Inference von europäischen Anbietern bezogen.
Voraussetzung: Peak Capacity kann nur bezogen werden, wenn der Kunde zugleich Token Resale (Abschnitt 9) aktiviert hat.
Die eigene GEKI AI Factory bleibt die primäre Infrastruktur. Routing erfolgt entsprechend den vereinbarten Datenschutz-, Standort- und Sicherheitsvorgaben. Die eingesetzten Anbieter werden in der jeweils gültigen Subprozessoren-Liste ausgewiesen.
Kosten
Die über Peak Capacity bezogene Kapazität wird dem Kunden zu den tagesaktuell ausgewiesenen Preisen des jeweiligen Anbieters für das jeweilige Modell weiterverrechnet, bis zu einem im Order Form angegebenen monatlichen Maximum.
Wird die zusätzliche Kapazität von GEKI selbst bereitgestellt, wird der Vergleichspreis (Marktwert) des europäischen Anbieters für das jeweilige Modell verrechnet.
9. Token Resale
Sofern im Order Form bestellt, kann freie Kapazität der AI Factory über einen europäischen Router für KI-Inference für externe Token-Produktion angeboten werden.
Eigene Workloads des Kunden haben immer Priorität.
Die Aufteilung der tatsächlich erzielten und vereinnahmten Nettoerlöse zwischen Kunde und GEKI wird im Order Form geregelt. Die Gutschrift des Kundenanteils erfolgt in der jeweiligen Folgeabrechnung.
Eine bestimmte Auslastung oder Höhe der Resale-Erlöse wird nicht garantiert.
10. Datenstandort
Die dedizierte GEKI AI Factory wird in dem im Order Form angegebenen Rechenzentrum betrieben.
Regelungen zur Verarbeitung personenbezogener Daten, technischen und organisatorischen Maßnahmen sowie eingesetzten Subprozessoren ergeben sich aus dem DPA / AVV und dessen Anlagen.
11. Nicht enthalten
Sofern nicht ausdrücklich vereinbart:
- Entwicklung kundenspezifischer Anwendungen oder Agents
- Datenaufbereitung und Migration
- individuelle Softwareentwicklung
- zusätzliche Storage- oder Netzwerkleistungen
- zusätzliche Modellwechsel
- Drittanbieter-Lizenzen
- über Peak Capacity bezogene zusätzliche Inference-Kapazität
Diese Leistungen können gesondert beauftragt und nach Zeitaufwand gemäß AGB Abschnitt 2.2 verrechnet werden.
12. Mitwirkung des Kunden
Der Kunde ist insbesondere verantwortlich für:
- rechtmäßige Nutzung der Services
- sichere Verwaltung seiner API Keys
- seine Daten, Prompts und Anwendungen
- fachliche Prüfung von AI-Ergebnissen
- Compliance seiner konkreten AI-Anwendungen und Use Cases
Diese Leistungsbeschreibung gilt gemeinsam mit dem jeweiligen Order Form, den GEKI AGB, dem GEKI SLA, dem DPA / AVV sowie gegebenenfalls dem Capacity Services Annex. Das Order Form ist das verbindliche Rahmendokument.