Capacity Services Annex
Stand: September 2026
Dieser Annex konkretisiert die Bedingungen der optionalen Capacity Services Peak Capacity und Token Resale und ist über das Order Form Vertragsbestandteil. Er gilt jeweils nur, soweit der betreffende Service im Order Form ausdrücklich aktiviert wurde. Bei Widersprüchen gilt die im Order Form festgelegte Rangfolge der Vertragsdokumente.
1. Peak Capacity
1.1 Zweck und Auslösung
Peak Capacity dient ausschließlich der temporären Erweiterung der Inference-Kapazität bei Überlastung der gebuchten AI Factory.
Peak Capacity kommt zum Einsatz, wenn die dedizierte GEKI AI Factory technisch ordnungsgemäß funktioniert, die aktuelle Kundennachfrage jedoch die verfügbare Kapazität der gebuchten GPU-Infrastruktur übersteigt (z. B. außergewöhnlich viele gleichzeitige Nutzer, stark steigende API-Nutzung, zusätzliche Agents oder besonders rechenintensive Workloads).
Peak Capacity ist kein Ersatz für die Störungsbehebung. Hardware- oder Infrastrukturfehler sind ein Incident und werden gemäß SLA behandelt, nicht über Peak Capacity.
1.2 Routing
Zusätzliche Kapazität wird über einen in der Subprozessoren-Liste ausgewiesenen europäischen Router für KI-Inference an von GEKI freigegebene europäische Inference-Anbieter geroutet.
Das Routing erfolgt entsprechend den mit dem Kunden vereinbarten Datenschutz-, Standort- und Sicherheitsvorgaben. GEKI kann die zulässige Providerauswahl einschränken. Die eigene GEKI AI Factory bleibt die primäre Infrastruktur.
Auch bei Peak Capacity gelten die Grundsätze des DPA: stateless, keine persistente Speicherung von Prompt-/Output-Inhalten, kein Training mit Kundendaten, Verarbeitung ausschließlich zur Durchführung des jeweiligen Requests.
1.3 Kosten
Die tatsächlich anfallenden Inference-Kosten werden dem Kunden zusätzlich zur monatlichen Grundgebühr weiterverrechnet, bis zu einem im Order Form angegebenen monatlichen Maximum. Die zusätzliche Kapazität kann extern bezogen oder aus dem GEKI-Pool bereitgestellt werden: bei externem Bezug zu den tagesaktuell ausgewiesenen Preisen des Anbieters je Modell, bei Bereitstellung aus dem GEKI-Pool zum Vergleichspreis (Marktwert) des europäischen Anbieters je Modell. Es wird keine bestimmte Menge an Peak-Capacity-Nutzung garantiert oder geschuldet.
Voraussetzung: Peak Capacity ist nur zusammen mit aktiviertem Token Resale (Abschnitt 2) beziehbar.
2. Token Resale
2.1 Zweck
Token Resale ermöglicht die Vermarktung freier Rechenkapazität der AI Factory für externe Inference-Workloads über einen europäischen Router für KI-Inference.
Token Resale darf ausschließlich freie Rechenkapazität nutzen. Eigene Workloads des Kunden haben zu jedem Zeitpunkt Priorität. Externe Workloads werden zurückgestellt oder abgewiesen, sobald der Kunde selbst Kapazität benötigt.
2.2 Trennung der Workloads
Kunden-Workloads und externe Token-Resale-Workloads werden technisch und logisch getrennt. Externe Workloads erhalten keinen Zugriff auf Kundendaten, Prompts, Outputs, Dokumente, Context, kundenspezifische Caches, Credentials oder API Keys. Kundendaten werden zu keinem Zeitpunkt für externe Workloads verwendet (siehe TOMs Abschnitt 7).
2.3 Erlösaufteilung
Die Aufteilung der tatsächlich erzielten und vereinnahmten Nettoerlöse des Token Resale zwischen Kunde und GEKI ist im Order Form festgelegt. Maßgeblich sind die dort vereinbarten Anteile.
Nettoerlöse sind die dem Router bzw. GEKI für die vermarktete Kapazität tatsächlich zugeflossenen Erlöse abzüglich der Entgelte des jeweiligen Routing-Anbieters. Der Kundenanteil wird in der jeweiligen Folgeabrechnung gutgeschrieben.
2.4 Keine Garantie
GEKI garantiert keine bestimmte Auslastung und keine Höhe der Resale-Erlöse. Ob und in welchem Umfang freie Kapazität vermarktet werden kann, hängt insbesondere von Marktnachfrage, Auslastung durch den Kunden und technischen Rahmenbedingungen ab.
3. Verhältnis zu anderen Dokumenten
Dieser Annex gilt gemeinsam mit Order Form, Leistungsbeschreibung, SLA, DPA/AVV, TOMs und Subprozessoren-Liste. Die eingesetzten Anbieter werden in der jeweils gültigen Subprozessoren-Liste ausgewiesen.