Starten Sie auf Infrastruktur von GEKI im europäischen Rechenzentrum: Tokens, Modelle und KI-Agenten per Klick. Eine Monatsgebühr. GEKI übernimmt den Betrieb. Optional auch mit eigenen GPUs.
Die Monatsgebühr deckt Inferenz, Modell-Hosting, Agenten, Monitoring und Support ab - keine Nutzer-Lizenzen, kein Token-Aufschlag. Die Rechnung wächst nicht mit jedem Nutzer oder Request. Optional: ungenutzte Kapazität verkaufen und so die Gebühr senken.
Ihre Hardware, betrieben von GEKI.
Sie besitzen oder leasen bereits GPUs? GEKI macht daraus eine gemanagte KI-Token-Fabrik - Tokens, Modelle und Agenten inklusive, ohne eigenes Ops-Team.
Ohne Invest starten - GEKI stellt Hardware & Rechenzentrum.
GEKI beschafft, hostet und betreibt die GPU und den kompletten KI-Stack - Sie nutzen nur Tokens und Agenten, ohne Hardware zu kaufen oder zu betreiben.
Pro Modell die passende Hardware, die erwartete Token-Menge pro Monat und der effektive Preis pro 1 Mio. Tokens - inkl. GEKI-Betrieb. Richtwerte bei hoher Auslastung; tatsächlich hängen Output und Kosten von Workload, Kontext und Auslastung ab.
| Modell | Empfohlene Hardware | Tokens / Monat | Effektiver Preis / 1 Mio. Tokens |
|---|---|---|---|
| Gemma 4 | 1× RTX PRO 6000 | ca. 20 Mrd. | ca. 0,10 € |
| Qwen 3.6 | 1× RTX PRO 6000 | ca. 15 Mrd. | ca. 0,13 € |
| DeepSeek V4 Flash | 2× RTX PRO 6000 | ca. 20 Mrd. | ca. 0,20 € |
| GLM 5.2 | 8× H200 | ca. 9 Mrd. | ca. 0,70 € |
* Richtwerte auf empfohlener Hardware bei hoher Auslastung - tatsächlicher Token-Output und Kosten hängen von Workload und Setup ab.
GEKI rechnet über die genutzte Infrastruktur, nicht über Token-Aufschläge.
Günstiger wird es, wenn Setup und Workload passen: passende GPU, passendes Modell, Routing nach Kosten und Qualität - und kein Frontier-Modell, wo ein offenes Modell reicht.
Wenn Ihre dedizierte GPU-Kapazität nicht voll genutzt wird, kann GEKI ungenutzte Kapazität optional als Tokens am Spotmarkt verkaufen. Ihre eigenen Workloads haben immer Priorität; Spotmarkt-Traffic läuft nur auf freier Kapazität und wird verdrängt, sobald Ihr Bedarf steigt. Der Erlös aus verkaufter Kapazität wird zwischen GEKI und dem Kunden geteilt.
Übersteigen Ihre Workloads temporär die dedizierte Kapazität, kann GEKI Lastspitzen optional zu geprüften europäischen Token-Anbietern routen - per Richtlinie konfigurierbar: nur EU-Anbieter, freigegebene Modelle, Budgetlimits, Latenzanforderungen, Workload-Typ und Datensensibilitätsregeln. Peak-Kapazität wird zum Marktpreis eingekauft.
Teilen Sie Ihre erwartete Nutzung mit. GEKI empfiehlt die passende Infrastruktur, KI-Modell und das Betriebsmodell.