Starten Sie auf Infrastruktur von GEKI im europäischen Rechenzentrum: Tokens, Modelle und KI-Agenten per Klick. Eine Monatsgebühr. GEKI übernimmt den Betrieb.
Die Monatsgebühr deckt Inferenz, Modell-Hosting, Agenten, Monitoring und Support ab - keine Nutzer-Lizenzen, kein Token-Aufschlag. Die Rechnung wächst nicht mit jedem Nutzer oder Request. Optional: ungenutzte Kapazität verkaufen und so die Gebühr senken.
Ohne Invest starten - GEKI stellt Hardware & Rechenzentrum.
GEKI beschafft, hostet und betreibt die GPUs und den kompletten KI-Stack - Sie nutzen nur Tokens und Agenten, ohne Hardware zu kaufen oder zu betreiben.
Dedizierte GPU-Kapazität im europäischen Rechenzentrum, komplett gemanagt. Zwei Hardware-Linien, je drei Größen - anteilig 8 CPU-Kerne und 96 GB RAM je GPU.
| Paket | Hardware | VRAM | Preis / Monat |
|---|---|---|---|
| Mini | 1× RTX 6000 Blackwell | 96 GB | 1.990 € |
| Standard | 2× RTX 6000 Blackwell | 192 GB | 3.980 € |
| Large | 8× RTX 6000 Blackwell | 768 GB | 15.920 € |
| Paket | Hardware | VRAM | Preis / Monat |
|---|---|---|---|
| Mini | 1× AMD Instinct MI350P | 144 GB | 2.200 € |
| Standard | 2× AMD Instinct MI350P | 288 GB | 4.400 € |
| Large | 8× AMD Instinct MI350P | 1.152 GB | 17.600 € |
Alle Preise exkl. USt. 36 Monate Mindestlaufzeit. Anteilig 8 CPU-Kerne und 96 GB RAM je GPU. Optional: Peak Capacity & Token-Verkauf.
Pro Modell die passende Hardware, die erwartete Token-Menge pro Monat und der effektive Preis pro 1 Mio. Tokens - inkl. GEKI-Betrieb. Richtwerte bei hoher Auslastung; tatsächlich hängen Output und Kosten von Workload, Kontext und Auslastung ab.
| Modell | Empfohlene Hardware | Tokens / Monat | Effektiver Preis / 1 Mio. Tokens |
|---|---|---|---|
| Gemma 4 | 1× RTX PRO 6000 | ca. 20 Mrd. | ca. 0,10 € |
| Qwen 3.6 | 1× RTX PRO 6000 | ca. 15 Mrd. | ca. 0,13 € |
| DeepSeek V4 Flash | 2× AMD MI350P | auf Anfrage | auf Anfrage |
| GLM 5.2 | 8× H200 | ca. 9 Mrd. | ca. 0,70 € |
* Richtwerte auf empfohlener Hardware bei hoher Auslastung - tatsächlicher Token-Output und Kosten hängen von Workload und Setup ab.
GEKI rechnet über die genutzte Infrastruktur, nicht über Token-Aufschläge.
Günstiger wird es, wenn Setup und Workload passen: passende GPU, passendes Modell, Routing nach Kosten und Qualität - und kein Frontier-Modell, wo ein offenes Modell reicht.
Wenn Ihre dedizierte GPU-Kapazität nicht voll genutzt wird, kann GEKI ungenutzte Kapazität optional als Tokens am Spotmarkt verkaufen. Ihre eigenen Workloads haben immer Priorität; Spotmarkt-Traffic läuft nur auf freier Kapazität und wird verdrängt, sobald Ihr Bedarf steigt. Der Erlös aus verkaufter Kapazität wird zwischen GEKI und dem Kunden geteilt.
Übersteigen Ihre Workloads temporär die dedizierte Kapazität, kann GEKI Lastspitzen optional zu geprüften europäischen Token-Anbietern routen - per Richtlinie konfigurierbar. Peak-Kapazität wird zum Marktpreis eingekauft.
Teilen Sie Ihre erwartete Nutzung mit. GEKI empfiehlt die passende Infrastruktur, KI-Modell und das Betriebsmodell.