GEKI.AI
Preise

Eine fixe Monatsgebühr. Stabile Leistung aus Ihrer KI-Fabrik.

Starten Sie auf Infrastruktur von GEKI im europäischen Rechenzentrum: Tokens, Modelle und KI-Agenten per Klick. Eine Monatsgebühr. GEKI übernimmt den Betrieb.

Keine Gebühren pro Nutzer Kein Aufschlag pro Token Eine fixe Monatsgebühr

Die Monatsgebühr deckt Inferenz, Modell-Hosting, Agenten, Monitoring und Support ab - keine Nutzer-Lizenzen, kein Token-Aufschlag. Die Rechnung wächst nicht mit jedem Nutzer oder Request. Optional: ungenutzte Kapazität verkaufen und so die Gebühr senken.

Komplett gemanagt

GEKI KI-Fabrik

Ohne Invest starten - GEKI stellt Hardware & Rechenzentrum.

Komplett gemanagt, ab 1.990 € / Monat 1× RTX 6000 Blackwell (Mini), alles inklusive - Strom, EU-Hosting, GEKI-Betrieb & kompletter KI-Stack. Größere Pakete siehe unten.

GEKI beschafft, hostet und betreibt die GPUs und den kompletten KI-Stack - Sie nutzen nur Tokens und Agenten, ohne Hardware zu kaufen oder zu betreiben.

  • Kompletter KI-Stack: Betrieb, Modelle, APIs, Agenten
  • GPUs + Hosting in der EU durch GEKI
  • Beschaffung & Kapazitätsplanung
  • Kein Hardware-Kauf, kein Ops-Team
KI-Fabriken

Aktuell verfügbare KI-Fabriken

Dedizierte GPU-Kapazität im europäischen Rechenzentrum, komplett gemanagt. Zwei Hardware-Linien, je drei Größen - anteilig 8 CPU-Kerne und 96 GB RAM je GPU.

NVIDIA RTX 6000 Blackwell

Paket Hardware VRAM Preis / Monat
Mini 1× RTX 6000 Blackwell 96 GB 1.990 €
Standard 2× RTX 6000 Blackwell 192 GB 3.980 €
Large 8× RTX 6000 Blackwell 768 GB 15.920 €

AMD Instinct MI350P

Paket Hardware VRAM Preis / Monat
Mini 1× AMD Instinct MI350P 144 GB 2.200 €
Standard 2× AMD Instinct MI350P 288 GB 4.400 €
Large 8× AMD Instinct MI350P 1.152 GB 17.600 €

Alle Preise exkl. USt. 36 Monate Mindestlaufzeit. Anteilig 8 CPU-Kerne und 96 GB RAM je GPU. Optional: Peak Capacity & Token-Verkauf.

Token-Ökonomie

Empfohlene Hardware und effektive Token-Preise.*

Pro Modell die passende Hardware, die erwartete Token-Menge pro Monat und der effektive Preis pro 1 Mio. Tokens - inkl. GEKI-Betrieb. Richtwerte bei hoher Auslastung; tatsächlich hängen Output und Kosten von Workload, Kontext und Auslastung ab.

Modell Empfohlene Hardware Tokens / Monat Effektiver Preis / 1 Mio. Tokens
Gemma 4 1× RTX PRO 6000 ca. 20 Mrd. ca. 0,10 €
Qwen 3.6 1× RTX PRO 6000 ca. 15 Mrd. ca. 0,13 €
DeepSeek V4 Flash 2× AMD MI350P auf Anfrage auf Anfrage
GLM 5.2 8× H200 ca. 9 Mrd. ca. 0,70 €

* Richtwerte auf empfohlener Hardware bei hoher Auslastung - tatsächlicher Token-Output und Kosten hängen von Workload und Setup ab.

Warum die Token-Kosten so aussehen

GEKI rechnet über die genutzte Infrastruktur, nicht über Token-Aufschläge.

Günstiger wird es, wenn Setup und Workload passen: passende GPU, passendes Modell, Routing nach Kosten und Qualität - und kein Frontier-Modell, wo ein offenes Modell reicht.

Optionale Kapazitäts-Services

Optional zu jeder KI-Fabrik.

Token-Verkauf ungenutzter Kapazität

Wenn Ihre dedizierte GPU-Kapazität nicht voll genutzt wird, kann GEKI ungenutzte Kapazität optional als Tokens am Spotmarkt verkaufen. Ihre eigenen Workloads haben immer Priorität; Spotmarkt-Traffic läuft nur auf freier Kapazität und wird verdrängt, sobald Ihr Bedarf steigt. Der Erlös aus verkaufter Kapazität wird zwischen GEKI und dem Kunden geteilt.

Peak-Kapazitäts-Management

Übersteigen Ihre Workloads temporär die dedizierte Kapazität, kann GEKI Lastspitzen optional zu geprüften europäischen Token-Anbietern routen - per Richtlinie konfigurierbar. Peak-Kapazität wird zum Marktpreis eingekauft.

Preise für Ihren KI-Workload

Sagen Sie uns, was Sie betreiben wollen.

Teilen Sie Ihre erwartete Nutzung mit. GEKI empfiehlt die passende Infrastruktur, KI-Modell und das Betriebsmodell.