GEKI.AI
Preise

Eine fixe Monatsgebühr. Stabile Leistung aus Ihrer KI-Fabrik.

Starten Sie auf Infrastruktur von GEKI im europäischen Rechenzentrum: Tokens, Modelle und KI-Agenten per Klick. Eine Monatsgebühr. GEKI übernimmt den Betrieb. Optional auch mit eigenen GPUs.

Keine Gebühren pro Nutzer Kein Aufschlag pro Token Eine fixe Monatsgebühr

Die Monatsgebühr deckt Inferenz, Modell-Hosting, Agenten, Monitoring und Support ab - keine Nutzer-Lizenzen, kein Token-Aufschlag. Die Rechnung wächst nicht mit jedem Nutzer oder Request. Optional: ungenutzte Kapazität verkaufen und so die Gebühr senken.

Eigene GPUs, betrieben von GEKI

Ihre Hardware, betrieben von GEKI.

Komplett gemanagt, ab 360 € / GPU·Monat pro GPU, die Sie einbringen - Tokens & Agenten inklusive

Sie besitzen oder leasen bereits GPUs? GEKI macht daraus eine gemanagte KI-Token-Fabrik - Tokens, Modelle und Agenten inklusive, ohne eigenes Ops-Team.

  • GPU-Betrieb & Wartung
  • KI-Inferenz-Ebene & Modell-Hosting
  • OpenAI-kompatibler API-Zugang
  • Monitoring, Routing & Auslastungsoptimierung
  • Support + optionale Agent-/Anwendungsebene
Komplett gemanagt

GEKI inkl. Infrastruktur

Ohne Invest starten - GEKI stellt Hardware & Rechenzentrum.

Komplett gemanagt, ab 3.900 € / Monat 2× RTX 6000, alles inklusive - Strom, europäisches Hosting, GEKI-Betriebsgebühr & kompletter KI-Stack

GEKI beschafft, hostet und betreibt die GPU und den kompletten KI-Stack - Sie nutzen nur Tokens und Agenten, ohne Hardware zu kaufen oder zu betreiben.

  • Kompletter KI-Stack: Betrieb, Modelle, APIs, Agenten
  • GPUs + Hosting in der EU durch GEKI
  • Beschaffung & Kapazitätsplanung
  • Kein Hardware-Kauf, kein Ops-Team
Token-Ökonomie

Empfohlene Hardware und effektive Token-Preise.*

Pro Modell die passende Hardware, die erwartete Token-Menge pro Monat und der effektive Preis pro 1 Mio. Tokens - inkl. GEKI-Betrieb. Richtwerte bei hoher Auslastung; tatsächlich hängen Output und Kosten von Workload, Kontext und Auslastung ab.

Modell Empfohlene Hardware Tokens / Monat Effektiver Preis / 1 Mio. Tokens
Gemma 41× RTX PRO 6000ca. 20 Mrd.ca. 0,10 €
Qwen 3.61× RTX PRO 6000ca. 15 Mrd.ca. 0,13 €
DeepSeek V4 Flash2× RTX PRO 6000ca. 20 Mrd.ca. 0,20 €
GLM 5.28× H200ca. 9 Mrd.ca. 0,70 €

* Richtwerte auf empfohlener Hardware bei hoher Auslastung - tatsächlicher Token-Output und Kosten hängen von Workload und Setup ab.

Warum die Token-Kosten so aussehen

GEKI rechnet über die genutzte Infrastruktur, nicht über Token-Aufschläge.

Günstiger wird es, wenn Setup und Workload passen: passende GPU, passendes Modell, Routing nach Kosten und Qualität - und kein Frontier-Modell, wo ein offenes Modell reicht.

Optionale Kapazitäts-Services

In beiden Modellen verfügbar.

Token-Verkauf ungenutzter Kapazität

Wenn Ihre dedizierte GPU-Kapazität nicht voll genutzt wird, kann GEKI ungenutzte Kapazität optional als Tokens am Spotmarkt verkaufen. Ihre eigenen Workloads haben immer Priorität; Spotmarkt-Traffic läuft nur auf freier Kapazität und wird verdrängt, sobald Ihr Bedarf steigt. Der Erlös aus verkaufter Kapazität wird zwischen GEKI und dem Kunden geteilt.

Peak-Kapazitäts-Management

Übersteigen Ihre Workloads temporär die dedizierte Kapazität, kann GEKI Lastspitzen optional zu geprüften europäischen Token-Anbietern routen - per Richtlinie konfigurierbar: nur EU-Anbieter, freigegebene Modelle, Budgetlimits, Latenzanforderungen, Workload-Typ und Datensensibilitätsregeln. Peak-Kapazität wird zum Marktpreis eingekauft.

Preise für Ihren KI-Workload

Sagen Sie uns, was Sie betreiben wollen.

Teilen Sie Ihre erwartete Nutzung mit. GEKI empfiehlt die passende Infrastruktur, KI-Modell und das Betriebsmodell.