Cloud Adoption & Infrastructure Automation

Agentic AI Platform on STACKIT with Kubernetes

Cloud Adoption & Infrastructure Automation

Motivation

Für die meisten Organisationen liegt die Herausforderung bei generativer und agentenbasierter KI nicht mehr in der Prototyping-Phase, sondern vielmehr darin, die Technologie zuverlässig in großem Maßstab zu betreiben und dabei die Datenhoheit zu wahren. Zugangsdaten werden teamübergreifend dupliziert, die Nutzung von Modellen lässt sich nicht ihrer Quelle zuordnen, jeder Agent integriert seine eigenen Tools, und die Bereitstellungspraktiken unterscheiden sich von Projekt zu Projekt. Wo regulatorische oder hoheitsrechtliche Anforderungen gelten, wirft die Weiterleitung sensibler Eingabeaufforderungen über externe LLM-APIs weitere Bedenken auf.

Dieses Angebot schafft eine auf STACKIT basierende, regulierte Plattform als „Sovereign Cloud“, die sicherstellt, dass Daten und KI-Workloads unter deutscher Rechtshoheit bleiben. Ein zentrales KI-Gateway bietet einen zentralen Zugang zu allen Modellen (ob von STACKIT verwaltet oder selbst gehostet) sowie zu den regulierten MCP-Tool-Servern. Das bedeutet, dass Zugriffskontrollen, Budgets und Sicherheitsgrenzen zentral und nicht projektbezogen durchgesetzt werden können.

Was wir mitbringen

Mit mehr als zwei Jahrzehnten Erfahrung in den Bereichen Unternehmenssoftwareentwicklung, Cloud-native Architektur und Kubernetes-Betrieb ist PRODYNA bestens aufgestellt, um Ihr Unternehmen zu unterstützen. Wir bieten eine geregelte, skalierbare Agentic-KI-Plattform, die auf standardisierten Open-Source-Technologien der Enterprise-Klasse basiert.

  • Ein zentrales Open-Source-KI-Gateway (AgentGateway) für einen einheitlichen, OpenAI-kompatiblen Zugriff auf von STACKIT verwaltete und selbst gehostete Modelle mit Single Sign-On, RBAC auf Gruppenebene, Anmeldedaten-Einbindung, Token-Budgets, Sicherheitsvorkehrungen und Kostenzuordnung auf Agentenebene
  • Ein verwaltetes MCP-Gateway, das als Schnittstelle zu den Tool-Servern des Model Context Protocol dient und über eine gemeinsame Authentifizierung, eine servereigene Autorisierung sowie ein Self-Service-Register verfügt, sodass Agenten nur die Tools erkennen, zu deren Nutzung sie berechtigt sind
  • Eine einsatzbereite Chat-Benutzeroberfläche (LibreChat) mit Single Sign-On, benutzerspezifischen Menüs, Token-Kontingenten und MCP-Tools im Chat
  • Ein GitOps-basierter Bereitstellungs-Workflow (CI/CD, gehärtete Container-Images und ArgoCD) für Bereitstellungen ohne Ausfallzeiten
  • Integrierte Observability mit dem Grafana-Stack: Prometheus-Metriken, Grafana Tempo (optional Langfuse) für die Verfolgung verteilter LLMs und Agenten sowie vorgefertigte Dashboards für Nutzung, Kosten und Budgets
  • Optionale, selbst gehostete LLMs auf Kubernetes (vLLM) können wahlweise über KServe verwaltet werden
  • Praktische Unterstützung: Wir entwickeln die ersten KI-Agenten gemeinsam mit Ihrem Team

Was Sie brauchen

Um dieses Angebot optimal nutzen zu können und einen schnellen und effizienten Start zu ermöglichen, benötigen Sie:

  • Eine STACKIT-Organisation + Stiftung (Landezonen)
  • Verfügbarkeit Ihrer Experten (z. B. Plattform, Netzwerk, IAM, Sicherheit)
  • Eine kleine Gruppe motivierter IT-Kollegen, die als Early Adopters eingebunden werden sollen

Was Sie bekommen

Kubernetes-Einrichtung

(2 Wochen)

  • Einen produktionsreifen Kubernetes-Cluster bereitstellen (Control Plane, Knotenpools, optionale GPU-Knoten)
  • Ingress/Gateway, Geheimnismanagement (Vault), Speicher und Netzwerkrichtlinien konfigurieren
  • Einführung eines Basis-Sicherheits- und Isolationsmodells für die Plattform

Ergebnisse

  • Ein gesicherter Kubernetes-Cluster, der für den Betrieb der KI-Plattform bereit ist
  • Wiederverwendbare Terraform-Module für den Clusterbetrieb
Mehr lesen

KI-Plattform (MVP)

(4–6 Wochen)

  • SSO und Identitätsmanagement (OIDC) einrichten: JWT-Authentifizierung und gruppenbasierte RBAC
  • Stellen Sie das LLM-Gateway (agentgateway) bereit: einheitlicher Modellzugriff, Einbindung von Upstream-Anmeldedaten, Token-Budgets, Sicherheitsvorkehrungen und Kostenverfolgung pro Benutzer/Agent
  • Bereitstellung des MCP-Gateways: regulierte Model Context Protocol-Toolserver mit servereigener Autorisierung und einer Self-Service-Registrierung
  • Stellen Sie die Chat-Benutzeroberfläche (LibreChat) mit SSO, benutzerspezifischen Menüs und MCP-Tools im Chat bereit
  • Observability implementieren: Grafana Tempo (LLM & Agent-Tracing) mit dem Prometheus/Grafana-Stack (Metriken, Dashboards und Protokolle)
  • Optional: selbst gehostete LLMs beliebiger Größe auf GPU-Knoten, z. B. mit vLLM/SGLang (optional über KServe)

Ergebnisse

  • Betrieb der Agentic AI Platform mit geregeltem Zugriff auf Modelle und Tools (SSO + RBAC)
  • Zentrale Kostenkontrolle, Token-Budgets und vollständige Transparenz
Mehr lesen

Bereitstellung des GitOps-Agenten

(4 Wochen)

  • Implementieren Sie die Agent-Vorlage „Golden Path“ (OpenAI-kompatibler Dienst, agent.yaml) – jeder Agent wird automatisch vom Gateway bereitgestellt und übernimmt SSO, RBAC, Budgets, Sicherheitsgrenzen und Tracing.
  • Einrichtung von CI/CD-Pipelines, einer Container-Registry und der ArgoCD-GitOps-Synchronisierung
  • Entwickeln Sie die ersten Agenten und MCP-Tool-Server gemeinsam mit Early Adopters.
  • Wissenstransfer und Dokumentation zur Einarbeitung

Ergebnisse

  • Reproduzierbarer Self-Service-Onboarding-Prozess
  • Erster KI-Agent läuft
  • Das interne Team ist nun in der Lage, weitere Anwendungsfälle zu integrieren
Mehr lesen

Fakten im Überblick

  • Dauer: ca. 10–12 Wochen, je nach Anwendungsfall und Clusterkonfiguration
  • Ergebnisse: Plattform mit Gateway und Observability, erste KI-Agenten, Team-Befähigung

Benefits

  • Von Grund auf souverän: Läuft auf Kubernetes auf STACKIT, wodurch Daten und KI-Workloads unter deutscher Rechtshoheit bleiben
  • Vorhersehbare Kosten: Hosten Sie Open-Weight-Modelle selbst auf Ihrer eigenen GPU-Kapazität, anstatt dynamische Preise pro Token zu zahlen
  • Self-Service für Entwickler: Eine vorgefertigte „Golden Path“-Vorlage ermöglicht die Bereitstellung von KI-Anwendungen innerhalb weniger Tage – auch ohne fundierte Kubernetes-Kenntnisse
  • Vom ersten Tag an integriert: Gateway, SSO und RBAC, Kostenverfolgung, Schutzmechanismen und Beobachtbarkeit sind in jedem Agenten integriert
  • Bewährte Grundlage: Standard-Open-Source-Lösung für Unternehmen mit praxisorientierter Unterstützung

Wie können wir helfen?

Nehmen Sie Kontakt mit unserem Team auf

Lukas Wolter, Lead Architect und Matthias Hauber, Cloud Architect
Kontakt aufnehmen
schwarzer Pfeil rechtsGrüner Pfeil rechts
Daten und KI, Daten & KI, Daten, KI
Dies ist ein "Zurück zum Anfang" Button