Gründer · Platform & Observability Engineer

Mehrshad Lotfi.

Ich helfe Teams, Kubernetes-Plattformen beobachtbar, zuverlässig und kosteneffizient zu betreiben.

Grafana Champion und Kubestronaut mit Forschungshintergrund im Cloud-Networking. Ich konzipiere und betreibe den Grafana-LGTM-Stack, Prometheus und OpenTelemetry auf Kubernetes und mache Monitoring zu Code, den Ihr Team selbst pflegen kann.

Frankfurt am Main · remote oder vor Ort im Umkreis von 250 kmVerfügbar für neue Projekte
Grafana Champion 2024KubestronautUpwork Top Rated Plus
Termin buchen
Mehrshad Lotfi
KubestronautGrafana ChampionCertified Cloud Native Platform Engineering Associate
Gründer & Platform EngineerOptiop GmbH

150k $+

jährliche Cloud-Einsparung für einen Kunden

~20 %

geringere Cloud-Kosten nach dem Wechsel von CloudWatch

15+

Cloud-native-Zertifizierungen

100 %

Job Success Score auf Upwork

Unternehmen, mit denen ich gearbeitet habe.

Von Börse und Banken über Forschung bis zu wachsenden SaaS-Teams


Deutsche Börse
Software- / DevOps-Engineer
dwpbank
Monitoring & Alerting
MPI-SWS
Max-Planck-Institut für Softwaresysteme
REDCap Cloud logo
Gesundheitswesen
Cequens logo
Cloud-Kommunikation
Patstown logo
Technologiepartner
Scope ICT logo
ICT-Lösungen

Ausgewählte Projekte.

Was ich gebaut habe und was es für die Teams verändert hat


Healthcare-SaaS · über Optiop2025

150k $+

Einsparung pro Jahr

Von CloudWatch zum Grafana-LGTM-Stack

CloudWatch-basiertes Logging, Metriken und Tracing durch einen selbst betriebenen Stack auf Kubernetes ersetzt: Loki für Logs, Tempo für Traces und Cortex für Langzeitmetriken, visualisiert in Grafana und instrumentiert mit OpenTelemetry.

  • Cloud-Kosten des Kunden um rund 20 % gesenkt, mehr als 150.000 $ pro Jahr
  • Logs, Metriken und Traces an einem Ort, um Vorfälle schneller zu analysieren
  • Ausgerollt mit Helm und ArgoCD, jede Änderung wird in Git geprüft
GrafanaLokiTempoCortexOpenTelemetryAWSArgoCD
E-Commerce & Gesundheitswesen · über Optiop2025 – heute

Dedizierte Monitoring-Plattform mit SSO

Dedizierte Monitoring-Cluster aufgebaut, die unabhängig von den überwachten Workloads laufen und mit Helm und ArgoCD ausgerollt werden. Dashboards und Alarmregeln liegen als Code in Git, der Zugriff läuft über Single Sign-on.

  • Alerts und Dashboards als Code, versioniert und geprüft wie Anwendungscode
  • SSO mit Azure Entra ID und Keycloak, abgebildet auf Teamrollen
  • Monitoring bleibt verfügbar, auch wenn Produktionscluster gestört sind
KubernetesHelmArgoCDPrometheusGrafanaKeycloakEntra ID
Plattform-Teams · über Optiop2025

Kosten- und Delivery-Transparenz mit OpenCost & DORA

OpenCost eingeführt, um Kubernetes-Kosten nach Team und Workload aufzuschlüsseln, sowie DORA-Metriken, um zu messen, wie schnell und sicher Teams ausliefern.

  • Kosten-Dashboards pro Namespace und Team in Grafana
  • Deployment-Frequenz, Lead Time, Change Failure Rate und MTTR automatisch erfasst
  • Gemeinsame Zahlen für Gespräche zwischen Engineering und Management
OpenCostPrometheusGrafanaKubernetesDORA
Deutsche WertpapierService Bank (dwpbank)

Monitoring und Alerting für Microservices im Bankenumfeld

Als DevOps-Engineer Monitoring und Alerting für Microservices, Datenbanken und Kafka verbessert, mit Fokus auf handlungsrelevante Alarme und schnellere Ursachenanalyse.

  • Einheitliche Dashboards für Services, Datenbanken und Kafka
  • Alarmregeln optimiert, um Rauschen zu reduzieren und echte Vorfälle früher zu erkennen
PrometheusGrafanaKafkaMicroservicesDatenbanken
Deutsche Börse02/2023 – 07/2023

Hochperformanter Client für Cloud-Stream-Marktdaten

Einen hochperformanten Client für den Marktdatendienst Cloud Stream der Deutschen Börse entwickelt und die Migration von Workloads von AWS zu Google Cloud unterstützt.

  • Verarbeitung von Echtzeit-Marktdaten mit geringer Latenz
  • Praktische Unterstützung bei der Migration von AWS zu Google Cloud
Google CloudAWSStreamingPerformance-Engineering
Max-Planck-Institut für Softwaresysteme10/2019 – 01/2023

CPU-effiziente Netzwerk-Stacks für Cloud-Virtualisierung

Forschung daran, Netzwerkvirtualisierung in der Cloud mit weniger CPU-Zyklen zu betreiben, nah an der Hardware mit virtuellen Switches, NICs und Offloading.

  • Forschung zu CPU-effizientem Networking für Multi-Tenant-Clouds
  • Tiefes Verständnis davon, wie sich Netzwerke unter Last verhalten, das heute mein Monitoring prägt
Open vSwitchNICsPCIeFPGAC/C++

Freelance-Highlights

Eine Auswahl abgeschlossener Projekte auf Upwork

Echtzeit-Alarme für eine Krisenmanagement-Anwendung

Echtzeit-Alerting und Benachrichtigungen auf Basis von Grafana-Dashboards und Loki-Abfragen.

GrafanaLokiAlerting

Grafana-Cloud-Monitoring für Netzwerkgeräte

Monitoring von Netzwerkgeräten mit Grafana Cloud, von der Datenerfassung bis zu den Dashboards.

Grafana CloudNetworking

Velocity-Dashboard

Dashboard-Projekt in Grafana, vollständig umgesetzt und vom Kunden mit fünf Sternen bewertet.

GrafanaDashboards

Monitoring für AWS-Infrastruktur und Anwendungen

Durchgängiges Monitoring für AWS-Infrastruktur und die darauf laufenden Anwendungen.

AWSGrafanaPrometheus

Erfahrung.


  1. 2025 – heute

    Gründer & Platform Engineer

    Optiop GmbH

    Beratung zu Observability, Platform Engineering und Kubernetes für Teams im Gesundheitswesen und E-Commerce.

  2. 08/2023 – heute

    Freiberuflicher DevOps- & Site-Reliability-Engineer

    Selbstständig

    Observability- und Kubernetes-Projekte für Kunden in Deutschland und weltweit, auch über Upwork.

  3. 02/2023 – 07/2023

    DevOps-Engineer

    Deutsche Börse

    Client für Cloud-Stream-Marktdaten und Migration von AWS zu Google Cloud.

  4. 10/2019 – 01/2023

    Wissenschaftlicher Mitarbeiter

    Max-Planck-Institut für Softwaresysteme

    CPU-effiziente Netzwerk-Stacks für Netzwerkvirtualisierung in der Cloud.

Ausbildung

  • M.Sc. Informatik

    Universität des Saarlandes & Max-Planck-Institut für Softwaresysteme

  • B.Sc.

    Sharif University of Technology

Sprachen

Deutsch (verhandlungssicher)Englisch (verhandlungssicher)Persisch (Muttersprache)

Zertifizierungen.

Verifizierte Nachweise in Kubernetes, Observability und Platform Engineering


Machen wir Ihre Plattform beobachtbar.

Erzählen Sie mir von Ihrem Stack und Ihren Zielen. In einem kostenlosen Erstgespräch schauen wir, wo sich Monitoring, Zuverlässigkeit oder Cloud-Kosten verbessern lassen.

mehrshad.lotfi@optiop.org