
Prometheus Experten in München
, die Produktionsmetriken mit geprüften, verfügbaren Freelancern nutzbar machenBeauftrage Experten, die Prometheus-Monitoring konzipieren, zuverlässige PromQL-Abfragen schreiben, Exporter anbinden und Alertmanager in robuste Observability-Stacks integrieren. FRATCH bringt dich schnell und präzise mit geprüften, verfügbaren Freelancern zusammen.
Lerne FRATCH Experten in München kennen, die kürzlich Prometheus eingesetzt haben
Ales L.
Letzte Position:
Senior DevOps Berater (Freelance) bei European Union Agency (via IBM)
- Arbeitete als freiberuflicher Senior DevOps Consultant vor Ort für IBM bei einer Agentur der Europäischen Union in einer hochsicheren, air-gapped Umgebung mit klassifizierten Systemen.
- Leitete Automatisierungs- und DevOps-Initiativen für eine große OpenShift-Plattform (>400 Nodes) und trieb die Deployment-Effizienz, GitOps-Einführung und operative Automatisierung mit Ansible, Python und Bash voran, während die Sicherheitsanforderungen eingehalten wurden.
- Übernahm die Automatisierung von Release- und Deployment-Workflows in einer Private-Cloud-Umgebung mit 400+ OpenShift-Nodes und verbesserte dadurch die Deployment-Geschwindigkeit und Zuverlässigkeit deutlich.
- Migrierte bestehende Playbooks, Rollen und Templates von Ansible Tower zu Ansible Automation Platform (AAP), stellte die vollständige Einhaltung von Fully Qualified Collection Names (FQCN) sicher und bereitete eigene Execution Environments (EE) für containerisierte Automatisierung vor.
- Implementierte den GitOps-Agent für AAP Controller Configuration as Code und ermöglichte damit die automatische Synchronisierung (CRUD) von Ansible-Controller-Objekten auf Basis von im Repository gespeicherten Konfigurationsdefinitionen über GitHub-Webhooks.
- Entwarf und automatisierte komplexe mehrstufige Betriebsabläufe, darunter Environment Cleanup, die Neuerstellung von Helix-Clusterkomponenten, Kafka-Topic-Management und das Lifecycle-Management von OpenShift-Objekten über rund 100 Umgebungen hinweg.
- Erreichte durch Automatisierungsverbesserungen über mehrere AAP-Cluster und OpenShift-Umgebungen hinweg eine Reduzierung von mehrtägigen manuellen Tätigkeiten auf weniger als wenige Stunden.
- Integrierte Ansible Automation Platform über ein Lookup-Plugin mit Thycotic (Delinea) Secret Server, um das sichere Credential-Management in automatisierten Prozessen zu verbessern.
- Verwaltete Deployment-Aufgaben, Platform-Troubleshooting und Istio-Netzwerkkonfigurationen unter Einhaltung strenger EU-PSC-Sicherheits- und Compliance-Standards.
- Arbeitete mit Infrastruktur- und Anwendungsteams zusammen, um Deployment-Prozesse zu verfeinern, Namenskonventionen zu entwickeln und die Automatisierungsabdeckung in einer air-gapped, klassifizierten Umgebung kontinuierlich zu verbessern.
Vicenco K.
Letzte Position:
ITSM Projektmanager (selbständig)
Einheitliches ITSM-Framework
- Definition eines konzernweiten ITSM-Zielbildes
- Einführung einer einheitlichen Service-Struktur über alle Fachbereiche
SLA- und OLA-Management
- Aufbau eines standardisierten SLA-Frameworks
- Definition von Serviceklassen (Business Critical, Standard, Low Priority)
- Einführung von OLAs zwischen internen Teams
- Aufbau eines aussagekräftigen SLA-Reportings
- Definition von KPI- und Service-Dashboards für Fachbereiche
Service Portfolio Management
- Definition von Servicebeschreibungen
- Ggf. Vorbereitung einer möglichen Kosten- und Leistungsverrechnung
Ticketing & Prozesse
- Incident Management
- Einheitliche Ticketkategorien
- Standardisierte Priorisierung
- Eskalationsmatrix
- Automatisierungen
- Self-Service-Optimierung
Request Fulfillment
- Servicekatalog über alle Fachbereiche
- Genehmigungsworkflows
Problem Management
- Einführung von Root-Cause-Analysen
- Known-Error-Datenbank
- Problem-Review-Prozess
Vollständiges Asset-Management-Konzept
- Hardware-Lifecycle-Management
- Software-Lifecycle-Management
- Leasing-Lifecycle
- Mobile-Device-Lifecycle
- Monitor-Lifecycle
- Telefon-Lifecycle
Prozesse
- Beschaffung
- Wareneingang
- Inventarisierung
- Zuweisung
- Rückgabe
- Entsorgung
- Leasing-Rückführung Ziel: Single Source of Truth für alle Assets
CMDB-Design
- Definition aller Configuration Items:
- Workplace
- Notebooks
- Monitore
- Mobiltelefone
- Drucker
Infrastruktur
- Server
- Firewalls
- Switches
- WLAN
- Storage
- Backup-Systeme
Cloud
- Azure-Ressourcen
- Microsoft 365
- SaaS-Dienste
Beziehungen
- User ↔ Asset
- Asset ↔ Service
- Service ↔ Infrastruktur
- Standort ↔ Asset
- Ziel: Vollständige Service-Abhängigkeiten sichtbar machen
Software Asset & Lizenz Management
- Lizenzmanagement-Konzept
- Lizenzbilanzierung
- Compliance-Reporting
- Microsoft-Lizenzmanagement
- Adobe-Lizenzmanagement
- SaaS-Management
- Vertragsmanagement
- Renewal-Management
Schnittstellen & Automatisierung Bestehende Systeme
- Workday
- Joiner
- Mover
- Leaver
TESMA
- Leasingdaten
- Vertragsdaten
Matrix42
- Asset-Synchronisation
- Benutzersynchronisation
Active Directory / Entra ID
- User Management
Microsoft 365
- Lizenzzuweisung
- Gruppenmanagement
Dormakaba
Zutrittsprozesse
Lifecycle Services
Monitoring-Plattformen
- PRTG
- Palo Alto
- Cisco
Reporting & KPI Framework
- Definition eines Management-Dashboards
- KPIs
- Ticketvolumen
- SLA-Erfüllung
- MTTR
- Erstlösungsquote
- Asset Accuracy
- Lizenz-Compliance
- Change Success Rate
- Service Availability
- Automatisierungsgrad
Netzwerk-Redesign-Begleitung
- Governance
- Begleitung des Netzwerk-Redesigns aus ITSM-Sicht
- Definition betroffener Services
- Change-Management-Struktur
- Kommunikationskonzept
CMDB-Integration
- Aufnahme aller Netzwerkkomponenten
- Service Mapping
- Abhängigkeitsanalyse
Validierung von Dokumentation und Knowledgebase-Artikeln
- Netzwerkdokumentation
- Betriebsdokumentation
- Standard Changes
Monitoring & Event Management
- Zielbild
- Zentrales Monitoring-Konzept
- Event-Management-Prozess
- Alarmierungsstrategie
- Eskalationsmodell
Systeme
Cisco
Palo Alto
Fortinet
Rubrik
Veeam
Matrix42
Azure
Microsoft 365 Automatisierung
Ticketgenerierung aus Monitoring
Eskalationen
Standardmaßnahmen
Audit, Compliance & Informationssicherheit
- ISO-27001-Beratung
- TISAX-Beratung
- NIS2-Vorbereitung - Beratung
- Auditfähige Prozesse
- Dokumentationsstruktur
- Nachweisführung in Matrix42
Roadmap
- 12-Monats-Roadmap
- Priorisierung aller Maßnahmen
- Quick Wins
- Mittelfristige Projekte
- Langfristiges Zielbild
- Dokumentation
Ljubomir O.
Letzte Position:
Senior Software Test Ingenieur bei Keil KTM GmbH
Arbeitnehmerüberlassung
- System-Black-Box-Integrationstests (BBIT, IVVQ): Durchführung von Regressions-, Freigabe-, Bestätigungs- und Konformitätstests für sicherheitskritische Bremssteuergeräte in Bahnindustrie
- Softwaretest-Applikation & Integration: Runtime-Konfiguration von Software-Komponenten und Bibliotheken, Validierung von Schnittstellen, Konfigurationsabhängigkeiten und Komponenteninteraktionen
- Testautomatisierung (FEAT-Framework): Mitentwicklung und Weiterentwicklung eines automatisierten Testframeworks für Testausführung, Reporting und Ergebnisanalyse
- Funktionale Sicherheit (SiL4, FuSi): Sicherstellung der Einhaltung von Sicherheitsanforderungen, Traceability und Coverage sowie Normkonformität gemäß EN50126/28/29
- Testautomatisierung für Kommunikationskomponenten: Konfiguration und Validierung der Feldbus-(CAN) und Ethernet-basierten TCMS Datenkommunikation-Schnittstellen (TRDP und CIP)
- Anforderungsanalyse & Shift-Left (PTC Windchill ALM): Analyse von Software- und Systemartefakten zur Identifikation von Lücken, Mehrdeutigkeiten und Redundanzen im frühen SDLC
- Testdesign & Testfallentwicklung: Ableitung von Testbedingungen, Abdeckungsstrategien und Implementierung datengetriebener Testfälle (DDT) inkl. wiederverwendbarer Testdaten-Fixtures
- CI/CD & Automatisierung (Python, PowerShell, Jenkins, SVN): Automatisierung von Build-, Test- und HIL-Deployment-Prozessen sowie Integration in CI/CD-Pipelines
- Testdaten & Konfigurationsmanagement (XML): Pflege und Anpassung von XML-Testvektoren und Systemkonfigurationen mit automatisierter Integration in Testumgebungen
- Nicht-funktionales Testen: Durchführung von Performance- und Lasttests zur Bewertung von Stabilität und Systemverhalten
- Agile Entwicklung & Defect Management (JIRA, Confluence): Mitarbeit in Scrum-Teams, Testkoordination, Review von Testartefakten sowie Defect Tracking und Root-Cause-Analyse
- Fehleranalyse & Debugging (CANoe, CANalyzer): Analyse von Fehlern und Nachrichtenflüssen über mehrere Systemebenen (Applikation bis Bus)
- Modellbasierte Analyse (UML, Enterprise Architect): Spezifikation von SUT/SOW und Unterstützung der systematischen Teststeuerung
- Prozess- & Testdokumentation: Erstellung von Integrations- und Testdokumentation gemäß internen Qualitäts- und Zertifizierungsanforderungen
Tamás E.
Letzte Position:
Senior Software Developer / Tech Lead bei NDA (Verteidigung / OSINT)
- Entwicklung des Audit-Logging-Frameworks
- Implementierung von APIs, die Entwickler in ihre Codebasen integrieren können
- Implementierung der Ingestion-Pipeline, der Datenbank-Abfrageschicht und der UI zum Durchsuchen der Audit-Events
- Verbesserung der Stabilität und Zuverlässigkeit des Backend-Systems
Ronald M.
Letzte Position:
DevOps Consultant bei M.it services & systems GmbH
- Anpassung, Optimierung, Konfiguration und Administration einer Multi-Stage-GitLab-Instanz mit über 250 Usern
- Aufbau, Anpassung, Erweiterung und Optimierung von Infrastruktur, Konfiguration und Monitoring
- Bereitstellung von Services sowie Übergabe an die Produktion
- Systemumgebung: DependencyTrack, GitLab, Grafana, Hedgedoc, Kubernetes, Oauth2 Proxy, Openstack, Prometheus, Syseleven
Alexandru G.
Letzte Position:
Principal Cloud DevOps Architect bei BP
In meiner Rolle als Senior Cloud DevOps Architect bei BP, einem Öl- und Gasunternehmen, hatte ich die Aufgabe, die Plattform für das Laden von Elektrofahrzeugen der EV Division von On-Premises und Azure in die AWS-Cloud zu migrieren, was zu einer hybriden Multi-Cloud-, Multi-Tenant-SaaS-Lösung führte.
Der Einsatz von Kubernetes für die Anwendungsebene bedeutete die Bereitstellung von Kubernetes-Clusters, die von EKS und AKS verwaltet wurden, mit Fokus auf die Integration in eine Multi-Tenant-Umgebung. Diese Integration wurde durch den Einsatz von Kubernetes-Namespace und Zugriffskontrollen erreicht, um Datenisolation und Datenschutz sicherzustellen.
Auf der Datenbankebene entschieden wir uns für eine RDS-Instanz mit PostgreSQL zur Unterstützung der Backend-Infrastruktur unserer Anwendungen. Die Mandanten teilten sich dieselbe RDS-Instanz, hatten aber jeweils ein eigenes Schema.
Um nahezu in Echtzeit Daten von physischen Ladestationen (CPOs) als IoT-Geräte über das OCPI-Protokoll aufzunehmen, stießen wir bei der Batch-Verarbeitung auf erhebliche Verzögerungen. Daher entwickelten wir eine Streaming-Datenpipeline in Echtzeit mit Apache Kafka und setzten dabei auf eine eventgetriebene Architektur.
Ich leitete die Zusammenarbeit über mehrere interne Teams, externe Anbieter, Cloud-Provider und Partner vor Ort hinweg, um über fünf Systeme in eine einheitliche Lösung zu integrieren.
Erfolge:
- Erfolgreich hybride Multi-Cloud-Lösungen entworfen und umgesetzt, die mehrere Cloud-Plattformen (AWS, Azure) mit On-Premises-Infrastruktur unter Einsatz von Site-to-Site-VPNs, Firewalls und Load Balancing integrierten.
- Die Migration der On-Premises-Infrastruktur zu einer Multi-Cloud-, Multi-Tenant-Infrastruktur geleitet, was zu 30 % schnelleren Verarbeitungszeiten führte.
- Workloads aus VMware- und Hyper-V-Umgebungen auf cloudbasierte VMs migriert und dabei Cloud-native Services genutzt, um Leistung, Kosteneffizienz und Skalierbarkeit zu optimieren.
- Eine Multi-Tenant-Kubernetes-Plattform entworfen, die das Kubernetes-Ökosystem nutzt, mit Karpenter für die dynamische Bereitstellung von EC2-Nodes, KEDA für eventgesteuertes Pod-Autoscaling (z. B. Kafka-Message-Lag) und Rancher für das zentrale Monitoring mehrerer Cluster (EKS, AKS oder On-Prem K8s), als Ersatz für den Microsoft-zentrierten Azure-Arc-Management-Service.
- Python-basierte FastAPI-Microservices als Teil des EV-Core-Backends auf der AWS-EKS-Anwendungsebene entworfen und umgesetzt, die Datenaufnahme- und Kundenanalyse-Pipelines antreiben.
- Asynchrone, eventgetriebene APIs (Python-FastAPI) für die Echtzeit-Integration mit CPOs entwickelt, mit Unterstützung für OCPI 2.3 und OICP-Protokolle.
- Eine sichere, produktionsreife Azure-Databricks-Plattform mit Terraform entworfen und umgesetzt und dabei Skalierbarkeit und Kosteneffizienz sichergestellt.
- On-Premises-ERP auf eine hybride Dynamics-365-Architektur migriert, mit ERP lokal gehostet und CRM in Azure betrieben, integriert über Azure Arc.
- CI/CD-Pipelines für Databricks-Notebooks und Jobs mit GitHub Actions und Databricks CLI automatisiert, wodurch die Bereitstellungszeit reduziert wurde. Die Bereitstellungszeit für Infrastruktur durch Automatisierung der Cloud-Ressourcenbereitstellung mit GitOps um 70 % reduziert.
- Die Einhaltung interner Audit- und Data-Governance-Standards (GDPR) durch OAuth2/OIDC-basierte Authentifizierung und fein abgestufte rollenbasierte Zugriffskontrollen sichergestellt.
- Ein Zero-Trust-Sicherheitsmodell entwickelt, das Least-Privilege-Zugriffe und Mikrosegmentierung durchsetzt und die Sicherheitslage sowie die Compliance mit GDPR und NIST verbessert.
- Interaktive Analytics-Dashboards in Amazon QuickSight erstellt, die Daten aus S3 und Redshift integrieren, um Echtzeit-Business-Insights und Visualisierungen mit eingebettetem Zugriff für Multi-Tenant-Nutzer bereitzustellen.
- Cloud-Sicherheitsbewertungen und eine Sicherheitsintegration über den gesamten Lebenszyklus während M&A geleitet, einschließlich AWS, Azure, IAM (Entra ID) und Datenschutz, und dabei die Sicherheitslage mit NIST, ISO 27001 und GDPR über hybride und cloud-native Umgebungen hinweg ausgerichtet.
- Die Cloud-Kosten für eine Dev-Umgebung eines Kunden um 64 % gesenkt, indem automatisierte Start-/Stopp-Zeitpläne für EC2- und RDS-Instanzen über AWS CDK mit EventBridge Scheduler oder AWS Systems Manager implementiert wurden.
Tech-Stack:
- Infrastructure as Code: Terraform, AWS CDK, Ansible.
- Container: Kubernetes auf EKS, AKS, Docker.
- Streaming-Datenverarbeitung: Kafka zu Confluent Cloud, nach AWS MSK.
- Frontend: TypeScript, React, NextJS, Hooks, Styled Components.
- Backend: Python mit FastAPI, außerdem Node.js mit NestJS.
- Datenbank: Aurora auf PostgreSQL mit TypeORM, RDS auf SQL Server, vollständiges Setup und Administration von Azure Databricks, ETL-Pipelines.
- CI/CD und GitOps: GitHub Actions, Azure DevOps, ArgoCD.
- Monitoring und Observability: Prometheus und Grafana.
- Virtualisierung: Hyper-V, VMware Cloud on AWS, Azure Migrate.
- ERP-Systeme: Odoo, Microsoft Dynamics 365 Business Central auf Azure, integriert mit Azure Arc.
- Netzwerke: Site-to-Site-VPNs, AWS Direct Connect, Azure ExpressRoute, Firewalls (AWS Network Firewall, Azure Firewall).
- Sicherheit: IAM, NIST Framework, Zero-Trust-Sicherheit, AWS WAF, AWS Shield, GuardDuty.
Thomas H.
Letzte Position:
Senior MLOps-, DevOps Engineer bei Trianel Energy
- Aufbau und Betrieb einer End-to-End-MLOps-Plattform auf Azure ML und Kubernetes (Kubeflow) zur automatisierten Bereitstellung, Überwachung und Skalierung von Forecasting-Modellen (u. a. Temporal Fusion Transformer, Informer, Autoformer).
- Implementierung von CI/CD-Pipelines in Azure DevOps für den vollständigen ML-Lifecycle – von Ressourcbereitstellung (Terraform), Datentransformation (Hugging Face Datasets, Pandas, PyTorch, CUDA-Cluster) über Training und Evaluation bis hin zu Model Registry und Endpoint-Deployment.
- Integration von MLflow für Experiment-Tracking, Modellversionierung, Performance-Monitoring und automatisierte Registrierung in der Azure Model Registry.
- Entwicklung und Containerisierung von PyTorch-Trainingsjobs (Azure Notebook, Jupyter Notebooks) für Preis- und Zeitreihenprognosen (PFC-Modelle) mit automatischem Rollout über Azure ML Endpoints und REST/gRPC-Schnittstellen, Docker-Containerisierung, Absicherung über OAuth 2.0.
- Einrichtung von Monitoring- und Alerting-Mechanismen (Prometheus, MLflow Metrics), Log-Zentralisierung und Kostenüberwachung.
- Automatisierung der Infrastruktur-Bereitstellung und Modellbereitstellung mittels Terraform, Helm und Azure CLI; Anbindung an bestehende Marktdatensysteme und Event-Pipelines.
- Migration bestehender Workloads und Datenbanken (IONOS → Azure, MongoDB) mit Integration in zentrale MLOps-Workflows und interne Netzwerke.
- Erweiterung der Plattform um LLM-basierte Tools (LangChain, LangServe) zur Integration von GPT-basierten Analysemodulen in bestehende Spring-Boot-Dienste für Marktanomalie-Erkennung und automatisierte Reports.
- Analyse, Architektur einer Softwarelösung zur effizienten Verarbeitung von Massendaten (>3000 Nachrichten/Sek.) (Market Data Store).
- Spring Boot / Java 21 Container-Entwicklung mit RabbitMQ zur Verteilung von Börsendaten über MongoDB (Kubernetes) mit Schnellspeicherung von Daten in Redis RMaps, Deduplizierung und Weiterleitung von Nachrichten an Read-Model-Queues, Aufbau von Read Models für die UI-Anzeige in MongoDB.
- Einbindung von RESTHeart zur Erzeugung einer REST API gegen MongoDB.
- Aufbau eines Angular-Frontends zur Vereinfachung der Datenabfrage und Stammdatenpflege.
- Agentic Coding mit remote und local LLM (Claude Sonnet, Ollama Qwen) und MCP-Servern.
- Entwicklung von Python-Skripten zur Transformation und Bereinigung eingehender Börsendaten (Pandas, scikit-learn).
Damian Ś.
Letzte Position:
CTO bei FRATCH.IO
- Produktentwicklung von Anfang bis Ende geleitet und die erfolgreiche Lieferung technischer Lösungen verantwortet.
- Ein Team hochspezialisierter technischer Experten geführt und begleitet und eine Kultur der Zusammenarbeit und Innovation gefördert.
- Den Einstellungsprozess gesteuert, um ein talentiertes und engagiertes Team aufzubauen.
- Ein skalierbares und robustes Backend-Microservices-System von Grund auf aufgebaut, entworfen und weiterentwickelt, um sich ändernde Geschäftsanforderungen zu erfüllen.
- Die hohe Verfügbarkeit des Systems mit 99,99 % Uptime sichergestellt und dafür eine belastbare Architektur sowie Monitoring-Mechanismen implementiert.
- Technische Strategien entwickelt und umgesetzt und sie an den Geschäftszielen und -vorgaben ausgerichtet.
Frank E.
Letzte Position:
DevOps bei Lauck-IT
Betrieb und Erweiterung von Azure DevOps-Pipelines
Betrieb und Erweiterung von AWS-Services
Citrix (Windows 10, Bitwarden)
AWS: ECR, EKS, CloudFront CDN, Route 53, VPC Peering und CNI-Upgrade, Atlas MongoDB, S3-Buckets, Hosting statischer Websites
Azure: Build und Deployment mit DevOps-Pipelines
Serge K.
Letzte Position:
MLOps (machine learning operations) bei REWE Digital GmbH
- Es ist wie ein Start-up innerhalb von REWE, wo wir ein neues Forecasting-System auf der Google Cloud Platform von Grund auf aufbauen müssen. Offiziell heißt meine Rolle zwar MLOps, aber zu meinen tatsächlichen Aufgaben gehören auch die Entwicklung von Datenverarbeitungspipelines (Data Engineering) und Aufgaben von Data Scientists wie Feature Engineering und Modelltraining.
- GCP: Terraform (tofu), Vertex AI (Kubeflow), Cloud Run, IAM, Google Cloud Storage, BigQuery, Artifact Registry
- Data Engineering: Snowflake als zentrales Data Warehouse, Terraform, DBT für die Umsetzung von Datenmodellen
- CI/CD: GitLab. Wir haben eine CI/CD-Pipeline aufgebaut, die Deployments neuer Releases bis in die Produktionsumgebung automatisiert
Eli R.
Letzte Position:
Technical co-founder bei AskTheLaws
- Aufbau eines KI-Rechtsassistenten mit modernen ML-Fähigkeiten.
- Implementierung einer RAG-Architektur mit Datenpipelines für die Suche in Rechtsdaten.
- Einsatz von AWS Bedrock für LLM- und Embedding-Modelle sowie LangChain/LangGraph
- Python mit FastAPI für das Backend und React für das Frontend
Vitaliy R.
Letzte Position:
DevOps GitOps (ANÜ) bei Signal Iduna
- Verantwortlich für die Administration von OpenShift/Kubernetes On-Prem und den Entwickler-Support.
- Automatisierte die URP-Infrastruktur mit Python, Ansible, Kustomize sowie dem ArgoCD- und Argo Workflow/Events-Stack.
- Schrieb Smoke- und Lasttests für die URP-Infrastruktur mit Python, Kustomize und ApplicationSets.
- Unterstützte beim Aufbau und der Bereitstellung der URP-Infrastruktur in Google Cloud (GKE).
- Implementierte Monitoring für die URP- und ArgoCD-Umgebung mit Splunk Cloud.
- Führte Systemadministrationsaufgaben auf RedHat Linux, Kubernetes/OpenShift, ArgoCD, GitLab, Bitbucket Enterprise, Kafka und MongoDB durch.
Frederik C.
Letzte Position:
Freiberuflicher Fullstack Softwareentwickler bei Bundesdruckerei GmbH
Entwicklung des digitalen Organspenderegisters, beauftragt durch das Bundesinstitut für Arzneimittel und Medizinprodukte (BfArM)
Umsetzung von User Stories in mehreren Microservices (Front- und Backend)
Sicherstellung der Qualität mit Unit-, Integrations- und E2E-Tests
Durchführung von Code-Reviews
Abstimmung mit anderen Entwicklungsteams
Übernahme der Softwarelizenzprüfung und Vereinfachung des Prozesses
Verantwortung für die Umsetzung und Dokumentation des fachlichen Loggings
Aufbau einer Entwicklungsumgebung mit Docker Compose
Tobias N.
Letzte Position:
Enterprise- und Solutions-Architekt
- Aufbau einer eigenständigen Unternehmens-IT — Cloud-Strategie, Netzwerk, AWS Landing Zone, Sicherheitsanforderungen, Vertragsverhandlungen.
- Migration aller Anwendungen; Vermeidung hoher Vertragsstrafen für den Kunden.
- Onboarding und Steuerung inte...
Stephan B.
Letzte Position:
Freiberuflicher Data Scientist bei Baier Data & AI Consulting
Entdecke mehr als 15.000 Top-Freelancer
Statistiken von Experten, die Prometheus einsetzen
Aggregiert aus den beruflichen Profilen passender Freelancer.
Berufserfahrung
21 Jahre (Deutschland: 17 Jahre)

Positionsdauer
2,2 Jahre (Deutschland: 1,9 Jahre)

Positionen pro Freelancer
11 (Deutschland: 12)

Häufigste Fachbereiche
Informationstechnologie (IT), Produktentwicklung, Betrieb

Häufigste Branchen
Informationstechnologie (IT), Bank- und Finanzwesen, Automotive

Fokus der Zertifizierungen
Informationstechnologie (IT), Produktentwicklung, Business Intelligence
Bachelor-Abschluss oder höher
92% (Deutschland: 89%)
Master-Abschluss oder höher
60% (Deutschland: 53%)
Doktortitel
20% (Deutschland: 10%)

Zertifizierungen pro Freelancer
3

Häufigste Sprachen
Deutsch, Englisch, Französisch

Sprechen zwei oder mehr Sprachen
96% (Deutschland: 97%)
Basierend auf unserem Profilpool, Stand 19 Sep 2026.
Tagessatzverteilung
Das Diagramm zeigt, wie sich die Tagessätze der Freelancer in dieser Technologie in München verteilen, basierend auf aktuellen Verträgen auf unserer Plattform. Jeder Balken deckt eine Tagessatzspanne ab – seine Höhe zeigt, wie viele Freelancer innerhalb dieser Spanne abrechnen.
Durchschnittssätze von Experten in München, die Prometheus einsetzen
Die Tagessätze basieren auf aktuellen Verträgen und enthalten keinen FRATCH-Aufschlag.
Der durchschnittliche Tagessatz ist der Mittelwert aller Tagessätze aus aktuellen Verträgen vergleichbarer Freelancer auf unserer Plattform.
Der Median-Tagessatz ist der mittlere Wert aller Tagessätze – die Hälfte der vergleichbaren Freelancer verlangt weniger, die andere Hälfte mehr. Anders als der Durchschnitt wird er von Ausreißern kaum beeinflusst.
Berechnet auf Basis der Tagessätze unserer Freelancer, Stand 19 Sep 2026. Die tatsächlichen Tagessätze können je nach Dienstalter, Erfahrung, Fachkenntnissen, Projektkomplexität und Auftragsdauer variieren.
Branchenfokus der Prometheus Experten
Sieh, in welchen Branchen unsere gematchten Freelancer am häufigsten tätig sind — jede Zahl wird live aus den Freelancern auf FRATCH berechnet.
- Informationstechnologie (IT) (96%)
- Bank- und Finanzwesen (50%)
- Automotive (46%)
- Fertigung (39%)
- Einzelhandel (39%)
- Versicherung (36%)
- Medien, Unterhaltung und Druck (32%)
- Bildung (29%)
Bitte beachte, dass Freelancer in mehreren Branchen tätig sein können, daher überschneiden sich die Prozentwerte.
Über die Technologie
Metriken und Monitoring
Prometheus ist ein Open-Source-Monitoring- und Alerting-System, das auf Zeitreihendaten basiert. Es sammelt Metriken, indem es HTTP-Endpunkte abruft, speichert sie mit Labels und wertet PromQL-Abfragen für Dashboards, Alarme und operative Analysen aus. Unternehmen nutzen es, um Services, Container, Hosts und geschäftsrelevante Signale zu überwachen.
Zentrales Ökosystem
Das Prometheus-Ökosystem umfasst Exporter für Infrastruktur und Anwendungen, Alertmanager zum Weiterleiten und Gruppieren von Alarmen sowie Client-Bibliotheken zur Instrumentierung von Services. Gute Spezialisten arbeiten außerdem mit Grafana, Kubernetes, Service Discovery, Recording Rules und Optionen für die Langzeitspeicherung wie Thanos oder Cortex-kompatiblen Systemen.
Typische Aufgaben in Projekten
Prometheus-Know-how kommt in Projekten zum Einsatz, die zuverlässige Transparenz über verteilte Systeme benötigen:
- Metriknamen, Labels und Sammelziele definieren
- Services mit geeigneten Client-Bibliotheken instrumentieren
- PromQL-Abfragen, Recording Rules und Alert Rules erstellen
- Alertmanager mit praktischen Benachrichtigungs-Workflows verbinden
- Grafana-Dashboards für Betriebs- und Produktteams erstellen
Wann Unternehmen Spezialisten beauftragen
Unternehmen holen häufig freiberufliche Expertise ins Haus, wenn das Monitoring schneller gewachsen ist als seine Standards. Warnzeichen sind unter anderem zu viele Alarme, Labels mit hoher Kardinalität, fehlende Servicemetriken, unklare Zuständigkeiten oder Dashboards, die die Reaktion auf Vorfälle nicht unterstützen. In München können Spezialisten lokale Industrie-, Software- und Digitalteams vor Ort oder remote unterstützen.
Wichtige Fähigkeiten
Gute Prometheus-Experten verstehen sowohl das Monitoring-Design als auch die gemessenen Systeme. Sie können Kubernetes-Workloads, Linux-Ressourcen, HTTP-Services, Datenbanken, Cloud-Infrastruktur und Anwendungsinstrumentierung beurteilen. Außerdem wissen sie, wie sich Abrufintervalle, Aufbewahrungsdauer, Labels und die Auswertung von Regeln auf Zuverlässigkeit und Betriebskosten auswirken.
Woran man Qualität erkennt
Ein guter Spezialist erstellt Metriken, die operative Fragen beantworten, statt einfach alles Verfügbare zu sammeln. Er hält Label-Dimensionen kontrolliert, dokumentiert den Zweck von Alarmen, testet PromQL und trennt Symptome von Ursachen. Außerdem plant er Skalierung, Federation oder Remote Write ein, wenn ein einzelner Prometheus-Server nicht mehr die passende Grenze darstellt, und erklärt Entscheidungen verständlich für Teams mit unterschiedlichen technischen Hintergründen.
Häufig gestellte Fragen
Was Kunden uns zu Prometheus am häufigsten fragen – kurz beantwortet.
Prometheus sammelt und durchsucht Zeitreihenmetriken aus Anwendungen, Infrastrukturen und Services. Unternehmen nutzen es für Dashboards, Alarmierung, Kapazitätsplanung und Fehleranalyse, häufig zusammen mit Grafana und Alertmanager.
Prometheus ist hauptsächlich ein System zur Sammlung, Speicherung und Abfrage von Metriken, während OpenTelemetry eine umfassendere Instrumentierung und Telemetriesammlung für Metriken, Traces und Logs bietet. Beide ergänzen sich häufig: OpenTelemetry kann Telemetriedaten sammeln oder weiterleiten, während Prometheus Teil des Metrik-Workflows bleibt.
Ein guter Prometheus-Spezialist versteht meist PromQL, Grafana, Alertmanager, Kubernetes und Service Discovery. Erfahrung mit Exportern, Linux, Cloud-Infrastruktur, Anwendungsinstrumentierung und Incident Response ist ebenfalls wertvoll.
Die erforderliche Tiefe hängt vom Umfang ab – von der Definition eines sauberen Metrikmodells bis zum Design eines Monitoring-Systems für mehrere Cluster. Ein kompetenter Prometheus-Experte sollte in der Lage sein, das aktuelle Setup zu prüfen, operative Risiken zu erkennen und getestete Regeln, Dashboards und Dokumentation zu liefern.
Die Arbeit mit Prometheus eignet sich gut für die Remote-Zusammenarbeit, da Konfigurationen, Abfragen, Dashboards und Infrastrukturänderungen digital geprüft werden können. Teams in München bevorzugen möglicherweise trotzdem gelegentliche Termine vor Ort für Architektur-Workshops, Incident-Reviews oder die Abstimmung mit Betriebsteams.
Prüfe, ob das Prometheus-Setup nützliche Signale mit kontrollierter Kardinalität und Alarmen erzeugt, die zu klaren Maßnahmen führen. Bitte eher um Beispiele für Metrikstandards, Regeltests, Dashboard-Design, den Umgang mit Ausfällen und Dokumentation, statt die Qualität an der Anzahl erstellter Dashboards zu messen.
Prometheus benötigt möglicherweise zusätzliche Komponenten, wenn Aufbewahrungsdauer, globale Abfragen oder eine sehr umfangreiche Federation komplex werden. Ein Spezialist sollte das Pull-basierte Modell mit Managed Monitoring, OpenTelemetry-basierten Pipelines und Systemen vergleichen, die für die Langzeit- oder regionsübergreifende Speicherung ausgelegt sind.
Ein Prometheus-Freelancer beginnt häufig mit der Qualität der Metriken, der Verwendung von Labels, der Abdeckung durch Scrapes und der Anzahl störender Alarme. Anschließend richtet er PromQL-Regeln und Grafana-Dashboards an den tatsächlichen Zielen der Services aus, damit Teams Ausfälle schneller erkennen und ihre Auswirkungen besser verstehen können.
Der durchschnittliche Stundensatz von Freelancern in München, Deutschland, die Prometheus in ihren letzten Projekten eingesetzt haben, liegt bei 98 €, was einem Tagessatz von etwa 787 € bei einem 8-Stunden-Tag entspricht.
Von den Freelancern in München, Deutschland, die Prometheus in ihren letzten Projekten eingesetzt haben, haben 92% mindestens einen Bachelor-Abschluss, 60% mindestens einen Master-Abschluss und 20% einen Doktortitel.
Freelancer in München, Deutschland, die Prometheus in ihren letzten Projekten eingesetzt haben, haben im Durchschnitt 21 Jahre Berufserfahrung; ein einzelnes Projekt dauert typischerweise etwa 2,2 Jahre.
Die häufigsten Sprachen unter Freelancern in München, Deutschland, die Prometheus in ihren letzten Projekten eingesetzt haben, sind Deutsch (96%), Englisch (93%) und Französisch (14%).
Die häufigsten Industrien unter Freelancern in München, Deutschland, die Prometheus in ihren letzten Projekten eingesetzt haben, sind Informationstechnologie (IT) (96%), Bank- und Finanzwesen (50%) und Automotive (46%).
Die häufigsten Bereiche unter Freelancern in München, Deutschland, die Prometheus in ihren letzten Projekten eingesetzt haben, sind Informationstechnologie (IT) (100%), Produktentwicklung (93%) und Betrieb (68%).
Hauptstandorte der FRATCH Experten, die kürzlich Prometheus eingesetzt haben
Unsere Freelancer und Interim-Experten sind in der gesamten DACH-Region zuhause — verfügbar vor Ort in den wichtigsten Wirtschaftszentren oder komplett remote. Wähle einen Standort und entdecke passende Spezialisten, lokale Markteinblicke und aktuelle Verfügbarkeiten.
Kostenlose Demo vereinbaren
Kontaktiere uns und das FRATCH-Team meldet sich innerhalb von 4 Stunden bei dir.
Möchtest du lieber direkt mit uns in Kontakt treten?
Wir haben immer Zeit für einen Anruf oder eine E-Mail!

Berlin
Hamburg
Köln
Frankfurt
Stuttgart
Düsseldorf