Raum München · Deutschland
Senior Linux & Observability Engineer
Enterprise-Infrastruktur · Automatisierung · Monitoring & Logging
Mehr als 23 Jahre Erfahrung im Aufbau, in der Automatisierung und im Betrieb hochverfügbarer Linux-Plattformen in Enterprise- und Behördenumgebungen. Schwerpunkte: RHEL, Ansible, Prometheus, Grafana und Elasticsearch.
Quick Facts
- 23+ Jahre Erfahrung mit Linux & Infrastruktur
- Enterprise- und Behördenumgebungen
- RHEL- und Ansible-Automatisierung
- Prometheus, Grafana und Elastic Stack
- Hochverfügbare Produktionsplattformen
- OSCP-zertifiziertes Security-Mindset
- Raum München; Remote- und Hybrid-Einsätze
- Kurzfristig für Vollzeitprojekte verfügbar
Kernkompetenzen
Drei Säulen, ein roter Faden: Linux, Automatisierung und Observability für geschäftskritische Plattformen.
Enterprise Linux & Infrastruktur
Konzeption, Betrieb und Fehleranalyse geschäftskritischer Linux-Plattformen — mit Fokus auf RHEL, Hochverfügbarkeit, Middleware, Lifecycle-Management und verlässlichen Produktionsbetrieb.
Automatisierung & zuverlässiger Betrieb
Wiederholbare Infrastruktur- und Betriebsabläufe mit Ansible, Scripting und CI/CD-Praktiken — ausgelegt auf Wartbarkeit, Nachvollziehbarkeit und stabilen Produktionseinsatz.
Observability, Monitoring & Logging
Aufbau und Weiterentwicklung von Monitoring-, Logging- und Observability-Plattformen, die Teams helfen, Probleme früh zu erkennen, Systemverhalten zu verstehen und strukturierte Root-Cause-Analysen durchzuführen.
Ausgewählte Projekte
Enterprise- und Behördenprojekte mit technischer Projekt- und Schnittstellenverantwortung.
HSE24 (Home Shopping Europe)
SRE / Technische Projektleitung Observability
Konsolidierung und Standardisierung einer unternehmensweiten Observability-Plattform. Konzeption und Weiterentwicklung von Monitoring, Logging und Dashboards mit Prometheus, Grafana und Elasticsearch sowie Koordination technischer Stakeholder und Plattformanforderungen.
MX1 Platform Services
SRE & Technische Projektleitung Observability
Einführung und Weiterentwicklung eines zentralen Open-Source-Monitoring- und Logging-Stacks. Mitarbeit an Observability-Architektur, automatisierten Deployments, Dashboards und Alerting; Mitbetreuung einer bestehenden Graylog-Umgebung und Anbindung zusätzlicher Log- und Datenquellen.
LGL Baden-Württemberg
Senior Linux & Middleware Engineer
Betrieb und Automatisierung einer hochverfügbaren Linux- und Middleware-Umgebung für Geoinformationsdienste im Behördenumfeld. Standardisierung der Serverkonfiguration und von WildFly-/JBoss-Deployments mit Ansible sowie Sicherstellung eines zuverlässigen Produktionsbetriebs und technischer Dokumentation.
Weitere relevante Erfahrung
Ergänzende Engagements in SRE, Monitoring-Migration und Infrastrukturverantwortung.
Chefkoch.de
2020 – 2021
Site Reliability & DevOps Engineer
Produktiver SRE- und DevOps-Betrieb in einer containerisierten Umgebung — Kubernetes-basierte Workloads, GitLab CI/CD, Docker und eine zentrale ELK-Logging-Pipeline zur proaktiven Fehleranalyse.
Payback
2015 – 2016
Monitoring Engineer (Migrationsprojekt)
Enterprise-Monitoring und -Logging im Migrationskontext: Automatisierung bestehender Monitoring-Setups, Migration von Icinga zu Icinga2 sowie Erweiterung des ELK- und Graphite-/Grafana-Stacks — eingebettet in Produktionsbetrieb und Troubleshooting.
Ludwig Beck
2009 – 2014
IT-Leitung / Systemadministration
Breite Infrastrukturverantwortung in der IT-Leitung: Linux-Systeme, Netzwerk, Storage, Virtualisierung und PKI. Implementierung und technische Integration einer AlienVault-SIEM-Plattform sowie Anbindung relevanter Infrastruktur- und Security-Logquellen.
Projektsued GmbH
2021 – heute
Mitgründer & CTO
Mitgründer und CTO eines operativen Unternehmens — verantwortlich für interne Linux-Infrastruktur, Proxmox, Docker-basierte Services, Ansible-Automatisierung, Monitoring, Backups und ausgewählte API-/Integrations-Workflows.
Laufende unternehmerische Tätigkeit — interne Infrastrukturverantwortung, kein externes Kundenprojekt.
Security-aware Operations
OSCP-zertifiziert, mit praktischer Erfahrung im sicheren Infrastrukturbetrieb und in der Integration von SIEM-Plattformen. Security wird dabei als betriebliche Qualität verstanden: gehärtete Systeme, kontrollierte Zugriffe, nachvollziehbare Änderungen, verlässliches Logging und transparente Incident-Daten.
- OSCP-Zertifizierung (Offensive Security Certified Professional)
- AlienVault-SIEM-Implementierung bei Ludwig Beck
- Security-bewusster Linux- und Infrastrukturbetrieb
- PKI, Zugriffskontrolle, Härtung und nachvollziehbare Betriebsprozesse
- Behörden- und Enterprise-Umgebungen
- Zentrale Logging- und Monitoring-Plattformen
Verfügbarkeit & Einsatzmodell
Kurzfristig für Vollzeitprojekte verfügbar
Remote bevorzugt · Hybrid im Raum München · Gelegentliche, planbare Vor-Ort-Einsätze deutschlandweit
Bevorzugte Rollen