01.07.2026 aktualisiert


100 % verfügbar
Senior DevOps Engineer & Cloud Solutions Architect
Köln, Deutschland
Weltweit
Diplom (Dipl.-Informatiker)Skills
ProxmoxKubernetes-SicherheitJavaAdobe InDesignAPIsAgile MethodologieKünstliche IntelligenzAmazon Web ServicesArchitekturAutomatisierungTest AutomationMicrosoft AzureBash ShellProzessoptimierungC++
Cloud & Containerisierung
Langjährige Erfahrung im Aufbau, Betrieb und der Migration komplexer Cloud-Infrastrukturen auf Basis von AWS, Google Cloud Platform und Azure. Planung und Umsetzung skalierbarer Plattformen für Energie-, E-Commerce- und Behördenkunden. Tiefes Verständnis für Cloud-native Architekturen, Microservices-Strukturen und Hybrid-Cloud-Szenarien (u. a. Migration zu Google Kubernetes Engine, Aufbau einer souveränen On-Prem-Plattform bei der Bundesdruckerei).
Kubernetes & Orchestrierung
Umfassende Expertise in Design, Aufbau und Betrieb von Kubernetes-Umgebungen. Einsatz von Rancher, RKE2, K3s, OpenShift und Helm-Charts. Automatisierte Bereitstellung über Terraform, GitOps mit Argo CD und CI/CD-Integration via GitLab oder Jenkins. Besondere Erfahrung mit KRITIS-Plattformen und Mandantenfähigkeit (z. B. PBM AG, Next Kraftwerke, Bundesdruckerei).
Infrastructure as Code (IaC) & Automatisierung
Tiefgreifende Kenntnisse in Terraform, OpenTofu, Ansible /AWX /AAP, Packer und Bash-Scripting. Aufbau standardisierter, reproduzierbarer Umgebungen und vollautomatisierter Provisionierungen. Erprobte Umsetzung von IaC- und GitOps-Workflows – inklusive Security-Checks, Linting und Testing in CI/CD-Pipelines.
CI/CD & DevOps Tooling
Architektur und Betrieb von CI/CD-Pipelines auf GitLab CI/CD, GitHub Actions und Jenkins, inklusive automatisierter Tests, Artefaktverwaltung (Harbor, Nexus, Artifactory) und Deployment-Strategien. Integration von Helm, Terraform, Renovate und bump2version für wiederholbare Releases. Erfahrung in agilen Umgebungen mit Scrum / Kanban.
Monitoring, Logging & Observability
Einrichtung kompletter Observability-Stacks mit Prometheus, Grafana, Loki, ELK Stack, Datadog und Icinga2. Entwicklung proaktiver Monitoring-Dashboards und Alarmierungsstrategien für hochverfügbare Cluster und Multi-Cloud-Setups.
Security & Compliance
Erprobte Umsetzung von Security-by-Design-Prinzipien und Governance-Vorgaben. Nutzung von Vault, Kyverno, Keycloak, mTLS und automatisierten Security-Scans. Erfahrung mit DORA-, NIS2-, SOC2- und KRITIS-Anforderungen.
Netzwerk & Systemarchitektur
Fundiertes Wissen in Netzwerkmanagement, VPN-Services (OpenVPN, WireGuard), Firewall-Konfiguration und Load-Balancing (HAProxy, NGINX, Cloud Armor). Erfahrung im Hardware- und Virtualisierungs-Management (Proxmox, VMware, CephFS, iDRAC, Redfish API).
Programmierung & Scripting
Breites Spektrum von Python, Bash, Java, Node.js bis C++. Entwicklung von Automatisierungs-, Test- und Integrationsskripten. Verwendung moderner Frameworks wie FastAPI oder pytest zur Qualitätssicherung.
Leadership & Teamarbeit
Leitung internationaler DevOps-Teams (z. B. Nearshore-Team in Belgrad), Mentoring und Schulung im Bereich IaC & Kubernetes. Agile Zusammenarbeit mit Architekten, Entwicklern und Security-Teams.
Sprachen
DeutschMutterspracheEnglischverhandlungssicherFranzösischGrundkenntnisse
Projekthistorie
AWS Cloud-Management & System Administration:
- Betrieb, Monitoring und kontinuierliche Optimierung der AWS-Infrastruktur für Energie- und IoT-bezogene Workloads im KRITS-Kontext, mit Fokus auf Skalierbarkeit, Hochverfügbarkeit und Betriebssicherheit.
- Unterstützung des Betriebs im 3nd-Level-Support für cloudbasierte Services und datengetriebene Energieprozesse.
- Entwicklung und Pflege von IaC-Komponenten mit Terraform zur automatisierten Bereitstellung cloudnativer Umgebungen.
- Einsatz von Bash- und Python-Skripten zur Automatisierung operativer Aufgaben und Infrastrukturprozesse.
- Aufbau und Weiterentwicklung von CI/CD-Pipelines mit GitHub Actions, zur kontinuierlichen Auslieferung containerisierter Microservices.
- Zusammenarbeit mit Enterprise-Architekten zur Entwicklung von Cloud-nativen Plattformkomponenten, darunter Kubernetes-basierte Microservices
- Integration verteilter Speichersysteme und datengetriebener Services zur Verarbeitung von Echtzeit Datenströmen.
- Umsetzung von Security-by-Design-Prinzipien in allen Phasen des Infrastruktur-Lifecycle.
- Durchsetzung von Governance-Vorgaben durch rollenbasiertes Zugriffsmanagement, Least-Privilege-Prinzipien und automatisierte Sicherheitsprüfungen.
- Orientierung an EU-/EWR-konformen Sicherheitsstandards und Anforderungen an souveräne Cloud-Architekturen, insbesondere im Betrieb kritischer Infrastrukturen (KRITIS).
- Einrichtung von Monitoring-Dashboards mit Grafana, Anbindung von Metriken und Alerts zur proaktiven Systemüberwachung.
On-Premises Cloud-Architektur & Kubernetes-Infrastruktur:
- Mitarbeit in einem DevOps-Team im Scrum-Ansatz zur Entwicklung einer skalierbaren und sicheren On-Premises-Plattform.
- Verwendung von CoreOS als Betriebssystem für Container-Hosts zur Optimierung der Kubernetes-Basis.
- Automatisierung von Infrastruktur- und Deployment-Prozessen mit Terraform, Terragrunt, Ansible und AWX.
- Programmierung von Bash-Skripten zur Unterstützung von Verwaltungs- und Automatisierungsprozessen.
- Aufbau der Virtualisierungsumgebung mit Proxmox und CephFS für eine hochverfügbare Infrastruktur.
- Hardware-Management mit iDRAC und Redfish API, automatisiert durch Ansible, zur zentralen Verwaltung von Server-Ressourcen.
- Einrichtung und Betrieb von Basiskomponenten, darunter:
- Vault für Secrets-Management
- Artifactory als Artefakt-Repository
- K3s als leichtgewichtige Kubernetes-Distribution
- OpenLDAP-Cluster für Authentifizierung und Zugriffskontrolle
- Zusammenarbeit mit interdisziplinären Teams zur Sicherstellung von Performance, Skalierbarkeit und Security.
- Unterstützung bei der Einhaltung von behördlichen Compliance- und Sicherheitsvorgaben, um höchste Standards in der IT-Sicherheit zu gewährleisten.
Cloud Migration & Kubernetes:
- Migration der SAP Hybris Webshop-Infrastruktur von Docker-Containern auf selbst gehosteten VMs nach Google Kubernetes Engine (GKE) zur Verbesserung der Skalierbarkeit und Verfügbarkeit.
- Entwicklung und Bereitstellung von Entwicklungsumgebungen mittels Terraform, um eine standardisierte Infrastruktur sicherzustellen.
- Automatisierung von Deployments und Infrastruktur mit Ansible und Argo CD (GitOps) für konsistente und effiziente Bereitstellungsprozesse.
- Programmierung von Bash-Skripten zur Unterstützung und Optimierung von Infrastruktur- & Deployment-Prozessen.
- Betrieb und Bereitstellung von OpenVPN-Services zur sicheren Netzwerkanbindung.
- Bereitstellung und Verwaltung kritischer Kubernetes-Dienste, darunter:
- Monitoring & Logging: Grafana mit Loki, Promtail, Prometheus
- Code-Qualität & Repository-Management: Nexus, Sonarqube
- Suchinfrastruktur: Solr Cluster (solr operator)
- Caching & Messaging: Redis, Zookeeper
- Session & User Analytics: OpenReplay
- Security & Authentifizierung: Oauth Proxy
- Nutzung diverser Google Cloud Services, darunter:
- Compute & Storage: Google Functions, Google Container Registry, Google Filestore (NFS), GCS
- Datenbanken & Messaging: MySQL, Redis
- Workflow & Automatisierung: Google Composer (Apache Airflow)
- Security & Netzwerk: Google Cloud Armor, Cloud Identity, CDN - Aufbau einer Disaster Recovery Umgebung in einer zweiten GCP-Region zur Sicherstellung der Hochverfügbarkeit und Geschäftskontinuität.