Stellenbeschreibung: Gesucht wird ein praxisorientierter Plattformingenieur (auf Vertragsbasis) für die Konzeption, den Betrieb, die Absicherung und die kontinuierliche Verbesserung der gemeinsamen Technologieplattformen, die von Produkt- und Entwicklungsteams genutzt werden. Der Schwerpunkt dieser Position liegt auf zuverlässigen, selbst gehosteten und cloud-nativen Plattformdiensten, der Unterstützung von Entwicklern, der Automatisierung der Infrastruktur, DevSecOps sowie dem Produktionsbetrieb in einem regulierten Fintech-Umfeld.
Der ausgewählte Auftragnehmer wird die Gesamtverantwortung für die Plattformfunktionen übernehmen, direkt mit den Teams aus den Bereichen Anwendung, Infrastruktur, Cybersicherheit und Governance zusammenarbeiten und ausfallsichere Dienste, wiederverwendbare Automatisierungslösungen, eine klare Dokumentation sowie nachhaltige Betriebsabläufe bereitstellen.
Kernaufgaben • Entwurf, Aufbau, Betrieb und Optimierung gemeinsamer Plattformdienste in Produktions- und Nicht-Produktionsumgebungen. • Verwaltung von Kubernetes-basierten Plattformen, einschließlich Upgrades, Kapazität, Netzwerk, Speicher, Zugriffskontrollen, Zuverlässigkeit der Workloads und Notfallwiederherstellung. • Entwicklung und Pflege von „Infrastructure as Code“ mithilfe von Terraform und automatisierten Konfigurationsverfahren in GCP-, OCI- und entsprechenden lokalen Umgebungen. • Verantwortung für DevOps-CI/CD-Fähigkeiten und wiederverwendbare Pipeline-Standards zur Gewährleistung einer starken Governance, von Sicherheitskontrollen, der Rückverfolgbarkeit von Releases sowie des Entwickler-Self-Service. • Einrichten, Verwalten, Aktualisieren, Sichern, Überwachen, Sichern und Wiederherstellen selbst gehosteter GitLab- und GitLab-Runner-Umgebungen, einschließlich Hochverfügbarkeit und Notfallwiederherstellung. • Einrichtung und Verwaltung von HashiCorp Vault Enterprise, einschließlich HA/DR-Architektur, Namespaces, Richtlinien, Authentifizierungsmethoden, Secret-Engines, PKI, Auto-Unseal, Auditing, Überwachung, Sicherung und Wiederherstellung. • Betrieb und Verwaltung der Checkmarx-Funktionen sowie Integration von Anwendungssicherheitsscans in CI/CD-Pipelines mit praktischen, risikobasierten Kontrollen und Berichterstellung. • Aufbau und Unterstützung von GitOps-Workflows, Container-Registern, Artefaktmanagement, Bereitstellung von Geheimnissen, Richtlinienkontrollen und Plattformautomatisierung. • Implementierung von Observability- und SRE-Praktiken unter Verwendung von Metriken, Protokollen, Traces, Dashboards, Warnmeldungen, Servicezielen, Kapazitätsplanung und operativem Berichtswesen. • Leitung der Reaktion auf Plattformvorfälle, Ursachenanalyse, Problemmanagement, Behebung von Störungen sowie Überprüfungen der Produktionsbereitschaft. • Zusammenarbeit mit Cybersicherheits- und Risikoteams, um die Anforderungen des Finanzsektors hinsichtlich Zugriffskontrolle, Aufgabentrennung, Schwachstellenmanagement, Überprüfbarkeit, Ausfallsicherheit und Änderungssteuerung zu erfüllen. • Erstellung von Runbooks, Architekturdokumentation, Standards, wiederverwendbaren Modulen und Wissenstransfer, um eine langfristige operative Eigenverantwortung sicherzustellen.
Erforderliche Erfahrung und Fähigkeiten • Fundierte praktische Erfahrung in den Bereichen Plattform-Engineering, DevOps, SRE oder Infrastruktur-Engineering in komplexen Produktionsumgebungen. • Fundierte praktische Kenntnisse in den Bereichen Kubernetes, Container, Linux-Administration, Netzwerke, Speicher sowie Fehlerbehebung in verteilten Systemen. • Nachgewiesene Erfahrung bei der Erstellung sicherer, wiederverwendbarer CI/CD- und GitOps-Workflows sowie bei der Unterstützung von Entwicklungsteams in großem Maßstab. • Fundierte Erfahrung mit Terraform und Infrastructure-as-Code, einschließlich disziplinierter Modulentwicklung, Statusverwaltung, Testverfahren und Änderungskontrolle. • Erfahrung mit mindestens einer der großen Cloud-Plattformen; Erfahrungen mit GCP und OCI sind besonders relevant. • Ausgeprägte Fähigkeiten im Bereich Skripting oder Entwicklung in Python, Bash, Go oder ähnlichen Sprachen. • Erfahrung bei der Implementierung von Überwachung, Protokollierung, Warnmeldungen, Datensicherung, Wiederherstellung und Betriebsbereitschaft für geschäftskritische Dienste. • Fähigkeit, selbstständig als Auftragnehmer zu arbeiten, Prioritäten zu setzen, Risiken klar zu kommunizieren und unter geringer Aufsicht messbare Ergebnisse zu erzielen.
Besonders wünschenswerte Erfahrungen: Praktische Erfahrung mit Vault Enterprise, selbst gehostetem GitLab, Checkmarx sowie DevOps-CI/CD-Plattformen für Unternehmen im Fintech- oder Bankensektor. Erfahrung mit ForgeRock oder vergleichbaren Plattformen für das Identitäts- und Zugriffsmanagement in Unternehmen.
Arbeitsweise • Ergebnisorientiert, pragmatisch und in der Lage, ein ausgewogenes Verhältnis zwischen Geschwindigkeit, Sicherheit, Ausfallsicherheit und regulatorischen Anforderungen herzustellen. • Klare Kommunikationsfähigkeit und die Fähigkeit zur effektiven Zusammenarbeit mit Ingenieuren, Sicherheitsspezialisten, Anbietern und leitenden Entscheidungsträgern. • Ausgeprägtes Verantwortungsbewusstsein, gepaart mit disziplinierter Dokumentation, Wissensvermittlung und konsequenter operativer Umsetzung.
Diese Stelle als Auftragnehmer richtet sich an einen erfahrenen Plattform-Experten, der sofort einen Beitrag leisten, wichtige Plattformfunktionen stärken und dabei helfen kann, sichere und nachhaltige Entwicklungsverfahren zu etablieren.