Ingénieur d'exploitation (SRE/SYSOPS) - Freelance (H/F)
Description du poste
Vos Missions
Gestion des Systèmes et des Applications et des flux
Garantir les engagements de services
Assurer une surveillance et une observabilité des systèmes, des applications et des flux, identifier et résoudre les problèmes avant qu'ils n'affectent les utilisateurs (capacity planning, mise en œuvre des mécanismes de résiliences et haute disponibilité, ...)
Planifier, surveiller les différents traitements
Mettre en production les nouvelles applications ou évolutions en mode CI/CD et GitOps)
Gestion des différents environnements (Recette, Pré Production, Production)
Gestion des Incidents et des Erreurs
Répondre rapidement aux incidents, analyser les causes et mettre en œuvre des solutions pour prévenir la récurrence des problèmes
Effectuer les contrôles au quotidien des traitements, corriger les erreurs, faire les reprises nécessaires et en informer les responsables
Automatisation et Optimisation des Performances
Développer et maintenir des scripts et des outils d'automatisation pour améliorer les opérations et réduire les interventions manuelles
Travailler continuellement à l'amélioration des performances des systèmes et des applications, en évaluant et en optimisant les configurations
Automatiser des déploiement (y compris infrastructure as A Code, Pipelines CI/CD, Chart de déploiement Kubernetes, ou scripts de déploiement)
Gérer de configuration des assets
Collaboration et Communication
Travailler en étroite collaboration avec les équipes de développement pour intégrer les pratiques de production dès la conception et tout au long du cycle de vie des applications
Participer à la formation et à l'accompagnement des autres membres de l'équipe, partager les connaissances et les meilleures pratiques en matière de fiabilité et d'opérations
Gestion de l'Infrastructure et de la Sécurité
Superviser et gérer l'infrastructure Cloud provisionnée, assurer une utilisation efficace des ressources et une conformité aux standards de l'entreprise
Participer à la définition de la politique de sauvegarde afin de s'assurer des engagements des services
Utiliser et respecter les processus DSI basés sur des bonnes pratiques ITIL tout en adoptant une posture DevOps
Documentation et Suivi
Mettre en place et documenter des procédures et des outils de suivi
Maintenir une documentation à jour des processus, des configurations et des interventions, et générer des rapports réguliers sur la santé et la performance des systèmes
Compétences Techniques requises
Administration
Connaissance approfondie des systèmes d'exploitation (Linux/Windows)
Connaissance de la configuration réseau
Connaissance des plateformes J2EE (JBoss, Tomcat)
Connaissance de l'architecture des systèmes en environnement Cloud virtualisé
Connaissance approfondie de l'orchestration de conteneurs avec Kubernetes (pods, services, ingress, volumes)
Administration de clusters Kubernetes via Rancher (gestion multi-clusters, projets, utilisateurs et rôles)
Programmation et Scripting
Capacité à écrire des scripts pour l'automatisation des tâches et la résolution de problèmes : Ansible, terraforme, Helm, Ansible, Shell
Gestion de configuration et CI/CD (Gitlab CI/Nexus)
Déploiement et packaging d'applications sur Kubernetes à l'aide de Helm (charts, templates, valeurs)
Automatisation de la gestion des clusters Kubernetes avec Rancher CLI et API
Connaissance du Cloud
Expérience avec des plateformes cloud (VMware NSX/Openstack/Outscale)
Gestion des ressources et compréhension des services cloud
Connaissance des solutions de stockage pour conteneurs (PV/PVC, CSI, stockage distribué)
Outils de Surveillance et d'Observabilité
Expérience avec les outils de surveillance et d'observabilité
Données marché — Analyste d'application informatique
Techniciens d'étude et de développement en informatique
Médian : 2 121 €
postes prévus (BMO 2025)