Ingénieur de plateforme
(h/f/d)
Bonjour, ravi de faire votre connaissance !
Nous recherchons un ingénieur plateforme pour aider nos équipes de développement à donner le meilleur d’elles-mêmes.
Vous travaillerez en étroite collaboration avec quatre équipes chargées de développer des logiciels complexes, et vos clients sont les développeurs eux-mêmes. Votre mission consiste à créer la base numérique sur laquelle ils s’appuient au quotidien, en rendant notre infrastructure automatisée, évolutive, sécurisée et, idéalement, presque invisible.
Vous permettrez à nos ingénieurs de déployer du code en production plusieurs fois par jour en toute confiance (et sans effort — ni sans mettre les serveurs à rude épreuve). Et lorsque les moments décisifs arriveront, comme le pic de trafic du matin de Noël, vous veillerez à ce que Skadii continue de fonctionner sans accroc.
Principales responsabilités
- L’infrastructure en tant que code (IaC)
- Architecture : Gérer et faire évoluer nos ressources cloud (AWS/Azure) exclusivement par le biais du code (Terraform/CloudFormation). Nous ne gérons pas l’infrastructure en cliquant dans une console.
- Évolutivité : Concevoir des règles d’auto-scaling et des stratégies d’équilibrage de charge permettant de gérer notre saisonnalité extrême (charge élevée en hiver, faible en été) de manière rentable.
- Expérience des développeurs (DX) et pipelines
- Responsabilité CI/CD : Vous êtes responsable du « pipeline ». Vous veillez à ce que le parcours, depuis la validation Git jusqu’à la mise en production, soit rapide, automatisé et sécurisé.
- Gestion des environnements : Mettez en place des fonctionnalités en libre-service afin que les développeurs puissent créer des environnements éphémères à des fins de test sans avoir à attendre d’autorisation.
- Fiabilité et observabilité
- Surveillance : Mettez en place les « yeux et les oreilles » du système (Datadog, Prometheus, ELK). Vous veillez à ce que nous soyons informés d’une panne avant même que le client n’appelle le service d’assistance.
- Réponse aux incidents : Aidez-nous à organiser notre roulement de permanence et animez les « analyses rétrospectives » après les incidents afin de garantir que nous en tirions les leçons et que nous améliorions la résilience du système.
Capacités et exigences
- Cloud Native : expertise approfondie d’Azure et de l’orchestration de conteneurs (Kubernetes/Docker).
- Script : Maîtrise approfondie de Python, Go ou Bash. Vous automatisez tout.
- Esprit de sécurité : Vous savez comment gérer les secrets, les pare-feu et les contrôles d’accès au sein d’un système distribué.
- Orienté service : vous considérez les développeurs comme vos clients. Vous êtes là pour les aider à surmonter leurs difficultés, et non pour jouer le rôle de « gardien ».
Indicateurs de performance (KPI)
- Fréquence des déploiements : augmenter le nombre de déploiements que nous pouvons effectuer en toute sécurité chaque semaine.
- Délai de mise en œuvre des modifications : réduire le délai entre la validation du code et sa mise en production.
- Disponibilité du système : 99,9 % ou plus pendant la haute saison hivernale.