Site Reliability Engineer / Infrastructure Engineer

  • CDI
  • Paris
  • Remote: Full remote
  • min: 100k€
  • max: 120k€
  • Scale-up
  • Entertainment
  • Senior
  • Infrastructure
  • Argo CD
  • CI/CD
  • Cloud
  • Docker
  • GCP
  • Kubernetes
  • Terraform

DESCRIPTIF DU POSTE

Le poste est à pourvoir au sein de l’équipe Infrastructure, qui fournit le socle sur lequel repose toute la croissance du produit: scalabilité, efficience et fiabilité de la plateforme. L’infrastructure est conçue et opérée sur GCP.

L’équipe travaille en binôme avec les squads de développement, avec un objectif simple: leur permettre de livrer vite, sans que la facture cloud ni la disponibilité en pâtissent. La cible est une infrastructure automatisée, pensée pour les développeurs, et dont les coûts sont réellement pilotés.

 

 

VOS COMPÉTENCES

Le périmètre

  • Appliquer et faire vivre les pratiques SRE sur son périmètre: SLI, SLO, error budgets, gestion des incidents, postmortems.
  • Concevoir, mettre en oeuvre et optimiser l'infrastructure sur quatre axes: disponibilité, scalabilité, fiabilité et maîtrise des coûts.
  • Contribuer à la stack d'observabilité: monitoring, alerting, logging, tracing distribué.
  • Automatiser l'infrastructure et les workflows opérationnels (Terraform, Terragrunt, Kubernetes).
  • Contribuer aux initiatives FinOps: construire les outils et les indicateurs qui permettent d'optimiser les coûts cloud.
  • Travailler au contact direct des squads de développement pour améliorer la fiabilité, la performance et l'exploitabilité de leurs services.
  • Peser dans les décisions d'architecture et diffuser les bonnes pratiques de construction de systèmes distribués résilients.
  • Analyser les goulets d'étranglement de performance et porter les solutions: stratégies de scaling, optimisations de services, debug système.
  • Partager ses connaissances avec les autres ingénieurs de l'équipe Infrastructure et faire monter le niveau collectif sur la fiabilité.

La stack

  • Orchestration: Kubernetes
  • Cloud: GCP
  • CI/CD: ArgoCD, GitHub Actions
  • Infrastructure as code: Terraform, Terragrunt
  • Monitoring: Datadog
  • Langages: Go, Node
  • Datastores: Spanner, PostgreSQL, Redis

VOTRE PROFIL

  • Maîtrise solide de Kubernetes.
  • Expérience d'architectures distribuées à fort trafic et des outils associés (service discovery, gestion de configuration et de secrets, etc.).
  • Bonne maîtrise d'au moins un cloud provider, GCP ou AWS de préférence.
  • Pratique réelle des méthodes SRE: SLO, gestion d'incidents, observabilité, ingénierie de la fiabilité.
  • Culture opérationnelle affirmée, avec de l'expérience de gestion d'incidents en production et de conduite d'améliorations de fiabilité dans la durée.
  • À l'aise pour collaborer avec d'autres ingénieurs et pour se positionner sur des choix techniques.
  • Sens de l'initiative: quand quelque chose ne fonctionne pas, la personne ne l'escalade pas en attendant des consignes, elle le corrige.
  • Pragmatisme et orientation impact: savoir arbitrer entre fiabilité, vitesse de livraison et priorités business.
  • Sensibilité au rapport performance / coût, et capacité à faire des choix qui tiennent à la fois techniquement et financièrement.

AVANTAGES

  • Rémunération selon expérience.
  • Carte titres-restaurant.
  • Abonnement sport pris en charge à 100%.
  • Mutuelle haut de gamme prise en charge à 100%, pour le collaborateur et sa famille.
  • Activités bien-être organisées dans les bureaux.
  • Poste basé à Paris.

DÉROULEMENTS DES ENTRETIENS

  • Premier échange téléphonique avec Skill Hunter (30 minutes) pour cadrer le projet et les attentes.
  • Entretien avec un membre de l'équipe Infrastructure.
  • Échange technique sur des cas concrets de fiabilité et d'architecture.
  • Rencontre avec l'équipe et proposition.

L'ENTREPRISE

Une application mobile grand public, utilisée par plusieurs dizaines de millions de personnes chaque mois à travers le monde. L'équipe compte une centaine de personnes et travaille depuis Paris.

La société est adossée à un actionnaire solide, qui lui donne les moyens de sa croissance tout en lui laissant une organisation resserrée et une forte autonomie technique.

Apply Now
Scroll to Top