Skip to main content

SRE Compute

Job Description

QUI SOMMES-NOUS ?


S3NS est né du partenariat industriel entre Thales, leader mondial de la cyber sécurité, et Google Cloud, leader mondial des solutions cloud. Nous avons pour ambition d’offrir le meilleur des deux mondes à l’ensemble des organisations soucieuses de protéger leurs données sensibles (institutions publiques, OIV, OSE…). C’est-à-dire une solution équivalente à Google Cloud Platform (incluant à la fois les services IaaS et PaaS de GCP) et respectant les exigences du label SecNumCloud.


Une première offre, ‘Contrôles locaux avec S3NS’, est déjà disponible depuis février 2023 pour permettre à nos clients de bénéficier d’un premier niveau de transparence et contrôles additionnels, et d'accélérer la trajectoire vers le cloud de confiance.


Votre Quotidien


En tant qu'Ingénieur(e) SRE Compute, votre mission sera au cœur de l'exploitation de notre univers GCP : 

  • Vous serez responsable du maintien en condition opérationnelle, de l'exploitation et de la gestion de l'ensemble des plateformes Compute (GCE, GKE, Vertex AI…), au sein d'un environnement équivalent à l'univers GCP.

  • Vous gérerez les incidents de production 24h/24 et 7j/7, et développerez une compréhension approfondie des services techniques qui constituent l'épine dorsale des services GCP utilisés par des millions de clients. 

  • Grâce à notre partenariat privilégié, Google nous partage ses connaissances et vous ouvre les portes de sa pile technique interne (Borg, Colossus, Spanner, Sawmill, etc.). Vous bénéficierez d'un programme de formation accéléré et intensif, dispensé au contact direct des experts Google et de nos équipes S3NS déjà formées par leurs soins, pour maîtriser des technologies d'exception habituellement réservées aux ingénieurs internes de Google.


Responsabilités Clés :

  • Monitoring SLI/SLO : Surveiller la disponibilité, l'évolutivité, la latence et l'efficacité des services souverains GCP liés au COMPUTE en traitant les incidents de production. 

  • Gestion d'Infrastructure : Gérer le parc de machines et les stacks de compute sous-jacentes (Borg et les différents control plane de Google) pour garantir une performance optimale.

  • Diagnostic et Résolution d'incidents : Garantir la fiabilité maximale de la plateforme. Afin d'assurer un maintien en condition opérationnelle 24/7 de notre cloud, le poste implique des permanences en journée ainsi que des astreintes de nuit par roulement.

  • Collaboration d'équipe : Collaborer avec des experts des services GCP à travers le monde pour aider à mitiger et à résoudre les incidents.

  • Automatisation & Connaissance : Documenter les connaissances pour s'assurer que tous les SRE S3NS travaillent avec la même information, standardiser les flux de résolution et améliorer les playbooks opérationnels.

  • Revues Post-incident : Après un incident, réunir les équipes pour effectuer un post-mortem, comprendre les causes, tirer des leçons et encourager l'amélioration continue. 


Conformément aux exigences de qualification SecNumCloud de nos services, délivrée par l'ANSSI, ce poste est soumis à des exigences de sécurité renforcées. Le candidat retenu devra se soumettre à une enquête de sécurité menée par nos services, conformément à notre politique de sécurité du personnel. 


Votre Profil 


Ce qui vous passionne et vous motive : 

  • L'innovation technologique, le Cloud, et l'exploitation de services et d'infrastructures en mode "as code"

  • L'excellence opérationnelle à grande échelle : L'exploitation et la haute disponibilité (≥ 99,99 %) de bases de données critiques et de moteurs analytiques à forte volumétrie.

  • L'ADN de l'ingénierie Compute chez Google : La curiosité d'explorer comment un hyperscaler gère des millions de cœurs et l'envie de maîtriser plus de 20 ans d'innovation en systèmes distribués (GCE, GKE, Borg, Colossus, Spanner, etc.).

  • L'impact au sein d'un collectif d'experts : La perspective de rejoindre une équipe spécialisée au cœur des enjeux Compute (parc de machines, control plane, virtualisation et orchestration).


Expérience : 

  • Diplômé(e) d'une école d'ingénieur ou titulaire d'un Master. 

  • Au moins 3 ans d'expérience en SRE et automatisation des opérations. Poste ouvert aux profils juniors justifiant d'une expérience significative en alternance dans un périmètre similaire.

  • Exposition à un environnement international avec un bon niveau d’anglais requis.

  • Bonus: Une expérience précédente sur GCP est un plus mais votre soif d'apprendre notre propre Cloud est primordiale ! 


Le mot de l'équipe 


« Envie de rejoindre une équipe passionnée à taille humaine ? Intégrez notre équipe SRE Compute : un collectif de 7 ingénieurs au cœur du moteur de notre cloud de confiance. Votre mission est critique : piloter le parc de machines et les stacks de compute sous-jacentes (Borg, control plane). Si vous aimez l'infrastructure pure et les systèmes à grande échelle, venez faire vibrer votre expertise avec nous ! »


Optimize Your Resume for This Job

Get a match score and see exactly which keywords you're missing

Optimize Resume

Job Details

Category
Software
Employment Type
Full Time
Location
PARIS 9ème (Hybrid)
Posted

About Thales Alenia Space

Thales Alenia Space is a joint venture between Thales (67%) and Leonardo (33%) that manufactures telecommunications satellites, Earth observation systems, and space station modules.

Found this role interesting?

SRE Compute
Thales Alenia Space
Apply