Remote Jobs RockRemote Jobs Rock

Site Reliability Engineer - Pôle Run - CDI Paris - Theodo Cloud

📅 Nov 25, 2024
Site Reliability EngineeringIncident ResponseKubernetesCloud Operations

📜 Description

  • React to production incidents and conduct investigations for technical issues.
  • Perform post-mortem analyses and communicate findings with clients.
  • Provide recommendations to clients for enhancing their infrastructure quality.
  • Work on a diverse range of infrastructures and tools, solving complex production bugs.
  • Opportunity for voluntary on-call duties.

🛠️ Requirements

  • Solid academic background from an engineering school.
  • Initial professional experience with infrastructure/cloud technologies, especially Kubernetes.
  • Ability to manage stress and react quickly in production environments.

✨ Benefits

  • Employee stock ownership to share in the company's success.
  • Savings plan with profit-sharing in partnership with Epsor.
  • Equipment budget for computer, smartphone, and headphones.
  • Benefits provided by the CSE, including sports with Gymlib.
  • 5 weeks of vacation plus 8 to 12 RTT per year.
  • Health insurance (SideCare) covered at 50%.
  • Swile meal voucher card.
  • Reserved childcare places and assistance.
Full job description
L’histoire du groupe Theodo et son succès
Theodo accompagne depuis 2009 les entreprises innovantes dans la conception, le développement et le déploiement de produits digitaux ingénieux - tels que la plateforme TF1+, l'application LCL Pro ou l'application France Identité Numérique - en tirant parti du meilleur de la technologie et de l’approche Lean.
Theodo connait une croissance exceptionnelle depuis 15 ans : nos équipes rassemblent plus de 850 Theodoers, principalement des Software Engineers, passionnés de technologie et d’amélioration continue. En 2025, le groupe Theodo génère 100M€ de CA.
La practice Run de Theodo a été lancée en 2023. Elle propose une offre d’infogérance nouvelle génération, respectant l'exigence ITIL 4, tout en combinant TMA applicative, opérations cloud (HDS) et amélioration continue accélérée par l’IA.

Ton équipe :
L’équipe technique de Theodo Cloud est constituée de deux pôles :
- le pôle Build, dédié à nos projets de création, migration et optimisation d’infrastructures
- le pôle Run, dédié à l’infogérance des infrastructures de nos clients.
Notre pôle Run connaît une forte croissance et recherche un Site Reliability Engineer pour renforcer l’équipe et ainsi pouvoir développer le nombre de clients infogérés par Theodo.
L’équipe Run est composée de 7 personnes, intervenant sur de la réaction à incident, du maintien en conditions opérationnelles des infrastructures et des optimisations.
Tes missions :
En tant que SRE Run, ton rôle est d’assurer la stabilité et la disponibilité des infrastructures de nos clients :
- Réagir aux incidents en production et mener des investigations en cas de problèmes techniques
- Réaliser les post-mortem et assurer la communication avec le client
- Répondre aux interrogations de nos clients et leur fournir des recommandations pour améliorer la qualité de leur infrastructure.
La réalisation d’astreintes est également possible, elle se fait toujours sur la base du volontariat.
Ce poste est idéal pour les personnes qui sont curieuses et souhaitent progresser vite : il offre l’opportunité de travailler sur un large panel d’infrastructures et d’outils. C’est l’assurance de ne jamais s’ennuyer et d’avoir à résoudre des bugs complexes en production.
Les opportunités d’évolution :
La première étape d’évolution chez Theodo Cloud est de devenir Lead sur le pôle Run, et de devenir ainsi garant de la montée en compétences de ton équipe. Nous proposons ensuite deux tracks d’évolution possibles :
- une track Management, qui t’emmènera vers un rôle d’Engineering Manager
- une track Expertise, qui te permettra d’accéder à un rôle de Staff Engineer
Profil recherché :
Nous recherchons une personne ayant :
- une solide formation académique en école d’ingénieur
- une 1ère expérience professionnelle avec les technologies infra / Cloud, et notamment Kubernetes
- de la rigueur et une bonne gestion du stress, afin d’être capable de réagir vite et intervenir sur des environnements en production
Tu ne coches pas 100% des critères mais tu penses tout de même correspondre à notre recherche ? Ne t’auto-censure pas et envoie-nous ta candidature, on se fera un plaisir de l’étudier !
Pour information :
- Le poste est proposé en CDI, basé depuis nos locaux à Paris.
- Nous permettons à nos équipes de télé-travailler jusqu’à 3 jours par semaine.
- Le salaire proposé dépend du niveau d’expérience de chacun : nous en parlons toujours dès le premier appel téléphonique.
Déroulement des entretiens :
Nous répondons à toutes les candidatures dans un délai de 3 jours.
Si ton profil nous plait, nous te proposons le process suivant :
- un appel téléphonique de 30 minutes avec un membre de l’équipe recrutement, pour comprendre tes critères de recherche
- un entretien d’une heure avec le recruteur ou la recruteuse avec qui tu as échangé à la première étape, pour parler plus en détail de la culture Theodo
- un entretien de logique
- un entretien technique de débug sur Docker de 45 minutes
- un échange de 30 minutes avec un membre de l'équipe dirigeante
Tu seras accompagné(e) par une personne de l’équipe recrutement, qui sera là pour te coacher tout au long du process.
L’histoire du groupe Theodo et son succès Theodo accompagne depuis 2009 les entreprises innovantes dans la conception, le développement et le déploiement de produits digitaux ingénieux - tels que la plateforme TF1+, l'application LCL Pro ou l'application France Identité Numérique - en tirant parti du meilleur de la technologie et de l’approche Lean.   Theodo connait une croissance exceptionnelle depuis 15 ans : nos équipes rassemblent plus de 850 Theodoers, principalement des Software Engineers, passionnés de technologie et d’amélioration continue. En 2025, le groupe Theodo génère 100M€ de CA.   La practice Run de Theodo a été lancée en 2023. Elle propose une offre d’infogérance nouvelle génération, respectant l'exigence ITIL 4, tout en combinant TMA applicative, opérations cloud (HDS) et amélioration continue accélérée par l’IA. Pourquoi rejoindre Theodo ? L’environnement: 💼 Rejoindre un groupe de 850 personnes avec de nombreuses possibilités d’évolutions cross-entités 🤝  Chaque Theodoer est accompagné par un coach interne. Son objectif : t’épauler dans ton quotidien et parler objectifs de carrière via des séances de coaching hebdomadaires. 🎯 Participation à des projets associatifs grâce à la Fondation Theodo (Ada Tech School, Code Phoenix, Article 1…) 🎉 Soirées mensuelles, keynotes et week-end d’entreprise annuel   Le package : 📈 Actionnariat salarié pour être associé à la réussite du groupe 💸 De l’épargne salariale avec un mécanisme d’intéressement en partenariat avec Epsor 🖥 Budget équipement (ordinateur, smartphone, écouteurs…) 🧒 Des avantages fournis par notre CSE (sport avec Gymlib,...) 🏖 5 semaines + 8 à 12 RTT/an 🩺 Mutuelle (SideCare) prise en charge à 50% 🍽 Carte ticket-restaurants Swile 🧒 Aides et places en crèche réservées   Prêt à nous rejoindre ?   Chez Theodo, nous sommes convaincus que la diversité est une richesse et que l’égalité des chances est essentielle pour construire des équipes performantes et épanouies. C’est pourquoi notre processus de recrutement est conçu pour être équitable, bienveillant et fondé sur les compétences. Nous accueillons toutes les candidatures, sans distinction de genre, d’origine, d’orientation sexuelle, d’âge, de situation de handicap ou de croyances.
SpaceX

Site Reliability Engineer (Manufacturing Infrastructure)

🕒 27 days ago
SpaceX👥 10,000+ employees🏢 Aviation And Aerospace Component Manufacturing🤝 B2B

As a Site Reliability Engineer for Manufacturing Infrastructure, you will enhance the reliability and scalability of systems supporting SpaceX's manufacturing processes.

Site Reliability EngineeringDevOpsInfrastructure As CodeLinux
Anyscale

Site Reliability Engineer, Platform Infrastructure (Foundations)

📅 Aug 26
Anyscale👥 201 - 500 employees🏢 Computer Software

As a Site Reliability Engineer, you will design and optimize critical infrastructure for distributed AI applications, ensuring high performance and reliability in cloud environments.

KubernetesCloud-native TechnologiesAWSAzure

Trusted by Remote Workers