Remote Jobs RockRemote Jobs Rock

Développeur(se) en fiabilité de site

📅 Feb 12
SREObservabilityCloud-native PlatformsInfrastructure As Code

📜 Description

  • Participate in assessing service maturity and provide recommendations to development teams.
  • Collaborate with development teams to implement best practices for observability.
  • Empower development teams to autonomously deploy, support, and operate their services and infrastructure.
  • Mentor developers on reliability practices, focusing on their autonomy.
  • Work closely with platform division teams to promote the adoption of practices among development teams.

🛠️ Requirements

  • Excellent understanding of observability practices in distributed systems and their impact on system design.
  • Practical experience with SRE concepts (SLOs, error budgets, incident management).
  • 3 to 5+ years of experience in software development, SRE, DevOps, or production development.
  • Proficiency with cloud-native platforms and infrastructure as code concepts and tools.
  • Practical knowledge of at least one programming language (TypeScript/Node.js is a plus).
  • Strong communication and collaboration skills with both technical and non-technical teams.
  • Ability to simplify complex reliability concepts into actionable recommendations.
  • Advanced English proficiency, both spoken and written.

Benefits

  • Competitive salary and significant equity opportunities.
  • Healthcare
  • Dental
  • Vision coverage
  • Flexible leave policy.
Full job description

MaintainX is a leading mobile-first work execution platform for industrial and frontline teams. More than 13,000 customers, including Duracell, McDonald's, Shell, DHL and Volvo, use MaintainX to cut unplanned downtime and run better operations, across 13.9 million managed assets and 79.5 million completed work orders.

In August 2026 MaintainX became part of Autodesk, joining Autodesk Operations Solutions, the organization unifying Autodesk's operations platform alongside Tandem, FlexSim and Fusion Operations. Autodesk's strategy is to converge design, make and operate into one continuous lifecycle: design an asset, build it, run it, then feed what you learn running it back into the next design. Autodesk had design and make. Operate is the phase that tells you what actually happened, and it is ours.

Nous recherchons un·e développeur(se) en fiabilité des sites (SRE) pour contribuer à améliorer la fiabilité, l’observabilité et l’autonomie des développeurs chez MaintainX, alors que nous faisons évoluer notre plateforme.

Dans ce rôle, vous collaborerez étroitement avec les équipes de développement produit et plateforme afin d’améliorer la stabilité, la résilience et la préparation opérationnelle de nos services. Vous travaillerez aux côtés des équipes pour concevoir la fiabilité dès le départ, définir clairement les responsabilités ainsi que les standards, et développer des outils partagés permettant aux équipes d’exploiter leurs services en toute confiance.

Vous contribuerez également à des initiatives à l’échelle de l’entreprise qui définissent l’approche de MaintainX en matière d’ingénierie de la fiabilité, notamment les standards d’observabilité, les pratiques de gestion des incidents et les indicateurs de santé des services, en aidant l’organisation à adopter des pratiques éprouvées de l’industrie à grande échelle.

Ce poste convient particulièrement à un·e développeur(se) qui aime travailler de manière transversale, influencer l’orientation technique grâce à de solides pratiques de développement, et transformer les principes de fiabilité en systèmes concrets, évolutifs et pérennes.

Ce que vous ferez :

  • Participer à l’évaluation du niveau de maturité des services et formuler des recommandations aux équipes de développement

  • Collaborer avec les équipes de développement afin de mettre en place les meilleures pratiques en matière d’observabilité

  • Permettre aux équipes de développement de gagner en autonomie dans le déploiement, le soutien et l’exploitation de leurs services et de leur infrastructure

  • Encadrer et accompagner les développeurs sur les pratiques de fiabilité, en mettant l’accent sur leur autonomie

  • Travailler en étroite collaboration avec les autres équipes de la division plateforme afin de favoriser l’adoption des pratiques auprès des équipes de développement

À propos de vous :

  • Excellente compréhension des pratiques d’observabilité dans des environnements de systèmes distribués, ainsi que de leur influence sur la conception des systèmes et le fonctionnement des équipes

  • Expérience pratique des concepts SRE (SLO, budgets d’erreur, gestion des incidents)

  • De 3 à 5 ans et plus d’expérience en développement logiciel, SRE, DevOps ou en développement de production, incluant l’exploitation de systèmes en production

  • Maîtrise des plateformes infonuagiques natives et des concepts et outils d’infrastructure en tant que code

  • Connaissance pratique d’au moins un langage de programmation (TypeScript / Node.js constitue un atout)

  • Excellentes aptitudes en communication et en collaboration, tant avec des équipes techniques que non techniques

  • Capacité à vulgariser des concepts complexes liés à la fiabilité et à les transformer en recommandations concrètes

  • Vous aimez permettre aux équipes de réussir de façon autonome et mesurez votre succès par la diminution de leur dépendance à votre égard

  • Un niveau avancé de l'anglais, à l'oral et à l'écrit, est requis puisque la personne devra diriger des gestionnaires d'ingénierie de plateforme répartis sur plusieurs équipes, présenter les priorités techniques à des parties prenantes exécutives, et s'aligner quotidiennement avec des leaders d'ingénierie situés à l'extérieur du Québec.

Our mission is to keep the physical world running. Factories, fleets, hospitals and campuses stay up because the people who maintain them have tools worth using. That is what we build.

Compensation and benefits. Base pay is one part of the package. Depending on the role, compensation may also include commission, an annual bonus and equity. Benefits differ by country. For roles in the United States, Autodesk’s benefits are described at benefits.autodesk.com. For roles in Canada and other countries, the plan differs on health coverage, retirement and leave, and your recruiter will walk you through it.

Belonging. We take pride in a culture where everyone can thrive. More at autodesk.com/company/global-belonging. More on where this is going: Autodesk CEO Andrew Anagnost on building the future of connected operations, and AOS SVP Stephen Hooper on welcoming MaintainX to Autodesk.

SpaceX

Site Reliability Engineer (Manufacturing Infrastructure)

SpaceX👥 10,000+ employees🏢 Aviation And Aerospace Component Manufacturing🤝 B2B
🕒 5 days ago

As a Site Reliability Engineer for Manufacturing Infrastructure, you will enhance the reliability and scalability of systems supporting SpaceX's manufacturing processes.

Site Reliability EngineeringDevOpsInfrastructure As CodeLinux
🕒 13 days ago

As a Site Reliability Engineer, you will design and optimize critical infrastructure for distributed AI applications, ensuring high performance and reliability in cloud environments.

KubernetesCloud-native TechnologiesAWSAzure
Pagerduty

Site Reliability Engineer II

Pagerduty👥 1001 - 5000 employees🏢 Computer Software
🕒 6 days ago

As a Site Reliability Engineer II, you will enhance and maintain the foundational infrastructure that supports PagerDuty's real-time digital operations platform, ensuring reliability and scalability.

Site Reliability EngineeringDevOpsPlatform EngineeringLinux
Proton

Site Reliability Engineer - Storage

Proton👥 501 - 1000 employees🏢 Internet
🕒 25 days ago

Storage is at the very center of everything we do. Whatever needs to be persisted eventually uses our Storage infrastructure. For this we run our infrastructure predominantly on-premise in multiple data centers.

Storage InfrastructureAutomation ToolsMonitoring And AlertingIncident Response

Trusted by Remote Workers