Remote Jobs RockRemote Jobs Rock

SRE ESPECIALISTA - GCP (SITE RELIABILITY ENGINEER)

📅 Aug 13
Google Cloud PlatformGKEKubernetesTerraform

📜 Description

  • Projetar e manter a infraestrutura da empresa na GCP.
  • Administrar ambientes baseados em GKE, Cloud Run e serviços gerenciados.
  • Construir e evoluir módulos Terraform reutilizáveis.
  • Definir padrões de rede, IAM, Service Accounts e gestão de segredos.
  • Aplicar práticas de least privilege e segregação entre ambientes.
  • Implementar observabilidade de infraestrutura e serviços com métricas, logs e tracing.

🛠️ Requirements

  • Experiência prática com Google Cloud Platform.
  • Conhecimento de GKE e Kubernetes.
  • Experiência com Terraform e infraestrutura como código.
  • Conhecimento de IAM, Service Accounts, Workload Identity e Secret Manager.
  • Experiência com redes na GCP, incluindo VPC, firewall, DNS e balanceamento de carga.
  • Conhecimento de Docker e operação de aplicações em containers.
  • Experiência com observabilidade, monitoramento e resposta a incidentes.
  • Experiência com automação utilizando Bash, Python ou Go.
Full job description

Somos o Grupo Energisa! Com mais de cem anos de história, a Energisa é o maior grupo privado com controle 100% nacional do setor elétrico brasileiro. Nosso portfólio diversificado abrange distribuidoras, concessões de transmissão, geração de grande porte renovável, uma marca inovadora de soluções energéticas – a (re)energisa –, com geração distribuída por fonte renovável, comercialização de energia no mercado livre e serviços de valor agregado, além de uma central de serviços compartilhados, uma empresa de contact center e a fintech Voltz, a primeira do nosso setor no mercado de contas digitais. Recentemente, diversificamos nosso portfólio com a inclusão da distribuição de gás natural, através da aquisição da ES Gás. Transformamos, através de nossos mais de 17.000 colaboradores, energia em conforto e desenvolvimento para mais de 20 milhões de pessoas. Acreditamos na força da diversidade e da pluralidade para gerar inovação e atingir resultados incríveis. Aqui todos são muito bem-vindos! Quer fazer parte desta história? Confere se esta oportunidade tem match com o seu perfil e vem conosco participar desta jornada de seleção!

Responsibilities

  • Projetar e manter a infraestrutura da empresa na GCP.
  • Administrar ambientes baseados em GKE, Cloud Run e serviços gerenciados.
  • Construir e evoluir módulos Terraform reutilizáveis.
  • Definir padrões de rede, IAM, Service Accounts e gestão de segredos.
  • Aplicar práticas de least privilege e segregação entre ambientes.
  • Estruturar mecanismos seguros de deploy entre pipeline e runtime.
  • Implementar observabilidade de infraestrutura e serviços com métricas, logs e tracing.
  • Apoiar os times na definição de SLIs, SLOs, alertas e capacity planning.
  • Automatizar provisionamento, configuração e tarefas operacionais recorrentes.
  • Atuar na investigação de incidentes e na eliminação de causas recorrentes.
  • Implementar controles de segurança sobre imagens, workloads e configurações de cloud.
  • Monitorar custos, capacidade, disponibilidade e riscos operacionais da plataforma.
  • Documentar padrões e orientar os times no uso seguro da infraestrutura.

Requirements

Requisitos


  • Experiência prática com Google Cloud Platform.
  • Conhecimento de GKE e Kubernetes.
  • Experiência com Terraform e infraestrutura como código.
  • Conhecimento de IAM, Service Accounts, Workload Identity e Secret Manager.
  • Experiência com redes na GCP, incluindo VPC, firewall, DNS e balanceamento de carga.
  • Conhecimento de Docker e operação de aplicações em containers.
  • Experiência com observabilidade, monitoramento e resposta a incidentes.
  • Conhecimento de alta disponibilidade, escalabilidade, backups e disaster recovery.
  • Experiência com automação utilizando Bash, Python ou Go.
  • Conhecimento de práticas de DevSecOps aplicadas à infraestrutura e ao runtime.


Diferenciais


  • Experiência com Cloud SQL, Pub/Sub, Memorystore e Artifact Registry.
  • Experiência com Datadog e OpenTelemetry.
  • Conhecimento de Policy as Code, como OPA ou Gatekeeper.
  • Experiência com hardening de clusters e workloads Kubernetes.
  • Conhecimento de SBOM, assinatura de imagens e controles de software supply chain.
  • Experiência com FinOps e otimização de custos em cloud.
  • Experiência em ambientes financeiros, regulados ou com requisitos de auditoria.
  • Certificação Professional Cloud DevOps Engineer, Cloud Architect ou equivalente.
Social-Discovery-Ventures

Site Reliability Engineer (SRE)

🕒 2 days ago
Social-Discovery-Ventures👥 501 - 1000 employees🏢 Computer Software

As a Site Reliability Engineer (SRE), you will enhance infrastructure reliability, automate processes, and develop scalable production systems to support our social discovery platforms.

Site Reliability EngineeringInfrastructure ReliabilityAutomationKubernetes
Arista Networks

FedRAMP Site Reliability Engineer (FedSRE) - CloudVision

🕒 15 days ago
Arista Networks👥 5001 - 10,000 employees🏢 Computer Networking

Join Arista's FedRAMP CloudVision-as-a-Service SRE team as a Site Reliability Engineer, driving projects focused on scalability, reliability, and performance in cloud environments.

Site Reliability EngineeringCloud ComputingKubernetesGCP

Red Hat is seeking a Customer Site Reliability Engineer to ensure the reliability and performance of critical services in the OpenShift Managed Cloud Services team.

📍 🇦🇺 Australia - Remote💼 Full-Time🎹 Mid-level⭐ Site Reliability Engineer📢 🇬🇧 English Required📢 🇯🇵 Japanese Required
OpenshiftKubernetesLinuxAWS

Trusted by Remote Workers