Remote Jobs RockRemote Jobs Rock

Analista SRE Azure

📅 Jul 29
Microsoft AzureCloud InfrastructureTroubleshootingMonitoring

📜 Description

  • Act as an Azure SRE Analyst for the maintenance and administration of technology environments.
  • Support Azure workloads through administration, troubleshooting, monitoring, and performance optimization.
  • Ensure operational best practices and effective communication with vendors and internal teams.
  • Manage and sustain workloads in Microsoft Azure, addressing issues related to virtual machines, networks, and storage.
  • Enhance observability of critical environments by contributing metrics, logs, and dashboards.
  • Assist in defining and validating operational and technical dashboards.

🛠️ Requirements

  • Experiência prática com administração ou sustentação de ambientes Microsoft Azure.
  • Conhecimento em recursos Azure como Virtual Machines, Virtual Network, NSG, Storage Account, Azure Monitor, Log Analytics, Backup, identidade e permissões.
  • Experiência em troubleshooting de infraestrutura cloud, conectividade, servidores, aplicações, logs e performance.
  • Vivência com ambientes Windows Server e Linux.
  • Conhecimento em monitoramento de infraestrutura, preferencialmente com Zabbix, Elastic Search e kibana.
  • Capacidade de interpretar logs, métricas, eventos e alertas para apoio à resolução de incidentes.
  • Conhecimento intermediário em automação com PowerShell, Azure CLI, Bash ou Python.
  • Conhecimento de DevOps, CI/CD, versionamento, documentação técnica e gestão de mudanças.
  • Boa comunicação para interface com fornecedores, times técnicos e áreas internas.
  • Organização para documentar procedimentos, evidências, runbooks e critérios de aceite.
Full job description

Na Stefanini, acreditamos no poder da colaboração. Co-criamos soluções inovadoras em parceria com nossos clientes, combinando tecnologia de ponta, inteligência artificial e a criatividade humana. Estamos na vanguarda da resolução de problemas de negócios, proporcionando impacto real em escala global.


Ao se juntar à Stefanini, você se torna parte de uma jornada global de transformação. Estamos empenhados em criar impacto positivo não apenas nos negócios, mas também na vida de nossos colaboradores. Se você procura uma oportunidade de crescimento profissional em uma empresa que valoriza inovação, respeito, autonomia e parceria, você encontra aqui!

Junte-se a nós e seja parte da mudança!


#LI-HYBRID

#LI-AR1

Responsibilities

  • Analista SRE Azure para atuar na sustentação, administração e melhoria contínua dos ambientes de tecnologia da companhia, com foco em Microsoft Azure, observabilidade, automação operacional, análise de incidentes e confiabilidade dos serviços críticos.
  • O profissional apoiará a operação dos workloads em Azure, atuando em administração, troubleshooting, monitoramento, disponibilidade, performance, automações e boas práticas de sustentação cloud.
  • A posição exige boa base técnica em infraestrutura, cloud, monitoramento, análise de logs, automação e operação de ambientes críticos, além de boa comunicação para interação com fornecedores, times técnicos e áreas internas.
  • Administrar e sustentar workloads em Microsoft Azure, apoiando a operação diária dos ambientes cloud.
  • Atuar no troubleshooting de recursos Azure, incluindo máquinas virtuais, redes, storage, conectividade, permissões, performance, disponibilidade e integrações.
  • Apoiar a evolução da observabilidade dos ambientes críticos, contribuindo com métricas, logs, eventos, dashboards, alertas e indicadores de disponibilidade.
  • Apoiar a definição, priorização e validação de dashboards operacionais, técnicos e executivos.
  • Traduzir necessidades dos times de infraestrutura, cloud, redes, segurança e aplicações em requisitos técnicos para o fornecedor.
  • Apoiar a criação de visibilidade sobre servidores, redes, links, bancos de dados, aplicações, integrações, ambientes cloud e serviços críticos.
  • Contribuir para a criação de alertas mais acionáveis, reduzindo ruído operacional e melhorando a resposta a incidentes.
  • Apoiar demandas relacionadas a Azure Monitor, Log Analytics, diagnósticos, análise de logs e alertas nativos dos recursos cloud.
  • Participar da análise de incidentes, correlação de eventos, identificação de causa raiz e proposição de ações corretivas e preventivas.
  • Contribuir com automações operacionais utilizando PowerShell, Azure CLI, Bash, Python ou ferramentas similares.
  • Apoiar iniciativas DevOps relacionadas a deploys, pipelines, versionamento, padronização de ambientes, documentação e redução de atividades manuais.
  • Apoiar a integração da plataforma de observabilidade com ferramentas de ITSM, canais de comunicação, NOC, fluxos de escalonamento e processos de incidentes.
  • Acompanhar indicadores de saúde, capacidade, disponibilidade, performance, MTTR, reincidência de incidentes e qualidade da monitoração.
  • Participar da construção e manutenção de runbooks, documentações técnicas, mapas de monitoração, procedimentos operacionais e evidências de sustentação.
  • Interagir com fornecedores, times internos e áreas técnicas para resolução de problemas, melhoria contínua e evolução dos ambientes cloud e da plataforma de observabilidade.

Requirements

  • Experiência prática com administração ou sustentação de ambientes Microsoft Azure.
  • Conhecimento em recursos Azure como Virtual Machines, Virtual Network, NSG, Storage Account, Azure Monitor, Log Analytics, Backup, identidade e permissões.
  • Experiência em troubleshooting de infraestrutura cloud, conectividade, servidores, aplicações, logs e performance.
  • Vivência com ambientes Windows Server e Linux.
  • Conhecimento em monitoramento de infraestrutura, preferencialmente com Zabbix, Elastic Search e kibana.
  • Capacidade de interpretar logs, métricas, eventos e alertas para apoio à resolução de incidentes.
  • Conhecimento intermediário em automação com PowerShell, Azure CLI, Bash ou Python.
  • Conhecimento de DevOps, CI/CD, versionamento, documentação técnica e gestão de mudanças.
  • Boa comunicação para interface com fornecedores, times técnicos e áreas internas.
  • Organização para documentar procedimentos, evidências, runbooks e critérios de aceite.


Requisitos desejáveis:


  • Conhecimento em Elastic Stack: Elasticsearch, Kibana, Logstash, Filebeat ou Metricbeat.
  • Vivência com Azure DevOps, GitHub Actions ou pipelines de CI/CD.
  • Noções de Kubernetes, AKS, Docker ou containers.
  • Conhecimento em Infrastructure as Code, como Terraform ou Bicep.
  • Experiência com criação ou validação de dashboards técnicos e executivos.
  • Conhecimento em práticas SRE, como SLI, SLO, redução de MTTR, postmortem e melhoria contínua.


Certificações desejáveis: Qualquer uma das certificações abaixo serão consideradas diferenciais:


  • Microsoft Certified: Azure Administrator Associate — AZ-104.
  • Microsoft Certified: Azure DevOps Engineer Expert — AZ-400.
  • Zabbix Certified Specialist.
  • Elastic Certified Engineer.
  • HashiCorp Certified: Terraform Associate.
SpaceX

Site Reliability Engineer (Manufacturing Infrastructure)

🕒 28 days ago
SpaceX👥 10,000+ employees🏢 Aviation And Aerospace Component Manufacturing🤝 B2B

As a Site Reliability Engineer for Manufacturing Infrastructure, you will enhance the reliability and scalability of systems supporting SpaceX's manufacturing processes.

Site Reliability EngineeringDevOpsInfrastructure As CodeLinux
OpenTable

Site Reliability Engineer II (AI Platform)

🕒 yesterday
OpenTable👥 1001 - 5000 employees🏢 Hospitality

As a Site Reliability Engineer II, you will design, automate, and manage the core container stack and infrastructure, ensuring reliability and efficiency for global business applications.

LinuxKubernetesCloud-native AutomationContainer Management

Trusted by Remote Workers