Course Library: the market's top courses for a single payment of R$ 29.90TAP HERETraffic management, digital marketing, sales, copywriting and much moreOne payment. Access to every courseCourse Library: the market's top courses for a single payment of R$ 29.90TAP HERETraffic management, digital marketing, sales, copywriting and much moreOne payment. Access to every courseCourse Library: the market's top courses for a single payment of R$ 29.90TAP HERETraffic management, digital marketing, sales, copywriting and much moreOne payment. Access to every courseCourse Library: the market's top courses for a single payment of R$ 29.90TAP HERETraffic management, digital marketing, sales, copywriting and much moreOne payment. Access to every course

Especialista SRE – Observabilidade & IaC

4Solution Group

São Paulo, SP, São Paulo, SP, Brazil, BR Remote opportunityTecnologia

About this job

Código da Vaga: 1764

### Empresa

### Área(s) de Atuação

TI - Banco de Dados

### Descrição da Vaga

Período: 6 meses, com possibilidade de renovação a partir do desempenho

100% remoto

Requisitos

Buscamos um(a) Especialista SRE com forte experiência em Observabilidade, Cloud e Infrastructure as Code (IaC) para atuar na evolução, automação, confiabilidade e governança de ambientes Azure.

O profissional terá atuação hands-on e consultiva, apoiando a definição de padrões, automações, troubleshooting e boas práticas de SRE.

Principais responsabilidades

  • Implementar e evoluir a observabilidade com Datadog (APM, Logs, Métricas e Distributed Tracing);
  • Criar dashboards, monitors, alerts e integrações;
  • Definir e acompanhar SLIs, SLOs e Error Budgets;
  • Implementar Observability as Code, provisionando dashboards, monitors, alerts e integrações Datadog via Terraform;
  • Garantir versionamento, review e criação de templates reutilizáveis de observabilidade;
  • Estruturar e evoluir práticas de IaC com Terraform, incluindo módulos e templates reutilizáveis;
  • Atuar no troubleshooting de aplicações, APIs e ambientes Cloud;
  • Realizar troubleshooting em Kubernetes/AKS, incluindo workloads, networking, ingress, resources e autoscaling;
  • Apoiar automações e pipelines de CI/CD;
  • Atuar em Incident Management, investigação de incidentes e Root Cause Analysis (RCA);
  • Definir boas práticas de governança, naming e tagging;
  • Documentar padrões e realizar transferência de conhecimento para os times.

Requisitos técnicos

  • Datadog e práticas SRE;
  • Terraform / Infrastructure as Code (IaC);
  • Observability as Code;
  • Microsoft Azure e AKS;
  • Kubernetes e Helm;
  • Troubleshooting de workloads, networking, ingress, resources e autoscaling;
  • Azure DevOps ou ferramenta equivalente de CI/CD;
  • Automação e scripting com Python, Bash ou PowerShell;
  • APM, Logs, Métricas e Distributed Tracing;
  • Git e versionamento;
  • Incident Management e Root Cause Analysis (RCA);
  • Automação e governança Cloud;
  • AWS será considerado um diferencial.
  • Localização

São Paulo - SP

  • Modalidade de Trabalho

Remoto

  • Nível Profissional

Consultor / Desenvolvedor Sênior

  • Nível Acadêmico Mínimo

Ensino Superior Graduação Completo

  • Tipo de Contrato

PJ

Official application link

RDV keeps the existing token and application flow on the main job page.

Unlock application