Descrição da vaga

Texto agregado para leitura rápida. Confira sempre a fonte original ao enviar a candidatura.

Buscamos um(a) Site Reliability Engineer (SRE) com experiência em Dynatrace para atuar na evolução da maturidade de observabilidade, confiabilidade e performance de ambientes críticos.

O profissional será responsável por apoiar a implementação de práticas de SRE, atuar na redução de ruídos operacionais, análise de causa raiz, definição de indicadores de confiabilidade e evolução contínua da observabilidade das aplicações e serviços.

A posição exige forte capacidade analítica, visão sistêmica e habilidade para atuar de forma colaborativa com equipes multidisciplinares de infraestrutura, operações, desenvolvimento e negócio.

Principais responsabilidades

  • Administrar, evoluir e otimizar a plataforma Dynatrace.
  • Realizar análises de performance e disponibilidade de aplicações e serviços críticos.
  • Implementar e acompanhar métricas de confiabilidade através de SLIs, SLOs e Error Budgets.
  • Criar e evoluir dashboards executivos e operacionais.
  • Desenvolver runbooks, playbooks e procedimentos operacionais.
  • Conduzir análises de causa raiz (RCA) utilizando métricas, logs, traces e topologia de dependências.
  • Reduzir falsos positivos, eventos duplicados e ruídos operacionais.
  • Apoiar a definição e implementação de práticas de observabilidade moderna.
  • Participar de war rooms e troubleshooting de incidentes críticos.
  • Conduzir post-mortems sem culpabilização, identificando oportunidades de melhoria.
  • Apoiar iniciativas de automação operacional e self-healing.
  • Atuar na construção e priorização de backlog de confiabilidade e observabilidade.
  • Promover transferência de conhecimento para equipes técnicas e operacionais.
  • Produzir relatórios técnicos e executivos demonstrando evolução da maturidade operacional.

Conhecimentos técnicos

  • Dynatrace (Application Monitoring, Infrastructure Monitoring, Distributed Tracing e Davis AI).
  • Observabilidade (Métricas, Logs, Traces e Topologia).
  • Conceitos de SRE.
  • SLI, SLO e Error Budget.
  • Análise de Performance de Aplicações (APM).
  • Troubleshooting de ambientes distribuídos.
  • Sistemas Linux e Windows.
  • Protocolos Web (HTTP, HTTPS, APIs REST).
  • Bancos de dados relacionais.
  • ITSM e Gestão de Incidentes.
  • Conceitos de Cloud Computing (AWS, Azure ou GCP).

Principais Entregáveis Esperados

Espera-se que o profissional seja capaz de:

  • Estabelecer e evoluir SLIs e SLOs dos sistemas priorizados.
  • Estruturar dashboards de confiabilidade e observabilidade.
  • Reduzir ruídos e falsos positivos do ambiente monitorado.
  • Produzir runbooks e playbooks operacionais.
  • Apoiar a criação de backlog contínuo de melhorias.
  • Conduzir análises de causa raiz e post-mortems.
  • Implementar melhorias de observabilidade utilizando recursos avançados do Dynatrace.
  • Apoiar iniciativas de automação e confiabilidade operacional.

Requisitos Obrigatórios

  • Diploma de nível superior e experiência em operações de TI, observabilidade, monitoramento ou confiabilidade.
  • Experiência prática com Dynatrace em ambientes corporativos.
  • Experiência em diagnóstico de aplicações distribuídas.
  • Vivência em ambientes críticos com requisitos elevados de disponibilidade.
  • Certificações Dynatrace Associate ou Professional.

Diferenciais

  • Curso de Pós Graduação
  • Outras Certificações na área
  • Conhecimento em OpenTelemetry.
  • Experiência com Kubernetes e containers.
  • Experiência com automação utilizando Python, Shell Script ou PowerShell.
  • Conhecimento em Grafana, Prometheus, Elastic, Splunk ou Zabbix.
  • Experiência em ambientes DevOps e CI/CD.
  • Vivência com AIOps e automação de operações.

About The Company

A Solutis é Digital!

Somos apaixonados por tecnologia e esse valor está presente em nossas ações e proposta de trabalho. Ambiente descontraído e criativo, horário flexível, possibilidade de trabalho home office, eventos e programas internos com games... Isso faz parte do nosso dia-a-dia.

Engajamento, busca intensa por conhecimento, empatia e criatividade são a nossa receita para cultivar e colher, sempre, o melhor resultado tecnológico.

Essa é a Solutis, flexível, acolhedora, inquieta, amante da tecnologia e de tudo que ela nos proporciona de mais incrível.

Para essa oportunidade, oferecemos Benefícios que fazem a diferença! 🌟

🔹 Vale Refeição ou Alimentação (Alelo): Escolha como aproveitar!

🔹 Auxílio Home Office: Um suporte proporcional aos dias remotos.

🔹 Assistência Médica e Odontológica SulAmérica: Cuidamos da sua saúde!

🔹 Seguro de Vida: Segurança para você e sua família.

🔹 Parcerias Exclusivas: Descontos em cursos de idiomas, educação, livrarias, restaurantes e muito mais!

🔹 Wellhub: Bem-estar em primeiro lugar.

🔹 Allya: Benefícios e descontos em um só lugar.

🔹 Day Off: Porque todo mundo merece uma folga especial.

🔹 Premiação por Indicações: Indique talentos e seja recompensado!

🔹 Inside Out: Quarta-feira de troca de conhecimento e muito networking.

🔹 Oportunidade de Crescimento: Construa sua trajetória com a gente!

🔹 Diversidade, todas as nossas vagas são afirmativas: Sua singularidade é nosso diferencial.

✨ Venha fazer parte de um time que valoriza você e suas conquistas! 🚀

Vagas relacionadas

Seleção por stack em comum com esta oportunidade

LinkedIn

Senior Software Engineer Python

Thomson Reuters Brasil São Paulo 25 candidaturas Hoje

Salário estimado

R$ 15k - 23k/mês

Sênior CLT

The AI Platform team has been established to build, develop, and run the Enterprise AI Platform. The Enterprise AI Platform serves as a comprehensive ecosystem of collaborative services, tools, and infrastructure, empowering both technical and non-technical users to seamlessly develop, evaluate, dep...

Ver Detalhes
Remoto LinkedIn

[Fully Remote] Full-Stack Software Engineer (Typescript, React, Next.js, Tailwind, Postgresql)

Reverie São Paulo 28 candidaturas Hoje

Salário estimado

R$ 4k - 7k/mês

Júnior CLT

Join Reverie as a Full-Stack Product Engineer and help us ship features for IEBridge, https://iebridge.com. A platform to manage US exchange students during their travels. From building responsive React to designing scalable backend systems to integrating AI-powered features, you’ll be crucial in de...

Ver Detalhes
LinkedIn

Analista de desenvolvimento de software Sênior

Serasa Experian Blumenau, Santa Catarina, Brazil 25 candidaturas Hoje

Salário estimado

R$ 11k - 16k/mês

Sênior CLT

Company DescriptionA Experian é uma empresa global de dados e tecnologia que impulsiona oportunidades para pessoas e empresas ao redor do mundo. Atuamos em diversos mercados, como serviços financeiros, saúde, automotivo, agronegócio, seguros, entre outros. A Experian investe em pessoas e em novas te...

Ver Detalhes