Texto agregado para leitura rápida. Confira sempre a fonte original ao enviar a candidatura.
Buscamos um(a) Site Reliability Engineer (SRE) com experiência em Dynatrace para atuar na evolução da maturidade de observabilidade, confiabilidade e performance de ambientes críticos.
O profissional será responsável por apoiar a implementação de práticas de SRE, atuar na redução de ruídos operacionais, análise de causa raiz, definição de indicadores de confiabilidade e evolução contínua da observabilidade das aplicações e serviços.
A posição exige forte capacidade analítica, visão sistêmica e habilidade para atuar de forma colaborativa com equipes multidisciplinares de infraestrutura, operações, desenvolvimento e negócio.
Principais responsabilidades
- Administrar, evoluir e otimizar a plataforma Dynatrace.
- Realizar análises de performance e disponibilidade de aplicações e serviços críticos.
- Implementar e acompanhar métricas de confiabilidade através de SLIs, SLOs e Error Budgets.
- Criar e evoluir dashboards executivos e operacionais.
- Desenvolver runbooks, playbooks e procedimentos operacionais.
- Conduzir análises de causa raiz (RCA) utilizando métricas, logs, traces e topologia de dependências.
- Reduzir falsos positivos, eventos duplicados e ruídos operacionais.
- Apoiar a definição e implementação de práticas de observabilidade moderna.
- Participar de war rooms e troubleshooting de incidentes críticos.
- Conduzir post-mortems sem culpabilização, identificando oportunidades de melhoria.
- Apoiar iniciativas de automação operacional e self-healing.
- Atuar na construção e priorização de backlog de confiabilidade e observabilidade.
- Promover transferência de conhecimento para equipes técnicas e operacionais.
- Produzir relatórios técnicos e executivos demonstrando evolução da maturidade operacional.
Conhecimentos técnicos
- Dynatrace (Application Monitoring, Infrastructure Monitoring, Distributed Tracing e Davis AI).
- Observabilidade (Métricas, Logs, Traces e Topologia).
- Conceitos de SRE.
- SLI, SLO e Error Budget.
- Análise de Performance de Aplicações (APM).
- Troubleshooting de ambientes distribuídos.
- Sistemas Linux e Windows.
- Protocolos Web (HTTP, HTTPS, APIs REST).
- Bancos de dados relacionais.
- ITSM e Gestão de Incidentes.
- Conceitos de Cloud Computing (AWS, Azure ou GCP).
Principais Entregáveis Esperados
Espera-se que o profissional seja capaz de:
- Estabelecer e evoluir SLIs e SLOs dos sistemas priorizados.
- Estruturar dashboards de confiabilidade e observabilidade.
- Reduzir ruídos e falsos positivos do ambiente monitorado.
- Produzir runbooks e playbooks operacionais.
- Apoiar a criação de backlog contínuo de melhorias.
- Conduzir análises de causa raiz e post-mortems.
- Implementar melhorias de observabilidade utilizando recursos avançados do Dynatrace.
- Apoiar iniciativas de automação e confiabilidade operacional.
Requisitos Obrigatórios
- Diploma de nível superior e experiência em operações de TI, observabilidade, monitoramento ou confiabilidade.
- Experiência prática com Dynatrace em ambientes corporativos.
- Experiência em diagnóstico de aplicações distribuídas.
- Vivência em ambientes críticos com requisitos elevados de disponibilidade.
- Certificações Dynatrace Associate ou Professional.
Diferenciais
- Curso de Pós Graduação
- Outras Certificações na área
- Conhecimento em OpenTelemetry.
- Experiência com Kubernetes e containers.
- Experiência com automação utilizando Python, Shell Script ou PowerShell.
- Conhecimento em Grafana, Prometheus, Elastic, Splunk ou Zabbix.
- Experiência em ambientes DevOps e CI/CD.
- Vivência com AIOps e automação de operações.
About The Company
A Solutis é Digital!
Somos apaixonados por tecnologia e esse valor está presente em nossas ações e proposta de trabalho. Ambiente descontraído e criativo, horário flexível, possibilidade de trabalho home office, eventos e programas internos com games... Isso faz parte do nosso dia-a-dia.
Engajamento, busca intensa por conhecimento, empatia e criatividade são a nossa receita para cultivar e colher, sempre, o melhor resultado tecnológico.
Essa é a Solutis, flexível, acolhedora, inquieta, amante da tecnologia e de tudo que ela nos proporciona de mais incrível.
Para essa oportunidade, oferecemos Benefícios que fazem a diferença! 🌟
🔹 Vale Refeição ou Alimentação (Alelo): Escolha como aproveitar!
🔹 Auxílio Home Office: Um suporte proporcional aos dias remotos.
🔹 Assistência Médica e Odontológica SulAmérica: Cuidamos da sua saúde!
🔹 Seguro de Vida: Segurança para você e sua família.
🔹 Parcerias Exclusivas: Descontos em cursos de idiomas, educação, livrarias, restaurantes e muito mais!
🔹 Wellhub: Bem-estar em primeiro lugar.
🔹 Allya: Benefícios e descontos em um só lugar.
🔹 Day Off: Porque todo mundo merece uma folga especial.
🔹 Premiação por Indicações: Indique talentos e seja recompensado!
🔹 Inside Out: Quarta-feira de troca de conhecimento e muito networking.
🔹 Oportunidade de Crescimento: Construa sua trajetória com a gente!
🔹 Diversidade, todas as nossas vagas são afirmativas: Sua singularidade é nosso diferencial.
✨ Venha fazer parte de um time que valoriza você e suas conquistas! 🚀