Talent.com
#sejaveriter
SRE Engineer - REMOTO#sejaveriter • Brasil
SRE Engineer - REMOTO

SRE Engineer - REMOTO

#sejaveriter • Brasil
Há 17 dias
Tipo de vaga
  • Remota
Descrição da vaga

A Verity é uma consultoria de Transformação e Engenharia Digital.


Estruturamos tecnologia para funcionar, escalar e gerar valor real. Atuamos na Modernização de Aplicações, decisões críticas de Arquitetura, Engenharia de Software e Dados, Experiência Digital e orquestração de processos com Inteligência Artificial.


Com o Verity Quantum®, nosso orquestrador de IA, conectamos engenharia, plataformas e operações para modernizar legados, otimizar código e acelerar decisões com impacto direto no negócio.


Há 16 anos, trabalhamos ao lado de mais de 100 empresas líderes em seus mercados, nos setores financeiro, saúde, varejo, indústria e serviços, transformando estratégia em soluções tecnológicas que geram eficiência, escala e vantagem competitiva.


Desde 2019, somos certificados como Great Place to Work - GPTW, reconhecimento que reforça nossa cultura baseada em transparência, confiança e compromisso real com a entrega.



INICIATIVAS VERITY_

Aqui na Verity temos diversas ações que estimulam a troca de conhecimento:



FAZER O MELHOR E O QUE É CERTO, SEMPRE_

Esse é o mantra que nos guia da modernização à aceleração digital para ofereceremos soluções de ponta a ponta da jornada de tecnologia.


VAGA PERFEITA_

Ser Veriter é ter coragem para evoluir, pensar diferente e contribuir com insights antes nunca imaginados. Aqui na Verity você tem vale refeição e alimentação, assistência médica e odontológica, seguro de vida, parceria com a Total Pass para cuidar da saúde, auxílio home office, acesso a cursos para desenvolvimento, day off no aniversário e outras iniciativas que não param de surgir.



/n

Experiência como Site Reliability Engineer, SRE ou função equivalente.


Experiência prática com ambientes Cloud, utilizando GCP, AWS e/ou Azure.


Conhecimento em Kubernetes e Docker.


Experiência com observabilidade, monitoramento, alertas e APM.


Conhecimento em métricas e práticas de SRE, como SLI, SLO, SLA, MTTR e MTTD.


Experiência em gestão, investigação e resolução de incidentes.


Conhecimento em troubleshooting de aplicações e infraestrutura.


Experiência com administração de ambientes Linux.


Conhecimento em redes, segurança, performance e alta disponibilidade.


Experiência com automação e Infrastructure as Code.


Vivência com pipelines de CI/CD.


Boa comunicação e capacidade de atuar com times multidisciplinares.


Perfil analítico, proativo, colaborativo e orientado à prevenção de problemas.


Diferenciais:

Experiência com GKE, EKS ou AKS.


Conhecimento em Dynatrace, Datadog, Grafana, Prometheus ou ferramentas similares.


Experiência com ELK Stack, Elasticsearch e Kibana.


Conhecimento em Terraform e Ansible.


Experiência com ambientes críticos e sistemas distribuídos.


Vivência em instituições financeiras ou ambientes regulados.


Experiência com gestão de capacidade e otimização de custos Cloud.


Conhecimento em disaster recovery e continuidade de negócio.


Experiência na definição e gestão de error budgets.


Certificações em Cloud, Kubernetes ou SRE.

/n

Definir e acompanhar SLIs, SLOs, SLAs, MTTR e MTTD.


Implementar observabilidade, monitoramento, alertas e APM.


Monitorar latência, tráfego, erros, saturação, disponibilidade e performance.


Atuar na prevenção, identificação e resolução de incidentes.


Conduzir análises de causa raiz e definir ações para evitar recorrências.


Identificar riscos, gargalos e pontos únicos de falha.


Apoiar o desenho de soluções resilientes, escaláveis e altamente disponíveis.


Automatizar atividades operacionais e reduzir tarefas manuais.


Operar e evoluir ambientes Kubernetes e Docker.


Apoiar estratégias de capacidade, continuidade e recuperação de desastres.


Participar de deploys e apoiar a estabilização das aplicações.


Trabalhar com os times para melhorar a confiabilidade desde a concepção das soluções.


Criar e manter dashboards, alertas, procedimentos e documentação operacional.


Promover uma cultura de confiabilidade, observabilidade e melhoria contínua.

Criar um alerta de emprego para esta pesquisa

SRE Engineer - REMOTO • Brasil