DEVOPS/SRE II
Resumo: Atuar como responsável por garantir a confiabilidade, disponibilidade, desempenho e escalabilidade dos ambientes e aplicações da organização e terá papel fundamental na evolução das práticas de confiabilidade, automação operacional e observabilidade, trabalhando em parceria com equipes de desenvolvimento, infraestrutura, segurança e operações para promover uma cultura orientada à estabilidade e melhoria contínua.
Responsabilidades:Garantir a disponibilidade, estabilidade e performance dos ambientes produtivos.
Atuar na investigação, mitigação e resolução de incidentes em ambientes críticos.
Participar de war rooms, apoiando a análise técnica e a restauração dos serviços.
Implementar e manter soluções de observabilidade, monitoramento, logs, métricas e alertas.
Desenvolver e manter automações operacionais para reduzir atividades manuais e recorrentes.
Executar rotinas de sustentação, deploy, troubleshooting e validação de ambientes.
Apoiar iniciativas de segurança operacional, correção de vulnerabilidades e aplicação de boas práticas.
Acompanhar pipelines, integrações e processos de CI/CD, atuando na resolução de falhas.
Participar de análises de causa raiz (RCA) e apoiar a elaboração de planos de ação.
Conduzir revisões pós-incidente com foco em aprendizado contínuo e melhoria dos processos.
Definir, acompanhar e reportar indicadores de confiabilidade, disponibilidade, incidentes e performance.
Realizar capacity planning e identificar gargalos de infraestrutura, aplicações e serviços.
Propor melhorias em automações, monitoramento, pipelines e processos operacionais.
Apoiar a evolução de práticas de SRE alinhadas às necessidades das áreas técnicas e de negócio.
Acompanhar a evolução das demandas analíticas, priorizando entregas conforme impacto para o negócio.
Participar da definição de estratégias de alta disponibilidade, recuperação de desastres e continuidade de serviços.
Contribuir para a evolução das práticas de SRE e DevOps, alinhando confiabilidade, eficiência operacional e objetivos do negócio.
Apoiar decisões técnicas relacionadas à arquitetura operacional, resiliência e escalabilidade dos ambientes.
Identificar oportunidades de melhoria estrutural para aumentar maturidade, confiabilidade e eficiência dos serviços.
·Requisitos da vaga:
Ensino super completo em Ciência da Computação; Engenharia da Computação; Sistemas de Informação; Redes de computadores; Segurança da Informação.
Conceitos de redes: (TCP/IP, DNS, HTTP/HTTPS, Balanceamento de carga, Firewalls, VPN, Certificados SSL/TLS);
Cloud Computing (AWS preferencialmente)
Containers e Orquestração;
Ferramentas de observabilidade e monitoramento (Prometheus, Grafana, Datadog, New Relic, Zabbix)
Automação (Python, bash, powershell);
Conhecimentos de Banco de Dados SQL e Postgress (diferencial).
Benefícios:
Vale Refeição ou Alimentação.
Cartão multibenefícios.
Assistência Odontológica.
Convênio médico.
❤ Seguro de Vida.
Vale Transporte.
Parcerias com faculdades.
Parceria com o SESC.
Day Off no mês do aniversário.
Wellhub.
Alerta-me sobre empregos como este
Regine de Contratação PJ • Desenvolver aplicações web utilizando tecnologias Front-end e Back-end; • Projetar, desenvolver e manter APIs REST...
Candidatar-se a Este EmpregoDescrição Você fará parte do time como Data Engineer Pleno na plataforma de dados corporativos da RD – Totvs, dentro...
Candidatar-se a Este EmpregoSobre a oportunidade Buscamos uma pessoa para atuar como SAP Hybris / SAP Commerce Cloud Business Analyst em projeto de...
Candidatar-se a Este EmpregoJunte-se à Skopia Digital: Code o futuro, impacte milhões! Na Skopia Digital, tecnologia é sinônimo de transformação. Somos a fusão...
Candidatar-se a Este EmpregoSobre a oportunidade: Nosso cliente atua na construção de soluções de infraestrutura financeira e tecnologia para o mercado de serviços...
Candidatar-se a Este EmpregoA primeira coisa que você precisa saber é que aqui você não vai cair na rotina. A Radix desenvolve soluções...
Candidatar-se a Este Emprego