Coordenador(a) de Observabilidade | AIOps
Há 6 dias
São Paulo, São Paulo, Brasil
Claro
Tempo integral
R$ 446.000 - R$ 781.000 Contrato
Grátis com e-mail ou Google
Salve esta vaga e mantenha sua pesquisa organizada
Crie uma conta gratuita para salvar vagas, criar alertas e retornar a esta listagem a partir do seu painel.
Grátis com e-mail ou Google
Job description
Main responsibilities
O que te espera no dia a dia:
- Liderança de Equipe: A coordenação deve liderar e motivar a equipe de AIOps, fornecendo orientação e apoio para alcançar os objetivos do time.
- Desenvolvimento de Estratégias: Ele deve desenvolver e implementar estratégias eficazes para melhorar a eficiência operacional, a resiliência do sistema e a detecção proativa de problemas por meio da aplicação de técnicas de AIOps e Observabilidade.
- Gestão de Projetos: Responsável por gerenciar projetos relacionados à implementação de soluções de AIOps e observabilidade, garantindo que sejam concluídos dentro do prazo e do orçamento estabelecidos.
- Implementação de Tecnologias: Supervisionar a implementação e integração de ferramentas e tecnologias de AIOps e observabilidade, garantindo que atendam às necessidades do time e da tecnologia.
- Análise de Dados: Utilizar técnicas avançadas de análise de dados e aprendizado de máquina para extrair insights significativos dos dados operacionais, identificando padrões, tendências e anomalias.
- Melhoria Contínua: Promover uma cultura de melhoria contínua dentro do time, buscando constantemente maneiras de otimizar processos, aumentar a eficiência e melhorar a qualidade dos serviços de TI.
- Colaboração Interdepartamental: Trabalhar em estreita colaboração com outros times (TI, Segurança, Engenharia, Digital, Negócios), para garantir uma abordagem integrada e holística para operações de TI.
- Gestão de Incidentes e Problemas: Lidar com incidentes críticos e problemas complexos, utilizando técnicas de AIOps e observabilidade para uma resolução rápida e eficaz.
- Monitoramento e Alerta: Estabelecer e manter sistemas de monitoramento e alerta robustos para detectar problemas de desempenho e indisponibilidade de sistemas de TI, garantindo alta disponibilidade e confiabilidade.
- Desenvolvimento de Talentos: Identificar lacunas de habilidades na equipe e implementar programas de desenvolvimento de talentos para capacitar os membros da equipe e manter-se atualizado com as tendências e tecnologias emergentes.
- Gestão de Serviços: conduzir a gestão operacional e contratual dos fornecedores vinculados ao time, assegurando aderência a SLAs e níveis de serviço acordados, controle de escopo e volumetria, governança de demandas e priorização, validação de entregas e faturamento, escalonamento de desvios e melhoria contínua da relação custo-benefício do contrato.
Requirements and skills
Buscamos alguém que:
- Pensa e age a partir das perspectivas dos clientes. Demonstra interesse e curiosidade de conhecer os clientes, seus comportamentos e preferências para atender e superar suas expectativas;
- Demonstra compromisso permanente em aprender, ensinar e desenvolver, contribuindo para um ambiente descontraído, respeitoso e colaborativo, incentivando a diversidade;
- É flexível para se desprender de paradigmas e modelos mentais existentes. Busca soluções inovadoras e sustentáveis, para criar vantagens competitivas para o negócio, equilibrando os interesses econômicos, ambientais e sociais.
Para fazer parte do nosso time, é essencial:
- Graduação Completa TI e/ou áreas correlatas;
Domínio técnico (intermediário a avançado)
- SRE: SLI/SLO/SLA, error budget, gestão de toil e princípios de confiabilidade aplicados à operação.
- Observabilidade: instrumentação e leitura de telemetria (métricas, logs, traces, RUM), golden signals e dashboards acionáveis — preferencialmente Dynatrace.
- AIOps: correlação de eventos, redução de ruído, detecção de anomalias e gestão de alertas/episódios (Splunk/ITSI ou equivalente).
- ITIL: Gestão de Incidente, Problema e Mudança aplicada à operação assistida (N1).
- DevOps: pipelines CI/CD, cultura de entrega contínua e colaboração Dev–Ops.
- Cloud: arquiteturas em nuvem (pública/híbrida) e seus modelos de operação e monitoração.
- Microsserviços: arquiteturas distribuídas, APIs e os desafios de observabilidade que impõem.
- Gestão Ágil: Scrum e Kanban aplicados à rotina operacional e à priorização de demandas.
Liderança e gestão
- Liderança de pessoas: conduzir, desenvolver e engajar equipe técnica, com gestão de desempenho e clima.
- Gestão de contrato de fornecedores: condução contratual com accountability sobre SLA, escopo, qualidade e custo.
- Comunicação executiva: traduzir indicadores técnicos em linguagem de negócio e reportar à gestão.
Postura e maturidade
- Maturidade emocional: equilíbrio e gestão de pressão para at