Back to jobs

ANALISTA DE SRE PLENO - VAGA AFIRMATIVA PARA MULHERES

Experian
Full-timemid
Sign in to applyFree account, takes a minute.

Job description

<p>Estamos em busca de uma&#xa0;<strong>Site Reliability Engineer (SRE)</strong>&#xa0;<strong>Plena </strong>altamente motivada para integrar nossa equipe de <strong>Cloud, Data &amp; AI Platform</strong>. Nesta função, você será responsável por projetar, operar e aprimorar continuamente a confiabilidade, escalabilidade, observabilidade e desempenho de plataformas cloud-native que suportam aplicações críticas para o negócio, pipelines de dados e cargas de trabalho de IA/ML.</p><p>Você trabalhará em estreita colaboração com as equipes de Engenharia de Software, Engenharia de Dados, Engenharia de IA e Plataforma para criar sistemas resilientes, automatizar operações, melhorar a experiência dos desenvolvedores e estabelecer as melhores práticas de confiabilidade em toda a organização.</p><p>Como engenheira plena, você desempenhará um papel fundamental no avanço da excelência operacional por meio de automação, observabilidade, gestão de incidentes, otimização de custos e modernização da infraestrutura.</p><p><strong>Principais Responsabilidades:</strong></p><ul><li>Projetar e operar plataformas em nuvem altamente disponíveis, escaláveis e seguras na AWS.</li><li>Construir e manter infraestrutura baseada em Kubernetes para suportar aplicações, dados e cargas de trabalho de IA.</li><li>Melhorar a confiabilidade da plataforma por meio de automação, Infraestrutura como Código (IaC) e recursos de autoatendimento (self-service).</li><li>Implementar e aprimorar soluções de observabilidade utilizando Datadog, incluindo monitoramento, logs, rastreamento (tracing), alertas, dashboards e gestão de SLOs.</li><li>Suportar e otimizar ambientes de processamento de dados em larga escala utilizando Airflow, Amazon EMR, S3 e outros serviços de dados da AWS.</li><li>Trabalhar em parceria com as equipes de Dados e IA para melhorar a confiabilidade, escalabilidade e maturidade operacional de plataformas de Machine Learning e Inteligência Artificial.</li><li>Liderar atividades de resposta a incidentes, análises de causa raiz e revisões pós-incidente, promovendo a melhoria contínua.</li><li>Definir e medir Indicadores de Nível de Serviço (SLIs), Objetivos de Nível de Serviço (SLOs) e orçamentos de erro (error budgets).</li><li>Aprimorar processos de implantação, pipelines de CI/CD e a confiabilidade das releases.</li><li>Otimizar a utilização, desempenho e custos da infraestrutura em nuvem.</li><li>Mentorar membros da equipe e promover as melhores práticas de SRE em toda a organização de engenharia.</li></ul><p><strong>O que define o sucesso nessa função</strong></p><ul><li>Aumento da disponibilidade e confiabilidade da plataforma.</li><li>Melhoria da observabilidade e redução do tempo de resolução de incidentes.</li><li>Maior automação e redução de esforços operacionais manuais e repetitivos.</li><li>Plataformas de Dados e IA confiáveis, escaláveis e com eficiência de custos.</li><li>Forte colaboração com as equipes de Engenharia para entregar sistemas de produção resilientes.</li></ul> <p><strong>Qualificações obrigatórias</strong></p><ul><li>Ensino Superior cursando/completo.</li><li>Experiência sólida em Site Reliability Engineering, Platform Engineering, Cloud Engineering ou funções de DevOps.</li><li>Forte experiência prática com serviços AWS e arquiteturas cloud-native.</li><li>Conhecimento profundo de Kubernetes e workloads conteinerizadas em ambientes de produção.</li><li>Experiência na gestão e resolução de problemas em sistemas distribuídos de grande escala.</li><li>Sólida experiência com plataformas de observabilidade, preferencialmente Datadog.</li><li>Experiência no suporte a plataformas e fluxos de dados utilizando tecnologias como Airflow, EMR, Spark e S3.</li><li>Expertise em Infraestrutura como Código (IaC) utilizando Terraform ou ferramentas similares.</li><li>Experiência na construção e manutenção de pipelines de CI/CD e automação de plataformas.</li><li>Sólidos conhecimentos em Linux, redes e troubleshooting de desempenho de sistemas.</li><li>Proficiência em scripts e automação utilizando Python, Bash ou linguagens similares.</li></ul><p><strong>Qualificações desejáveis</strong></p><ul><li>Experiência no suporte a plataformas cloud-native de grande escala em ambientes AWS.</li><li>Experiência com operações de plataformas Kubernetes e gerenciamento do ciclo de vida de clusters.</li><li>Conhecimento dos princípios de Site Reliability Engineering, incluindo SLOs, SLIs, error budgets e práticas de excelência operacional.</li><li>Experiência na implementação de soluções de observabilidade utilizando ferramentas como Datadog, Prometheus, Grafana, OpenTelemetry ou tecnologias similares.</li><li>Familiaridade com plataformas de processamento de dados e orquestração de workflows, como Airflow, Spark ou EMR.</li><li>Experiência com Infraestrutura como Código (IaC) e práticas de automação de plataformas.</li><li>Certificações AWS, Kubernetes, Terraform ou Datadog.</li><li>Experiência atuando em ambientes corporativos de grande escala, altamente disponíveis ou de missão crítica.</li><li>Inglês técnico intermediário.</li></ul> <p>Esta é uma posição afirmativa para mulheres, como parte do nosso compromisso com o avanço da equidade de gênero no ambiente de trabalho.</p><p>A Serasa Experian investe na liderança feminina e possui a parceria com a TODAS Group. Além disso, aderimos ao Movimento 'Elas Lideram 2030’, e nos unimos à ONU Mulheres para reduzir a desigualdade de gênero até 2030!!</p><p>Temos também o grupo Women in Experian que busca melhorar a equidade de gênero para mulheres, criando oportunidades de desenvolvimento, diferentes perspectivas, habilidades, entre outros.</p><p>Venha fazer parte dessa transformação!</p><p>Caso você não se identifique com este grupo, convidamos você a explorar outras oportunidades em nossa página de carreiras. Temos diversas vagas que podem se conectar com seu perfil e interesses.</p><p><strong>#LI-HOME</strong></p><div sr-tagline=""></div><p>Experian Careers - Creating a better tomorrow together</p><p><a href="https://www.experian.com/careers/" rel="noopener noreferrer">Find out what its like to work for Experian by clicking here</a></p>

Skills

AWSKubernetesDatadogAirflowAmazon EMRS3TerraformCI/CDPythonBashLinuxNetworkingObservabilitySLOsSLIsError BudgetsInfraestrutura como CódigoIaCPrometheusGrafanaOpenTelemetrySpark