Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage

Back to Jobs
Dell Technologies logo

Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage

Dell Technologies

Location

ELDORADO DO SUL, RS, Brazil

Experience

Senior

Posted

Jul 30, 2026

Apply by

August 5, 2026

Applicants

0

Early applicantEasy applyFull-timeWork from Office

Job Description

Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage Junte-se a nós como Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage em nossa equipe de Engenharia de Infraestrutura em Eldorado do Sul/RS para fazer o melhor trabalho da sua carreira e gerar um impacto social profundo. O que você conquistará Como Engenheiro(a) Sênior de Confiabilidade de Sites (SRE) – Storage, você será responsável por projetar, desenvolver e administrar automações para todo o ciclo de vida dos serviços de armazenamento, garantindo escalabilidade, disponibilidade, desempenho e confiabilidade dos ambientes corporativos. Você trabalhará com equipes de Engenharia de Storage, Automação de Plataforma, Observabilidade e Infraestrutura para entregar uma operação altamente automatizada, suportando cargas de trabalho críticas por meio de práticas modernas de SRE, automação e engenharia de confiabilidade. Você irá: - Projetar, desenvolver e manter automações para todo o ciclo de vida dos serviços de armazenamento, incluindo provisionamento de volumes e LUNs, gerenciamento de snapshots e replicação, monitoramento de capacidade, gestão de firmware, descomissionamento e remediação automatizada utilizando Ansible, APIs REST e pipelines CI/CD - Definir e operar práticas de confiabilidade para serviços de storage por meio da criação e manutenção de SLIs, SLOs e error budgets, aprimorando a observabilidade, reduzindo ruídos operacionais, conduzindo análises pós-incidente e transformando problemas recorrentes em soluções automatizadas - Colaborar com equipes de Engenharia de Storage, Automação de Plataforma e Observabilidade para estabelecer requisitos operacionais, integrar automações à plataforma corporativa de IA, definir critérios de prontidão operacional e contribuir com políticas como código voltadas à proteção da disponibilidade, durabilidade e capacidade dos ambientes - Liderar iniciativas de melhoria contínua por meio da medição da cobertura de automação, aumento das taxas de resolução autônoma, manutenção da base de conhecimento estruturada, identificação de oportunidades de automação e avaliação de novas ferramentas para integração ao ecossistema corporativo - Participar da escala de plantão da torre de Storage, atuando como ponto de escalonamento quando mecanismos automatizados não resolverem incidentes críticos dentro dos níveis de serviço estabelecidos e utilizando diagnósticos previamente consolidados para acelerar a tomada de decisão e resolução Dê o primeiro passo para a carreira dos seus sonhos Todas as pessoas da nossa equipe agregam algo único. Veja o que estamos buscando para esta posição: Requisitos Essenciais - Ensino superior completo em Ciência da Computação, Tecnologia da Informação, Engenharia ou áreas correlatas, com experiência em Engenharia de Storage, SRE, Operações de Armazenamento ou Infraestrutura corporativa de grande porte - Inglês avançado ou fluente, com capacidade de colaborar efetivamente com equipes globais - Experiência prática avançada em pelo menos duas das seguintes áreas: armazenamento SAN/Block, NAS/File Storage, Object Storage ou plataformas corporativas equivalentes, incluindo soluções Dell, Pure Storage, NetApp, HPE ou similares - Experiência comprovada no desenvolvimento de automações para plataformas de armazenamento utilizando Ansible, Python, APIs REST, Git, pipelines CI/CD e práticas de GitOps, incluindo provisionamento, replicação, gerenciamento de capacidade e ciclo de vida dos ambientes - Conhecimento sólido em observabilidade, monitoramento, confiabilidade de serviços, análise de incidentes, troubleshooting e resolução de falhas complexas envolvendo desempenho, replicação, capacidade, controladoras, discos e arquiteturas distribuídas de armazenamento Requisitos Desejáveis - Experiência com ambientes multivendor de storage, plataformas de monitoramento como Zabbix ou vROps, ServiceNow CMDB, GitLab CI, serviços de armazenamento em nuvem, arquiteturas híbridas e práticas formais de Site Reliability Engineering (SRE) - Familiaridade com plataformas corporativas de automação assistida por IA, soluções agentic AI, integração de LLMs em processos operacionais, ambientes regulados por requisitos de conformidade (SOX, PCI-DSS, ISO 27001) e geração de evidências para auditoria ### About the Company Who We Are We believe that each of us has the power to make an impact. That’s why we put our team members at the center of everything we do. If you’re looking for an opportunity to grow your career with some of the best minds and most advanced tech in the industry, we’re looking for you. Dell Technologies is a unique family of businesses that helps individuals and organizations transform how they work, live and play. Join us to build a future that works for everyone because Progress Takes All of Us. Dell Technologies is committed to the principle of equal employment opportunity for all employees and to providing employees with a work environment free of discrimination and harassment. [Read the full Equal Employment Opportunity Policy](https://iawmqy.fa.ocs.oraclecloud.com/hcmUI/CandidateExperience/en/sites/careers/pages/equal-employment-opportunity-policy-statement). Visit our [Culture Code](https://jobs.dell.com/en/how-we-work-and-lead) page to learn more about how we work and lead.

Key Responsibilities

  • Design, develop, and maintain automations for the storage service lifecycle including provisioning, snapshots, and replication.
  • Define and operate reliability practices such as SLIs, SLOs, and error budgets.
  • Collaborate with Storage, Platform Automation, and Observability teams to establish operational requirements and policies.
  • Lead continuous improvement initiatives by measuring automation coverage and identifying new automation opportunities.
  • Participate in the storage tower on-call rotation to resolve critical incidents.

Requirements

  • Bachelor's degree in Computer Science
  • Information Technology
  • Engineering
  • or related fields

Skills Required

AnsiblePythonREST APIsGitCI/CD PipelinesGitOpsSAN/Block StorageNAS/File StorageObject StorageDell Storage SolutionsPure StorageNetAppHPE StorageObservabilityMonitoringIncident AnalysisTroubleshootingAdvanced English proficiencyCollaborationProblem solvingZabbixvROpsServiceNow CMDBGitLab CICloud StorageHybrid ArchitecturesAI-assisted Automation PlatformsLLM IntegrationSOX CompliancePCI-DSS ComplianceISO 27001 Compliance

App exclusive · Free

Smart Job AI Coach

Your personal interview coach on every job — readiness tips, profile improvements, and role-specific prep. Available only in the Pulse Job app.

Interview readiness

See how prepared you are and what to improve for each role.

Personalized tips

Actionable suggestions based on your profile and the job.

After you apply

Keep coaching momentum from job detail through application success.

Get Smart Job AI Coach in the appFree on iOS and Android