TruckPag · Remoto · Cascavel, BR
A TruckPag, startup de Meios de Pagamento, busca profissionais que queiram causar impacto relevante, solucionar grandes problemas e tornar as operações logísticas mais efetivas, assertivas e competitivas.
Buscamos pessoas que gostem de um ambiente colaborativo, de alta performance e descontraído, contribuindo para a evolução de nossa infraestrutura, aplicações e práticas de engenharia.
Responsabilidades:
Gerenciar e evoluir infraestrutura e aplicações em AWS;
Administrar ambientes Linux, containers e Kubernetes;
Automatizar infraestrutura, processos operacionais e fluxos de CI/CD e GitOps;
Atuar em troubleshooting e resolução de problemas em ambientes de produção;
Evoluir práticas de Observabilidade e SRE, incluindo SLIs, SLOs e indicadores de confiabilidade;
Atuar em incidentes, war rooms, análise de causa raiz e post-mortems;
Monitorar disponibilidade, performance, capacidade e métricas como MTTR e MTBF;
Iriscos, pontos de falha e oportunidades de melhoria em confiabilidade, resiliência e performance;
Reduzir atividades operacionais repetitivas (toil) por meio de automação;
Padronizar, documentar e melhorar continuamente processos e práticas de engenharia;
Trabalhar em conjunto com os times de Desenvolvimento, Produto, Segurança e Infraestrutura.
Stack & Skills:
Cloud & Infrastructure: AWS (EC2, RDS, S3, SES, CloudFront, EKS, ECS e ECR), Linux, Kubernetes e Containers, Infrastructure as Code.
DevOps & Platform Engineering: Git, GitLab e Argo CD, GitOps e CI/CD, Bash/Shell e automação, Engenharia de Plataformas.
Observability & SRE: Prometheus Stack, Grafana e Elastic, logs, métricas, traces e alerting, SLIs, SLOs, Error Budgets, MTTR, MTBF, incidentes e post-mortems.
Security: Cloud Security, IAM e princípio do menor privilégio, segurança de infraestrutura e workloads.
Entre para ver como esta vaga combina com seu perfil.
Entrar