Devops/SRE

Минск, Беларусь
Сеньор • Тимлид/Руководитель группы
Информационные технологии • DevOps • Ansible • Docker • Python • ClickHouse • MySQL • PostgreSQL • Redis • AWS • Amazon S3
Удаленная работа • Работа в офисе
Опыт работы более 5 лет
от 450 000 до 550 000 ₽

Кандидат ищет работу анонимно

Есть файл резюме (защищен)
О себе

Текущий статус/должность: Devops.

Мои компетенции и опыт

Последние несколько лет в основном работаю как DevOps/SRE с продовой инфраструктурой, Kubernetes и AWS.

Сейчас работаю Senior DevOps/SRE в продуктовой компании. В основном занимаюсь несколькими production Kubernetes кластерами и AWS инфраструктурой вокруг них. Из повседневного это Helm, ArgoCD, Karpenter, autoscaling, Pulumi/Terraform/Terragrunt, GitLab CI, Ansible, Prometheus, Thanos, Grafana, Loki, Alertmanager. В AWS много работаю с EC2/ASG, RDS/Aurora, ElastiCache, ALB, CloudFront, IAM, VPC, S3.

Довольно много именно production работы: релизы, миграции, обновления, инциденты, дебаг проблем, capacity, on-call. Из более крупных вещей переносил AWS аккаунты между Organizations так, чтобы после миграции не развалились CI/CD, мониторинг и автоматизация. Занимался Cloudflare, DNS, зеркалами и редиректами для проектов с региональными блокировками. Разбирал проблемы с платёжным трафиком и внутренней связностью сервисов. Плюс периодически занимаюсь FinOps: смотрю загрузку EC2/RDS/ElastiCache, ищу что можно уменьшить или убрать, проверяю cold reserve и неиспользуемые ресурсы.

Ещё поддерживаю Airflow в Kubernetes для BI/warehouse. В основном это разбор упавших DAG/task, странных ситуаций когда в UI нет логов, проверка pod'ов, scheduler, Loki и всего вокруг. Часть таких проверок вынес в GitLab CI, чтобы типовые проблемы можно было диагностировать без ручного хождения по кластеру.

До этого примерно полтора года работал DevOps Engineer в high-load fintech/iGaming проекте. Там тоже был production, Kubernetes, Docker, Terraform, Ansible, Jenkins, Prometheus, Linux, Bash/Python. Поддерживал dev/stage/prod, релизы и rollback, разбирал проблемы производительности, failed deploys и инфраструктурные инциденты.

Перед этим работал на нескольких AWS проектах. В основном Terraform, AWS CodePipeline, S3, Route53, CloudFront, Docker, CI/CD и поддержка релизов. Ещё раньше были Kubernetes/Docker проекты и Azure, но последние годы основной фокус у меня всё-таки AWS + Kubernetes.

Формальных KPI в виде какой-то одной цифры обычно не было. По факту смотрели на стабильность прода, насколько нормально проходят релизы, скорость разбора инцидентов, количество ручной работы и стоимость инфраструктуры. Поэтому стараюсь не просто поддерживать то, что есть, а убирать повторяющиеся ручные операции, автоматизировать диагностику и делать инфраструктуру проще для поддержки.

Из личных проектов ещё запускал свой небольшой AI сервис на Kubernetes с NVIDIA Runtime и локальной LLM. Сделал pipeline и веб-морду для поиска нужных фотографий среди большой пачки фото. Это скорее pet project, просто было интересно самому собрать всё от Kubernetes/GPU runtime до model serving и API.

Кандидат ищет работу анонимно

Дополнительную информацию вы сможете получить, зарегистрировавшись в нашем сервисе



Есть файл резюме (защищен)
Кандидат ищет работу анонимно
Чтобы получить доступ к его резюме, вам нужно связаться с кандидатом и предложить вашу вакансию. Кандидат получит ваше приглашение и ответит вам, если ваше предложение его заинтересует



Интересные кандидаты