Сейчас мы расширяемся и ищем в команду Ведущего DevOps-инженера.
Чем предстоит заниматься:
- сопровождать и развивать инфраструктуру закреплённого проекта, обеспечивать безопасный перенос изменений между окружениями;
- находить узкие места в производительности, надёжности и безопасности по всей цепочке сервиса: Linux, виртуальные машины, Kubernetes, Cloudflare, Nginx, PostgreSQL, ClickHouse, Kafka и Redis. Подтверждать выводы метриками и журналами;
- планировать масштабирование, оптимизировать использование ресурсов и расходы на инфраструктуру. Предлагать развитие текущих технологий и альтернативы, оценивать эффект и риски; значимые решения согласовывать с техническим руководителем;
- готовить обновления, миграции и другие плановые работы: оценивать сроки, согласовывать окна обслуживания, составлять план выполнения и отката, проверять результат;
- развивать CI/CD и автоматизацию с помощью GitLab CI/CD, Ansible и Terraform; улучшать мониторинг и оповещения на базе Prometheus, Grafana и Zabbix;
- улучшать управление доступами, резервное копирование и восстановление; проверять работоспособность механизмов восстановления;
- диагностировать инциденты, участвовать в восстановлении сервисов и устранять причины повторных сбоев;
- планировать свои задачи, поддерживать техническую документацию и кратко фиксировать ход работ, результаты и риски;
- взаимодействовать с разработчиками и подрядчиками.
Наши ожидания: -
от 5 лет практической эксплуатации production-инфраструктуры в роли DevOps или системного инженера;
-
опыт самостоятельной ответственности за проект или крупное направление: планирование изменений, развитие инфраструктуры, инциденты и проверка восстановления;
-
личные примеры масштабирования систем, устранения сложных проблем на стыке компонентов и оптимизации ресурсов и расходов;
- уверенная диагностика Linux, сети и пути запроса через балансировщик к приложению; практический опыт с Kubernetes и виртуальными машинами;
- работа с GitLab CI/CD, Ansible, Terraform, мониторингом и журналами;
- практический опыт эксплуатации PostgreSQL, ClickHouse, Kafka и Redis: диагностика сбоев и ограничений, оценка нагрузки, безопасные изменения и восстановление;
- понимание Nginx/HAProxy, резервного копирования, управления доступами и секретами;
- умение самостоятельно оценить технические варианты, составить план масштабирования или изменения, согласовать его и довести до проверенного результата.
Будет плюсом:
- опыт с Cloudflare, Vault, Sealed Secrets, ELK/Loki и применением SLI/SLO.
Мы предлагаем: -
формат работы: гибрид или удаленка;
-
предлагаем атмосферу молодой компании, гибких процессов и прозрачности;
-
оформляем по ТК РФ и всё, что с этим связано;
-
предоставляем ДМС после испытательного срока, а еще у нас есть корпоративный врач;
-
поддерживаем стремление к развитию: корпоративные скидки на обучение от партнеров;
-
доверяем: есть возможность взять 3 дня в квартал по болезни, без официального подтверждения;
-
работаем 5/2, гибкий старт дня с 09:00 до 11:00;
-
находимся в шаговой доступности от м. Василеостровская или м. Спортивная-2, в офисе есть всё необходимое для отличной рабочей жизни.