PeopleFinders.com — ведущий онлайн-сервис для потребителей, позволяющий находить, связываться и проверять людей и компании. За последние пару десятилетий компания незаметно стала одним из крупнейших владельцев данных публичных записей в стране, распространяя свои продукты через обширную сеть веб-сайтов.
PeopleFinders | Удалённо |
Зарплата — $170k - $180k
О роли
Мы ищем стратегического и практически вовлечённого директора по инфраструктуре и IT-операциям, который возглавит технологические возможности, обеспечивающие безопасность, надёжность и продуктивность наших цифровых продуктов, облачных платформ и сотрудников.
Этот руководитель будет курировать облачную инфраструктуру, Site Reliability Engineering, эксплуатацию продакшена, противодействие ботам, корпоративный IT и поддержку helpdesk, одновременно обеспечивая архитектурное руководство в области облачных платформ, сетей, идентификации, наблюдаемости и операционных инструментов.
Идеальный кандидат сочетает сильное техническое суждение с дисциплинированным операционным лидерством: построение высокоэффективных команд, установление чётких ожиданий по сервису, повышение надёжности, управление поставщиками и затратами и снижение операционных рисков по всему портфелю цифровых ресурсов компании.
Это не традиционная позиция корпоративного IT — она охватывает как внутренние технологии для сотрудников, так и производственную инфраструктуру, поддерживающую высоконагруженные клиентские приложения.
Ключевые обязанности
Руководство инфраструктурой и технологиями
Руководить командами, отвечающими за облачную инфраструктуру, SRE, эксплуатацию продакшена, корпоративный IT, helpdesk и противодействие ботам. Устанавливать зоны ответственности, операционные стандарты, SLO, процедуры эскалации и метрики эффективности для каждой функции. Развивать менеджеров, технических лидов и IT-персонал через коучинг и карьерное развитие. Формировать квартальные и годовые дорожные карты инфраструктуры в соответствии с бизнес-приоритетами, ростом, безопасностью, надёжностью и затратами. Взаимодействовать с инженерией, продуктом, данными, маркетингом, финансами, HR, юридическим отделом и руководством, предоставляя чёткие рекомендации по рискам, архитектуре и компромиссам. Формировать культуру ответственности, документирования, автоматизации и непрерывного улучшения.
Облачная инфраструктура и архитектура
Нести ответственность за надёжность, масштабируемость, безопасность, производительность и экономическую эффективность облачной инфраструктуры компании, преимущественно AWS. Обеспечивать архитектурное руководство в области облачных сервисов, приложений, API, сетей, идентификации, баз данных, хранилищ, наблюдаемости и интеграций. Устанавливать архитектурные стандарты, эталонные паттерны, управление и процессы технического ревью. Сотрудничать с инженерией для повышения безопасности развёртывания, производительности и готовности. Продвигать автоматизацию, управление конфигурацией и инфраструктуру как код. Вести планирование мощностей под рост бизнеса и пики нагрузки. Устранять единые точки отказа, недокументированные системы, ручные процессы и зависимость от отдельных сотрудников или поставщиков. Проверять новые системы на соответствие архитектуре, поддерживаемость, безопасность и совокупную стоимость владения. Обеспечивать надлежащее разделение, защиту и мониторинг продакшен- и непродакшен-сред.
Надёжность сайтов и эксплуатация продакшена
Устанавливать и поддерживать SLI, SLO, целевые показатели доступности и практики error budget для критических систем. Улучшать наблюдаемость через централизованное логирование, метрики, распределённую трассировку, APM и действенные оповещения. Руководить управлением крупными инцидентами, включая координацию, коммуникацию с руководством, анализ первопричин и отслеживание корректирующих действий. Разрабатывать и тестировать процедуры резервного копирования, аварийного восстановления и непрерывности бизнеса. Сокращать среднее время обнаружения, реагирования и восстановления после инцидентов. Устанавливать практики дежурств, балансируя покрытие и устойчивость команды. Сотрудничать с командами разработки для повышения устойчивости и поддержки продакшена. Использовать данные об инцидентах для приоритизации долгосрочной работы по надёжности. Обеспечивать актуальные runbook, архитектурные схемы и документацию для систем.
Противодействие ботам и защита трафика
Нести ответственность за стратегию противодействия ботам, защиты от скрапинга, предотвращения автоматизированного злоупотребления и управления качеством трафика. Защищать ресурсы компании от скрапинга, атак на учётные данные, мошенничества, автоматизированного злоупотребления и исчерпания инфраструктуры. Руководить настройкой технологий, таких как Cloudflare, DataDome, WAF, ограничение частоты запросов, альтернативы CAPTCHA, отпечатки устройств и защита на уровне приложений. Сотрудничать с инженерией, продуктом, маркетингом, SEO и отделом доходов, чтобы отличать вредоносную автоматизацию от легитимных клиентов, поисковых систем, партнёров и одобренных AI-краулеров. Устанавливать процедуры мониторинга и реагирования на скрапинг и аномальный трафик. Оценивать эффективность через снижение трафика, долю ложных срабатываний, стабильность платформы и экономию инфраструктуры. Оценивать поставщиков по измеримой ценности и следить за актуальными методами скрапинга, автоматизации браузеров, резидентных прокси и AI-краулеров.
Корпоративный IT и helpdesk
Курировать внутренние IT-сервисы и поддержку helpdesk для сотрудников. Устанавливать ожидания по уровню сервиса: время ответа, время решения, удовлетворённость и сокращение backlog. Нести ответственность за жизненный цикл технологий сотрудника: онбординг, офбординг, выдача оборудования, управление доступом и возврат активов. Управлять ноутбуками, конечными точками, платформами совместной работы, ПО для продуктивности и телеком-сервисами. Стандартизировать конфигурацию конечных точек, шифрование, патчинг и обнаружение на конечных точках. Улучшать опыт поддержки через понятный приём заявок, ресурсы самообслуживания и автоматизацию. Поддерживать точные инвентаризации устройств, лицензий и активов. Сотрудничать с HR, чтобы новые сотрудники получали оборудование и доступ вовремя, а у уходящих доступ своевременно отзывался. Выявлять и устранять первопричины повторяющихся проблем поддержки.
Идентификация, доступ и операционная безопасность
Устанавливать единообразные практики идентификации и управления доступом в корпоративных и производственных системах. Внедрять ролевой доступ, принцип минимальных привилегий, MFA, периодические ревью доступа и своевременное удаление доступа. Поддерживать безопасные процессы для привилегированных, административных и сервисных учётных записей. Сотрудничать с безопасностью и юридическим отделом для выявления и снижения технологических рисков. Поддерживать устранение уязвимостей, оценки безопасности, аудиты и ревью поставщиков. Обеспечивать соответствие облачных сред, конечных точек, приложений и сторонних сервисов стандартам безопасности компании и готовность к инцидентам кибербезопасности и применимым требованиям конфиденциальности.
Управление поставщиками, бюджетом и затратами
Управлять поставщиками инфраструктуры, безопасности, IT, телекома, мониторинга и поддержки, включая оценки, ревью контрактов, продления, лицензирование и SLA. Разрабатывать и вести бюджеты инфраструктуры и IT. Улучшать видимость облачных затрат через тегирование, распределение и прогнозирование. Выявлять возможности устранения неиспользуемых сервисов, консолидации инструментов и пересмотра контрактов. Сообщать руководству о выполнении бюджета и инвестиционных рекомендациях. Обеспечивать надлежащие меры безопасности у критических поставщиков и документированную ответственность, снижать зависимость от поставщиков за счёт внутренних знаний.
Ожидания от лидерства
Действовать одновременно как стратегический технологический лидер и эффективный принимающий технические решения. Сохранять спокойствие, организованность и решительность во время сбоев, событий безопасности и в стрессовых ситуациях. Создавать ответственность без излишней бюрократии. Чётко доносить технические риски и рекомендации до технической и нетехнической аудитории. Выстраивать продуктивное партнёрство с инженерией, продуктом, данными, маркетингом, безопасностью и бизнес-операциями. Принимать решения на основе надёжности, риска, влияния на клиентов, затрат и измеримых результатов. Развивать лидеров, способных самостоятельно управлять своими функциями при сохранении единых стандартов, и поощрять команды устранять первопричины, а не полагаться на повторяющееся ручное вмешательство.
Обязательные требования
10+ лет в облачной инфраструктуре, SRE, платформенной инженерии, DevOps, IT-операциях или смежных областях. 5+ лет руководства инженерными или технологическими командами, включая менеджеров или технических лидов. Подтверждённый опыт эксплуатации высоконагруженных клиентских платформ в AWS или сопоставимом облаке. Глубокое понимание облачной архитектуры, сетей, идентификации, безопасности, наблюдаемости, баз данных, API, хранилищ и распределённых систем. Опыт управления доступностью продакшена, реагированием на инциденты, анализом первопричин, аварийным восстановлением и непрерывностью бизнеса. Опыт автоматизации инфраструктуры, управления конфигурацией, CI/CD и инфраструктуры как код. Опыт управления корпоративным IT, поддержкой сотрудников, управлением конечными точками, лицензированием и выдачей доступа. Опыт установления операционных метрик, SLO и стандартов поддержки. Подтверждённая способность управлять поставщиками, контрактами, бюджетами и облачными затратами. Сильные навыки письменной и устной коммуникации с умением объяснять технические вопросы и компромиссы руководству.
Желательные требования
Опыт работы с Cloudflare, DataDome или сопоставимыми платформами управления ботами и защиты веб-приложений, а также руководства программами противодействия ботам или управления качеством трафика. Опыт с сервисами AWS, контейнерными средами, инфраструктурой как код, централизованным логированием и APM (например, AppDynamics). Опыт поддержки крупномасштабных потребительских подписок, платформ публичных записей, data-as-a-service, рекламы или электронной коммерции. Опыт модернизации устаревшей инфраструктуры, перевода систем с внешних поставщиков и консолидации облачных аккаунтов или IT-сервисов. Знакомство с требованиями конфиденциальности и безопасной обработкой чувствительных потребительских данных. Опыт создания или развития функций SRE, DevOps или платформенной инженерии.
Критерии успеха
Успех будет оцениваться по: улучшению доступности и стабильности клиентских платформ; снижению влияния ботов, скрапинга и злоупотреблений; более быстрому обнаружению и восстановлению после инцидентов; меньшему числу повторяющихся инцидентов; улучшенной наблюдаемости и снижению шума оповещений; проверенным возможностям резервного копирования и аварийного восстановления; снижению облачных потерь и лучшей видимости затрат; стабильной работе helpdesk; надёжному онбордингу, офбордингу и управлению доступом; усиленной безопасности конечных точек и управлению активами; снижению зависимости от недокументированных систем и поставщиков; усиленному архитектурному управлению; и улучшению ответственности и развития команды
Льготы
401k
Соответствие взносам в 401k
Медицинская/стоматологическая/офтальмологическая/страхование жизни
Будьте осторожны: если работодатель просит войти через Google, iCloud или Госуслуги, прислать код или пароль, запустить ПО или перевести деньги — это мошенники.