DevOps / Platform Engineer( МИЛЫЙ КОТ )
15 Августа 2026
от 160 000 до 180 000 руб.
Город:
Санкт-Петербург
Занятость:
Полная занятость
Компания "МИЛЫЙ КОТ"
DevOps / Platform Engineer
Мы ищем DevOps / Platform Engineer для развития и эксплуатации внутренней микросервисной платформы.
Нам нужен инженер, который сможет не только поддерживать инфраструктуру в рабочем состоянии, но и развивать её как единую платформу для продуктовых команд: стандартизировать запуск сервисов, автоматизировать deployment, поддерживать Kubernetes и общие инфраструктурные сервисы, observability, identity/security-инфраструктуру и локальное окружение разработчиков.
Чем предстоит заниматься
Основная зона ответственности — эксплуатация и развитие платформы, на которой работают микросервисы компании.
В задачи будут входить:
- эксплуатация и развитие Kubernetes-кластеров;
- сопровождение PostgreSQL, Kafka, Redis и других shared platform resources;
- эксплуатация Keycloak и инфраструктуры аутентификации сервисов;
- сопровождение API Gateway и service registration/discovery;
- развитие CI/CD для микросервисов;
- создание и поддержка Helm charts;
- Docker/container runtime;
- управление конфигурацией и secrets;
- поддержка dev/stage/prod окружений;
- развитие локального platform runtime для разработчиков;
- организация централизованных logs, metrics и traces;
- Prometheus/Grafana и развитие alerting;
- OpenTelemetry;
- readiness/liveness/startup probes;
- управление ресурсами Kubernetes, requests/limits и HPA;
- анализ производительности и capacity planning;
- backup/restore и disaster recovery;
- обновление платформенных компонентов;
- управление сертификатами, ingress, DNS и сетевой инфраструктурой;
- поиск причин инфраструктурных и production-инцидентов;
- участие в разборе инцидентов и устранении их системных причин;
- поддержание инфраструктуры воспроизводимой через IaC;
- автоматизация рутинных эксплуатационных операций.
Отдельная важная часть работы — Platform Engineering. Мы хотим, чтобы новый микросервис подключался к платформе по стандартизированному пути, а не собирал собственную инфраструктуру вокруг себя.
Например, разработчику сервиса не должно требоваться самостоятельно придумывать, как подключить Kafka, зарегистрировать сервис, настроить observability или подготовить Kubernetes deployment. Платформа должна предоставлять для этого готовые контракты, шаблоны и автоматизацию.
С чем предстоит работать
Наш технологический стек включает:
Platform / Infrastructure: Kubernetes, Docker, Helm, Linux, Nginx/API Gateway, DNS/TLS.
Data & Messaging: PostgreSQL, Kafka, Schema Registry, Redis, Cassandra, Clickhouse
Identity & Security: Keycloak, OAuth 2.0 / OpenID Connect, JWT, service-to-service authentication.
Observability: Prometheus, Grafana, OpenTelemetry, централизованные structured logs, distributed tracing, Loki
Development: микросервисная архитектура, преимущественно JVM/Kotlin/Spring Boot сервисы; REST, GraphQL, gRPC, Kafka/Avro.
Delivery: Git, CI/CD, container registry, автоматизированные сборки, тестирование и deployment.
Что для нас важно
Мы ожидаем уверенный production-опыт с Kubernetes и Linux и хорошее понимание того, как устроена работающая микросервисная платформа целиком, а не только отдельных CI pipelines.
Нужен опыт с Kubernetes, Docker, Helm, CI/CD, PostgreSQL и Kafka, понимание networking, DNS, TLS, ingress и reverse proxy, а также практический опыт построения monitoring/alerting.
Важно понимать:
- readiness/liveness/startup semantics;
- rolling deployment и zero/low-downtime deployment;
- resource requests/limits;
- autoscaling;
- secrets management;
- RBAC;
- backup/restore;
- Kafka topics, consumer groups и Schema Registry;
- database migrations;
- OAuth/OIDC и service-to-service authentication;
- troubleshooting распределённых систем.
Мы ожидаем способность разобраться в проблеме уровня:
«Сервис успешно запустился, но не получает Kafka events, readiness нестабилен, traces отсутствуют, а после deployment часть запросов через Gateway получает 502»
— и последовательно найти причину на уровне приложения, Kubernetes, сети, Kafka или платформенной конфигурации.
Будет большим плюсом
Опыт именно в Platform Engineering , а также GitOps, Argo CD/Flux, Terraform/OpenTofu, Ansible, Vault или аналогичных secrets-management системах.
Плюсом будет опыт эксплуатации Kafka в production, Keycloak, OpenTelemetry, gRPC/GraphQL и JVM/Spring Boot приложений.
Особенно интересен опыт создания Golden Path для разработчиков: когда новый сервис получает стандартные Helm templates, CI/CD, observability, security, service registration и доступ к shared resources практически из коробки.
Что мы хотим получить от этой роли
Нам не нужен человек, который будет вручную «чинить серверы».
Цель роли — постепенно добиться состояния, при котором инфраструктура и эксплуатация становятся предсказуемой платформой.
У нового микросервиса должен существовать стандартный жизненный цикл:
repository → build → tests → image → registry → deploy → registration → gateway → observability → alerts
При этом PostgreSQL, Kafka, Redis, Keycloak и другие общие компоненты должны оставаться платформенными ресурсами с понятными правилами подключения и изоляции.
Первые задачи
В первые месяцы мы хотим вместе провести аудит существующей инфраструктуры и зафиксировать её фактическое состояние, после чего:
- привести Kubernetes/runtime к воспроизводимой конфигурации;
- формализовать dev/stage/prod environments;
- привести CI/CD к единому стандарту;
- стандартизировать Helm/deployment сервисов;
- привести в порядок monitoring, alerting, logging и tracing;
- формализовать эксплуатацию PostgreSQL/Kafka/Redis/Keycloak;
- настроить backup/restore и проверить восстановление;
- сформировать Golden Path для нового микросервиса;
- уменьшить количество ручных действий при deployment;
- определить SLI/SLO для критичных компонентов платформы.
- Раскатать инфраструктуру на AWS
Зарегистрируйтесь или войдите, чтобы открыть контакты работодателя
Прикрепите резюме для отклика
Уже с нами?
Войдите, чтобы отправить резюме
05 Августа
Инженер данных (Data engineer)( ИнфоТеКС )
Санкт-Петербург
Компания "ИнфоТеКС" ГК "ИнфоТеКС", входящая в ТОП-5 компаний России в сфере защиты информации, лидер в разработке средств защиты информации,...
09 Августа
Санкт-Петербург
Компания "JACOBS DOUWE EGBERTS (JDE)" Обязанности: Техническое обеспечение бесперебойной работы оборудования упаковочного производства;...
10 Августа
SRE / Site Reliability Engineer
Санкт-Петербург
Компания "Twinby" О роли Twinby — один из крупнейших российских дейтинг-сервисов с миллионами пользователей: реалтайм (лента, матчи, чаты),...
09 Августа
Инженер проекта (упаковочное производство) | Project Engineer
Санкт-Петербург
Компания "JACOBS DOUWE EGBERTS (JDE)" Зона ответственности: Реализация Инвестиционных проектов, преимущественно технологических процессов...
12 Августа
Инженер по компьютерному зрению и машинному обучению (Computer Vision / ML Engineer)
Санкт-Петербург
от 150 000 руб.
Компания "АТИС" Обязанности: Отвечать за разработку, внедрение и сопровождение решений в области компьютерного зрения и искусственного...
Вакансия размещена в отрасли