Мы проводим масштабную миграцию цифрового финансового продукта на новую платформу. Это комплексный проект по переносу системы кредитования, включающий миграцию данных, переписывание бизнес-логики и построение новых интеграций.
Мы ищем DevOps-инженера для проектирования, развёртывания и дальнейшей эксплуатации инфраструктуры новой платформы в AWS, в рамках масштабной миграции цифрового финансового продукта. Это комплексный проект по переносу системы кредитования, включающий миграцию данных, переписывание бизнес-логики и построение новых интеграций. В этой роли важно не просто поддерживать окружения, а выстраивать надёжную production-ready платформу: от AWS-сети и EKS до CI/CD, monitoring/logging, backup/restore и безопасного управления доступами. Вы будете работать в тесной связке с разработчиками, системными аналитиками, QA и другими инженерами, обеспечивая скорость поставки, стабильность сервисов и управляемость миграции.
Чем предстоит заниматьсяПроектирование и эксплуатация AWS-инфраструктуры
- Проектировать, разворачивать и сопровождать инфраструктуру в AWS: VPC, Subnets, Route Tables, Security Groups, IAM, EC2, EBS, S3, ELB/ALB/NLB, Route53.
- Настраивать AWS networking: public/private subnets, NAT Gateway, Internet Gateway, VPC Peering / Transit Gateway, VPN, routing.
- Обеспечивать HA, backup/restore, disaster recovery и принципы production-инфраструктуры.
- Создавать и сопровождать AWS-инфраструктуру как код с помощью Terraform.
Kubernetes и контейнеризация
- Строить и эксплуатировать Kubernetes в AWS (EKS).
- Работать с основными Kubernetes-сущностями: Deployment, StatefulSet, DaemonSet, Service, Ingress, ConfigMap, Secret, Job/CronJob, PVC/PV, Namespace, ServiceAccount.
- Использовать Helm для управления приложениями.
- Настраивать Ingress Controller, Load Balancer и TLS/certificates.
- Понимать Kubernetes storage и обеспечивать работу stateful-приложений.
- Работать с Docker: сборка образов, registry, troubleshooting контейнеров.
CI/CD и автоматизация
- Строить CI/CD-процессы, желательно на GitLab CI.
- Автоматизировать развёртывание приложений и зависимых сервисов.
- Интегрировать инфраструктурные изменения в пайплайны и поддерживать воспроизводимость окружений.
Наблюдаемость, надёжность и эксплуатация
- Настраивать мониторинг на базе Prometheus + Grafana: метрики и алерты.
- Организовывать централизованный сбор и анализ логов: Loki/ELK/OpenSearch.
- Диагностировать сетевые и системные проблемы в Linux.
- Обеспечивать стабильность production-среды, реагировать на инциденты и устранять их причины.
Безопасность и управление доступами
- Управлять secrets: AWS Secrets Manager / Vault/OpenBao / External Secrets.
- Настраивать RBAC/IAM и соблюдать принцип least privilege.
- Обеспечивать безопасное взаимодействие сервисов и доступ к инфраструктуре.
Работа с данными и сервисами
- Поддерживать PostgreSQL, Redis, RabbitMQ/Kafka на уровне инфраструктуры и интеграции с приложениями.
- Обеспечивать backup/restore и отказоустойчивость stateful-сервисов.
- Помогать командам разворачивать и сопровождать зависимые сервисы в Kubernetes.
Наши ожиданияAWS и сети
- Уверенный опыт AWS: VPC, Subnets, Route Tables, Security Groups, IAM, EC2, EBS, S3, ELB/ALB/NLB, Route53.
- Хорошее понимание AWS networking: public/private subnets, NAT Gateway, Internet Gateway, VPC Peering / Transit Gateway, VPN, routing.
Kubernetes и контейнеры
- Практический опыт построения и эксплуатации Kubernetes в AWS (EKS).
- Понимание основных Kubernetes-сущностей: Deployment, StatefulSet, DaemonSet, Service, Ingress, ConfigMap, Secret, Job/CronJob, PVC/PV, Namespace, ServiceAccount.
- Опыт настройки Ingress Controller, Load Balancer и TLS/certificates.
- Работа с Docker: сборка образов, registry, troubleshooting контейнеров.
- Понимание Kubernetes storage и работы stateful-приложений.
IaC и CI/CD
- Terraform — создание и сопровождение AWS-инфраструктуры как кода.
- Опыт построения CI/CD, желательно GitLab CI.
Данные, очереди и storage
- Опыт с PostgreSQL, Redis, RabbitMQ/Kafka на уровне инфраструктуры и интеграции с приложениями.
- Понимание HA, backup/restore, disaster recovery и принципов production-инфраструктуры.
Мониторинг, логирование и secrets
- Мониторинг: Prometheus + Grafana, настройка метрик и алертов.
- Централизованный сбор и анализ логов: Loki/ELK/OpenSearch.
- Управление secrets: AWS Secrets Manager / Vault/OpenBao / External Secrets.
Linux и безопасность
- Linux administration и уверенная диагностика сетевых и системных проблем.
- Опыт настройки RBAC/IAM и соблюдения принципа least privilege.
Особенно важен практический опыт
- Инженер должен уметь с нуля спроектировать AWS-сеть → поднять EKS → развернуть приложение и зависимые сервисы → организовать ingress/DNS/TLS → CI/CD → monitoring/logging → backup → передать production-ready инфраструктуру в эксплуатацию.