ЕЛ

Инженер по надежности

Елесина Мария Сергеевна

250 000 – 350 000 ₽
🌍 Удалённо 💼 Проект ⚡ 1-3 года

Описание вакансии

Условия Привет! Мы - Т-Банк, и мы строим одну из самых надежных финтех-экосистем в стране. Наш стек - тысячи микросервисов, миллионы запросов в секунду, критичные финансовые транзакции. Именно здесь ты сможешь влиять на архитектуру, внедрять самые современные практики Observability и отказоустойчивости, а не просто "поддерживать". Сейчас мы ищем SRE-инженера, который поможет нам делать систему еще более устойчивой, прозрачной и автоматизированной. Ты будешь не тушить пожары, а проектировать системы так, чтобы они не загорались. Зарплата: 250 000 - 350 000 руб. на руки (зависит от опыта и навыков). Формат: Офис в Москве (м. Белорусская) или гибрид (2 дня в офисе). Удаленка - только для кандидатов из других городов с возможностью периодических поездок. Оформление: Трудовой договор, полный соцпакет. Бонусы, которые реально работают: ДМС со стоматологией и страховкой для всей семьи (льготные условия для близких). Современный MacBook Pro / мощная рабочая станция. Оплата участия в профессиональных конференциях (HighLoad++, SREcon) и курсов (Kubernetes, Prometheus). Возможность работать с opensource-инструментами и влиять на их развитие внутри компании. Карьерный трек: через 1-1, 5 года - рост до Lead SRE или переход в архитектурное направление. Мы поддерживаем внутренние перемещения. Команда: ты будешь работать с бывшими инженерами Яндекса, Google и стартаперами, которые строили системы для миллионов пользователей. У нас культура blameless postmortems и непрерывного улучшения. Обязанности Разрабатывать инструменты для повышения надежности информационных систем (автоматическое восстановление, хаос-инжиниринг). Участвовать в расследовании инцидентов и устранять их первопричины (не просто "перезагрузить", а понять, почему это произошло). Повышать Observability: внедрять и поддерживать метрики, логи, трейсы (Prometheus, Grafana, Tempo, ELK). Проектировать отказоустойчивую архитектуру: резервирование, балансировка, circuit breakers, retries. Автоматизировать рутину: писать скрипты/операторы для k8s, терраформить инфраструктуру, строить CI/CD. Быть на связи в рамках дежурств (on-call) - но мы ценим work-life balance, поэтому дежурства компенсируются. Требования Обязательно (без этого - никак): Коммерческий опыт от 2 лет в похожей роли (SRE / DevOps / системный инженер). Глубокое знание Linux (системные вызовы, network stack, тюнинг ядра). Владение хотя бы одним языком: Go (приоритет), Python, Java, C#. Опыт построения CI/CD (GitLab CI / GitHub Actions / Jenkins) и IaC (Terraform / Ansible). Понимание сетей (TCP/IP, DNS, HTTP, gRPC), баз данных, очередей. Git - обязательно. Мониторинг и логи: Prometheus, Grafana, ELK/Splunk/Graylog. Контейнеризация и оркестрация: Docker, Kubernetes (операторы, Helm, кастомные контроллеры). Будет большим плюсом: Опыт работы с облачными провайдерами (Yandex Cloud, AWS, GCP). Знание Service Mesh (Istio / Linkerd). Участие в Open Source или личные pet-проекты по автоматизации. Понимание финансовой сферы и требований к безопасности.
Откликнуться в приложении →

Похожие вакансии