🔥

Не упустите лучшие вакансии!

Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!

Подключить бота

Разработчик в Reliability Tools Yandex Cloud

Яндекс
Москва
Гибридный, Офис
Опубликовано: 06 Feb 2026
Команда Reliability Tools занимается разработкой инструментов для повышения надёжности сервисов Yandex Cloud. Мы создаём платформы и сервисы, которые помогают командам Yandex Cloud отслеживать качество мониторинга, управлять инцидентами и измерять уровень сервиса.

Мы разрабатываем:

  • Платформу отслеживания и повышения качества алертов и звонков в терминах precision и recall.
  • Инструменты управления инцидентами (автозаведение инцидентов, призывы ответственных, создание Zoom-встреч для разбора, AI-суммаризация таймлайна инцидента и другое).
  • Инструмент измерения SLI сервисов Yandex Cloud.

В работе мы используем:

  • Go и Kotlin — для разработки сервисов.
  • Terraform — для описания инфраструктуры.
  • TeamCity — для процессов CI/CD.

Какие задачи вас ждут

Система агрегации данных по SLI
Вам предстоит развивать систему агрегации данных по SLI сервисов Yandex Cloud, а также собирать и анализировать метрики надёжности.

Система аналитики качества алертов
Вы будете проектировать и развивать систему агрегации и аналитики качества алертов, помогая командам улучшать мониторинг.

Работа с инфраструктурой
Нужно будет настраивать CI/CD для новых сервисов, отлаживать сервисы в Kubernetes, поддерживать и развивать инфраструктуру команды.

Больше о бэкенде в Яндексе — в канале Yandex for Backend

Мы ждем, что вы

  • Разрабатывали и поддерживали отказоустойчивые системы
  • Выстраивали и эксплуатировали CI/CD-процессы для сервисов, использовали концепцию Infrastructure as Code
  • Умеете хорошо писать код на Golang и/или Kotlin
  • Знаете, как построить идеальный мониторинг
  • Любите улучшать процессы и автоматизировать задачи, писали сервисы и утилиты для автоматизации

Будет плюсом, если вы

  • Работали с системами контейнеризации и управления конфигурациями (Docker, K8s, SaltStack, Ansible, Terraform)
  • Строили облачные сервисы
  • Имеете опыт многопоточного и асинхронного программирования
  • Умеете быстро разбираться в чём угодно — в работе мы используем Go, Python, Linux, QEMU/KVM, Yandex Cloud и множество собственных и свободно распространяемых технологий
  • Глубоко знаете Linux
🚀

Ваше резюме увидят первым!

Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!

Подключить автоподнятие