🔥

Не упустите лучшие вакансии!

Подключите наш Telegram-бот и получайте мгновенные уведомления о новых предложениях из 10+ источников. Будьте первым, кто откликнется!

Подключить бота

Разработчик в команду управления жизненным циклом серверов

Яндекс
Москва, Санкт-Петербург, Екатеринбург, Новосибирск
Гибридный, Офис
Опубликовано: 06 May 2025
Наша группа является частью Platform Engineering в Яндексе. У Яндекса большой серверный парк, распределённый по нескольким локациям, в которых живут несколько отдельных облаков. В каждом облаке мы строим сервис, позволяющий автоматически управлять серверами и доводить их утилизацию до максимума. Мы разрабатываем систему, которая предоставляет нашим пользователям железо-как-сервис (Hardware-as-a-Service — HaaS).

Цели системы:

  • Автоматизировать процессы управления серверами
  • Автоматизировать диагностику и устранение проблем на серверах
  • Обеспечивать работоспособность серверной инфраструктуры
  • Создавать инструментарий, чтобы координировать плановые работы на серверах
  • Управлять доступами и правами на серверах

Наша система управляет примерно 98% мощностей компании: сотнями тысяч серверов в нескольких географически распределённых дата-центрах. На этих серверах запущены миллионы контейнеров с приложениями Яндекса.

Наш стек:

  • Код — Go и Python 3
  • Инфраструктура — YDB, MongoDB, Kubernetes, Terraform

Какие задачи вас ждут

Общее ускорение работы системы
Наша система собирает сотни метрик с каждого сервера. Вы будете вместе с нами оптимизировать и ускорять все пайплайны доставки и обработки данных.

Построение системы управления правами и доступами для виртуальных машин
Мы строим новый сервис, который объединит в себе инвентаризацию и управление доступами к виртуальным машинам. Наша цель — эффективно и быстро (за секунды) выдавать тысячам инженеров доступы к сотням тысяч виртуальных машин.

Создание эффективного планировщика регламентных/массовых работ
Каждый день в дата-центрах проводят десятки регламентных работ: меняют свитчи, апгрейдят стойки, планово выводят отдельные серверы в обслуживание. Наша задача — проводить все операции максимально эффективно и с минимальным влиянием на доступность облаков.

Мы ждем, что вы

  • Занимались промышленной разработкой на Go или Python от трёх лет
  • Проектировали и разрабатывали распределённые и высоконагруженные сервисы

Будет плюсом, если вы

  • Глубоко знаете Linux
  • Занимались многопоточным и асинхронным программированием
  • Имели опыт сетевого программирования
  • Получили коммерческий опыт в проектах с большим количеством интеграций
  • Работали с реляционными (PostgreSQL) и NoSQL (MongoDB) базами данных, умеете составлять сложные запросы и оптимизировать их
🚀

Ваше резюме увидят первым!

Автоматическое поднятие на HeadHunter каждые 4 часа. Увеличьте свои шансы на успех в 10 раз!

Подключить автоподнятие