Managed Service for Valkey изнутри: как мы выжили на тысячах хостов

Базы данных и системы хранения

C/C++
Базы данных / другое

Программный комитет ещё не принял решения по этому докладу

Целевая аудитория

Инженеры, эксплуатирующие Redis/Valkey, и все, кому интересны внутренности облачных DBaaS-решений

Тезисы

Запустить Valkey в проде не очень сложно. Запустить его как Managed-сервис для тысяч клиентов с жесткими SLA - вызов, где стандартные инструменты ломаются один за другим. В этом докладе я расскажу о внутренней кухне нашего Managed Service for Valkey и поделюсь опытом эксплуатации.

Мы обсудим, почему мы выкинули встроенный Sentinel/Cluster failover и написали свой, как чтение AOF для бекапов спасает нас от OOM-ов, и как наш патч для PSYNC из AOF позволяет выкатывать обновления с рестартом, не перегружая primary-ноды генерацией RDB для реплик. Отдельно затронем суровую реальность эксплуатации сервиса на C: как организовать централизованный сбор minidump'ов без использования гигантских core-файлов и риска утечки пользовательских данных.

Будет много архитектуры и низкоуровневых деталей.

Разработчик Managed Databases в Yandex Cloud.

Видео

Другие доклады секции

Базы данных и системы хранения