Managed Service for Valkey изнутри: как мы выжили на тысячах хостов
Программный комитет ещё не принял решения по этому докладу
Целевая аудитория
Тезисы
Запустить Valkey в проде не очень сложно. Запустить его как Managed-сервис для тысяч клиентов с жесткими SLA - вызов, где стандартные инструменты ломаются один за другим. В этом докладе я расскажу о внутренней кухне нашего Managed Service for Valkey и поделюсь опытом эксплуатации.
Мы обсудим, почему мы выкинули встроенный Sentinel/Cluster failover и написали свой, как чтение AOF для бекапов спасает нас от OOM-ов, и как наш патч для PSYNC из AOF позволяет выкатывать обновления с рестартом, не перегружая primary-ноды генерацией RDB для реплик. Отдельно затронем суровую реальность эксплуатации сервиса на C: как организовать централизованный сбор minidump'ов без использования гигантских core-файлов и риска утечки пользовательских данных.
Будет много архитектуры и низкоуровневых деталей.
Разработчик Managed Databases в Yandex Cloud.
Видео
Другие доклады секции
Базы данных и системы хранения