Вообще, мое мнение по статье, сводится к тому что, вот смотрите какая крутая у нас СХД, покупая DELL, IBM, Huawei вы становитесь заложниками vendor lock-in, а у нас супер СХД и вообще почти open-source, но мысль что отвязываясь от именитых брендов и привязываясь к местечковому вендору не покидает, со всеми вытекающими последствиями, примерно как в современной авиации, есть Boeing, есть Airbus, и есть например Туполев, если у А или Б самолет сломается в любой части земного шара, то максимум что грозит это ожидание ближайшего рейса с запчастью с ближайшего склада, в случае с Ту, это пока эту деталь закажут на заводе, сделают, и только через n-дней доставят до получателя вместе с командой техников…
1. у ceph тоже сначала в кеш(wal/db на nvme диски), и тоже для повышения производительности
2. Как ни странно но вы не единственные кто юзает BBU на контроллере ))
3. В ceph данные дублируются на еще 2 OSD не расположенные в этом же сервере, итого имеем фактор репликации 3
4. Ну в вашей терминологии у меня 14 контроллеров(14 выделенных серверов хранения) максимальное количество даже страшно представить, в CERN'е хранилки на CEPH доходят до 30Пб, горячая замена по прежнему присутствует и активно используется, выход из строя 1/3 всего кластера не ложит систему на лопатки
5. В цеф это сделано через pool's, можно сделать only flash pool и использовать его как горячее хранилище, но при использовании nvme дисков и так производительности хватает
Чем вам RBD не блочный сторадж? в случае с ceph я могу по одной две ноды выводить на maintainance и обновлять их без урона производительности, в случае с цефом, возможно очень быстро горизонтально увеличить емкость и производительность, у меня в данный момент в продакшене кластер цефа, 6 нод под iSCSI, 14 нод хранения(36x6Tb, 2x800Gb NVME) обьем RAW 2.5Петабайта replication factor=2 вся сеть передачи 2x10Gb на production и 2x10 cluster network
2. Как ни странно но вы не единственные кто юзает BBU на контроллере ))
3. В ceph данные дублируются на еще 2 OSD не расположенные в этом же сервере, итого имеем фактор репликации 3
4. Ну в вашей терминологии у меня 14 контроллеров(14 выделенных серверов хранения) максимальное количество даже страшно представить, в CERN'е хранилки на CEPH доходят до 30Пб, горячая замена по прежнему присутствует и активно используется, выход из строя 1/3 всего кластера не ложит систему на лопатки
5. В цеф это сделано через pool's, можно сделать only flash pool и использовать его как горячее хранилище, но при использовании nvme дисков и так производительности хватает
Да да, Ceph смотрит на это с презрением, не раз обновлял работающий кластер без существенного падения производительности и простоя