RU

Oracle → PostgreSQL без даунтайма: как мы перевозили терабайт банковской базы и где всё ломалось

Задача звучала как задача из учебника: перенести кредитный домен банка с Oracle на PostgreSQL. 70+ таблиц, чуть больше терабайта данных, 500–3000 RP…

миграция баз данныхzero downtimecdcapache kafkapgbouncerhighloadархитектура бдshadow readsрепликация
Habr
RU

Переполнение диска в БД: обзор сценариев и механизмов защиты

База данных — бизнес-критический компонент любой ИТ-инфраструктуры, поэтому вопрос обеспечения ее доступности и отказоустойчивости обычно находится…

vk clouddatabasesпереполнение дискаwalрепликациямониторингалертыавтомасштабированиеread-only режимотказоустойчивость
Habr
RU

Снапшот — это не бэкап, а бэкап — это не гарантия

Что на самом деле защищает наши данные? Снапшоты, которые создаются за секунды и позволяют мгновенно откатиться к предыдущему состоянию? Регулярные…

бэкапрезервное копированиерепликациявиртуализацияснапшотыit-инфраструктура
Habr
RU

Почему шины данных не всегда лучшее решение для синхронизации систем

При миграции из одной корпоративной системы в другую часто встает задача репликации данных. Например, при поэтапной замене ERP по методологии Parall…

erp-системымиграциямиграция данныхсинхронизациясинхронизация данныхрепликациярепликация данныхparallel runningerpшины данных
Хабр — Управление
RU

Шардинг в Manticore Search: автоматическое распределение и репликация

На старте поисковая система часто устроена просто: одна таблица на одном сервере. Это работает, пока не случится одно из двух. Либо отдельный запрос…

шардингшардированиевысокая производительностьмасштабирование системмасштабирование поискараспределение данныхкластеррепликациябалансировка нагрузки
Habr
RU

Проблема миграции больших кластеров на Cassandra

Миграция Cassandra выглядит простой задачей ровно до того момента, пока кластер не становится действительно большим. Разберем, где достаточно snapsh…

cassandraбазы данныхбаза дынныхмиграцияsnapshotкластеррепликацияkubernetesstatefulsetоператор
Habr
RU

С самого начала у нас был четкий план восстановления, и мы его придерживались: как рассчитать честные RTO и RPO

Классическая ловушка при проектировании отказоустойчивости — разрыв между ожиданиями бизнеса и возможностями инфраструктуры. На бумаге в SLA может б…

RTORPODisaster RecoveryDRaaSPostgreSQLотказоустойчивостьбэкапрепликацияSLAХайстекс Акура
Habr
RU

[Перевод] Как Reddit без потерь перенес петабайтную Kafka с EC2 на Kubernetes

Миграция — риск даже для небольших инфраструктур. А когда у вас больше миллиарда пользователей и петабайт данных, права на ошибку нет вообще. Но вых…

kafkaмиграцияstrimziredditkraftkubernetesec2zookeeperрепликация
Habr
RU

Почему ваш DR-план не сработает при реальной аварии (и что с этим делать)

Недавно на вебинаре Хайстекс разбирались реальные сценарии DR на практике. В чате трансляции зрители задали ряд технических вопросов, наиболее интер…

аварийное восстановлениеdisaster recoveryRTORPOрепликацияfailoverfailbackрезервное копированиевиртуализацияхайстекс акура
Habr
RU

Репликация по DDIA: что я понял, только когда сам сломал прод

В понедельник утром бухгалтер из клиентской компании написала мне в Telegram: «У контрагента в SAP всё оплачено, а в Smartup долг 12 миллионов». Я о…

DDIAрепликацияmulti-leaderраспределённые системысинхронизация данныхSAP Business OneHANAконфликты репликацииlast-write-winsидемпотентность