Tilda Publishing
Привет, любопытный друг. Да, это Tilda. Потому что мы хотим быстро внедрять и управлять решением, а не ждать
в очереди разработчика. Контроль, предсказуемость и отказоустойчивость — наша главная идея.
Подберём типовое или произведем на заказ серверное оборудование, предоставим расчёт и поможем интегрировать в систему.

Заполните форму запроса слева или отправьте описание вашей задачи на почту get@work-system.ru

При отправке письма на почту укажите номер телефона вашего специалиста для обсуждения аналогов оборудования в случае необходимости

Резервное копирование и аварийное восстановление под ключ

Резервное копирование и аварийное восстановление под ключ — это проектирование и внедрение системы, которая гарантирует не только сохранность ваших данных, но и возобновление работы бизнеса в заданное время после сбоя, шифровальщика или физической аварии ЦОД. Такое решение нужно компаниям, где простой инфраструктуры измеряется деньгами: процессинг, биллинг, производство, госсектор, объекты КИИ. Без него бизнес рискует потерять данные за часы или сутки работы — и обнаружить это в момент, когда восстанавливать уже нечего. Work System проектирует архитектуру хранения, поставляет серверы и ленточные библиотеки, разворачивает ПО (Кибер Бэкап, RuBackup) и проверяет восстановление на практике.

RPO и RTO: как бизнес определяет допустимые потери данных

RPO (Recovery Point Objective) — максимально допустимый объём данных во временном эквиваленте, который вы готовы безвозвратно потерять. Именно RPO диктует частоту копирования. Если бэкап ERP снимается раз в сутки ночью, а сбой происходит в 15:00, вы теряете 15 часов работы. Для транзакционных систем — биллинга, процессинга — RPO должен исчисляться минутами, а это уже требует потоковой репликации, а не ночного задания.

RTO (Recovery Time Objective) — предельное время, за которое инфраструктура должна быть восстановлена. Оно включает не только копирование данных обратно, но и обнаружение инцидента, мобилизацию команды, инициализацию серверов и проверку консистентности баз. Наличие резервной копии не тождественно наличию DR-плана: бэкап гарантирует сохранность данных, DR-план гарантирует, что бизнес возобновит операции в срок.

Из чего состоит система резервного копирования и DR

  • Сервер резервного копирования и дисковые репозитории
    Использование RAID 5 для репозитория бэкапов — доказанная ошибка. При отказе одного диска в массиве 6×18 ТБ SATA контроллер читает около 90 ТБ для перестройки, и вероятность встретить Unrecoverable Read Error (один сбой на 10^14 бит) на таком объёме превышает 50% — массив рассыпается вместе со всеми копиями. Индустриальный стандарт для репозиториев: RAID 6, RAID 60 или пулы ZFS (RAID-Z2/Z3). Дедупликация требует от 8 ядер CPU и около 1 ГБ RAM на каждый 1 ТБ дедуплицированных данных; NVMe под кэш и индексы ускоряет синтетические полные копии.
  • Программное обеспечение: Кибер Бэкап и RuBackup
    Кибер Бэкап (Киберпротект) построен на базе кода Acronis, но это полностью независимый российский продукт без связи с зарубежными облачными сервисами. Он закрывает гетерогенные среды — физические серверы, VMware, Hyper-V, KVM, отечественные гипервизоры, рабочие станции — через единую веб-консоль, а модуль «Активная защита» блокирует шифрование и восстанавливает поражённые файлы из кэша.

    RuBackup (Группа Астра) ориентирован на госсектор, КИИ и Enterprise на Linux: нативная поддержка Astra Linux, zVirt, VMmanager, Postgres Pro, многопоточное копирование и ролевая модель доступа. Оба продукта в реестре Минцифры и сертифицированы ФСТЭК.
  • Правило 3-2-1-1-0: локально, off-site и ленточная библиотека
    Классическое 3-2-1 — три копии, на двух типах носителей, одна off-site. Шифровальщики заставили расширить его до 3-2-1-1-0: добавляется одна изолированная (Air-gapped) или неизменяемая (Immutable) копия, а ноль означает ноль ошибок при восстановлении. Последнее достигается автоматизированной проверкой в изолированных виртуальных лабораториях (SureBackup).

    Неизменяемость обеспечивают WORM на лентах или S3 Object Lock в объектных хранилищах. Практический смысл прост: злоумышленник с правами Domain Admin не сможет ни удалить, ни переписать такой архив — а именно на это рассчитывают современные шифровальщики.
  • DR-площадка и репликация данных
    DR-стратегия выбирается под ваши RTO и бюджет. Active-Passive держит резервный ЦОД на приёме реплик с переключением Failover при аварии. Warm Standby — оборудование включено, ВМ выключены и получают инкременты, запуск занимает минуты. Pilot Light держит рабочими только базовые сервисы (AD, СУБД), остальное разворачивается по факту аварии. Active-Active даёт RTO = 0, но требует сложной синхронизации БД и широких оптических каналов.

    Репликация бывает синхронной (RPO = 0, задержка 2–5 мс, расстояние обычно до 50–100 км) и асинхронной (RPO от секунд до минут, без ограничений по дистанции). Выбор между ними — это баланс между нулевой потерей данных и географической защитой

Типичные ошибки, которые обнаруживаем при аудите

Самая частая — бэкап на том же RAID, что и продуктив: при отказе массива теряются и оригинал, и копия. Немногим лучше репозиторий в том же домене Active Directory — шифровальщик с правами Domain Admin шифрует его наравне с боевыми серверами.

Отдельная категория — бэкапы, которые никто не пробовал восстановить. При реальном инциденте всплывают логические ошибки, забытые пароли шифрования, отсутствующие ключи запуска СУБД. Встречается и разрыв между архитектурой и SLA: RPO 24 часа при требовании бизнеса «потерять не более часа». И почти всегда нет DR-плана — копии есть, но разворачивать их некуда, а заказ новых серверов занимает 8 недель.

Кейсы из нашей практики

ОАК
кластер резервного копирования для авиастроительной корпорации
Для ОАК требовался надёжный кластер для архивного хранения возросшего потока данных, включая оцифровку старой документации, с обязательным условием — оборудование производства КНР или РФ. За 3 месяца Work System провёл техническую оценку совместимости, предложил варианты на базе трёх производителей и перешёл на отечественное оборудование, заменив Supermicro на Контролшифт.

Подобрана высокоплотная СХД с полками расширения до 120 дисков 3.5" по 20 ТБ в 8U, с запасом по объёму и мощности на 5 лет вперёд. В результате объём хранения архивов вырос вдвое, расходы на дальнейшее масштабирование снижены на 30%, выбран вендор с официальной поддержкой в РФ, а решение оказалось совместимо со всем существующим оборудованием заказчика.
Промышленно-продовольственный кластер «Косино»
виртуализация и резервное копирование
Для Косино (дочерняя компания ВТБ Недвижимости) нужно было построить кластер виртуализации и резервного копирования с обязательным набором функций ПО: снапшоты, репликация, дедупликация, кластеризация, нарезка LUN. Горизонт планирования — 5 лет.

За 2 недели Work System сравнил российские и зарубежные решения и рекомендовал моновендорную архитектуру на базе Huawei — она закрывала весь перечень требований и позволяла оптимизировать вложения в оборудование и поддержку. Выполнены монтаж, ввод в сеть и запуск. Построенная инфраструктура в срок закрыла технические потребности заказчика, набор оборудования стандартизирован, а вложения оптимизированы.
Спортивные лотереи
серверы, ленточная библиотека и СХД Lenovo
Для проекта «Спортивные лотереи» требовалось инфраструктурное решение для бесперебойной обработки данных и хранения больших объёмов информации. Work System поставил и интегрировал комплекс на базе серверов, ленточной библиотеки и СХД Lenovo.

Ленточная библиотека здесь работает как элемент архитектуры долгосрочного хранения: лента даёт физический Air-gap и срок хранения до 30 лет, что делает её опорой для архивного слоя. Инфраструктура введена в эксплуатацию, обработка данных и долгосрочное хранение обеспечены в штатном режиме.

Почему выбирают Work System

Work System — российский интегратор и поставщик серверного оборудования, СХД и комплексных IT-решений, работающий с 2017 года. Мы ведём проект от аудита и подбора решения до поставки, настройки, тестирования и сопровождения. За плечами более 600 реализованных проектов, свыше 30 партнёров-производителей и более 70 сертификатов у специалистов.

Мы не разработчик ПО для бэкапа — наша зона ответственности инженерная: проектирование архитектуры хранения, поставка и настройка серверов-репозиториев и ленточных библиотек, развёртывание Кибер Бэкап и RuBackup, тестирование восстановления. Перед отгрузкой оборудование проходит нагрузочное тестирование и проверку по 20 параметрам. Мы также участвуем в подготовке ТЗ для закупок по 44-ФЗ и 223-ФЗ.
  • 600+
    реализованных проектов
  • 30+
    вендоров-партнёров
  • 70+
    сертификатов инженеров
  • 24/7
    поддержка по SLA

Начните с аудита текущей системы резервного копирования

Мы проверим, где ваши копии уязвимы перед шифровальщиком и сбоем RAID, рассчитаем архитектуру хранения и подберём программный стек под ваши RPO и RTO. Оставьте заявку — обсудим проект, требования и бюджет, а расчёт предложим после анализа вашей инфраструктуры.

Этапы внедрения системы резервного копирования и DR под ключ

  • Аудит инфраструктуры и Business Impact Analysis
    Начинаем с инвентаризации систем и Business Impact Analysis (BIA): определяем, какие сервисы критичны, сколько стоит час их простоя и какие RPO и RTO реально нужны бизнесу, а не декларируются на бумаге. Параллельно проверяем текущие копии — где они лежат, в одном ли домене с продуктивом, тестировалось ли восстановление. На выходе — карта рисков и разрывов между архитектурой и требованиями.
  • Проектирование архитектуры и выбор программного стека
    По результатам BIA проектируем схему хранения: локальный слой для быстрого восстановления, off-site или лента для катастрофоустойчивости, иммутабельные копии против шифровальщиков. Подбираем ПО — Кибер Бэкап или RuBackup — под ваши платформы виртуализации, регуляторные требования (реестр Минцифры, ФСТЭК) и модель лицензирования. Рассчитываем сервер-репозиторий с корректным уровнем RAID, объёмом RAM под дедупликацию и сетью.
  • Поставка оборудования и развёртывание ПО
    Поставляем серверы, СХД и ленточные библиотеки, разворачиваем и настраиваем ПО, собираем репозитории и задания копирования. При работе с LTO-9 закладываем время на калибровку картриджей — процедура занимает 20–120 минут на ленту, и на большой библиотеке инициализация медиа растягивается на недели. Настраиваем репликацию на DR-площадку по выбранной стратегии.
  • Тестирование восстановления и документация DR-плана
    Бэкап, из которого ни разу не восстанавливали систему, фактически не существует. Мы проводим реальные тесты восстановления в изолированной среде, проверяем консистентность баз, время развёртывания и укладываемся ли в заявленный RTO. Итог фиксируем в DR-плане: порядок действий, роли, точки переключения Failover и Failback. Документ становится инструкцией, по которой ваша команда действует в момент аварии, а не импровизирует.

Часто задаваемые вопросы