Disaster Recovery as a Service, или DRaaS, - это облачная услуга, которая позволяет восстановить работу серверов и данных компании после сбоя за 5-15 минут вместо часов или дней простоя. Провайдер хранит копии вашей инфраструктуры на своем оборудовании и запускает их в работу, пока вы устраняете аварию на своей стороне. По сути это страховка для бизнеса от вирусов-вымогателей, аварий оборудования и человеческих ошибок, которая обходится дешевле содержания собственного резервного дата-центра.
Дальше разберем, чем DRaaS отличается от обычного бэкапа, какие показатели определяют качество услуги, кому она реально нужна и как проходит подключение.
От бэкапа к полноценному восстановлению
Backup as a Service решает одну задачу: сохраняет копии файлов и баз данных на случай, если что-то пропадет или повредится. Восстановление из такого бэкапа может занять часы, а иногда и дни, потому что нужно поднимать серверы, настраивать сеть и разворачивать приложения заново, уже после того, как файлы вернулись на место.
DRaaS решает другую задачу. Здесь заранее реплицируется не только сами данные, но и вся система целиком: серверы, приложения, сетевые настройки и связи между ними. Когда наступает авария, копия инфраструктуры включается почти сразу, потому что она уже готова к работе, а не собирается с нуля.
| Параметр | BaaS | DRaaS |
|---|---|---|
| Что защищает | Файлы, базы данных | Всю систему целиком: серверы, приложения, сеть |
| Скорость восстановления | От нескольких часов до нескольких дней | 5-15 минут |
| Что получаете на выходе | Копии данных для загрузки | Работающую копию инфраструктуры |
| Для кого подходит | Компании с некритичными данными, где допустим простой | Бизнес, где простой стоит денег и репутации |
На практике многие компании используют оба подхода вместе: бэкап для архивов и редко используемых данных, DRaaS для критичных систем, от которых зависит выручка.
RTO и RPO: цифры, которые определяют все
Когда провайдеры DRaaS рекламируют свою услугу, они почти всегда называют два показателя. RPO (Recovery Point Objective) - это объем данных, который может быть потерян с момента последнего сохранения до момента аварии. Если RPO равен одной минуте, значит при сбое вы теряете максимум минуту работы, а не час или день, как бывает при классическом бэкапе раз в сутки.
RTO (Recovery Time Objective) показывает, сколько времени пройдет с момента аварии до момента, когда система снова заработает. У качественных DRaaS-провайдеров этот показатель держится в районе 15 минут, а в отдельных случаях доходит до 5.
Разница между RPO в минуту и RPO в час для интернет-магазина или банка ощущается совсем не абстрактно: это разница между потерянными десятком заказов и потерянными сутками транзакций, которые придется восстанавливать вручную.
Кому подходит DRaaS, а кому пока рано
Услуга полезна не всем в одинаковой степени. Вот основные категории бизнеса, где DRaaS оправдывает вложения:
- Малый и средний бизнес. Собственный резервный дата-центр стоит дорого и требует отдельных специалистов. Облачная услуга дает доступ к тем же возможностям без капитальных затрат, а провайдер берет мониторинг и поддержку на себя.
- Крупные компании с критичными данными. Здесь важна не столько цена, сколько минимальный RPO и предсказуемость восстановления при большом объеме операций в сутки.
- Регулируемые отрасли. Финансовые организации, медицина, работа с персональными данными - там, где закон требует конкретных параметров защиты и восстановления, а не просто "мы стараемся".
- Компании с распределенной инфраструктурой. Филиалы в разных городах или странах получают единую платформу управления восстановлением вместо разрозненных локальных решений.
- Бизнес с высоким риском атак. Финансовый сектор, энергетика, здравоохранение - отрасли, где вымогатели особенно активны, а простой оборачивается прямыми убытками.
Если простой на несколько часов не критичен ни для выручки, ни для репутации, DRaaS может оказаться избыточным - в таком случае обычного резервного копирования вполне достаточно, а разницу в цене лучше направить на другие задачи.
Как устроен процесс подключения
Подключение к DRaaS обычно проходит в несколько этапов, и от того, насколько подробно проведен первый из них, зависит качество всего остального.
- Специалисты провайдера вместе с вашей IT-командой анализируют инфраструктуру и определяют, какие системы критичны, а какие можно восстанавливать позже.
- Настраивается первичная репликация данных, а затем регулярная синхронизация - от режима реального времени до заданных интервалов, в зависимости от требований бизнеса.
- Составляется план аварийного восстановления (Disaster Recovery Plan) с описанием процедур, ответственных лиц и контактов на случай сбоя.
- Система мониторинга подключается к инфраструктуре клиента и начинает отслеживать состояние в фоновом режиме.
- Проводится тестовый период (обычно около месяца), в течение которого можно проверить, как сценарий восстановления работает на практике, без риска для основной инфраструктуры.
После аварии, когда локальная инфраструктура снова готова к работе, данные реплицируются обратно, и система возвращается на основные мощности компании.
Как формируется цена: пример с рынка
Модель оплаты у большинства российских провайдеров DRaaS построена на резервировании ресурсов, а не на их постоянной оплате в полном объеме. У LanCloud, эта схема выглядит так: резерв процессорных ядер и памяти, которые всегда готовы к аварийному запуску, стоит 30% от их полной цены, а при плановом или аварийном запуске серверов ресурсы оплачиваются уже по полной стоимости, с поминутной тарификацией. Если резерв не оплачивать вовсе, реплицировать серверы в облако все равно можно, но автоматический аварийный запуск станет недоступен - в момент сбоя придется обращаться в техподдержку и ждать выделения мощностей, без гарантии, что они найдутся сразу под весь объем инфраструктуры.
Услуга у этого провайдера построена на технологии Veeam Cloud Connect Replication, а при аварийном переключении серверы остаются доступны по сети благодаря автоматически создаваемому VPN-туннелю на канальном уровне (L2) - то есть подключение к резервным серверам не требует ручной перенастройки сети. Актуальность данных на момент сбоя заявлена в пределах 15 минут, восстановление работы серверов - тоже в пределах 15 минут.
При предоплате провайдеры обычно дают скидку в зависимости от срока:
| Срок предоплаты | Типичная скидка |
|---|---|
| 1 месяц | 0% |
| 3 месяца | 5% |
| 6 месяцев | 10% |
| 12 месяцев | 15% |
Тестовый период на рынке чаще всего дают на 30 дней и без ограничения функциональности - это тот самый месяц, за который можно на практике проверить обещанные 15 минут восстановления, а не верить цифрам в презентации.
Какие планы восстановления существуют
Не все системы одинаково критичны, и универсального плана восстановления не существует. На практике провайдеры предлагают несколько вариантов, которые можно комбинировать.
Полная репликация подразумевает копирование всей инфраструктуры без исключений: серверов, баз данных, сетевых настроек. Такой план выбирают там, где простой любой части системы недопустим, например банки или онлайн-сервисы с непрерывным потоком транзакций. Цена у этого варианта самая высокая, зато и потери при аварии минимальны.
Частичная репликация покрывает только ключевые серверы и приложения, оставляя второстепенные системы для восстановления в обычном режиме уже после аварии. Это компромисс между стоимостью и надежностью, который подходит компаниям, где не все процессы одинаково важны для выручки.
Резервное копирование данных без репликации инфраструктуры - самый экономичный вариант. Данные хранятся в облаке, но серверы и приложения при аварии придется разворачивать заново. Подходит там, где важна сохранность информации, а время простоя не критично.
Разностное (инкрементальное) копирование сохраняет только изменения с момента последнего сохранения, а не полную копию каждый раз. Это экономит место на дисках и ускоряет сам процесс копирования, но при сбое в цепочке инкрементов возрастает риск потери части данных.
Мнение эксперта
При выборе между полной и частичной репликацией многие компании ошибаются в одну и ту же сторону: экономят на репликации второстепенных систем, а потом обнаруживают, что "второстепенное" на деле оказалось завязано на критичный процесс через десяток скрытых зависимостей. Перед подключением DRaaS имеет смысл потратить лишнюю неделю на честный аудит инфраструктуры и карту зависимостей между сервисами - это дешевле, чем разбираться с последствиями во время реальной аварии.
Частые вопросы
Сколько стоит DRaaS по сравнению с собственным резервным ЦОДом?
Точную цифру назвать сложно без расчета под конкретную инфраструктуру, но облачная модель почти всегда выходит дешевле за счет отсутствия капитальных затрат на оборудование, помещение и штат специалистов - вы платите за используемые ресурсы, а не за простаивающее "на всякий случай" железо.
Что произойдет с данными, если провайдер обанкротится?
Это стоит уточнять на этапе выбора провайдера: надежные компании прописывают в договоре условия передачи данных и предоставляют возможность выгрузки копий по запросу в любой момент действия услуги.
Можно ли протестировать DRaaS без риска для основной инфраструктуры?
Да, большинство провайдеров предоставляют тестовый период (обычно 30 дней) и инструменты для проверки сценариев восстановления в изолированной среде, не затрагивающей рабочие системы.
Подходит ли DRaaS небольшой компании с ограниченным бюджетом?
Если простой напрямую влияет на выручку или репутацию, да - облачная модель как раз и создавалась, чтобы снизить порог входа для бизнеса, у которого нет ресурсов на собственный резервный ЦОД. Если данные и системы не критичны, часто достаточно обычного бэкапа.
Что в итоге
DRaaS закрывает конкретную проблему: минуты и часы простоя, которые для одних компаний означают неудобство, а для других - прямые убытки и потерю клиентов. Перед покупкой стоит честно оценить два момента: сколько вам реально будет стоить час или сутки простоя, и какие показатели RTO и RPO предлагает провайдер на практике, а не в маркетинговых материалах. Если цифры сходятся в пользу облачного восстановления, тестовый период - лучший способ проверить это без лишнего риска.

