7 мин

Что выбрать для резервного копирования 20 ТБ?

Резервное копирование 20 ТБ: сравниваем Veeam, Bacula и Proxmox Backup Server по цене, восстановлению и нагрузке на ИТ-службу.

Что выбрать для резервного копирования 20 ТБ?

Двадцать терабайт не определяют победителя. При таком объеме Veeam, Bacula и Proxmox Backup Server способны хранить резервные копии, но они требуют разного количества оплачиваемых лицензий, серверов, ручной работы и специальных знаний. Для небольшой ИТ-службы обычно выигрывает не продукт с самым длинным списком функций, а тот, на котором дежурный сможет восстановить нужную систему в плохой день без звонка единственному специалисту по бэкапу.

Моя короткая рекомендация такова. Для почти однородной среды Proxmox VE сначала проверяйте Proxmox Backup Server. Для VMware, Hyper-V, Proxmox VE и физических серверов в одной политике чаще разумнее Veeam. Bacula стоит выбирать, когда организации нужны разные носители, длительные циклы хранения и широкая автоматизация, а в команде есть инженер, готовый владеть Director, Catalog и конфигурацией. Бесплатная лицензия сама по себе не делает эксплуатацию дешевой.

Сначала посчитайте не 20 ТБ, а окно потери

Выбор начинается с RPO и RTO по каждой системе, потому что один общий объем скрывает самые дорогие требования. RPO отвечает, сколько данных допустимо потерять: сутки, час или несколько минут. RTO задает время до возврата сервиса. Файловый архив на 12 ТБ может терпеть восстановление двое суток, а база на 800 ГБ должна вернуться за час. Если сложить их в строку «20 ТБ», важное различие исчезнет.

Составьте реестр не по серверам, а по восстанавливаемым объектам: виртуальная машина, база, каталог пользователей, файловая шара, физический узел. Для каждого запишите используемый объем, дневное изменение, срок хранения, RPO, RTO, зависимые сервисы и требуемую точку восстановления. Отдельно отметьте, нужен ли возврат отдельного файла, диска, приложения или всей машины. Один и тот же продукт может быстро вернуть файл и медленно собрать целую ВМ.

Не смешивайте три величины:

  • исходный объем, то есть занятое место защищаемых систем;
  • логический объем всех точек восстановления до дедупликации и сжатия;
  • физический объем репозитория с запасом на рост, служебные данные и операции обслуживания.

Для первичной оценки используйте формулу репозиторий = полный объем + дневные изменения × число точек + запас. Коэффициент сжатия и дедупликации подставляйте только после пилота на собственных данных. Зашифрованные архивы, уже сжатые видео и некоторые базы почти не уменьшаются. Офисные ВМ с похожими операционными системами уменьшаются заметно лучше. Обещанный коэффициент без измерения превращает закупку дисков в лотерею.

Дневное изменение влияет на емкость сильнее, чем название продукта. Если из 20 ТБ каждый день меняется 2 процента, до сжатия появляется около 400 ГБ новых данных. При изменении 10 процентов тот же парк создает уже около 2 ТБ. Уточните также характер записи: база может переписывать крупные блоки из-за обслуживания, хотя полезных строк изменилось мало. Снимите показатели хотя бы за две обычные недели и отдельно за закрытие месяца, установку обновлений и массовую загрузку данных.

Срок хранения тоже нельзя свести к числу «30 дней». Политика из семи дневных, четырех недельных и двенадцати месячных точек расходует место иначе, чем тридцать последовательных инкрементов. Синтетические полные копии, активные полные копии и неизменяемость меняют временный запас и нагрузку на диски. Попросите каждого кандидата показать прогноз по вашей политике, а затем сравните прогноз с фактом после пилота.

При 20 ТБ исходных данных я не проектирую репозиторий ровно на 20 ТБ. Ему нужно принять первую полную копию, цепочку изменений, временный всплеск после обновления систем и рост до следующего бюджетного цикла. Еще нужно место для второй независимой копии. RAID защищает от отказа диска, но не заменяет вторую копию и не спасает от ошибочного удаления с правами администратора.

Цена складывается из трех счетов

Сравнивать только прайс лицензии неправильно. Полная стоимость складывается из программного обеспечения, инфраструктуры и труда команды. Для горизонта в три года полезно завести отдельные строки на сервер управления, репозиторий, диски, сетевые порты, удаленную площадку, обновления, поддержку, обучение и часы дежурных. Нулевая цена загрузки может соседствовать с дорогим восстановлением.

У Veeam коммерческое лицензирование обычно считают по защищаемым нагрузкам, а не по терабайтам. Официальная политика Veeam относит ВМ VMware, Hyper-V и Proxmox VE к защищаемым объектам VUL. Community Edition ограничена небольшим числом встроенных лицензируемых единиц, поэтому оценивать проект на 20 ТБ надо по количеству ВМ, физических машин и других нагрузок. Десять крупных ВМ и восемьдесят небольших ВМ дают одинаковые 20 ТБ, но разный счет. Точную цену и состав редакции следует фиксировать в коммерческом предложении, а не брать из старой статьи.

Proxmox Backup Server распространяется как открытое ПО. Платная подписка оформляется на сервер PBS и включает стабильный Enterprise Repository и выбранный уровень поддержки, при этом объем хранилища и число клиентов не ограничивают тариф. Это удобно для плотного кластера с множеством ВМ: добавление очередной машины не добавляет лицензионную единицу. Бесплатный репозиторий обновлений годится для лаборатории, но в рабочем расчете небольшой команды я закладываю подписку или другой оформленный канал поддержки.

У Bacula нужно сразу разделить Community и Enterprise. Community бесплатна и хорошо защищает файлы и системы через агенты, но многие удобные плагины для гипервизоров относятся к Enterprise. Документация Bacula Systems прямо помечает Proxmox Plugin как возможность только Enterprise. Если расчет предполагает агентное резервное копирование внутри гостевых систем, это один проект. Если нужен согласованный снимок ВМ, просмотр виртуальной инфраструктуры и восстановление через специальный плагин, это другой состав и коммерческая цена.

Труд сложнее всего поместить в таблицу, хотя небольшая служба платит им постоянно. Посчитайте часы на еженедельную проверку заданий, ежемесячное тестовое восстановление, обновления, разбор переполненного хранилища и исправление после смены пароля или сертификата. Добавьте стоимость отсутствия инженера, который один понимает конфигурацию. Bacula часто экономит лицензионный бюджет и требует больше инженерного владения. PBS обычно дает самый короткий путь в чистом Proxmox. Veeam просит больший программный бюджет, но переносит много повседневных операций в одну консоль.

Скорость восстановления надо измерить заранее

Скорость бэкапа не отвечает на вопрос о восстановлении. На возврате всей ВМ данные идут из репозитория через сеть к рабочему хранилищу, распаковываются, проверяются и записываются. Самый медленный участок ограничивает весь путь. Дедупликация экономит диски, но при слабом процессоре, случайном чтении множества блоков или фрагментированном хранилище она может увеличить время сборки.

Чистая арифметика быстро отрезвляет. Передача 20 ТБ по каналу 1 Гбит/с при недостижимом идеальном заполнении заняла бы около 44 часов. Для 10 Гбит/с нижняя граница близка к 4,4 часа. Протокол, параллельная нагрузка, чтение дисков и запись на целевое хранилище только увеличат время. Поэтому обещание «восстановим все за четыре часа» требует либо меньшего критичного набора, либо более быстрого пути, либо запуска ВМ прямо из резервной копии там, где продукт и платформа это поддерживают.

Проведите одинаковое приемочное испытание для всех кандидатов:

  1. Возьмите одну типичную ВМ, одну большую ВМ и сервис с базой. Сделайте полную копию и несколько инкрементов после реальных изменений.
  2. В рабочие часы верните отдельный файл, затем целую ВМ в изолированную сеть. Зафиксируйте время выбора точки, первого доступного файла, запуска ВМ и проверки приложения.
  3. Повторите возврат при параллельном задании резервного копирования. Иначе тест показывает пустой стенд, а не рабочий понедельник.
  4. Ограничьте права тестового оператора так, как они будут ограничены на дежурстве. Если для каждого шага нужен главный администратор, процесс еще не готов.
  5. Выключите сервер управления и проверьте документированную процедуру аварийного доступа к копиям.

Для базовой проверки репозитория сохраните такой профиль в файле restore-read.fio и запустите fio restore-read.fio:

[restore-read]
filename=/repo/testfile
size=100G
rw=read
bs=1M
direct=1

В результате ищите строку вида READ: bw=...MiB/s, но не принимайте ее за скорость продукта. Она показывает потолок последовательного чтения. Сравните его с фактической строкой времени полного восстановления и сохраните оба результата в протоколе.

Оценивать надо не лучший прогон, а повторяемый. Если три восстановления дают сильно разное время, найдите конкуренцию за диски, сеть, прокси или CPU. Для маленькой команды предсказуемые 90 минут полезнее случайного результата от 35 минут до четырех часов.

Veeam удобнее в смешанной инфраструктуре

Veeam чаще выигрывает, когда одна команда защищает несколько типов платформ и хочет одинаковый процесс задания, копирования и восстановления. Актуальная документация Veeam Backup & Replication перечисляет VMware vSphere, Microsoft Hyper-V, Nutanix AHV и Proxmox VE среди поддерживаемых платформ виртуализации. Поддержка Proxmox VE появилась начиная с версии 12.2, поэтому старое возражение «Veeam не умеет Proxmox» уже неверно.

Для Proxmox Veeam разворачивает Linux worker в инфраструктуре виртуализации. Он обрабатывает поток между узлом и репозиторием, значит его ресурсы, сеть и жизненный цикл входят в проект. Veeam умеет вернуть ВМ в Proxmox VE, восстановить гостевые файлы без предварительного запуска всей машины и выполнять ряд межплатформенных восстановлений. Набор операций зависит от версии сервера и платформы назначения, поэтому пилот должен повторять именно ваш маршрут, например VMware в Proxmox, а не абстрактное восстановление в исходный кластер.

Сильная сторона Veeam для небольшой службы состоит в готовых рабочих процедурах и понятном делегировании. Оператор видит задания и точки восстановления в одной консоли. Для защиты репозитория можно выделить Linux hardened repository с неизменяемыми файлами. Руководство Veeam рекомендует физический сервер с локальным блочным хранилищем, XFS и разовыми учетными данными для первичного добавления. NFS и SMB не подходят для этой роли, что нужно выяснить до закупки NAS.

Цена такой цельности состоит из лицензий и дополнительных компонентов. Сервер управления, репозиторий, workers или прокси, учетные записи и обновления требуют явной схемы. Не ставьте все роли в одну ВМ внутри защищаемого кластера: отказ кластера отнимет и рабочие системы, и инструмент возврата. Экспорт конфигурации, аварийные учетные данные и инструкция восстановления самого Veeam должны лежать отдельно.

Выбирайте Veeam, если у вас смешанные гипервизоры, важны прикладные восстановления и на дежурстве нужен единый интерфейс. Не выбирайте его по привычке, если все 20 ТБ живут в небольшом Proxmox-кластере, бюджет ограничен, а дополнительные возможности не входят в требования. В таком случае сначала докажите, что разница во времени восстановления или эксплуатации окупает лицензию.

Proxmox Backup Server выигрывает на своей платформе

Репозиторий для ваших 20 ТБ
GSE подберет серверную основу и дисковую конфигурацию под измеренное окно восстановления.
Обсудить проект

Proxmox Backup Server дает самый прямой путь для Proxmox VE. Кластер видит PBS как родное хранилище резервных копий, задания создаются из знакомого интерфейса, а сервер хранит снимки как набор индексируемых блоков. Клиент отправляет только отсутствующие блоки, но каждая точка восстановления логически содержит полный снимок. Это уменьшает сетевой трафик после первой копии и упрощает выбор точки.

Технический обзор PBS делает важное уточнение: дедупликация работает на уровне chunks, а индексы разных снимков ссылаются на общие блоки. Удаление старой точки удаляет сначала ее метаданные. Место освобождает отдельная сборка мусора, когда она подтверждает, что блоки больше никому не нужны. Администратор, который ожидает мгновенного возврата свободного места после prune, легко принимает нормальное поведение за поломку. Планируйте расписание garbage collection и следите, чтобы репозиторий не подошел к пределу до ее запуска.

PBS умеет проверять целостность по расписанию. Руководство рекомендует регулярно проверять новые копии и как минимум ежемесячно повторно проверять все архивы из-за деградации носителей. Эти чтения создают заметную дисковую нагрузку на 20 ТБ, поэтому verification, garbage collection, синхронизацию на второй PBS и рабочие бэкапы нельзя бездумно ставить в одно окно. Уведомления о результате каждого задания должны попадать в канал, который команда действительно читает.

Поддержка других источников уже, чем иногда предполагают. proxmox-backup-client работает на современных Linux-системах и умеет сохранять файловые архивы, но нативная интеграция PBS ориентирована на QEMU и LXC в Proxmox VE. Это не универсальная замена защите VMware, Hyper-V, Windows-приложений и всех физических серверов. Если рядом с Proxmox остаются две критичные системы другого типа, придется принять второй инструмент или изменить границы проекта.

Сам сервер PBS лучше ставить на отдельное физическое оборудование. Это прямо рекомендует руководство Proxmox: при отказе гипервизора копии останутся доступны. Второй datastore на том же корпусе не считается удаленной копией. Настройте Sync Job на другой PBS или отдельный носитель и дайте исходному кластеру учетную запись, которая может добавлять новые снимки, но не удалять существующие. Ключ шифрования и пароль к нему храните вне сервера. Без ключа зашифрованная удаленная копия бесполезна.

Выбирайте PBS для среды, где Proxmox VE составляет почти весь объем, команда хорошо знает Debian и можно выделить отдельный сервер плюс вторую площадку. Его низкая стоимость входа не отменяет диски, проверку, мониторинг и тренировку аварийного возврата. Зато число ВМ не превращается в растущий лицензионный счет.

Bacula требует владельца, а не просто администратора

Bacula подходит организациям, которым нужен конструктор политик для разных операционных систем, хранилищ, лент и долгих сроков. Ее архитектура разделяет Director, Storage Daemon, File Daemon и Catalog. Такое разделение дает точный контроль, но добавляет места отказа и конфигурацию, которую кто-то должен понимать без поисков в истории команд.

В Community Edition можно построить надежное агентное копирование файлов и систем. Это разумный вариант, когда приложения умеют готовить согласованное состояние скриптами, а команда принимает восстановление гостя по слоям: операционная система, данные, база, конфигурация. Но бесплатную редакцию нельзя описывать списком функций Enterprise. Специальные плагины Bacula Systems для VMware, Hyper-V, Nutanix, Proxmox и других платформ требуют проверки по выбранной подписке.

Proxmox Plugin в Bacula Enterprise сохраняет конфигурацию гостя, вызывает снимок или нужный режим остановки и передает архив через механизм Proxmox. Документация показывает отдельные объекты для QEMU и LXC и позволяет восстанавливать исходный или новый VMID. Это рабочая интеграция, но ее процесс не становится таким же нативным, как задание PBS из интерфейса Proxmox. Инженеру надо понимать одновременно журнал Bacula, каталог, хранилище и поведение гипервизора.

Bacula особенно уместна там, где уже есть компетенция, ленточная библиотека, несколько классов хранения или требования к длительному архиву. Она хуже подходит маленькой службе, которая хочет поставить продукт и касаться его только при красном уведомлении. Обновление Director, базы Catalog, агентов и плагинов требует совместимости версий и регрессионного восстановления после изменений.

Перед выбором попросите будущего владельца собрать стенд и затем передать дежурство коллеге по одной странице инструкции. Если коллега не может найти нужную точку, восстановить объект и объяснить сообщения JobId, эксплуатационная цена уже выше нуля. Покупка поддержки помогает с дефектами и сложными случаями, но не заменяет внутреннего владельца политики.

Неизменяемость не заменяет вторую границу доверия

Пилот с реальным восстановлением
Системная интеграция GSE поможет собрать стенд для проверки скорости на ваших нагрузках.
Обсудить проект

У всех трех решений можно построить стойкую схему, но ни одно название продукта не создает ее автоматически. Рабочая копия, репозиторий и удаленная копия должны иметь разные границы доступа. Учетная запись гипервизора не должна уметь удалить историю на удаленной площадке. Учетные данные резервного сервера не должны лежать в том же менеджере секретов, который зависит от восстанавливаемого домена.

Veeam hardened repository запрещает менять или удалять файлы до конца срока неизменяемости. Это сильная мера, если администратор правильно отделил Linux-сервер и не сделал его обычной сетевой шарой. PBS ограничивает возможности клиента и поддерживает синхронизацию datastore, но административные права самого PBS остаются мощными. В Bacula граница зависит от выбранного Storage Daemon, носителя и политики: лента вне библиотеки дает физическое отделение, а обычная доступная файловая система его не дает.

Неизменяемость создает и эксплуатационный риск. Ошибочная полная копия, зараженные данные или внезапный рост будут занимать место до истечения блокировки. Срок блокировки должен сочетаться с емкостью и политикой хранения. Проверяйте сценарий заполнения заранее: кто получает предупреждение, какие задания останавливаются первыми и как добавить емкость без снятия защиты.

Для 20 ТБ разумный минимум состоит из основной копии на отдельном сервере, второй копии с отдельными учетными данными и одной точки, недоступной обычному администратору производственной среды. Облачный объектный слой, удаленный PBS или лента могут закрыть последнюю роль, если команда умеет восстановиться с них. Название носителя менее важно, чем проверенный путь и доступ к ключам.

Для небольшой ИТ-службы выбор довольно узок

Поддержка после запуска системы
Круглосуточная техническая поддержка и сервисная сеть закрывают аппаратные вопросы на площадках.
Выбрать решение

Если 80-90 процентов объема находятся в Proxmox VE, а остальные данные можно уверенно забрать Linux-клиентом или отдельным простым заданием, берите PBS в пилот первым. Он проще лицензируется, близок к гипервизору и не требует отдельной универсальной платформы. Деньги лучше направить на отдельный сервер, быстрые диски, 10-гигабитный путь и вторую копию.

Если среда смешанная, есть VMware или Hyper-V, физические узлы и приложения с требованиями к точечному возврату, первым кандидатом становится Veeam. Проверьте поддержку конкретных версий гипервизоров и приложений, рассчитайте VUL по числу нагрузок и включите все служебные компоненты в схему. Его преимущество проявится только тогда, когда дежурный реально выполняет разные восстановления через общий процесс.

Если организация уже эксплуатирует Bacula или ей нужны ленты, сложные сроки хранения и разнообразные источники, Bacula может дать лучшую экономику. Без внутреннего владельца я не рекомендую начинать с нее ради бесплатной Community Edition. Через год сэкономленная лицензия не поможет, если Catalog никто не умеет восстановить.

Необязательно защищать все 20 ТБ одним продуктом, но два продукта удваивают часть процедур: мониторинг, обновления, документацию, учетные записи и учения. Разделение оправдано, когда граница ясна, например PBS для Proxmox и отдельное приложение для SaaS или старой платформы. Случайный набор исключений создает слепые зоны.

Проверьте еще один ресурс, который редко попадает в коммерческую таблицу: внимание дежурного. Одна служба может спокойно обслуживать сложную Bacula, если задания стабильны, конфигурация хранится под контролем версий, а два инженера умеют вернуть Catalog. Та же система станет риском при частой смене сотрудников. У Veeam проще передать типовые операции через консоль, но сложная смешанная схема все равно требует документации. PBS понятен администратору Proxmox, однако знание гипервизора не гарантирует знание дедупликации, garbage collection и восстановления ключей.

Разделите обязанности до выбора. Владелец сервиса назначает RPO и подтверждает результат запуска. Администратор бэкапа отвечает за задания, емкость и копии. Специалист по безопасности проверяет границы прав и хранение ключей. Дежурный выполняет инструкцию без расширенных прав. В маленькой команде один человек может носить несколько ролей, но проверки должны проходить с участием другого сотрудника. Иначе инженер подтверждает собственные предположения и пропускает шаг, который понятен только ему.

Попросите поставщика или интегратора передать не презентацию, а комплект эксплуатации: схему потоков данных, перечень учетных записей, порядок обновления, процедуру восстановления сервера управления и таблицу совместимости версий. В договоре поддержки уточните канал обращения, часы работы, язык и границу между неисправностью программы и проблемой оборудования. Ответ «поддержка включена» слишком расплывчат для ночного сбоя.

GSE может собрать такую схему на локально произведенных серверах и интегрировать ее с выбранным ПО, а общенациональная сервисная сеть и круглосуточная техническая поддержка закрывают аппаратную часть эксплуатации. Выбор самого продукта все равно должен пройти ваш тест восстановления, потому что интегратор не знает допустимый простой каждого сервиса лучше его владельца.

Решение принимает аварийная репетиция

До закупки подпишите короткий протокол приемки с измеримыми условиями. В нем должны быть допустимое время возврата критичной ВМ, файла и базы, скорость полной копии, окно ежедневного задания, потребление места после нескольких изменений, успешная повторная проверка и восстановление при недоступном сервере управления. Добавьте обновление продукта: после него повторите хотя бы один возврат.

Зафиксируйте итог в четырех строках: стоимость на три года, часы обслуживания в месяц, подтвержденный RPO и подтвержденный RTO. Все функции, которые не меняют эти строки и не закрывают обязательное требование, не должны решать спор. Для однородного Proxmox результат чаще укажет на PBS, для смешанной среды на Veeam, для сложной политики с сильной Unix-компетенцией на Bacula.

Самая опасная экономия состоит не в выборе бесплатного продукта, а в отказе от второго репозитория и учений. Купите меньше удобных функций, если нужно, но не вычеркивайте независимую копию, быстрый путь восстановления и время людей на проверку. Через шесть месяцев откройте протокол снова и восстановите те же объекты. Если результат перестал укладываться в RTO, система выросла из проекта раньше, чем закончились диски.

FAQ

Хватит ли бесплатной версии для резервного копирования 20 ТБ?

Объем сам по себе не запрещает бесплатный вариант. PBS не ограничивает хранилище лицензией, Bacula Community бесплатна, а Veeam Community Edition ограничивает число защищаемых единиц. Считать нужно ВМ, требуемые плагины, поддержку и часы эксплуатации.

Сколько места нужно для бэкапа 20 ТБ?

Начните с полного занятого объема, добавьте дневные изменения за срок хранения и запас на рост и обслуживание. Не уменьшайте расчет на рекламный коэффициент дедупликации до пилота. Для второй независимой копии нужна отдельная емкость.

Что быстрее восстанавливает ВМ: Veeam или Proxmox Backup Server?

Без теста на вашем сервере честного общего ответа нет. PBS имеет короткий нативный путь в Proxmox VE, а Veeam предлагает широкий набор способов возврата и удобен в смешанной среде. Скорость ограничат диски, сеть, CPU и целевое хранилище.

Подходит ли Proxmox Backup Server для VMware?

PBS нативно интегрирован с Proxmox VE, а его отдельный клиент ориентирован на современные Linux-системы. Считать его полноценной заменой специализированной защите VMware не стоит. Для смешанной среды сравните Veeam или коммерческие плагины Bacula.

Может ли Veeam копировать виртуальные машины Proxmox VE?

Да. Veeam Backup & Replication поддерживает Proxmox VE начиная с версии 12.2 и использует Linux workers для обработки данных. Проверяйте матрицу версий и нужный сценарий восстановления перед закупкой.

Нужна ли Bacula Enterprise или хватит Community?

Community подходит для агентного копирования и команд, готовых собирать процесс из компонентов. Специальные возможности гипервизоров, включая Proxmox Plugin, могут требовать Enterprise. Сверяйте редакцию по каждой обязательной функции, а не по общему списку Bacula.

Нужен ли отдельный физический сервер для резервных копий?

Да, если отказ защищаемого кластера не должен забрать инструмент восстановления вместе с копиями. Руководство Proxmox рекомендует отдельный физический PBS, а Veeam советует физический сервер с локальными дисками для hardened repository. Виртуальный сервер управления допустим только при отдельном аварийном пути.

Достаточно ли RAID для защиты резервных копий?

Нет. RAID сохраняет работу при отказе отдельных дисков, но не защищает от удаления, шифровальщика, ошибки администратора или потери площадки. Нужна вторая копия с отдельными правами и проверенным восстановлением.

Как часто проверять восстановление?

Критичные сервисы проверяйте после внедрения, после значимых обновлений и по регулярному графику, хотя бы ежемесячно для выбранных объектов. Проверка целостности блоков полезна, но она не доказывает запуск приложения. Нужны оба теста.

Можно ли использовать два решения одновременно?

Можно, если граница проста и записана, например PBS защищает Proxmox, а второе решение закрывает другую платформу. Учтите двойные обновления, мониторинг, права и инструкции. Если исключения множатся, единая система обычно дешевле в дежурстве.