Как это работает
RAID-массив объединяет несколько дисков в один для увеличения емкости, скорости или отказоустойчивости, а не все три одновременно. Каждый уровень решает это обязательство по-своему: есть уровни, которые распределяют данные, не сохраняя ничего другого, другие записывают полные копии, а третьи вычисляют четность, чтобы иметь возможность восстановить то, что потеряно.
Калькулятор берет количество дисков, их емкость и выбранный уровень и возвращает, сколько емкости реально осталось для данных, сколько взято резервирования, сколько дисков может выйти из строя без потери информации и какая примерная производительность получается. Емкость отображается в десятичных единицах, используемых производителями, и в двоичных единицах, сообщаемых операционной системой, поэтому возникает вечное ощущение, что на диске меньше того, что указано на коробке.
Он также оценивает, сколько времени занимает перестроение и насколько вероятно возникновение неисправимой ошибки чтения во время его выполнения, что является моментом, когда многие массивы с одинарной четностью в конечном итоге выходят из строя. При окончательном сравнении рассчитываются все уровни с одним и тем же оборудованием, чтобы сразу увидеть, что получается и что теряется на каждом из них.
Примеры
8 × 4 TB · RAID 624 TBДва из восьми дисков переходят в режим двойной четности, поэтому для данных остается шесть: 24 ТБ в десятичном формате, что операционная система покажет как 21,8 ТиБ. КПД составляет 75% и массив терпит выход из строя любых двух дисков.8 × 4 TB · RAID 1016 TBПри тех же дисках зеркало оставляет только половину емкости. В свою очередь, он записывает в два раза быстрее, чем RAID 6, и восстанавливает, копируя один диск вместо чтения оставшихся семи.5 × 4 TB · RAID 572 %Это вероятность возникновения неисправимой ошибки чтения при восстановлении поврежденного диска, при этом на настольных дисках возникает 1 ошибка каждые 10^14 бит. Вам нужно прочитать целые 16 ТБ, а в RAID 5 любую ошибку во время чтения некуда восстановить.12 × 8 TB · RAID 6064 TBДвенадцать дисков разделены на две группы по шесть: каждая группа теряет два диска из-за двойной четности, поэтому для данных остается восемь. Приносится в жертву больше емкости, чем в RAID 6, но при восстановлении считываются только пять дисков в затронутой группе вместо одиннадцати в массиве.Сценарии использования
- Решите, сколько дисков купить и какого размера, чтобы достичь емкости, необходимой для NAS или файлового сервера.
- Сравнивайте уровни перед созданием аранжировки, когда у вас еще есть возможность выбора, поскольку последующее изменение уровней почти всегда означает переделку их с нуля.
- Объясните клиенту или начальнику, почему восемь дисков емкостью 4 ТБ не дадут вам 32 ТБ полезного пространства.
- Оцените, сколько часов массив подвергается воздействию при восстановлении диска, чтобы спланировать изменения в окне с низким уровнем использования.
- Оправдайте переход с RAID 5 на RAID 6 в большом дисковом массиве, показав риск перестройки.
- Прежде чем подписывать договор купли-продажи, рассчитайте фактическую стоимость одного используемого терабайта для различных комбинаций дисков и уровней.
Часто задаваемые вопросы
Почему операционная система показывает меньшую производительность, чем я оцениваю?
Потому что они не говорят на одном языке. Производители продают данные в десятичных единицах, где ТБ равен одному триллиону байт, а большинство операционных систем сообщают данные в двоичных единицах, где ТиБ равен 2^40 байтам, что примерно на 9% больше. Диск емкостью 4 ТБ отображается как 3,64 ТиБ без пропуска ни одного байта. Калькулятор показывает две цифры именно так, что разница не удивляет. К этому добавляется то, что резервирует файловая система, что зависит от того, какую из них вы используете.
RAID 5 или RAID 6?
Это зависит от размера дисков и их количества. RAID 5 жертвует одним диском и допускает один сбой; Проблема в том, что при перестроении массив остается без какой-либо защиты и все уцелевшие диски приходится читать от начала до конца, что для многотерабайтных дисков может занять несколько дней. RAID 6 жертвует еще одним диском, но терпит второй сбой прямо в этот критический момент. Для дисков емкостью 4 ТБ и более или массивов из восьми и более дисков разумным выбором будет RAID 6.
Что такое штраф за запись?
Это количество операций с физическим диском, которые стоит каждая логическая запись. В RAID 0 это 1, потому что написано и всё. В зеркалах стоит 2, потому что на два диска идут одни и те же данные. В RAID 5 это 4: вам нужно прочитать старые данные, прочитать старую четность, записать новые данные и записать новую четность. В RAID 6 это 6, потому что есть две четности. Вот почему массив с четностью может иметь отличное чтение и очень плохую произвольную запись, и именно поэтому базы данных с большим объемом записи обычно используют RAID 10.
Сколько дисков на самом деле поддерживает RAID 10?
Один гарантирован, и до половины суммы, если повезет. RAID 10 создает зеркала попарно и распределяет данные между ними: пока сбои приходятся на разные зеркала, массив еще жив, но если два вышедших из строя диска — одна пара, все потеряно. Имея восемь дисков, вы можете потерять четыре и продолжить игру, или потерять два и остаться ни с чем. Вот почему калькулятор показывает обе цифры, и никогда не рекомендуется планировать с оптимистической цифрой.
Когда подходит RAID 50 или RAID 60?
Когда дисков так много, что единая группа четности становится громоздкой. Разделение двенадцати или двадцати четырех дисков на несколько групп сокращает время восстановления, поскольку считывается только группа, в которой произошел сбой диска, а не весь массив, а также позволяет допускать один сбой на группу вместо одного во всем массиве. Цена в том, что у каждой группы остается свое соотношение: чем больше групп, тем меньше полезная емкость. Это уровни контроллера сервера или корпуса дисков, а не NAS с четырьмя отсеками.
Что произойдет, если диски разного размера?
В классическом RAID все диски ведут себя так, как если бы они были размером с самый маленький, а то, что осталось на больших, остается неиспользованным. Поэтому калькулятор работает с одним размером: если у вас смешанные диски, загрузите самый маленький и получите реальную емкость массива. Некоторые системы хранения, например несколько домашних NAS или файловых систем с собственным резервированием, умеют использовать избыточное пространство, но уже не подчиняются правилам традиционного RAID.
Повышает ли диск горячего резерва отказоустойчивость?
Это не добавляет терпимости к неудачам, это добавляет скорости реакции. Горячий резерв подключен и вращается без данных, ожидая отключения диска, чтобы восстановление могло загрузиться самостоятельно, за считанные минуты, а не тогда, когда кто-то пройдет мимо стойки. Поскольку самый опасный момент исправления — это именно тот момент от сбоя до окончания реконструкции, сокращение этого окна дорогого стоит. Разумеется, он занимает отсек и оплачивается как любой другой диск, поэтому калькулятор вычитает его из КПД.
Что такое неисправимая ошибка чтения и почему она портит восстановление?
Это сектор, который диск не может прочитать даже при наличии собственных корректирующих кодов. В технических характеристиках это указано как норма: диски для настольных ПК обычно указывают менее 1 на каждые 10^14 бит чтения, диски NAS — 1 на каждые 10^15, а диски для бизнеса SAS — 1 на каждые 10^16. При повседневном использовании это почти незаметно, но перестроение вынуждает вас полностью прочитать все уцелевшие диски, и именно тогда подсчет становится неудобным: в массиве с одной четностью единственная ошибка при таком массовом чтении означает потерю данных. При двойной четности же сектор перестраивается со второй и ничего не происходит.
Заменяет ли RAID резервное копирование?
Нет, и это самое дорогое недопонимание хранения. RAID защищает от физического отказа диска и ничего больше: случайное удаление, повреждение файла приложением, программа-вымогатель, кража, пожар или источник, забирающий все диски сразу, реплицируется или теряется одинаково по всему массиву. RAID – это высокая доступность, то есть продолжение работы при смене диска; резервная копия - это возможность вернуться назад. Оба необходимы.
Я собираюсь измерить значения IOPS и скорости?
Это теоретический потолок, полезный для сравнения уровней друг с другом. Они предполагают, что нагрузка распределяется равномерно между всеми дисками и что ни контроллер, ни его кэш, ни шина, ни файловая система не попадают в очередь. На практике контроллер с кэшем, защищенным от батареи, может скрыть большую часть штрафов за запись, а текущая перестройка может снизить производительность вдвое. Используйте цифры, чтобы определить уровень, а не обещайте цифры.