DellShop B2B

Как спрогнозировать замену SSD в Dell PowerEdge по iDRAC

25 августа 2026 г.·6 мин чтения·Марина ЧерныхМарина Черных
Как спрогнозировать замену SSD в Dell PowerEdge по iDRAC

Два одинаковых SSD показывают 76 и 18% оставшегося ресурса. Второй выглядит опаснее, но одного снимка мало: первый может терять по два процентных пункта в месяц, а второй годами держаться на прежнем уровне.

Вам нужна не ещё одна цифра из iDRAC, а дата замены. Для неё придётся снять два сопоставимых замера, вычислить скорость износа и назначить рабочий порог. Тогда ИТ-служба получит план обслуживания, а согласующий бюджет — список накопителей с понятной очередностью.

Какие показатели брать из iDRAC #

Для SAS- и SATA-накопителей за PERC смотрите отчёт StorageDiskSMARTData. Поле PercentDriveLifeRemaining показывает оставшийся ресурс SSD в процентах. Это определение приводит отчёт Dell Telemetry Streaming with iDRAC9 — Storage Reports, ID 430.

Очередь накопителей на замену

У NVMe логика обратная. Отчёт NVMeSMARTData содержит PercentageUsed — оценку уже израсходованного ресурса. Остаток считают так:

Оставшийся ресурс = 100 − PercentageUsed

Если PercentageUsed равен 27%, для расчёта берите остаток 73%.

Поле AvailableSpare для этой задачи не подходит. По отчёту Dell оно показывает оставшуюся резервную ёмкость NVMe, а не срок службы накопителя. Подмена этих двух показателей даст неверный прогноз.

Потоковая телеметрия доступна на iDRAC9 с прошивкой 4.00.00.00 и лицензией Datacenter. Без неё снимите SMART через smartmontools. В статье Dell How To Pull SMART Information from a PERC Controller для первого устройства за PERC приведена команда:

smartctl -a -d megaraid,1 /dev/bus/0

Сначала выполните сканирование устройств и сопоставьте номер с физическим диском. Не переносите номер SMART-атрибута с одной модели SSD на другую: Dell отдельно предупреждает, что формат показателей износа зависит от накопителя.

Если Вы принимаете сервер после ремонта или покупаете его на вторичном рынке, сохраните исходный отчёт. Порядок проверки описан в руководстве по снятию SMART через PERC и оценке б/у накопителей.

Один замер показывает состояние, два — срок #

Допустим, 90 дней назад PercentDriveLifeRemaining показывал 82%, а сегодня — 76%. За этот период SSD израсходовал шесть процентных пунктов:

Расход в сутки = (82 − 76) / 90 = 0,067 пункта

Теперь нужен порог плановой замены. Возьмём 15% и посчитаем:

Дней до порога = (76 − 15) / 0,067 ≈ 910 дней

При прежней нагрузке накопитель достигнет порога примерно через 30 месяцев. До остатка 5% — примерно через 1060 дней, или 35 месяцев.

Пороги 15 и 5% взяты не для всех PowerEdge. В статье Dell по коду RAP162 для систем ECS профилактическая замена SATA OS SSD и SATA SSDr назначается при 15% остатка, реактивная — при 5%. Для обычного PowerEdge используйте внутренний резерв компании или порог, заданный для конкретной модели накопителя.

Например, компания может назначить замену при 20%, если закупка совместимого SSD занимает два месяца, а обслуживание проводят раз в квартал. Это внутреннее правило, не требование Dell. Оно защищает от ситуации, когда расчётный остаток уже достигнут, а диск ещё ждёт согласования.

Нагрузка меняется — прогноз тоже #

Линейный расчёт работает, пока профиль записи остаётся прежним. Если объём записи удвоится и скорость износа вырастет пропорционально, прогноз сократится примерно с 30 до 15 месяцев.

Поэтому рядом с процентом ресурса сохраняйте хотя бы объём записи. Для SATA и SAS отчёт Dell перечисляет MediaWriteCount; для NVMe — DataUnitsWritten и HostWriteCommands. Эти показатели помогают объяснить резкое изменение прогноза после переноса базы, запуска новой виртуальной машины или расширения журнала транзакций.

Если за 90 дней процент не изменился, делить на ноль нельзя. Это не означает, что SSD получил бесконечный ресурс. Увеличьте интервал наблюдения до момента, когда показатель изменится, либо дополните расчёт данными о записанном объёме.

Минимальная рабочая таблица выглядит так:

Диск Прошлый остаток Текущий остаток Период Расход в сутки Рабочий порог Прогноз Действие
SSD 1 82% 76% 90 дней 0,067 п. п. 15% 30 месяцев Включить в годовой план
SSD 2 нет замера 18% 15% Не вычисляется Снять SMART и проверить журнал
NVMe 1 21% использовано 27% использовано 90 дней 0,067 п. п. 85% использовано 29 месяцев Повторить замер через месяц

Для NVMe в третьей строке расход считают по PercentageUsed: показатель вырос на шесть пунктов за 90 дней. Порог 85% использованного ресурса в примере равен 15% остатка и служит внутренней расчётной границей.

Возраст сервера не заменяет данные об износе #

Правило «SSD работает пять лет» не учитывает объём записи, тип NAND и температуру. В FAQ Dell по серверным SSD ресурс NAND описан через конечное число циклов программирования и стирания. Чтение само по себе не расходует ресурс ячеек SLC, а высокая температура сокращает срок удержания данных.

Два накопителя одного года выпуска поэтому могут прийти к порогу в разные даты. Диск под журналом СУБД получает один профиль записи, загрузочный SSD гипервизора — другой. Срок считайте по каждому устройству, а не по возрасту сервера или массива.

При подборе замены проверьте не только интерфейс и объём, но и допустимую запись за сутки. Методика есть в сравнении потребительских и серверных SSD с расчётом DWPD.

SSD0001 и PDR16 отменяют спокойное наблюдение #

Согласно статье Dell Enterprise SAS SATA SSD — SMART Predictive Failures, событие SSD0001 появляется, когда оставшийся ресурс записи конкретного SSD опускается ниже заданного для него порога. Позже LifeCycle Log может записать PDR16 — SSD Predictive Failure.

Dell не задаёт единый процент срабатывания этих событий для всей линейки PowerEdge. Таблица вида «SSD0001 всегда появляется при 10%» была бы выдумкой.

При SSD0001 сохраните резервную копию, LifeCycle Log и SMART, затем проверьте состояние массива и совместимость замены. При PDR16 работайте с диском как с предсказанным отказом: не ждите нулевого остатка и следующего планового цикла. Подробный порядок действий вынесен в руководство по событиям SSD0001 и PDR16 в iDRAC.

Износ не всегда получится провести как гарантийный дефект. Ограниченная аппаратная гарантия Dell покрывает дефекты материалов и изготовления, но не проблемы после достижения максимального ресурса устройства. Журналы и SMART всё равно стоит сохранить: они отделят износ от другой неисправности и помогут согласовать решение.

Как превратить прогноз в заявку на рубли #

В заявку включайте диск, когда расчётная дата достижения рабочего порога наступит раньше ближайшего доступного окна закупки и обслуживания. Если до порога осталось девять месяцев, а согласование, поставка и плановое окно вместе занимают четыре, ждать ещё полгода нельзя.

Сумму считайте по свежему коммерческому предложению на совместимую модель:

Бюджет = цена одного SSD × число дисков к замене + резерв

Допустим, один совместимый SSD в полученном предложении стоит 85 000 ₽. Один диск с быстрым износом и второй с близким прогнозом требуют 170 000 ₽ без учёта резерва:

85 000 ₽ × 2 = 170 000 ₽

Цена 85 000 ₽ здесь — пример исходных данных, а не рыночная оценка. Подставьте сумму из своего предложения. Резерв обоснуйте не процентом «на всякий случай», а конкретным риском: второй диск той же партии, длительная поставка или отсутствие совместимой модели на месте.

Рабочее правило короткое:

  • снимайте одну и ту же метрику не реже раза в квартал;
  • считайте скорость износа отдельно для каждого SSD;
  • назначайте порог по модели накопителя и сроку своей закупки;
  • включайте диск в бюджет до того, как прогноз пересечёт доступное окно обслуживания;
  • после SSD0001 готовьте замену, после PDR16 не ждите следующего планового цикла.

Поделиться статьёй:

TelegramVKWhatsApp

Об авторе

Марина Черных
Марина Черных

Диагностика и ремонт · Реальные поломки

Инженер технической поддержки, 6 лет в диагностике и ремонте серверов. Знает, почему серверы ломаются и как этого избежать. Объясняет сложное простым языком.

Все статьи автора →

Похожие материалы

Регламент резервного копирования: как проверить, что данные восстановятся

Регламент резервного копирования: как проверить, что данные восстановятся

Ежедневные копии не гарантируют, что 1С или виртуальная машина поднимется после сбоя. Каркас регламента связывает расписание с RTO и RPO, назначает ответственных и задаёт четыре уровня тестов — от файла до площадки.

01.09.20268 мин
Завис сервер Dell PowerEdge: что проверить до перезагрузки

Завис сервер Dell PowerEdge: что проверить до перезагрузки

ОС не отвечает, но iDRAC доступен. До перезагрузки выгрузите SEL, отделите сетевой обрыв от аппаратного сбоя и сохраните признаки отказа. Порядок проверки PowerEdge: от первых минут до F10/F11-диагностики и границы гарантийного ремонта.

01.09.20265 мин