Поставщик предлагает включить Atlas ASM 2.5 в проект, а руководитель ждёт ответа по закупке. Но среди доступных материалов нет документации Atlas, по которой можно проверить версию, производительность и схему отказоустойчивости.

Согласовывать ASM 2.5 для рабочего контура пока рано. Сначала запросите первичные документы Atlas, затем проверьте продукт на отдельном стенде. До этого характеристики из предложения нельзя включать в обоснование закупки.

Подробнее о проверке заявлений поставщика мы писали в материале о том, почему миллионы IOPS не доказывают пригодность СХД для 1С.

Одно предложение скрывает несколько разных утверждений

В предложении новой системы хранения обычно смешаны три утверждения. Поставщик называет версию продукта, приводит результат нагрузочного теста и обещает работу после отказа оборудования. Для проверки каждого пункта нужен отдельный документ.

Среди доступных материалов нет публикации Atlas об ASM 2.5 и примечаний к выпуску. Поэтому нельзя подтвердить статус версии, перечень изменений и поддерживаемые конфигурации.

Заявления о производительности тоже требуют протокола испытаний. Без размера блока, доли чтения и записи, глубины очереди, задержки и состава стенда результат нельзя переносить на вашу базу 1С.

То же относится к отказоустойчивости. Наличие второго контроллера или узла ещё не подтверждает автоматическое переключение. Нужен документ Atlas с архитектурой системы и описанными сценариями отказа.

Что указано в предложенииЧего не хватает для проверкиКакое решение допустимо сейчас
Название ASM 2.5Публикации Atlas, примечаний к выпуску и списка поддерживаемого оборудованияЗапросить документы, но не планировать обновление
Результат нагрузочного тестаСостава стенда, размера блока, доли чтения и записи, глубины очереди и задержкиНе учитывать результат при сравнении СХД
Заявление об отказоустойчивой работеАрхитектуры кластера, перечня резервируемых компонентов и порядка переключенияНе обещать непрерывную работу 1С
Пригодность для инфраструктуры 1СМатрицы совместимости с СУБД, гипервизором, драйверами и оборудованиемДопустить продукт только к изолированному пилоту

Пока предложение годится лишь как основание запросить техническое досье. Для закупки или обновления данных недостаточно.

Отказоустойчивость начинается со сценария сбоя

Imperva определяет отказоустойчивость как способность системы продолжать работу без перерыва при отказе одного или нескольких компонентов. Высокая доступность допускает минимальный уровень прерывания сервиса.

Для 1С разница проявляется во время переключения. Горячий резерв принимает нагрузку сразу. Тёплому или холодному резерву требуется время на запуск.

Наличие второго контроллера не объясняет поведение системы при сбое. Надо выяснить, кто обнаруживает отказ, куда переходит нагрузка и что происходит с незавершёнными записями. Ответы должны относиться именно к ASM 2.5.

Проверку строят по границам отказа. Контроллер, управляющий узел, сетевой путь и накопитель отключают по очереди. Одновременный отказ нескольких компонентов проверяют отдельно.

Сбой на пилотеКакой ответ нужен от AtlasЧто считать критерием допуска
Потеря контроллера храненияКак система обнаруживает отказ, какой узел принимает нагрузку, что происходит с операциями в очереди1С и СУБД продолжают работать либо возвращаются по согласованному сценарию
Остановка управляющего узла ASMЗависит ли путь данных от управляющего сервиса, как возвращается управлениеДанные остаются целыми, управление возвращается без пересборки системы
Разрыв одного сетевого путиКакие протоколы и схемы multipath поддержаны, как выбирается запасной маршрутСУБД сохраняет доступ к томам, в журналах нет ошибок записи
Отказ накопителяКакая схема защиты действует, как начинается восстановление массива, что происходит при следующем сбоеМассив остаётся доступен, восстановление укладывается в пределы пилота
Возврат компонента после ремонтаНужна ли ручная синхронизация, как система исключает устаревшую копию данныхКомпонент возвращается без расхождения данных

Слово «отказоустойчивость» получит технический смысл после воспроизводимой проверки заявленных отказов. До неё это формулировка поставщика, а не характеристика рабочего контура.

Числовые пределы времени переключения нельзя назначить вместо Atlas. Производитель должен указать поведение системы, а владелец 1С — допустимую паузу для компании. Эти условия фиксируют до пилота.

Почему число IOPS не превращается в пользователей 1С

IOPS показывает число операций ввода-вывода за секунду. Показатель не раскрывает время отдельной операции и поведение вашей базы.

Одинаковое число IOPS можно получить при несопоставимых нагрузках. Последовательное чтение крупными блоками отличается от случайной записи малыми блоками. Смешанная нагрузка даст ещё один результат.

Глубокая очередь способна увеличить итоговое число операций. Задержка отдельного запроса при этом может вырасти. Для пользователей 1С это означает паузу, хотя показатель IOPS выглядит убедительно.

Запрос 1С проходит через несколько компонентов. Клиент обращается к серверу приложений, сервер работает с СУБД, а СУБД читает и записывает данные через файловую систему и контроллер хранения. Результат на последнем участке не предсказывает длительность всей операции.

Перевести IOPS в число пользователей расчётом нельзя. Для этого нужны распределение операций базы, размер блока, доля записи, допустимая задержка и запас под фоновые задания. Без исходных данных любой коэффициент придётся придумать.

Сетевые интерфейсы также задают границу пропускной способности, но не скорость работы 1С. В обзоре ZDNET NAS TerraMaster F8 SSD Plus получил один порт 10GbE. Заявленная скорость чтения и записи достигает 1024 МБ/с.

В обзоре PCMag у Asustor AS6804T указаны два порта 10GbE и два порта 5GbE. Эти характеристики относятся к названным NAS, а не к ASM 2.5.

Примеры показывают границу паспортных данных. Число портов и пропускная способность не отвечают на вопрос о задержке базы. Сравнивать по ним разные системы хранения нельзя.

ПоказательЧто он сообщаетЧего по нему нельзя определить
IOPSЧисло операций за секунду при заданном профиле тестаСколько пользователей выдержит база 1С
МБ/сОбъём данных, переданный за секундуСколько длится проведение документа
Средняя задержкаСреднее время ответа за периодКак система ведёт себя на коротких пиках
Число сетевых портовДоступные физические подключенияРаботает ли переключение при обрыве пути
Максимальная ёмкостьПредельный объём поддерживаемых накопителейХватит ли производительности под рабочую нагрузку

Для допуска СХД нужен не самый крупный паспортный показатель, а воспроизводимый результат на вашем профиле 1С.

Какие документы запросить у Atlas

Начните не с коммерческого предложения, а с технического досье версии. Обозначение ASM 2.5 должно стоять в каждом документе. Сведения о другой версии не закрывают проверку.

Сначала запросите примечания к выпуску. В них нужны дата публикации, перечень изменений, известные ограничения и требования к обновлению. Без этого документа нельзя подтвердить статус версии.

Следом запросите матрицу совместимости. В ней должны совпасть модель СХД, версия микропрограммы, ASM 2.5, операционная система, гипервизор, СУБД, драйверы и протокол доступа. Поддержку отсутствующего сочетания нельзя выводить по аналогии.

Третий документ — описание архитектуры отказоустойчивости. Нужны роли узлов, резервируемые компоненты, механизм обнаружения отказа и порядок возврата после ремонта. Общая схема без последовательности переключения не отвечает на эти вопросы.

Для каждого результата нагрузочного теста запросите полный протокол. В нём должны быть указаны:

Если Atlas не раскрывает часть методики, результат нельзя включать в техническое сравнение. Запишите это ограничение прямо в заключении по закупке.

ДокументЧто проверить внутриКогда документ не закрывает вопрос
Примечания к выпускуНомер версии, дата, изменения, ограничения, порядок обновленияОписана другая версия или нет даты публикации
Матрица совместимостиСХД, микропрограмма, ОС, гипервизор, СУБД, драйверы, протоколНет точного сочетания вашего контура
Архитектура отказоустойчивостиРоли узлов, границы отказа, переключение, возврат после ремонтаУказано лишь наличие резервных компонентов
Протокол нагрузочного тестаСтенд, профиль нагрузки, очередь, задержка, длительностьОпубликован только итоговый показатель
Руководство администратораУстановка, обновление, диагностика, откатНет процедур для ASM 2.5

Если хотя бы один документ относится к соседней версии, считайте соответствующий вопрос открытым.

Пилот должен повторять ваш контур, а не тест вендора

После получения документов ASM 2.5 можно допустить к отдельному пилоту. Рабочую СХД для проверки не обновляют. Неизвестная версия не должна одновременно обслуживать пользователей и доказывать свою пригодность.

Стенд собирают на сочетании оборудования и программ из матрицы Atlas. Если точной комбинации нет, сначала запросите письменное подтверждение поддержки.

На стенде разверните копию рабочей базы. Воспроизведите проведение документов, тяжёлые отчёты, обмены и фоновые задания, которые пересекаются по времени. Абстрактная дисковая нагрузка этот этап не заменит.

Сначала зафиксируйте исходное поведение базы на прежнем хранилище. Затем повторите тот же сценарий на пилоте. Иначе различия нельзя будет связать именно с новой СХД.

Средняя задержка скрывает короткие провалы. Поэтому фиксируйте худшие интервалы, ошибки СУБД, разрывы путей, паузы рабочих процессов и рост очереди хранения. Эти признаки объяснят остановку 1С, если она возникнет.

После нагрузочного прогона переходите к отказам. Отключите контроллер, управляющий узел, сетевой путь и один накопитель. Для каждого отказа нужен отдельный запуск.

Между прогонами возвращайте систему в подтверждённое состояние. Проверяйте целостность данных и журналы СУБД. Иначе последствия предыдущего сбоя исказят следующую проверку.

Если ASM 2.5 затрагивает доменные службы, не меняйте одновременно несколько компонентов инфраструктуры. Порядок из материала о проверке инфраструктурных обновлений до рабочего контура поможет разделить изменения и найти причину сбоя.

Для второй площадки добавьте проверку репликации и аварийного запуска. Асинхронная передача не обещает нулевую потерю данных: результат зависит от накопившейся очереди и доступности канала. Критерии такого пилота описаны в разборе репликации СХД для виртуальной 1С.

Этап пилотаЧто сделатьПризнак допуска
Проверка конфигурацииСверить все версии и компоненты с матрицей AtlasСочетание указано в матрице или письменно подтверждено
Базовый прогонВыполнить рабочий сценарий без искусственных отказовНет ошибок СУБД, разрывов путей и повреждения данных
Нагрузочный прогонСовместить документы, отчёты, обмены и фоновые заданияПаузы укладываются в пределы, заданные владельцем системы
Проверка отказовПоочерёдно отключить четыре выбранных компонентаКаждый сценарий проходит с предсказуемым результатом
Возврат после ремонтаВернуть компонент и проверить синхронизациюНет расхождения данных и ручной пересборки
Повторный прогонПовторить рабочую нагрузку после отказовСистема вернулась к исходному поведению

Пилот закончен только после повторной проверки нагрузки. Сам факт установки ASM 2.5 успешным результатом не считается.

Решение по ASM 2.5 можно принять уже сейчас

ASM 2.5 не стоит переносить в рабочий контур 1С по доступному набору материалов. Среди них нет первичной публикации Atlas, матрицы совместимости, архитектуры переключения и протокола нагрузочного теста.

Запросите документы и примените пять правил:

  1. Нет методики теста — результат не участвует в сравнении.
  2. Нет описания переключения — отказоустойчивость не подтверждена.
  3. Нет точного сочетания в матрице — рабочий контур не обновляют.
  4. Документы получены — ASM 2.5 допускают только к изолированному пилоту.
  5. Сценарии нагрузки и отказов пройдены — результаты передают на согласование вместе с журналами и описанием стенда.

Этот порядок не требует заранее принимать или отклонять продукт. Он даёт администратору проверяемое основание для решения: документы, условия пилота и наблюдаемое поведение базы.

atlas asm отказоустойчивость пилотный контур схд хранилище для 1с