HACMP является сокращением от "High Availability Cluster Multi-Processing". Главными
составляющими здесь являются
В современных сложных средах обеспечение непрерывности работы приложений
является основным компонентом эффективной реализации IT-системы.
Решения
Вкратце
Помимо
Краткое определение кластерной мультиобработки может иметь такой вид: множество приложений, выполняющихся на нескольких узлах с общим или одновременным доступом к данным.
Хотя компонент кластерной мультиобработки и является желательным, эффективное использование им всех доступных в многоузловой (кластерной) среде ресурсов зависит от возможностей приложения и реализации системы. Их реализация должна начинаться на этапе планирования и проектирования кластеров.
HACMP – всего лишь одна из технологий
Решение
IBM также разработала расширенную версию HACMP, содержащую функции аварийного восстановления, интегрированные в решение под названием HACMP Extended Distance (HACMP/XD), которое поддерживает функциональность HACMP между двумя географически распределенными сайтами. HACMP/XD поддерживает множество различных методов репликации данных и подробно обсуждается в лекции 15, "Понятия и планирование HACMP Extended Distance".
Существует множество решений, обеспечивающих широкий диапазон опций доступности. В таблице 1.1 описаны различные типы решений обеспечения доступности и их характеристики.
| Решение | Время простоя (отключения) | Доступность данных | Стоимость |
|---|---|---|---|
| Автономное (Standalone) | Дни | С последней резервной копии | Базовые затраты на аппаратное и программное обеспечение ($) |
| Улучшенное автономное (Enhanced standalone) | Часы | До последней транзакции | Двойные затраты на аппаратное обеспечение ($$) |
| Кластеры |
Минуты | До последней транзакции | Двойные затраты на аппаратное обеспечение и дополнительное обслуживание ($$+) |
| Отказоустойчивые вычислительные системы
( |
Никогда не отключаются | Без потери данных | Специализированное аппаратное и программное обеспечение, очень дорогостоящее ($$$$$$) |
| HACMP/XD | Минуты | До последней транзакции | Двойная или тройная стоимость аппаратного обеспечения + дополнительные затраты на связь ($$$$) |
Решения по обеспечению
Решение
При планировании внедрения решения HACMP следует учитывать следующие аспекты:
(рис 1.1) Кластер HACMPВремя отключения (простоя) означает период, когда приложение недоступно для обслуживания своих клиентов. Можно разделить отключения на две категории:
Таким образом, роль HACMP состоит в том, чтобы обеспечивать доступность приложения как при незапланированных отказах, так и при выполнении обычных повседневных административных задач. HACMP обеспечивает мониторинг и автоматическое восстановление ресурсов, от которых зависит приложение.
Единой точкой отказа (single point of failure,
Хорошее проектирование позволяет устранить единые точки отказа (узлы, устройства хранения, сети) в кластере. HACMP осуществляет управление этими компонентами, а также управление ресурсами, необходимыми для приложения (включая скрипты запуска-перезапуска приложений).
В конечном счете цель любого информационного решения в критической среде состоит в том, чтобы обеспечить непрерывную доступность приложения и защиту данных.
Во избежание возникновения единых точек отказа необходимы:
Как говорилось выше, хорошее проектирование позволяет устранить единые точки отказа, и HACMP осуществляет управление доступностью приложения во время отключений. В табл. 1.2 перечислены все объекты кластеров, сбой которых может вызвать недоступность приложения. Каждый объект кластера может представлять собой физический или логический компонент.
| Объекты кластера | Способ устранения единой точки отказа |
|---|---|
| Узел (серверы) | Использование нескольких узлов |
| Электропитание | Использование нескольких цепей или источников питания и/или ИБП |
| Сетевой адаптер | Избыточность сетевых адаптеров |
| Сеть | Несколько сетей, подключенных ко всем узлам, избыточные сетевые пути с независимым оборудованием между каждым узлом и клиентами |
| Подсистема TCP/IP | Использование сетей "точка-точка" для подключения каждого узла к соседнему узлу в кольце |
| Адаптер ввода-вывода | Избыточность адаптеров ввода-вывода |
| Контроллеры | Избыточность контроллеров |
| Хранение | Избыточность оборудования, дисковые стойки, зеркальное отображение/технология RAID, избыточность путей данных |
| Приложение | Конфигурирование мониторинга приложения и резервных узлов для "подхвата" приложения и его данных |
| Сайты | Использование более одного сайта для аварийного восстановления |
| Группы ресурсов | Использование групп ресурсов для управления всеми ресурсами, требуемыми приложению |
HACMP также обеспечивает оптимизацию доступности, допуская динамическое реконфигурирование работающих кластеров. Задачи обслуживания, такие, как добавление или удаление узлов, можно выполнять без остановки и перезапуска кластера.
Кроме того, на работающем кластере можно выполнять другие задачи управления,
такие, как изменение конфигурации системы хранения, управление пользователями
с применением eдиной точки управления кластером (Cluster Single Point of Control,
C-
История IBM High Availability Cluster Multi-Processing началась в начале 1990-х гг. Разработка HACMP была начата в 1990 г. с целью обеспечить решение
Изначально HACMP разрабатывался как автономный продукт (называемый сейчас
HACMP Classic), однако, как только появилась инфраструктура
| HACMP V4.2.2 | Наряду с HACMP Classic (HAS) эта версия включала версию с улучшенной масштабируемостью (enhanced |
| HACMP V4.3.X | Помимо прочего, эта версия включала поддержку 32 узлов для HACMP/ES, усовершенствования C- |
| HACMP V4.4.X | К новым элементам в этой версии относятся интеграция с Tivoli, мониторинг приложений, каскадирование без возврата после восстановления (cascading without |
| HACMP V4.5 | В этой версии обязательным является использование AIX 5L; версия содержит функцию автоматического определения конфигурации, допускает применение нескольких сервисных меток (service labels) для каждого сетевого адаптера [посредством использования IP-синонимов (alias)], обеспечивает поддержку постоянных (persistent) IP-адресов, содержит 64-разрядный API и функции мониторинга и восстановления после потери кворума группы томов. |
В этой версии появилось множество крупных изменений, от упрощения конфигурирования и повышения производительности до изменения терминологии HACMP:
HACMP Classic (HAS) не был включен; пакет содержал только HACMP/ES, основанный на технологии IBM
Ниже приведены некоторые наиболее важные новые возможности HACMP V5.1.
Выпущенная в июле 2004 г. версия HACMP V5.2 содержала дополнительные усовершенствования в управлении, упрощении конфигурирования, автоматизации и производительности: Two-Node Configuration Assistant (упрощенное конфигурирование
кластера из двух узлов), содержащий как меню
Начиная с июля 2005 г. новая версия, HACMP V5.3, продолжает развитие HACMP, добавляя дальнейшие усовершенствования в областях управления, упрощения конфигурирования, автоматизации и производительности. Ниже приведен обзор усовершенствований в HACMP V5.3.
Примечание. На момент публикации существовали версии HACMP 5.1, 5.2 и 5.3, однако в этом курсе для тестирования использовалась HACMP V5.3.
Чтобы понимать функциональные возможности HACMP и эффективно их использовать, необходимо знать некоторые важные термины и понятия.
Начиная с HACMP V5.1 терминология, используемая для описания конфигурации и работы HACMP, значительно изменилась. Цель такого изменения заключается в упрощении общего использования и обслуживания HACMP, а также в том, чтобы согласовать терминологию с прочими продуктами IBM.
Например, в предыдущей версии HACMP термин "адаптер" в зависимости от контекста мог иметь различные значения, что затрудняло конфигурирование.
В этом курсе используются следующие термины:
| Кластер (Cluster) | Слабосвязанный набор независимых систем (узлов) или логических разделов
( |
| Узел (Node) | Компьютер IBM eserver pSeries (или LPAR), на котором выполняются AIX и HACMP и который определен как часть кластера. Каждый узел имеет набор ресурсов (диски, файловые системы, IP-адреса и приложения), которые могут быть переданы другому узлу в кластере в случае сбоя узла или компонента. |
| Клиенты | Клиентом является система, которая может осуществлять доступ к приложению, выполняющемуся на узлах кластера через локальную сеть. На клиентах выполняется клиентское приложение, осуществляющее подключение к серверу (узлу), на котором выполняется приложение. |
Основные понятия HACMP можно систематизировать следующим образом:
| Топология | Включает основные компоненты кластера: узлы, сети, коммуникационные интерфейсы, коммуникационные устройства и коммуникационные адаптеры. |
| Ресурсы | Логические компоненты или объекты, к которым обеспечивается высокий уровень доступа [например, файловые системы, устройства прямого доступа (raw
devices), сервисные IP-метки и приложения] путем перемещения с одного узла на
другой. Все ресурсы, которые совместно составляют приложение или службу с
|
| Сервисная IP-метка (Service IP label) | Метка, соответствующая сервисному IP-адресу и используемая для связи
между клиентами и узлом. Сервисная IP-метка является частью группы ресурсов, что означает, что HACMP осуществляет ее мониторинг и обеспечивает ее
|
| Процесс, при котором IP-адрес перемещается с одного адаптера на другой
адаптер в той же |
|
| Перехват ресурса (Resourse takeover) | Представляет собой операцию передачи ресурсов между узлами внутри кластера. При отказе одного компонента или узла в связи с проблемами оборудования или операционной системы его группы ресурсов передаются на другой узел. |
| Перемещение при сбое (Fallover) | Представляет собой перемещение группы ресурсов с одного активного узла на другой узел (резервный узел) при сбое на этом активном узле. |
| Возврат после
восстановления
( |
Представляет собой перемещение группы ресурсов обратно с резервного узла на прежний узел, когда он станет доступным. Это перемещение обычно выполняется после реинтеграции ранее отказавшего узла. |
| Пакет "пульсации"
( |
Пакет, передаваемый между коммуникационными интерфейсами в кластере, используемый различными демонами кластера для мониторинга состояния компонентов кластера – узлов, сетей, адаптеров. |
| Демоны RSCT | Включают два процесса (службы топологии и службы групп), осуществляющие мониторинг состояния кластера и каждого узла. Диспетчер кластера получает информацию о событиях, генерируемую этими демонами, и предпринимает соответствующие (ответные) действия в случае сбоя. |
| Лидер группы (Group
|
Узел с наивысшим IP-адресом, определенным в одной из сетей HACMP (первой доступной сети), выступающий в качестве центрального репозитория (хранилища) для всех данных топологии и групп, поступающих от демонов RSCT, относящихся к состоянию кластера. |
| Резервный лидер группы
(Group |
Узел со вторым по величине IP-адресом в той же произвольно выбранной сети, выступающий в качестве резервного узла для лидера группы и принимающий на себя роль лидера группы в случае выхода его из кластера. |
| Распорядитель (Mayor) | Узел, выбранный лидером группы RSCT (узел с третьим по величине IP-адресом, если таковой существует; в противном случае им является резервный лидер группы). В его обязанности входит информирование других узлов о любых изменениях в кластере, определенных лидером группы. |
Примечание. В более ранних версиях HACMP перемещение группы ресурсов при сбое
компонента на одном узле называлось "
Более подробно эти понятия описаны в лекции 2, "Составляющие
В зависимости от времени реагирования и ответного действия на обнаруженные отказы системы кластеры и системы можно разделить:
Все эти компоненты, процессоры, память и диски имеют специальный дизайн, обеспечивающий непрерывную работу даже при отказе одного субкомпонента. Только специализированное программное обеспечение работает на отказоустойчивом оборудовании.
Такие системы являются очень дорогостоящими и чрезвычайно специализированными. Внедрение отказоустойчивого решения требует больших затрат и значительных усилий на настройку всех компонентов системы.
В средах, где отключения абсолютно неприемлемы (в жизненно важных системах), использование отказоустойчивого оборудования и решений является обязательным.
Системы
В таких системах используемое специальное программное обеспечение обнаруживает проблемы в среде и управляет живучестью приложения, выполняя его перезапуск на том же или на другом доступном компьютере (сохраняя идентичность первоначального компьютера-узла).
Другая важная задача состоит в том, чтобы защитить данные посредством зеркального отображения и их записи в совместно используемые дисковые области, доступные с любого компьютера в кластере.
Программное обеспечение HACMP (High Availability Cluster Multi-Processing) гарантирует инфраструктуру и набор инструментов для
Приложения, интегрируемые в кластер HACMP, требуют значительной настройки,
причем не на уровне приложения, а скорее на уровне платформ HACMP и AIX.
HACMP представляет собой гибкую платформу, позволяющую осуществлять интеграцию обычных приложений, выполняющихся на платформе AIX, что дает возможность создавать системы
В процессе планирования кластера HACMP один из наиболее важных этапов состоит в том, чтобы определить параметры программного обеспечения, которое будет выполняться на узлах кластера.
Определяющими факторами при планировании программного обеспечения узла являются:
Перед установкой HACMP необходимо проверить другие требования уровня программного обеспечения.
Актуальный список рекомендованных параметров для HACMP V5.1, 5.2 и V5.3 см. на веб-сайте IBM по адресу http://www-912.ibm.com/eserver/support/fixes/fcgui.jsp
Табл. 1.3 содержит рекомендованные уровни обновлений HACMP и другого программного обеспечения на момент написания этой курса.
| Версия HACMP | Уровень ОС AIX и прочего ПО | AIX APAR | Уровень RSCT |
|---|---|---|---|
| HACMP V5.1 | 5100-05 | IY50579, IY48331 | 2.2.1.30 или выше |
| HACMP V5.1 | 5200-02 | IY48180, IY44290 | 2.3.1.0 или выше |
| HACMP V5.2 | 5100-06 | IY54018, IY53707, IY54140, IY55017 | 2.2.1.30 или выше |
| HACMP V5.2 | 5200-03 | IY56213 | 2.3.3.0 или выше |
| HACMP V5.3 | 5200-04 | IY72082, IY72946, IY72928 | 2.3.6 или выше |
| HACMP V5.3 | 5300-02 | IY71500, 72852, IY72916, IY72928 | 2.4.2 или выше |
| HACMP 5.3, CBU, DLPAR, CUoD | 5.2 / 5.3 | IY73050, IY73051 | |
| HACMP/XD:HAGeo | Дополнительные требования отсутствуют | ||
| HACMP/XD:GLVM | 5200-04 | IY66555 | |
| HACMP/XD:GLVM | 5300-02 | IY68029, IY68300 |
Примечание. Для использования C-
Требования HACMP/XD с использованием
Следующие компоненты базовой операционной системы AIX являются обязательными для работы HACMP:
При использовании одновременного доступа к ресурсам [(enhanced)
Полный список рекомендованных пакетов обновлений (
Большинство производителей программного обеспечения требуют наличия лицензий для каждого приложения, для каждого физического компьютера или процессора многопроцессорного компьютера (SMP). Обычно код активизации лицензии вводится во время установки.
Однако в среде HACMP при перехвате, в случае перезапуска приложения на другом узле нужно убедиться в наличии необходимых кодов активизации (лицензий) для нового компьютера; в противном случае приложение может не запуститься должным образом.
Приложение также может требовать наличия уникальной лицензии, привязанной к узлу (отдельного файла лицензии на каждом узле).
Некоторые приложения также содержат ограничения на количество плавающих лицензий для этого приложения в кластере. Во избежание этой проблемы необходимо убедиться, что вы имеете достаточно лицензий для каждого узла кластера, чтобы приложение могло выполняться одновременно на нескольких узлах (особенно это касается действующих приложений, работающих в параллельном (конкурентном) режиме).
Программное обеспечение HACMP содержит набор средств, которые можно использовать для обеспечения
Например, если все данные критического приложения находятся на одном диске, этот диск является единой точкой отказа для всего кластера и защита HACMP на него не распространяется. В этом случае необходимо применять защиту с использованием диспетчера логических томов (LVM) AIX или подсистем хранения. HACMP только лишь обеспечивает перехват диска на резервном узле, обеспечивая доступ к данным.
Планирование HACMP потому является столь важным, что главная цель в процессе планирования состоит в устранении единых точек отказа. Единая точка отказа имеет место в том случае, когда критическая функция кластера обеспечивается одним компонентом. При отказе этого компонента кластер не имеет альтернативного способа обеспечения этой функции и приложение или служба, зависящие от этого компонента, становятся недоступными.
Также необходимо помнить о том, что при хорошем планировании кластер является простым в установке, обеспечивает более
По окончании планирования необходимо убедиться в том, что ваша система соответствует требованиям, предъявляемым к HACMP; это позволит избежать множества потенциальных ошибок.
HACMP V5.1 требует наличия одного из следующих компонентов операционной системы:
Поддержка C-
Наиболее актуальные сведения о требованиях и APAR см. в файле README, поставляемом вместе с продуктом, а также на следующей веб-странице IBM: http://techsupport.services.ibm.com/server/cluster/
HACMP V5.2 требует наличия одного из следующих компонентов операционной системы:
Поддержка C-
HACMP V5.3 требует наличия одного из следующих компонентов операционной системы:
AIX 5L V5.3 ML2 с RSCT V2 или выше (рекомендуемая версия – 2.3);
Поддержка C-
HACMP может быть установлен с использованием программы AIX Network Installation
Management (NIM), включающей опцию Alternate Disk
Установка с использованием сервера NIM
Мы рекомендуем использование NIM просто потому, что это позволяет загрузить программное обеспечение HACMP на другие узлы с сервера быстрее, чем с другого носителя. Кроме того, это является гибким методом распространения, обновления и администрирования узлов. Он позволяет установить несколько узлов параллельно и обеспечить среду для выполнения обновления программного обеспечения. В больших средах это может быть очень полезно и позволяет сэкономить время; в небольших средах может быть достаточно локального хранилища.
Если вы решили использовать NIM, необходимо скопировать все наборы файлов HACMP на сервер NIM и определить ресурс lpp_source, прежде чем продолжать установку.
Установка с компакт-диска или жесткого диска
Если ваша среда содержит лишь несколько узлов или если вы считаете использование NIM излишним, можно воспользоваться установкой с компакт-диска или создать локальное хранилище, скопировав наборы файлов HACMP на локальный диск и воспользовавшись командой exportfs ; это позволит другим узлам осуществлять доступ к данным с использованием NFS.
Прочие примеры установки, например пример установки на SP-системах, а также
инструкции по созданию
Перед установкой HACMP настоятельно советуем просмотреть документацию к релизу (release notes) HACMP V5.1, находящуюся в каталоге /usr/es/lpp/cluster/doc. на наличие последней информации о требованиях или известных проблемах.
Для установки программного обеспечения HACMP на серверном узле необходимо выполнить следующие действия:
all для установки всех образов
серверов и клиентов. Выберите пакеты, которые требуется установить, в соответствии с конфигурацией вашего кластера. Некоторые из пакетов могут потребовать
использования систем, отсутствующих в вашей среде (например, Tivoli Monitoring).
Образы cluster.es и cluster.cspoc (содержащие исполняемый модуль HACMP) являются обязательными и должны быть установлены на всех серверах. Примечание. При установке диспетчера одновременного доступа к ресурсам
(Действия после установки
После установки программного обеспечения HACMP необходимо выполнить следующие действия:
lppchk, а также просмотрите установленные каталоги на наличие требуемых
файлов.lppchk -v и lppchk -c cluster*. Если установка прошла без
ошибок, обе команды выполняются без выдачи сообщений; в противном случае
следует использовать соответствующие методы устранения неполадок.При обновлении или преобразовании кластера HACMP возможны следующие варианты: поузловая миграция и миграция на основе снимка (
Поузловая миграция
Вариант поузловой миграции используется в том случае, если необходимо обеспечить доступность приложения во время процесса миграции. Ниже перечислены действия, выполняемые при поузловой миграции.
Этот процесс также называется циклической миграцией (rolling
Если вы можете отключить приложение для его обслуживания, миграция будет включать следующие действия:
Миграция на основе снимка
Кроме того, можно перевести весь кластер на HACMP V5.1 с использованием функции снимка кластера. Однако во время этого процесса кластер будет недоступен и все узлы должны быть обновлены до повторной активизации кластера.
Этот метод миграции предназначен для случаев, когда для AIX и HACMP необходимо выполнить обновление и миграцию одновременно (например, при переходе с AIX V4.3.3 и HACMP V4.4.1 на AIX 5L™ V5.1 и HACMP V5.1).
Важно! Не оставляйте кластер в режиме одновременного использования различных
версий надолго, так как при этом нельзя гарантировать
При миграции с ранней поддерживаемой версии HACMP (HAS) на HACMP V5.X
можно выполнить миграцию кластера без снимка. Необходимо сохранить таблицу
планирования (planning
Примечание. Нужно помнить о том, что после миграции или обновления ни одна из функций HACMP V5.X еще не является активной. Для активизации новых функций (усовершенствований) необходимо сконфигурировать опции и синхронизировать кластер.
Для перехода с поддерживаемой версии HAS на HACMP необходимо выполнить следующие действия:
Инструмент создания снимков кластера позволяет сохранить конфигурацию кластера в файл посредством выполнения следующих действий:
Эти действия подробно описаны в следующем разделе.
Проверка предыдущих версий HACMP
Чтобы просмотреть, существует ли программное обеспечение HACMP Classic (HAS) в вашей системе, введите следующую команду:
# lslpp -h "cluster*"
Если выходные данные команды lslpp покажут, что установлена HACMP версии ниже V4.5, то, прежде чем использовать утилиту преобразования снимков, необходимо сначала выполнить обновление как минимум до версии V4.5. Дополнительные сведения см. в руководстве HACMP for AIX 5L V5.1 Administration and
Troubleshooting Guide, SC23-4862-02.
Сохранение конфигурации кластера и модифицированных скриптов обработки событий
Для сохранения конфигурации кластера HACMP (HAS) версии V4.5 или выше, необходимо создать снимок в HACMP (HAS). Если у вас есть модифицированные скрипты обработки событий, они также должны быть сохранены.
Внимание! Не сохраняйте конфигурацию своего кластера или модифицированные скрипты обработки событий в каталогах /usr/sbin/cluster, /usr/es/sbin/cluster и /usr/lpp/ cluster. При установке новых пакетов HACMP эти каталоги удаляются и создаются заново.
Как удалить программное обеспечение HACMP Classic (HAS)
Для удаления программного обеспечения HACMP и конфигурации кластера на узлах кластера и клиентах, необходимо выполнить следующие действия:
Remove Installed Software Type or select values in entry fields. Press Enter AFTER making all desired changes. [Entry Fields] * SOFTWARE name [cluster*] + PREVIEW only? (remove operation will NOT occur) yes + REMOVE dependent software? no + EXTEND file systems if space needed? no + DETAILED output? no + F1=Help F2=Refresh F3=Cancel F4=List F5=Reset F6=Command F7=Edit F8=Image F9=Shell F10=Exit Enter=Do
Установка HACMP V5.1
При установке программного обеспечения следуйте инструкциям, приведенным в разделе "Установка HACMP".
Примечание. Не выполняйте перезагрузку до преобразования и применения сохраненного снимка.
Проверка установленного программного обеспечения
После установки HACMP проверьте наличие требуемых файлов с использованием команды lppchk. Дополнительные сведения см. в разделе "Действия после установки".
Преобразование и применение сохраненного снимка
После установки HACMP V5.1 на узлах кластера необходимо преобразовать и применить снимок, сохраненный в прежней конфигурации.
Важно! Преобразование снимка необходимо выполнять перед перезагрузкой узлов кластера.
Для преобразования и применения снимка:
clconvert_snapshot, указав номер версии HACMP (HAS)
и имя преобразуемого файла снимка. Флаг -C выполняет преобразование снимка
HACMP (HAS) в формат снимка HACMP V5.1:clconvert_snapshot -C -v версия -s <имя_файла>
Переустановка сохраненных модифицированных скриптов обработки событий
Переустановите требуемые модифицированные скрипты обработки событий, сохраненные в предыдущей конфигурации.
Примечание. Некоторые скрипты обработки событий, использовавшиеся в прежних версиях, могут оказаться ненужными в HACMP V5.1, особенно в группах ресурсов, применяющих параллельную обработку.
Перезагрузка узлов кластера
Перезагрузка узлов кластера необходима для активизации коммуникационного демона нового кластера (clcomdES).
Проверка и синхронизация конфигурации кластера
После установки программного обеспечения HACMP и перезагрузки каждого узла необходимо выполнить проверку (верификацию) и синхронизацию топологии кластера. При верификации удостоверяется согласованность определения кластера на всех узлах с выдачей соответствующих ошибок и/или предупреждений. В следующем разделе мы кратко рассмотрим процесс проверки кластера.
Выполните команду smitty hacmp и выберите пункт Extended Configuration
Extended Verification and Synchronization (Расширенная конфигурация >
Расширенная верификация и синхронизация), выберите Verify changes only
(Верифицировать только изменения), после чего нажмите Enter (пример 1.2).
HACMP Verification and Synchronization (Active Cluster on a Local Node) Type or select values in entry fields. Press Enter AFTER making all desired changes. [Entry Fields] * Emulate or Actual [Actual] + Force synchronization if verification fails? [No] + * Verify changes only? [No] + * Logging [Standard] + F1=Help F2=Refresh F3=Cancel F4=List F5=Reset F6=Command F7=Edit F8=Image F9=Shell F10=Exit Enter=Do
Важно! Нельзя выполнить синхронизацию в кластере со смешанными версиями. При обновлении не следует надолго оставлять кластер со смешанными версиями HACMP. Новые функции версии V5.1 доступны только после обновления всех узлов и синхронизации кластера.
При выполнении поузловой (циклической) миграции необходимо учитывать следующее:
Stop Cluster Services Type or select values in entry fields. Press Enter AFTER making all desired changes. [Entry Fields] * Stop now, on system restart or both on system restart + Stop Cluster Services on these nodes [p630n01] + BROADCAST cluster shutdown? true + * Shutdown mode graceful + F1=Help F2=Refresh F3=Cancel F4=List F5=Reset F6=Command F7=Edit F8=Image F9=Shell F10=Exit Enter=Do
Если вы не используете C-
Как осуществить поузловую миграцию
Для осуществления поузловой миграции с HACMP V4.5 на HACMP V5.1 необходимо выполнить следующие действия:
# /usr/es/sbin/cluster/utilities/clstop -gr
smitty hacmp ;| HACMP | HACMP/ES | RSCT |
|---|---|---|
| clstmgr | clstmgrES | grpsvcs |
| cllockd (необязательный) | cllockdES (необязательный) | topsvcs |
| clsmuxpd | clsmuxpES | emsvcs |
| clinfo (необязательный) | clinfoES (необязательный) | grpglsm |
| clcomdES | emaixos |
Примечание. В процессе поузловой миграции с HAS 4.5 на HACMP V5.1 будут выдаваться следующие предупреждения: sysck: 3001-036 WARNING: File /etc/cluster/lunreset.lst is also owned by fileset cluster. base.server.events. sysck: 3001-036 WARNING: File /etc/cluster/disktype.lst is also owned by fileset cluster. base.server.events. Можете благополучно игнорировать эти предупреждения и продолжать установку.
Сообщение config_too_long
После завершения процесса миграции во время удаления наборов файлов HACMP может появиться сообщение config_too_long. Это сообщение возникает, когда диспетчер кластера обнаруживает, что обработка события занимает больше установленного времени. Сообщения config_too_long добавляются в файл hacmp.out, пока не завершится событие. При возникновении таких сообщений следует периодически убеждаться в том, что событие все еще действует и что не произошел отказ.
Можно избежать вывода этих сообщений, увеличив время ожидания до вызова события config_too_long (с использованием
smitty hacmp.Это необходимо сделать на каждом узле. Изменения вступают в действие после перезапуска служб кластера.
Как работает процесс поузловой миграции
После установки HACMP на всех узлах кластера (когда все узлы находятся в гибридном состоянии) запуск служб кластера на последнем узле кластера автоматически вызывает передачу управления в HACMP V5.1 следующим образом:
Снимки кластера, сохраненные во время миграции
Ранее существовавшие снимки HACMP сохраняются в каталоге /usr/es/sbin/cluster/
Обработка отказа узла в процессе миграции
При отказе узла в процессе миграции после
Процедура возврата
Если по какой-то причине вы решите не продолжать процесс миграции, вы можете удалить программное обеспечение HACMP V5.1 с узлов, на которых оно было установлено, в любой момент процесса до запуска HACMP на последнем узле.
Примечание. Удаление программного обеспечения HACMP следует проводить только на локальном узле. Во время миграции не следует выбирать вариант удаления программного обеспечения с нескольких узлов.
Удаление программного обеспечения HACMP
Для этого проделайте следующее:
Обработка отказов синхронизации при поузловой миграции
Если вы попытаетесь внести изменение в топологию или ресурсы кластера до завершения миграции, произойдет отказ процесса синхронизации. Возникнет следующее сообщение:
cldare: Migration from HACMP V4.5 to HACMP V5.1 Detected. cldare cannot be run until migration has completed.
Для возврата после изменения необходимо восстановить активный
smitty hacmp.В этом разделе мы обсудим обновления для HACMP.
Поддерживаемые обновления для HACMP V5.1
Утилиты преобразования HACMP предлагают простой путь обновления до версии V5.1 с нижеперечисленных версий:
Если вам потребуется выполнить преобразование на HACMP V5.1 с более ранних версий, чем указаны выше, необходимо сначала выполнить обновление до одной из поддерживаемых версий. Затем вы сможете выполнить преобразование на HACMP V5.1. Например, для преобразования с HACMP/ES 4.2.2 на HACMP V5.1 сначала нужно будет выполнить обновление установки до HACMP/ES 4.4.1 или выше и затем выполнить обновление до HACMP V5.1.
Чтобы выполнить обновление до HACMP V5.1, нужно выполнить следующие действия:
clstop.lppchk -v or lppchk -c "cluster.*"Если установка прошла без ошибок, обе команды выполняются без выдачи сообщений.
smitty
clstart и убедитесь в успешном подключении первого узла к кластеру.lspv проверьте PVID для каждого диска). Если PVID для дисков не выводятся,
может потребоваться удалить диск и выполнить повторное конфигурирование.cl_convert и clconvert_snapshot
HACMP содержит утилиты преобразования cl_convert и clconvert_snapshot.
Обновление программного обеспечения HACMP/ES до последней версии HACMP
включает преобразование
В случае сбоя при преобразовании следует выполнить cl_convert с флагом -F.
Например, чтобы выполнить преобразование с HACMP/ES V4.5 на HACMP V5.1, следует использовать флаги -F и -v (version) следующим образом (обратите внимание на
добавление "0" к номеру версии V4.5):
# /usr/es/sbin/cluster/conversion/cl_convert -F -v 4.5.0
Для запуска утилиты преобразования требуются:
Утилита cl_convert записывает информацию о выполнении преобразования в файл /tmp/clconvert.log, что дает возможность оценить успешность выполнения преобразования. Этот файл журнала генерируется (перезаписывается) при каждом выполнении cl_convert или clconvert_snapshot.
Утилита clconvert_snapshot не запускается автоматически во время установки, ее следует запускать из командной строки. Выполните clconvert_snapshot для обновления снимков кластера при миграции с HACMP (HAS) на HACMP, как описано в этом разделе.
Обновление диспетчера одновременного доступа к ресурсам
Для установки средства одновременного доступа на узлах кластера необходимо установить диспетчер одновременного доступа к ресурсам (
AIX 5L V5.1 поддерживает расширенный режим одновременного доступа (enhanced
Сведения о расширенном режиме одновременного доступа и о поддерживаемых
дисковых устройствах общего доступа производства IBM см. в гл. 5, "Planning Shared
LVM Components", руководства HACMP for AIX 5L V5.1 Planning and Installation
Guide, SC23-4861-02. Кроме того, если вы хотите использовать диски других производителей, см. прил. D, "
Проблемы при установке
Если при установке возникают проблемы, программа установки автоматически выполняет процесс очистки. Если по какой-либо причине после неудачной установки не была выполнена очистка, нужно выполнить следующие действия:
HACMP является сокращением от "High Availability Cluster Multi-Processing". Главными
составляющими здесь являются
В современных сложных средах обеспечение непрерывности работы приложений
является основным компонентом эффективной реализации IT-системы.
Решения
Вкратце
Помимо
Краткое определение кластерной мультиобработки может иметь такой вид: множество приложений, выполняющихся на нескольких узлах с общим или одновременным доступом к данным.
Хотя компонент кластерной мультиобработки и является желательным, эффективное использование им всех доступных в многоузловой (кластерной) среде ресурсов зависит от возможностей приложения и реализации системы. Их реализация должна начинаться на этапе планирования и проектирования кластеров.
HACMP – всего лишь одна из технологий
Решение
IBM также разработала расширенную версию HACMP, содержащую функции аварийного восстановления, интегрированные в решение под названием HACMP Extended Distance (HACMP/XD), которое поддерживает функциональность HACMP между двумя географически распределенными сайтами. HACMP/XD поддерживает множество различных методов репликации данных и подробно обсуждается в лекции 15, "Понятия и планирование HACMP Extended Distance".
Существует множество решений, обеспечивающих широкий диапазон опций доступности. В таблице 1.1 описаны различные типы решений обеспечения доступности и их характеристики.
| Решение | Время простоя (отключения) | Доступность данных | Стоимость |
|---|---|---|---|
| Автономное (Standalone) | Дни | С последней резервной копии | Базовые затраты на аппаратное и программное обеспечение ($) |
| Улучшенное автономное (Enhanced standalone) | Часы | До последней транзакции | Двойные затраты на аппаратное обеспечение ($$) |
| Кластеры |
Минуты | До последней транзакции | Двойные затраты на аппаратное обеспечение и дополнительное обслуживание ($$+) |
| Отказоустойчивые вычислительные системы
( |
Никогда не отключаются | Без потери данных | Специализированное аппаратное и программное обеспечение, очень дорогостоящее ($$$$$$) |
| HACMP/XD | Минуты | До последней транзакции | Двойная или тройная стоимость аппаратного обеспечения + дополнительные затраты на связь ($$$$) |
Решения по обеспечению
Решение
При планировании внедрения решения HACMP следует учитывать следующие аспекты:
(рис 1.1) Кластер HACMPВремя отключения (простоя) означает период, когда приложение недоступно для обслуживания своих клиентов. Можно разделить отключения на две категории:
Таким образом, роль HACMP состоит в том, чтобы обеспечивать доступность приложения как при незапланированных отказах, так и при выполнении обычных повседневных административных задач. HACMP обеспечивает мониторинг и автоматическое восстановление ресурсов, от которых зависит приложение.
Единой точкой отказа (single point of failure,
Хорошее проектирование позволяет устранить единые точки отказа (узлы, устройства хранения, сети) в кластере. HACMP осуществляет управление этими компонентами, а также управление ресурсами, необходимыми для приложения (включая скрипты запуска-перезапуска приложений).
В конечном счете цель любого информационного решения в критической среде состоит в том, чтобы обеспечить непрерывную доступность приложения и защиту данных.
Во избежание возникновения единых точек отказа необходимы:
Как говорилось выше, хорошее проектирование позволяет устранить единые точки отказа, и HACMP осуществляет управление доступностью приложения во время отключений. В табл. 1.2 перечислены все объекты кластеров, сбой которых может вызвать недоступность приложения. Каждый объект кластера может представлять собой физический или логический компонент.
| Объекты кластера | Способ устранения единой точки отказа |
|---|---|
| Узел (серверы) | Использование нескольких узлов |
| Электропитание | Использование нескольких цепей или источников питания и/или ИБП |
| Сетевой адаптер | Избыточность сетевых адаптеров |
| Сеть | Несколько сетей, подключенных ко всем узлам, избыточные сетевые пути с независимым оборудованием между каждым узлом и клиентами |
| Подсистема TCP/IP | Использование сетей "точка-точка" для подключения каждого узла к соседнему узлу в кольце |
| Адаптер ввода-вывода | Избыточность адаптеров ввода-вывода |
| Контроллеры | Избыточность контроллеров |
| Хранение | Избыточность оборудования, дисковые стойки, зеркальное отображение/технология RAID, избыточность путей данных |
| Приложение | Конфигурирование мониторинга приложения и резервных узлов для "подхвата" приложения и его данных |
| Сайты | Использование более одного сайта для аварийного восстановления |
| Группы ресурсов | Использование групп ресурсов для управления всеми ресурсами, требуемыми приложению |
HACMP также обеспечивает оптимизацию доступности, допуская динамическое реконфигурирование работающих кластеров. Задачи обслуживания, такие, как добавление или удаление узлов, можно выполнять без остановки и перезапуска кластера.
Кроме того, на работающем кластере можно выполнять другие задачи управления,
такие, как изменение конфигурации системы хранения, управление пользователями
с применением eдиной точки управления кластером (Cluster Single Point of Control,
C-
История IBM High Availability Cluster Multi-Processing началась в начале 1990-х гг. Разработка HACMP была начата в 1990 г. с целью обеспечить решение
Изначально HACMP разрабатывался как автономный продукт (называемый сейчас
HACMP Classic), однако, как только появилась инфраструктура
| HACMP V4.2.2 | Наряду с HACMP Classic (HAS) эта версия включала версию с улучшенной масштабируемостью (enhanced |
| HACMP V4.3.X | Помимо прочего, эта версия включала поддержку 32 узлов для HACMP/ES, усовершенствования C- |
| HACMP V4.4.X | К новым элементам в этой версии относятся интеграция с Tivoli, мониторинг приложений, каскадирование без возврата после восстановления (cascading without |
| HACMP V4.5 | В этой версии обязательным является использование AIX 5L; версия содержит функцию автоматического определения конфигурации, допускает применение нескольких сервисных меток (service labels) для каждого сетевого адаптера [посредством использования IP-синонимов (alias)], обеспечивает поддержку постоянных (persistent) IP-адресов, содержит 64-разрядный API и функции мониторинга и восстановления после потери кворума группы томов. |
В этой версии появилось множество крупных изменений, от упрощения конфигурирования и повышения производительности до изменения терминологии HACMP:
HACMP Classic (HAS) не был включен; пакет содержал только HACMP/ES, основанный на технологии IBM
Ниже приведены некоторые наиболее важные новые возможности HACMP V5.1.
Выпущенная в июле 2004 г. версия HACMP V5.2 содержала дополнительные усовершенствования в управлении, упрощении конфигурирования, автоматизации и производительности: Two-Node Configuration Assistant (упрощенное конфигурирование
кластера из двух узлов), содержащий как меню
Начиная с июля 2005 г. новая версия, HACMP V5.3, продолжает развитие HACMP, добавляя дальнейшие усовершенствования в областях управления, упрощения конфигурирования, автоматизации и производительности. Ниже приведен обзор усовершенствований в HACMP V5.3.
Примечание. На момент публикации существовали версии HACMP 5.1, 5.2 и 5.3, однако в этом курсе для тестирования использовалась HACMP V5.3.
Чтобы понимать функциональные возможности HACMP и эффективно их использовать, необходимо знать некоторые важные термины и понятия.
Начиная с HACMP V5.1 терминология, используемая для описания конфигурации и работы HACMP, значительно изменилась. Цель такого изменения заключается в упрощении общего использования и обслуживания HACMP, а также в том, чтобы согласовать терминологию с прочими продуктами IBM.
Например, в предыдущей версии HACMP термин "адаптер" в зависимости от контекста мог иметь различные значения, что затрудняло конфигурирование.
В этом курсе используются следующие термины:
| Кластер (Cluster) | Слабосвязанный набор независимых систем (узлов) или логических разделов
( |
| Узел (Node) | Компьютер IBM eserver pSeries (или LPAR), на котором выполняются AIX и HACMP и который определен как часть кластера. Каждый узел имеет набор ресурсов (диски, файловые системы, IP-адреса и приложения), которые могут быть переданы другому узлу в кластере в случае сбоя узла или компонента. |
| Клиенты | Клиентом является система, которая может осуществлять доступ к приложению, выполняющемуся на узлах кластера через локальную сеть. На клиентах выполняется клиентское приложение, осуществляющее подключение к серверу (узлу), на котором выполняется приложение. |
Основные понятия HACMP можно систематизировать следующим образом:
| Топология | Включает основные компоненты кластера: узлы, сети, коммуникационные интерфейсы, коммуникационные устройства и коммуникационные адаптеры. |
| Ресурсы | Логические компоненты или объекты, к которым обеспечивается высокий уровень доступа [например, файловые системы, устройства прямого доступа (raw
devices), сервисные IP-метки и приложения] путем перемещения с одного узла на
другой. Все ресурсы, которые совместно составляют приложение или службу с
|
| Сервисная IP-метка (Service IP label) | Метка, соответствующая сервисному IP-адресу и используемая для связи
между клиентами и узлом. Сервисная IP-метка является частью группы ресурсов, что означает, что HACMP осуществляет ее мониторинг и обеспечивает ее
|
| Процесс, при котором IP-адрес перемещается с одного адаптера на другой
адаптер в той же |
|
| Перехват ресурса (Resourse takeover) | Представляет собой операцию передачи ресурсов между узлами внутри кластера. При отказе одного компонента или узла в связи с проблемами оборудования или операционной системы его группы ресурсов передаются на другой узел. |
| Перемещение при сбое (Fallover) | Представляет собой перемещение группы ресурсов с одного активного узла на другой узел (резервный узел) при сбое на этом активном узле. |
| Возврат после
восстановления
( |
Представляет собой перемещение группы ресурсов обратно с резервного узла на прежний узел, когда он станет доступным. Это перемещение обычно выполняется после реинтеграции ранее отказавшего узла. |
| Пакет "пульсации"
( |
Пакет, передаваемый между коммуникационными интерфейсами в кластере, используемый различными демонами кластера для мониторинга состояния компонентов кластера – узлов, сетей, адаптеров. |
| Демоны RSCT | Включают два процесса (службы топологии и службы групп), осуществляющие мониторинг состояния кластера и каждого узла. Диспетчер кластера получает информацию о событиях, генерируемую этими демонами, и предпринимает соответствующие (ответные) действия в случае сбоя. |
| Лидер группы (Group
|
Узел с наивысшим IP-адресом, определенным в одной из сетей HACMP (первой доступной сети), выступающий в качестве центрального репозитория (хранилища) для всех данных топологии и групп, поступающих от демонов RSCT, относящихся к состоянию кластера. |
| Резервный лидер группы
(Group |
Узел со вторым по величине IP-адресом в той же произвольно выбранной сети, выступающий в качестве резервного узла для лидера группы и принимающий на себя роль лидера группы в случае выхода его из кластера. |
| Распорядитель (Mayor) | Узел, выбранный лидером группы RSCT (узел с третьим по величине IP-адресом, если таковой существует; в противном случае им является резервный лидер группы). В его обязанности входит информирование других узлов о любых изменениях в кластере, определенных лидером группы. |
Примечание. В более ранних версиях HACMP перемещение группы ресурсов при сбое
компонента на одном узле называлось "
Более подробно эти понятия описаны в лекции 2, "Составляющие
В зависимости от времени реагирования и ответного действия на обнаруженные отказы системы кластеры и системы можно разделить:
Все эти компоненты, процессоры, память и диски имеют специальный дизайн, обеспечивающий непрерывную работу даже при отказе одного субкомпонента. Только специализированное программное обеспечение работает на отказоустойчивом оборудовании.
Такие системы являются очень дорогостоящими и чрезвычайно специализированными. Внедрение отказоустойчивого решения требует больших затрат и значительных усилий на настройку всех компонентов системы.
В средах, где отключения абсолютно неприемлемы (в жизненно важных системах), использование отказоустойчивого оборудования и решений является обязательным.
Системы
В таких системах используемое специальное программное обеспечение обнаруживает проблемы в среде и управляет живучестью приложения, выполняя его перезапуск на том же или на другом доступном компьютере (сохраняя идентичность первоначального компьютера-узла).
Другая важная задача состоит в том, чтобы защитить данные посредством зеркального отображения и их записи в совместно используемые дисковые области, доступные с любого компьютера в кластере.
Программное обеспечение HACMP (High Availability Cluster Multi-Processing) гарантирует инфраструктуру и набор инструментов для
Приложения, интегрируемые в кластер HACMP, требуют значительной настройки,
причем не на уровне приложения, а скорее на уровне платформ HACMP и AIX.
HACMP представляет собой гибкую платформу, позволяющую осуществлять интеграцию обычных приложений, выполняющихся на платформе AIX, что дает возможность создавать системы
В процессе планирования кластера HACMP один из наиболее важных этапов состоит в том, чтобы определить параметры программного обеспечения, которое будет выполняться на узлах кластера.
Определяющими факторами при планировании программного обеспечения узла являются:
Перед установкой HACMP необходимо проверить другие требования уровня программного обеспечения.
Актуальный список рекомендованных параметров для HACMP V5.1, 5.2 и V5.3 см. на веб-сайте IBM по адресу http://www-912.ibm.com/eserver/support/fixes/fcgui.jsp
Табл. 1.3 содержит рекомендованные уровни обновлений HACMP и другого программного обеспечения на момент написания этой курса.
| Версия HACMP | Уровень ОС AIX и прочего ПО | AIX APAR | Уровень RSCT |
|---|---|---|---|
| HACMP V5.1 | 5100-05 | IY50579, IY48331 | 2.2.1.30 или выше |
| HACMP V5.1 | 5200-02 | IY48180, IY44290 | 2.3.1.0 или выше |
| HACMP V5.2 | 5100-06 | IY54018, IY53707, IY54140, IY55017 | 2.2.1.30 или выше |
| HACMP V5.2 | 5200-03 | IY56213 | 2.3.3.0 или выше |
| HACMP V5.3 | 5200-04 | IY72082, IY72946, IY72928 | 2.3.6 или выше |
| HACMP V5.3 | 5300-02 | IY71500, 72852, IY72916, IY72928 | 2.4.2 или выше |
| HACMP 5.3, CBU, DLPAR, CUoD | 5.2 / 5.3 | IY73050, IY73051 | |
| HACMP/XD:HAGeo | Дополнительные требования отсутствуют | ||
| HACMP/XD:GLVM | 5200-04 | IY66555 | |
| HACMP/XD:GLVM | 5300-02 | IY68029, IY68300 |
Примечание. Для использования C-
Требования HACMP/XD с использованием
Следующие компоненты базовой операционной системы AIX являются обязательными для работы HACMP:
При использовании одновременного доступа к ресурсам [(enhanced)
Полный список рекомендованных пакетов обновлений (
Большинство производителей программного обеспечения требуют наличия лицензий для каждого приложения, для каждого физического компьютера или процессора многопроцессорного компьютера (SMP). Обычно код активизации лицензии вводится во время установки.
Однако в среде HACMP при перехвате, в случае перезапуска приложения на другом узле нужно убедиться в наличии необходимых кодов активизации (лицензий) для нового компьютера; в противном случае приложение может не запуститься должным образом.
Приложение также может требовать наличия уникальной лицензии, привязанной к узлу (отдельного файла лицензии на каждом узле).
Некоторые приложения также содержат ограничения на количество плавающих лицензий для этого приложения в кластере. Во избежание этой проблемы необходимо убедиться, что вы имеете достаточно лицензий для каждого узла кластера, чтобы приложение могло выполняться одновременно на нескольких узлах (особенно это касается действующих приложений, работающих в параллельном (конкурентном) режиме).
Программное обеспечение HACMP содержит набор средств, которые можно использовать для обеспечения
Например, если все данные критического приложения находятся на одном диске, этот диск является единой точкой отказа для всего кластера и защита HACMP на него не распространяется. В этом случае необходимо применять защиту с использованием диспетчера логических томов (LVM) AIX или подсистем хранения. HACMP только лишь обеспечивает перехват диска на резервном узле, обеспечивая доступ к данным.
Планирование HACMP потому является столь важным, что главная цель в процессе планирования состоит в устранении единых точек отказа. Единая точка отказа имеет место в том случае, когда критическая функция кластера обеспечивается одним компонентом. При отказе этого компонента кластер не имеет альтернативного способа обеспечения этой функции и приложение или служба, зависящие от этого компонента, становятся недоступными.
Также необходимо помнить о том, что при хорошем планировании кластер является простым в установке, обеспечивает более
По окончании планирования необходимо убедиться в том, что ваша система соответствует требованиям, предъявляемым к HACMP; это позволит избежать множества потенциальных ошибок.
HACMP V5.1 требует наличия одного из следующих компонентов операционной системы:
Поддержка C-
Наиболее актуальные сведения о требованиях и APAR см. в файле README, поставляемом вместе с продуктом, а также на следующей веб-странице IBM: http://techsupport.services.ibm.com/server/cluster/
HACMP V5.2 требует наличия одного из следующих компонентов операционной системы:
Поддержка C-
HACMP V5.3 требует наличия одного из следующих компонентов операционной системы:
AIX 5L V5.3 ML2 с RSCT V2 или выше (рекомендуемая версия – 2.3);
Поддержка C-
HACMP может быть установлен с использованием программы AIX Network Installation
Management (NIM), включающей опцию Alternate Disk
Установка с использованием сервера NIM
Мы рекомендуем использование NIM просто потому, что это позволяет загрузить программное обеспечение HACMP на другие узлы с сервера быстрее, чем с другого носителя. Кроме того, это является гибким методом распространения, обновления и администрирования узлов. Он позволяет установить несколько узлов параллельно и обеспечить среду для выполнения обновления программного обеспечения. В больших средах это может быть очень полезно и позволяет сэкономить время; в небольших средах может быть достаточно локального хранилища.
Если вы решили использовать NIM, необходимо скопировать все наборы файлов HACMP на сервер NIM и определить ресурс lpp_source, прежде чем продолжать установку.
Установка с компакт-диска или жесткого диска
Если ваша среда содержит лишь несколько узлов или если вы считаете использование NIM излишним, можно воспользоваться установкой с компакт-диска или создать локальное хранилище, скопировав наборы файлов HACMP на локальный диск и воспользовавшись командой exportfs ; это позволит другим узлам осуществлять доступ к данным с использованием NFS.
Прочие примеры установки, например пример установки на SP-системах, а также
инструкции по созданию
Перед установкой HACMP настоятельно советуем просмотреть документацию к релизу (release notes) HACMP V5.1, находящуюся в каталоге /usr/es/lpp/cluster/doc. на наличие последней информации о требованиях или известных проблемах.
Для установки программного обеспечения HACMP на серверном узле необходимо выполнить следующие действия:
all для установки всех образов
серверов и клиентов. Выберите пакеты, которые требуется установить, в соответствии с конфигурацией вашего кластера. Некоторые из пакетов могут потребовать
использования систем, отсутствующих в вашей среде (например, Tivoli Monitoring).
Образы cluster.es и cluster.cspoc (содержащие исполняемый модуль HACMP) являются обязательными и должны быть установлены на всех серверах. Примечание. При установке диспетчера одновременного доступа к ресурсам
(Действия после установки
После установки программного обеспечения HACMP необходимо выполнить следующие действия:
lppchk, а также просмотрите установленные каталоги на наличие требуемых
файлов.lppchk -v и lppchk -c cluster*. Если установка прошла без
ошибок, обе команды выполняются без выдачи сообщений; в противном случае
следует использовать соответствующие методы устранения неполадок.При обновлении или преобразовании кластера HACMP возможны следующие варианты: поузловая миграция и миграция на основе снимка (
Поузловая миграция
Вариант поузловой миграции используется в том случае, если необходимо обеспечить доступность приложения во время процесса миграции. Ниже перечислены действия, выполняемые при поузловой миграции.
Этот процесс также называется циклической миграцией (rolling
Если вы можете отключить приложение для его обслуживания, миграция будет включать следующие действия:
Миграция на основе снимка
Кроме того, можно перевести весь кластер на HACMP V5.1 с использованием функции снимка кластера. Однако во время этого процесса кластер будет недоступен и все узлы должны быть обновлены до повторной активизации кластера.
Этот метод миграции предназначен для случаев, когда для AIX и HACMP необходимо выполнить обновление и миграцию одновременно (например, при переходе с AIX V4.3.3 и HACMP V4.4.1 на AIX 5L™ V5.1 и HACMP V5.1).
Важно! Не оставляйте кластер в режиме одновременного использования различных
версий надолго, так как при этом нельзя гарантировать
При миграции с ранней поддерживаемой версии HACMP (HAS) на HACMP V5.X
можно выполнить миграцию кластера без снимка. Необходимо сохранить таблицу
планирования (planning
Примечание. Нужно помнить о том, что после миграции или обновления ни одна из функций HACMP V5.X еще не является активной. Для активизации новых функций (усовершенствований) необходимо сконфигурировать опции и синхронизировать кластер.
Для перехода с поддерживаемой версии HAS на HACMP необходимо выполнить следующие действия:
Инструмент создания снимков кластера позволяет сохранить конфигурацию кластера в файл посредством выполнения следующих действий:
Эти действия подробно описаны в следующем разделе.
Проверка предыдущих версий HACMP
Чтобы просмотреть, существует ли программное обеспечение HACMP Classic (HAS) в вашей системе, введите следующую команду:
# lslpp -h "cluster*"
Если выходные данные команды lslpp покажут, что установлена HACMP версии ниже V4.5, то, прежде чем использовать утилиту преобразования снимков, необходимо сначала выполнить обновление как минимум до версии V4.5. Дополнительные сведения см. в руководстве HACMP for AIX 5L V5.1 Administration and
Troubleshooting Guide, SC23-4862-02.
Сохранение конфигурации кластера и модифицированных скриптов обработки событий
Для сохранения конфигурации кластера HACMP (HAS) версии V4.5 или выше, необходимо создать снимок в HACMP (HAS). Если у вас есть модифицированные скрипты обработки событий, они также должны быть сохранены.
Внимание! Не сохраняйте конфигурацию своего кластера или модифицированные скрипты обработки событий в каталогах /usr/sbin/cluster, /usr/es/sbin/cluster и /usr/lpp/ cluster. При установке новых пакетов HACMP эти каталоги удаляются и создаются заново.
Как удалить программное обеспечение HACMP Classic (HAS)
Для удаления программного обеспечения HACMP и конфигурации кластера на узлах кластера и клиентах, необходимо выполнить следующие действия:
Remove Installed Software Type or select values in entry fields. Press Enter AFTER making all desired changes. [Entry Fields] * SOFTWARE name [cluster*] + PREVIEW only? (remove operation will NOT occur) yes + REMOVE dependent software? no + EXTEND file systems if space needed? no + DETAILED output? no + F1=Help F2=Refresh F3=Cancel F4=List F5=Reset F6=Command F7=Edit F8=Image F9=Shell F10=Exit Enter=Do
Установка HACMP V5.1
При установке программного обеспечения следуйте инструкциям, приведенным в разделе "Установка HACMP".
Примечание. Не выполняйте перезагрузку до преобразования и применения сохраненного снимка.
Проверка установленного программного обеспечения
После установки HACMP проверьте наличие требуемых файлов с использованием команды lppchk. Дополнительные сведения см. в разделе "Действия после установки".
Преобразование и применение сохраненного снимка
После установки HACMP V5.1 на узлах кластера необходимо преобразовать и применить снимок, сохраненный в прежней конфигурации.
Важно! Преобразование снимка необходимо выполнять перед перезагрузкой узлов кластера.
Для преобразования и применения снимка:
clconvert_snapshot, указав номер версии HACMP (HAS)
и имя преобразуемого файла снимка. Флаг -C выполняет преобразование снимка
HACMP (HAS) в формат снимка HACMP V5.1:clconvert_snapshot -C -v версия -s <имя_файла>
Переустановка сохраненных модифицированных скриптов обработки событий
Переустановите требуемые модифицированные скрипты обработки событий, сохраненные в предыдущей конфигурации.
Примечание. Некоторые скрипты обработки событий, использовавшиеся в прежних версиях, могут оказаться ненужными в HACMP V5.1, особенно в группах ресурсов, применяющих параллельную обработку.
Перезагрузка узлов кластера
Перезагрузка узлов кластера необходима для активизации коммуникационного демона нового кластера (clcomdES).
Проверка и синхронизация конфигурации кластера
После установки программного обеспечения HACMP и перезагрузки каждого узла необходимо выполнить проверку (верификацию) и синхронизацию топологии кластера. При верификации удостоверяется согласованность определения кластера на всех узлах с выдачей соответствующих ошибок и/или предупреждений. В следующем разделе мы кратко рассмотрим процесс проверки кластера.
Выполните команду smitty hacmp и выберите пункт Extended Configuration
Extended Verification and Synchronization (Расширенная конфигурация >
Расширенная верификация и синхронизация), выберите Verify changes only
(Верифицировать только изменения), после чего нажмите Enter (пример 1.2).
HACMP Verification and Synchronization (Active Cluster on a Local Node) Type or select values in entry fields. Press Enter AFTER making all desired changes. [Entry Fields] * Emulate or Actual [Actual] + Force synchronization if verification fails? [No] + * Verify changes only? [No] + * Logging [Standard] + F1=Help F2=Refresh F3=Cancel F4=List F5=Reset F6=Command F7=Edit F8=Image F9=Shell F10=Exit Enter=Do
Важно! Нельзя выполнить синхронизацию в кластере со смешанными версиями. При обновлении не следует надолго оставлять кластер со смешанными версиями HACMP. Новые функции версии V5.1 доступны только после обновления всех узлов и синхронизации кластера.
При выполнении поузловой (циклической) миграции необходимо учитывать следующее:
Stop Cluster Services Type or select values in entry fields. Press Enter AFTER making all desired changes. [Entry Fields] * Stop now, on system restart or both on system restart + Stop Cluster Services on these nodes [p630n01] + BROADCAST cluster shutdown? true + * Shutdown mode graceful + F1=Help F2=Refresh F3=Cancel F4=List F5=Reset F6=Command F7=Edit F8=Image F9=Shell F10=Exit Enter=Do
Если вы не используете C-
Как осуществить поузловую миграцию
Для осуществления поузловой миграции с HACMP V4.5 на HACMP V5.1 необходимо выполнить следующие действия:
# /usr/es/sbin/cluster/utilities/clstop -gr
smitty hacmp ;| HACMP | HACMP/ES | RSCT |
|---|---|---|
| clstmgr | clstmgrES | grpsvcs |
| cllockd (необязательный) | cllockdES (необязательный) | topsvcs |
| clsmuxpd | clsmuxpES | emsvcs |
| clinfo (необязательный) | clinfoES (необязательный) | grpglsm |
| clcomdES | emaixos |
Примечание. В процессе поузловой миграции с HAS 4.5 на HACMP V5.1 будут выдаваться следующие предупреждения: sysck: 3001-036 WARNING: File /etc/cluster/lunreset.lst is also owned by fileset cluster. base.server.events. sysck: 3001-036 WARNING: File /etc/cluster/disktype.lst is also owned by fileset cluster. base.server.events. Можете благополучно игнорировать эти предупреждения и продолжать установку.
Сообщение config_too_long
После завершения процесса миграции во время удаления наборов файлов HACMP может появиться сообщение config_too_long. Это сообщение возникает, когда диспетчер кластера обнаруживает, что обработка события занимает больше установленного времени. Сообщения config_too_long добавляются в файл hacmp.out, пока не завершится событие. При возникновении таких сообщений следует периодически убеждаться в том, что событие все еще действует и что не произошел отказ.
Можно избежать вывода этих сообщений, увеличив время ожидания до вызова события config_too_long (с использованием
smitty hacmp.Это необходимо сделать на каждом узле. Изменения вступают в действие после перезапуска служб кластера.
Как работает процесс поузловой миграции
После установки HACMP на всех узлах кластера (когда все узлы находятся в гибридном состоянии) запуск служб кластера на последнем узле кластера автоматически вызывает передачу управления в HACMP V5.1 следующим образом:
Снимки кластера, сохраненные во время миграции
Ранее существовавшие снимки HACMP сохраняются в каталоге /usr/es/sbin/cluster/
Обработка отказа узла в процессе миграции
При отказе узла в процессе миграции после
Процедура возврата
Если по какой-то причине вы решите не продолжать процесс миграции, вы можете удалить программное обеспечение HACMP V5.1 с узлов, на которых оно было установлено, в любой момент процесса до запуска HACMP на последнем узле.
Примечание. Удаление программного обеспечения HACMP следует проводить только на локальном узле. Во время миграции не следует выбирать вариант удаления программного обеспечения с нескольких узлов.
Удаление программного обеспечения HACMP
Для этого проделайте следующее:
Обработка отказов синхронизации при поузловой миграции
Если вы попытаетесь внести изменение в топологию или ресурсы кластера до завершения миграции, произойдет отказ процесса синхронизации. Возникнет следующее сообщение:
cldare: Migration from HACMP V4.5 to HACMP V5.1 Detected. cldare cannot be run until migration has completed.
Для возврата после изменения необходимо восстановить активный
smitty hacmp.В этом разделе мы обсудим обновления для HACMP.
Поддерживаемые обновления для HACMP V5.1
Утилиты преобразования HACMP предлагают простой путь обновления до версии V5.1 с нижеперечисленных версий:
Если вам потребуется выполнить преобразование на HACMP V5.1 с более ранних версий, чем указаны выше, необходимо сначала выполнить обновление до одной из поддерживаемых версий. Затем вы сможете выполнить преобразование на HACMP V5.1. Например, для преобразования с HACMP/ES 4.2.2 на HACMP V5.1 сначала нужно будет выполнить обновление установки до HACMP/ES 4.4.1 или выше и затем выполнить обновление до HACMP V5.1.
Чтобы выполнить обновление до HACMP V5.1, нужно выполнить следующие действия:
clstop.lppchk -v or lppchk -c "cluster.*"Если установка прошла без ошибок, обе команды выполняются без выдачи сообщений.
smitty
clstart и убедитесь в успешном подключении первого узла к кластеру.lspv проверьте PVID для каждого диска). Если PVID для дисков не выводятся,
может потребоваться удалить диск и выполнить повторное конфигурирование.cl_convert и clconvert_snapshot
HACMP содержит утилиты преобразования cl_convert и clconvert_snapshot.
Обновление программного обеспечения HACMP/ES до последней версии HACMP
включает преобразование
В случае сбоя при преобразовании следует выполнить cl_convert с флагом -F.
Например, чтобы выполнить преобразование с HACMP/ES V4.5 на HACMP V5.1, следует использовать флаги -F и -v (version) следующим образом (обратите внимание на
добавление "0" к номеру версии V4.5):
# /usr/es/sbin/cluster/conversion/cl_convert -F -v 4.5.0
Для запуска утилиты преобразования требуются:
Утилита cl_convert записывает информацию о выполнении преобразования в файл /tmp/clconvert.log, что дает возможность оценить успешность выполнения преобразования. Этот файл журнала генерируется (перезаписывается) при каждом выполнении cl_convert или clconvert_snapshot.
Утилита clconvert_snapshot не запускается автоматически во время установки, ее следует запускать из командной строки. Выполните clconvert_snapshot для обновления снимков кластера при миграции с HACMP (HAS) на HACMP, как описано в этом разделе.
Обновление диспетчера одновременного доступа к ресурсам
Для установки средства одновременного доступа на узлах кластера необходимо установить диспетчер одновременного доступа к ресурсам (
AIX 5L V5.1 поддерживает расширенный режим одновременного доступа (enhanced
Сведения о расширенном режиме одновременного доступа и о поддерживаемых
дисковых устройствах общего доступа производства IBM см. в гл. 5, "Planning Shared
LVM Components", руководства HACMP for AIX 5L V5.1 Planning and Installation
Guide, SC23-4861-02. Кроме того, если вы хотите использовать диски других производителей, см. прил. D, "
Проблемы при установке
Если при установке возникают проблемы, программа установки автоматически выполняет процесс очистки. Если по какой-либо причине после неудачной установки не была выполнена очистка, нужно выполнить следующие действия:
Для получения официальных документов о завершении программы дополнительного профессионального образования (удостоверения о повышении квалификации, дипломов о профессиональной переподготовке и MBA) необходимо предоставить:
Внимание! Вы можете не заказывать доставку бумажной версии официального документы, а скачать его в электронном виде и распечатать самостоятельно. Информация о выданном документе в течение 1 месяца загружается в Федеральную информационную систему «Федеральный реестр сведений о документах об образовании и (или) о квалификации, документах об обучении» - ФИС ФРДО.
Доступ на новый сайт осуществляется с использованием адреса электронной почты, который был указан вами при регистрации на "старом". Мы постарались перенести все ваши данные с прежнего ресурса, однако не исключена вероятность потери части информации.
При возникновении проблемы со входом, воспользуйтесь функцией сброса пароля
Если вы обнаружите несоответствия, пожалуйста, сообщите нам.