20.7 Производительность и устранение неполадок группы репликации
- 20.7.1 Тонкая настройка потока групповой коммуникации
- 20.7.2 Управление потоком
- 20.7.3 Единственный лидер консенсуса
- 20.7.4 Сжатие сообщений
- 20.7.5 Фрагментация сообщений
- 20.7.6 Управление кэшем XCom
- 20.7.7 Реакция на обнаружение сбоев и разделение сети
- 20.7.8 Обработка разделения сети и потери кворума
- 20.7.9 Мониторинг использования памяти группы репликации с помощью инструментария Performance Schema для памяти
Группа репликации предназначена для создания отказоустойчивых систем с встроенным обнаружением сбоев и автоматическим восстановлением. Если экземпляр сервера-члена добровольно покидает группу или прекращает общение с группой, оставшиеся члены договариваются о переконфигурации группы между собой и выбирают нового первичного сервера, если это необходимо. Выгнанные члены автоматически пытаются присоединиться к группе и доводятся до актуального состояния с помощью распределенного восстановления. Если группа испытывает проблемы, такие что не может связаться с большинством своих членов для согласования решения, она идентифицирует себя как потерявшую кворум и прекращает обработку транзакций. Группа репликации также имеет встроенные механизмы и настройки, которые помогают группе адаптироваться к и управлять изменениями в рабочем процессе и размере сообщений, и оставаться в рамках ограничений основной системы и сетевых ресурсов.
Значения по умолчанию для системных переменных группы репликации предназначены для максимального повышения производительности и автономности группы. Информация в этом разделе поможет вам настроить группу репликации для оптимизации автоматической обработки любых повторяющихся проблем, которые вы испытываете в своих конкретных системах, таких как временные сетевые сбои или рабочие нагрузки и транзакции, которые превышают ресурсы экземпляра сервера.
Если вы обнаружите, что члены группы выгоняются и присоединяются к группе чаще, чем хотелось бы, возможно, настройки обнаружения сбоев по умолчанию для группы репликации слишком чувствительны для вашей системы. Это может быть в случае медленных сетей или машин, сетей с высокой частотой неожиданных временных сбоев или во время запланированных сетевых отключений. Советы по решению этой ситуации путем изменения настроек см. в разделе 20.7.7, “Реакция на обнаружение сбоев и разделение сети”.
Вам следует вмешиваться вручную в настройку группы репликации только в случае возникновения проблем, с которыми группа не может справиться автоматически. К числу ключевых проблем, требующих вмешательства администратора, относятся случаи, когда член находится в статусе ERROR и не может присоединиться к группе, или когда разделение сети приводит к потере кворума группой.
Если член, работающий и настроенный должным образом, не может присоединиться или вновь присоединиться к группе с помощью распределенного восстановления и остается в статусе
ERROR, раздел 20.5.4.4, “Отказоустойчивость для распределенного восстановления” объясняет возможные проблемы. Вероятной причиной является то, что присоединяющемуся члену требуются дополнительные транзакции, отсутствующие у существующих членов группы. Советы по решению этой проблемы см. в разделе 20.4.1, “GTID и группа репликации”.Если группа потеряла кворум, это может быть вызвано разделением сети, которое разделило группу на две части, или, возможно, из-за сбоя большинства серверов. Советы по решению этой ситуации см. в разделе 20.7.8, “Обработка разделения сети и потери кворума”.
© 2025 Oracle
Licensed under the GPLv2 License.