Spec-Zone.ru › MySQL 9.2

12.10.2 Западно-европейские наборы символов

Западно-европейские наборы символов охватывают большинство западноевропейских языков, таких как французский, испанский, каталонский, баскский, португальский, итальянский, албанский, голландский, немецкий, датский, шведский, норвежский, финский, фарерский, исландский, ирландский, шотландский и английский.

  • ascii (US ASCII) сопоставления:

    • ascii_bin

    • ascii_general_ci (по умолчанию)

  • cp850 (DOS Западно-европейский) сопоставления:

    • cp850_bin

    • cp850_general_ci (по умолчанию)

  • dec8 (DEC Западно-европейский) сопоставления:

    • dec8_bin

    • dec8_swedish_ci (по умолчанию)

    Набор символов dec устарел; ожидайте, что поддержка будет удалена в последующей версии MySQL.

  • hp8 (HP Западно-европейский) сопоставления:

    • hp8_bin

    • hp8_english_ci (по умолчанию)

    Набор символов hp8 устарел; ожидайте, что поддержка будет удалена в последующей версии MySQL.

  • latin1 (cp1252 Западно-европейский) сопоставления:

    • latin1_bin

    • latin1_danish_ci

    • latin1_general_ci

    • latin1_general_cs

    • latin1_german1_ci

    • latin1_german2_ci

    • latin1_spanish_ci

    • latin1_swedish_ci (по умолчанию)

    Набор символов latin1 MySQL совпадает с набором символов Windows cp1252. Это означает, что он совпадает с официальным набором символов ISO 8859-1 или IANA (Международный орган по распределению интернет-номеров) latin1, за исключением того, что IANA latin1 рассматривает кодовые точки между 0x80 и 0x9f как “неопределённые”, тогда как cp1252, и, следовательно, набор символов MySQL latin1, присваивает символы для этих позиций. Например, 0x80 — это знак евро. Для “неопределённых” записей в cp1252 MySQL преобразует 0x81 в Unicode 0x0081, 0x8d в 0x008d, 0x8f в 0x008f, 0x90 в 0x0090 и 0x9d в 0x009d.

    Сопоставление latin1_swedish_ci по умолчанию, вероятно, используется большинством клиентов MySQL. Хотя часто говорят, что оно основано на шведско-финской системе сопоставления, некоторые шведы и финны не согласны с этим утверждением.

    Сопоставления latin1_german1_ci и latin1_german2_ci основаны на стандартах DIN-1 и DIN-2, где DIN означает Deutsches Institut für Normung (немецкий аналог ANSI). DIN-1 называется «сопоставление словаря», а DIN-2 — «сопоставление телефонного справочника». Пример влияния этого на сравнения или при выполнении поиска см. в разделе 12.8.6 «Примеры влияния сопоставления».

    • latin1_german1_ci (словарь) правила:

      Ä = A
      Ö = O
      Ü = U
      ß = s
      
    • latin1_german2_ci (телефонный справочник) правила:

      Ä = AE
      Ö = OE
      Ü = UE
      ß = ss
      

    В сопоставлении latin1_spanish_ci ñ (тильда) является отдельной буквой между n и o.

  • macroman (Mac Западно-европейский) сопоставления:

    • macroman_bin

    • macroman_general_ci (по умолчанию)

    macroroman устарел; ожидайте, что поддержка будет удалена в последующей версии MySQL.

  • swe7 (7-битный шведский) сопоставления:

    • swe7_bin

    • swe7_swedish_ci (по умолчанию)

© 2025 Oracle
Licensed under the GPLv2 License.
https://docs.oracle.com/cd/E17952_01/mysql-8.4-en/charset-we-sets.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API