6.12 Полуточная точность с плавающей точкой
На целевых платформах ARM и AArch64 GCC поддерживает полуточную (16-битную) плавающую точку через тип __fp16, определенный в расширениях языка C для ARM. На системах ARM вам необходимо явно включить этот тип с помощью опции командной строки -mfp16-format, чтобы использовать его.
Целевые платформы ARM поддерживают две несовместимые представления значений полуточной точности с плавающей точкой. Вы должны выбрать одно из представлений и использовать его последовательно в вашей программе.
Указание -mfp16-format=ieee выбирает формат IEEE 754-2008. Этот формат может представлять нормализованные значения в диапазоне от 2^{-14} до 65504. Есть 11 битов точности мантиссы, примерно 3 десятичных знака.
Указание -mfp16-format=alternative выбирает альтернативный формат ARM. Это представление аналогично формату IEEE, но не поддерживает бесконечности или NaN. Вместо этого диапазон показателей расширен, так что этот формат может представлять нормализованные значения в диапазоне от 2^{-14} до 131008.
Порт GCC для AArch64 поддерживает только формат IEEE 754-2008 и не требует использования опции командной строки -mfp16-format.
Тип __fp16 может быть использован только как аргумент к внутренним функциям, определенным в <arm_fp16.h>, или как формат хранения. Для целей арифметики и других операций значения __fp16 в выражениях C или C++ автоматически повышаются до float.
Целевая платформа ARM предоставляет аппаратную поддержку преобразований между __fp16 и float значениями как расширение VFP и NEON (Advanced SIMD), а с ARMv8-A предоставляет аппаратную поддержку преобразований между __fp16 и double значениями. GCC генерирует код, использующий эти аппаратные инструкции, если вы компилируете с опциями для выбора FPU, который их предоставляет; например, -mfpu=neon-fp16 -mfloat-abi=softfp, в дополнение к опции -mfp16-format для выбора формата полуточной точности.
Поддержка на уровне языка для типа данных __fp16 не зависит от того, генерирует ли GCC код, использующий аппаратные инструкции с плавающей точкой. В случаях, когда аппаратная поддержка не указана, GCC реализует преобразования между __fp16 и другими типами как библиотечные вызовы.
Рекомендуется, чтобы переносимый код использовал тип _Float16, определенный в ISO/IEC TS 18661-3:2015. См. Типы с плавающей точкой.
Далее: Десятичная плавающая точка, Предыдущее: Типы с плавающей точкой, Вверх: Расширения C [Содержание][Индекс]
© Free Software Foundation
Licensed under the GNU Free Documentation License, Version 1.3.
https://gcc.gnu.org/onlinedocs/gcc-8.5.0/gcc/Half-Precision.html