Spec-Zone.ru › GCC 6

6.12 Полуточная точность с плавающей точкой

На целевых платформах ARM компилятор GCC поддерживает полуточную (16-битную) плавающую точку через тип __fp16. Для использования этого типа необходимо явно включить его с помощью параметра командной строки -mfp16-format.

ARM поддерживает две несовместимые представления значений полуточной плавающей точки. Вы должны выбрать одно из представлений и использовать его последовательно в вашей программе.

Указание -mfp16-format=ieee выбирает формат IEEE 754-2008. Этот формат может представлять нормализованные значения в диапазоне от 2-14 до 65504. Точность мантиссы составляет 11 бит, что примерно соответствует 3 десятичным цифрам.

Указание -mfp16-format=alternative выбирает альтернативный формат ARM. Это представление аналогично формату IEEE, но не поддерживает бесконечности или числа Not a Number (NaN). Вместо этого диапазон показателей расширен, так что этот формат может представлять нормализованные значения в диапазоне от 2-14 до 131008.

Тип __fp16 — это только формат хранения. Для целей арифметических и других операций значения __fp16 в выражениях C или C++ автоматически повышаются до float. Кроме того, вы не можете объявить функцию со значением возврата или параметрами типа __fp16.

Обратите внимание, что преобразования из double в __fp16 включают промежуточное преобразование в float. Из-за округления это иногда может привести к другому результату, чем прямое преобразование.

ARM предоставляет аппаратную поддержку преобразований между __fp16 и float значениями как расширение VFP и NEON (Advanced SIMD). GCC генерирует код, использующий эти аппаратные инструкции, если вы компилируете с параметрами выбора FPU, которые их предоставляют; например, -mfpu=neon-fp16 -mfloat-abi=softfp, в дополнение к параметру -mfp16-format для выбора формата полуточной точности.

Поддержка типа данных __fp16 на уровне языка независима от того, генерирует ли GCC код с использованием аппаратных инструкций с плавающей точкой. В тех случаях, когда аппаратная поддержка не указана, GCC реализует преобразования между __fp16 и float значениями как вызовы библиотечных функций.

Далее: Десятичная плавающая точка, Предыдущее: Типы с плавающей точкой, Вверх: Расширения C [Оглавление][Индекс]

© Free Software Foundation
Licensed under the GNU Free Documentation License, Version 1.3.
https://gcc.gnu.org/onlinedocs/gcc-6.5.0/gcc/Half-Precision.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API