tf.raw_ops.StringToHashBucketStrong
Преобразует каждую строку в тензоре-входе в её остаток от деления на количество ведер.
tf.raw_ops.StringToHashBucketStrong(
input, num_buckets, key, name=None
)
Функция хэширования является детерминированной по содержанию строки в процессе. Функция хэширования является хэшированием с ключом, где атрибут key определяет ключ функции хэширования. key представляет собой массив из 2 элементов.
Сильное хэширование важно, когда входные данные могут быть вредоносными, например, URL-адреса с дополнительными компонентами. Злоумышленники могут пытаться заставить свои входные данные хешироваться в одно и то же ведро для атаки типа "отказ в обслуживании" или для искажения результатов. Сильное хэширование может затруднить поиск входных данных со смещённым распределением значений хэша по ведрам. Это требует, чтобы функция хэширования была заполнена ключом с высокой энтропией (случайным) ключом, неизвестным злоумышленнику.
Дополнительная надёжность влечёт за собой приблизительно в 4 раза большее время вычислений по сравнению с tf.string_to_hash_bucket_fast.
Примеры:
tf.strings.to_hash_bucket_strong(["Hello", "TF"], 3, [1, 2]).numpy() array([2, 0])
| Аргументы | |
|---|---|
input | A Tensor типа string. Строки, которым нужно назначить ведро хэша. |
num_buckets | A int, что >= 1. Количество ведер. |
key | Список ints. Ключ, используемый для инициализации функции хэширования, передаваемый в виде списка из двух элементов uint64. |
name | Имя операции (необязательно). |
| Возвращаемые значения | |
|---|---|
A Tensor типа int64. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.3/api_docs/python/tf/raw_ops/StringToHashBucketStrong