pandas.util.hash_array
- pandas.util.hash_array(vals, encoding='utf8', hash_key='0123456789123456', categorize=True)[source]
-
В качестве входных данных принимает одномерный массив и возвращает массив целочисленных значений, вычисленных детерминированным способом.
- Параметры:
-
- vals:ndarray или ExtensionArray
- encoding:str, по умолчанию ‘utf8’
-
Кодировка данных и ключа при работе со строками.
- hash_key:str, по умолчанию _default_hash_key
-
Ключ хэширования для кодирования строкового ключа.
- categorize:bool, по умолчанию True
-
Признак того, нужно ли предварительно категоризировать массив объектов перед хэшированием. Это эффективнее, когда массив содержит повторяющиеся значения.
- Возвращает:
-
- ndarray[np.uint64, ndim=1]
-
Хэшированные значения, длина которых совпадает с длиной vals.
Примеры
>>> pd.util.hash_array(np.array([1, 2, 3])) array([ 6238072747940578789, 15839785061582574730, 2185194620014831856], dtype=uint64)
© 2008–2022, AQR Capital Management, LLC, Lambda Foundry, Inc. and PyData Development Team
Licensed under the 3-clause BSD License.
https://pandas.pydata.org/pandas-docs/version/2.2.2/reference/api/pandas.util.hash_array.html