polars.DataFrame.approx_n_unique
-
Приблизительное количество уникальных значений.
Устарело с версии 0.20.11: Вместо этого используйте метод
select(pl.all().approx_n_unique()).Для оценки кардинальности используется алгоритм HyperLogLog++.
Примеры
>>> df = pl.DataFrame( ... { ... "a": [1, 2, 3, 4], ... "b": [1, 2, 1, 1], ... } ... ) >>> df.approx_n_unique() shape: (1, 2) ┌─────┬─────┐ │ a ┆ b │ │ --- ┆ --- │ │ u32 ┆ u32 │ ╞═════╪═════╡ │ 4 ┆ 2 │ └─────┴─────┘
DataFrame.approx_n_unique() → DataFrame
© 2020 Ritchie Vink
© 2022 Polars contributors
Licensed under the MIT License.
https://docs.pola.rs/api/python/stable/reference/dataframe/api/polars.DataFrame.approx_n_unique.html