Spec-Zone.ru › Polars

polars.DataFrame.top_k

DataFrame.top_k(
    k: int,
    *,
    by: IntoExpr | Iterable[IntoExpr],
    reverse: bool | Sequence[bool] = False,
) → DataFrame

Возвращает k строк с наибольшими значениями.

Ненулевые элементы всегда имеют приоритет над нулевыми независимо от значения reverse. Порядок вывода не гарантируется; если необходимо отсортировать вывод, вызовите sort() после этой функции.

Изменено в версии 1.0.0: Параметр descending переименован в reverse.

Параметры:
k

Количество возвращаемых строк.

by

Столбец или столбцы, используемые для определения строк с наибольшими значениями. Принимает на вход выражения. Строки интерпретируются как имена столбцов.

reverse

Выбирать k наименьших элементов из by столбца или столбцов (вместо k наибольших). Для каждого столбца можно задать отдельное значение, передав последовательность логических значений.

См. также

bottom_k

Примеры

>>> df = pl.DataFrame(
...     {
...         "a": ["a", "b", "a", "b", "b", "c"],
...         "b": [2, 1, 1, 3, 2, 1],
...     }
... )

Получить строки, содержащие 4 наибольших значения в столбце b.

>>> df.top_k(4, by="b")
shape: (4, 2)
┌─────┬─────┐
│ a   ┆ b   │
│ --- ┆ --- │
│ str ┆ i64 │
╞═════╪═════╡
│ b   ┆ 3   │
│ a   ┆ 2   │
│ b   ┆ 2   │
│ b   ┆ 1   │
└─────┴─────┘

Получить строки, содержащие 4 наибольших значения при сортировке по столбцам b и a.

>>> df.top_k(4, by=["b", "a"])
shape: (4, 2)
┌─────┬─────┐
│ a   ┆ b   │
│ --- ┆ --- │
│ str ┆ i64 │
╞═════╪═════╡
│ b   ┆ 3   │
│ b   ┆ 2   │
│ a   ┆ 2   │
│ c   ┆ 1   │
└─────┴─────┘

© 2020 Ritchie Vink
© 2022 Polars contributors
Licensed under the MIT License.
https://docs.pola.rs/api/python/stable/reference/dataframe/api/polars.DataFrame.top_k.html

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API