Spec-Zone.ru › TensorFlow 2.4

tf.raw_ops.BoostedTreesCalculateBestFeatureSplitV2

Вычисляет выигрыши для каждого признака и возвращает информацию о наилучшем возможном разбиении для каждого узла. Однако, если разбиение не найдено, то информация о разбиении для данного узла не возвращается.

Просмотр псевдонимов

Псевдонимы для миграции

Дополнительные сведения см. в Руководстве по миграции.

tf.compat.v1.raw_ops.BoostedTreesCalculateBestFeatureSplitV2

tf.raw_ops.BoostedTreesCalculateBestFeatureSplitV2(
    node_id_range, stats_summaries_list, split_types, candidate_feature_ids, l1, l2,
    tree_complexity, min_node_weight, logits_dimension, name=None
)

Информация о разбиении — это лучший порог (номер корзины), выигрыши и вклады левого/правого узла на узел для каждого признака.

Возможен случай, когда не все узлы могут быть разделены на каждом признаке. Таким образом, список возможных узлов может отличаться для разных признаков. Поэтому мы возвращаем node_ids_list для каждого признака, содержащий список узлов, для которых этот признак может быть использован для разбиения.

Таким образом, результат — наилучшее разбиение по признакам и по узлам, так что его необходимо объединить позднее для получения наилучшего разбиения для каждого узла (среди всех возможных признаков).

Форматы выходных данных совместимы таким образом, что первое измерение всех тензоров одинаково и равно числу возможных узлов разбиения для каждого признака.

Аргументы
node_id_range A Tensor типа int32. Тензор ранга 1 (форма=[2]), задающий диапазон [первый, последний) идентификаторов узлов для обработки в stats_summary_list. Узлы обрабатываются между двумя узлами, указанными в тензоре, аналогично for node_id in range(node_id_range[0], node_id_range[1]) (обратите внимание, что индекс последнего узла node_id_range[1] исключается).
stats_summaries_list Список из как минимум 1 Tensor объекта типа float32. Список тензоров ранга 4 (#форма=[max_splits, feature_dims, bucket, stats_dims]) для накопленных сводных статистик (градиент/гессиан) на узел, на измерение, на корзины для каждого признака. Первое измерение тензора — максимальное количество разбиений, и поэтому не все элементы будут использоваться, но будут использоваться только индексы, указанные в node_ids.
split_types A Tensor типа string. Тензор ранга 1, указывающий, должен ли этот оператор выполнять разбиение по неравенству или по равенству для каждого признака.
candidate_feature_ids A Tensor типа int32. Тензор ранга 1 с идентификаторами для каждого признака. Это фактический идентификатор признака.
l1 A Tensor типа float32. Коэффициент регуляризации l1 для весов листа, на основе экземпляра.
l2 A Tensor типа float32. Коэффициент регуляризации l2 для весов листа, на основе экземпляра.
tree_complexity A Tensor типа float32. Корректировка выигрыша, на основе листа.
min_node_weight A Tensor типа float32. Минимальное среднее значение гессиана в узле, необходимое для того, чтобы узел считался кандидатом на разбиение.
logits_dimension An int который является >= 1. Размеры лога, то есть количество классов.
name Имя операции (необязательно).
Возвращаемые значения
Кортеж объектов Tensor (node_ids, gains, feature_ids, feature_dimensions, thresholds, left_node_contribs, right_node_contribs, split_with_default_directions).
node_ids A Tensor типа int32.
gains A Tensor типа float32.
feature_ids A Tensor типа int32.
feature_dimensions A Tensor типа int32.
thresholds A Tensor типа int32.
left_node_contribs A Tensor типа float32.
right_node_contribs A Tensor типа float32.
split_with_default_directions A Tensor типа string.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.4/api_docs/python/tf/raw_ops/BoostedTreesCalculateBestFeatureSplitV2

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API