Spec-Zone.ru › TensorFlow 2.3

tf.estimator.MultiHead

Просмотр исходного кода на GitHub

Создаёт Head для многоцелевого обучения.

Наследуется от: Head

Просмотр псевдонимов

Псевдонимы для миграции

См. Руководство по миграции для получения дополнительных сведений.

tf.compat.v1.estimator.MultiHead

tf.estimator.MultiHead(
    heads, head_weights=None
)

Этот класс объединяет вывод нескольких Head объектов. Конкретно:

  • Для обучения суммирует потери каждого объекта, вызывает train_op_fn с этой итоговой потерей.
  • Для оценки объединяет метрики, добавляя суффикс head.name к ключам в метриках оценки, таким как precision/head1.name, precision/head2.name.
  • Для прогнозирования объединяет прогнозы и обновляет ключи в словаре прогнозов до 2-кортежа, (head.name, prediction_key). Объединяет export_outputs таким образом, что по умолчанию используется первый объект.

Использование:

head1 = tf.estimator.MultiLabelHead(n_classes=2, name='head1')
head2 = tf.estimator.MultiLabelHead(n_classes=3, name='head2')
multi_head = tf.estimator.MultiHead([head1, head2])
logits = {
   'head1': np.array([[-10., 10.], [-15., 10.]], dtype=np.float32),
   'head2': np.array([[20., -20., 20.], [-30., 20., -20.]],
   dtype=np.float32),}
labels = {
   'head1': np.array([[1, 0], [1, 1]], dtype=np.int64),
   'head2': np.array([[0, 1, 0], [1, 1, 0]], dtype=np.int64),}
features = {'x': np.array(((42,),), dtype=np.float32)}
# For large logits, sigmoid cross entropy loss is approximated as:
# loss = labels * (logits < 0) * (-logits) +
#        (1 - labels) * (logits > 0) * logits =>
# head1: expected_unweighted_loss = [[10., 10.], [15., 0.]]
# loss1 = ((10 + 10) / 2 + (15 + 0) / 2) / 2 = 8.75
# head2: expected_unweighted_loss = [[20., 20., 20.], [30., 0., 0]]
# loss2 = ((20 + 20 + 20) / 3 + (30 + 0 + 0) / 3) / 2 = 15.00
# loss = loss1 + loss2 = 8.75 + 15.00 = 23.75
loss = multi_head.loss(labels, logits, features=features)
print('{:.2f}'.format(loss.numpy()))
23.75
eval_metrics = multi_head.metrics()
updated_metrics = multi_head.update_metrics(
  eval_metrics, features, logits, labels)
for k in sorted(updated_metrics):
 print('{} : {:.2f}'.format(k, updated_metrics[k].result().numpy()))
auc/head1 : 0.17
auc/head2 : 0.33
auc_precision_recall/head1 : 0.60
auc_precision_recall/head2 : 0.40
average_loss/head1 : 8.75
average_loss/head2 : 15.00
loss/head1 : 8.75
loss/head2 : 15.00
preds = multi_head.predictions(logits)
print(preds[('head1', 'logits')])
tf.Tensor(
  [[-10.  10.]
   [-15.  10.]], shape=(2, 2), dtype=float32)

Использование с готовым оценщиком:

# In `input_fn`, specify labels as a dict keyed by head name:
def input_fn():
  features = ...
  labels1 = ...
  labels2 = ...
  return features, {'head1.name': labels1, 'head2.name': labels2}

# In `model_fn`, specify logits as a dict keyed by head name:
def model_fn(features, labels, mode):
  # Create simple heads and specify head name.
  head1 = tf.estimator.MultiClassHead(n_classes=3, name='head1')
  head2 = tf.estimator.BinaryClassHead(name='head2')
  # Create MultiHead from two simple heads.
  head = tf.estimator.MultiHead([head1, head2])
  # Create logits for each head, and combine them into a dict.
  logits1, logits2 = logit_fn()
  logits = {'head1.name': logits1, 'head2.name': logits2}
  # Return the merged EstimatorSpec
  return head.create_estimator_spec(..., logits=logits, ...)

# Create an estimator with this model_fn.
estimator = tf.estimator.Estimator(model_fn=model_fn)
estimator.train(input_fn=input_fn)

Также поддерживает logits в качестве Tensor формы [D0, D1, ... DN, logits_dimension]. Он разделит Tensor по последнему измерению и распределит его соответствующим образом между объектами. Например:

# Input logits.
logits = np.array([[-1., 1., 2., -2., 2.], [-1.5, 1., -3., 2., -2.]],
                  dtype=np.float32)
# Suppose head1 and head2 have the following logits dimension.
head1.logits_dimension = 2
head2.logits_dimension = 3
# After splitting, the result will be:
logits_dict = {'head1_name': [[-1., 1.], [-1.5, 1.]],
               'head2_name':  [[2., -2., 2.], [-3., 2., -2.]]}

Использование:

def model_fn(features, labels, mode):
  # Create simple heads and specify head name.
  head1 = tf.estimator.MultiClassHead(n_classes=3, name='head1')
  head2 = tf.estimator.BinaryClassHead(name='head2')
  # Create multi-head from two simple heads.
  head = tf.estimator.MultiHead([head1, head2])
  # Create logits for the multihead. The result of logits is a `Tensor`.
  logits = logit_fn(logits_dimension=head.logits_dimension)
  # Return the merged EstimatorSpec
  return head.create_estimator_spec(..., logits=logits, ...)
Аргументы
heads Список или кортеж экземпляров Head. Все объекты должны иметь name. Первый объект в списке используется по умолчанию во время предоставления сервиса.
head_weights Необязательный список весов, такой же длины, как heads. Используется при объединении потерь для вычисления взвешенной суммы потерь от каждого объекта. Если None, все потери взвешиваются одинаково.
Атрибуты
logits_dimension Подробности см. в base_head.Head
loss_reduction Подробности см. в base_head.Head
name Подробности см. в base_head.Head

Методы

create_estimator_spec

Просмотреть исходный код

create_estimator_spec(
    features, mode, logits, labels=None, optimizer=None, trainable_variables=None,
    train_op_fn=None, update_ops=None, regularization_losses=None
)

Возвращает model_fn.EstimatorSpec.

Аргументы
features Входные dict объектов Tensor или SparseTensor
mode ModeKeys оценщика.
logits Входные dict с ключами по имени объекта, или логиты Tensor с формой [D0, D1, ... DN, logits_dimension]. Для многих применений форма Tensor составляет [batch_size, logits_dimension]. Если логиты являются Tensor, то Tensor будет разделено по последнему измерению и распределено соответствующим образом между объектами. Смотрите MultiHead для примеров.
labels Входные dict с ключами по имени объекта. Для каждого объекта значение метки может быть целым числом или строкой Tensor с формой, соответствующей его logits.labels является обязательным аргументом, когда mode равно TRAIN или EVAL.
optimizer Экземпляр tf.keras.optimizers.Optimizer для оптимизации потерь в режиме TRAIN. А именно, устанавливает train_op = optimizer.get_updates(loss, trainable_variables), который обновляет переменные для минимизации loss.
trainable_variables Список или кортеж объектов Variable для обновления для минимизации loss. В Tensorflow 1.x, по умолчанию это список переменных, собранных в графе под ключом GraphKeys.TRAINABLE_VARIABLES. Так как Tensorflow 2.x не имеет коллекций и GraphKeys, trainable_variables должны быть явно переданы здесь.
train_op_fn Функция, которая принимает скалярную потерю Tensor и возвращает train_op. Используется, если optimizer является None.
update_ops Список или кортеж операций обновления, которые необходимо выполнить во время обучения. Например, слои, такие как BatchNormalization, создают операции обновления среднего и дисперсии, которые необходимо выполнять во время обучения. В Tensorflow 1.x они помещаются в коллекцию UPDATE_OPS. Поскольку Tensorflow 2.x не имеет коллекций, update_ops должны быть явно переданы здесь.
regularization_losses Список дополнительных скалярных потерь, которые нужно добавить к обучающей потере, такие как потери регуляризации. Эти потери обычно выражаются как среднее значение по партии, поэтому для наилучших результатов в каждом объекте пользователи должны использовать значение по умолчанию loss_reduction=SUM_OVER_BATCH_SIZE для предотвращения ошибок масштабирования. По сравнению с потерями регуляризации для каждого объекта, эта потеря предназначена для регуляризации объединенной потери всех объектов в многоголовом объекте и будет добавлена к общей обучающей потере многоголового объекта.
Возвращает
Экземпляр model_fn.EstimatorSpec
Возможные исключения
ValueError Если оба train_op_fn и optimizer являются None в режиме TRAIN, или если оба установлены. Если mode отсутствует в ModeKeys оценщика.

loss

Просмотреть исходный код

loss(
    labels, logits, features=None, mode=None, regularization_losses=None
)

Возвращает регуляризованную обучающую потерю. Подробности см. в base_head.Head.

metrics

Просмотреть исходный код

metrics(
    regularization_losses=None
)

Создаёт метрики. Подробности см. в base_head.Head.

predictions

Просмотреть исходный код

predictions(
    logits, keys=None
)

Создаёт прогнозы. Подробности см. в base_head.Head.

update_metrics

Просмотреть исходный код

update_metrics(
    eval_metrics, features, logits, labels, regularization_losses=None
)

Обновляет метрики оценки. Подробности см. в base_head.Head.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.3/api_docs/python/tf/estimator/MultiHead

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API