Spec-Zone.ru › TensorFlow 2.4

tf.distribute.cluster_resolver.TFConfigClusterResolver

Просмотреть исходный код на GitHub

Реализация ClusterResolver, которая считывает переменную окружения TF_CONFIG.

Наследуется от: ClusterResolver

Просмотр псевдонимов

Псевдонимы для миграции

См. Руководство по миграции для получения дополнительной информации.

tf.compat.v1.distribute.cluster_resolver.TFConfigClusterResolver

tf.distribute.cluster_resolver.TFConfigClusterResolver(
    task_type=None, task_id=None, rpc_layer=None, environment=None
)

Это реализация решателей кластеров при использовании TF_CONFIG для задания информации о кластере. Спецификация кластера будет инициализирована из переменной окружения TF_CONFIG.

Пример настройки TF_CONFIG:

os.environ['TF_CONFIG'] = json.dumps({
  'cluster': {
      'worker': ["localhost:12345", "localhost:23456"]
  },
  'task': {'type': 'worker', 'index': 0}
})

Однако иногда среда выполнения контейнера устанавливает TF_CONFIG за вас. В этом случае вы можете просто создать экземпляр, не передавая никаких аргументов. Пример, как настроить Kuburnetes для установки TF_CONFIG: https://github.com/tensorflow/ecosystem/tree/master/kubernetes. Затем вы можете использовать его с tf.distribute.Strategy как:

# `TFConfigClusterResolver` is already the default one in the following
# strategy.
strategy = tf.distribute.experimental.MultiWorkerMirroredStrategy(
    cluster_resolver=TFConfigClusterResolver())
Аргументы
task_type (Строка, необязательно) Перезаписывает тип задачи, указанный в переменной окружения TF_CONFIG.
task_id (Целое число, необязательно) Перезаписывает индекс задачи, указанный в переменной окружения TF_CONFIG.
rpc_layer (Строка, необязательно) Перезаписывает уровень RPC, используемый TensorFlow.
environment (Строка, необязательно) Перезаписывает среду, в которой работает TensorFlow.
Атрибуты
environment Возвращает текущую среду, в которой выполняется TensorFlow.

Возможны два значения возврата: «google» (если TensorFlow выполняется во внутренней среде Google) или пустая строка (если TensorFlow выполняется в другом месте).

Если вы реализуете ClusterResolver, который работает как в среде Google, так и в открытом исходном коде (например, TPU ClusterResolver или аналогичный), вам нужно будет вернуть соответствующую строку в зависимости от среды, которую вы должны определить.

В противном случае, если вы реализуете ClusterResolver, который будет работать только в TensorFlow с открытым исходным кодом, вам не нужно реализовывать этот атрибут.

rpc_layer
task_id Возвращает идентификатор задачи, который указывает этот ClusterResolver.

В среде распределенного TensorFlow каждая задача может иметь применимый идентификатор задачи, который является индексом экземпляра в пределах его типа задачи. Это полезно, когда пользователю необходимо выполнить определенный код в соответствии с индексом задачи. Например,

cluster_spec = tf.train.ClusterSpec({
"ps": ["localhost:2222", "localhost:2223"],
"worker": ["localhost:2224", "localhost:2225", "localhost:2226"]
})

# SimpleClusterResolver is used here for illustration; other cluster
# resolvers may be used for other source of task type/id.
simple_resolver = SimpleClusterResolver(cluster_spec, task_type="worker",
task_id=0)

...

if cluster_resolver.task_type == 'worker' and cluster_resolver.task_id == 0:
# Perform something that's only applicable on 'worker' type, id 0. This
# block will run on this particular instance since we've specified this
# task to be a 'worker', id 0 in above cluster resolver.
else:
# Perform something that's only applicable on other ids. This block will
# not run on this particular instance.

Возвращает None, если такая информация недоступна или неприменима в текущей распределенной среде, например, при обучении с помощью tf.distribute.cluster_resolver.TPUClusterResolver.

Для получения дополнительной информации см. документацию класса tf.distribute.cluster_resolver.ClusterResolver.

task_type Возвращает тип задачи, который указывает этот ClusterResolver.

В распределенной среде TensorFlow каждая задача может иметь соответствующий тип задачи. Допустимые типы задач в TensorFlow включают «chief» (рабочий узел с большей ответственностью), «worker» (обычный рабочий узел для обучения/оценки), «ps» (сервер параметров) или «evaluator» (оценщик, оценивающий контрольные точки по метрикам).

См. Настройка многоузлового выполнения для получения дополнительной информации о типах задач «chief» и «worker», которые наиболее часто используются.

Доступ к такой информации полезен, когда пользователю необходимо выполнить определенный код в соответствии с типами задач. Например,

cluster_spec = tf.train.ClusterSpec({
"ps": ["localhost:2222", "localhost:2223"],
"worker": ["localhost:2224", "localhost:2225", "localhost:2226"]
})

# SimpleClusterResolver is used here for illustration; other cluster
# resolvers may be used for other source of task type/id.
simple_resolver = SimpleClusterResolver(cluster_spec, task_type="worker",
task_id=1)

...

if cluster_resolver.task_type == 'worker':
# Perform something that's only applicable on workers. This block
# will run on this particular instance since we've specified this task to
# be a worker in above cluster resolver.
elif cluster_resolver.task_type == 'ps':
# Perform something that's only applicable on parameter servers. This
# block will not run on this particular instance.

Возвращает None, если такая информация недоступна или неприменима в текущей распределенной среде, например, при обучении с помощью tf.distribute.experimental.TPUStrategy.

Для получения дополнительной информации см. документацию класса tf.distribute.cluster_resolver.ClusterResolver.

Методы

cluster_spec

Просмотреть исходный код

cluster_spec()

Возвращает ClusterSpec на основе переменной окружения TF_CONFIG.

Возвращает
ClusterSpec с информацией из переменной окружения TF_CONFIG.

master

Просмотреть исходный код

master(
    task_type=None, task_id=None, rpc_layer=None
)

Возвращает адрес узла-мастера для использования при создании сеанса TensorFlow.

Примечание: это полезно только для TensorFlow 1.x.
Аргументы
task_type (Строка, необязательно) Перезаписывает и устанавливает тип задачи узла-мастера.
task_id (Целое число, необязательно) Перезаписывает и устанавливает идентификатор задачи узла-мастера.
rpc_layer (Строка, необязательно) Перезаписывает и устанавливает протокол, по которому узлы TensorFlow взаимодействуют друг с другом.
Возвращает
Адрес узла-мастера.
Возможные исключения
RuntimeError Если тип задачи или идентификатор задачи не указаны, а переменная окружения TF_CONFIG не содержит раздел task.

num_accelerators

Просмотреть исходный код

num_accelerators(
    task_type=None, task_id=None, config_proto=None
)

Возвращает количество ускорителей на ядро рабочего узла.

Это возвращает количество ядер ускорителей (таких как GPU и TPU), доступных на один рабочий узел.

Мы также позволяем вызывающим сторонам указать тип и идентификатор задачи, чтобы нацелиться на конкретную задачу TensorFlow для запроса количества ускорителей. Это позволяет поддерживать гетерогенные среды, где количество ядер ускорителей на хост различается.

Аргументы
task_type (Необязательно) Тип задачи TensorFlow машины, которую нужно запросить.
task_id (Необязательно) Индекс задачи TensorFlow машины, которую нужно запросить.
config_proto (Необязательно) Конфигурация для запуска нового сеанса, чтобы запросить количество ядер ускорителей.
Возвращает
Отображение типов ускорителей на количество ядер.

© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.4/api_docs/python/tf/distribute/cluster_resolver/TFConfigClusterResolver

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API