tf.compat.v1.train.replica_device_setter
Возвращает device function для использования при построении графа для реплик.
tf.compat.v1.train.replica_device_setter(
ps_tasks=0,
ps_device='/job:ps',
worker_device='/job:worker',
merge_devices=True,
cluster=None,
ps_ops=None,
ps_strategy=None
)
Функции устройств используются в with tf.device(device_function): операторе для автоматической привязки устройств к Operation объектам по мере их создания. Ограничения устройств добавляются из самого внутреннего контекста, двигаясь наружу. Поведение объединения добавляет ограничения к полям, которые ещё не установлены более внутренним контекстом. В настоящее время полями являются (job, task, cpu/gpu).
Если cluster равно None, и ps_tasks равно 0, возвращаемая функция является бесполезной. В противном случае, значение ps_tasks выводится из cluster.
По умолчанию только операции переменных размещаются на задачах ps, а стратегия размещения — циклическое чередование по всем задачам ps. Может использоваться настраиваемая ps_strategy для более интеллектуального размещения, например, tf.contrib.training.GreedyLoadBalancingStrategy.
Например,
# To build a cluster with two ps jobs on hosts ps0 and ps1, and 3 worker
# jobs on hosts worker0, worker1 and worker2.
cluster_spec = {
"ps": ["ps0:2222", "ps1:2222"],
"worker": ["worker0:2222", "worker1:2222", "worker2:2222"]}
with
tf.compat.v1.device(tf.compat.v1.train.replica_device_setter(cluster=cluster_spec)):
# Build your graph
v1 = tf.Variable(...) # assigned to /job:ps/task:0
v2 = tf.Variable(...) # assigned to /job:ps/task:1
v3 = tf.Variable(...) # assigned to /job:ps/task:0
# Run compute
| Аргументы | |
|---|---|
ps_tasks | Количество задач в задаче ps job. Игнорируется, если указан cluster . |
ps_device | Строка. Устройство задачи ps job. Если пусто, задача ps job не используется. По умолчанию ps. |
worker_device | Строка. Устройство задачи worker job. Если пусто, задача worker job не используется. |
merge_devices | Boolean. Если True, объединяет или только устанавливает устройство, если ограничение устройства полностью не установлено. Объединяет спецификацию устройства, а не перезаписывает её. |
cluster | ClusterDef протокол или ClusterSpec. |
ps_ops | Список строк, представляющих типы Operation операций, которые необходимо разместить на устройствах ps. Если None, по умолчанию STANDARD_PS_OPS. |
ps_strategy | Функция, вызываемая для каждой ps Operation (т. е. соответствующей ps_ops), которая принимает Operation и возвращает индекс задачи ps, который следует использовать. Если None, по умолчанию используется стратегия циклического чередования по всем устройствам ps. |
| Возвращает | |
|---|---|
Функция для передачи в tf.device(). |
| Возможные исключения | |
|---|---|
TypeError, если cluster не является словарем или ClusterDef протоколом, или если ps_strategy указан, но не является вызываемой функцией. |
© 2022 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 4.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.9/api_docs/python/tf/compat/v1/train/replica_device_setter