tf.train.Coordinator
| Просмотреть исходный код на GitHub |
Координатор для потоков.
tf.train.Coordinator(
clean_stop_exception_types=None
)
Этот класс реализует простой механизм координации завершения набора потоков.
Использование:
# Create a coordinator. coord = Coordinator() # Start a number of threads, passing the coordinator to each of them. ...start thread 1...(coord, ...) ...start thread N...(coord, ...) # Wait for all the threads to terminate. coord.join(threads)
Любой из потоков может вызвать coord.request_stop() , чтобы запросить остановку всех потоков. Для сотрудничества с запросами каждый поток должен регулярно проверять coord.should_stop() . coord.should_stop() возвращает True , как только coord.request_stop() был вызван.
Типичный поток, работающий с координатором, выполняет что-то вроде:
while not coord.should_stop(): ...do some work...
Обработка исключений:
Поток может сообщить об исключении координатору в рамках вызова request_stop() . Исключение будет повторно поднято при вызове coord.join() .
Код потока:
try:
while not coord.should_stop():
...do some work...
except Exception as e:
coord.request_stop(e)
Код основной программы:
try: ... coord = Coordinator() # Start a number of threads, passing the coordinator to each of them. ...start thread 1...(coord, ...) ...start thread N...(coord, ...) # Wait for all the threads to terminate. coord.join(threads) except Exception as e: ...exception that was passed to coord.request_stop()
Для упрощения реализации потоков координатор предоставляет обработчик контекста stop_on_exception() , который автоматически запрашивает остановку, если возникает исключение. Используя обработчик контекста, код потока выше можно записать так:
with coord.stop_on_exception():
while not coord.should_stop():
...do some work...
Период ожидания для остановки:
После того, как поток вызвал coord.request_stop() , у других потоков есть фиксированное время для остановки, это называется «период ожидания остановки», по умолчанию он равен 2 минутам. Если какой-либо из потоков по-прежнему активен после истечения периода ожидания, coord.join() вызывает RuntimeError, сообщая о «отстающих» потоках.
try: ... coord = Coordinator() # Start a number of threads, passing the coordinator to each of them. ...start thread 1...(coord, ...) ...start thread N...(coord, ...) # Wait for all the threads to terminate, give them 10s grace period coord.join(threads, stop_grace_period_secs=10) except RuntimeError: ...one of the threads took more than 10s to stop after request_stop() ...was called. except Exception: ...exception that was passed to coord.request_stop()
| Аргументы | |
|---|---|
clean_stop_exception_types | Необязательная кортеж типов исключений, которые должны привести к чистой остановке координатора. Если исключение одного из этих типов будет сообщено request_stop(ex) , координатор будет вести себя так, как если бы был вызван request_stop(None) . По умолчанию (tf.errors.OutOfRangeError,) , который используется очередями ввода для сигнализации о конце ввода. При подаче данных обучения из Python-итератора часто добавляется StopIteration в этот список. |
| Атрибуты | |
|---|---|
joined | |
Методы
clear_stop
clear_stop()
Очищает флаг остановки.
После этого вызовы should_stop() вернут False.
join
join(
threads=None, stop_grace_period_secs=120, ignore_live_threads=False
)
Ожидание завершения потоков.
Этот вызов блокируется до тех пор, пока набор потоков не завершит свою работу. Набор потоков является объединением потоков, переданных в аргументе threads , и списка потоков, зарегистрированных в координаторе вызовом Coordinator.register_thread().
После остановки потоков, если исключение exc_info было передано в request_stop, это исключение будет повторно поднято.
Обработка периода ожидания: когда request_stop() вызывается, потокам предоставляется «stop_grace_period_secs» секунд для завершения. Если какой-либо из них по-прежнему активен после истечения этого периода, возникает RuntimeError . Обратите внимание, что если исключение exc_info было передано в request_stop() , оно будет поднято вместо этого RuntimeError.
| Аргументы | |
|---|---|
threads | Список threading.Threads . Запущенные потоки, которые необходимо включить в соединение, помимо зарегистрированных потоков. |
stop_grace_period_secs | Количество секунд, предоставляемых потокам для остановки после вызова request_stop() . |
ignore_live_threads | Если False, выводит ошибку, если какой-либо из потоков по-прежнему активен после stop_grace_period_secs . |
| Возможные исключения | |
|---|---|
RuntimeError | Если какой-либо поток по-прежнему активен после вызова request_stop() и истечения периода ожидания. |
raise_requested_exception
raise_requested_exception()
Если исключение было передано в request_stop, оно будет поднято.
register_thread
register_thread(
thread
)
Регистрация потока для соединения.
| Аргументы | |
|---|---|
thread | Поток Python для соединения. |
request_stop
request_stop(
ex=None
)
Запрос остановки потоков.
После этого вызовы should_stop() вернут True.
Примечание: Если исключение передается, оно должно быть в контексте обработки исключения (т.е. try: ... except Exception as ex: ...) и не должно быть новым.
| Аргументы | |
|---|---|
ex | Необязательное исключение, или кортеж Python исключений, как возвращается sys.exc_info(). Если это первый вызов request_stop(), соответствующее исключение будет записано и повторно поднято из join(). |
should_stop
should_stop()
Проверка на запрос остановки.
| Возвращаемое значение | |
|---|---|
| True, если запрос остановки был сделан. |
stop_on_exception
@contextlib.contextmanager stop_on_exception()
Блок контекста для запроса остановки при возникновении исключения.
Код, использующий координатор, должен перехватывать исключения и передавать их методу request_stop() для остановки других потоков, управляемых координатором.
Этот обработчик контекста упрощает обработку исключений. Используйте его следующим образом:
with coord.stop_on_exception(): # Any exception raised in the body of the with # clause is reported to the coordinator before terminating # the execution of the body. ...body...
Это полностью эквивалентно немного более длинному коду:
try: ...body... except: coord.request_stop(sys.exc_info())
| Выходные данные | |
|---|---|
| ничего. |
wait_for_stop
wait_for_stop(
timeout=None
)
Ожидание сигнала остановки от координатора.
| Аргументы | |
|---|---|
timeout | Вещественное число. Ожидать до этого числа секунд, пока timeout не станет True. |
| Возвращаемое значение | |
|---|---|
| True, если координатор запросил остановку, False, если таймаут истек. |
© 2020 The TensorFlow Authors. All rights reserved.
Licensed under the Creative Commons Attribution License 3.0.
Code samples licensed under the Apache 2.0 License.
https://www.tensorflow.org/versions/r2.4/api_docs/python/tf/train/Coordinator