get-workflow-run
Описание
Получает метаданные для заданного выполнения рабочего процесса. История выполнения задач доступна в течение 90 дней для вашего рабочего процесса и выполнения задачи.
См. также: Документация API AWS
Синтаксис
get-workflow-run
--name <value>
--run-id <value>
[--include-graph | --no-include-graph]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--name (строка)
--run-id (строка)
--include-graph | --no-include-graph (логическое значение)
--cli-input-json | --cli-input-yaml (строка) Считывает аргументы из предоставленной строки JSON. Строка JSON соответствует формату, указанному в --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределят значения, указанные в JSON. Невозможно передавать произвольные двоичные значения с помощью значения, предоставленного в JSON, так как строка будет интерпретирована буквально. Это не может быть указано вместе с --cli-input-yaml.
--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса API. Если предоставлено значение без значения или значение input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если предоставлено yaml-input, будет напечатан пример входного YAML, который можно использовать с --cli-input-yaml. Если предоставлено значение output, оно валидирует входные данные команды и возвращает пример выходного JSON для этой команды. Сгенерированный JSON-скелет не является стабильным между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.
Глобальные параметры
--debug (логическое значение)
Включить отладочную регистрацию.
--endpoint-url (строка)
Переопределить URL по умолчанию команды на заданный URL.
--no-verify-ssl (логическое значение)
По умолчанию AWS CLI использует SSL при общении с сервисами AWS. Для каждого SSL-соединения AWS CLI будет проверять SSL-сертификаты. Этот параметр переопределяет поведение проверки SSL-сертификатов по умолчанию.
--no-paginate (логическое значение)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI сделает только один вызов для первой страницы результатов.
--output (строка)
Стиль форматирования выходных данных команды.
- json
- text
- table
- yaml
- yaml-stream
--query (строка)
Запрос JMESPath для фильтрации данных ответа.
--profile (строка)
Использование определенного профиля из файла учетных данных.
--region (строка)
Регион для использования. Переопределяет настройки конфигурации/среды.
--version (строка)
Отображение версии этого инструмента.
--color (строка)
Включение/выключение цветного вывода.
- on
- off
- auto
--no-sign-request (логическое значение)
Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент предоставлен.
--ca-bundle (строка)
Файл сертификатов CA для проверки SSL-сертификатов. Переопределяет настройки конфигурации/среды.
--cli-read-timeout (целое число)
Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.
--cli-connect-timeout (целое число)
Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.
--cli-binary-format (строка)
Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны быть переданы буквально. При предоставлении содержимого файла, соответствующего двоичному блоку, fileb:// всегда будет обрабатываться как двоичный и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (логическое значение)
Отключить постраничный вывод CLI.
--cli-auto-prompt (логическое значение)
Автоматически запрашивать параметры CLI.
--no-cli-auto-prompt (логическое значение)
Отключить автоматическое запроса параметров CLI.
Вывод
Запуск -> (структура)
Запрашиваемые метаданные о запуске рабочего процесса.
Имя -> (строка)
WorkflowRunId -> (строка)
PreviousRunId -> (строка)
WorkflowRunProperties -> (массив)
Свойства запуска рабочего процесса, которые были установлены во время выполнения.
ключ -> (строка)
значение -> (строка)
StartedOn -> (временная метка)
CompletedOn -> (временная метка)
Статус -> (строка)
Сообщение об ошибке -> (строка)
foo».Статистика -> (структура)
Статистика запуска.
Общее количество действий -> (целое число)
Действия с истекшим временем ожидания -> (целое число)
Неудавшиеся действия -> (целое число)
Остановленные действия -> (целое число)
Успешные действия -> (целое число)
Действия в состоянии выполнения -> (целое число)
Действия с ошибками -> (целое число)
Ожидающие действия -> (целое число)
Граф -> (структура)
Граф, представляющий все компоненты Glue, относящиеся к рабочему процессу, как узлы, а направленные соединения между ними — как рёбра.
Узлы -> (список)
Список компонентов Glue, относящихся к рабочему процессу, представленный как узлы.
(структура)
Узел представляет собой компонент Glue (триггер, обходчик или задачу) на графике рабочего процесса.
Тип -> (строка)
Имя -> (строка)
UniqueId -> (строка)
TriggerDetails -> (структура)
Подробности триггера, если узел представляет триггер.
Триггер -> (структура)
Информация о триггере, представленном узлом-триггером.
Имя -> (строка)
Имя рабочего процесса -> (строка)
Id -> (строка)
Тип -> (строка)
Состояние -> (строка)
Описание -> (строка)
Расписание -> (строка)
cron выражение, используемое для задания расписания (см. Расписания по времени для задач и обходчиков. Например, чтобы запускать что-то каждый день в 12:15 по UTC, вы должны указать: cron(15 12 * * ? *) .Действия -> (список)
Действия, инициированные этим триггером.
(структура)
Определяет действие, которое должно быть инициировано триггером.
Имя задачи -> (строка)
Аргументы -> (массив)
Аргументы задачи, используемые при срабатывании этого триггера. Для этого запуска задачи они заменяют аргументы по умолчанию, заданные в определении задачи.
Вы можете указать здесь аргументы, которые использует ваша собственная скрипт выполнения задачи, а также аргументы, которые использует сам Glue.
Дополнительную информацию о том, как указывать и использовать свои собственные аргументы задачи, см. в разделе «Вызов API Glue на языке Python» в руководстве разработчика.
Дополнительную информацию об парах ключ-значение, которые использует Glue для настройки вашей задачи, см. в разделе «Специальные параметры, используемые Glue» в руководстве разработчика.
ключ -> (строка)
значение -> (строка)
Предельное время ожидания -> (целое число)
JobRun предельное время ожидания в минутах. Это максимальное время, которое запуск задачи может использовать ресурсы, прежде чем он будет завершен и переведён в состояние TIMEOUT. Это переопределяет значение предельного времени ожидания, заданное в родительской задаче.
Задачи должны иметь значения предельного времени ожидания менее 7 дней или 10080 минут. В противном случае задачи будут генерировать исключение.
Если значение не указано, предельное время ожидания по умолчанию составляет 2880 минут.
Любые существующие задачи Glue, у которых было задано значение предельного времени ожидания более 7 дней, будут изменены на 7 дней. Например, если вы указали предельное время ожидания 20 дней для задачи пакетной обработки, она будет остановлена на 7-й день.
Для задач потоковой обработки, если вы настроили окно обслуживания, оно будет перезапущено в течение окна обслуживания после 7 дней.
Настройка безопасности -> (строка)
SecurityConfiguration структуры, которая будет использоваться с этим действием.Свойство уведомления -> (структура)
Указывает конфигурационные свойства уведомления о запуске задачи.
Задержка уведомления после -> (целое число)
Имя обходчика -> (строка)
Условие -> (структура)
Условие этого триггера, которое определяет, когда он сработает.
Логический -> (строка)
Условия -> (список)
Список условий, определяющих, когда триггер сработает.
(структура)
Определяет условие, при котором срабатывает триггер.
Логический оператор -> (строка)
Имя задачи -> (строка)
Состояние -> (строка)
SUCCEEDED , STOPPED , FAILED и TIMEOUT. Единственные состояния обходчика, на которые может подписываться триггер, — SUCCEEDED , FAILED и CANCELLED.Имя обходчика -> (строка)
Состояние обхода -> (строка)
Условие группировки событий -> (структура)
Условие группировки, которое должно быть выполнено (указанное число событий получено или истекло время окна группировки), прежде чем триггер события EventBridge сработает.
Размер группы -> (целое число)
Окно группировки -> (целое число)
Подробности задачи -> (структура)
Подробности задачи, если узел представляет задачу.
Запуски задач -> (список)
Информация о запусках задач, представленных узлом задачи.
(структура)
Содержит информацию о выполнении задачи.
Id -> (строка)
Attempt -> (целое число)
PreviousRunId -> (строка)
JobRunId, указанный в действии StartJobRun.TriggerName -> (строка)
JobName -> (строка)
JobMode -> (строка)
Режим, описывающий способ создания задачи. Допустимые значения:
-
SCRIPT- Задача создана с помощью редактора сценариев Glue Studio. -
VISUAL- Задача создана с помощью визуального редактора Glue Studio. -
NOTEBOOK- Задача создана с помощью ноутбука интерактивных сессий.
Если поле JobMode отсутствует или равно null, по умолчанию используется значение SCRIPT.
JobRunQueuingEnabled -> (булево)
Указывает, включено ли очередирование выполнения задач для этого выполнения.
Значение true означает, что очередирование выполнения задач включено для этого выполнения. Если false или не указано, выполнение задачи не будет учитываться в очереди.
StartedOn -> (метка времени)
LastModifiedOn -> (метка времени)
CompletedOn -> (метка времени)
JobRunState -> (строка)
Arguments -> (карта)
Аргументы задачи, связанные с этим выполнением. Для этого выполнения они заменяют аргументы по умолчанию, установленные в определении задачи.
Вы можете указать здесь аргументы, используемые собственным скриптом выполнения задачи, а также аргументы, используемые самим Glue.
Аргументы задачи могут регистрироваться. Не передавайте открытые секреты в качестве аргументов. Получайте секреты из подключения Glue, Secrets Manager или другого механизма управления секретами, если вы хотите сохранить их в пределах задачи.
Дополнительную информацию о том, как указать и использовать собственные аргументы задачи, см. в разделе Вызов API Glue в Python в руководстве для разработчиков.
Дополнительную информацию об аргументах, которые можно указать в этом поле при настройке задач Spark, см. в разделе Специальные параметры, используемые Glue в руководстве для разработчиков.
Дополнительную информацию об аргументах, которые можно указать в этом поле при настройке задач Ray, см. в разделе Использование параметров задач в задачах Ray в руководстве для разработчиков.
key -> (строка)
value -> (строка)
ErrorMessage -> (строка)
PredecessorRuns -> (список)
Список предшественников для этого выполнения задачи.
(структура)
Выполнение задачи, используемое в предикате условного триггера, который инициировал это выполнение задачи.
JobName -> (строка)
RunId -> (строка)
AllocatedCapacity -> (целое число)
Это поле устарело. Используйте MaxCapacity вместо него.
Количество единиц обработки данных Glue (DPU), выделенных для этого выполнения задачи. Можно выделить от 2 до 100 DPU; значение по умолчанию — 10. DPU — это относительная мера вычислительной мощности, состоящая из 4 vCPU и 16 ГБ памяти. Дополнительную информацию см. на странице ценообразования Glue.
ExecutionTime -> (целое число)
Timeout -> (целое число)
Таймаут JobRun в минутах. Это максимальное время, в течение которого выполнение задачи может потреблять ресурсы, прежде чем оно будет завершено и перейдет в состояние TIMEOUT. Это значение переопределяет значение таймаута, установленное в родительской задаче.
Значения таймаута задач должны быть меньше 7 дней или 10080 минут. В противном случае задачи сгенерируют исключение.
Если значение не указано, таймаут по умолчанию равен 2880 минутам.
Любые существующие задачи Glue с таймаутом больше 7 дней будут установлены по умолчанию на 7 дней. Например, если для задачи пакетной обработки задан таймаут 20 дней, она будет остановлена на 7-й день.
Для задач потоковой обработки, если вы настроили окно обслуживания, оно будет перезапущено в течение окна обслуживания после 7 дней.
MaxCapacity -> (вещественное число)
Для задач Glue версии 1.0 или более ранних, использующих стандартный тип исполняющей системы, количество единиц обработки данных Glue (DPU), которые могут быть выделены при выполнении этой задачи. DPU — это относительная мера вычислительной мощности, состоящая из 4 vCPU и 16 ГБ памяти. Дополнительную информацию см. на странице ценообразования Glue.
Для задач Glue версии 2.0 и выше нельзя указать Maximum capacity. Вместо этого необходимо указать Worker type и Number of workers.
Не устанавливайте MaxCapacity, если используете WorkerType и NumberOfWorkers.
Выделяемое значение для MaxCapacity зависит от того, выполняете ли вы задачу интерпретатора Python, задачу ETL Apache Spark или задачу Apache Spark потоковой обработки ETL:
- При указании задачи интерпретатора Python (
JobCommand.Name=”pythonshell”) можно выделить 0,0625 или 1 DPU. По умолчанию используется 0,0625 DPU. - При указании задачи ETL Apache Spark (
JobCommand.Name=”glueetl”) или задачи Apache Spark потоковой обработки ETL (JobCommand.Name=”gluestreaming”) можно выделить от 2 до 100 DPU. По умолчанию используется 10 DPU. Для этого типа задач нельзя использовать дробное выделение DPU.
WorkerType -> (строка)
Тип предопределенного исполняющего элемента, который выделяется при запуске задачи. Принимает значения G.1X, G.2X, G.4X, G.8X или G.025X для задач Spark. Принимает значение Z.2X для задач Ray.
- Для типа исполняющего элемента
G.1Xкаждый исполняющий элемент соответствует 1 DPU (4 vCPU, 16 ГБ памяти) с диском объемом 94 ГБ и предоставляет 1 исполнитель на исполняющий элемент. Мы рекомендуем использовать этот тип исполняющего элемента для рабочих нагрузок, таких как преобразования данных, объединения и запросы, чтобы обеспечить масштабируемый и экономичный способ запуска большинства задач. - Для типа исполняющего элемента
G.2Xкаждый исполняющий элемент соответствует 2 DPU (8 vCPU, 32 ГБ памяти) с диском объемом 138 ГБ и предоставляет 1 исполнитель на исполняющий элемент. Мы рекомендуем использовать этот тип исполняющего элемента для рабочих нагрузок, таких как преобразования данных, объединения и запросы, чтобы обеспечить масштабируемый и экономичный способ запуска большинства задач. - Для типа исполняющего элемента
G.4Xкаждый исполняющий элемент соответствует 4 DPU (16 vCPU, 64 ГБ памяти) с диском объемом 256 ГБ и предоставляет 1 исполнитель на исполняющий элемент. Мы рекомендуем использовать этот тип исполняющего элемента для задач с рабочими нагрузками, включающими самые сложные преобразования, агрегации, объединения и запросы. Этот тип исполняющего элемента доступен только для задач ETL Apache Spark Glue версии 3.0 или более поздней в следующих регионах Amazon Web Services: США (Огайо), США (Северная Вирджиния), США (Орегон), Азия-Тихий океан (Сингапур), Азия-Тихий океан (Сидней), Азия-Тихий океан (Токио), Канада (Центр), Европа (Франкфурт), Европа (Ирландия) и Европа (Стокгольм). - Для типа исполняющего элемента
G.8Xкаждый исполняющий элемент соответствует 8 DPU (32 vCPU, 128 ГБ памяти) с диском объемом 512 ГБ и предоставляет 1 исполнитель на исполняющий элемент. Мы рекомендуем использовать этот тип исполняющего элемента для задач с рабочими нагрузками, включающими самые сложные преобразования, агрегации, объединения и запросы. Этот тип исполняющего элемента доступен только для задач ETL Apache Spark Glue версии 3.0 или более поздней в тех же регионах Amazon Web Services, что и для типа исполняющего элементаG.4X. - Для типа исполняющего элемента
G.025Xкаждый исполняющий элемент соответствует 0,25 DPU (2 vCPU, 4 ГБ памяти) с диском объемом 84 ГБ и предоставляет 1 исполнитель на исполняющий элемент. Мы рекомендуем использовать этот тип исполняющего элемента для задач потоковой обработки с небольшим объемом данных. Этот тип исполняющего элемента доступен только для задач потоковой обработки Glue версии 3.0 или более поздней. - Для типа исполняющего элемента
Z.2Xкаждый исполняющий элемент соответствует 2 M-DPU (8 vCPU, 64 ГБ памяти) с диском объемом 128 ГБ и предоставляет до 8 исполняющих элементов Ray на основе автоматического масштабирования.
NumberOfWorkers -> (целое число)
workerType, выделяемых при выполнении задачи.SecurityConfiguration -> (строка)
SecurityConfiguration, используемой с этим выполнением задачи.LogGroupName -> (строка)
/aws-glue/jobs/, в этом случае шифрование по умолчанию — NONE. Если вы добавите имя роли и имя SecurityConfiguration (иными словами, /aws-glue/jobs-yourRoleName-yourSecurityConfigurationName/), то будет использоваться эта конфигурация безопасности для шифрования группы журналов.NotificationProperty -> (структура)
Указывает конфигурационные свойства уведомления о выполнении задачи.
NotifyDelayAfter -> (целое число)
GlueVersion -> (строка)
В задачах Spark, GlueVersion определяет версии Apache Spark и Python, доступные Glue в задаче. Версия Python указывает версию, поддерживаемую для задач типа Spark.
Задачи Ray должны установить GlueVersion на 4.0 или более высокую. Однако версии Ray, Python и дополнительных библиотек, доступных в вашей задаче Ray, определяются параметром Runtime команды задачи.
Дополнительную информацию о доступных версиях Glue и соответствующих версиях Spark и Python см. в руководстве для разработчиков в разделе Glue version.
Задачи, созданные без указания версии Glue, по умолчанию используют Glue 0.9.
DPUSeconds -> (вещественное число)
FLEX или при включенном автоматическом масштабировании и представляет собой общее время работы каждого исполнителя за цикл выполнения задачи в секундах, умноженное на множитель DPU (1 для G.1X, 2 для G.2X или 0,25 для исполняющих элементов G.025X). Это значение может отличаться от executionEngineRuntime * MaxCapacity, как в случае с задачами автоматического масштабирования, поскольку количество работающих исполнителей в данный момент может быть меньше, чем MaxCapacity. Поэтому возможно, что значение DPUSeconds меньше executionEngineRuntime * MaxCapacity.ExecutionClass -> (строка)
Указывает, выполняется ли задача со стандартным или гибким классом выполнения. Стандартный класс выполнения подходит для задач с критически важным временем, требующим быстрого запуска задачи и выделенных ресурсов.
Гибкий класс выполнения подходит для задач, не зависящих от времени, у которых время запуска и завершения могут варьироваться.
Только задачи с Glue версии 3.0 и выше и типом команды glueetl смогут установить ExecutionClass в FLEX. Гибкий класс выполнения доступен для задач Spark.
MaintenanceWindow -> (строка)
Это поле указывает день недели и час для окна технического обслуживания для потоковых задач. Glue периодически выполняет задачи технического обслуживания. Во время этих окон технического обслуживания Glue потребуется перезапустить ваши потоковые задачи.
Glue перезапустит задачу в течение 3 часов после указанного окна технического обслуживания. Например, если вы настроили окно технического обслуживания на понедельник в 10:00 по Гринвичу, ваши задачи будут перезапущены между 10:00 по Гринвичу и 13:00 по Гринвичу.
ProfileName -> (строка)
StateDetail -> (строка)
Это поле содержит подробности, относящиеся к состоянию выполнения задачи. Поле может быть нулевым.
Например, когда выполнение задачи находится в состоянии ОЖИДАНИЯ в результате очереди выполнения задачи, поле содержит причину, по которой выполнение задачи находится в этом состоянии.
CrawlerDetails -> (структура)
Подробности о ползунке, когда узел представляет собой ползунок.
Crawls -> (список)
Список ползунков, представленных узлом ползунка.
(структура)
Подробности ползунка в потоке.
State -> (строка)
StartedOn -> (отметка времени)
CompletedOn -> (отметка времени)
ErrorMessage -> (строка)
LogGroup -> (строка)
LogStream -> (строка)
Edges -> (список)
Список всех направленных соединений между узлами, принадлежащими потоку.
(структура)
Ребро представляет собой направленное соединение между двумя компонентами Glue, которые являются частью потока, к которому принадлежит ребро.
SourceId -> (строка)
DestinationId -> (строка)
StartingEventBatchCondition -> (структура)
Условие пакетной обработки, которое запустило выполнение потока.
BatchSize -> (целое число)
BatchWindow -> (целое число)
© Copyright 2025, Amazon Web Services. Created using Sphinx.