Spec-Zone.ru › AWS CLI v2

[ aws . databrew ]

create-recipe-job

Описание

Создает новую задачу преобразования входных данных, используя шаги, определенные в существующем рецепте Glue DataBrew.

См. также: Документацию API AWS

Синтаксис

  create-recipe-job
[--dataset-name <value>]
[--encryption-key-arn <value>]
[--encryption-mode <value>]
--name <value>
[--log-subscription <value>]
[--max-capacity <value>]
[--max-retries <value>]
[--outputs <value>]
[--data-catalog-outputs <value>]
[--database-outputs <value>]
[--project-name <value>]
[--recipe-reference <value>]
--role-arn <value>
[--tags <value>]
[--timeout <value>]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--dataset-name (строка)

Имя набора данных, который обрабатывает эта задача.

--encryption-key-arn (строка)

Amazon Resource Name (ARN) ключа шифрования, используемого для защиты задачи.

--encryption-mode (строка)

Режим шифрования для задачи, который может быть одним из следующих:

  • SSE-KMS — шифрование на стороне сервера с использованием ключей, управляемых KMS.
  • SSE-S3 — шифрование на стороне сервера с использованием ключей, управляемых Amazon S3.

Возможные значения:

  • SSE-KMS
  • SSE-S3

--name (строка)

Уникальное имя задачи. Допустимые символы — буквенно-цифровые (A-Z, a-z, 0-9), дефис (-), точка (.) и пробел.

--log-subscription (строка)

Включает или отключает ведение журнала Amazon CloudWatch для задачи. Если ведение журнала включено, CloudWatch записывает один поток журнала для каждого запуска задачи.

Возможные значения:

  • ENABLE
  • DISABLE

--max-capacity (целое число)

Максимальное количество узлов, которые может использовать DataBrew при обработке данных.

--max-retries (целое число)

Максимальное количество попыток повторного выполнения задачи после сбоя запуска.

--outputs (список)

Один или несколько артефактов, представляющих выходные данные выполнения задачи.

(структура)

Представляет параметры, определяющие, как и где DataBrew записывает выходные данные, сгенерированные задачами рецептов или профилей, в Amazon S3.

CompressionFormat -> (строка)

Алгоритм сжатия, используемый для сжатия выходного текста задачи.

Format -> (строка)

Формат данных выходных данных задачи.

PartitionColumns -> (список)

Имена одного или нескольких столбцов разбиения для выходных данных задачи.

(строка)

Location -> (структура)

Расположение в Amazon S3, куда задача записывает свои выходные данные.

Bucket -> (строка)

Имя ведра Amazon S3.

Key -> (строка)

Уникальное имя объекта в ведре.

BucketOwner -> (строка)

Идентификатор учетной записи Amazon Web Services владельца ведра.

Overwrite -> (булево)

Значение, которое, если истинно, означает, что все данные в указанном для вывода расположении перезаписываются новыми выходными данными.

FormatOptions -> (структура)

Представляет параметры, определяющие, как DataBrew форматирует выходные файлы задач.

Csv -> (структура)

Представляет набор параметров, определяющих структуру выходных данных задачи в формате CSV.

Delimiter -> (строка)

Один символ, который определяет разделитель, используемый для создания выходных данных задач в формате CSV.

MaxOutputFiles -> (целое число)

Максимальное количество файлов, которые должна сгенерировать задача и записать в папку вывода. Для вывода, разграниченного столбцом(ами), значение MaxOutputFiles — это максимальное количество файлов на разбиение.

Сокращенный синтаксис:

CompressionFormat=string,Format=string,PartitionColumns=string,string,Location={Bucket=string,Key=string,BucketOwner=string},Overwrite=boolean,FormatOptions={Csv={Delimiter=string}},MaxOutputFiles=integer ...

Синтаксис JSON:

[
  {
    "CompressionFormat": "GZIP"|"LZ4"|"SNAPPY"|"BZIP2"|"DEFLATE"|"LZO"|"BROTLI"|"ZSTD"|"ZLIB",
    "Format": "CSV"|"JSON"|"PARQUET"|"GLUEPARQUET"|"AVRO"|"ORC"|"XML"|"TABLEAUHYPER",
    "PartitionColumns": ["string", ...],
    "Location": {
      "Bucket": "string",
      "Key": "string",
      "BucketOwner": "string"
    },
    "Overwrite": true|false,
    "FormatOptions": {
      "Csv": {
        "Delimiter": "string"
      }
    },
    "MaxOutputFiles": integer
  }
  ...
]

--data-catalog-outputs (список)

Один или несколько артефактов, представляющих выходные данные Glue Data Catalog после выполнения задачи.

(структура)

Представляет параметры, определяющие, как и куда DataBrew записывает выходные данные, сгенерированные задачами рецептов, в Glue Data Catalog.

CatalogId -> (строка)

Уникальный идентификатор учетной записи Amazon Web Services, которая владеет Data Catalog, хранящим данные.

DatabaseName -> (строка)

Имя базы данных в Data Catalog.

TableName -> (строка)

Имя таблицы в Data Catalog.

S3Options -> (структура)

Представляет параметры, определяющие, как и куда DataBrew записывает выходные данные Amazon S3, сгенерированные задачами рецептов.

Location -> (структура)

Представляет расположение в Amazon S3 (имя ведра и ключ объекта), куда DataBrew может записать выходные данные задачи.

Bucket -> (строка)

Имя ведра Amazon S3.

Key -> (строка)

Уникальное имя объекта в ведре.

BucketOwner -> (строка)

Идентификатор учетной записи Amazon Web Services владельца ведра.

DatabaseOptions -> (структура)

Представляет параметры, определяющие, как и куда DataBrew записывает выходные данные базы данных, сгенерированные задачами рецептов.

TempDirectory -> (структура)

Представляет расположение в Amazon S3 (имя ведра и ключ объекта), куда DataBrew может хранить промежуточные результаты.

Bucket -> (строка)

Имя ведра Amazon S3.

Key -> (строка)

Уникальное имя объекта в ведре.

BucketOwner -> (строка)

Идентификатор учетной записи Amazon Web Services владельца ведра.

TableName -> (строка)

Префикс имени таблицы, которую DataBrew создаст в базе данных.

Overwrite -> (булево)

Значение, которое, если истинно, означает, что все данные в указанном для вывода расположении перезаписываются новыми выходными данными. Не поддерживается с DatabaseOptions.

Сокращенный синтаксис:

CatalogId=string,DatabaseName=string,TableName=string,S3Options={Location={Bucket=string,Key=string,BucketOwner=string}},DatabaseOptions={TempDirectory={Bucket=string,Key=string,BucketOwner=string},TableName=string},Overwrite=boolean ...

Синтаксис JSON:

[
  {
    "CatalogId": "string",
    "DatabaseName": "string",
    "TableName": "string",
    "S3Options": {
      "Location": {
        "Bucket": "string",
        "Key": "string",
        "BucketOwner": "string"
      }
    },
    "DatabaseOptions": {
      "TempDirectory": {
        "Bucket": "string",
        "Key": "string",
        "BucketOwner": "string"
      },
      "TableName": "string"
    },
    "Overwrite": true|false
  }
  ...
]

--database-outputs (список)

Представляет список объектов вывода базы данных JDBC, определяющих место назначения вывода для задачи DataBrew recipe job.

(структура)

Представляет объект вывода базы данных JDBC, определяющий место назначения вывода для задачи DataBrew recipe job.

GlueConnectionName -> (строка)

Подключение Glue, хранящее информацию о подключении к целевой базе данных.

DatabaseOptions -> (структура)

Представляет параметры, определяющие, как и куда DataBrew записывает выходные данные базы данных, сгенерированные задачами рецептов.

TempDirectory -> (структура)

Представляет расположение в Amazon S3 (имя ведра и ключ объекта), куда DataBrew может хранить промежуточные результаты.

Bucket -> (строка)

Имя ведра Amazon S3.

Key -> (строка)

Уникальное имя объекта в ведре.

BucketOwner -> (строка)

Идентификатор учетной записи Amazon Web Services владельца ведра.

TableName -> (строка)

Префикс имени таблицы, которую DataBrew создаст в базе данных.

DatabaseOutputMode -> (строка)

Режим вывода для записи в базу данных. В настоящее время поддерживается опция: NEW_TABLE.

Сокращенный синтаксис:

GlueConnectionName=string,DatabaseOptions={TempDirectory={Bucket=string,Key=string,BucketOwner=string},TableName=string},DatabaseOutputMode=string ...

Синтаксис JSON:

[
  {
    "GlueConnectionName": "string",
    "DatabaseOptions": {
      "TempDirectory": {
        "Bucket": "string",
        "Key": "string",
        "BucketOwner": "string"
      },
      "TableName": "string"
    },
    "DatabaseOutputMode": "NEW_TABLE"
  }
  ...
]

--project-name (строка)

Имя существующего проекта или сочетание рецепта и набора данных для ассоциации с рецептом.

--recipe-reference (структура)

Представляет имя и версию рецепта DataBrew.

Name -> (строка)

Имя рецепта.

RecipeVersion -> (строка)

Идентификатор версии рецепта.

Сокращенный синтаксис:

Name=string,RecipeVersion=string

Синтаксис JSON:

{
  "Name": "string",
  "RecipeVersion": "string"
}

--role-arn (строка)

Amazon Resource Name (ARN) роли Identity and Access Management (IAM), которая будет использована при запуске задачи DataBrew.

--tags (карта)

Метки метаданных, применяемые к этой задаче.

key -> (строка)

value -> (строка)

Сокращенный синтаксис:

KeyName1=string,KeyName2=string

Синтаксис JSON:

{"string": "string"
  ...}

--timeout (целое число)

Таймаут задачи в минутах. Задача, которая пытается выполняться дольше, чем этот таймаут, завершается со статусом TIMEOUT.

--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка соответствует формату, предоставленному --generate-cli-skeleton. Если на командной строке указаны другие аргументы, эти значения переопределяют значения из JSON. Невозможно передать произвольные двоичные значения с помощью значения JSON, так как строка будет взята буквально. Это не может быть указано вместе с --cli-input-yaml.

--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, выводит пример входного YAML, который можно использовать с --cli-input-yaml. Если указано output, выполняет валидацию входных данных команды и возвращает пример выходного JSON для этой команды. Сгенерированный JSON-скелет не стабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.

Общие параметры

--debug (boolean)

Включить отладку логгирования.

--endpoint-url (string)

Переопределить стандартный URL команды на заданный URL.

--no-verify-ssl (boolean)

По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого SSL-соединения AWS CLI будет проверять SSL-сертификаты. Этот параметр переопределяет стандартное поведение проверки SSL-сертификатов.

--no-paginate (boolean)

Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один запрос для первой страницы результатов.

--output (string)

Стиль форматирования вывода команды.

  • json
  • text
  • table
  • yaml
  • yaml-stream

--query (string)

Запрос JMESPath для фильтрации данных ответа.

--profile (string)

Использовать определенный профиль из файла учетных данных.

--region (string)

Используемый регион. Переопределяет настройки из конфигурации/среды.

--version (string)

Отобразить версию этого инструмента.

--color (string)

Включить/выключить вывод в цвете.

  • on
  • off
  • auto

--no-sign-request (boolean)

Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент указан.

--ca-bundle (string)

Файл с корневыми сертификатами для проверки SSL-сертификатов. Переопределяет настройки из конфигурации/среды.

--cli-read-timeout (int)

Максимальное время чтения сокета в секундах. Если значение равно 0, чтение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.

--cli-connect-timeout (int)

Максимальное время подключения сокета в секундах. Если значение равно 0, подключение сокета будет блокирующим и не будет иметь таймаута. Значение по умолчанию составляет 60 секунд.

--cli-binary-format (string)

Стиль форматирования, используемый для двоичных блоков. По умолчанию используется формат base64. Формат base64 ожидает, что двоичные блоки будут представлены в виде закодированной строки base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, соответствующего двоичному блоку fileb:// всегда будет обрабатываться как двоичный и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла необходимо правильно отформатировать для настроенного cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (boolean)

Отключить вывод с помощью кли-пейджера.

--cli-auto-prompt (boolean)

Автоматически запрашивать входные параметры CLI.

--no-cli-auto-prompt (boolean)

Отключить автоматическую запрос входных параметров CLI.

Вывод

Имя -> (string)

Имя созданной задачи.

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API