Spec-Zone.ru › AWS CLI v2

[ aws . personalize ]

create-dataset-import-job

Описание

Создаёт задание, которое импортирует обучающие данные из вашего источника данных (ведра Amazon S3) в набор данных Amazon Personalize. Чтобы разрешить Amazon Personalize импортировать обучающие данные, вы должны указать роль службы IAM, которой разрешено читать из источника данных, так как Amazon Personalize создаёт копию ваших данных и обрабатывает их внутри. Сведения о предоставлении доступа к вашему ведру Amazon S3 см. в разделе Предоставление Amazon Personalize доступа к ресурсам Amazon S3 .

Если вы уже создали рекомендатель или развернули версию пользовательского решения с кампанией, то как новые объёмные записи влияют на рекомендации зависит от предметной области или рецепта, которые вы используете. Дополнительную информацию см. в разделе Как новые данные влияют на рекомендации в режиме реального времени .

Предупреждение

По умолчанию задание импорта набора данных заменяет любые существующие данные в наборе данных, которые вы импортировали объёмно. Чтобы добавить новые записи без замены существующих данных, укажите INCREMENTAL для режима импорта в операции CreateDatasetImportJob.

Статус

Задание импорта набора данных может находиться в одном из следующих состояний:

  • CREATE PENDING > CREATE IN_PROGRESS > ACTIVE - или - CREATE FAILED

Чтобы получить статус задания импорта, вызовите DescribeDatasetImportJob , указав Amazon Resource Name (ARN) задания импорта набора данных. Импорт набора данных завершается, когда статус отображается как ACTIVE. Если статус отображается как CREATE FAILED, в ответе содержится ключ failureReason, описывающий причину неудачи задания.

Примечание

Импорт занимает время. Вы должны подождать, пока статус не отобразится как ACTIVE, прежде чем обучать модель, используя набор данных.

Связанные API

  • ListDatasetImportJobs
  • DescribeDatasetImportJob

См. также: AWS API Documentation

Резюме

  create-dataset-import-job
--job-name <value>
--dataset-arn <value>
--data-source <value>
--role-arn <value>
[--tags <value>]
[--import-mode <value>]
[--publish-attribution-metrics-to-s3 | --no-publish-attribution-metrics-to-s3]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--job-name (строка)

Имя задания импорта набора данных.

--dataset-arn (строка)

ARN набора данных, который получает импортированные данные.

--data-source (структура)

Ведро Amazon S3, содержащее обучающие данные для импорта.

dataLocation -> (строка)

Для заданий импорта наборов данных путь к ведру Amazon S3, в котором хранятся данные, которые вы хотите загрузить в свой набор данных. Для заданий удаления данных путь к ведру Amazon S3, хранящему список записей для удаления.

Например:

s3://bucket-name/folder-name/fileName.csv

Если ваши CSV-файлы находятся в папке в вашем ведре Amazon S3 и вы хотите, чтобы ваше задание импорта или задание удаления данных учитывали несколько файлов, вы можете указать путь к папке. При использовании задания удаления данных Amazon Personalize использует все файлы в папке и любых подпапках. Используйте следующий синтаксис с / после имени папки:

s3://bucket-name/folder-name/

Сокращённый синтаксис:

dataLocation=string

Синтаксис JSON:

{
  "dataLocation": "string"
}

--role-arn (строка)

ARN роли IAM, имеющей разрешения на чтение из источника данных Amazon S3.

--tags (список)

Список тегов для применения к заданию импорта набора данных.

(структура)

Дополнительные метаданные, которые вы применяете к ресурсам, чтобы помочь вам категоризировать и организовывать их. Каждый тег состоит из ключа и необязательного значения, оба из которых вы определяете. Дополнительную информацию см. в разделе Помечание ресурсов Amazon Personalize .

tagKey -> (строка)

Одна часть пары ключ-значение, составляющей тег. Ключ — это общая метка, которая служит категорией для более конкретных значений тегов.

tagValue -> (строка)

Необязательная часть пары ключ-значение, составляющей тег. Значение служит описателем в категории тегов (ключ).

Сокращённый синтаксис:

tagKey=string,tagValue=string ...

Синтаксис JSON:

[
  {
    "tagKey": "string",
    "tagValue": "string"
  }
  ...
]

--import-mode (строка)

Укажите, как добавить новые записи в существующий набор данных. По умолчанию режим импорта — FULL. Если вы ранее не импортировали объёмные записи в набор данных, вы можете указать только FULL.

  • Укажите FULL, чтобы перезаписать все существующие объёмные данные в вашем наборе данных. Данные, которые вы импортировали по отдельности, не заменяются.
  • Укажите INCREMENTAL, чтобы добавить новые записи к существующим данным в вашем наборе данных. Amazon Personalize заменяет любую запись с тем же идентификатором новой.

Возможные значения:

  • FULL
  • INCREMENTAL

--publish-attribution-metrics-to-s3 | --no-publish-attribution-metrics-to-s3 (логическое значение)

Если вы создали метрику атрибуции, укажите, нужно ли публиковать метрики для этого задания импорта в Amazon S3

--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной строки JSON. Строка JSON следует формату, предоставленному --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределят значения, предоставленные в JSON. Невозможно передавать произвольные двоичные значения с помощью предоставленного значения JSON, так как строка будет взята дословно. Это не может быть указано вместе с --cli-input-yaml.

--generate-cli-skeleton (строка) Выводит каркас JSON в стандартный вывод без отправки запроса API. Если предоставлено значение без значения или значение input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если предоставлено yaml-input, оно выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если предоставлено значение output, оно валидирует входные данные команды и возвращает пример выходного JSON для этой команды. Сгенерированный каркас JSON не является стабильным между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном каркасе JSON.

Глобальные параметры

--debug (логическое значение)

Включить отладочную запись журнала.

--endpoint-url (строка)

Переопределить URL по умолчанию команды заданным URL.

--no-verify-ssl (логическое значение)

По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого соединения SSL AWS CLI будет проверять сертификаты SSL. Этот параметр переопределяет стандартное поведение проверки сертификатов SSL.

--no-paginate (логическое значение)

Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI сделает только один вызов для первой страницы результатов.

--output (строка)

Стиль форматирования выходных данных команды.

  • json
  • text
  • таблица
  • yaml
  • yaml-поток

--query (строка)

Запрос JMESPath для фильтрации данных ответа.

--profile (строка)

Использовать определённый профиль из файла учетных данных.

--region (строка)

Регион для использования. Переопределяет настройки конфигурации/окружения.

--version (строка)

Отобразить версию этого инструмента.

--color (строка)

Включить/отключить цветной вывод.

  • включено
  • выключено
  • авто

--no-sign-request (логическое значение)

Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент предоставлен.

--ca-bundle (строка)

Пакет сертификата CA для использования при проверке сертификатов SSL. Переопределяет настройки конфигурации/окружения.

--cli-read-timeout (целое число)

Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокирующим и не будет времени ожидания. Значение по умолчанию — 60 секунд.

--cli-connect-timeout (целое число)

Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет блокирующим и не будет времени ожидания. Значение по умолчанию — 60 секунд.

--cli-binary-format (строка)

Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные блоки будут предоставлены в виде закодированной в base64 строки. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, а двоичные значения должны быть переданы буквально. При предоставлении содержимого из файла, которое отображается в двоичном блоке, fileb:// всегда будет обрабатываться как двоичный, и будут использоваться непосредственно содержимое файла независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (логическое значение)

Отключить пагинатор cli для вывода.

--cli-auto-prompt (логическое значение)

Автоматически запросить параметры ввода CLI.

--no-cli-auto-prompt (логическое значение)

Отключить автоматическое запрошенную ввод параметров CLI.

Вывод

datasetImportJobArn -> (строка)

ARN задания импорта набора данных.

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API