[ aws . personalize ]
create-data-deletion-job
Описание
Создаёт пакетную задачу, которая удаляет все ссылки на определённых пользователей из группы наборов данных Amazon Personalize по частям. Вы указываете пользователей для удаления в файле CSV с идентификаторами пользователей в ведре Amazon S3. После завершения задачи Amazon Personalize больше не использует данные пользователей для обучения и не учитывает пользователей при формировании сегментов пользователей. Дополнительную информацию о создании задачи удаления данных см. в разделе Удаление пользователей .
- Ваш входной файл должен быть файлом CSV с единственным столбцом USER_ID, в котором перечислены идентификаторы пользователей. Дополнительную информацию о подготовке файла CSV см. в разделе Подготовка файла удаления данных и загрузка его в Amazon S3 .
- Чтобы предоставить Amazon Personalize разрешение на доступ к вашему входному CSV-файлу с идентификаторами пользователей, вы должны указать роль службы IAM, имеющую разрешения на чтение из источника данных. Эта роль нуждается в
GetObjectиListBucketразрешениях для ведра и его содержимого. Эти разрешения аналогичны импорту данных. Сведения о предоставлении Amazon Personalize доступа к ресурсам Amazon S3 см. в разделе Предоставление Amazon Personalize доступа к ресурсам Amazon S3 .
После создания задачи может потребоваться до одного дня, чтобы удалить все ссылки на пользователей из наборов данных и моделей. Пока задача не завершена, Amazon Personalize продолжает использовать данные при обучении. И если вы используете рецепт сегментации пользователей, пользователи могут появляться в сегментах пользователей.
Задача удаления данных может иметь один из следующих статусов:
- ОЖИДАНИЕ > В_ПРОЦЕССЕ > ЗАВЕРШЕНО -или- НЕУДАЧА
Чтобы получить статус задачи удаления данных, вызовите операцию API DescribeDataDeletionJob и укажите Amazon Resource Name (ARN) задачи. Если статус — НЕУДАЧА, ответ включает ключ failureReason, описывающий причину неудачи задачи.
- ListDataDeletionJobs
- DescribeDataDeletionJob
См. также: AWS API Documentation
Синтаксис
create-data-deletion-job
--job-name <value>
--dataset-group-arn <value>
--data-source <value>
--role-arn <value>
[--tags <value>]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--job-name (строка)
--dataset-group-arn (строка)
--data-source (структура)
Ведро Amazon S3, содержащее список идентификаторов пользователей, которых нужно удалить.
dataLocation -> (строка)
Для задач импорта наборов данных путь к ведру Amazon S3, где хранятся данные, которые вы хотите загрузить в свой набор данных. Для задач удаления данных путь к ведру Amazon S3, хранящему список записей для удаления.
Например:
s3://bucket-name/folder-name/fileName.csvЕсли ваши CSV-файлы находятся в папке в вашем ведре Amazon S3 и вы хотите, чтобы ваша задача импорта или задача удаления данных учитывали несколько файлов, вы можете указать путь к папке. При работе с задачей удаления данных Amazon Personalize использует все файлы в папке и любые подпапки. Используйте следующий синтаксис с / после имени папки:
s3://bucket-name/folder-name/Сокращённый синтаксис:
dataLocation=string
Синтаксис JSON:
{
"dataLocation": "string"
}
--role-arn (строка)
--tags (список)
Список тегов для применения к задаче удаления данных.
(структура)
Необязательные метаданные, которые вы применяете к ресурсам, чтобы помочь в их категоризации и организации. Каждый тег состоит из ключа и необязательного значения, которые вы определяете. Дополнительную информацию см. в разделе Тегирование ресурсов Amazon Personalize .
tagKey -> (строка)
tagValue -> (строка)
Сокращённый синтаксис:
tagKey=string,tagValue=string ...
Синтаксис JSON:
[
{
"tagKey": "string",
"tagValue": "string"
}
...
]
--cli-input-json | --cli-input-yaml (строка) Считывает аргументы из предоставленной строки JSON. Строка JSON следует формату, предоставленному --generate-cli-skeleton. Если другие аргументы предоставляются в командной строке, эти значения переопределят значения, предоставленные JSON. Невозможно передавать произвольные двоичные значения с помощью предоставленного значения JSON, так как строка будет воспринята буквально. Это может не быть указано вместе с --cli-input-yaml.
--generate-cli-skeleton (строка) Выводит каркас JSON в стандартный вывод без отправки запроса API. Если предоставлено без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если предоставлено yaml-input, он выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если предоставлено значение output, он проверит входные данные команды и вернёт пример выходного JSON для этой команды. Сгенерированный каркас JSON не стабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном каркасе JSON.
Глобальные параметры
--debug (булево)
Включить отладочную запись журнала.
--endpoint-url (строка)
Переопределить значение URL по умолчанию для команды указанным URL.
--no-verify-ssl (булево)
По умолчанию AWS CLI использует SSL при общении с сервисами AWS. Для каждого соединения SSL AWS CLI будет проверять сертификаты SSL. Этот параметр переопределяет поведение проверки сертификатов SSL по умолчанию.
--no-paginate (булево)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.
--output (строка)
Стиль форматирования вывода команд.
- json
- text
- table
- yaml
- yaml-stream
--query (строка)
Запрос JMESPath для фильтрации данных ответа.
--profile (строка)
Использовать определённый профиль из файла учётных данных.
--region (строка)
Регион для использования. Переопределяет настройки конфигурации/среды.
--version (строка)
Отобразить версию данного инструмента.
--color (строка)
Включить/выключить цветной вывод.
- on
- off
- auto
--no-sign-request (булево)
Не подписывать запросы. Учётные данные не будут загружены, если этот аргумент предоставлен.
--ca-bundle (строка)
Файл сертификатов CA для проверки сертификатов SSL. Переопределяет настройки конфигурации/среды.
--cli-read-timeout (целое число)
Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокирующим и не будет иметь таймаут. Значение по умолчанию — 60 секунд.
--cli-connect-timeout (целое число)
Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет блокирующим и не будет иметь таймаут. Значение по умолчанию — 60 секунд.
--cli-binary-format (строка)
Стиль форматирования, используемый для двоичных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, а двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, которое соответствует двоичному блоку, fileb:// всегда будет обрабатываться как двоичный и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (булево)
Отключить пагинатор CLI для вывода.
--cli-auto-prompt (булево)
Автоматически запрашивать параметры ввода CLI.
--no-cli-auto-prompt (булево)
Отключить автоматическое запросы параметров ввода CLI.
Вывод
dataDeletionJobArn -> (строка)
© Copyright 2025, Amazon Web Services. Created using Sphinx.