[ aws . entityresolution ]
создать-потоки-сопоставления
Описание
Создаёт объект MatchingWorkflow, хранящий конфигурацию задачи обработки данных, которую нужно запустить. Важно отметить, что не должно быть существующего MatchingWorkflow с таким же именем. Для изменения существующего потока используйте API UpdateMatchingWorkflow.
См. также: Документацию API AWS
create-matching-workflow использует значения типов документов. Типы документов следуют модели JSON-данных, где допустимые значения: строки, числа, булевы значения, null, массивы и объекты. Для входных данных команды, опций и вложенных параметров, помеченных типом document, необходимо предоставить JSON. Краткая запись не поддерживает типы документов.
Синтаксис
create-matching-workflow
--workflow-name <value>
[--description <value>]
--input-source-config <value>
--output-source-config <value>
--resolution-techniques <value>
[--incremental-run-config <value>]
--role-arn <value>
[--tags <value>]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--workflow-name (строка)
MatchingWorkflows с одинаковым именем.--description (строка)
--input-source-config (список)
Список объектов InputSource, у которых есть поля InputSourceARN и SchemaName .
(структура)
Объект, содержащий InputSourceARN, SchemaName и ApplyNormalization.
inputSourceARN -> (строка)
schemaName -> (строка)
applyNormalization -> (булево)
AttributeType PHONE_NUMBER, а данные во входной таблице имеют формат 1234567890, Entity Resolution нормализует это поле в выходе до (123)-456-7890.Краткая запись:
inputSourceARN=string,schemaName=string,applyNormalization=boolean ...
JSON-синтаксис:
[
{
"inputSourceARN": "string",
"schemaName": "string",
"applyNormalization": true|false
}
...
]
--output-source-config (список)
Список объектов OutputSource, каждый из которых содержит поля OutputS3Path, ApplyNormalization и Output .
(структура)
Список объектов OutputAttribute, у каждого из которых есть поля Name и Hashed. Каждый из этих объектов выбирает столбец для включения в выходную таблицу и то, следует ли хешировать значения столбца.
outputS3Path -> (строка)
KMSArn -> (строка)
output -> (список)
Список объектов OutputAttribute, каждый из которых имеет поля Name и Hashed. Каждый из этих объектов выбирает столбец для включения в выходную таблицу и то, следует ли хешировать значения столбца.
(структура)
Список объектов OutputAttribute, каждый из которых имеет поля Name и Hashed. Каждый из этих объектов выбирает столбец для включения в выходную таблицу и то, следует ли хешировать значения столбца.
name -> (строка)
InputField в отображении схемы.hashed -> (булево)
applyNormalization -> (булево)
AttributeType PHONE_NUMBER, а данные во входной таблице имеют формат 1234567890, Entity Resolution нормализует это поле в выходе до (123)-456-7890.Краткая запись:
outputS3Path=string,KMSArn=string,output=[{name=string,hashed=boolean},{name=string,hashed=boolean}],applyNormalization=boolean ...
JSON-синтаксис:
[
{
"outputS3Path": "string",
"KMSArn": "string",
"output": [
{
"name": "string",
"hashed": true|false
}
...
],
"applyNormalization": true|false
}
...
]
--resolution-techniques (структура)
Объект, определяющий resolutionType и ruleBasedProperties.
resolutionType -> (строка)
RULE_MATCHING, ML_MATCHING и PROVIDER.ruleBasedProperties -> (структура)
Объект, определяющий список правил сопоставления для выполнения и имеющий поле Rules, которое является списком объектов правил.
rules -> (список)
Список объектов Rule, у каждого из которых есть поля RuleName и MatchingKeys.
(структура)
Объект, содержащий RuleName и MatchingKeys.
ruleName -> (строка)
matchingKeys -> (список)
Список MatchingKeys. MatchingKeys должны быть определены в SchemaMapping. Две записи считаются совпадающими по этому правилу, если все MatchingKeys совпадают.
(строка)
attributeMatchingModel -> (строка)
Тип сравнения. Вы можете выбрать ONE_TO_ONE или MANY_TO_MANY в качестве attributeMatchingModel.
Если вы выберите MANY_TO_MANY, система может сопоставлять атрибуты по всем подтипам типа атрибута. Например, если значение поля Email профиля A и значение поля BusinessEmail профиля B совпадают, два профиля сопоставляются по типу атрибута Email.
Если вы выберите ONE_TO_ONE, система может сопоставлять атрибуты только в том случае, если подтипы точно совпадают. Например, для типа атрибута Email система будет рассматривать его как совпадение только в том случае, если значение поля Email профиля A совпадает со значением поля Email профиля B.
matchPurpose -> (строка)
Индикатор о том, нужно ли генерировать идентификаторы и индексировать данные или нет.
Если вы выберете IDENTIFIER_GENERATION, процесс генерирует идентификаторы и индексирует данные.
Если вы выберете INDEXING, процесс индексирует данные без генерации идентификаторов.
providerProperties -> (структура)
Свойства сервиса-провайдера.
providerServiceArn -> (строка)
providerConfiguration -> (документ)
intermediateSourceConfiguration -> (структура)
Местоположение Amazon S3, временно хранящее ваши данные во время обработки. Ваша информация не будет сохранена постоянно.
intermediateS3Path -> (строка)
s3://provider_bucket/DOC-EXAMPLE-BUCKETJSON-синтаксис:
{
"resolutionType": "RULE_MATCHING"|"ML_MATCHING"|"PROVIDER",
"ruleBasedProperties": {
"rules": [
{
"ruleName": "string",
"matchingKeys": ["string", ...]
}
...
],
"attributeMatchingModel": "ONE_TO_ONE"|"MANY_TO_MANY",
"matchPurpose": "IDENTIFIER_GENERATION"|"INDEXING"
},
"providerProperties": {
"providerServiceArn": "string",
"providerConfiguration": {...},
"intermediateSourceConfiguration": {
"intermediateS3Path": "string"
}
}
}
--incremental-run-config (структура)
Объект, определяющий тип инкрементного выполнения и имеющий только поле incrementalRunType.
incrementalRunType -> (строка)
IMMEDIATE.Краткая запись:
incrementalRunType=string
JSON-синтаксис:
{
"incrementalRunType": "IMMEDIATE"
}
--role-arn (строка)
--tags (отображение)
Теги, используемые для организации, отслеживания или управления доступом к этому ресурсу.
key -> (строка)
value -> (строка)
Краткая запись:
KeyName1=string,KeyName2=string
JSON-синтаксис:
{"string": "string"
...}
--cli-input-json | --cli-input-yaml (строка) Читает аргументы из предоставленной JSON-строки. JSON-строка следует формату, предоставленному --generate-cli-skeleton. Если другие аргументы предоставлены в командной строке, эти значения переопределяют значения, предоставленные JSON. Невозможно передавать произвольные двоичные значения с помощью значения, предоставленного JSON, так как строка будет взята буквально. Это может не быть указано вместе с --cli-input-yaml.
--generate-cli-skeleton (строка) Выводит JSON-скелет в стандартный вывод без отправки запроса к API. Если предоставлено значение без значения или значение input, выводит пример входного JSON, который может быть использован как аргумент для --cli-input-json. Аналогично, если предоставлено yaml-input, оно выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если предоставлено значение output, оно валидирует входные данные команды и возвращает пример выходного JSON для этой команды. Сгенерированный JSON-скелет не стабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном JSON-скелете.
Общие параметры
--debug (boolean)
Включить отладовую запись в журнал.
--endpoint-url (string)
Переопределить URL команды по умолчанию на предоставленный URL.
--no-verify-ssl (boolean)
По умолчанию AWS CLI использует SSL при общении с сервисами AWS. Для каждого подключения SSL AWS CLI проверяет сертификаты SSL. Этот параметр переопределяет поведение проверки SSL-сертификатов по умолчанию.
--no-paginate (boolean)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI сделает только один вызов для первой страницы результатов.
--output (string)
Стиль форматирования вывода команды.
- json
- text
- table
- yaml
- yaml-stream
--query (string)
Запрос JMESPath для фильтрации данных ответа.
--profile (string)
Использовать конкретный профиль из файла учетных данных.
--region (string)
Регион для использования. Переопределяет настройки конфигурации/среды.
--version (string)
Отобразить версию этого инструмента.
--color (string)
Включить/выключить вывод в цвете.
- on
- off
- auto
--no-sign-request (boolean)
Не подписывать запросы. Учетные данные не будут загружены, если этот аргумент указан.
--ca-bundle (string)
Пакет сертификатов CA для проверки SSL-сертификатов. Переопределяет настройки конфигурации/среды.
--cli-read-timeout (int)
Максимальное время чтения сокета в секундах. Если значение установлено в 0, чтение сокета будет блокирующим и без таймаута. Значение по умолчанию — 60 секунд.
--cli-connect-timeout (int)
Максимальное время подключения сокета в секундах. Если значение установлено в 0, подключение сокета будет блокирующим и без таймаута. Значение по умолчанию — 60 секунд.
--cli-binary-format (string)
Стиль форматирования, который будет использоваться для бинарных блоков. Формат по умолчанию — base64. Формат base64 ожидает, что бинарные блоки будут предоставлены как строка, закодированная в base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и бинарные значения должны быть переданы буквально. При предоставлении содержимого из файла, сопоставляющегося с бинарным блоком, fileb:// всегда будет рассматриваться как бинарный и использовать содержимое файла напрямую независимо от cli-binary-format настройки. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (boolean)
Отключить пейджер CLI для вывода.
--cli-auto-prompt (boolean)
Автоматически запросить параметры ввода CLI.
--no-cli-auto-prompt (boolean)
Отключить автоматический запрос параметров ввода CLI.
Вывод
workflowName -> (string)
workflowArn -> (string)
MatchingWorkflow .description -> (string)
inputSourceConfig -> (list)
Список объектов InputSource, которые имеют поля InputSourceARN и SchemaName .
(структура)
Объект, содержащий InputSourceARN, SchemaName и ApplyNormalization .
inputSourceARN -> (string)
schemaName -> (string)
applyNormalization -> (boolean)
AttributeType типа PHONE_NUMBER, и данные в входной таблице имеют формат 1234567890, Entity Resolution нормализует это поле в выводе до (123)-456-7890.outputSourceConfig -> (list)
Список объектов OutputSource, каждый из которых содержит поля OutputS3Path, ApplyNormalization и Output .
(структура)
Список объектов OutputAttribute, каждый из которых имеет поля Name и Hashed. Каждый из этих объектов выбирает столбец для включения в выходную таблицу и указывает, следует ли хэшировать значения столбца.
outputS3Path -> (string)
KMSArn -> (string)
output -> (list)
Список объектов OutputAttribute, каждый из которых имеет поля Name и Hashed. Каждый из этих объектов выбирает столбец для включения в выходную таблицу и указывает, следует ли хэшировать значения столбца.
(структура)
Список объектов OutputAttribute, каждый из которых имеет поля Name и Hashed. Каждый из этих объектов выбирает столбец для включения в выходную таблицу и указывает, следует ли хэшировать значения столбца.
name -> (string)
InputField в сопоставлении схем.hashed -> (boolean)
applyNormalization -> (boolean)
AttributeType типа PHONE_NUMBER, и данные в входной таблице имеют формат 1234567890, Entity Resolution нормализует это поле в выводе до (123)-456-7890.resolutionTechniques -> (структура)
Объект, определяющий resolutionType и ruleBasedProperties .
resolutionType -> (string)
RULE_MATCHING, ML_MATCHING и PROVIDER .ruleBasedProperties -> (структура)
Объект, определяющий список правил сопоставления для выполнения и имеющий поле Rules, которое является списком объектов правил.
rules -> (list)
Список объектов Rule, каждый из которых имеет поля RuleName и MatchingKeys .
(структура)
Объект, содержащий RuleName и MatchingKeys .
ruleName -> (string)
matchingKeys -> (list)
Список MatchingKeys. MatchingKeys должны быть определены в SchemaMapping. Два записей считаются совпадающими в соответствии с этим правилом, если все MatchingKeys совпадают.
(string)
attributeMatchingModel -> (string)
Тип сравнения. Вы можете выбрать ONE_TO_ONE или MANY_TO_MANY в качестве attributeMatchingModel .
Если вы выберете MANY_TO_MANY, система может сопоставлять атрибуты по подтипам типа атрибута. Например, если значение поля Email профиля A и значение поля BusinessEmail профиля B совпадают, два профиля сопоставлены по типу атрибута Email.
Если вы выберете ONE_TO_ONE, система может сопоставлять атрибуты только в том случае, если подтипы являются точным соответствием. Например, для типа атрибута Email система будет считать это соответствием только если значение поля Email профиля A совпадает со значением поля Email профиля B.
matchPurpose -> (string)
Показатель того, генерировать ли идентификаторы и индексировать ли данные.
Если вы выберете IDENTIFIER_GENERATION, процесс генерирует идентификаторы и индексирует данные.
Если вы выберете INDEXING, процесс индексирует данные без генерации идентификаторов.
providerProperties -> (структура)
Свойства службы-провайдера.
providerServiceArn -> (string)
providerConfiguration -> (документ)
intermediateSourceConfiguration -> (структура)
Расположение Amazon S3, которое временно хранит ваши данные во время обработки. Ваша информация не будет сохранена постоянно.
intermediateS3Path -> (string)
s3://provider_bucket/DOC-EXAMPLE-BUCKET
incrementalRunConfig -> (структура)
Объект, определяющий тип инкрементного выполнения и имеющий только поле incrementalRunType.
incrementalRunType -> (string)
IMMEDIATE .roleArn -> (string)
© Copyright 2025, Amazon Web Services. Created using Sphinx.