get-document-text-detection
Описание
Получает результаты асинхронной операции Amazon Textract, которая распознаёт текст в документе. Amazon Textract может распознавать строки текста и слова, составляющие строку текста.
Вы начинаете асинхронное распознавание текста, вызвав StartDocumentTextDetection, которая возвращает идентификатор задачи (JobId). Когда операция распознавания текста завершается, Amazon Textract публикует состояние завершения в тему Amazon Simple Notification Service (Amazon SNS), зарегистрированную в первоначальном вызове к StartDocumentTextDetection. Чтобы получить результаты операции распознавания текста, сначала проверьте, что значение состояния, опубликованное в теме Amazon SNS, равно SUCCEEDED. В таком случае, вызовите GetDocumentTextDetection и передайте идентификатор задачи (JobId) из первоначального вызова к StartDocumentTextDetection.
GetDocumentTextDetection возвращает массив объектов Block.Каждая страница документа имеет связанный Block типа PAGE. Каждый PAGE Block объект является родительским элементом для объектов LINE Block, представляющих строки распознанного текста на странице. Объект LINE Block является родительским элементом для каждого слова, составляющего строку. Слова представлены объектами Block типа WORD.
Используйте параметр MaxResults, чтобы ограничить количество возвращаемых блоков. Если результатов больше, чем указано в MaxResults, значение NextToken в ответе операции содержит маркер постраничной навигации для получения следующего набора результатов. Чтобы получить следующую страницу результатов, вызовите GetDocumentTextDetection и заполните параметр запроса NextToken значением маркера, возвращённым из предыдущего вызова GetDocumentTextDetection.
Для получения дополнительной информации см. Раздел Распознавание текста в документе.
См. также: Документация API AWS
Синтаксис
get-document-text-detection
--job-id <value>
[--max-results <value>]
[--next-token <value>]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]
Параметры
--job-id (строка)
JobId возвращается из StartDocumentTextDetection. Значение JobIdдействительно только в течение 7 дней.--max-results (целое число)
--next-token (строка)
--cli-input-json | --cli-input-yaml (строка) Считывает аргументы из предоставленной строки JSON. Строка JSON соответствует формату, предоставленному --generate-cli-skeleton. Если другие аргументы указаны в командной строке, эти значения переопределят значения, предоставленные в формате JSON. Невозможно передавать произвольные двоичные данные с помощью значения, предоставленного в формате JSON, так как строка будет интерпретироваться буквально. Это не может быть указано вместе с --cli-input-yaml.
--generate-cli-skeleton (строка) Выводит каркас JSON в стандартный вывод без отправки запроса к API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, он выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если указано значение output, он валидирует входные данные команд и возвращает пример выходного JSON для этой команды. Сгенерированный каркас JSON не стабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном каркасе JSON.
Глобальные параметры
--debug (булево)
Включить отладку логирования.
--endpoint-url (строка)
Переопределить URL по умолчанию команды заданным URL.
--no-verify-ssl (булево)
По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого соединения SSL AWS CLI проверяет сертификаты SSL. Этот параметр переопределяет поведение проверки сертификатов SSL по умолчанию.
--no-paginate (булево)
Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.
--output (строка)
Стиль форматирования вывода команд.
- json
- текст
- таблица
- yaml
- yaml-поток
--query (строка)
Запрос JMESPath для фильтрации данных ответа.
--profile (строка)
Использовать определённый профиль из файла с данными аутентификации.
--region (строка)
Регион для использования. Переопределяет настройки конфигурации/окружения.
--version (строка)
Отобразить версию этого инструмента.
--color (строка)
Включить/отключить цветной вывод.
- включено
- выключено
- авто
--no-sign-request (булево)
Не подписывать запросы. Кредиты не будут загружены, если этот аргумент указан.
--ca-bundle (строка)
Файл с пакетом сертификатов CA для проверки сертификатов SSL. Переопределяет настройки конфигурации/окружения.
--cli-read-timeout (целое число)
Максимальное время чтения сокета в секундах. Если значение равно 0, чтение сокета будет выполняться без блокировки и таймаута. Значение по умолчанию — 60 секунд.
--cli-connect-timeout (целое число)
Максимальное время подключения сокета в секундах. Если значение равно 0, подключение сокета будет выполняться без блокировки и таймаута. Значение по умолчанию — 60 секунд.
--cli-binary-format (строка)
Стиль форматирования, используемый для двоичных данных. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные данные будут предоставлены как строка в кодировке base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, отображающего двоичные данные, fileb:// всегда будет интерпретироваться как двоичные данные и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.
- base64
- raw-in-base64-out
--no-cli-pager (булево)
Отключить страницу CLI для вывода.
--cli-auto-prompt (булево)
Автоматически запрашивать параметры ввода CLI.
--no-cli-auto-prompt (булево)
Отключить автоматическую запрос параметров ввода CLI.
Примеры
Примечание
Чтобы использовать следующие примеры, необходимо установить и настроить AWS CLI. Для получения дополнительной информации см. руководство по началу работы в Руководстве пользователя AWS CLI.
Если не указано иное, во всех примерах используются правила цитирования Unix. Эти примеры необходимо адаптировать к правилам цитирования вашей терминальной оболочки. См. Использование кавычек со строками в Руководстве пользователя AWS CLI.
Получение результатов асинхронного распознавания текста в документе с несколькими страницами
Следующий пример get-document-text-detection показывает, как получить результаты асинхронного распознавания текста в документе с несколькими страницами.
aws textract get-document-text-detection \
--job-id 57849a3dc627d4df74123dca269d69f7b89329c870c65bb16c9fd63409d200b9 \
--max-results 1000
Вывод
{
"Blocks": [
{
"Geometry": {
"BoundingBox": {
"Width": 1.0,
"Top": 0.0,
"Left": 0.0,
"Height": 1.0
},
"Polygon": [
{
"Y": 0.0,
"X": 0.0
},
{
"Y": 0.0,
"X": 1.0
},
{
"Y": 1.0,
"X": 1.0
},
{
"Y": 1.0,
"X": 0.0
}
]
},
"Relationships": [
{
"Type": "CHILD",
"Ids": [
"1b926a34-0357-407b-ac8f-ec473160c6a9",
"0c35dc17-3605-4c9d-af1a-d9451059df51",
"dea3db8a-52c2-41c0-b50c-81f66f4aa758"
]
}
],
"BlockType": "PAGE",
"Id": "84671a5e-8c99-43be-a9d1-6838965da33e",
"Page": 1
}
],
"NextToken": "GcqyoAJuZwujOT35EN4LCI3EUzMtiLq3nKyFFHvU5q1SaIdEBcSty+njNgoWwuMP/muqc96S4o5NzDqehhXvhkodMyVO5OJGyms5lsrCxibWJw==",
"DocumentMetadata": {
"Pages": 1
},
"JobStatus": "SUCCEEDED"
}
Для получения дополнительной информации см. Раздел Распознавание и анализ текста в документах с несколькими страницами в Руководстве разработчика Amazon Textract
Вывод
DocumentMetadata -> (структура)
Информация о документе, обработанном Amazon Textract. DocumentMetadata возвращается на каждой странице постраничных ответов от операции Amazon Textract.
Pages -> (целое число)
JobStatus -> (строка)
NextToken -> (строка)
Blocks -> (список)
Результаты операции распознавания текста.
(структура)
Block представляет элементы, распознанные в документе в группе пикселей, расположенных близко друг к другу. Информация, возвращаемая в объекте Block, зависит от типа операции. При распознавании текста в документах (например, DetectDocumentText) вы получаете информацию о распознанных словах и строках текста. При анализе текста (например, AnalyzeDocument) вы также можете получить информацию о распознанных полях, таблицах и элементах выбора в документе.
Массив объектов Block возвращается как синхронными, так и асинхронными операциями. В синхронных операциях, таких как DetectDocumentText, массив объектов Block представляет собой весь набор результатов. В асинхронных операциях, таких как GetDocumentAnalysis, массив возвращается в одном или нескольких ответах.
Для получения дополнительной информации см. Как работает Amazon Textract.
BlockType -> (строка)
Тип распознанного элемента текста. В операциях распознавания текста возвращаются следующие типы:
-
PAGE - Содержит список объектов LINE
Block, распознанных на странице документа. - WORD - Слово, распознанное на странице документа. Слово состоит из одного или более символов латинского алфавита, не разделенных пробелами.
- LINE - Строка табулированных, непрерывных слов, распознанных на странице документа.
В операциях анализа текста возвращаются следующие типы:
-
PAGE - Содержит список дочерних объектов
Block, распознанных на странице документа. -
KEY_VALUE_SET - Хранит объекты KEY и VALUE
Blockдля связанного текста, распознанного на странице документа. Используйте полеEntityType, чтобы определить, является ли объект KEY_VALUE_SET объектом KEYBlockили VALUEBlock. - WORD - Слово, распознанное на странице документа. Слово состоит из одного или более символов латинского алфавита, не разделенных пробелами.
- LINE - Строка табулированных, непрерывных слов, распознанных на странице документа.
- TABLE - Таблица, распознанная на странице документа. Таблица — это информация, основанная на сетке, с двумя или более строками или столбцами, с размахом ячейки по одной строке и одному столбцу.
- TABLE_TITLE - Заголовок таблицы. Заголовок обычно представляет собой строку текста над или под таблицей или встроен в первую строку таблицы.
- TABLE_FOOTER - Подвал, связанный с таблицей. Подвал обычно представляет собой строку или строки текста под таблицей или встроен в последнюю строку таблицы.
- CELL - Ячейка в распознанной таблице. Ячейка — родительский элемент блока, содержащего текст в ячейке.
-
MERGED_CELL - Ячейка в таблице, содержимое которой охватывает более одной строки или столбца. Массив
Relationshipsдля этой ячейки содержит данные из отдельных ячеек. -
SELECTION_ELEMENT - Элемент выбора, такой как кнопка выбора (радиокнопка) или флажок, распознанный на странице документа. Используйте значение
SelectionStatusдля определения состояния элемента выбора. - SIGNATURE - Местоположение и коэффициент достоверности распознанной подписи на странице документа. Может быть возвращён как часть пары «Ключ-Значение» или распознанной ячейки.
- QUERY - Вопрос, заданный во время вызова AnalyzeDocument. Содержит псевдоним и идентификатор, привязывающий его к ответу.
- QUERY_RESULT - Ответ на вопрос, заданный во время вызова AnalyzeDocument. Имеет псевдоним и идентификатор для удобства поиска в ответе. Также содержит местоположение и коэффициент достоверности.
Следующие типы BlockType возвращаются только для Amazon Textract Layout.
-
LAYOUT_TITLE- Основной заголовок документа. -
LAYOUT_HEADER- Текст, расположенный в верхнем отступе документа. -
LAYOUT_FOOTER- Текст, расположенный в нижнем отступе документа. -
LAYOUT_SECTION_HEADER- Заголовки разделов внутри документа. -
LAYOUT_PAGE_NUMBER- Номер страницы документа. -
LAYOUT_LIST- Любая информация, сгруппированная в виде списка. -
LAYOUT_FIGURE- Указывает на местоположение изображения в документе. -
LAYOUT_TABLE- Указывает на местоположение таблицы в документе. -
LAYOUT_KEY_VALUE- Указывает на местоположение значений пар «ключ-значение» в форме документа. -
LAYOUT_TEXT- Текст, обычно присутствующий как часть абзацев в документах.
Confidence -> (вещественное число)
Text -> (строка)
TextType -> (строка)
RowIndex -> (целое число)
RowIndex не возвращается DetectDocumentText и GetDocumentTextDetection.ColumnIndex -> (целое число)
ColumnIndex не возвращается DetectDocumentText и GetDocumentTextDetection.RowSpan -> (целое число)
RowSpan не возвращается DetectDocumentText и GetDocumentTextDetection.ColumnSpan -> (целое число)
ColumnSpan не возвращается DetectDocumentText и GetDocumentTextDetection.Geometry -> (структура)
Местоположение распознанного текста на изображении. Оно включает осью выровненную грубую рамку, которая окружает текст, и более тонкую полилинию для более точной пространственной информации.
BoundingBox -> (структура)
Осью выровненное грубое представление местоположения распознанного элемента на странице документа.
Width -> (вещественное число)
Height -> (вещественное число)
Left -> (вещественное число)
Top -> (вещественное число)
Polygon -> (список)
Внутри рамки, полилиния вокруг распознанного элемента.
(структура)
Координаты X и Y точки на странице документа. Значения X и Y, которые возвращаются, являются отношениями размера всей страницы документа. Например, если входной документ имеет размер 700x200, а операция возвращает X=0,5 и Y=0,25, то точка находится в пиксельной координате (350,50) на странице документа.
Массив объектов Point, Polygon, возвращается функцией DetectDocumentText. Polygon представляет собой полилинию вокруг распознанного текста. Дополнительную информацию см. в разделе Geometry в руководстве разработчика Amazon Textract.
X -> (вещественное число)
Polygon.Y -> (вещественное число)
Polygon.Id -> (строка)
Relationships -> (список)
Список объектов отношений, которые описывают, как блоки связаны друг с другом. Например, объект блока LINE содержит тип отношения CHILD с блоками WORD, которые составляют строку текста. Объектов Relationships в списке нет для отношений, которые не существуют, например, когда у текущего блока нет дочерних блоков.
(структура)
Информация о взаимосвязях между блоками. Объект Block содержит 0 или более объектов Relation в списке, Relationships. Для получения дополнительной информации см. Block.
Элемент Type предоставляет тип отношения для всех блоков в массиве IDs.
Type -> (строка)
Тип отношения между блоками в массиве IDs и текущим блоком. Следующий список описывает типы отношений, которые могут быть возвращены.
- VALUE - Список, содержащий идентификатор блока VALUE, связанного с ключом пары «ключ-значение».
- CHILD - Список идентификаторов, определяющих блоки, найденные внутри текущего блока. Например, блоки WORD имеют отношение CHILD к типу блока LINE.
- MERGED_CELL - Список идентификаторов, определяющих каждый из типов блоков MERGED_CELL в таблице.
- ANSWER - Список, содержащий идентификатор блока QUERY_RESULT, связанного с соответствующим блоком QUERY.
- TABLE - Список идентификаторов, определяющих связанные типы блоков TABLE.
- TABLE_TITLE - Список, содержащий идентификатор типа блока TABLE_TITLE в таблице.
- TABLE_FOOTER - Список идентификаторов, определяющих типы блоков TABLE_FOOTER в таблице.
Ids -> (список)
Массив идентификаторов связанных блоков. Тип отношения можно получить из элемента Type.
(строка)
EntityTypes -> (список)
Тип сущности.
Следующие типы сущностей могут быть возвращены анализом форм:
- KEY - Идентификатор поля в документе.
- VALUE - Текст поля.
Следующие типы сущностей могут быть возвращены анализом таблиц:
- COLUMN_HEADER - Идентифицирует ячейку, являющуюся заголовком столбца.
- TABLE_TITLE - Идентифицирует ячейку, являющуюся заголовком таблицы.
- TABLE_SECTION_TITLE - Идентифицирует ячейку, являющуюся заголовком раздела внутри таблицы. Заголовок раздела — это ячейка, которая обычно охватывает всю строку над разделом.
- TABLE_FOOTER - Идентифицирует ячейку, являющуюся подвалом таблицы.
- TABLE_SUMMARY - Идентифицирует ячейку сводки таблицы. Ячейка сводки может быть строкой таблицы или дополнительной, меньшей таблицей, содержащей сводную информацию для другой таблицы.
- STRUCTURED_TABLE - Идентифицирует таблицу с заголовками столбцов, где содержимое каждой строки соответствует заголовкам.
- SEMI_STRUCTURED_TABLE - Идентифицирует неструктурированную таблицу.
EntityTypes не возвращается DetectDocumentText и GetDocumentTextDetection.(строка)
SelectionStatus -> (строка)
Page -> (целое число)
Page возвращается синхронными и асинхронными операциями. Значения страниц, большие 1, возвращаются только для многостраничных документов в формате PDF или TIFF. Скан-изображение (JPEG/PNG), предоставленное асинхронной операции, даже если оно содержит несколько страниц документа, рассматривается как документ с одной страницей. Это означает, что для отсканированных изображений значение Page всегда равно 1.Запрос -> (структура)
Текст -> (строка)
Псевдоним -> (строка)
Страницы -> (список)
Параметр Страницы, который пользователь вводит для указания страниц, к которым должен быть применён запрос. Ниже приведены правила использования этого параметра.
- Если страница не указана, она по умолчанию устанавливается в значение
["1"]. - В строке параметра разрешены следующие символы:
0 1 2 3 4 5 6 7 8 9 - *. Пробелы не допускаются. - При использовании * для обозначения всех страниц, он должен быть единственным элементом в списке.
- Можно использовать интервалы страниц, такие как
[“1-3”, “1-1”, “4-*”]. Где*обозначает последнюю страницу документа. - Указанные страницы должны быть больше 0 и меньше или равны количеству страниц в документе.
(строка)
Предупреждения -> (список)
Список предупреждений, возникших во время операции обнаружения текста для документа.
(структура)
Предупреждение о проблеме, возникшей во время асинхронного анализа текста ( StartDocumentAnalysis ) или асинхронного обнаружения текста в документе ( StartDocumentTextDetection ).
Код ошибки -> (строка)
Страницы -> (список)
Список страниц, к которым относится предупреждение.
(целое число)
Сообщение состояния -> (строка)
DetectDocumentTextModelVersion -> (строка)
© Copyright 2025, Amazon Web Services. Created using Sphinx.