Spec-Zone.ru › AWS CLI v2

[ aws . textract ]

get-document-text-detection

Описание

Получает результаты асинхронной операции Amazon Textract, которая распознаёт текст в документе. Amazon Textract может распознавать строки текста и слова, составляющие строку текста.

Вы начинаете асинхронное распознавание текста, вызвав StartDocumentTextDetection, которая возвращает идентификатор задачи (JobId). Когда операция распознавания текста завершается, Amazon Textract публикует состояние завершения в тему Amazon Simple Notification Service (Amazon SNS), зарегистрированную в первоначальном вызове к StartDocumentTextDetection. Чтобы получить результаты операции распознавания текста, сначала проверьте, что значение состояния, опубликованное в теме Amazon SNS, равно SUCCEEDED. В таком случае, вызовите GetDocumentTextDetection и передайте идентификатор задачи (JobId) из первоначального вызова к StartDocumentTextDetection.

GetDocumentTextDetection возвращает массив объектов Block.

Каждая страница документа имеет связанный Block типа PAGE. Каждый PAGE Block объект является родительским элементом для объектов LINE Block, представляющих строки распознанного текста на странице. Объект LINE Block является родительским элементом для каждого слова, составляющего строку. Слова представлены объектами Block типа WORD.

Используйте параметр MaxResults, чтобы ограничить количество возвращаемых блоков. Если результатов больше, чем указано в MaxResults, значение NextToken в ответе операции содержит маркер постраничной навигации для получения следующего набора результатов. Чтобы получить следующую страницу результатов, вызовите GetDocumentTextDetection и заполните параметр запроса NextToken значением маркера, возвращённым из предыдущего вызова GetDocumentTextDetection.

Для получения дополнительной информации см. Раздел Распознавание текста в документе.

См. также: Документация API AWS

Синтаксис

  get-document-text-detection
--job-id <value>
[--max-results <value>]
[--next-token <value>]
[--cli-input-json | --cli-input-yaml]
[--generate-cli-skeleton <value>]
[--debug]
[--endpoint-url <value>]
[--no-verify-ssl]
[--no-paginate]
[--output <value>]
[--query <value>]
[--profile <value>]
[--region <value>]
[--version <value>]
[--color <value>]
[--no-sign-request]
[--ca-bundle <value>]
[--cli-read-timeout <value>]
[--cli-connect-timeout <value>]
[--cli-binary-format <value>]
[--no-cli-pager]
[--cli-auto-prompt]
[--no-cli-auto-prompt]

Параметры

--job-id (строка)

Уникальный идентификатор задачи распознавания текста. JobId возвращается из StartDocumentTextDetection. Значение JobIdдействительно только в течение 7 дней.

--max-results (целое число)

Максимальное количество результатов, возвращаемых за один запрос с постраничной навигацией. Максимальное значение, которое можно указать, равно 1000. Если вы укажете значение больше 1000, будет возвращено максимальное количество результатов — 1000. Значение по умолчанию — 1000.

--next-token (строка)

Если предыдущий ответ был неполным (потому что для получения необходимо больше блоков), Amazon Textract возвращает маркер постраничной навигации в ответе. Вы можете использовать этот маркер для получения следующего набора блоков.

--cli-input-json | --cli-input-yaml (строка) Считывает аргументы из предоставленной строки JSON. Строка JSON соответствует формату, предоставленному --generate-cli-skeleton. Если другие аргументы указаны в командной строке, эти значения переопределят значения, предоставленные в формате JSON. Невозможно передавать произвольные двоичные данные с помощью значения, предоставленного в формате JSON, так как строка будет интерпретироваться буквально. Это не может быть указано вместе с --cli-input-yaml.

--generate-cli-skeleton (строка) Выводит каркас JSON в стандартный вывод без отправки запроса к API. Если указано без значения или со значением input, выводит пример входного JSON, который можно использовать в качестве аргумента для --cli-input-json. Аналогично, если указано yaml-input, он выведет пример входного YAML, который можно использовать с --cli-input-yaml. Если указано значение output, он валидирует входные данные команд и возвращает пример выходного JSON для этой команды. Сгенерированный каркас JSON не стабилен между версиями AWS CLI, и нет гарантий обратной совместимости в сгенерированном каркасе JSON.

Глобальные параметры

--debug (булево)

Включить отладку логирования.

--endpoint-url (строка)

Переопределить URL по умолчанию команды заданным URL.

--no-verify-ssl (булево)

По умолчанию AWS CLI использует SSL при общении с AWS-сервисами. Для каждого соединения SSL AWS CLI проверяет сертификаты SSL. Этот параметр переопределяет поведение проверки сертификатов SSL по умолчанию.

--no-paginate (булево)

Отключить автоматическую постраничную навигацию. Если автоматическая постраничная навигация отключена, AWS CLI выполнит только один вызов для первой страницы результатов.

--output (строка)

Стиль форматирования вывода команд.

  • json
  • текст
  • таблица
  • yaml
  • yaml-поток

--query (строка)

Запрос JMESPath для фильтрации данных ответа.

--profile (строка)

Использовать определённый профиль из файла с данными аутентификации.

--region (строка)

Регион для использования. Переопределяет настройки конфигурации/окружения.

--version (строка)

Отобразить версию этого инструмента.

--color (строка)

Включить/отключить цветной вывод.

  • включено
  • выключено
  • авто

--no-sign-request (булево)

Не подписывать запросы. Кредиты не будут загружены, если этот аргумент указан.

--ca-bundle (строка)

Файл с пакетом сертификатов CA для проверки сертификатов SSL. Переопределяет настройки конфигурации/окружения.

--cli-read-timeout (целое число)

Максимальное время чтения сокета в секундах. Если значение равно 0, чтение сокета будет выполняться без блокировки и таймаута. Значение по умолчанию — 60 секунд.

--cli-connect-timeout (целое число)

Максимальное время подключения сокета в секундах. Если значение равно 0, подключение сокета будет выполняться без блокировки и таймаута. Значение по умолчанию — 60 секунд.

--cli-binary-format (строка)

Стиль форматирования, используемый для двоичных данных. Формат по умолчанию — base64. Формат base64 ожидает, что двоичные данные будут предоставлены как строка в кодировке base64. Формат raw-in-base64-out сохраняет совместимость с поведением AWS CLI V1, и двоичные значения должны передаваться буквально. При предоставлении содержимого из файла, отображающего двоичные данные, fileb:// всегда будет интерпретироваться как двоичные данные и будет использовать содержимое файла напрямую независимо от настройки cli-binary-format. При использовании file:// содержимое файла должно быть должным образом отформатировано для настроенного cli-binary-format.

  • base64
  • raw-in-base64-out

--no-cli-pager (булево)

Отключить страницу CLI для вывода.

--cli-auto-prompt (булево)

Автоматически запрашивать параметры ввода CLI.

--no-cli-auto-prompt (булево)

Отключить автоматическую запрос параметров ввода CLI.

Примеры

Примечание

Чтобы использовать следующие примеры, необходимо установить и настроить AWS CLI. Для получения дополнительной информации см. руководство по началу работы в Руководстве пользователя AWS CLI.

Если не указано иное, во всех примерах используются правила цитирования Unix. Эти примеры необходимо адаптировать к правилам цитирования вашей терминальной оболочки. См. Использование кавычек со строками в Руководстве пользователя AWS CLI.

Получение результатов асинхронного распознавания текста в документе с несколькими страницами

Следующий пример get-document-text-detection показывает, как получить результаты асинхронного распознавания текста в документе с несколькими страницами.

aws textract get-document-text-detection \
    --job-id 57849a3dc627d4df74123dca269d69f7b89329c870c65bb16c9fd63409d200b9 \
    --max-results 1000

Вывод

{
    "Blocks": [
        {
            "Geometry": {
                "BoundingBox": {
                    "Width": 1.0,
                    "Top": 0.0,
                    "Left": 0.0,
                    "Height": 1.0
                },
                "Polygon": [
                    {
                        "Y": 0.0,
                        "X": 0.0
                    },
                    {
                        "Y": 0.0,
                        "X": 1.0
                    },
                    {
                        "Y": 1.0,
                        "X": 1.0
                    },
                    {
                        "Y": 1.0,
                        "X": 0.0
                    }
                ]
            },
            "Relationships": [
                {
                    "Type": "CHILD",
                    "Ids": [
                        "1b926a34-0357-407b-ac8f-ec473160c6a9",
                        "0c35dc17-3605-4c9d-af1a-d9451059df51",
                        "dea3db8a-52c2-41c0-b50c-81f66f4aa758"
                    ]
                }
            ],
            "BlockType": "PAGE",
            "Id": "84671a5e-8c99-43be-a9d1-6838965da33e",
            "Page": 1
        }
    ],
    "NextToken": "GcqyoAJuZwujOT35EN4LCI3EUzMtiLq3nKyFFHvU5q1SaIdEBcSty+njNgoWwuMP/muqc96S4o5NzDqehhXvhkodMyVO5OJGyms5lsrCxibWJw==",
    "DocumentMetadata": {
        "Pages": 1
    },
    "JobStatus": "SUCCEEDED"
}

Для получения дополнительной информации см. Раздел Распознавание и анализ текста в документах с несколькими страницами в Руководстве разработчика Amazon Textract

Вывод

DocumentMetadata -> (структура)

Информация о документе, обработанном Amazon Textract. DocumentMetadata возвращается на каждой странице постраничных ответов от операции Amazon Textract.

Pages -> (целое число)

Количество страниц, распознанных в документе.

JobStatus -> (строка)

Текущее состояние задачи распознавания текста.

NextToken -> (строка)

Если ответ усечён, Amazon Textract возвращает этот маркер. Вы можете использовать этот маркер в последующем запросе для получения следующего набора результатов распознавания текста.

Blocks -> (список)

Результаты операции распознавания текста.

(структура)

Block представляет элементы, распознанные в документе в группе пикселей, расположенных близко друг к другу. Информация, возвращаемая в объекте Block, зависит от типа операции. При распознавании текста в документах (например, DetectDocumentText) вы получаете информацию о распознанных словах и строках текста. При анализе текста (например, AnalyzeDocument) вы также можете получить информацию о распознанных полях, таблицах и элементах выбора в документе.

Массив объектов Block возвращается как синхронными, так и асинхронными операциями. В синхронных операциях, таких как DetectDocumentText, массив объектов Block представляет собой весь набор результатов. В асинхронных операциях, таких как GetDocumentAnalysis, массив возвращается в одном или нескольких ответах.

Для получения дополнительной информации см. Как работает Amazon Textract.

BlockType -> (строка)

Тип распознанного элемента текста. В операциях распознавания текста возвращаются следующие типы:

  • PAGE - Содержит список объектов LINE Block, распознанных на странице документа.
  • WORD - Слово, распознанное на странице документа. Слово состоит из одного или более символов латинского алфавита, не разделенных пробелами.
  • LINE - Строка табулированных, непрерывных слов, распознанных на странице документа.

В операциях анализа текста возвращаются следующие типы:

  • PAGE - Содержит список дочерних объектов Block, распознанных на странице документа.
  • KEY_VALUE_SET - Хранит объекты KEY и VALUE Block для связанного текста, распознанного на странице документа. Используйте поле EntityType, чтобы определить, является ли объект KEY_VALUE_SET объектом KEY Block или VALUE Block.
  • WORD - Слово, распознанное на странице документа. Слово состоит из одного или более символов латинского алфавита, не разделенных пробелами.
  • LINE - Строка табулированных, непрерывных слов, распознанных на странице документа.
  • TABLE - Таблица, распознанная на странице документа. Таблица — это информация, основанная на сетке, с двумя или более строками или столбцами, с размахом ячейки по одной строке и одному столбцу.
  • TABLE_TITLE - Заголовок таблицы. Заголовок обычно представляет собой строку текста над или под таблицей или встроен в первую строку таблицы.
  • TABLE_FOOTER - Подвал, связанный с таблицей. Подвал обычно представляет собой строку или строки текста под таблицей или встроен в последнюю строку таблицы.
  • CELL - Ячейка в распознанной таблице. Ячейка — родительский элемент блока, содержащего текст в ячейке.
  • MERGED_CELL - Ячейка в таблице, содержимое которой охватывает более одной строки или столбца. Массив Relationships для этой ячейки содержит данные из отдельных ячеек.
  • SELECTION_ELEMENT - Элемент выбора, такой как кнопка выбора (радиокнопка) или флажок, распознанный на странице документа. Используйте значение SelectionStatus для определения состояния элемента выбора.
  • SIGNATURE - Местоположение и коэффициент достоверности распознанной подписи на странице документа. Может быть возвращён как часть пары «Ключ-Значение» или распознанной ячейки.
  • QUERY - Вопрос, заданный во время вызова AnalyzeDocument. Содержит псевдоним и идентификатор, привязывающий его к ответу.
  • QUERY_RESULT - Ответ на вопрос, заданный во время вызова AnalyzeDocument. Имеет псевдоним и идентификатор для удобства поиска в ответе. Также содержит местоположение и коэффициент достоверности.

Следующие типы BlockType возвращаются только для Amazon Textract Layout.

  • LAYOUT_TITLE - Основной заголовок документа.
  • LAYOUT_HEADER - Текст, расположенный в верхнем отступе документа.
  • LAYOUT_FOOTER - Текст, расположенный в нижнем отступе документа.
  • LAYOUT_SECTION_HEADER - Заголовки разделов внутри документа.
  • LAYOUT_PAGE_NUMBER - Номер страницы документа.
  • LAYOUT_LIST - Любая информация, сгруппированная в виде списка.
  • LAYOUT_FIGURE - Указывает на местоположение изображения в документе.
  • LAYOUT_TABLE - Указывает на местоположение таблицы в документе.
  • LAYOUT_KEY_VALUE - Указывает на местоположение значений пар «ключ-значение» в форме документа.
  • LAYOUT_TEXT - Текст, обычно присутствующий как часть абзацев в документах.

Confidence -> (вещественное число)

Коэффициент уверенности Amazon Textract в точности распознанного текста и точности геометрических точек вокруг распознанного текста.

Text -> (строка)

Слово или строка текста, распознанные Amazon Textract.

TextType -> (строка)

Тип текста, распознанного Amazon Textract. Может проверять рукописный и печатный текст.

RowIndex -> (целое число)

Строка, в которой расположена ячейка таблицы. Номер первой строки — 1. RowIndex не возвращается DetectDocumentText и GetDocumentTextDetection.

ColumnIndex -> (целое число)

Столбец, в котором расположена ячейка таблицы. Номер первого столбца — 1. ColumnIndex не возвращается DetectDocumentText и GetDocumentTextDetection.

RowSpan -> (целое число)

Количество строк, занимаемых ячейкой таблицы. RowSpan не возвращается DetectDocumentText и GetDocumentTextDetection.

ColumnSpan -> (целое число)

Количество столбцов, занимаемых ячейкой таблицы. ColumnSpan не возвращается DetectDocumentText и GetDocumentTextDetection.

Geometry -> (структура)

Местоположение распознанного текста на изображении. Оно включает осью выровненную грубую рамку, которая окружает текст, и более тонкую полилинию для более точной пространственной информации.

BoundingBox -> (структура)

Осью выровненное грубое представление местоположения распознанного элемента на странице документа.

Width -> (вещественное число)

Ширина рамки в долях ширины страницы документа.

Height -> (вещественное число)

Высота рамки в долях высоты страницы документа.

Left -> (вещественное число)

Левая координата рамки в долях ширины страницы документа.

Top -> (вещественное число)

Верхняя координата рамки в долях высоты страницы документа.

Polygon -> (список)

Внутри рамки, полилиния вокруг распознанного элемента.

(структура)

Координаты X и Y точки на странице документа. Значения X и Y, которые возвращаются, являются отношениями размера всей страницы документа. Например, если входной документ имеет размер 700x200, а операция возвращает X=0,5 и Y=0,25, то точка находится в пиксельной координате (350,50) на странице документа.

Массив объектов Point, Polygon, возвращается функцией DetectDocumentText. Polygon представляет собой полилинию вокруг распознанного текста. Дополнительную информацию см. в разделе Geometry в руководстве разработчика Amazon Textract.

X -> (вещественное число)

Значение координаты X для точки на Polygon.

Y -> (вещественное число)

Значение координаты Y для точки на Polygon.

Id -> (строка)

Идентификатор распознанного текста. Идентификатор уникален только для одной операции.

Relationships -> (список)

Список объектов отношений, которые описывают, как блоки связаны друг с другом. Например, объект блока LINE содержит тип отношения CHILD с блоками WORD, которые составляют строку текста. Объектов Relationships в списке нет для отношений, которые не существуют, например, когда у текущего блока нет дочерних блоков.

(структура)

Информация о взаимосвязях между блоками. Объект Block содержит 0 или более объектов Relation в списке, Relationships. Для получения дополнительной информации см. Block.

Элемент Type предоставляет тип отношения для всех блоков в массиве IDs.

Type -> (строка)

Тип отношения между блоками в массиве IDs и текущим блоком. Следующий список описывает типы отношений, которые могут быть возвращены.

  • VALUE - Список, содержащий идентификатор блока VALUE, связанного с ключом пары «ключ-значение».
  • CHILD - Список идентификаторов, определяющих блоки, найденные внутри текущего блока. Например, блоки WORD имеют отношение CHILD к типу блока LINE.
  • MERGED_CELL - Список идентификаторов, определяющих каждый из типов блоков MERGED_CELL в таблице.
  • ANSWER - Список, содержащий идентификатор блока QUERY_RESULT, связанного с соответствующим блоком QUERY.
  • TABLE - Список идентификаторов, определяющих связанные типы блоков TABLE.
  • TABLE_TITLE - Список, содержащий идентификатор типа блока TABLE_TITLE в таблице.
  • TABLE_FOOTER - Список идентификаторов, определяющих типы блоков TABLE_FOOTER в таблице.

Ids -> (список)

Массив идентификаторов связанных блоков. Тип отношения можно получить из элемента Type.

(строка)

EntityTypes -> (список)

Тип сущности.

Следующие типы сущностей могут быть возвращены анализом форм:

  • KEY - Идентификатор поля в документе.
  • VALUE - Текст поля.

Следующие типы сущностей могут быть возвращены анализом таблиц:

  • COLUMN_HEADER - Идентифицирует ячейку, являющуюся заголовком столбца.
  • TABLE_TITLE - Идентифицирует ячейку, являющуюся заголовком таблицы.
  • TABLE_SECTION_TITLE - Идентифицирует ячейку, являющуюся заголовком раздела внутри таблицы. Заголовок раздела — это ячейка, которая обычно охватывает всю строку над разделом.
  • TABLE_FOOTER - Идентифицирует ячейку, являющуюся подвалом таблицы.
  • TABLE_SUMMARY - Идентифицирует ячейку сводки таблицы. Ячейка сводки может быть строкой таблицы или дополнительной, меньшей таблицей, содержащей сводную информацию для другой таблицы.
  • STRUCTURED_TABLE - Идентифицирует таблицу с заголовками столбцов, где содержимое каждой строки соответствует заголовкам.
  • SEMI_STRUCTURED_TABLE - Идентифицирует неструктурированную таблицу.
EntityTypes не возвращается DetectDocumentText и GetDocumentTextDetection.

(строка)

SelectionStatus -> (строка)

Статус выбора элемента выбора, такого как кнопка выбора или флажок.

Page -> (целое число)

Страница, на которой был обнаружен блок. Page возвращается синхронными и асинхронными операциями. Значения страниц, большие 1, возвращаются только для многостраничных документов в формате PDF или TIFF. Скан-изображение (JPEG/PNG), предоставленное асинхронной операции, даже если оно содержит несколько страниц документа, рассматривается как документ с одной страницей. Это означает, что для отсканированных изображений значение Page всегда равно 1.

Запрос -> (структура)

Текст -> (строка)

Вопрос, который Amazon Textract задаст документу. Пример: «Какой ИНН у клиента?»

Псевдоним -> (строка)

Псевдоним, прикрепленный к запросу для удобства поиска.

Страницы -> (список)

Параметр Страницы, который пользователь вводит для указания страниц, к которым должен быть применён запрос. Ниже приведены правила использования этого параметра.

  • Если страница не указана, она по умолчанию устанавливается в значение ["1"].
  • В строке параметра разрешены следующие символы: 0 1 2 3 4 5 6 7 8 9 - *. Пробелы не допускаются.
  • При использовании * для обозначения всех страниц, он должен быть единственным элементом в списке.
  • Можно использовать интервалы страниц, такие как [“1-3”, “1-1”, “4-*”]. Где * обозначает последнюю страницу документа.
  • Указанные страницы должны быть больше 0 и меньше или равны количеству страниц в документе.

(строка)

Предупреждения -> (список)

Список предупреждений, возникших во время операции обнаружения текста для документа.

(структура)

Предупреждение о проблеме, возникшей во время асинхронного анализа текста ( StartDocumentAnalysis ) или асинхронного обнаружения текста в документе ( StartDocumentTextDetection ).

Код ошибки -> (строка)

Код ошибки для предупреждения.

Страницы -> (список)

Список страниц, к которым относится предупреждение.

(целое число)

Сообщение состояния -> (строка)

Возвращает информацию, если работа по обнаружению не была завершена. Содержит объяснение причины ошибки.

DetectDocumentTextModelVersion -> (строка)

© Copyright 2025, Amazon Web Services. Created using Sphinx.

Spec-Zone.ru

Настройки Оффлайн Что нового Помощь О нас
Spec-Zone .ru
спецификации, руководства, описания, API