この文章は Salesforce 機械翻訳システムを使用して翻訳されました。詳細はこちらをご参照ください。
英語に切り替える

[テキスト抽出を開始] アクション

Amazon Textract API によってアップロードされたドキュメントからテキストを抽出します。

この呼び出し可能アクションを使用して、インテリジェントフォームリーダーのテキスト検出と抽出ステップを自動化できます。

特別なアクセスルール

このアクションは、API バージョン 58.0 以降で、AWSTextract1000LimitAddOn または IntelligentDocumentReaderAddOn ライセンスを所有するユーザーが使用できます。

サポートされている REST HTTP メソッド

URI
/services/data/vXX.X/actions/standard/initiateTextExtraction
形式
JSON、XML
HTTP のメソッド
POST
認証
Authorization: Bearer token

入力

入力 詳細
contentDocumentId
string
説明
必須。テキストの抽出を開始するために使用する、アップロードされたドキュメントの一意のコンテンツドキュメント ID。

最大 20 件のコンテンツドキュメント ID を指定できます。

メモ

endPageIndex
integer
説明
省略可能。抽出する必要があるテキストの最後のページ番号。デフォルト値は、指定したドキュメントの最後のページ番号です。
ocrService
picklist
説明
省略可能。ドキュメントからテキストを抽出する OCR サービスの名前。有効な値は、次のとおりです。
  • AMAZON_TEXTRACT - AWS ドキュメントサービスを示します。
  • AMAZON_TEXTRACT_ANALYZE_ID - AWS Analyze ID サービスを示します。
startPageIndex
integer
説明
省略可能。テキストの抽出を開始するページ番号。デフォルトでは開始ページ番号は 1 です。

テキストの抽出の開始ページに指定できるのは、指定したドキュメントの最初から 20 ページまでです。

メモ

出力

出力 詳細
ocrDocumentScanResultDetails
string
説明
指定したドキュメントの各抽出ページの OcrDocumentScanResult ID とページ番号を含むカンマ区切りのリスト。

要求サンプル

1{
2   "inputs":[
3      {
4         "contentDocumentId":"069T10000004FnoIAE",
5         "startPageIndex":1,
6         "endPageIndex":20,
7         "ocrService":"AMAZON_TEXTRACT"
8      }
9   ]
10}

応答サンプル

1[
2   {
3      "actionName":"initiateTextExtraction",
4      "errors":null,
5      "isSuccess":true,
6      "outputValues":{
7         "ocrDocumentScanResultDetails":{
8            "ocrDocumentScanResults":[
9               {
10                  "pageNumber":1,
11                  "ocrDocumentScanResultId":"0ixT100000000bv"
12               }
13            ]
14         }
15      },
16      "version":1
17   }
18]