注: 以下の翻訳の正確性は検証されていません。AIPを利用して英語版の原文から機械的に翻訳されたものです。

画像からレイアウトを保持してコンテンツを抽出

サポート対象:バッチ、高速

元のレイアウトを保持しながら、画像からコンテンツを抽出します。

式のカテゴリー: メディア

宣言された引数

  • 検出する言語: 入力ファイル内で検出する言語。
    Set<Enum<アフリカーンス語, アルバニア語, アムハラ語, アラビア語, アルメニア語, アッサム語, アゼルバイジャン語, アゼルバイジャン語 - キリル文字, バスク語, ベラルーシ語, ほか ...>>
  • メディア参照: コンテンツを抽出する画像。
    式<Media Reference>
  • 出力形式: 出力は文字列になります。
    Enum<完全な抽出, テキストとテーブル>
  • 任意 エラー処理: 処理に失敗した入力に対するパイプラインの動作を指定します。
    Enum<FAIL, NULL>

出力タイプ: 配列<構造体<block_index, block_id:文字列, block_type:文字列, content:文字列, bounding_box:文字列, languages:配列<文字列>, confidence>> | 文字列

例

例1:基本ケース

引数の値:

  • 検出する言語: {ENG}
  • メディア参照: mediaReference
  • 出力形式: TEXT
  • エラー処理: FAIL_FAST
mediaReference出力
{"mimeType":"image/png","reference":{"type":"mediaSetItem","mediaSetItem":{"mediaSetRid":"ri.mio.main.media-set.a", "mediaItemRid":"ri.mio.main.media-item.a"}}}抽出されたコンテンツ