document-understanding
2022.10
false
- 概要
 - Document Understanding Process
 - クイックスタート チュートリアル
 - フレームワーク コンポーネント
 - ML パッケージ
 - パイプライン
 - Document Manager
 - OCR サービス
 - Automation Suite にデプロイされた Document Understanding
 - AI Center スタンドアロンにデプロイされた Document Understanding
 - ディープ ラーニング
 - ライセンス
 - 参照
- UiPath.Abbyy.Activities
 - UiPath.AbbyyEmbedded.Activities
 - UiPath.DocumentUnderstanding.ML.Activities
 - UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
 - UiPath.IntelligentOCR.Activities
 - UiPath.OCR.Activities
 - UiPath.OCR.Contracts
 - UiPath.DocumentProcessing.Contracts
 - UiPath.OmniPage.Activities
 - UiPath.PDF.Activities
 
 
重要 :
このコンテンツの一部は機械翻訳によって処理されており、完全な翻訳を保証するものではありません。
新しいコンテンツの翻訳は、およそ 1 ~ 2 週間で公開されます。

Document Understanding ガイド
最終更新日時 2025年3月5日
評価パイプラインは、トレーニング済みの ML モデルの評価に使用します。
評価パイプラインを次のように設定します。
- [パイプラインの種類] フィールドで [評価の実行] を選択します。
 - [パッケージを選択] フィールドで、評価するパッケージを選択します。
 - [パッケージのメジャー バージョンを選択] フィールドで、パッケージのメジャー バージョンを選択します。
 - [パッケージのマイナー バージョンを選択] フィールドで、評価するマイナー バージョンを選択します。
 - [評価データセットを選択] フィールドで、代表的な評価データセットを選択します。
 - [パラメーターを入力] セクションには、評価パイプラインに関連する、使用できる環境変数が 1 つあります。
 eval.redo_ocrを true に設定すると、パイプラインの実行時に OCR を再実行して、抽出の精度に OCR が与える影響を評価できます。この前提として、ML パッケージの作成時に OCR エンジンが構成されているものとします。- [GPU を有効化] スライダーは既定で無効化されており、パイプラインは CPU で実行されます。評価パイプラインの実行は CPU でのみ行うことを強くお勧めします。
 - 
                     
パイプラインの実行頻度として、[今すぐ実行]、[時間ベース]、[定期的] のいずれかのオプションを選択します。
 
すべてのフィールドを設定したら、[作成] をクリックします。パイプラインが作成されます。
評価パイプラインの場合、[出力] ペインには、次の 2 つのファイルを含む [成果物]/[eval_metrics] フォルダーも含まれます。
evaluation_default.xlsxは次の 3 種類のシートを含む Excel スプレッドシートです。- 1 枚目のシートには、標準フィールド、列フィールド、分類フィールドごとに、全体的なスコアとバッチごとのスコアの概要が記載されています。完全に抽出されたドキュメントの割合も、バッチおよびドキュメント全体の両方に対して表示されます。
 - 2 枚目のシートには、色分けされた標準フィールドの比較情報が横並びに表示されます。この情報はドキュメントの精度を向上するために役立ちます。最も精度の低いドキュメントが一番上に表示されるため、診断とトラブルシューティングをスムーズに進められます。
 - 
                     
3 枚目のシートには、色分けされた列フィールドの比較情報が横並びに表示されます。
Excel ファイル内のスコアはすべて精度スコアを表します。
 evaluation_metrics_default.txtには、予測されたフィールドの F1 スコアが含まれます。