- 概要
- Document Understanding Process
- クイックスタート チュートリアル
- フレームワーク コンポーネント
- ML パッケージ
- パイプライン
- データ マネージャー (Data Manager)
- OCR サービス
- Automation Suite にデプロイされた Document Understanding
- AI Center スタンドアロンにデプロイされた Document Understanding
- ディープ ラーニング
- 優れたパフォーマンスの ML モデルを構築する
- ライセンス
- 参照
- UiPath.Abbyy.Activities
- UiPath.AbbyyEmbedded.Activities
- UiPath.DocumentUnderstanding.ML.Activities
- UiPath.DocumentUnderstanding.OCR.LocalServer.Activities
- UiPath.IntelligentOCR.Activities
- UiPath.OCR.Activities
- UiPath.OCR.Contracts
- UiPath.DocumentProcessing.Contracts
- UiPath.OmniPage.Activities
- UiPath.PDF.Activities
UiPath Document Manager は、Document Understanding マシン ラーニング モデルのトレーニングと評価に必要なデータセットを準備、レビュー、修正できる軽量の Web アプリケーションです。
オンプレミスでのデプロイ方法は以下のとおりです。
- Data Manager in AI Center On Premises. This is Generally Available and it is fully supported for Production scenarios. There is no limitation on the size of datasets that can be imported, with the exception of Auto-retraining which still has the 2000 pages or 2GB limit per import. For all the AI Center deployment methods available for On Premises, please see this page.
Data Manager によって、データのバッチ、データの準備、モデルの設定に伴う各種操作を複数のユーザーが実行できます。
ML モデルで抽出するフィールドを定義・設定します。
ラベル付けのためにドキュメントをインポートします。
UiPath が提供する、すぐに使える既存の ML モデル (請求書抽出や領収書抽出など) や、AI Center でトレーニングしたモデルを使用して、ドキュメントの事前ラベル付けを行います。
ドキュメントのラベル付けを行います。
AI Center のトレーニング パイプラインで使用できる形式で、ドキュメントをエクスポートします。
ユーザー インターフェイス
Data Manager インターフェイスには、以下のパネルがあります。
管理バー
Data Manager のページの上部に表示されます。
複数の操作を実行できます (ドキュメント間の移動、ドキュメントの削除/復元、ドキュメントの検索/フィルター処理、AI モデルの予測の実行、ドキュメントのインポートとエクスポート)。
以下に、管理バーで利用可能なオプションを示します。
| オプション | Icon | 説明 |
|---|---|---|
|
ナビゲーション |
|
アクティブなフィルターに一致するドキュメント間を移動します。2 つの矢印の間にカウンターが表示されます。アクティブな検索/フィルターに一致するドキュメントの総数のうち、現在のドキュメントの数を示します。 |
|
|
ドキュメントを検索またはフィルター処理します。フィルターはドキュメントのエクスポート時にも適用されます。ドキュメント内の単語またはドキュメント名でフィルター処理することもできます。 | |
|
削除/復元 |
|
ドキュメントを削除または復元します。削除したドキュメントは、deleted フィルターで検索できます。 |
|
予測 |
|
AI モデルの予測を実行し、結果を表示します。 事前ラベル付けを設定すると、管理バーでこのボタンが有効化されます。このボタンをクリックすると、現在のドキュメントの事前ラベル付けが行われます。 At the moment, using the Predict option with Public Endpoints prelabels only the first 10 pages of a document. This is a known issue and a fix is in the working. Using the Predict option with ML Skills in AI Center, however, does not impose such a limitation. |
|
|
[データをインポート] ダイアログ ボックスを開きます。 | |
|
|
[ファイルをエクスポート] ダイアログ ボックスを開きます。 | |
|
|
アイコンをクリックすると、元のドキュメントを含む Zip ファイルをダウンロードできます。 | |
|
|
OCR と事前ラベル付けの設定を行ったり、[使い方] パネルにアクセスしたりします。詳しくは、以下をご覧ください。 |
ダウンロードする
元のドキュメントを含む Zip ファイルに加え、Document Manager によって内部で .jpeg 画像に変換されたすべてのページもダウンロードされます。
ドキュメントの名前、種類、セッション名
アイコンの右側には、現在アクティブなドキュメントの名前、その種類、およびセッション名が表示されます。
ドキュメントには以下の 3 種類があります。
- トレーニング ドキュメント
- 検証ドキュメント
- 評価ドキュメント
Training and Validation documents are part of training datasets used by Training Pipelines.
Evaluation documents are ignored by Training Pipelines and are intended to only be used by Evaluation pipelines in AI Center. These documents are the ones that were marked as evaluation by selecting the Make this an evaluation set checkbox in the Import data dialog box.
設定
設定ボタンには、2 つの利用可能なオプションがあります。
- Settings where you can configure the OCR service or Prelabelling
- How to... which has the purpose of a help menu
OCR
Data Manager にドキュメントをインポートするには、OCR サービスの設定が必須です。
次のオプションを使用できます。
OCR メソッド
Data Manager にドキュメントをインポートするために使用する OCR エンジンの選択は、重要です。
モデルをデプロイする際 (実行時) に使用する OCR と同じ OCR を、トレーニング データをインポートする際 (トレーニング時) にも使用することをお勧めします。
いくつかの異なる OCR を試して、使用するドキュメントに最適な OCR を見定めてからその OCR に決めるのが理想的です。
オンプレミスのオプションは以下のとおりです。
- UiPath OCR コンテナー - 西ヨーロッパの主要な言語をサポートします。
- Microsoft Read コンテナー (Microsoft でプレビュー版として利用可能) - 多数の言語をカバーしています。
- UiPath OCR ML スキル - v2020.10 以降のオンプレミス版 AI Center でデプロイされています。
クラウドベースのオプションは以下のとおりです。
- UiPath Document OCR - https://du.uipath.com/ocr;
- Google Cloud Vision OCR - 対応している言語の種類は最多です。
- Google Cloud Vision OCR for Japanese - 日本語ドキュメントの読み取りに最適です。
- Microsoft Read OCR
OCR の URL
OCR を設定するには、OCR サービスに URL が必要です。使用できる URL は以下のとおりです。
-
public URLs such as https://du.uipath.com/ocr or third-party URLs from Google Vision OCR or Microsoft Read OCR
-
オンプレミスでデプロイされた UiPath によって提供される UiPath Document OCR のスタンドアロン コンテナーの URL
-
v2020.10 以降のオンプレミス版 AI Center で公開されている、ML スキルとしてデプロイされた OCR ML パッケージの URL
重要:Data Manager と同じマシンで OCR を実行している場合は、ローカル マシンを参照する際に
localhostは使用せず、ローカル マシンの IP アドレスまたはドメイン名を使用してください。オンプレミス版の AI Center にパブリック ML スキルとしてデプロイされた OCR の URL の場合は、AI Center の ML スキルの詳細画面に表示される URL を使用してください。
OCR キー
The corresponding API Key for the selected OCR engine. For example, for UiPath Document OCR, you need to use the Document Understanding API Key. Mandatory for Data Manager Cloud and Data Manager On-Prem Online. It is not required for Data Manager On-Prem Air-gapped.
事前ラベル付け
ラベル付けが必要なフィールドの一部を抽出できるモデルを既に所持しており、追加で手動のラベル付けが必要なフィールドがほとんどない場合、Data Manager の事前ラベル付け機能を使用すると、時間を大幅に節約できます。
次のオプションを使用できます。
事前ラベル付け URL
事前ラベル付けを行うには、ML モデルに URL が必要です。使用できる URL は以下のとおりです。
- public URLs such as https://du.uipath.com/ie/invoices or https://du.uipath.com/ie/purchase_orders
- see the full list of endpoints here
- オンプレミスの AI Center または AI Center Cloud で公開されている ML スキルの URL
エアギャップ環境にデプロイされたオンプレミス版 AI Center の ML スキルは、事前ラベル付けに使用できません。
Data Manager と同じマシンで事前ラベル付けモデルを実行している場合は、ローカル マシンを参照する際に localhost は使用せず、ローカル マシンの IP アドレスまたはドメイン名を使用してください。
オンプレミス版 AI Center の、パブリック ML スキルの URL の場合は、AI Center の ML スキルの詳細画面に表示される URL を使用してください。
事前ラベル付けキー
The Document Understanding API Key. Mandatory for Data Manager Cloud and Data Manager On-Prem Online. It is not required for Data Manager On-Prem Air-gapped.
使い方
[使い方] オプションから、Data Manager のヘルプ メニューにアクセスできます。
以下の項目が含まれます。
- Data Manager のバージョン
- 製品ガイドのページへのリンク です。
- [ラベル付けのコントロール] セクション: データを処理するときに使用されるコントロールが表示されます。
- [ドキュメントのショートカット] セクション: ナビゲーションや UI のスケーリングなどのさまざまな操作の実行に使用されるショートカットが表示されます。
- [構成] セクション: インストール時に実行されたインスタンス構成に関する詳細が表示されます。
列フィールド
列フィールドでは、以下のオプションを利用できます。
- 新しい列フィールドを作成

- フィールドを編集

- 列フィールドの値を展開/折りたたみ

For more details on column fields, visit this section.
標準フィールド
標準フィールドでは、以下のオプションを利用できます。
- 新しい標準フィールドを作成

- フィールドを編集

For more details on regular fields, visit this section.
分類フィールド
分類フィールドでは、以下のオプションを利用できます。
- 新しい分類フィールドを作成

- フィールドを編集

For more details on classification fields, visit this section.
ドキュメント ビュー
複数のページが含まれるドキュメントの場合、PDF ビューアーと同様に、ページからページへと自然にスクロールできます。拡大または縮小するには、Ctrl キーを押しながらマウスをスクロールします。
ドキュメント ビューでは、ドキュメントのラベル付けを行えます。単語ボックスを選択し、キーを押してそれらのボックスをフィールドに割り当てます。また、単語ボックスを右クリックして、抽出された情報を検証することもできます。
For more details on how to label documents, visit this page.
新しい Data Manager セッションを開く場合、またはフィルターが空の場合は、ドキュメント ビューに特定のガイドラインが表示されます。
また、読み込みの失敗もドキュメント ビューに表示されます。