UiPath Documentation
document-understanding
latest
false
Document Understanding ガイド
重要 :
このコンテンツの一部は機械翻訳によって処理されており、完全な翻訳を保証するものではありません。 新しいコンテンツの翻訳は、およそ 1 ~ 2 週間で公開されます。

UiPath Helix Extractor 2.0

UiPath Helix Extractor 2.0 を設定します。これは、ドキュメントのテキストと視覚的なレイアウトを処理して、複雑なドキュメントや半構造化されたドキュメントの精度を向上させる、微調整可能なマルチモーダル抽出モデルです。

UiPath Helix Extractor 2.0 は、モダン プロジェクト用の微調整可能なドキュメント抽出モデルです。マルチモーダル アーキテクチャに基づいて構築されており、ドキュメントのテキストと視覚的なレイアウトの両方を処理し、複雑なドキュメントや半構造化されたドキュメントをより正確に抽出できます。

重要:

UiPath Helix Extractor 2.0 はまだ顧客管理のキー (CMK) をサポートしていません。CMK が組織レベルで有効化されている場合でも、ベンダー管理のキーのみが使用されます。

利用可能状況

UiPath Helix Extractor 2.0 は 、欧州 および 米国のテナントに対して一般提供を開始しました。Automation Suite または GxP リージョンではまだ利用できません。

リージョン別の既定の動作

Helix Extractor 2.0 の既定の動作は、テナントのリージョンによって異なります。

  • 米国: 新しいプロジェクトの既定値は Helix Extractor 2.0 です。2026 年 7 月 15 日までは、[ドキュメントの種類マネージャー] から Helix Extractor 1.0 に戻すことができます。その後、Helix Extractor 1.0 のトレーニングは削除されます。
  • ヨーロッパ: Helix Extractor 2.0 は、新規および既存のすべてのプロジェクトで利用可能な Settings トグルを通じてオプトインのままです。

Helix Extractor 1.0 からの改良点

機能Helix Extractor 1.0Helix Extractor 2.0
アーキテクチャテキストベースマルチモーダル — テキストと視覚的なレイアウトを処理します。
言語サポートラテン文字のみラテン文字と非ラテン文字
表抽出標準行と列の精度の向上
信頼度の調整標準実際の抽出精度との相関性が高い

Helix Extractor 2.0 を有効化

Helix Extractor 2.0 は、次の方法で有効にできます。

  • 新しいモダン プロジェクトを作成する場合。
  • 既存のモダン プロジェクトから

新しいモダン プロジェクトを作成する場合

  1. [ プロジェクトを作成 ] ダイアログで [ モダン] を選択します。

  2. Enable Helix Extractor 2.0 トグルを有効にします。

  3. [作成] を選択します。

プロジェクトに追加されたすべてのドキュメントタイプは、デフォルトでHelix Extractor 2.0を使用します。

既存のモダン プロジェクトから

  1. [プロジェクトの設定] を開きます。

  2. [ Extraction] で、[ Enable Helix Extractor 2.0 ] トグルをオンにします。

  3. [保存] を選択します。

注:

Helix Extractor 2.0 を有効にした後:

  • 新しく作成したドキュメントタイプでは、トレーニングにHelix Extractor 2.0 を使用します。
  • 新しい設定を適用するには、既存のすべての抽出器を再トレーニングする必要があります。
  • 既存のプロジェクト バージョンでモデル バージョンがピン留めされているドキュメントの種類は影響を受けず、引き続き元のモデル バージョンが使用されます。

抽出モデルのバージョンを確認する

ドキュメントの種類で使用されているモデル バージョンを確認するには、以下の手順を実行します。

  1. 新しいプロジェクトのバージョンを作成します。
  2. [バージョンを編集] を選択します。
  3. 各ドキュメントの種類に関連付けられているモデル バージョンを確認します。
注:

モデル バージョン 25.9.x26.2.x、および 26.6.xUiPath Helix Extractor 2.0 に対応しています。

ドキュメントの種類ごとにモデルの種類を選択する

Helix Extractor 2.0 をプロジェクト レベルで有効にすると、すべてのドキュメント タイプの既定になります。ただし、モデルの種類をドキュメントの種類ごとに個別に設定することもできます。

  1. ドキュメントの種類マネージャーを開きます。

  2. ドキュメントの種類を選択します。

  3. [設定] を開きます。

  4. [モデル タイプ]ドロップダウン リストから、[Helix Extractor 2.0]または[レガシ]を選択します。

  5. [保存] を選択します。

注:

変更を保存すると、そのドキュメントの種類に対して新しいトレーニング イベントをトリガーするオプションが表示されます。

これにより、パフォーマンスを向上させたいドキュメントの種類には Helix Extractor 2.0 を使用し、自動化の目標を既に達成しているドキュメントの種類にはレガシ モデルを維持することができます。

既知の制限事項

  • UiPath Helix Extractor 2.0 は、実行時にドキュメントあたり最大 100 ページを処理します。仕様の完全なリストについては、「 既知の制限事項」をご覧ください。
  • UiPath Helix Extractor 2.0 はまだ顧客管理のキー (CMK) をサポートしていません。CMK が組織レベルで有効化されている場合でも、ベンダー管理のキーのみが使用されます。
  • UiPath Helix Extractor 2.0 はまだ Automation Suite で利用できません。
  • UiPath Helix Extractor 2.0 はまだドキュメントのタグ (バッチ) をサポートしていません。これらは、高度なメトリック レポート ファイルには表示されません。

このページは役に立ちましたか?

接続

ヘルプ リソース サポート

学習する UiPath アカデミー

質問する UiPath フォーラム

最新情報を取得