UiPath Documentation
document-understanding
latest
false
Document Understanding 用户指南
重要 :
请注意,此内容已使用机器翻译进行了部分本地化。 新发布内容的本地化可能需要 1-2 周的时间才能完成。

UiPath Helix Extractor 2.0

配置 UiPath Helix Extractor 2.0,这是一个可微调的多模态提取模型,用于处理文档文本和可视化布局,以提高复杂和半结构化文档的准确性。

UiPath Helix Extractor 2.0 是一个可微调的文档提取模型,适用于新式项目。它基于多模态架构构建,可同时处理文档文本和可视化布局,从而更准确地提取复杂和半结构化文档。

可用性​

UiPath Helix Extractor 2.0 已在欧洲和美国正式发布。如果您属于美国延迟发展 (GxP) 区域,则可以开始使用此功能。

按区域划分的默认行为​

Helix Extractor 2.0 的默认行为因租户所在区域而异:

  • 美国,包括延迟的 (GxP) 区域:Helix Extractor 2.0 是新项目的默认值。在 2026 年 7 月 15 日(延迟的区域为 2026 年 8 月 21 日)之前,您可以在文档类型管理器中还原使用 Helix Extractor 1.0,在此之后,Helix Extractor 1.0 训练将被移除。
  • 欧洲:Helix Extractor 2.0 仍然可以通过“设置”开关选择加入,该开关可用于所有项目,包括新项目和现有项目。

对 Helix Extractor 1.0 的改进​

功能Helix Extractor 1.0Helix Extractor 2.0
架构文本型多模态 — 处理文本和可视化布局
语言支持仅限拉丁语脚本拉丁语和非拉丁语脚本
表格数据提取标准提高了行和列的准确性
置信度对齐标准与实际提取准确性的相关性更高

启用 Helix Extractor 2.0​

您可以通过以下方式启用 Helix Extractor 2.0:

  • 新建新式项目时。
  • 来自现有的新式项目。

新建新式项目时

  1. 在“创建项目”对话框中,选择“新式” 。

  2. 启用“启用 Helix Extractor 2.0”开关。

  3. 选择“创建”。

默认情况下,添加到项目的所有文档类型都使用 Helix Extractor 2.0。

来自现有的新式项目

  1. 打开项目设置。

  2. 在“提取”下,启用“启用 Helix Extractor 2.0”切换开关。

  3. 选择“保存”。

备注:

启用 Helix Extractor 2.0 后:

  • 新创建的文档类型使用 Helix Extractor 2.0 进行训练。
  • 所有现有的提取程序都需要重新训练,才能使新设置生效。
  • 现有项目版本中已固定模型版本的文档类型不受影响,并将继续使用其原始模型版本。

验证提取模型版本​

要确认文档类型使用的模型版本,请执行以下操作:

  1. 创建新的项目版本。
  2. 选择“编辑版本”。
  3. 查看与每个文档类型关联的模型版本。
备注:

模型版本25.9.x和26.x对应于 UiPath Helix Extractor 2.0。

根据文档类型选择模型类型​

在项目级别启用 Helix Extractor 2.0 时,它将成为所有文档类型的默认值。您仍然可以为每个文档类型单独配置模型类型:

  1. 打开文档类型管理器。

  2. 选择文档类型。

  3. 打开设置。

  4. 从“模型类型”下拉列表中,选择"Helix Extractor" 2.0或“旧版” 。

  5. 选择“保存”。

备注:

保存更改会提示用户选择是否触发该文档类型的新训练事件。

这样,您就可以将 Helix Extractor 2.0 用于需要提高性能的文档类型,同时对已经满足您的自动化目标的文档类型保留旧版模型。

已知限制​

  • UiPath Helix Extractor 2.0 在运行时最多为每个文档处理 100 个页面。有关规范的完整列表,请参阅已知限制。
  • UiPath Helix Extractor 2.0 尚不支持文档标签(批次)。“高级指标”报告文件中将缺少这些值。

此页面有帮助吗?

连接

需要帮助? 支持

想要了解详细内容? UiPath Academy

有问题? UiPath 论坛

保持更新