UiPath Documentation
document-understanding
latest
false
Document Understanding 发行说明
重要 :
新发布内容的本地化可能需要 1-2 周的时间才能完成。

2026 年 6 月

Automation Cloud 中 Document Understanding 2026 年 6 月的发布说明。

2026 年 6 月 30 日

Introducing UiPath Helix Extractor 2.0

UiPath Helix Extractor 2.0 现已向欧洲美国的租户正式发布 (GA)。该模型基于多模态架构构建,同时处理文档文本和可视化布局,支持非拉丁语脚本语言,并提高了表格提取的准确性。

有关更多详细信息,请查看UiPath Helix Extractor 2.0页面。

UiPath Helix Extractor 1.0 弃用

继 UiPath Helix Extractor 2.0 正式发布后,我们将弃用 UiPath Helix Extractor 1.0 模型版本 24.7。因此,您的模型版本将从 24.7 (Helix 1.0) 移至 26.2.x/26.6.x(Helix 2.0)。

迁移阶段

以下是迁移流程的各个阶段:

  • 第 1 阶段(2026 年 6 月 30 日) :Helix Extractor 2.0 正式发布。
  • 第 2 阶段(2026 年 7 月中旬) :在 Helix Extractor 1.0 上训练新模型的过程结束。您训练的任何新模型都将使用 Helix 2.0。
  • 第 3 阶段(2026 年 8 月之前) :已部署的项目版本会自动迁移到 Helix Extractor 2.0。
按区域划分的默认行为

Helix Extractor 2.0 的默认行为因租户所在区域而异:

  • 美国:新项目的默认值是 Helix Extractor 2.0。在 2026 年 7 月 15 日之前,您可以通过文档类型管理器恢复使用 Helix Extractor 1.0,在此之后,Helix Extractor 1.0 训练将被移除。
  • 欧洲:Helix Extractor 2.0 仍然可以通过“设置”开关选择加入,该开关可用于所有项目,包括新项目和现有项目。
这对您意味着什么

在已部署版本的迁移期间,不会出现停机或服务中断,因为这是一个自动流程,UiPath 团队将完全处理完毕。因此,您无需采取进一步的操作即可完成迁移。在迁移期间,已部署的项目版本将继续按预期运行。

在迁移之前,请考虑以下事项:

  • 一旦 Helix 2.0 在您的租户中可用,我们建议您事先在用例中进行测试,以确保其满足您的需求。
  • 如果您使用客户管理的密钥 (CMK),则在 Helix Extractor 2.0 支持 CMK 之前,您仍有权访问 Helix Extractor 1.0。
  • 如果您使用的是 GxP(延迟环),您将可以继续访问美国租户中的 Helix Extractor 1.0,直到 GxP 上也部署 Helix Extractor 2.0 之前。

已更新的可训练拆分器指标

可训练拆分器的“度量”选项卡现在会报告每个文档类型的“拆分”“分类”“总体F1”分数,替换以前的“精度”和“召回率”分数。有关详细信息,请参阅可训练的拆分器

2026 年 6 月 26 日

引入字段组和货币量

字段组和货币数量现在已在验证站点、活动和 API 中正式发布。有关更多详细信息,请参阅分类管理器

此项增强功能使 Document Understanding 数据类型模型与 IXP 非结构化复杂文档保持一致。

Document Understanding API v2

Document Understanding API v2 现已正式发布。API v2 在提取结果中添加了分类驱动的提取和验证、业务规则评估、扩展的非拉丁语言支持,以及 Intelligent Xtraction 和处理 (IXP) FieldGroup 支持。

新增功能
  • 发现会在响应中返回关联的分类,以便您使用分类来指导提取和验证。
  • 提取验证接受分类作为输入参数。这可实现部分提取、数据类型覆盖和其他验证自定义。有关详细信息,请参阅使用验证服务
  • 在提取和验证期间,API 会评估分类中定义的业务规则,以确保提取的数据符合配置要求,例如必填字段和允许的值。
  • 预定义项目现在支持使用名为生产的单个标签进行基于标签的提取。
  • IXP 提取结果现在作为FieldGroup返回,而不再以Table 形式返回。使用字段组,每个字段都保留其实际数据类型。有关详细信息,请参阅分类管理器
  • 新的预定义项目可提供对非拉丁字符集的增强支持。

Document Understanding API v2 重大变更

从 API v1 迁移到 v2 时,以下更改需要更新自动化:

  • 所有路由上的响应正文现在使用帕斯卡拼写法属性名称,而不是驼峰式命名法。任何区分大小写的集成,例如以 Python、JavaScript 或其他语言编写的集成,都需要更新以匹配新的大小写。
  • 基于标签的路由现在使用/projects/{projectId}/tags/{tag}/... 。在 v2 中,使用之前路由结构的请求将返回 400 错误请求错误。
  • 已从发现响应中移除fields属性;集成必须改用taxonomy
  • 发现路由现在返回 tags,而不是 tag
  • IXP 提取结果现在作为FieldGroup返回,而非以Table 形式返回,如果您的自动化将提取结果视为表格,则需要更新,以处理新的FieldGroup结构和数据类型。
  • 以前返回FieldType == Table的条目现在返回FieldType == FieldGroup 。仅处理Table结果的解析器不会处理此数据。有关详细的迁移步骤和示例,请查看将集成从 Document Understanding API v1 迁移到 v2

2026 年 6 月 8 日

错误修复

空白页面导致提取高亮显示在 Action Center 的错误页面上。提取结果不受影响。

此页面有帮助吗?

连接

需要帮助? 支持

想要了解详细内容? UiPath Academy

有问题? UiPath 论坛

保持更新