- 适用于 Automation Cloud 和 Test Cloud 的 Document Understanding
- 适用于 Automation Cloud 和 Test Cloud 公共部门的 Document Understanding
- Document Understanding for Automation Cloud 和 Test Cloud 专用版
- ML 包和公共端点
Automation Cloud 中 Document Understanding 2026 年 6 月的发布说明。
2026 年 6 月 30 日
Introducing UiPath Helix Extractor 2.0
UiPath Helix Extractor 2.0 现已向欧洲和美国的租户正式发布 (GA)。该模型基于多模态架构构建,同时处理文档文本和可视化布局,支持非拉丁语脚本语言,并提高了表格提取的准确性。
有关更多详细信息,请查看UiPath Helix Extractor 2.0页面。
UiPath Helix Extractor 1.0 弃用
继 UiPath Helix Extractor 2.0 正式发布后,我们将弃用 UiPath Helix Extractor 1.0 模型版本 24.7。因此,您的模型版本将从 24.7 (Helix 1.0) 移至 26.2.x/26.6.x(Helix 2.0)。
迁移阶段
以下是迁移流程的各个阶段:
- 第 1 阶段(2026 年 6 月 30 日) :Helix Extractor 2.0 正式发布。
- 第 2 阶段(2026 年 7 月中旬) :在 Helix Extractor 1.0 上训练新模型的过程结束。您训练的任何新模型都将使用 Helix 2.0。
- Phase 3 (by end of August 2026): Deployed project versions are automatically migrated to Helix Extractor 2.0.
按区域划分的默认行为
Helix Extractor 2.0 的默认行为因租户所在区域而异:
- 美国:新项目的默认值是 Helix Extractor 2.0。在 2026 年 7 月 15 日之前,您可以通过文档类型管理器恢复使用 Helix Extractor 1.0,在此之后,Helix Extractor 1.0 训练将被移除。
- 欧洲:Helix Extractor 2.0 仍然可以通过“设置”开关选择加入,该开关可用于所有项目,包括新项目和现有项目。
这对您意味着什么
在已部署版本的迁移期间,不会出现停机或服务中断,因为这是一个自动流程,UiPath 团队将完全处理完毕。因此,您无需采取进一步的操作即可完成迁移。在迁移期间,已部署的项目版本将继续按预期运行。
在迁移之前,请考虑以下事项:
- 一旦 Helix 2.0 在您的租户中可用,我们建议您事先在用例中进行测试,以确保其满足您的需求。
- 如果您使用客户管理的密钥 (CMK),则在 Helix Extractor 2.0 支持 CMK 之前,您仍有权访问 Helix Extractor 1.0。
- If you are on GxP (delayed ring), you will continue to have access to Helix Extractor 1.0 in your United States tenants, until Helix Extractor 2.0 is also deployed on GxP.
已更新的可训练拆分器指标
可训练拆分器的“度量”选项卡现在会报告每个文档类型的“拆分” 、 “分类”和“总体F1”分数,替换以前的“精度”和“召回率”分数。有关详细信息,请参阅可训练的拆分器。
2026 年 6 月 26 日
引入字段组和货币量
字段组和货币数量现在已在验证站点、活动和 API 中正式发布。有关更多详细信息,请参阅分类管理器。
此项增强功能使 Document Understanding 数据类型模型与 IXP 非结构化复杂文档保持一致。
Document Understanding API v2
Document Understanding API v2 现已正式发布。API v2 在提取结果中添加了分类驱动的提取和验证、业务规则评估、扩展的非拉丁语言支持,以及 Intelligent Xtraction 和处理 (IXP) FieldGroup 支持。
新增功能
- 发现会在响应中返回关联的分类,以便您使用分类来指导提取和验证。
- 提取和验证接受分类作为输入参数。这可实现部分提取、数据类型覆盖和其他验证自定义。有关详细信息,请参阅使用验证服务。
- 在提取和验证期间,API 会评估分类中定义的业务规则,以确保提取的数据符合配置要求,例如必填字段和允许的值。
- 预定义项目现在支持使用名为生产的单个标签进行基于标签的提取。
- IXP 提取结果现在作为FieldGroup返回,而不再以Table 形式返回。使用字段组,每个字段都保留其实际数据类型。有关详细信息,请参阅分类管理器。
- 新的预定义项目可提供对非拉丁字符集的增强支持。
Document Understanding API v2 重大变更
从 API v1 迁移到 v2 时,以下更改需要更新自动化:
- 所有路由上的响应正文现在使用帕斯卡拼写法属性名称,而不是驼峰式命名法。任何区分大小写的集成,例如以 Python、JavaScript 或其他语言编写的集成,都需要更新以匹配新的大小写。
- 基于标签的路由现在使用
/projects/{projectId}/tags/{tag}/...。在 v2 中,使用之前路由结构的请求将返回 400 错误请求错误。 - 已从发现响应中移除
fields属性;集成必须改用taxonomy。 - 发现路由现在返回
tags,而不是tag。 - IXP 提取结果现在作为FieldGroup返回,而非以Table 形式返回,如果您的自动化将提取结果视为表格,则需要更新,以处理新的FieldGroup结构和数据类型。
- 以前返回
FieldType == Table的条目现在返回FieldType == FieldGroup。仅处理Table结果的解析器不会处理此数据。有关详细的迁移步骤和示例,请查看将集成从 Document Understanding API v1 迁移到 v2 。
2026 年 6 月 8 日
错误修复
空白页面导致提取高亮显示在 Action Center 的错误页面上。提取结果不受影响。