- 适用于 Automation Cloud 和 Test Cloud 的 Document Understanding
- 适用于 Automation Cloud 和 Test Cloud 公共部门的 Document Understanding
- Document Understanding for Automation Cloud 和 Test Cloud 专用版
- ML 包和公共端点
Automation Cloud 中 Document Understanding 2026 年 6 月的发布说明。
2026 年 6 月 30 日
Introducing UiPath Helix Extractor 2.0
UiPath Helix Extractor 2.0 现已向欧洲和美国的租户正式发布 (GA)。该模型基于多模态架构构建,同时处理文档文本和可视化布局,支持非拉丁语脚本语言,并提高了表格提取的准确性。
有关更多详细信息,请查看UiPath Helix Extractor 2.0页面。
UiPath Helix Extractor 1.0 弃用
继 UiPath Helix Extractor 2.0 正式发布后,我们将弃用 UiPath Helix Extractor 1.0 模型版本 24.7。因此,您的模型版本将从 24.7 (Helix 1.0) 移至 26.2.x/26.6.x(Helix 2.0)。
迁移阶段
以下是迁移流程的各个阶段:
- 第 1 阶段(2026 年 6 月 30 日) :Helix Extractor 2.0 正式发布。
- 第 2 阶段(2026 年 7 月中旬) :在 Helix Extractor 1.0 上训练新模型的过程结束。您训练的任何新模型都将使用 Helix 2.0。
- 第 3 阶段(2026 年 8 月之前) :已部署的项目版本会自动迁移到 Helix Extractor 2.0。
按区域划分的默认行为
Helix Extractor 2.0 的默认行为因租户所在区域而异:
- 美国:新项目的默认值是 Helix Extractor 2.0。在 2026 年 7 月 15 日之前,您可以通过文档类型管理器恢复使用 Helix Extractor 1.0,在此之后,Helix Extractor 1.0 训练将被移除。
- 欧洲:Helix Extractor 2.0 仍然可以通过“设置”开关选择加入,该开关可用于所有项目,包括新项目和现有项目。
这对您意味着什么
在已部署版本的迁移期间,不会出现停机或服务中断,因为这是一个自动流程,UiPath 团队将完全处理完毕。因此,您无需采取进一步的操作即可完成迁移。在迁移期间,已部署的项目版本将继续按预期运行。
在迁移之前,请考虑以下事项:
- 一旦 Helix 2.0 在您的租户中可用,我们建议您事先在用例中进行测试,以确保其满足您的需求。
- 如果您使用客户管理的密钥 (CMK),则在 Helix Extractor 2.0 支持 CMK 之前,您仍有权访问 Helix Extractor 1.0。
- 如果您使用的是 GxP(延迟环),您将可以继续访问美国租户中的 Helix Extractor 1.0,直到 GxP 上也部署 Helix Extractor 2.0 之前。
已更新的可训练拆分器指标
可训练拆分器的“度量”选项卡现在会报告每个文档类型的“拆分” 、 “分类”和“总体F1”分数,替换以前的“精度”和“召回率”分数。有关详细信息,请参阅可训练的拆分器。
2026 年 6 月 26 日
引入字段组和货币量
字段组和货币数量现在已在验证站点、活动和 API 中正式发布。有关更多详细信息,请参阅分类管理器。
此项增强功能使 Document Understanding 数据类型模型与 IXP 非结构化复杂文档保持一致。
Document Understanding API v2
Document Understanding API v2 现已正式发布。API v2 在提取结果中添加了分类驱动的提取和验证、业务规则评估、扩展的非拉丁语言支持,以及 Intelligent Xtraction 和处理 (IXP) FieldGroup 支持。
新增功能
- 发现会在响应中返回关联的分类,以便您使用分类来指导提取和验证。
- 提取和验证接受分类作为输入参数。这可实现部分提取、数据类型覆盖和其他验证自定义。有关详细信息,请参阅使用验证服务。
- 在提取和验证期间,API 会评估分类中定义的业务规则,以确保提取的数据符合配置要求,例如必填字段和允许的值。
- 预定义项目现在支持使用名为生产的单个标签进行基于标签的提取。
- IXP 提取结果现在作为FieldGroup返回,而不再以Table 形式返回。使用字段组,每个字段都保留其实际数据类型。有关详细信息,请参阅分类管理器。
- 新的预定义项目可提供对非拉丁字符集的增强支持。
Document Understanding API v2 重大变更
从 API v1 迁移到 v2 时,以下更改需要更新自动化:
- 所有路由上的响应正文现在使用帕斯卡拼写法属性名称,而不是驼峰式命名法。任何区分大小写的集成,例如以 Python、JavaScript 或其他语言编写的集成,都需要更新以匹配新的大小写。
- 基于标签的路由现在使用
/projects/{projectId}/tags/{tag}/...。在 v2 中,使用之前路由结构的请求将返回 400 错误请求错误。 - 已从发现响应中移除
fields属性;集成必须改用taxonomy。 - 发现路由现在返回
tags,而不是tag。 - IXP 提取结果现在作为FieldGroup返回,而非以Table 形式返回,如果您的自动化将提取结果视为表格,则需要更新,以处理新的FieldGroup结构和数据类型。
- 以前返回
FieldType == Table的条目现在返回FieldType == FieldGroup。仅处理Table结果的解析器不会处理此数据。有关详细的迁移步骤和示例,请查看将集成从 Document Understanding API v1 迁移到 v2 。
2026 年 6 月 8 日
错误修复
空白页面导致提取高亮显示在 Action Center 的错误页面上。提取结果不受影响。