- 概述
- 入门指南
- 构建模型
- 使用模型
- 模型详细信息
- Automation Cloud 和 Test Cloud 的公共端点
- Automation Cloud 和 Test Cloud 公共部门版的公共端点
- 1040 - 文档类型
- 1040 计划 C - 文档类型
- 1040 计划 D - 文档类型
- 1040 计划 E - 文档类型
- 1040x - 文档类型
- 3949a - 文档类型
- 4506T - 文档类型
- 709 - 文档类型
- 941x - 文档类型
- 9465 - 文档类型
- ACORD125 - 文档类型
- ACORD126 - 文档类型
- ACORD131 - 文档类型
- ACORD140 - 文档类型
- ACORD25 - 文档类型
- 银行对账单 - 文档类型
- 提单 - 文档类型
- 公司注册证书 - 文档类型
- 原产地证书 - 文档类型
- 支票 - 文档类型
- 儿童产品证书 - 文档类型
- CMS 1500 - 文档类型
- 欧盟符合性声明 - 文档类型
- 财务报表 - 文档类型
- FM1003 - 文档类型
- I9 - 文档类型
- 身份证 - 文档类型
- 发票 - 文档类型
- 发票 2 - 文档类型
- 澳大利亚发票 - 文档类型
- 发票中国 - 文档类型
- 希伯来语发票 - 文档类型
- 发票印度 - 文档类型
- 日本发票 - 文档类别
- 发票运输 - 文档类型
- 装箱单列表 - 文档类型
- 工资单 - 文档类型
- 护照 - 文档类型
- 采购订单 - 文档类型
- 收据 - 文档类型
- 收据 2 - 文档类型
- 日本收据 - 文档类型
- 汇款通知书 - 文档类型
- UB04 - 文档类型
- 美国抵押贷款平交披露 - 文档类型
- 公用事业账单 - 文档类型
- 车辆标题 - 文档类型
- W2 - 文档类型
- W9 - 文档类型
- 支持的语言
- Insights 仪表板
- 数据与安全性
- 日志记录
- 许可
- 如何
- 故障排除
UiPath Helix Extractor 2.0
配置 UiPath Helix Extractor 2.0,这是一个可微调的多模态提取模型,用于处理文档文本和可视化布局,以提高复杂和半结构化文档的准确性。
UiPath Helix Extractor 2.0 是一个可微调的文档提取模型,适用于新式项目。它基于多模态架构构建,可同时处理文档文本和可视化布局,从而更准确地提取复杂和半结构化文档。
可用性
UiPath Helix Extractor 2.0 已在欧洲和美国正式发布。如果您属于美国延迟发展 (GxP) 区域,则可以开始使用此功能。
按区域划分的默认行为
Helix Extractor 2.0 的默认行为因租户所在区域而异:
- 美国,包括延迟的 (GxP) 区域:Helix Extractor 2.0 是新项目的默认值。在 2026 年 7 月 15 日(延迟的区域为 2026 年 8 月 21 日)之前,您可以在文档类型管理器中还原使用 Helix Extractor 1.0,在此之后,Helix Extractor 1.0 训练将被移除。
- 欧洲:Helix Extractor 2.0 仍然可以通过“设置”开关选择加入,该开关可用于所有项目,包括新项目和现有项目。
对 Helix Extractor 1.0 的改进
| 功能 | Helix Extractor 1.0 | Helix Extractor 2.0 |
|---|---|---|
| 架构 | 文本型 | 多模态 — 处理文本和可视化布局 |
| 语言支持 | 仅限拉丁语脚本 | 拉丁语和非拉丁语脚本 |
| 表格数据提取 | 标准 | 提高了行和列的准确性 |
| 置信度对齐 | 标准 | 与实际提取准确性的相关性更高 |
启用 Helix Extractor 2.0
您可以通过以下方式启用 Helix Extractor 2.0:
- 新建新式项目时。
- 来自现有的新式项目。
新建新式项目时
-
在“创建项目”对话框中,选择“新式” 。
-
启用“启用 Helix Extractor 2.0”开关。
-
选择“创建”。
默认情况下,添加到项目的所有文档类型都使用 Helix Extractor 2.0。
来自现有的新式项目
-
打开项目设置。
-
在“提取”下,启用“启用 Helix Extractor 2.0”切换开关。
-
选择“保存”。
启用 Helix Extractor 2.0 后:
- 新创建的文档类型使用 Helix Extractor 2.0 进行训练。
- 所有现有的提取程序都需要重新训练,才能使新设置生效。
- 现有项目版本中已固定模型版本的文档类型不受影响,并将继续使用其原始模型版本。
验证提取模型版本
要确认文档类型使用的模型版本,请执行以下操作:
- 创建新的项目版本。
- 选择“编辑版本”。
- 查看与每个文档类型关联的模型版本。
模型版本25.9.x和26.x对应于 UiPath Helix Extractor 2.0。
根据文档类型选择模型类型
在项目级别启用 Helix Extractor 2.0 时,它将成为所有文档类型的默认值。您仍然可以为每个文档类型单独配置模型类型:
-
打开文档类型管理器。
-
选择文档类型。
-
打开设置。
-
从“模型类型”下拉列表中,选择"Helix Extractor" 2.0或“旧版” 。
-
选择“保存”。
保存更改会提示用户选择是否触发该文档类型的新训练事件。
这样,您就可以将 Helix Extractor 2.0 用于需要提高性能的文档类型,同时对已经满足您的自动化目标的文档类型保留旧版模型。
已知限制
- UiPath Helix Extractor 2.0 在运行时最多为每个文档处理 100 个页面。有关规范的完整列表,请参阅已知限制。
- UiPath Helix Extractor 2.0 尚不支持文档标签(批次)。“高级指标”报告文件中将缺少这些值。