UiPath Documentation
document-understanding
latest
false
Document Understanding 传统用户指南
重要 :
请注意,此内容已使用机器翻译进行了部分本地化。 新发布内容的本地化可能需要 1-2 周的时间才能完成。

数字化相关活动

在 Document Understanding 中支持文档数字化的活动,包括用于提取 DOM 和文本的数字化文档,以及用于提取用户界面元素字符串的活动。

框架组件​

将文档数字化​

将文档数字化,提取其“文档对象模型”(DOM) 和文本,并将提取内容存储在相应类型的变量中。更多详情请点击此处。

OCR 引擎​

UiPath 扩展语言 OCR​

使用 OCR 引擎从指定的用户界面元素或图像中提取字符串及其信息。有关详细信息,请参阅 UiPath 扩展语言 OCR。

OCR for Chinese, Japanese, Korean​

备注:

自 2025 年 1 月起,我们将弃用 UiPath 中文、日语、韩语 OCR。我们建议改用UiPath 扩展语言 OCR 。查看弃用时间线,详细了解即将弃用和删除的内容。

使用 OCR 引擎从指定的用户界面元素或图像中提取字符串及其信息。有关详细信息,请参阅中文、日语、韩语 OCR。

UiPath 文档 OCR​

提取有关文档图像文本内容的字符串和相关信息。更多详情请点击此处。

OmniPage OCR​

使用 OmniPage OCR 引擎从指定的用户界面元素或图像中提取字符串及其信息。更多详情请点击此处。

Google Cloud Vision OCR​

使用 Google Cloud OCR 引擎从指定的用户界面元素或图像中提取字符串及其信息。更多详情请点击此处。

Microsoft Azure 计算机视觉 OCR​

使用 Microsoft Azure 计算机视觉 OCR 引擎从指定的用户界面元素或图像中提取字符串及其信息。更多详情请点击此处。

Microsoft OCR​

从提供的图像中提取字符串及其信息。Microsoft OCR 活动使用 Windows 10 内置的 OCR(如果可用),否则,它会恢复到默认的 MODI OCR 引擎。更多详情请点击此处。

Tesseract OCR​

使用 Tesseract OCR 引擎从指定的用户界面元素或图像中提取字符串及其信息。更多详情请点击此处。

此页面有帮助吗?

连接

需要帮助? 支持

想要了解详细内容? UiPath Academy

有问题? UiPath 论坛

保持更新