- Introdução
- Componentes do framework
- Document Understanding no AI Center
- Pipelines
- Pacotes de ML
- Gerenciador de Dados
- Serviços de OCR
- Licenciamento
- Referências
AI Center does not support filenames containing special characters, so we strongly recommend that before importing documents to Data Manager, you make sure that their names contain only Latin characters, numbers, dash (-) and underscore (_).
Há 4 tipos de importação suportados no Data Manager:
- Importação de esquema
- Importação de documentos brutos
- Importação de conjunto de dados no Data Manager
- Importação do conjunto de dados do Machine Learning Extractor Trainer (funcionalidade em VISUALIZAÇÃO)
Importação de esquema
Se quiser iniciar uma nova instância do Data Manager usando o mesmo esquema de uma instância existente, siga estas etapas:
- Insira uma string aleatória no filtro da instância existente, de forma que nenhum documento permaneça na visualização
- Clique no botão Exportar. Um arquivo zip será exportado.
- Importe o arquivo zip diretamente para a nova instância do Data Manager (não descompacte). O esquema será importado.
Você também pode usar um dos esquemas predefinidos fornecidos na seção Configurando o Data Manager desta documentação.
Importação de documentos brutos
Os tipos de documentos que podem ser importados para rotulagem são: .pdf, .tiff, .png, .jpg. As etapas são:
-
Click Import. The Import Data window is displayed.
-
Provide a batch name in the Batch Name field. This enables you to easily filter and find these documents using the Filter drop-down later on.
-
If you want to use this document batch for training an ML model, leave the Make this a test set checkbox unselected.
-
If you want to use this document batch for evaluating an ML model (i.e. measuring its performance), select the Make this a test set checkbox. This ensures the data is ignored by the training pipelines.
-
Carregue ou arraste e solte um arquivo ou conjunto de arquivos na seção Procurar ou soltar arquivos.
Qualquer tipo de arquivo é aceito. O aplicativo os inspeciona e indica quantos deles podem ser importados. Arquivos
.ziptambém são aceitos. O aplicativo descompacta o arquivo e percorre as pastas recursivamente para encontrar todos os arquivos nela inseridos.Importing a dataset zip file exported from another Data Manager instance will import the documents with the labels. This works only if the dataset schema is the same or is a subset of the pre-existing schema in the Data Manager.
Importação de conjunto de dados no Data Manager
To import a dataset that was labelled previously on another instance of Data Manager, you need to get the zip file which was exported originally, and import it directly into the new Data Manager instance. If your new Data Manager instance is completely empty (no data and no fields defined) then both the data and the schema will be imported. If your new Data Manager instance already has fields defined, then the newly imported dataset needs to have the same fields, or a subset of those fields. Otherwise the import will be rejected.
Importação de conjunto de dados da Estação de Validação (funcionalidade em Visualização)
Como seu fluxo de trabalho de RPA processa documentos usando um modelo de ML existente, alguns documentos podem exigir validação manual usando a atividade Estação de Validação (disponível em robôs attended ou no navegador usando o Orchestrator Action Center).
The validated data generated in Validation Station can be exported using Machine Learning Extractor Trainer activity and can be used to train ML models using the feature described here.
As etapas envolvidas são:
- Configure o ML Extractor Trainer para gerar dados em uma pasta com caminho <Trainer/Output/Folder> (use qualquer caminho de pasta vazio).
- Execute o fluxo de trabalho de RPA, incluindo Estação de Validação e ML Extractor Trainer.
- O ML Extractor Trainer criará 3 subpastas denominadas: documentos, metadados e previsões dentro da pasta de saída.
- Compacte o <Trainer/Output/Folder> para obter um arquivo zip como TrainerOutputFolder.zip
- Importe o arquivo zip para o Data Manager. O Data Manager detectará que a importação contém dados produzidos pelo ML Extractor Trainer e importará os dados de acordo.
- Exporte os dados como de costume e faça o upload para o AI Center.
- Inicie o pipeline de treinamento ou o pipeline completo e certifique-se de selecionar o Pacote de ML e a versão que deseja ajustar.