- Visão geral
- Introdução
- Fornecedores do Marketplace
- Clientes do Marketplace
- Diretrizes de publicação
- Diretrizes de publicação para automações prontas para execução
- Diretrizes de publicação para aceleradores de soluções
- Diretrizes de publicação para conectores do Integration Service
- Diretrizes de publicação para modelos de aplicativos do Process Mining
- Benefícios dos aceleradores de solução
- Segurança e Proteção de IP
- Guias de instalação
- Outras listagens da UiPath
- Node-RED
- Configuração
- Teams
- Escopo do Microsoft Teams
- Criar equipe
- Criar equipe do grupo
- Get Team
- Obter equipes
- Canais
- Criar canal
- Excluir canal
- Obter canal
- Obter canais
- Canal de Atualização
- Chats
- Obter chat
- Obter chats
- Get Chat Members
- Mensagens
- Get message
- Get Messages
- Obter respostas da mensagem
- Responder à mensagem
- Enviar mensagem
- Events
- Create Event
- Delete Event
- Get Event
- Obter eventos
- Usuários
- Get User Presença
- Como funciona
- Referências técnicas
- Introdução
- Configuração
- Referências técnicas
- Inícios rápidos
- Escopo da Amazon
- Atividades
- Analisar documento de página única
- Analisar documento de várias páginas
- Iniciar análise do documento
- Obter status da análise do documento
- Obter análise do documento
- O objeto Detalhes da página
- Como funciona
- Referências técnicas
- Introdução
- Sobre
- Configuração
- Referências técnicas
- Escopo do Reconhecedor de formulário do Azure
- Atividades
- Analisar formulário
- Analisar formulário assíncrono
- Obter resultado do formulário de análise
- Analisar recibo
- Analisar recibo assíncrono
- Obter resultado de recebimento da análise
- Analisar layout
- Analisar layout assíncrono
- Obter resultado da análise de layout
- Treinar modelo
- Obter modelos
- Obter chaves do modelo
- Obter informações do modelo
- Excluir modelo
- Conectores
- Como criar atividades
- Crie sua integração
Analyze a multipage document stored in an S3 bucket using Amazon Textract APIs and retrieve extracted data as a PageDetailCollection object.
The Analyze Multipage Document activity uses the Amazon Textract StartDocumentAnalysis and GetDocumentAnalysis APIs to analyze a multi-page document stored in an S3 bucket (Bucket, DocumentName, and Version). If your document includes a table, you have the option to indicate if the first row contains column headers (DiscoverColumnHeaders) and/or ignore empty rows (IgnoreEmptyRows).
Depois de analisar o documento, a atividade retorna as propriedades do documento em um PageDetailCollection objeto (Páginas) que você pode usar como variáveis de entrada em outras atividades fora do pacote de atividades Amazon Textract.
A atividade Analyze Multipage Document é essencialmente uma combinação das atividades Start Document Analysis, Get Document Analysis Status e Get Document Analysis em uma única atividade.
Nas versões anteriores dessa atividade, o parâmetro de saída (Páginas) retornava um objeto PageDetail[] . Na versão 2.0, isso foi alterado para um PageDetailCollection para nos permitir retornar a propriedade JsonBruto para a chamada do método, o que não era possível com um array.
Como funciona
As etapas a seguir e o diagrama de sequência de mensagens são um exemplo de como a atividade funciona desde o momento do design (ou seja, as dependências da atividade e propriedades de entrada/saída) até o tempo de execução.
- Conclua as etapas de Configuração .
- Adicione a atividade Amazon Scope ao seu projeto.
- Adicione a atividade Analisar documento único dentro da atividade Amazon Scope .
- Insira valores para as propriedades de entrada do S3 Storage .
- Crie e insira uma variável
PageDetailCollectionpara sua propriedade Saída . - Execute a atividade.
-
Suas propriedades de entrada são enviadas para a API AnalyzeDocument .
-
A API retorna o valor
PageDetailpara sua variável de propriedade de saída.
-
Propriedades
Os valores para as seguintes propriedades são especificados ao adicionar esta atividade ao seu projeto no UiPath Studio.
Comum
NomeDeExibição
O nome de exibição da atividade.
| Atributos | Detalhes |
|---|---|
| Tipo | String |
| Required | Sim |
| Valor padrão | Analyze Multipage Document |
| Valores permitidos | Insira uma variável String ou String . |
| Observações | N/A |
Entrada
Ao contrário do Obter Status de Análise de Documento, que requer um mecanismo de atraso externo para pesquisar o serviço para alterações de status, o Analisar Documento Multipágina inclui as seguintes propriedades de entrada opcionais para definir um atraso de verificação de status inicial (InicialDelay) e intervalo de verificação de status (StatusCheckInterval).
InitialDelay
O tempo de espera antes que a atividade chame a API Amazon Textract GetDocumentAnalysis para recuperar o valor JobStatus.
| Atributos | Detalhes |
|---|---|
| Tipo | Int32 (milissegundos) |
| Required | Não |
| Valor padrão | 15000 (não exibido) |
| Valores permitidos | Insira uma variável Int32 ou Int32 . |
| Observações | Insira seu valor em milissegundos (por exemplo, 30.000 para 30 segundos); seu valor deve ser maior ou igual a 15000. Ao analisar um documento grande, é recomendável que você insira o tempo estimado que leva para o serviço Amazon Textract concluir sua análise. Por exemplo, se seu documento levar até dois minutos para analisar, você deve inserir 120000 como seu valor e usar a propriedade StatusCheckInterval para indicar com que frequência deseja verificar um status atualizado se o trabalho não for concluído dentro de 2 minutos estimativa. |
StatusCheckInterval
O tempo de espera entre as chamadas para a API Amazon Textract GetDocumentAnalysis para recuperar o valor de JobStatus.
| Atributos | Detalhes |
|---|---|
| Tipo | Int32 (milissegundos) |
| Required | Não |
| Valor padrão | 10000 (não exibido) |
| Valores permitidos | Insira uma variável Int32 ou Int32 . |
| Observações | Insira seu valor em milissegundos (por exemplo, 15000 para 30 segundos); seu valor deve ser maior ou igual a 10000. O objetivo dessa propriedade é ajudar a gerenciar o número de chamadas que sua atividade faz para a API do Amazon Textract. |
Opções
TipoDeAnálise
Especifica os tipos de análise a serem realizados. Use Tabelas para retornar informações sobre as tabelas detectadas no documento de entrada e Formulários para retornar dados de formulários detectados.
| Atributos | Detalhes |
|---|---|
| Tipo | ENUM |
| Required | Não. |
| Valor padrão | Todos |
| Valores permitidos | Todas, Tabelas, Formulários |
| Observações | N/A |
DiscoverColumnHeaders
Indica se as tabelas no documento incluem cabeçalhos de coluna.
| Atributos | Detalhes |
|---|---|
| Tipo | Caixa de seleção |
| Required | Não |
| Valor padrão | não selecionado |
| Valores permitidos | Selecionado ou Não Selecionado |
| Observações | N/A |
IgnorarLinhasVazias
Indica se as linhas vazias nas tabelas do documento devem ser ignoradas ao analisar o documento.
| Atributos | Detalhes |
|---|---|
| Tipo | Caixa de seleção |
| Required | Não |
| Valor padrão | não selecionado |
| Valores permitidos | Selecionado ou Não Selecionado |
| Observações | N/A |
Armazenamento S3
Bucket
O nome do bucket S3 em que o documento é armazenado.
| Atributos | Detalhes |
|---|---|
| Tipo | String |
| Required | Sim |
| Valor padrão | Vazio |
| Valores permitidos | Insira uma variável String ou String . |
| Observações | A região da AWS para o bucket do S3 que contém o documento deve corresponder à região que você selecionou na atividade Amazon Scope . Para que o Amazon Textract processe um arquivo em um bucket S3, o usuário deve ter permissão para acessar o bucket S3; para obter mais informações, consulte a etapa 6 na seção Criar usuário de IAM do guia de Configuração . |
Nome do Documento
The case-sensitive name of the file in the specified Bucket that you want to analyze.
| Atributos | Detalhes |
|---|---|
| Tipo | String |
| Required | Sim |
| Valor padrão | Vazio |
| Valores permitidos | Insira uma variável String ou String . |
| Observações | Formatos de documento suportados: PNG, JPEG e PDF. |
Versão
Se o bucket tiver o controle de versão habilitado, você poderá especificar a versão do objeto.
| Atributos | Detalhes |
|---|---|
| Tipo | String |
| Required | Não |
| Valor padrão | Vazio |
| Valores permitidos | Insira uma variável String ou String . |
| Observações | N/A |
Diversos
Particular
Se selecionado, os valores das variáveis e argumentos não são mais registrados no nível Verbose.
| Atributos | Detalhes |
|---|---|
| Tipo | Caixa de seleção |
| Required | Não |
| Valor padrão | não selecionado |
| Valores permitidos | Selecionado ou Não Selecionado |
| Observações | N/A |
Saída
Páginas
As propriedades extraídas do documento especificado são retornadas como uma matriz.
| Atributos | Detalhes |
|---|---|
| Tipo | PageDetailCollection |
| Required | Não (recomendado se você planejar usar os dados de saída em atividades subsequentes) |
| Valor padrão | Vazio |
| Valores permitidos | Insira uma variável PageDetailCollection |
| Observações | Each object from the array represents the results for one individual page. This is a change from previous versions which returned a PageDetail[] object. See Page Detail for the description of the PageDetail object and its properties. |
Exemplo
A imagem a seguir mostra um exemplo do relacionamento de dependência de atividade e valores de propriedade de entrada/saída.
Para obter instruções passo a passo e exemplos, consulte os guias de Início rápido .