- Visão geral
- Contratos de Processamento de Documentos
- Notas de versão
- Sobre os Contratos de Processamento de Documentos
- Classe Box
- Interface IPersistedActivity
- Classe PrettyBoxConverter
- Interface IClassifierActivity
- Interface IClassifierCapabilitiesProvider
- Classe ClassifierDocumentType
- Classe ClassifierResult
- Classe ClassifierCodeActivity
- Classe ClassifierNativeActivity
- Classe ClassifierAsyncCodeActivity
- Classe ClassifierDocumentTypeCapability
- ContentValidationData Class
- EvaluatedBusinessRulesForFieldValue Class
- EvaluatedBusinessRuleDetails Class
- Classe ExtractorAsyncCodeActivity
- Classe ExtractorCodeActivity
- Classe ExtractorDocumentType
- Classe ExtractorDocumentTypeCapabilities
- Classe ExtractorFieldCapability
- Classe ExtractorNativeActivity
- Classe ExtractorResult
- FieldValue Class
- FieldValueResult Class
- Interface ICapabilitiesProvider
- Interface IExtractorActivity
- Classe ExtractorPayload
- Enumeração DocumentActionPriority
- Classe DocumentActionData
- Enumeração DocumentActionStatus
- Enumeração DocumentActionType
- Classe DocumentClassificationActionData
- Classe DocumentValidationActionData
- Classe UserData
- Classe Document
- Classe DocumentSplittingResult
- Classe DomExtensions
- Classe Page
- Classe PageSection
- Classe Polígono
- Classe PolygonConverter
- Classe de metadados
- Classe WordGroup
- Classe Word
- Enumeração ProcessingSource
- Classe ResultsTableCell
- Classe ResultsTableValue
- Classe ResultsTableColumnInfo
- Classe ResultsTable
- Enumeração Rotation
- Rule Class
- RuleResult Class
- RuleSet Class
- RuleSetResult Class
- Enumeração SectionType
- Enumeração WordGroupType
- Interface IDocumentTextProjection
- Classe ClassificationResult
- Classe ExtractionResult
- Classe ResultsDocument
- Classe ResultsDocumentBounds
- Classe ResultsDataPoint
- Classe ResultsValue
- Classe ResultsContentReference
- Classe ResultsValueTokens
- Classe ResultsDerivedField
- Enumeração ResultsDataSource
- Classe ResultConstants
- Classe SimpleFieldValue
- Classe TableFieldValue
- Classe DocumentGroup
- Classe DocumentTaxonomy
- Classe DocumentType
- Classe Field
- Enumeração FieldType
- FieldValueDetails Class
- Classe LanguageInfo
- Classe MetadataEntry
- Enumeração de tipo de texto
- Classe TypeField
- Interface ITrackingActivity
- Interface ITrainableActivity
- Interface ITrainableClassifierActivity
- Interface ITrainableExtractorActivity
- Classe TrainableClassifierAsyncCodeActivity
- Classe TrainableClassifierCodeActivity
- Classe TrainableClassifierNativeActivity
- Classe TrainableExtractorAsyncCodeActivity
- Classe TrainableExtractorCodeActivity
- Classe TrainableExtractorNativeActivity
- Classe BasicDataPoint
- Classe BasicValue
- Classe ComponentCollectionFacade
- Classe DataPointFacadeBase
- Classe ExtractionResultHandler
- Classe FieldGroupDataPoint
- Classe FieldGroupValue
- Classe Field Lookup Base
- Classe FieldRedactionSettings
- Classe RedactionOptions (pré-visualização)
- TipoDeRedação Enum
- Classe ResultsValueFacadeBase
- Classe TableDataPoint
- Classe TableRow
- Classe TableValue
- Classe CuringaDataPoint
- Classe curingaDataPointCollection
- Document Understanding ML
- Document Understanding OCR Local Server
- Document Understanding
- Notas de versão
- Sobre o pacote de atividades Document Understanding
- Compatibilidade do projeto
- Configuração da conexão externa
- APIs de automação codificadas do Document Understanding (visualização)
- Definir Senha do PDF
- Merge PDFs
- Get PDF Page Count
- Extract PDF Text
- Extract PDF Images
- Extract PDF Page Range
- Extract Document Data
- Criar tarefa de validação e aguardar
- Aguarde a tarefa de validação e retome
- Create Validation Task
- Create Document Validation Artifacts
- Recuperar artefatos de validação de documento
- Classificar Documento
- Create Classification Validation Task
- Create Classification Validation Task and Wait
- Aguardar a tarefa de Validação de Classificação e retomar
- IntelligentOCR
- Notas de versão
- Sobre o pacote de atividades IntelligentOCR
- Compatibilidade do projeto
- Carregar Taxonomia
- Digitize Document
- Classificar Escopo do Documento
- Classificador baseado em palavra-chave
- Document Understanding Project Classifier
- Intelligent Keyword Classifier
- Create Document Classification Action
- Create Document Validation Artifacts
- Recuperar artefatos de validação de documento
- Aguardar ação de classificação do documento e retomar
- Train Classifiers Scope
- Instrutor de Classificador Baseado em Palavra-chave
- Intelligent Keyword Classifier Trainer
- Escopo da Extração de Dados
- Document Understanding Project Extractor
- Document Understanding Project Extractor Trainer
- Regex Based Extractor
- Form Extractor
- Intelligent Form Extractor
- Rasurar documento
- Create Document Validation Action
- Wait For Document Validation Action And Resume
- Escopo de Extratores de Treinamento
- Exportar Resultados da Extração
- Machine Learning Extractor
- Machine Learning Extractor Trainer
- Machine Learning Classifier
- Machine Learning Classifier Trainer
- Classificador Generativo
- Extrator Generativo
- Configuração da autenticação
- Validação de documentos com ações de aplicativos
- Validação manual para digitalizar documentos
- Extração de dados baseada em âncora usando a atividade Intelligent Form Extractor
- Validation Station
- Atividades generativas — Boas práticas
- Extrator generativo — boas práticas
- Classificador generativo — Boas práticas
- Serviços de ML
- OCR
- Contratos de OCR
- Notas de versão
- Sobre os Contratos OCR
- Compatibilidade do projeto
- Interface IOCRActivity
- Classe OCRAsyncCodeActivity
- Classe OCRCodeActivity
- Classe OCRNativeActivity
- Character Class
- Classe OCRResult
- Classe Word
- Enumeração FontStyles
- Enumeração OCRRotation
- Classe OCRCapabilities
- Classe OCRScrapeBase
- Classe OCRScrapeFactory
- Classe ScrapeControlBase
- Enumeração ScrapeEngineUsages
- ScrapeEngineBase
- Classe ScrapeEngineFactory
- Classe ScrapeEngineProvider
- OmniPage
- PDF
- Notas de versão
- Sobre o pacote de atividades PDF
- Compatibilidade do projeto
- APIs de automação codificadas em PDF (pré-visualização)
- Converter e-mail para PDF (pré-visualização)
- Converter HTML para PDF (pré-visualização)
- Converter texto para PDF (pré-visualização)
- Export PDF Page As Image
- Extrair anexos de PDF
- Extract Images From PDF
- Extract PDF Page Range
- Get PDF Page Count
- Join PDF Files
- Manage PDF Password
- Read PDF Text
- Read PDF With OCR
- Read XPS Text
- Read XPS With OCR
- [Não listado] Abbyy
- [Não listado] Abbyy Embedded
Atividade Redact Document, que gera um PDF editado aplicando resultados da extração e palavras especificadas a rasurar.
UiPath.IntelligentOCR.Activities.Redaction.RedactDocument
Description
A atividade Redigir Documento gera um PDF rasurado com base no PDF de entrada original (fornecido como o Caminho do Documento), os campos de entrada Resultado da Extração e Palavras a Editar .
A atividade Redact Document usa o Modelo de Objeto de Documento para acessar a localização de todas as palavras identificadas no PDF, enquanto os campos Resultado da Extração e Words To Redact são usados como entrada para os dados que devem ser rasurados, da seguinte forma:
- Cada entrada na matriz de entrada Words To Redact é considerada como uma string para uma pesquisa contínua que não diferencia maiúsculas de minúsculas no documento para fins de rasura.
- Os valores de Resultado de extração que têm uma referência serão editados com base nesse valor de referência (incluindo as seleções de área do cliente como referência para um valor). Os campos regulares e as células da tabela são rasurados.
- Os valores de Resultado da extração que não têm uma referência (adicionados sem uma referência a um campo em que Requer referência está definido como False) são considerados de forma semelhante às entradas no campo Palavras a escrever . Isso significa que todas as ocorrências daquele texto específico encontrado no documento de entrada serão rasuradas.
A atividade pesquisa palavras usando o Modelo de Objeto do Documento. Não há correspondência difusa disponível.
Você pode controlar como as rasuras aparecem. Por padrão, cada área rasurada é coberta com uma caixa preenchida. A entrada RedactionOptions (Pré-visualização) adiciona controle por campo sobre essa aparência, incluindo uma caixa preenchida ou um estilo tachado, preenchimento personalizado e cores de borda e opacidade e um rótulo de código de rasura exibido sobre cada área rasurada. Para obter detalhes, consulte a classe RedactionOptions .
Para lidar com documentos extremamente confidenciais, é altamente recomendável realizar a validação humana dos resultados da extração e usar valores e seleções baseados em referência. Isso garante uma revisão abrangente de todos os dados que precisam ser editados, minimizando as chances de erros de OCR ou problemas de ordem das palavras que afetam a saída final da edição.
Compatibilidade do projeto
Windows
Configuração
Painel do Designer
Entrada
- Caminho do documento: o caminho para o documento que você deseja rasurar.
- Modelo de Objeto de Documento: o Modelo de Objeto de Documento para a entrada documentada obtida da atividade Digitalizar Documento .
- Resultados da extração (opcional): os resultados da extração do processo de extração de dados, armazenados em uma variável
ExtractionResult. Você pode recuperar isso da atividade Data Extraction Scope . - Palavras a rasurar (opcional): uma lista de strings que serão rasuradas, além dos dados obtidos no campo de entrada Resultados da extração .
- Arquivo de saída: o caminho do arquivo de saída onde você deseja salvar o PDF rasurado.
Painel de Propriedades
Comum
- NomeDeExibição: o nome de exibição da atividade.
Entrada
- Caminho do documento: o caminho para o documento que você deseja rasurar.
- Modelo de Objeto de Documento: o Modelo de Objeto de Documento para a entrada documentada obtida da atividade Digitalizar Documento .
- Resultados da extração (opcional): os resultados da extração do processo de extração de dados, armazenados em uma variável
ExtractionResult. Você pode recuperar isso da atividade Data Extraction Scope . - Palavras a rasurar (opcional): uma lista de strings que serão rasuradas, além dos dados obtidos no campo de entrada Resultados da extração .
- Arquivo de saída: o caminho do arquivo de saída onde você deseja salvar o PDF rasurado.
Diversos
- Particular: se selecionada, os valores de variáveis e argumentos não são mais registrados no nível Verbose.
Saída
- Arquivo de saída: o arquivo de saída que contém as informações rasuradas.
Configurações da rasura
- Border color: The color of the border used for redaction.
- Border thickness: The thickness of the border used for redaction.
- Dpi: o valor em pontos por mm que representa a qualidade das imagens incorporadas no PDF rasurado.
- Fill color: The fill color used for redaction.
- Redaction code (preview): The default text to draw over each redaction that does not define its own redaction code. To split the text across multiple lines, use
\nwhere you want a line break, for exampleREDACTED\nCONFIDENTIAL. To display a literal backslash, type it twice, as inC:\\temp\\notes. The text is resized automatically to fit inside the redaction box. - Redaction code font color (preview): The default hex color of the redaction code text, used for any redaction that does not define its own font color.
- Redaction code font size (preview): The default font size of the redaction code text, used for any redaction that does not define its own font size. Use
0to auto-fit the text to the redaction box. - Redaction options (preview): Per-field redaction settings that override the global redaction appearance. Each entry uses a field id to style that field's redactions, or an empty field id to style the Words To Redact matches. Fields without a matching entry use the global FillColor, BorderColor, and BorderThickness values. For details, see the RedactionOptions class.
The Redaction code, Redaction code font color, and Redaction code font size properties set the defaults for the whole document. They apply to every redaction that does not already define its own value, including fields, table cells, and Words To Redact matches. Each one is applied independently, so a field keeps the values you set for it, and uses the defaults only for the values you left empty.