Divisor personalizado
O divisor personalizado foi projetado para ser usado para dividir documentos compostos (documentos compostos de várias classes) em vários documentos de classe única, identificando cada documento lógico. Por exemplo, um pacote de hipoteca contém várias classes, como inscrição, verificação de renda e documento de identificação com foto. Os processadores de divisor personalizados podem ser usados imediatamente ou treinados do zero usando seus próprios documentos e classes personalizadas.
Descrição e uso do divisor
Você pode criar divisores personalizados que são especificamente adequados para seus documentos e treinados e avaliados com seus dados, ou implantar modelos pré-treinados com IA generativa. Esses processadores identificam classes de documentos de um conjunto de classes definido pelo usuário. Em seguida, use esses processadores nos seus documentos. Normalmente, você usaria um divisor personalizado em arquivos compostos por diferentes tipos de documentos lógicos e, em seguida, usaria a identificação de classe de cada um para transmitir os documentos a um processador de extração apropriado para extrair as entidades.
Como os modelos de ML não são perfeitos e têm uma certa taxa de erro, e como erros de divisão costumam ser muito problemáticos (uma divisão incorreta compõe dois documentos errados e causa erros de extração), uma prática recomendada é a etapa de revisão humana após a previsão de divisão, mas antes da divisão de arquivo real. Com base nos requisitos da empresa, existem alternativas para sempre fazer a revisão humana:
- Use as pontuações de confiança na previsão para decidir se deve ignorar a revisão humana (se for alta o suficiente). Esse limite de pontuação de confiança precisa ser determinado com base em dados históricos sobre taxas de erro com pontuações de confiança determinadas. Essa deve ser uma decisão de negócios com base na tolerância do processo de negócios a erros e no requisito de ignorar a revisão humana.
- Em alguns casos de uso, os documentos divididos podem ser roteados diretamente para o extrator apropriado, de acordo com a classe prevista. Em seguida, se a extração estiver incompleta ou tiver pontuações de confiança baixas, isole os documentos divididos e acione o documento composto original e a decisão de divisão a serem analisados. Isso tem requisitos de fluxo de trabalho bastante complexos.
Versões do modelo de divisor personalizado
Os seguintes modelos estão disponíveis para divisores personalizados. Para mudar as versões do modelo, consulte Gerenciar versões do processador.
A versão 1.5 é compatível com pontuações de confiança.