A folha inteira num PDF. O sistema separa e manda para cada um.
O seu sistema de folha exporta um arquivo com centenas de contracheques. Aqui ele é lido página por página, o CPF e o nome são reconhecidos, e cada demonstrativo vira um documento no nome da pessoa certa.
O que você ganha
Se algum destes pontos é a sua rotina, este módulo é para você.
Não é recurso bonito de catálogo: cada item abaixo apareceu em operação real de cliente, e é o que o módulo tira do caminho.
O que dói hoje
- Alguém abrindo o PDF da folha, recortando página por página e salvando com o nome do funcionário.
- Contracheque enviado para a pessoa errada — e um problema de privacidade na mesa do RH.
- Dois dias de trabalho manual todo mês, sempre na semana mais apertada.
Do começo ao documento na mão
Anexe o arquivo da folha
Um PDF com todas as páginas, do jeito que o seu sistema de folha exporta.
O sistema lê cada página
Primeiro o texto do próprio PDF. Se o arquivo for digitalizado, entra o OCR em português para reconhecer as letras.
Identifica pelos seus identificadores
Você define as regras de captura: onde está o CPF, a matrícula, o nome. O valor encontrado tem de ser idêntico ao do cadastro.
Confira e envie
Uma tela mostra página por página com o dono encontrado. Ajuste o que ficou em dúvida, descarte a página de totais e dispare.
Os detalhes que fazem a diferença no dia a dia
Identificadores configuráveis
Regras de captura com âncora de texto: depois de "CPF:", depois de "Matrícula:". Cada empresa tem o seu layout.
Só envia com certeza
CPF que não existe no cadastro, nome repetido, página sem dono: tudo retido para alguém olhar.
Recorte de páginas seguidas
Demonstrativo de duas páginas? As páginas seguidas da mesma pessoa saem num arquivo só.
Impressora virtual
O seu sistema de folha imprime direto para a API e o lote entra pronto, sem ninguém anexar nada.
Prévia por página
Abra qualquer página antes de enviar e veja o que o leitor entendeu dali.
Exigir tudo identificado
Opção para o lote só disparar quando a última página tiver dono. Nada passa pela metade.
A parte que o time de TI pergunta
Este módulo não é só tela: ele existe inteiro na API, com os mesmos limites e as mesmas regras.
- Como está feito
- Leitura em cascata: pdftotext quando existe, leitor em PHP puro quando a hospedagem bloqueia programa externo, OCR local (tesseract em português) para digitalizado e serviço remoto como última saída.
- Recorte com extração real de páginas — o PDF da pessoa é o original, não uma imagem.
- Captura escopada: a regra procura o valor só nos caracteres seguintes à âncora, para não pegar o CNPJ da empresa no cabeçalho.
- Limite de páginas por lote configurável, para arquivo gigante não consumir o servidor.
Endpoints deste módulo
curl -X POST https://seu-dominio/api/v1/lotes \
-H "Authorization: Bearer tsk_live_..." \
-F "arquivo=@folha_outubro.pdf" \
-F "tipo_documento_id=4" \
-F "origem=impressora" \
-F "enviar_automatico=1" \
-F "exigir_todas_identificadas=1"
O que costumam perguntar sobre este módulo
Funciona com PDF escaneado?
Funciona. Quando não há texto no arquivo, o OCR em português lê a imagem da página. Arquivos gerados pelo sistema de folha são lidos direto do texto, com precisão total.
E se o OCR errar o CPF?
Então a página não é enviada. O valor lido precisa ser idêntico a um cadastro ativo; se não bater, a página fica retida para conferência humana.
Dá para automatizar sem ninguém abrir o sistema?
Sim, é o cenário da impressora virtual: o seu sistema manda o PDF pela API com envio automático, e o lote é lido, separado e disparado sozinho.
Os módulos que trabalham junto com este
Lote com separação por OCR funcionando com um documento seu.
Na demonstração a gente usa um arquivo da sua empresa e monta o cenário que você vive hoje. Você sai da reunião sabendo exatamente o que muda na sua rotina.