Obtenha texto reutilizável de um PDF
Extraia conteúdo textual para reutilizar trechos, nomes, números e outras informações reconhecidas fora do PDF original.
Extraia o conteúdo, não o layout da página
Transforme o conteúdo textual de um PDF em uma saída de texto utilizável quando você precisa de palavras, números e trechos para copiar, revisar ou processar em vez do layout original do PDF.
Sem assinatura obrigatória. Os arquivos não são armazenados permanentemente.
Recupere conteúdo para a próxima tarefa
A saída é útil quando você precisa das informações textuais de um PDF sem tentar reconstruir o documento como um arquivo Word editável.
Extraia conteúdo textual para reutilizar trechos, nomes, números e outras informações reconhecidas fora do PDF original.
Use o texto extraído como ponto de partida quando copiar manualmente o conteúdo de um PDF seria lento ou repetitivo.
Quando o PDF contém imagens de páginas digitalizadas em vez de texto nativo utilizável, o OCR pode recuperar texto reconhecido do conteúdo visível.
O texto de um PDF pode ser armazenado de forma diferente daquela em que aparece visualmente, e o OCR pode introduzir erros de reconhecimento. Confira o conteúdo importante antes de usar o resultado.
De documento PDF para texto utilizável
Use o fluxo existente de PDF para Texto do FilexFlow e revise o texto gerado em relação ao documento original quando a precisão for importante.
Escolha o PDF que contém o texto ou conteúdo digitalizado que você precisa recuperar.
Escolha PDF para Texto e revise o consumo estimado de créditos antes de executar a extração.
Baixe o texto gerado e confira nomes, números, parágrafos e ordem de leitura importantes em relação ao PDF original.
Quando você precisa das informações que estão dentro do PDF
PDF para Texto é responsável pela extração de conteúdo. Outros fluxos do FilexFlow são mais adequados quando o objetivo real é reconstruir um documento editável ou criar um PDF pesquisável.
Reutilização de conteúdo
Extraia o conteúdo textual quando precisar de citações, parágrafos, informações de referência ou outro texto fora do documento original.
Extrair texto de PDFPDFs digitalizados
Use extração com OCR quando um PDF digitalizado contém palavras visíveis, mas não fornece texto nativo utilizável.
Extrair texto de PDF digitalizado com OCREscolha da saída
Se você precisa principalmente do conteúdo do documento, a extração de texto pode ser mais adequada do que reconstruir um documento Word editável com layout.
Comparar PDF para Texto e PDF para WordPrivacidade e segurança
O FilexFlow processa no servidor e foi projetado para evitar retenção permanente.
Antes de usar o texto extraído
A utilidade do texto extraído depende de como o PDF de origem armazena seu conteúdo e de ser necessário ou não utilizar OCR.
PDF para Texto extrai o conteúdo textual do documento em uma saída de texto utilizável em vez de tentar reproduzir o layout da página PDF como documento editável.
Não. PDF para Texto se concentra em recuperar conteúdo textual. PDF para Word atende a outro objetivo, no qual é necessária uma estrutura de documento editável.
PDFs digitalizados podem conter imagens de páginas em vez de texto nativo. O OCR pode reconhecer caracteres visíveis e recuperar texto, mas o resultado depende da qualidade do arquivo de origem.
Um PDF pode armazenar fragmentos de texto conforme instruções de posicionamento na página, e não segundo a ordem de leitura percebida por uma pessoa. A extração pode revelar uma ordem inesperada de linhas, colunas ou caracteres.
Revise nomes, números, datas, parágrafos e ordem de leitura importantes em relação ao PDF original, principalmente quando o arquivo é digitalizado ou possui layout complexo com várias colunas.
Recupere o conteúdo de que realmente precisa
Extraia o texto, revise o conteúdo importante e escolha outro fluxo de documento somente quando precisar reconstruir o layout ou criar um PDF pesquisável.