file2markdown
PDFMarkdownOCRferramentasIA

Como converter PDF para Markdown: ferramentas, OCR e revisão

20 de setembro de 2026

Converter um PDF para Markdown ajuda quando você precisa editar o texto, organizar notas ou preparar documentos para uma ferramenta de IA. O resultado é um arquivo .md com títulos, listas e tabelas que pode ser aberto em um editor de texto comum.

O caminho depende do arquivo. Um relatório com texto selecionável é diferente de uma nota fiscal digitalizada. Neste guia, você encontra um fluxo simples, alternativas para usar no computador e cuidados para revisar a saída.

Converta em três passos

  1. Abra o conversor de PDF para Markdown.
  2. Arraste o PDF para a área de envio e inicie a conversão.
  3. Revise a prévia, copie o Markdown ou baixe o arquivo .md.

O plano gratuito permite 5 arquivos por dia sem conta ou 15 com uma conta gratuita, com até 25 MB por arquivo. O Pro oferece arquivos de até 100 MB, lotes de até 10 arquivos e conversões ilimitadas. O OCR de PDFs digitalizados faz parte do Pro.

A interface em português brasileiro não traduz o conteúdo do arquivo. Um relatório em inglês continua em inglês depois da conversão.

PDF com texto ou PDF digitalizado?

Tente selecionar e copiar uma frase no leitor de PDF. Se conseguir, provavelmente há uma camada de texto que pode ser extraída diretamente. Mesmo assim, fontes e colunas podem causar problemas de caracteres ou ordem de leitura.

Quando a página contém apenas uma imagem, é necessário OCR: reconhecimento de texto a partir de pixels. No file2markdown, PDFs identificados como digitalizados usam OCR com Pro, limitado a 50 páginas por arquivo.

Um PDF também pode combinar páginas com texto e páginas digitalizadas. A identificação inicial usa uma amostra do documento. Confira se as páginas em imagem apareceram no resultado; a presença de bastante texto não comprova que todas as páginas foram processadas.

Qual ferramenta escolher?

A escolha depende do seu fluxo e dos seus arquivos. A tabela descreve alternativas, sem atribuir notas de precisão que não foram medidas em condições equivalentes.

FerramentaQuando considerarO que conferir
file2markdownConversão pelo navegador sem instalaçãoLimites do plano e necessidade de OCR
MarkerCriar um fluxo de extração com modelosInstalação, recursos e licença
pdf-inspectorIntegrar extração de PDF em um aplicativoVersão e configuração de OCR
PyMuPDF4LLMGerar Markdown com PythonTabelas e ordem de leitura
MarkItDownProcessar vários formatos com PythonSaída dos seus documentos reais
PandocConverter DOCX, HTML ou EPUBPDF não é um formato de entrada

Veja as fontes oficiais de Marker, pdf-inspector, PyMuPDF4LLM e MarkItDown. O file2markdown usa pdf-inspector no fluxo de PDFs com texto. Recursos de uma biblioteca dependem da versão e não são automaticamente recursos do serviço web.

O que revisar no Markdown

Abra o original ao lado do resultado. Compare uma página do começo, outra do meio e a última. Procure títulos ausentes, cabeçalhos repetidos e trechos de colunas diferentes misturados no mesmo parágrafo.

Em tabelas, confira se cada valor continua associado à coluna correta. Verifique sinais negativos, unidades, datas e separadores decimais. Esta é uma ilustração da estrutura de Markdown:

# Relatório mensal

## Vendas

| Região | Unidades |
|---|---|
| Norte | 120 |
| Sul | 95 |

O exemplo mostra a sintaxe, não uma medição de qualidade. Gráficos, equações e tabelas com células mescladas podem exigir consulta ao PDF original.

Todas as conversões incluem verificações básicas. Para PDFs, a verificação opcional com Jev procura possíveis problemas em trechos do texto convertido. Ela não compara o resultado com o original e não corrige o documento automaticamente.

Usar com IA e automatizar

Markdown facilita separar seções e manter referências ao documento de origem. Isso não garante respostas corretas nem economia de tokens em qualquer situação. Se a pergunta depender de um gráfico, forneça também o original a uma ferramenta que aceite conteúdo visual.

O servidor MCP, com documentação em inglês, permite usar o file2markdown a partir de assistentes e agentes. Teste arquivos representativos antes de automatizar lotes grandes, especialmente quando houver tabelas ou digitalizações.

O serviço converte arquivos em memória e não os armazena. O OCR usa Claude, e a opção Jev envia trechos do texto convertido à TypeSafe. Consulte a política de privacidade, em inglês, para entender o processamento.

Perguntas frequentes

Posso converter PDF para Markdown de graça?

Sim, para PDFs com texto dentro dos limites gratuitos. PDFs digitalizados precisam do OCR disponível no Pro.

Pandoc aceita PDF como entrada?

Não. Pandoc pode converter formatos como DOCX e EPUB, mas essa tarefa precisa de um extrator de PDF.

Todas as tabelas e imagens são preservadas?

A extração busca recuperar a estrutura do texto. Tabelas complexas e informações visuais precisam de revisão; mantenha o original como referência.

Converta seu PDF para Markdown.

The Markdown Memo

Uma newsletter quinzenal em inglês para profissionais do direito, pesquisa, contabilidade e quem trabalha com PDFs, documentos digitalizados e apresentações. Sem spam.