---
title: "Markdown, HTML e TXT para PDF digitalizado: páginas de verdade e quebras de página"
description: "Arquivos Markdown, HTML e de texto simples saíram da fase beta. Agora eles abrem como páginas A4 de verdade no navegador, com quebras de página, tabelas e blocos de código no lugar certo, sem passar pela janela de impressão."
date: 2026-10-03T01:00:00.000Z
lang: pt
source: https://lookscanned.io/pt/blog/html-markdown-to-scanned-pdf
tags: ["Markdown", "HTML", "PDF", "novidades"]
---

# Markdown, HTML e TXT para PDF digitalizado: páginas de verdade e quebras de página

Muitos documentos nunca passam pelo Word. Atas de reunião e READMEs são escritos em Markdown, rascunhos saem do ChatGPT ou do Claude em Markdown, relatórios são exportados como páginas HTML e logs são texto simples. Mais cedo ou mais tarde, um deles precisa ser entregue em PDF, e às vezes em um PDF que pareça ter saído de um scanner.

O Look Scanned já abria arquivos `.md`, `.html` e `.txt`, mas só como formatos beta. O arquivo inteiro saía em uma única página comprida. Para qualquer coisa mais longa, a recomendação era imprimir em PDF pelo navegador primeiro e digitalizar esse PDF. Esse desvio acabou. Os três formatos agora são diagramados em páginas A4 dentro do navegador, e o aviso de beta foi removido.

## Páginas de verdade, com as quebras onde você colocou

Não importa o que você abra, o resultado é uma pilha de páginas, e não uma tira comprida:

- O texto passa sozinho para a próxima página.
- As quebras de página que você inseriu no arquivo são mantidas.
- Uma tabela longa continua na próxima página, e nenhuma linha é cortada pela metade.
- Um bloco de código longo continua na próxima página, e linhas longas são quebradas em vez de sair pela borda.
- Uma imagem mais alta que a página é reduzida para caber.

## Markdown

Arquivos Markdown recebem a formatação que você conhece do GitHub: títulos, listas, tabelas, citações e blocos de código delimitados. As imagens aparecem quando estão incorporadas no arquivo ou referenciadas com um endereço `https://` completo. Uma imagem referenciada por um caminho relativo como `images/chart.png` não pode ser encontrada, porque o arquivo é aberto sozinho, sem a pasta dele.

O Markdown não tem sintaxe própria para quebra de página, então você insere uma linha de HTML onde a próxima página deve começar:

```html
<div style="break-before: page"></div>
```

O antigo `page-break-before: always` também funciona.

Se um assistente de IA colocou a resposta inteira dentro de um bloco de código, remova as três crases externas antes de salvar o arquivo. Senão, o documento todo sai como um único bloco de código.

## HTML

Um arquivo HTML é diagramado com os estilos escritos dentro dele: os blocos `<style>` e os atributos `style`. Fontes, cores, espaçamentos e as suas regras `break-before` ou `page-break-before` são aplicados. Uma folha de estilos guardada em um arquivo separado não é carregada. Imagens e fontes web com um endereço `https://` completo são baixadas de onde estiverem hospedadas, então precisam de conexão com a internet. Um caminho relativo como `page_files/photo.jpg` não pode ser encontrado, pelo mesmo motivo do Markdown.

A página é tratada como um documento para imprimir, não como uma página web para executar. Scripts e quadros incorporados são removidos, e nada na página pode ser executado ou enviado. Páginas web salvas pelo navegador como `.mhtml` ou `.mht` também abrem, com as imagens e os estilos guardados dentro do arquivo. Para essas, nada é baixado da web.

## Texto simples

Um arquivo `.txt`, `.text` ou `.log` mantém as quebras de linha e o recuo. Linhas mais largas que a página são quebradas em vez de cortadas. Os arquivos são lidos como UTF-8, e qualquer tag ou código no texto aparece exatamente como foi digitado.

## Como transformar um deles em PDF digitalizado

1. Abra [Markdown para PDF digitalizado](https://lookscanned.io/pt/scan/markdown), [HTML para PDF digitalizado](https://lookscanned.io/pt/scan/html) ou [TXT para PDF digitalizado](https://lookscanned.io/pt/scan/txt). Qualquer uma das três páginas abre qualquer um dos três formatos.
2. Selecione o seu arquivo e espere um pouco enquanto as páginas são montadas.
3. Folheie a pré-visualização. Confira onde as páginas quebram e se as tabelas e os blocos de código estão certos.
4. Ajuste o efeito de digitalização. Para texto pequeno ou código, deixe o desfoque e o ruído baixos para que o texto continue fácil de ler.
5. Clique em “Gerar PDF digitalizado” e depois em “Baixar PDF digitalizado”.

Você também pode salvar cada página como imagem JPG ou PNG. O nosso [guia de PDF, JPG e PNG](https://lookscanned.io/pt/blog/scanned-document-pdf-jpg-png) explica quando usar cada um. Com o Pro, a [digitalização em lote](https://lookscanned.io/pt/scan/bulk) processa vários arquivos de uma vez.

## Seu arquivo fica no seu dispositivo

O arquivo é diagramado e digitalizado no seu próprio dispositivo. Ele não é enviado a um servidor. A única exceção é um arquivo HTML ou Markdown que referencia imagens ou fontes na web: elas são baixadas dos sites que as hospedam, exatamente como aconteceria se você abrisse a página normalmente.

## Bom saber

- **As páginas são sempre A4 com margens de 2,54 cm.** Um tamanho de papel ou uma margem definidos no CSS do arquivo são ignorados. Se você precisar de Carta (US Letter), escolha em Configurações de papel, e cada página é ajustada a esse tamanho.
- **As fontes vêm do seu dispositivo.** A menos que os próprios estilos do HTML carreguem fontes web, o texto é composto com as fontes instaladas no seu computador ou celular, então o mesmo arquivo pode quebrar as páginas em pontos diferentes em outra máquina.
- **Fórmulas e diagramas ficam como texto.** Expressões matemáticas entre cifrões e código de diagramas como o Mermaid aparecem como o texto que você digitou. Se precisar que eles sejam desenhados, exporte um PDF de um editor que os renderize e digitalize esse PDF.
- **Arquivos muito longos podem estourar o tempo.** A diagramação precisa terminar em cerca de 30 segundos, então um log enorme ou um Markdown do tamanho de um livro pode parar com um erro. Divida-o antes em arquivos menores.
- **O resultado é feito de imagens.** Como em uma digitalização de verdade, o texto não pode ser selecionado nem pesquisado. Guarde o arquivo original para editar.

Já teve um arquivo Markdown ou HTML que saiu como uma única página comprida? [Tente de novo](https://lookscanned.io/pt/scan/markdown).
