Muitos documentos nunca passam pelo Word. Atas de reunião e READMEs são escritos em Markdown, rascunhos saem do ChatGPT ou do Claude em Markdown, relatórios são exportados como páginas HTML e logs são texto simples. Mais cedo ou mais tarde, um deles precisa ser entregue em PDF, e às vezes em um PDF que pareça ter saído de um scanner.
O Look Scanned já abria arquivos .md, .html e .txt, mas só como formatos beta. O arquivo inteiro saía em uma única página comprida. Para qualquer coisa mais longa, a recomendação era imprimir em PDF pelo navegador primeiro e digitalizar esse PDF. Esse desvio acabou. Os três formatos agora são diagramados em páginas A4 dentro do navegador, e o aviso de beta foi removido.
Páginas de verdade, com as quebras onde você colocou
Não importa o que você abra, o resultado é uma pilha de páginas, e não uma tira comprida:
- O texto passa sozinho para a próxima página.
- As quebras de página que você inseriu no arquivo são mantidas.
- Uma tabela longa continua na próxima página, e nenhuma linha é cortada pela metade.
- Um bloco de código longo continua na próxima página, e linhas longas são quebradas em vez de sair pela borda.
- Uma imagem mais alta que a página é reduzida para caber.
Markdown
Arquivos Markdown recebem a formatação que você conhece do GitHub: títulos, listas, tabelas, citações e blocos de código delimitados. As imagens aparecem quando estão incorporadas no arquivo ou referenciadas com um endereço https:// completo. Uma imagem referenciada por um caminho relativo como images/chart.png não pode ser encontrada, porque o arquivo é aberto sozinho, sem a pasta dele.
O Markdown não tem sintaxe própria para quebra de página, então você insere uma linha de HTML onde a próxima página deve começar:
<div style="break-before: page"></div>
O antigo page-break-before: always também funciona.
Se um assistente de IA colocou a resposta inteira dentro de um bloco de código, remova as três crases externas antes de salvar o arquivo. Senão, o documento todo sai como um único bloco de código.
HTML
Um arquivo HTML é diagramado com os estilos escritos dentro dele: os blocos <style> e os atributos style. Fontes, cores, espaçamentos e as suas regras break-before ou page-break-before são aplicados. Uma folha de estilos guardada em um arquivo separado não é carregada. Imagens e fontes web com um endereço https:// completo são baixadas de onde estiverem hospedadas, então precisam de conexão com a internet. Um caminho relativo como page_files/photo.jpg não pode ser encontrado, pelo mesmo motivo do Markdown.
A página é tratada como um documento para imprimir, não como uma página web para executar. Scripts e quadros incorporados são removidos, e nada na página pode ser executado ou enviado. Páginas web salvas pelo navegador como .mhtml ou .mht também abrem, com as imagens e os estilos guardados dentro do arquivo. Para essas, nada é baixado da web.
Texto simples
Um arquivo .txt, .text ou .log mantém as quebras de linha e o recuo. Linhas mais largas que a página são quebradas em vez de cortadas. Os arquivos são lidos como UTF-8, e qualquer tag ou código no texto aparece exatamente como foi digitado.
Como transformar um deles em PDF digitalizado
- Abra Markdown para PDF digitalizado, HTML para PDF digitalizado ou TXT para PDF digitalizado. Qualquer uma das três páginas abre qualquer um dos três formatos.
- Selecione o seu arquivo e espere um pouco enquanto as páginas são montadas.
- Folheie a pré-visualização. Confira onde as páginas quebram e se as tabelas e os blocos de código estão certos.
- Ajuste o efeito de digitalização. Para texto pequeno ou código, deixe o desfoque e o ruído baixos para que o texto continue fácil de ler.
- Clique em “Gerar PDF digitalizado” e depois em “Baixar PDF digitalizado”.
Você também pode salvar cada página como imagem JPG ou PNG. O nosso guia de PDF, JPG e PNG explica quando usar cada um. Com o Pro, a digitalização em lote processa vários arquivos de uma vez.
Seu arquivo fica no seu dispositivo
O arquivo é diagramado e digitalizado no seu próprio dispositivo. Ele não é enviado a um servidor. A única exceção é um arquivo HTML ou Markdown que referencia imagens ou fontes na web: elas são baixadas dos sites que as hospedam, exatamente como aconteceria se você abrisse a página normalmente.
Bom saber
- As páginas são sempre A4 com margens de 2,54 cm. Um tamanho de papel ou uma margem definidos no CSS do arquivo são ignorados. Se você precisar de Carta (US Letter), escolha em Configurações de papel, e cada página é ajustada a esse tamanho.
- As fontes vêm do seu dispositivo. A menos que os próprios estilos do HTML carreguem fontes web, o texto é composto com as fontes instaladas no seu computador ou celular, então o mesmo arquivo pode quebrar as páginas em pontos diferentes em outra máquina.
- Fórmulas e diagramas ficam como texto. Expressões matemáticas entre cifrões e código de diagramas como o Mermaid aparecem como o texto que você digitou. Se precisar que eles sejam desenhados, exporte um PDF de um editor que os renderize e digitalize esse PDF.
- Arquivos muito longos podem estourar o tempo. A diagramação precisa terminar em cerca de 30 segundos, então um log enorme ou um Markdown do tamanho de um livro pode parar com um erro. Divida-o antes em arquivos menores.
- O resultado é feito de imagens. Como em uma digitalização de verdade, o texto não pode ser selecionado nem pesquisado. Guarde o arquivo original para editar.
Já teve um arquivo Markdown ou HTML que saiu como uma única página comprida? Tente de novo.