Veel documenten komen nooit in Word terecht. Vergadernotities en README’s worden in Markdown geschreven, concepten komen als Markdown uit ChatGPT of Claude, rapporten worden als HTML-pagina geëxporteerd, en logbestanden zijn platte tekst. Vroeg of laat moet een ervan als PDF worden ingeleverd, en soms als een PDF die eruitziet alsof hij uit een scanner komt.
Look Scanned kon .md-, .html- en .txt-bestanden al openen, maar alleen als bètaformaten. Het hele bestand kwam op één hoge pagina terecht. Voor alles wat langer was, luidde het advies: druk het eerst vanuit je browser af naar PDF en scan die. Die omweg is verleden tijd. Alle drie de formaten worden nu in je browser op A4-pagina’s gezet, en het bètalabel is eraf.
Echte pagina’s, met de einden waar jij ze zet
Wat je ook opent, het resultaat is een stapel pagina’s en niet één lange strook:
- Tekst loopt vanzelf door naar de volgende pagina.
- Pagina-einden die je in het bestand hebt gezet, blijven staan.
- Een lange tabel loopt door op de volgende pagina, en een rij wordt nooit doormidden gesneden.
- Een lang codeblok gaat verder op de volgende pagina, en lange regels worden afgebroken in plaats van over de rand te lopen.
- Een afbeelding die hoger is dan de pagina wordt verkleind zodat ze past.
Markdown
Markdown-bestanden krijgen de opmaak die je kent van GitHub: koppen, lijsten, tabellen, citaten en codeblokken tussen backticks. Afbeeldingen verschijnen wanneer ze in het bestand zijn ingesloten of met een volledig https://-adres zijn gelinkt. Een afbeelding waarnaar met een relatief pad zoals images/chart.png wordt verwezen, kan niet worden gevonden, omdat het bestand op zichzelf wordt geopend, zonder zijn map.
Markdown heeft geen eigen syntaxis voor een pagina-einde, dus zet je een regel HTML neer op de plek waar de volgende pagina moet beginnen:
<div style="break-before: page"></div>
Het oudere page-break-before: always werkt ook.
Heeft een AI-assistent zijn hele antwoord in een codeblok gezet, verwijder dan de buitenste drie backticks voordat je het bestand opslaat. Anders wordt het hele document één codeblok.
HTML
Een HTML-bestand wordt opgemaakt met de stijlen die erin zijn geschreven: zijn <style>-blokken en style-attributen. Lettertypen, kleuren, witruimte en je break-before- of page-break-before-regels gelden allemaal. Een stylesheet in een apart bestand wordt niet geladen. Afbeeldingen en webfonts met een volledig https://-adres worden opgehaald van waar ze staan, dus daarvoor is een internetverbinding nodig. Een relatief pad zoals page_files/photo.jpg kan niet worden gevonden, om dezelfde reden als bij Markdown.
De pagina wordt behandeld als een document om af te drukken, niet als een webpagina om uit te voeren. Scripts en ingesloten frames worden verwijderd, en niets op de pagina kan worden uitgevoerd of verzonden. Webpagina’s die je browser als .mhtml of .mht heeft opgeslagen, openen ook, met de afbeeldingen en stijlen die in het archief zijn opgeslagen. Daarvoor wordt niets van het web opgehaald.
Platte tekst
Een .txt-, .text- of .log-bestand houdt zijn regeleinden en inspringing. Regels die breder zijn dan de pagina worden afgebroken in plaats van afgekapt. Bestanden worden gelezen als UTF-8, en tags of code in de tekst verschijnen precies zoals ze zijn getypt.
Zo maak je er een gescande PDF van
- Open Markdown naar gescande PDF, HTML naar gescande PDF of TXT naar gescande PDF. Elk van de drie pagina’s opent elk van de drie formaten.
- Kies je bestand en wacht even terwijl de pagina’s worden opgemaakt.
- Blader door het voorbeeld. Kijk waar de pagina’s eindigen en of tabellen en codeblokken er goed uitzien.
- Pas het scaneffect aan. Bij kleine tekst of code houd je vervaging en ruis laag, zodat de tekst goed leesbaar blijft.
- Kies ‘Gescande PDF genereren’ en daarna ‘Gescande PDF downloaden’.
Je kunt elke pagina ook als JPG of PNG opslaan. In onze uitleg over PDF, JPG en PNG lees je wanneer welk formaat handig is. Met Pro verwerk je met bulkscannen meerdere bestanden tegelijk.
Je bestand blijft op je apparaat
Het bestand wordt op je eigen apparaat opgemaakt en gescand. Het wordt niet naar een server geüpload. De enige uitzondering is een HTML- of Markdown-bestand dat verwijst naar afbeeldingen of lettertypen op het web: die worden opgehaald bij de sites waar ze staan, net als wanneer je de pagina gewoon zou openen.
Goed om te weten
- Pagina’s zijn altijd A4 met marges van 2,54 cm. Een papierformaat of marge in de CSS van het bestand zelf wordt genegeerd. Heb je US Letter nodig, kies dat dan onder Papierinstellingen; elke pagina wordt er dan passend op gezet.
- Lettertypen komen van je apparaat. Tenzij de eigen stijlen van de HTML webfonts laden, wordt de tekst gezet in de lettertypen die op je computer of telefoon staan. Hetzelfde bestand kan op een andere machine dus anders in pagina’s worden verdeeld.
- Formules en diagrammen blijven tekst. Wiskunde tussen dollartekens en diagramcode zoals Mermaid verschijnen als de tekst die je hebt getypt. Wil je ze getekend hebben, exporteer dan een PDF vanuit een editor die ze weergeeft en scan die PDF.
- Heel lange bestanden kunnen te veel tijd kosten. De opmaak moet binnen ongeveer 30 seconden klaar zijn, dus een enorm logbestand of een Markdown-bestand zo lang als een boek kan stoppen met een foutmelding. Splits het eerst op in kleinere bestanden.
- Het resultaat bestaat uit afbeeldingen. Net als bij een echte scan kun je de tekst niet selecteren of doorzoeken. Bewaar het originele bestand om te bewerken.
Kwam een Markdown- of HTML-bestand er eerder uit als één lange pagina? Probeer het nog eens.