Viele Dokumente kommen nie mit Word in Berührung. Besprechungsnotizen und READMEs werden in Markdown geschrieben, Entwürfe kommen als Markdown aus ChatGPT oder Claude, Berichte werden als HTML-Seiten exportiert, und Protokolldateien sind reiner Text. Früher oder später muss eines davon als PDF abgegeben werden, und manchmal als PDF, das aussieht, als käme es aus dem Scanner.

Look Scanned konnte .md-, .html- und .txt-Dateien schon bisher öffnen, allerdings nur als Beta-Formate. Die ganze Datei landete auf einer einzigen hohen Seite. Bei längeren Dateien lautete der Rat, sie zuerst im Browser als PDF zu drucken und dann dieses PDF zu scannen. Dieser Umweg entfällt. Alle drei Formate werden jetzt direkt im Browser auf A4-Seiten verteilt, und der Beta-Hinweis ist verschwunden.

Richtige Seiten, mit den Umbrüchen genau dort, wo Sie sie gesetzt haben

Egal, was Sie öffnen: Das Ergebnis ist ein Stapel Seiten und kein langer Streifen:

  • Der Text läuft von selbst auf die nächste Seite weiter.
  • Seitenumbrüche, die Sie in der Datei eingefügt haben, bleiben erhalten.
  • Eine lange Tabelle geht auf der nächsten Seite weiter, und keine Zeile wird in der Mitte durchgeschnitten.
  • Ein langer Codeblock wird auf der nächsten Seite fortgesetzt, und lange Zeilen werden umbrochen, statt über den Rand hinauszulaufen.
  • Ein Bild, das höher ist als die Seite, wird passend verkleinert.

Markdown

Markdown-Dateien erhalten die Formatierung, die Sie von GitHub kennen: Überschriften, Listen, Tabellen, Zitate und Codeblöcke mit Backticks. Bilder erscheinen, wenn sie in die Datei eingebettet oder mit einer vollständigen https://-Adresse verlinkt sind. Ein Bild, auf das mit einem relativen Pfad wie images/chart.png verwiesen wird, kann nicht gefunden werden, weil die Datei für sich allein geöffnet wird, ohne ihren Ordner.

Markdown hat keine eigene Syntax für einen Seitenumbruch. Fügen Sie deshalb überall dort, wo die nächste Seite beginnen soll, eine Zeile HTML ein:

<div style="break-before: page"></div>

Das ältere page-break-before: always funktioniert ebenfalls.

Hat ein KI-Assistent seine ganze Antwort in einen Codeblock gepackt, entfernen Sie die äußeren drei Backticks, bevor Sie die Datei speichern. Sonst wird das ganze Dokument zu einem einzigen Codeblock.

HTML

Eine HTML-Datei wird mit den Stilen gesetzt, die in ihr selbst stehen: ihren <style>-Blöcken und style-Attributen. Schriftarten, Farben, Abstände und Ihre break-before- oder page-break-before-Regeln gelten alle. Ein Stylesheet in einer separaten Datei wird nicht geladen. Bilder und Webfonts mit einer vollständigen https://-Adresse werden von dort abgerufen, wo sie liegen, und brauchen deshalb eine Internetverbindung. Ein relativer Pfad wie page_files/photo.jpg kann nicht gefunden werden, aus demselben Grund wie bei Markdown.

Die Seite wird wie ein Dokument zum Drucken behandelt, nicht wie eine Webseite, die ausgeführt wird. Skripte und eingebettete Frames werden entfernt, und nichts auf der Seite kann ausgeführt oder abgeschickt werden. Webseiten, die Ihr Browser als .mhtml oder .mht gespeichert hat, öffnen sich ebenfalls, mit den Bildern und Stilen, die im Archiv gespeichert sind. Für diese wird nichts aus dem Web abgerufen.

Reiner Text

Eine .txt-, .text- oder .log-Datei behält ihre Zeilenumbrüche und Einzüge. Zeilen, die breiter sind als die Seite, werden umbrochen statt abgeschnitten. Dateien werden als UTF-8 gelesen, und Tags oder Code im Text erscheinen genau so, wie sie getippt wurden.

So wird daraus ein gescanntes PDF

  1. Öffnen Sie Markdown in gescanntes PDF, HTML in gescanntes PDF oder TXT in gescanntes PDF. Jede der drei Seiten öffnet jedes der drei Formate.
  2. Wählen Sie Ihre Datei aus und warten Sie einen Moment, bis die Seiten gesetzt sind.
  3. Blättern Sie durch die Vorschau. Prüfen Sie, wo die Seiten umbrechen und ob Tabellen und Codeblöcke richtig aussehen.
  4. Passen Sie den Scan-Effekt an. Bei kleiner Schrift oder Code halten Sie Unschärfe und Rauschen niedrig, damit der Text gut lesbar bleibt.
  5. Klicken Sie auf „Gescanntes PDF generieren“ und danach auf „Gescanntes PDF herunterladen“.

Sie können jede Seite auch als JPG oder PNG speichern. Unser Leitfaden zu PDF, JPG und PNG erklärt, wann sich welches Format eignet. Mit Pro verarbeitet der Massenscan mehrere Dateien auf einmal.

Ihre Datei bleibt auf Ihrem Gerät

Die Datei wird auf Ihrem eigenen Gerät gesetzt und gescannt. Sie wird nicht auf einen Server hochgeladen. Die einzige Ausnahme ist eine HTML- oder Markdown-Datei, die auf Bilder oder Schriftarten im Web verweist: Diese werden von den Websites abgerufen, auf denen sie liegen, genau wie beim normalen Öffnen der Seite.

Gut zu wissen

  • Seiten sind immer A4 mit 2,54 cm Rand. Ein Papierformat oder ein Rand im CSS der Datei wird ignoriert. Wenn Sie US-Letter brauchen, wählen Sie es unter Papiereinstellungen aus, und jede Seite wird darauf eingepasst.
  • Die Schriftarten kommen von Ihrem Gerät. Sofern die eigenen Stile des HTML keine Webfonts laden, wird der Text in den Schriftarten gesetzt, die auf Ihrem Computer oder Smartphone installiert sind. Dieselbe Datei kann deshalb auf einem anderen Gerät anders umbrechen.
  • Formeln und Diagramme bleiben Text. Mathematik zwischen Dollarzeichen und Diagrammcode wie Mermaid erscheinen als der Text, den Sie getippt haben. Wenn sie gezeichnet werden sollen, exportieren Sie ein PDF aus einem Editor, der sie darstellt, und scannen Sie stattdessen dieses PDF.
  • Sehr lange Dateien können die Zeit überschreiten. Das Setzen der Seiten muss innerhalb von etwa 30 Sekunden abgeschlossen sein, deshalb kann eine riesige Protokolldatei oder eine buchlange Markdown-Datei mit einem Fehler abbrechen. Teilen Sie sie zuerst in kleinere Dateien auf.
  • Das Ergebnis besteht aus Bildern. Wie bei einem echten Scan lässt sich der Text nicht markieren oder durchsuchen. Behalten Sie die ursprüngliche Datei zum Bearbeiten.

Kam eine Markdown- oder HTML-Datei bei Ihnen bisher als eine lange Seite heraus? Probieren Sie es noch einmal.