Beaucoup de documents ne passent jamais par Word. Les comptes rendus de réunion et les README s’écrivent en Markdown, les brouillons sortent de ChatGPT ou de Claude en Markdown, les rapports sont exportés en pages HTML et les journaux sont du texte brut. Tôt ou tard, il faut en remettre un en PDF, et parfois en PDF qui semble sortir d’un scanner.

Look Scanned savait déjà ouvrir les fichiers .md, .html et .txt, mais seulement en tant que formats bêta. Tout le fichier s’affichait sur une seule page très longue. Pour un fichier plus long, le conseil était de l’imprimer d’abord en PDF depuis votre navigateur, puis de numériser ce PDF. Ce détour n’a plus lieu d’être. Les trois formats sont désormais mis en page en A4 dans votre navigateur, et la mention bêta a disparu.

De vraies pages, avec les sauts là où vous les avez mis

Quel que soit le fichier ouvert, le résultat est une série de pages et non une longue bande :

  • Le texte passe tout seul à la page suivante.
  • Les sauts de page que vous avez ajoutés dans le fichier sont conservés.
  • Un long tableau continue sur la page suivante, et une ligne n’est jamais coupée en deux.
  • Un long bloc de code continue sur la page suivante, et les longues lignes sont repliées au lieu de dépasser du bord.
  • Une image plus haute que la page est réduite pour y tenir.

Markdown

Les fichiers Markdown reçoivent la mise en forme que vous connaissez de GitHub : titres, listes, tableaux, citations et blocs de code délimités. Les images s’affichent lorsqu’elles sont intégrées au fichier ou liées par une adresse https:// complète. Une image référencée par un chemin relatif tel que images/chart.png est introuvable, car le fichier est ouvert seul, sans son dossier.

Markdown n’a pas de syntaxe propre pour le saut de page ; vous insérez donc une ligne de HTML là où la page suivante doit commencer :

<div style="break-before: page"></div>

L’ancienne règle page-break-before: always fonctionne aussi.

Si un assistant IA a placé toute sa réponse dans un bloc de code, retirez les trois accents graves extérieurs avant d’enregistrer le fichier, sinon tout le document ressort en un seul bloc de code.

HTML

Un fichier HTML est mis en page avec les styles écrits à l’intérieur : ses blocs <style> et ses attributs style. Polices, couleurs, espacements et vos règles break-before ou page-break-before s’appliquent. Une feuille de style conservée dans un fichier séparé n’est pas chargée. Les images et les polices web dotées d’une adresse https:// complète sont récupérées depuis l’endroit où elles sont hébergées ; il faut donc une connexion Internet. Un chemin relatif tel que page_files/photo.jpg est introuvable, pour la même raison qu’en Markdown.

La page est traitée comme un document à imprimer, pas comme une page web à exécuter. Les scripts et les cadres intégrés sont retirés, et rien sur la page ne peut s’exécuter ni être envoyé. Les pages web enregistrées par votre navigateur en .mhtml ou .mht s’ouvrent aussi, avec les images et les styles conservés dans l’archive. Pour celles-ci, rien n’est récupéré sur le web.

Texte brut

Un fichier .txt, .text ou .log garde ses retours à la ligne et son indentation. Les lignes plus larges que la page sont repliées au lieu d’être tronquées. Les fichiers sont lus en UTF-8, et les balises ou le code présents dans le texte apparaissent exactement comme ils ont été tapés.

Comment en faire un PDF numérisé

  1. Ouvrez Markdown en PDF numérisé, HTML en PDF numérisé ou TXT en PDF numérisé. Chacune des trois pages ouvre les trois formats.
  2. Sélectionnez votre fichier et patientez un instant, le temps que les pages soient mises en page.
  3. Feuilletez l’aperçu. Vérifiez où tombent les sauts de page et que les tableaux et les blocs de code sont corrects.
  4. Réglez l’effet de numérisation. Pour les petits caractères ou le code, gardez le flou et le bruit faibles afin que le texte reste facile à lire.
  5. Cliquez sur « Générer le PDF numérisé », puis sur « Télécharger le PDF numérisé ».

Vous pouvez aussi enregistrer chaque page en image JPG ou PNG. Notre guide PDF, JPG et PNG explique quand choisir l’un ou l’autre. Avec Pro, la numérisation par lots traite plusieurs fichiers à la fois.

Votre fichier reste sur votre appareil

Le fichier est mis en page et numérisé sur votre propre appareil. Il n’est pas envoyé sur un serveur. Seule exception : un fichier HTML ou Markdown qui renvoie à des images ou des polices sur le web. Celles-ci sont récupérées depuis les sites qui les hébergent, exactement comme si vous ouvriez la page normalement.

Bon à savoir

  • Les pages sont toujours en A4 avec des marges de 2,54 cm. Un format de papier ou une marge définis dans le CSS du fichier sont ignorés. Si vous avez besoin du format Lettre US, choisissez-le dans Paramètres du papier : chaque page est alors ajustée à ce format.
  • Les polices viennent de votre appareil. Sauf si les propres styles du HTML chargent des polices web, le texte est composé avec les polices installées sur votre ordinateur ou votre téléphone ; le même fichier peut donc être paginé différemment sur une autre machine.
  • Les formules et les diagrammes restent du texte. Les mathématiques entre signes dollar et le code de diagrammes comme Mermaid apparaissent tels que vous les avez tapés. Si vous avez besoin qu’ils soient dessinés, exportez un PDF depuis un éditeur qui les affiche et numérisez ce PDF à la place.
  • Les fichiers très longs peuvent manquer de temps. La mise en page doit se terminer en 30 secondes environ ; un énorme fichier journal ou un fichier Markdown de la taille d’un livre peut donc s’arrêter sur une erreur. Découpez-le d’abord en fichiers plus petits.
  • Le résultat est composé d’images. Comme pour une vraie numérisation, le texte ne peut pas être sélectionné ni recherché. Gardez le fichier d’origine pour les modifications.

Un fichier Markdown ou HTML s’affichait jusqu’ici sur une seule longue page ? Essayez-le à nouveau.