Wiele dokumentów nigdy nie przechodzi przez Worda. Notatki ze spotkań i pliki README powstają w formacie Markdown, ChatGPT czy Claude zwracają szkice jako Markdown, raporty są eksportowane do stron HTML, a logi to zwykły tekst. Wcześniej czy później któryś z nich trzeba oddać jako PDF, a czasem jako PDF wyglądający tak, jakby wyszedł ze skanera.

Look Scanned już wcześniej otwierał pliki .md, .html i .txt, ale tylko jako formaty w wersji beta. Cały plik trafiał na jedną długą stronę. Przy czymś dłuższym radziliśmy najpierw wydrukować go do PDF z przeglądarki i zeskanować ten PDF. Ta droga naokoło zniknęła. Wszystkie trzy formaty są teraz układane na stronach A4 w Twojej przeglądarce, a oznaczenie beta zniknęło.

Prawdziwe strony z podziałami tam, gdzie je wstawisz

Cokolwiek otworzysz, wynikiem jest stos stron, a nie jeden długi pasek:

  • Tekst sam przechodzi na następną stronę.
  • Podziały stron dodane w pliku zostają zachowane.
  • Długa tabela przechodzi na następną stronę, a wiersz nigdy nie jest przecinany na pół.
  • Długi blok kodu jest kontynuowany na następnej stronie, a długie wiersze są zawijane, zamiast uciekać za krawędź.
  • Obraz wyższy niż strona jest zmniejszany, żeby się zmieścił.

Markdown

Pliki Markdown dostają formatowanie znane z GitHuba: nagłówki, listy, tabele, cytaty i bloki kodu w potrójnych odwrotnych apostrofach. Obrazy pojawiają się, gdy są osadzone w pliku lub podlinkowane pełnym adresem https://. Obrazu wskazanego ścieżką względną, taką jak images/chart.png, nie da się znaleźć, bo plik jest otwierany sam, bez swojego folderu.

Markdown nie ma własnej składni podziału strony, więc tam, gdzie ma się zacząć następna strona, wstawiasz wiersz HTML:

<div style="break-before: page"></div>

Starsze page-break-before: always też działa.

Jeśli asystent AI zamknął całą odpowiedź w bloku kodu, usuń zewnętrzne potrójne odwrotne apostrofy przed zapisaniem pliku, bo inaczej cały dokument wyjdzie jako jeden blok kodu.

HTML

Plik HTML jest układany według stylów zapisanych w jego środku: bloków <style> i atrybutów style. Czcionki, kolory, odstępy oraz Twoje reguły break-before lub page-break-before są stosowane. Arkusz stylów trzymany w osobnym pliku nie jest wczytywany. Obrazy i czcionki internetowe z pełnym adresem https:// są pobierane z miejsca, w którym się znajdują, więc wymagają połączenia z internetem. Ścieżki względnej, takiej jak page_files/photo.jpg, nie da się znaleźć, z tego samego powodu co w Markdown.

Strona jest traktowana jak dokument do wydruku, a nie jak działająca strona internetowa. Skrypty i osadzone ramki są usuwane, a nic na stronie nie może się uruchomić ani zostać wysłane. Strony internetowe zapisane przez przeglądarkę jako .mhtml lub .mht też się otwierają, z obrazami i stylami zapisanymi w archiwum. Dla nich nic nie jest pobierane z internetu.

Zwykły tekst

Plik .txt, .text lub .log zachowuje podziały wierszy i wcięcia. Wiersze szersze niż strona są zawijane, a nie ucinane. Pliki są odczytywane jako UTF-8, a wszystkie tagi czy kod w tekście wyglądają dokładnie tak, jak zostały wpisane.

Jak zamienić taki plik w zeskanowany PDF

  1. Otwórz Markdown na zeskanowany PDF, HTML na zeskanowany PDF lub TXT na zeskanowany PDF. Każda z tych trzech stron otwiera każdy z trzech formatów.
  2. Wybierz plik i chwilę poczekaj, aż strony zostaną ułożone.
  3. Przejrzyj podgląd. Sprawdź, gdzie wypadają podziały stron i czy tabele oraz bloki kodu wyglądają dobrze.
  4. Dostosuj efekt skanowania. Przy drobnym tekście lub kodzie ustaw niewielkie rozmycie i szum, żeby tekst był łatwy do przeczytania.
  5. Kliknij „Generuj zeskanowany PDF”, a potem „Pobierz zeskanowany PDF”.

Każdą stronę możesz też zapisać jako JPG lub PNG. Kiedy który format ma sens, wyjaśnia nasz poradnik o PDF, JPG i PNG. W wersji Pro skanowanie zbiorcze obsłuży kilka plików naraz.

Plik zostaje na Twoim urządzeniu

Plik jest układany na stronach i skanowany na Twoim urządzeniu. Nie jest wysyłany na serwer. Jedyny wyjątek to plik HTML lub Markdown, który prowadzi do obrazów lub czcionek w internecie: są one pobierane z serwisów, które je udostępniają, tak samo jak przy zwykłym otwarciu strony.

Warto wiedzieć

  • Strony są zawsze w formacie A4 z marginesami 2,54 cm. Rozmiar papieru lub marginesy ustawione w CSS pliku są ignorowane. Jeśli potrzebujesz US Letter, wybierz go w „Ustawieniach papieru”, a każda strona zostanie dopasowana do tego formatu.
  • Czcionki pochodzą z Twojego urządzenia. Jeśli własne style HTML nie wczytują czcionek internetowych, tekst jest składany czcionkami zainstalowanymi na Twoim komputerze lub telefonie, więc na innym komputerze ten sam plik może dzielić strony inaczej.
  • Wzory i diagramy pozostają tekstem. Wzory matematyczne między znakami dolara i kod diagramów, taki jak Mermaid, pojawiają się jako wpisany tekst. Jeśli mają być narysowane, wyeksportuj PDF z edytora, który je renderuje, i zeskanuj ten PDF.
  • Bardzo długie pliki mogą przekroczyć limit czasu. Układanie musi się zakończyć w około 30 sekund, więc ogromny plik logu lub plik Markdown wielkości książki może zatrzymać się z błędem. Najpierw podziel go na mniejsze pliki.
  • Wynik składa się z obrazów. Jak w prawdziwym skanie, tekstu nie da się zaznaczyć ani przeszukać. Zachowaj oryginalny plik do edycji.

Plik Markdown lub HTML wychodził wcześniej jako jedna długa strona? Spróbuj jeszcze raz.