Чимало документів ніколи не проходять через Word. Нотатки з нарад і файли README пишуть у Markdown, чернетки з ChatGPT чи Claude приходять у Markdown, звіти експортують як HTML-сторінки, а логи — це звичайний текст. Рано чи пізно якийсь із них доводиться подати як PDF, а іноді — як PDF, що виглядає так, ніби його зняли зі сканера.
Look Scanned і раніше відкривав файли .md, .html і .txt, але лише як бета-формати. Увесь файл виходив однією довгою сторінкою. Для чогось довшого ми радили спершу роздрукувати його у PDF із браузера і сканувати вже той PDF. Цей обхідний шлях більше не потрібен. Усі три формати тепер розкладаються на сторінки A4 у вашому браузері, а позначку «бета» знято.
Справжні сторінки з розривами там, де ви їх поставили
Що б ви не відкрили, у результаті буде стос сторінок, а не одна довга смуга:
- Текст сам переходить на наступну сторінку.
- Розриви сторінок, додані у файлі, зберігаються.
- Довга таблиця продовжується на наступній сторінці, і рядок ніколи не розрізається навпіл.
- Довгий блок коду продовжується на наступній сторінці, а довгі рядки переносяться, а не виходять за край.
- Зображення, яке вище за сторінку, зменшується, щоб уміститися.
Markdown
Файли Markdown отримують знайоме з GitHub форматування: заголовки, списки, таблиці, цитати й блоки коду в потрійних зворотних апострофах. Зображення показуються, якщо вони вбудовані у файл або вказані за повною адресою https://. Зображення, на яке вказує відносний шлях, як-от images/chart.png, знайти не вдасться, бо файл відкривається сам по собі, без своєї папки.
У Markdown немає власного синтаксису для розриву сторінки, тому там, де має починатися наступна сторінка, вставте рядок HTML:
<div style="break-before: page"></div>
Старіше page-break-before: always також працює.
Якщо ШІ-асистент загорнув усю відповідь у блок коду, перед збереженням файлу видаліть зовнішні потрійні зворотні апострофи, інакше весь документ стане одним блоком коду.
HTML
Файл HTML розкладається за стилями, записаними всередині нього: блоками <style> та атрибутами style. Шрифти, кольори, відступи та ваші правила break-before чи page-break-before — усе застосовується. Таблиця стилів, винесена в окремий файл, не завантажується. Зображення й вебшрифти з повною адресою https:// завантажуються звідти, де вони розміщені, тому для них потрібне з’єднання з інтернетом. Відносний шлях, як-от page_files/photo.jpg, знайти не вдасться — з тієї ж причини, що й у Markdown.
Сторінка обробляється як документ для друку, а не як вебсторінка, яку потрібно запускати. Скрипти та вбудовані фрейми вилучаються, і ніщо на сторінці не може виконуватися чи надсилатися. Вебсторінки, збережені браузером як .mhtml або .mht, також відкриваються — із зображеннями й стилями, збереженими всередині архіву. Для них нічого не завантажується з інтернету.
Звичайний текст
Файл .txt, .text або .log зберігає переноси рядків і відступи. Рядки, ширші за сторінку, переносяться, а не обрізаються. Файли читаються в кодуванні UTF-8, а будь-які теги чи код у тексті виглядають точно так, як їх набрано.
Як перетворити такий файл на скан-копію PDF
- Відкрийте Markdown у скан-копію PDF, HTML у скан-копію PDF або TXT у скан-копію PDF. Будь-яка з трьох сторінок відкриває будь-який із трьох форматів.
- Виберіть файл і трохи зачекайте, поки сторінки розкладуться.
- Погортайте попередній перегляд. Перевірте, де закінчуються сторінки й чи добре виглядають таблиці та блоки коду.
- Налаштуйте ефект сканування. Для дрібного тексту чи коду залиште небагато розмиття й шуму, щоб текст легко читався.
- Натисніть «Створити скан-копію PDF», а потім «Зберегти скан-копію PDF».
Також можна зберегти кожну сторінку як JPG або PNG. Коли який формат доречний, пояснює наш порадник про PDF, JPG і PNG. А в пакетному скануванні, функції Pro, можна обробити одразу кілька файлів.
Файл залишається на вашому пристрої
Файл розкладається на сторінки й сканується на вашому пристрої. На сервер його не надсилають. Єдиний виняток — файл HTML або Markdown із посиланнями на зображення чи шрифти в інтернеті: їх завантажують із сайтів, де вони розміщені, так само, як при звичайному відкритті сторінки.
Що варто знати
- Сторінки завжди A4 з полями 2,54 см. Розмір паперу чи поля, задані у CSS самого файлу, ігноруються. Якщо потрібен US Letter, виберіть його в «Налаштуваннях паперу», і кожна сторінка буде вміщена в цей формат.
- Шрифти беруться з вашого пристрою. Якщо власні стилі HTML не підключають вебшрифтів, текст набирається шрифтами, встановленими на вашому комп’ютері чи телефоні, тому на іншому пристрої той самий файл може розбитися на сторінки інакше.
- Формули й діаграми залишаються текстом. Математика між знаками долара та код діаграм, як-от Mermaid, виводяться як набраний вами текст. Якщо їх потрібно намалювати, експортуйте PDF із редактора, який їх відображає, і скануйте вже той PDF.
- Дуже довгі файли можуть не вкластися в час. Розкладання має завершитися приблизно за 30 секунд, тому величезний лог-файл або Markdown завбільшки з книжку може зупинитися з помилкою. Спершу розділіть його на менші файли.
- Результат складається із зображень. Як і в справжній скан-копії, текст не можна виділити чи знайти пошуком. Збережіть оригінальний файл для редагування.
Раніше файл Markdown або HTML перетворювався на одну довгу сторінку? Спробуйте ще раз.