بہت سی دستاویزات کبھی Word سے گزرتی ہی نہیں۔ میٹنگ کے نوٹس اور README فائلیں Markdown میں لکھی جاتی ہیں، ChatGPT یا Claude سے مسودے Markdown کی شکل میں نکلتے ہیں، رپورٹس HTML صفحات کے طور پر ایکسپورٹ ہوتی ہیں، اور لاگ سادہ متن ہوتے ہیں۔ آج نہیں تو کل ان میں سے کوئی ایک PDF کی صورت میں جمع کرانی پڑتی ہے، اور کبھی ایسی PDF کے طور پر جو اسکینر سے نکلی ہوئی لگے۔

Look Scanned پہلے بھی .md، .html اور .txt فائلیں کھول لیتا تھا، مگر صرف تجرباتی فارمیٹس کے طور پر۔ پوری فائل ایک لمبے صفحے پر آ جاتی تھی۔ کسی لمبی فائل کے لیے مشورہ یہ تھا کہ پہلے اسے براؤزر سے PDF میں پرنٹ کریں اور پھر اسے اسکین کریں۔ اب اس چکر کی ضرورت نہیں رہی۔ تینوں فارمیٹس اب آپ کے براؤزر کے اندر A4 صفحات میں ترتیب پاتے ہیں، اور تجرباتی والا لیبل ہٹ گیا ہے۔

اصل صفحات، اور پیج بریک وہیں جہاں آپ نے لگائے

آپ جو بھی کھولیں، نتیجہ ایک لمبی پٹی نہیں بلکہ صفحات کا ایک سیٹ ہوتا ہے:

  • متن خود ہی اگلے صفحے پر چلا جاتا ہے۔
  • فائل میں آپ کے لگائے ہوئے پیج بریک برقرار رہتے ہیں۔
  • لمبا جدول اگلے صفحے پر جاری رہتا ہے، اور کوئی قطار کبھی بیچ سے نہیں کٹتی۔
  • لمبا کوڈ بلاک اگلے صفحے پر جاری رہتا ہے، اور لمبی سطریں کنارے سے باہر نکلنے کے بجائے اگلی سطر میں آ جاتی ہیں۔
  • صفحے سے اونچی تصویر چھوٹی کر دی جاتی ہے تاکہ صفحے میں آ جائے۔

Markdown

Markdown فائلوں کو وہی فارمیٹنگ ملتی ہے جو آپ GitHub پر دیکھتے ہیں: عنوانات، فہرستیں، جدول، اقتباسات اور کوڈ بلاکس۔ تصویریں اس وقت نظر آتی ہیں جب وہ فائل میں شامل ہوں یا مکمل https:// ایڈریس سے لنک ہوں۔ images/chart.png جیسے نسبتی راستے (relative path) سے حوالہ دی گئی تصویر نہیں مل سکتی، کیونکہ فائل اپنے فولڈر کے بغیر اکیلی کھولی جاتی ہے۔

Markdown میں پیج بریک کے لیے اپنا کوئی سنٹیکس نہیں، اس لیے جہاں سے اگلا صفحہ شروع ہونا چاہیے وہاں HTML کی ایک سطر لگا دیں:

<div style="break-before: page"></div>

پرانا page-break-before: always بھی کام کرتا ہے۔

اگر کسی AI اسسٹنٹ نے اپنا پورا جواب ایک کوڈ بلاک میں لپیٹ دیا ہو تو فائل محفوظ کرنے سے پہلے باہر والے تین بیک ٹِکس ہٹا دیں، ورنہ پوری دستاویز ایک ہی کوڈ بلاک بن کر نکلے گی۔

HTML

HTML فائل اپنے اندر لکھے اسٹائلز کے مطابق ترتیب پاتی ہے: اس کے <style> بلاکس اور style ایٹریبیوٹس۔ فونٹس، رنگ، فاصلے اور آپ کے break-before یا page-break-before قواعد، سب لاگو ہوتے ہیں۔ الگ فائل میں رکھی اسٹائل شیٹ لوڈ نہیں ہوتی۔ مکمل https:// ایڈریس والی تصویریں اور ویب فونٹس وہیں سے حاصل کیے جاتے ہیں جہاں وہ موجود ہیں، اس لیے انٹرنیٹ کنکشن درکار ہوتا ہے۔ page_files/photo.jpg جیسا نسبتی راستہ نہیں مل سکتا، اسی وجہ سے جو Markdown میں ہے۔

صفحے کو پرنٹ کی جانے والی دستاویز سمجھا جاتا ہے، چلائے جانے والے ویب صفحے کے طور پر نہیں۔ اسکرپٹس اور ایمبیڈڈ فریمز ہٹا دیے جاتے ہیں، اور صفحے پر کوئی چیز نہ چل سکتی ہے نہ جمع (submit) ہو سکتی ہے۔ براؤزر کے ذریعے .mhtml یا .mht کے طور پر محفوظ کیے گئے ویب صفحات بھی کھلتے ہیں، آرکائیو کے اندر محفوظ تصویروں اور اسٹائلز کے ساتھ۔ ان کے لیے ویب سے کچھ بھی حاصل نہیں کیا جاتا۔

سادہ متن

.txt، .text یا .log فائل میں سطروں کے بریک اور انڈینٹ برقرار رہتے ہیں۔ صفحے سے زیادہ چوڑی سطریں کٹنے کے بجائے اگلی سطر میں آ جاتی ہیں۔ فائلیں UTF-8 کے طور پر پڑھی جاتی ہیں، اور متن میں موجود کوئی بھی ٹیگ یا کوڈ بالکل ویسا ہی نظر آتا ہے جیسا ٹائپ کیا گیا تھا۔

ان میں سے کسی کو اسکین شدہ PDF میں کیسے بدلیں

  1. Markdown سے اسکین شدہ PDF، HTML سے اسکین شدہ PDF یا TXT سے اسکین شدہ PDF کھولیں۔ ان تینوں میں سے ہر صفحہ تینوں فارمیٹس کھول سکتا ہے۔ یہ صفحات انگریزی میں ہیں۔
  2. اپنی فائل منتخب کریں اور صفحات ترتیب پانے تک ذرا انتظار کریں۔
  3. پیش منظر میں صفحے پلٹ کر دیکھیں۔ چیک کریں کہ صفحات کہاں ٹوٹتے ہیں اور جدول اور کوڈ بلاکس ٹھیک نظر آتے ہیں۔
  4. اسکین کا اثر حسبِ ضرورت بدلیں۔ چھوٹی تحریر یا کوڈ کے لیے بلر اور نوائز کم رکھیں تاکہ متن آسانی سے پڑھا جا سکے۔
  5. پہلے “Generate Scanned PDF” اور پھر “Download Scanned PDF” پر کلک کریں۔

آپ ہر صفحہ JPG یا PNG تصویر کے طور پر بھی محفوظ کر سکتے ہیں۔ PDF، JPG اور PNG کی رہنمائی میں بتایا گیا ہے کہ کون سا فارمیٹ کب بہتر ہے۔ Pro کے ساتھ Bulk Scan ایک ساتھ کئی فائلیں پروسیس کر سکتا ہے۔

آپ کی فائل آپ کے آلے پر ہی رہتی ہے

فائل آپ کے اپنے آلے پر ہی ترتیب پاتی اور اسکین ہوتی ہے۔ اسے کسی سرور پر اپ لوڈ نہیں کیا جاتا۔ صرف ایک استثنا ہے: وہ HTML یا Markdown فائل جو ویب پر موجود تصویروں یا فونٹس سے لنک کرتی ہو۔ یہ ان سائٹس سے حاصل کیے جاتے ہیں جہاں وہ رکھے ہیں، بالکل ویسے ہی جیسے عام طریقے سے صفحہ کھولنے پر ہوتا ہے۔

یہ باتیں جان لیں

  • صفحات ہمیشہ ایک انچ حاشیے کے ساتھ A4 ہوتے ہیں۔ فائل کی اپنی CSS میں دیا گیا کاغذ کا سائز یا حاشیہ نظر انداز کر دیا جاتا ہے۔ اگر آپ کو US Letter چاہیے تو Paper Settings (کاغذ کی ترتیبات) میں اسے منتخب کریں، اور ہر صفحہ اس پر فٹ کر دیا جاتا ہے۔
  • فونٹس آپ کے آلے سے آتے ہیں۔ جب تک HTML کے اپنے اسٹائلز ویب فونٹس لوڈ نہ کریں، متن آپ کے کمپیوٹر یا فون پر نصب فونٹس میں دکھایا جاتا ہے، اس لیے ایک ہی فائل کے صفحات کسی دوسری مشین پر مختلف جگہوں سے ٹوٹ سکتے ہیں۔
  • فارمولے اور ڈایاگرام متن ہی رہتے ہیں۔ ڈالر کی علامتوں کے بیچ لکھی ریاضی اور Mermaid جیسا ڈایاگرام کوڈ اسی متن کی صورت میں نظر آتا ہے جو آپ نے ٹائپ کیا۔ اگر آپ انھیں بنی ہوئی شکل میں چاہتے ہیں تو کسی ایسے ایڈیٹر سے PDF ایکسپورٹ کریں جو انھیں رینڈر کرتا ہو، اور اس PDF کو اسکین کریں۔
  • بہت لمبی فائلوں کا وقت ختم ہو سکتا ہے۔ ترتیب کا کام تقریباً 30 سیکنڈ کے اندر مکمل ہونا چاہیے، اس لیے کوئی بہت بڑی لاگ فائل یا کتاب جتنی لمبی Markdown فائل غلطی کے ساتھ رک سکتی ہے۔ اسے پہلے چھوٹی فائلوں میں تقسیم کر لیں۔
  • آؤٹ پٹ تصویروں سے بنا ہوتا ہے۔ اصلی اسکین کی طرح متن نہ منتخب ہو سکتا ہے، نہ اس میں تلاش ہو سکتی ہے۔ ترمیم کے لیے اصل فائل سنبھال کر رکھیں۔

کیا پہلے کوئی Markdown یا HTML فائل ایک لمبے صفحے کی صورت میں نکلی تھی؟ اسے دوبارہ آزمائیں۔