آپ نے کوئی دستاویز اسکین کی، پی ڈی ایف کھولی، ایک پیراگراف کاپی کرنا چاہا، مگر کچھ منتخب ہی نہیں ہو رہا۔ کوئی نام تلاش کیا تو کچھ نہ ملا۔ یہ کوئی خرابی نہیں: اسکینر یا فون کا کیمرہ صفحے کی تصویر محفوظ کرتا ہے۔ OCR (آپٹیکل کریکٹر ریکگنیشن) اسی تصویر کو پڑھ کر شکلوں کو اصل حروف میں بدل دیتا ہے، تاکہ آپ متن کو تلاش، منتخب اور کاپی کر سکیں۔
دو عام کام
- پی ڈی ایف جوں کی توں رکھنی ہے، بس قابلِ تلاش بنانی ہے۔ پی ڈی ایف OCR ٹول استعمال کریں۔ نتیجہ آپ کے اسکین جیسا ہی دکھتا ہے مگر اس کا متن منتخب اور تلاش کیا جا سکتا ہے۔
- تصویر یا اسکرین شاٹ سے صرف متن چاہیے۔ تصویر سے متن استعمال کریں، جو تصویر سے کاپی کرنے لائق متن نکالتا ہے۔ انگریزی اور ہندی اس میں پہلے سے شامل ہیں۔
مراحل

- اسکین شدہ پی ڈی ایف یا تصویر متعلقہ ٹول میں اپ لوڈ کریں۔
- شناخت مکمل ہونے کا انتظار کریں۔ لمبی دستاویز میں زیادہ وقت لگتا ہے کیونکہ ہر صفحہ جانچا جاتا ہے۔
- قابلِ تلاش پی ڈی ایف ڈاؤن لوڈ کریں، یا نکلا ہوا متن کاپی کریں۔
- متن غور سے پڑھ کر درست کریں۔ صاف چھپے ہوئے متن پر OCR بہت اچھا ہوتا ہے، مگر کبھی سو فیصد درست نہیں ہوتا۔
OCR چلانے سے پہلے بہتر نتیجے کے لیے
- ریزولوشن: چھپے ہوئے متن کے لیے 300 dpi بہترین سمجھا جاتا ہے۔ تقریباً 150 dpi سے کم پر چھوٹے حروف آپس میں مل جاتے ہیں۔
- سیدھا صفحہ: ٹیڑھی تصویر میں سطریں جھکی دکھائی دیتی ہیں۔ صفحہ ہموار رکھیں اور فون کو اس کے متوازی پکڑیں۔ ضرورت ہو تو پہلے پی ڈی ایف گھمائیں سے صفحے سیدھے کر لیں۔
- اچھی روشنی، سایہ نہیں: آپ کے ہاتھ کا سایہ بھی تصویر کا حصہ سمجھا جاتا ہے۔
- زیادہ کنٹراسٹ: سفید کاغذ پر کالا متن سب سے بہتر رہتا ہے۔ مدھم مہر یا رنگین پس منظر سے درستی گھٹتی ہے۔
- ایک صفحے پر ایک ہی زبان: ملی جلی تحریریں پہچاننا مشکل ہوتا ہے۔
اردو متن میں کن باتوں کا خیال رکھیں
اردو کا رسم الخط نستعلیق انداز کا ہوتا ہے، جس کے حروف جڑتے وقت شکل بدلتے ہیں اور نقطے و اعراب باریک ہوتے ہیں، اس لیے OCR میں غلطی کا امکان انگریزی سے زیادہ رہتا ہے۔ نتیجے میں خاص طور پر نقطے، ہمزہ، گول ہ اور بڑی ے کی شکلیں دیکھ لیں۔ نام، پتے اور تاریخیں اصل دستاویز سے ملانا نہ بھولیں۔ یاد رہے کہ فی الحال انگریزی اور ہندی ٹول میں پہلے سے دستیاب ہیں؛ دوسری زبانوں کا انحصار سرور پر نصب لینگویج پیک پر ہے، اس لیے ٹول کا صفحہ دیکھ لیں۔
OCR کے بعد کیا جانچیں
سب سے پہلے اعداد پڑھیں۔ ملتی جلتی شکلیں کلاسک غلطیاں ہیں: حرف O اور عدد 0، حرف l اور عدد 1، یا 5 اور S۔ نام، تاریخ، رقم اور حوالہ نمبر اصل سے ملائیں۔ جدول اور ہاتھ کی لکھائی سب سے مشکل ہیں؛ ہاتھ کی لکھائی اکثر بھروسے کے ساتھ نہیں پہچانی جاتی۔
OCR اور فائل کا سائز
قابلِ تلاش پی ڈی ایف کا سائز اسکین کے برابر ہوتا ہے اور اس میں ایک غیر مرئی متن کی تہہ شامل ہو جاتی ہے۔ اگر اپ لوڈ کے لیے بھاری لگے تو بعد میں اسے کمپریس کر لیں۔
اکثر پوچھے جانے والے سوالات
کیسے پتا چلے کہ میری پی ڈی ایف کو OCR چاہیے؟
متن منتخب کرنے یا کوئی لفظ تلاش کرنے کی کوشش کریں۔ اگر کچھ ہائی لائٹ نہ ہو یا نہ ملے تو صفحے تصویر ہیں اور OCR درکار ہے۔
کیا OCR ہاتھ کی لکھائی پڑھ لیتا ہے؟
صرف جزوی طور پر۔ یہ چھپے ہوئے متن کے لیے بنا ہے۔ الگ الگ صاف حروف میں لکھا متن جڑی ہوئی لکھائی سے بہتر پہچانا جاتا ہے، پھر بھی نتیجہ ضرور جانچیں۔
کون سی زبانیں سپورٹ ہوتی ہیں؟
انگریزی اور ہندی پہلے سے دستیاب ہیں۔ دیگر زبانیں سرور پر نصب لینگویج پیک پر منحصر ہیں، اس لیے ٹول کا صفحہ دیکھ لیں۔
کیا OCR سے میری دستاویز کی شکل بدل جائے گی؟
قابلِ تلاش پی ڈی ایف میں صفحے کی تصویر ویسی ہی رہتی ہے؛ پہچانا گیا متن اس کے پیچھے غیر مرئی طور پر جوڑ دیا جاتا ہے۔