PDF کو ٹیکسٹ میں بدلنے کا طریقہ
- اپنی PDF شامل کریں: فائل اوپر والے باکس میں ڈالیں، یا ٹیپ کر کے فون یا کمپیوٹر سے چنیں۔
- صفحات چنیں: “تمام صفحات” رہنے دیں، یا “صفحات چنیں” دبا کر مطلوبہ صفحے لکھیں، مثلاً 1-3, 5 یا 8-۔
- ضرورت ہو تو صفحوں کے نشان لگائیں: “ہر صفحے کے شروع میں نشان لگائیں” آن کریں تو ہر صفحے سے پہلے ----- صفحہ 3 ----- جیسی لائن آ جاتی ہے۔
- “ٹیکسٹ نکالیں” دبائیں: پیش رفت کی پٹی بتاتی ہے کہ کون سا صفحہ پڑھا جا رہا ہے۔
- کاپی یا محفوظ کریں: “کاپی کریں” سے ٹیکسٹ کہیں اور پیسٹ کریں، یا “.txt ڈاؤن لوڈ کریں” سے اسے UTF-8 ٹیکسٹ فائل کی صورت میں محفوظ کریں۔
خصوصیات
- پڑھنے کے قابل نتیجہ: الفاظ دوبارہ لائنوں میں جوڑے جاتے ہیں، اور جہاں صفحے کا فاصلہ نیا پیراگراف دکھائے وہاں، اور صفحات کے درمیان، ایک خالی لائن آتی ہے۔
- دو کالم والے صفحات کالم در کالم پڑھے جاتے ہیں، دونوں کالموں کی لائنیں آپس میں نہیں ملتیں۔ دونوں کالموں پر پھیلی سرخیاں اپنی جگہ رہتی ہیں۔
- ٹیبل الگ الگ رہتے ہیں: لائن کے اندر بڑے خلا ٹیب بن جاتے ہیں، اس لیے قطاریں اسپریڈ شیٹ میں صاف پیسٹ ہوتی ہیں۔
- صفحات کی رینج، بشمول 8- جیسی کھلی رینج جس کا مطلب ہے “صفحہ 8 سے آخر تک”۔
- صفحوں کے اختیاری نشان، جنہیں ٹیکسٹ نکالنے کے بعد بھی فائل دوبارہ پڑھے بغیر آن یا آف کیا جا سکتا ہے۔
- ایک نظر میں گنتی: حروف، الفاظ اور صفحات کی تعداد ٹیکسٹ کے اوپر نظر آتی ہے۔
- اسکین شدہ صفحات کی پہچان: جن صفحات پر ٹیکسٹ کی تہہ نہیں، ان کے نمبر بتائے جاتے ہیں تاکہ آپ جان لیں کہ کن کے لیے OCR چاہیے۔
- دائیں سے بائیں زبانوں کی سپورٹ: اردو، عربی، فارسی اور عبرانی ٹیکسٹ کے لیے۔
PDF کا ٹیکسٹ نکالنے کے لیے Fileora کیوں استعمال کریں
PDF ویوئر سے سیدھا ٹیکسٹ کاپی کرنا اکثر مشکل ہوتا ہے۔ سلیکشن ایک کالم سے دوسرے میں کود جاتی ہے، جملوں کے بیچ میں لائن ٹوٹ جاتی ہے، اور فون پر ایک پیراگراف سے زیادہ منتخب کرنا تقریباً ناممکن ہوتا ہے۔ پوری دستاویز کا ٹیکسٹ ایک ساتھ نکالنے سے آپ کو صاف ٹیکسٹ ملتا ہے جسے حوالہ دینے، ترجمہ کرنے، تلاش کرنے، خلاصہ بنانے یا دوبارہ استعمال کرنے میں آسانی رہتی ہے۔
Fileora آپ کی PDF براؤزر ہی میں پڑھتا ہے، اس لیے معاہدے، بینک اسٹیٹمنٹ اور امتحانی پرچے آپ کے ڈیوائس سے باہر نہیں جاتے۔ نہ سائن اپ، نہ واٹرمارک اور نہ صفحات کی کوئی حد، اور ٹول فون پر بھی ویسے ہی چلتا ہے جیسے لیپ ٹاپ پر۔ ٹیکسٹ ملنے کے بعد اسے الفاظ گنیں میں پیسٹ کر کے لمبائی اور پڑھنے کا وقت دیکھ سکتے ہیں۔
جب ٹیکسٹ نہ نکلے
کوئی PDF اسکرین پر ٹیکسٹ جیسی دکھ سکتی ہے لیکن اندر صرف تصاویر ہوتی ہیں۔ فون سے اسکین کیے گئے کاغذ، فیکس اور PDF میں محفوظ فوٹو کاپیاں ایسی ہی ہوتی ہیں۔ جب کسی بھی صفحے پر ٹیکسٹ نہ ہو تو ٹول صاف بتا دیتا ہے، اور جب صرف کچھ صفحات اسکین ہوں تو ان کے نمبر لکھ دیتا ہے۔ اسکین شدہ صفحات پڑھنے کے لیے انہیں PDF سے JPG سے تصاویر بنائیں اور پھر تصویر سے ٹیکسٹ (OCR) میں ڈالیں۔
اگر پاس ورڈ مانگا جائے تو PDF انکرپٹ شدہ ہے۔ اپنے معلوم پاس ورڈ کے ساتھ اسے PDF ان لاک کریں سے کھولیں اور پھر دوبارہ کوشش کریں۔
کچھ PDF ایسے فونٹ استعمال کرتی ہیں جن میں حروف کا درست نقشہ (character map) نہیں ہوتا۔ ان کا ٹیکسٹ اسکرین پر ٹھیک دکھتا ہے مگر نکالنے پر عجیب نشانات بن جاتا ہے یا بالکل نہیں نکلتا۔ فائل سے یہ حروف واپس لانے کا کوئی قابلِ بھروسا طریقہ نہیں، اس لیے یہاں بھی OCR ہی حل ہے۔
اردو PDF کے بارے میں ایک ضروری بات
اردو، عربی اور فارسی ٹیکسٹ PDF کے اندر اکثر بائیں سے دائیں کی ترتیب میں یا ٹکڑوں کی صورت میں محفوظ ہوتا ہے۔ یہ ٹول ہر لفظ کی صفحے پر جگہ دیکھ کر لائن کو دائیں سے بائیں درست ترتیب میں جوڑتا ہے، اور جب نتیجہ زیادہ تر دائیں سے بائیں ہو تو ایک یاد دہانی بھی دکھاتا ہے۔ لا جیسے جڑے ہوئے حروف کبھی کبھار الٹ کر نکل سکتے ہیں، اس لیے اہم اردو ٹیکسٹ کو استعمال سے پہلے ایک بار ضرور پڑھ لیں۔ اگر اردو PDF اسکین شدہ ہے تو OCR میں چھپا ہوا نسخ طرز کا ٹیکسٹ نستعلیق کے مقابلے میں کہیں بہتر پڑھا جاتا ہے۔
نتیجے سے کیا توقع رکھیں
نتیجہ سادہ ٹیکسٹ ہے، اس لیے بولڈ، اٹالک، رنگ، لنکس اور تصاویر شامل نہیں ہوتے۔ ہیڈر، فوٹر اور صفحہ نمبر صفحے کے ٹیکسٹ کا حصہ ہیں، اس لیے یہ بھی نتیجے میں آتے ہیں۔ لائن کے آخر میں ہائفن سے ٹوٹے الفاظ ٹوٹے ہی رہتے ہیں۔ بہت پیچیدہ لے آؤٹ، جیسے رسالے کے صفحات جن میں تصاویر کے گرد ٹیکسٹ باکس اور کیپشن بکھرے ہوں، غیر متوقع ترتیب میں نکل سکتے ہیں، کیونکہ پڑھنے کی ترتیب صفحے پر الفاظ کی جگہ سے دوبارہ بنائی جاتی ہے۔