مواد پر جائیں

PDF سے ٹیکسٹ – کسی بھی PDF کا ٹیکسٹ نکالیں

PDF کے الفاظ سادہ ٹیکسٹ کی صورت میں حاصل کریں جسے آپ کاپی، ایڈٹ یا .txt فائل میں محفوظ کر سکیں۔ PDF آپ کے براؤزر میں پڑھی جاتی ہے اور کبھی اپ لوڈ نہیں ہوتی۔

PDF کو ٹیکسٹ میں بدلنے کا طریقہ

  1. اپنی PDF شامل کریں: فائل اوپر والے باکس میں ڈالیں، یا ٹیپ کر کے فون یا کمپیوٹر سے چنیں۔
  2. صفحات چنیں: “تمام صفحات” رہنے دیں، یا “صفحات چنیں” دبا کر مطلوبہ صفحے لکھیں، مثلاً 1-3, 5 یا 8-۔
  3. ضرورت ہو تو صفحوں کے نشان لگائیں: “ہر صفحے کے شروع میں نشان لگائیں” آن کریں تو ہر صفحے سے پہلے ----- صفحہ 3 ----- جیسی لائن آ جاتی ہے۔
  4. “ٹیکسٹ نکالیں” دبائیں: پیش رفت کی پٹی بتاتی ہے کہ کون سا صفحہ پڑھا جا رہا ہے۔
  5. کاپی یا محفوظ کریں: “کاپی کریں” سے ٹیکسٹ کہیں اور پیسٹ کریں، یا “.txt ڈاؤن لوڈ کریں” سے اسے UTF-8 ٹیکسٹ فائل کی صورت میں محفوظ کریں۔

خصوصیات

  • پڑھنے کے قابل نتیجہ: الفاظ دوبارہ لائنوں میں جوڑے جاتے ہیں، اور جہاں صفحے کا فاصلہ نیا پیراگراف دکھائے وہاں، اور صفحات کے درمیان، ایک خالی لائن آتی ہے۔
  • دو کالم والے صفحات کالم در کالم پڑھے جاتے ہیں، دونوں کالموں کی لائنیں آپس میں نہیں ملتیں۔ دونوں کالموں پر پھیلی سرخیاں اپنی جگہ رہتی ہیں۔
  • ٹیبل الگ الگ رہتے ہیں: لائن کے اندر بڑے خلا ٹیب بن جاتے ہیں، اس لیے قطاریں اسپریڈ شیٹ میں صاف پیسٹ ہوتی ہیں۔
  • صفحات کی رینج، بشمول 8- جیسی کھلی رینج جس کا مطلب ہے “صفحہ 8 سے آخر تک”۔
  • صفحوں کے اختیاری نشان، جنہیں ٹیکسٹ نکالنے کے بعد بھی فائل دوبارہ پڑھے بغیر آن یا آف کیا جا سکتا ہے۔
  • ایک نظر میں گنتی: حروف، الفاظ اور صفحات کی تعداد ٹیکسٹ کے اوپر نظر آتی ہے۔
  • اسکین شدہ صفحات کی پہچان: جن صفحات پر ٹیکسٹ کی تہہ نہیں، ان کے نمبر بتائے جاتے ہیں تاکہ آپ جان لیں کہ کن کے لیے OCR چاہیے۔
  • دائیں سے بائیں زبانوں کی سپورٹ: اردو، عربی، فارسی اور عبرانی ٹیکسٹ کے لیے۔

PDF کا ٹیکسٹ نکالنے کے لیے Fileora کیوں استعمال کریں

PDF ویوئر سے سیدھا ٹیکسٹ کاپی کرنا اکثر مشکل ہوتا ہے۔ سلیکشن ایک کالم سے دوسرے میں کود جاتی ہے، جملوں کے بیچ میں لائن ٹوٹ جاتی ہے، اور فون پر ایک پیراگراف سے زیادہ منتخب کرنا تقریباً ناممکن ہوتا ہے۔ پوری دستاویز کا ٹیکسٹ ایک ساتھ نکالنے سے آپ کو صاف ٹیکسٹ ملتا ہے جسے حوالہ دینے، ترجمہ کرنے، تلاش کرنے، خلاصہ بنانے یا دوبارہ استعمال کرنے میں آسانی رہتی ہے۔

Fileora آپ کی PDF براؤزر ہی میں پڑھتا ہے، اس لیے معاہدے، بینک اسٹیٹمنٹ اور امتحانی پرچے آپ کے ڈیوائس سے باہر نہیں جاتے۔ نہ سائن اپ، نہ واٹرمارک اور نہ صفحات کی کوئی حد، اور ٹول فون پر بھی ویسے ہی چلتا ہے جیسے لیپ ٹاپ پر۔ ٹیکسٹ ملنے کے بعد اسے الفاظ گنیں میں پیسٹ کر کے لمبائی اور پڑھنے کا وقت دیکھ سکتے ہیں۔

جب ٹیکسٹ نہ نکلے

کوئی PDF اسکرین پر ٹیکسٹ جیسی دکھ سکتی ہے لیکن اندر صرف تصاویر ہوتی ہیں۔ فون سے اسکین کیے گئے کاغذ، فیکس اور PDF میں محفوظ فوٹو کاپیاں ایسی ہی ہوتی ہیں۔ جب کسی بھی صفحے پر ٹیکسٹ نہ ہو تو ٹول صاف بتا دیتا ہے، اور جب صرف کچھ صفحات اسکین ہوں تو ان کے نمبر لکھ دیتا ہے۔ اسکین شدہ صفحات پڑھنے کے لیے انہیں PDF سے JPG سے تصاویر بنائیں اور پھر تصویر سے ٹیکسٹ (OCR) میں ڈالیں۔

اگر پاس ورڈ مانگا جائے تو PDF انکرپٹ شدہ ہے۔ اپنے معلوم پاس ورڈ کے ساتھ اسے PDF ان لاک کریں سے کھولیں اور پھر دوبارہ کوشش کریں۔

کچھ PDF ایسے فونٹ استعمال کرتی ہیں جن میں حروف کا درست نقشہ (character map) نہیں ہوتا۔ ان کا ٹیکسٹ اسکرین پر ٹھیک دکھتا ہے مگر نکالنے پر عجیب نشانات بن جاتا ہے یا بالکل نہیں نکلتا۔ فائل سے یہ حروف واپس لانے کا کوئی قابلِ بھروسا طریقہ نہیں، اس لیے یہاں بھی OCR ہی حل ہے۔

اردو PDF کے بارے میں ایک ضروری بات

اردو، عربی اور فارسی ٹیکسٹ PDF کے اندر اکثر بائیں سے دائیں کی ترتیب میں یا ٹکڑوں کی صورت میں محفوظ ہوتا ہے۔ یہ ٹول ہر لفظ کی صفحے پر جگہ دیکھ کر لائن کو دائیں سے بائیں درست ترتیب میں جوڑتا ہے، اور جب نتیجہ زیادہ تر دائیں سے بائیں ہو تو ایک یاد دہانی بھی دکھاتا ہے۔ لا جیسے جڑے ہوئے حروف کبھی کبھار الٹ کر نکل سکتے ہیں، اس لیے اہم اردو ٹیکسٹ کو استعمال سے پہلے ایک بار ضرور پڑھ لیں۔ اگر اردو PDF اسکین شدہ ہے تو OCR میں چھپا ہوا نسخ طرز کا ٹیکسٹ نستعلیق کے مقابلے میں کہیں بہتر پڑھا جاتا ہے۔

نتیجے سے کیا توقع رکھیں

نتیجہ سادہ ٹیکسٹ ہے، اس لیے بولڈ، اٹالک، رنگ، لنکس اور تصاویر شامل نہیں ہوتے۔ ہیڈر، فوٹر اور صفحہ نمبر صفحے کے ٹیکسٹ کا حصہ ہیں، اس لیے یہ بھی نتیجے میں آتے ہیں۔ لائن کے آخر میں ہائفن سے ٹوٹے الفاظ ٹوٹے ہی رہتے ہیں۔ بہت پیچیدہ لے آؤٹ، جیسے رسالے کے صفحات جن میں تصاویر کے گرد ٹیکسٹ باکس اور کیپشن بکھرے ہوں، غیر متوقع ترتیب میں نکل سکتے ہیں، کیونکہ پڑھنے کی ترتیب صفحے پر الفاظ کی جگہ سے دوبارہ بنائی جاتی ہے۔

اکثر پوچھے جانے والے سوالات

PDF سے ٹیکسٹ کیسے نکالوں؟

اپنی PDF شامل کریں، “تمام صفحات” رہنے دیں یا “صفحات چنیں” دبائیں، پھر “ٹیکسٹ نکالیں” پر کلک کریں۔ ٹیکسٹ نیچے ایک باکس میں آ جاتا ہے، ساتھ “کاپی کریں” اور “.txt ڈاؤن لوڈ کریں” کے بٹن ہوتے ہیں۔

یہ کیوں کہتا ہے کہ کوئی ٹیکسٹ نہیں ملا؟

غالباً آپ کی PDF اسکین شدہ ہے: ہر صفحہ ٹیکسٹ کی تصویر ہے، اصل ٹیکسٹ نہیں، اس لیے نکالنے کو کچھ ہے ہی نہیں۔ ایسے صفحات کو PDF سے JPG کے ذریعے تصاویر بنائیں اور پھر تصویر سے ٹیکسٹ (OCR) سے پڑھیں۔ اگر صرف کچھ صفحات اسکین ہیں تو ٹول ان کے نمبر بتا دیتا ہے اور باقی صفحات کا ٹیکسٹ نکال دیتا ہے۔

کیا صرف چند صفحات کا ٹیکسٹ نکالا جا سکتا ہے؟

جی ہاں۔ “صفحات چنیں” دبائیں اور 1-3, 5 یا 8- جیسے نمبر لکھیں۔ 8- جیسی رینج جس کا آخر نہ لکھا ہو، آخری صفحے تک جاتی ہے۔ صفحات اسی ترتیب میں نکالے جاتے ہیں جس میں آپ انہیں لکھتے ہیں۔

کیا PDF کا لے آؤٹ برقرار رہتا ہے؟

لائنیں، پیراگراف اور پڑھنے کی ترتیب برقرار رہتی ہے، لیکن فونٹ، رنگ، تصاویر اور الفاظ کی بالکل درست جگہ نہیں۔ دو کالم والے صفحات ایک کالم کے بعد دوسرا پڑھے جاتے ہیں، اور ایک لائن کے اندر بڑے خلا، جیسے ٹیبل کے خانوں کے درمیان، ٹیب بن جاتے ہیں۔

کیا یہ اردو اور عربی PDF کے ساتھ کام کرتا ہے؟

جی ہاں، بشرطیکہ PDF میں اصل ٹیکسٹ موجود ہو۔ دائیں سے بائیں لائنوں کو ہر لفظ کی جگہ دیکھ کر درست ترتیب میں لایا جاتا ہے، اور انگریزی الفاظ اور نمبر اپنی ترتیب میں رہتے ہیں۔ پھر بھی نتیجہ جانچ لیں، کیونکہ کچھ PDF جڑے ہوئے حروف کو ایسے محفوظ کرتی ہیں کہ لا جیسے حروف الٹ کر نکل سکتے ہیں۔

اگر میری PDF پاس ورڈ سے محفوظ ہو تو؟

جو PDF کھولنے کے لیے پاس ورڈ مانگتی ہے وہ پڑھی نہیں جا سکتی۔ پہلے “PDF ان لاک کریں” سے پاس ورڈ ہٹائیں، پھر ٹیکسٹ نکالیں۔ جو PDF بغیر پاس ورڈ کھل جاتی ہے مگر کاپی کرنے سے روکتی ہے، وہ عام طریقے سے پڑھ لی جاتی ہے۔

کیا میری PDF کسی سرور پر اپ لوڈ ہوتی ہے؟

نہیں۔ ٹیکسٹ آپ کا براؤزر آپ کے اپنے ڈیوائس پر نکالتا ہے۔ کچھ بھی کہیں نہیں بھیجا جاتا، اس لیے خفیہ دستاویزات محفوظ رہتی ہیں۔

آپ کو مطلوبہ ٹول نہیں ملا، یا کچھ کام نہیں کر رہا؟

ہمیں بتائیں کہ آپ کو اگلا کون سا ٹول چاہیے یا کیا خرابی ہوئی۔ ہم ہر پیغام پڑھتے ہیں، اور درخواستوں سے ہی طے ہوتا ہے کہ ہم آگے کیا بنائیں۔

آپ کی ای میل ایپ کھلے گی۔ براہِ کرم نجی فائلیں منسلک نہ کریں۔