مواد پر جائیں

تصویر سے ٹیکسٹ کنورٹر (OCR) – مفت اور محفوظ

فوٹو، اسکرین شاٹ یا اسکین شدہ صفحے سے ٹیکسٹ نکالیں تاکہ اسے کاپی، ایڈٹ اور تلاش کیا جا سکے۔ ٹیکسٹ آپ کے اپنے ڈیوائس پر پڑھا جاتا ہے، اس لیے آپ کی تصاویر کبھی اپ لوڈ نہیں ہوتیں۔

مشورہ: آپ اسکرین شاٹ کو Ctrl+V (Mac پر ⌘+V) سے پیسٹ بھی کر سکتے ہیں۔

PDF ہے؟ اس کا ٹیکسٹ “PDF سے ٹیکسٹ” سے نکالیں۔

تصویر کو ٹیکسٹ میں بدلنے کا طریقہ

  1. اپنی تصاویر شامل کریں: JPG، PNG، WebP، BMP یا GIF فائلیں باکس میں ڈالیں، ٹیپ کر کے چنیں، یا اسکرین شاٹ کاپی کر کے Ctrl+V (Mac پر ⌘+V) سے پیسٹ کریں۔
  2. ٹیکسٹ کی زبان چنیں: تصاویر میں موجود ہر زبان پر ٹیپ کریں: English، اردو، Español، Português یا Bahasa Indonesia۔ ملے جلے ٹیکسٹ کے لیے ایک سے زیادہ چنیں۔
  3. “ٹیکسٹ نکالیں” دبائیں: پیش رفت کی پٹی انجن کا لوڈ ہونا اور ہر تصویر کا پڑھا جانا دکھاتی ہے۔ آپ کسی بھی وقت “روکیں” دبا سکتے ہیں۔
  4. نتیجہ جانچیں اور درست کریں: ٹیکسٹ ایک قابلِ ترمیم خانے میں آتا ہے۔ غلط پڑھے گئے الفاظ وہیں ٹھیک کریں۔
  5. کاپی یا ڈاؤن لوڈ کریں: “کاپی کریں” سے ٹیکسٹ کلپ بورڈ پر لیں، یا “.txt ڈاؤن لوڈ کریں” سے سادہ ٹیکسٹ فائل محفوظ کریں۔

خصوصیات

  • پانچ زبانیں، اس ویب سائٹ کی زبانوں کے مطابق، اور ملی جلی زبانوں والی تصاویر کے لیے ان کا کوئی بھی مجموعہ۔
  • ایک ساتھ کئی تصاویر: سب کا ٹیکسٹ ایک جگہ، ہر ایک اپنی فائل کے نام کے نیچے۔
  • کلپ بورڈ سے پیسٹ: اسکرین شاٹ لیں اور محفوظ کیے بغیر سیدھا پیسٹ کریں۔
  • قابلِ ترمیم نتیجہ ایک ٹیپ میں کاپی اور سادہ ٹیکسٹ ڈاؤن لوڈ کے ساتھ۔
  • اردو کے لیے دائیں سے بائیں ڈسپلے، تاکہ نکالا گیا اردو ٹیکسٹ درست سمت میں پڑھا جائے۔
  • تصویر کی خودکار تیاری: کٹے ہوئے اسکرین شاٹ جیسی چھوٹی تصاویر پڑھنے سے پہلے بڑی کی جاتی ہیں، جو چھوٹے ٹیکسٹ میں مدد دیتا ہے، اور شفاف PNG کو سفید پر رکھا جاتا ہے تاکہ گہرا ٹیکسٹ غائب نہ ہو۔
  • روکنے کا بٹن لمبی فہرست کے لیے، جو پڑھا جا چکا ٹیکسٹ برقرار رکھتا ہے۔

تصاویر سے ٹیکسٹ نکالنے کے لیے Fileora کیوں استعمال کریں

زیادہ تر آن لائن OCR سروسز آپ کی تصویر سرور پر اپ لوڈ کر کے وہاں پڑھتی ہیں۔ یہ ان چیزوں کے لیے بالکل مناسب نہیں جن سے لوگ سب سے زیادہ ٹیکسٹ کاپی کرتے ہیں: شناختی کارڈ، بینک کے خطوط، رسیدیں، میڈیکل رپورٹس اور نجی پیغامات۔ Fileora ایک اوپن سورس انجن (Tesseract) کے ذریعے پہچان کا کام آپ کے براؤزر میں کرتا ہے، اس لیے تصویر آپ کے فون یا کمپیوٹر پر ہی رہتی ہے۔ نہ اکاؤنٹ، نہ روزانہ کی حد اور نہ واٹرمارک۔

چونکہ کچھ اپ لوڈ نہیں ہوتا، اس لیے بہت سی تصاویر کو سست کنکشن پر سفر بھی نہیں کرنا پڑتا۔ ایک بار انجن اور زبان کی فائلیں براؤزر میں محفوظ ہو جائیں تو موبائل ڈیٹا پر بھی پڑھنا تیزی سے ہوتا ہے۔

اردو OCR: نسخ اور نستعلیق

اردو کے لیے ایک خاص بات جاننا ضروری ہے۔ اردو زبان کا ڈیٹا زیادہ تر نسخ طرز کے حروف پر تربیت یافتہ ہے، اس لیے عام ویب فونٹس میں اسکرین پر دکھنے والی اردو، جیسے خبروں کی ویب سائٹس یا سرکاری فارم کا ٹیکسٹ، اچھی طرح پڑھی جاتی ہے۔ کتابوں اور اخبارات کا روایتی نستعلیق اکثر غلط جگہ سے ٹوٹتا یا جڑتا ہے، کیونکہ اس میں حروف ترچھی لائن میں ایک دوسرے پر چڑھے ہوتے ہیں۔ نستعلیق کے نتیجے کو ایک کچا مسودہ سمجھیں جسے غور سے جانچنا ضروری ہے۔ اردو ہاتھ کی لکھائی سپورٹ نہیں ہوتی۔

پاکستانی فارم یا بل جن میں اردو اور انگریزی دونوں ہوں، ان کے لیے دونوں زبانیں چنیں۔

بہتر نتیجے کے لیے

تصویر کی کوالٹی سب سے زیادہ اہم ہے۔ کیمرہ صفحے کے بالکل اوپر رکھیں تاکہ ٹیکسٹ کی لائنیں سیدھی ہوں، فریم میں صرف مطلوبہ ٹیکسٹ بھریں، اور روشنی برابر رکھیں تاکہ ہاتھ یا فون کا سایہ نہ پڑے۔ دھندلی، ٹیڑھی یا کم کنٹراسٹ والی تصاویر غلطیوں کی سب سے عام وجہ ہیں۔

اگر بھرے ہوئے صفحے سے صرف ایک پیراگراف چاہیے تو پہلے تصویر کراپ کریں سے اسے کاٹ لیں۔ کم بھیڑ کا مطلب ہے کم فالتو حروف۔ اسکرین شاٹ عموماً تقریباً مکمل درست پڑھے جاتے ہیں کیونکہ ان کا ٹیکسٹ تیز اور بالکل سیدھا ہوتا ہے۔

صرف وہی زبانیں چنیں جو واقعی تصویر میں ہیں۔ ہر اضافی زبان پڑھنے کو تھوڑا سست کرتی ہے اور انجن کو ملتے جلتے حروف میں الجھا سکتی ہے۔

iPhone کی HEIC فوٹوز ہر براؤزر میں نہیں کھلتیں۔ انہیں پہلے HEIC سے JPG سے بدلیں، پھر JPG فائلیں یہاں شامل کریں۔

OCR کیا کر سکتا ہے اور کیا نہیں

آپٹیکل کریکٹر ریکگنیشن حروف کی شکلوں کو قابلِ ترمیم ٹیکسٹ میں بدلتا ہے۔ صاف چھپے ٹیکسٹ پر یہ بہترین ہے اور تصویر جتنی اس سے دور ہو اتنا کمزور ہوتا جاتا ہے۔ ٹیبل اسپریڈ شیٹ کے بجائے سادہ لائنوں کی صورت میں آتے ہیں۔ اخبارات اور پمفلٹ کے کالم غیر متوقع ترتیب میں پڑھے جا سکتے ہیں۔ لوگو، سجاوٹی سرخیاں اور فوٹو پر لکھا ٹیکسٹ کبھی پڑھا جاتا ہے کبھی نہیں۔

ٹیکسٹ ملنے کے بعد الفاظ گنیں سے اس کے الفاظ اور حروف گن سکتے ہیں۔ جو دستاویزات پہلے سے PDF ہیں ان کے لیے PDF سے ٹیکسٹ تیز بھی ہے اور بالکل درست بھی، بشرطیکہ PDF میں اسکین شدہ تصاویر کے بجائے اصل ٹیکسٹ ہو۔

اکثر پوچھے جانے والے سوالات

تصویر کو ٹیکسٹ میں کیسے بدلوں؟

ایک یا کئی تصاویر شامل کریں (یا Ctrl+V سے اسکرین شاٹ پیسٹ کریں)، ٹیکسٹ کی زبان چنیں اور “ٹیکسٹ نکالیں” دبائیں۔ ٹیکسٹ ایک ایسے خانے میں آتا ہے جس میں آپ غلطیاں درست کر سکتے ہیں، کاپی کر سکتے ہیں یا .txt فائل میں ڈاؤن لوڈ کر سکتے ہیں۔

کیا میری تصویر کسی سرور پر اپ لوڈ ہوتی ہے؟

نہیں۔ پڑھنے والا انجن آپ کے براؤزر کے اندر چلتا ہے اور تصویر آپ کے ڈیوائس سے باہر نہیں جاتی۔ صرف انجن اور زبان کی فائلیں ڈاؤن لوڈ ہوتی ہیں، جو پہلی بار ہماری اپنی ویب سائٹ سے آتی ہیں اور پھر آپ کا براؤزر انہیں محفوظ رکھتا ہے۔

ٹیکسٹ پہچاننا کتنا درست ہے؟

صاف چھپے ہوئے ٹیکسٹ، جیسے اسکرین شاٹ، دستاویزات اور اچھی روشنی میں سیدھے لی گئی کتاب کے صفحات کی تصاویر، کے لیے درستگی عموماً بہت اچھی ہوتی ہے۔ دھندلا پن، سائے، مڑے ہوئے صفحات، سجاوٹی فونٹ، بہت چھوٹا ٹیکسٹ اور بھرا ہوا پس منظر اسے کم کر دیتے ہیں۔ نتیجے پر بھروسا کرنے سے پہلے، خاص طور پر نمبر، ہمیشہ ایک بار پڑھ لیں۔

کیا یہ ہاتھ کی لکھائی پڑھ سکتا ہے؟

بہت کم۔ انجن چھپی ہوئی لکھائی پر تربیت یافتہ ہے، اس لیے صاف الگ الگ بڑے انگریزی حروف کچھ حد تک پڑھے جا سکتے ہیں، لیکن جڑی ہوئی ہاتھ کی لکھائی عموماً غلط پڑھی جاتی ہے۔ ہاتھ سے لکھے نوٹس کو ڈیجیٹل بنانے کا یہ قابلِ بھروسا طریقہ نہیں۔

کیا یہ اردو پڑھتا ہے؟

جی ہاں، نسخ طرز کے فونٹ میں چھپی اردو، جیسے زیادہ تر ویب سائٹس اور بہت سے فارم، اچھی طرح پڑھی جاتی ہے۔ نستعلیق، یعنی زیادہ تر اردو اخبارات اور کتابوں کا بہتا ہوا انداز، بہت کم درستگی سے پہچانا جاتا ہے، اور اردو ہاتھ کی لکھائی سپورٹ نہیں ہوتی۔ اردو نتیجہ دائیں سے بائیں دکھایا جاتا ہے۔

کیا ایک ساتھ کئی تصاویر کنورٹ ہو سکتی ہیں؟

جی ہاں۔ جتنی چاہیں تصاویر شامل کریں، وہ ایک کے بعد ایک پڑھی جاتی ہیں۔ ہر تصویر کا ٹیکسٹ اس کی فائل کے نام کے نیچے ایک ہی خانے میں آ جاتا ہے، کاپی یا ڈاؤن لوڈ کے لیے تیار۔

پہلی بار زیادہ وقت کیوں لگتا ہے؟

پہلی بار آپ کا براؤزر پڑھنے والا انجن اور آپ کی چنی ہوئی زبانوں کا ڈیٹا ڈاؤن لوڈ کرتا ہے، جو کل ملا کر چند میگابائٹ ہوتا ہے۔ اس کے بعد یہ براؤزر میں محفوظ رہتے ہیں، اس لیے اگلی بار کام بہت جلدی شروع ہوتا ہے، صفحہ بند کرنے کے بعد بھی۔

کیا PDF سے ٹیکسٹ مل سکتا ہے؟

یہ ٹول تصاویر پڑھتا ہے۔ PDF کے لیے “PDF سے ٹیکسٹ” استعمال کریں، جو دستاویز کی ٹیکسٹ والی تہہ سیدھی نکال لیتا ہے۔

آپ کو مطلوبہ ٹول نہیں ملا، یا کچھ کام نہیں کر رہا؟

ہمیں بتائیں کہ آپ کو اگلا کون سا ٹول چاہیے یا کیا خرابی ہوئی۔ ہم ہر پیغام پڑھتے ہیں، اور درخواستوں سے ہی طے ہوتا ہے کہ ہم آگے کیا بنائیں۔

آپ کی ای میل ایپ کھلے گی۔ براہِ کرم نجی فائلیں منسلک نہ کریں۔