تصویر کو ٹیکسٹ میں بدلنے کا طریقہ
- اپنی تصاویر شامل کریں: JPG، PNG، WebP، BMP یا GIF فائلیں باکس میں ڈالیں، ٹیپ کر کے چنیں، یا اسکرین شاٹ کاپی کر کے Ctrl+V (Mac پر ⌘+V) سے پیسٹ کریں۔
- ٹیکسٹ کی زبان چنیں: تصاویر میں موجود ہر زبان پر ٹیپ کریں: English، اردو، Español، Português یا Bahasa Indonesia۔ ملے جلے ٹیکسٹ کے لیے ایک سے زیادہ چنیں۔
- “ٹیکسٹ نکالیں” دبائیں: پیش رفت کی پٹی انجن کا لوڈ ہونا اور ہر تصویر کا پڑھا جانا دکھاتی ہے۔ آپ کسی بھی وقت “روکیں” دبا سکتے ہیں۔
- نتیجہ جانچیں اور درست کریں: ٹیکسٹ ایک قابلِ ترمیم خانے میں آتا ہے۔ غلط پڑھے گئے الفاظ وہیں ٹھیک کریں۔
- کاپی یا ڈاؤن لوڈ کریں: “کاپی کریں” سے ٹیکسٹ کلپ بورڈ پر لیں، یا “.txt ڈاؤن لوڈ کریں” سے سادہ ٹیکسٹ فائل محفوظ کریں۔
خصوصیات
- پانچ زبانیں، اس ویب سائٹ کی زبانوں کے مطابق، اور ملی جلی زبانوں والی تصاویر کے لیے ان کا کوئی بھی مجموعہ۔
- ایک ساتھ کئی تصاویر: سب کا ٹیکسٹ ایک جگہ، ہر ایک اپنی فائل کے نام کے نیچے۔
- کلپ بورڈ سے پیسٹ: اسکرین شاٹ لیں اور محفوظ کیے بغیر سیدھا پیسٹ کریں۔
- قابلِ ترمیم نتیجہ ایک ٹیپ میں کاپی اور سادہ ٹیکسٹ ڈاؤن لوڈ کے ساتھ۔
- اردو کے لیے دائیں سے بائیں ڈسپلے، تاکہ نکالا گیا اردو ٹیکسٹ درست سمت میں پڑھا جائے۔
- تصویر کی خودکار تیاری: کٹے ہوئے اسکرین شاٹ جیسی چھوٹی تصاویر پڑھنے سے پہلے بڑی کی جاتی ہیں، جو چھوٹے ٹیکسٹ میں مدد دیتا ہے، اور شفاف PNG کو سفید پر رکھا جاتا ہے تاکہ گہرا ٹیکسٹ غائب نہ ہو۔
- روکنے کا بٹن لمبی فہرست کے لیے، جو پڑھا جا چکا ٹیکسٹ برقرار رکھتا ہے۔
تصاویر سے ٹیکسٹ نکالنے کے لیے Fileora کیوں استعمال کریں
زیادہ تر آن لائن OCR سروسز آپ کی تصویر سرور پر اپ لوڈ کر کے وہاں پڑھتی ہیں۔ یہ ان چیزوں کے لیے بالکل مناسب نہیں جن سے لوگ سب سے زیادہ ٹیکسٹ کاپی کرتے ہیں: شناختی کارڈ، بینک کے خطوط، رسیدیں، میڈیکل رپورٹس اور نجی پیغامات۔ Fileora ایک اوپن سورس انجن (Tesseract) کے ذریعے پہچان کا کام آپ کے براؤزر میں کرتا ہے، اس لیے تصویر آپ کے فون یا کمپیوٹر پر ہی رہتی ہے۔ نہ اکاؤنٹ، نہ روزانہ کی حد اور نہ واٹرمارک۔
چونکہ کچھ اپ لوڈ نہیں ہوتا، اس لیے بہت سی تصاویر کو سست کنکشن پر سفر بھی نہیں کرنا پڑتا۔ ایک بار انجن اور زبان کی فائلیں براؤزر میں محفوظ ہو جائیں تو موبائل ڈیٹا پر بھی پڑھنا تیزی سے ہوتا ہے۔
اردو OCR: نسخ اور نستعلیق
اردو کے لیے ایک خاص بات جاننا ضروری ہے۔ اردو زبان کا ڈیٹا زیادہ تر نسخ طرز کے حروف پر تربیت یافتہ ہے، اس لیے عام ویب فونٹس میں اسکرین پر دکھنے والی اردو، جیسے خبروں کی ویب سائٹس یا سرکاری فارم کا ٹیکسٹ، اچھی طرح پڑھی جاتی ہے۔ کتابوں اور اخبارات کا روایتی نستعلیق اکثر غلط جگہ سے ٹوٹتا یا جڑتا ہے، کیونکہ اس میں حروف ترچھی لائن میں ایک دوسرے پر چڑھے ہوتے ہیں۔ نستعلیق کے نتیجے کو ایک کچا مسودہ سمجھیں جسے غور سے جانچنا ضروری ہے۔ اردو ہاتھ کی لکھائی سپورٹ نہیں ہوتی۔
پاکستانی فارم یا بل جن میں اردو اور انگریزی دونوں ہوں، ان کے لیے دونوں زبانیں چنیں۔
بہتر نتیجے کے لیے
تصویر کی کوالٹی سب سے زیادہ اہم ہے۔ کیمرہ صفحے کے بالکل اوپر رکھیں تاکہ ٹیکسٹ کی لائنیں سیدھی ہوں، فریم میں صرف مطلوبہ ٹیکسٹ بھریں، اور روشنی برابر رکھیں تاکہ ہاتھ یا فون کا سایہ نہ پڑے۔ دھندلی، ٹیڑھی یا کم کنٹراسٹ والی تصاویر غلطیوں کی سب سے عام وجہ ہیں۔
اگر بھرے ہوئے صفحے سے صرف ایک پیراگراف چاہیے تو پہلے تصویر کراپ کریں سے اسے کاٹ لیں۔ کم بھیڑ کا مطلب ہے کم فالتو حروف۔ اسکرین شاٹ عموماً تقریباً مکمل درست پڑھے جاتے ہیں کیونکہ ان کا ٹیکسٹ تیز اور بالکل سیدھا ہوتا ہے۔
صرف وہی زبانیں چنیں جو واقعی تصویر میں ہیں۔ ہر اضافی زبان پڑھنے کو تھوڑا سست کرتی ہے اور انجن کو ملتے جلتے حروف میں الجھا سکتی ہے۔
iPhone کی HEIC فوٹوز ہر براؤزر میں نہیں کھلتیں۔ انہیں پہلے HEIC سے JPG سے بدلیں، پھر JPG فائلیں یہاں شامل کریں۔
OCR کیا کر سکتا ہے اور کیا نہیں
آپٹیکل کریکٹر ریکگنیشن حروف کی شکلوں کو قابلِ ترمیم ٹیکسٹ میں بدلتا ہے۔ صاف چھپے ٹیکسٹ پر یہ بہترین ہے اور تصویر جتنی اس سے دور ہو اتنا کمزور ہوتا جاتا ہے۔ ٹیبل اسپریڈ شیٹ کے بجائے سادہ لائنوں کی صورت میں آتے ہیں۔ اخبارات اور پمفلٹ کے کالم غیر متوقع ترتیب میں پڑھے جا سکتے ہیں۔ لوگو، سجاوٹی سرخیاں اور فوٹو پر لکھا ٹیکسٹ کبھی پڑھا جاتا ہے کبھی نہیں۔
ٹیکسٹ ملنے کے بعد الفاظ گنیں سے اس کے الفاظ اور حروف گن سکتے ہیں۔ جو دستاویزات پہلے سے PDF ہیں ان کے لیے PDF سے ٹیکسٹ تیز بھی ہے اور بالکل درست بھی، بشرطیکہ PDF میں اسکین شدہ تصاویر کے بجائے اصل ٹیکسٹ ہو۔