Solved by پی ڈی ایف او سی آر
او سی آر (OCR) کے ذریعے متن نکال کر اور اسے فائل میں شامل کر کے ناقابل تلاش پی ڈی ایف کو تلاش کے قابل دستاویزات میں تبدیل کریں۔ یہ آرکائیو شدہ دستاویزات کو کلیدی الفاظ کی تلاش کے ذریعے بعد میں تلاش کرنا آسان بناتا ہے جبکہ اصل لے آؤٹ کو برقرار رکھتا ہے۔
یہ فیچر اسکین شدہ یا تصویر پر مبنی پی ڈی ایف کو متن کی شناخت کر کے اور دستاویز میں ایک پوشیدہ ٹیکسٹ لیئر شامل کر کے تلاش کے قابل پی ڈی ایف میں بدل دیتا ہے۔ یہ آرکائیونگ کے ان ورک فلو کے لیے ڈیزائن کیا گیا ہے جہاں آپ کو مہینوں یا سالوں بعد ناموں، تاریخوں، انوائس نمبروں، یا دیگر اہم اصطلاحات کو تلاش کر کے دستاویزات کو قابل اعتماد طریقے سے بازیافت کرنے کی ضرورت ہوتی ہے۔ آپ اپنی موجودہ پی ڈی ایف فائلیں اپ لوڈ یا منتخب کرتے ہیں اور "تلاش کے قابل بنائیں" کا عمل چلاتے ہیں، جو ہر صفحے کا تجزیہ کرتا ہے اور پرنٹ شدہ متن کا پتہ لگاتا ہے۔ آؤٹ پٹ ایک تلاش کے قابل پی ڈی ایف ہے جو اصل بصری شکل کو برقرار رکھتا ہے جبکہ کاپی/پیسٹ اور دستاویز کے اندر تلاش کو فعال کرتا ہے۔ یہ مواد کو چیک کرنے کے لیے فائلوں کو دستی طور پر کھولنے میں صرف ہونے والے وقت کو کم کر کے طویل مدتی دستاویز کے انتظام کو بہتر بناتا ہے۔ یہ آرکائیو کے معیار کو معیاری بنانے میں بھی مدد کرتا ہے تاکہ نئی اور پرانی پی ڈی ایف فائلیں آپ کے اسٹوریج سسٹم میں مستقل طور پر کام کریں۔ یہ فیچر اسکین شدہ معاہدوں، رسیدوں، انوائسز، طبی ریکارڈز، عدالتی فائلنگز، اور کسی بھی ایسی کاغذی کارروائی کے لیے مفید ہے جسے تصاویر کے طور پر ڈیجیٹائز کیا گیا تھا۔ یہ بڑے آرکائیوز کو مؤثر طریقے سے ہینڈل کرنے کے لیے بلک پروسیسنگ کو سپورٹ کرتا ہے اور دستاویز کے انتظام یا اسٹوریج ٹولز کے ذریعے ڈاؤن اسٹریم انڈیکسنگ کے لیے موزوں نتائج تیار کرتا ہے۔ پی ڈی ایف کو ماخذ پر ہی تلاش کے قابل بنا کر، یہ دریافت کرنے کی صلاحیت کو بڑھاتا ہے اور صرف فائل کے نام رکھنے کے کنونشنز پر انحصار کو کم کرتا ہے۔
External Resource
https://cross-service-solutions.com/
If you know of a tool or approach that could help people solve a problem we haven't covered yet, we'd love to hear about it.