Skip to content

OCR

OCR تصاویر، اسکینز اور دستاویزی اسکرین شاٹس سے متن نکالتا ہے۔

شناخت کے بعد آپ نتیجہ کاپی کر سکتے ہیں، اسے Markdown, PDF یا Word کے طور پر برآمد کر سکتے ہیں، یا کئی فارمیٹس کو ایک ساتھ پیکج کر کے ڈاؤن لوڈ کر سکتے ہیں۔

OCR کیا کر سکتا ہے

خصوصیتوضاحت
تصویر متن شناختتصاویر، اسکرین شاٹس اور اسکینز سے متن نکالتا ہے۔
دستاویز لے آؤٹ شناختجدولوں، فارمولوں، مہروں اور متن-تصویر ملے جلے لے آؤٹس کے لیے بہتر ہے۔
متعدد خدماتBaidu PaddleOCR، Microsoft Azure Vision اور Google Vision کی حمایت کرتا ہے۔
نتائج کاپی کرناپراسیسنگ کے بعد شناخت شدہ متن کاپی کرتا ہے۔
فائلیں برآمد کرناMarkdown, PDF اور Word برآمد کرتا ہے۔
بیچ پیکجنگکئی فائلیں شناخت کرنے کے بعد نتائج پیکج کے طور پر ڈاؤن لوڈ کرتا ہے۔

پہلے OCR خدمات ترتیب دیں

کھولیں:

text
System Settings -> Other Settings -> OCR

IP جغرافیائی مقام اور OCR

جن خدمات کو استعمال کرنا چاہتے ہیں ان کی اسناد بھریں:

خدمتکیا درج کریںبہترین استعمال
Baidu PaddleOCRPaddleOCR Tokenپہلے انتخاب کے طور پر تجویز کردہ۔ دستاویزات، تصاویر، جدولوں اور ملے جلے لے آؤٹس کے لیے اچھا ہے۔
Microsoft Azure VisionAzure Vision Endpoint اور Azure Vision API Keyاگر آپ پہلے سے Microsoft کلاؤڈ خدمات استعمال کرتے ہیں تو مفید ہے۔
Google VisionGoogle Vision API Key۔ سروس اکاؤنٹ JSON صرف کوٹا معلوم کرنے کے لیے استعمال ہوتا ہے۔اگر آپ Google Cloud خدمات استعمال کرتے ہیں تو مفید ہے۔

اسناد بھرنے کے بعد محفوظ کریں۔

ابتدائی جانچ کے لیے صرف ایک خدمت ترتیب دی جا سکتی ہے۔ تینوں ضروری نہیں۔

Google Vision ترتیب

Google ترتیب کے دو حصے ہیں:

مقصدضرورت
OCR استعمال کرناCloud Vision API فعال کریں، پھر API Key بنائیں۔
استعمال معلوم کرناسروس اکاؤنٹ بنائیں، Monitoring Viewer دیں، پھر سروس اکاؤنٹ JSON ڈاؤن لوڈ کریں۔

Google API کلید اور سروس اکاؤنٹ

OCR کے لیے Google استعمال کرنا

  1. Google Cloud Console کھولیں۔
  2. APIs & Services پر جائیں۔
  3. Library کھولیں، Cloud Vision API تلاش کریں اور فعال کریں۔
  4. Credentials پر واپس جائیں۔
  5. API Key بنائیں۔
  6. API کلید کھولیں اور اسے کاپی کریں۔
  7. اسے ImgHost میں Google Vision API Key میں چسپاں کریں۔
  8. محفوظ کریں۔

اس کے بعد OCR ڈائیلاگ میں Google Vision منتخب کیا جا سکتا ہے۔

Google کے استعمال کی معلومات معلوم کرنا

کوٹا معلوم کرنا شناخت کے لیے ضروری نہیں۔

یہ صرف اندازاً دکھاتا ہے کہ پچھلے 30 دنوں میں Google Vision کالز کتنی استعمال ہوئیں۔

  1. Google Cloud Console میں IAM & Admin کھولیں۔
  2. Service Accounts کھولیں۔
  3. vision-monitor جیسا سروس اکاؤنٹ بنائیں۔
  4. اسے Monitoring Viewer کردار دیں۔
  5. سروس اکاؤنٹ کی تفصیلات کھولیں اور کلید بنائیں۔
  6. JSON منتخب کریں۔
  7. تیار شدہ JSON فائل ڈاؤن لوڈ کریں۔
  8. ImgHost پر واپس جا کر اسے سروس اکاؤنٹ JSON کے تحت درآمد کریں (اختیاری)۔
  9. درآمد کامیاب ہونے کے بعد کوٹا معلوم کرنے پر کلک کریں۔

درآمد کے بعد ImgHost اس پروجیکٹ کا نام دکھاتا ہے جس سے سروس اکاؤنٹ تعلق رکھتا ہے۔ استعمال کی معلومات معلوم کرتے وقت ImgHost Google کا مانیٹرنگ ڈیٹا پڑھتا ہے اور اس ماہ کی کال تعداد دکھاتا ہے۔

مختصر طور پر:

آئٹممقصد
Google Vision API KeyOCR شناخت انجام دیتا ہے۔
سروس اکاؤنٹ JSONمعلوم کرتا ہے کہ Google Vision کالز کتنی استعمال ہوئیں۔
Monitoring Viewer کردارسروس اکاؤنٹ کو استعمال کا ڈیٹا پڑھنے کی اجازت دیتا ہے۔

Baidu PaddleOCR ٹوکن حاصل کرنا

Baidu PaddleOCR کو رسائی ٹوکن درکار ہے۔

PaddleOCR ٹوکن حاصل کریں

Baidu PaddleOCR صفحے پر API کال ونڈو کھولیں، ٹوکن حاصل کرنے کے لیے کلک کریں، پھر اسے کاپی کریں۔

ImgHost پر واپس جائیں، اسے PaddleOCR Token میں چسپاں کریں اور محفوظ کریں۔

شناخت شروع کرنا

فائل مینجمنٹ میں کوئی تصویر یا دستاویزی اسکرین شاٹ منتخب کریں اور OCR پر کلک کریں۔

OCR شناخت

ڈائیلاگ میں شناختی خدمت اور ماڈل منتخب کریں۔

عام PaddleOCR ماڈل انتخاب:

ماڈلبہترین استعمال
PP-StructureV3تجویز کردہ ڈیفالٹ۔ دستاویزات، جدولوں، فارمولوں، مہروں اور ملے جلے لے آؤٹس کے لیے اچھا ہے۔
PP-OCRv5سادہ تصاویر، عام متن اور ہلکی شناخت۔
PaddleOCR-VLکثیر لسانی، پیچیدہ تصاویر اور چارٹ جیسے مواد۔
PaddleOCR-VL-1.5زیادہ پیچیدہ دستاویزی صفحات اور لے آؤٹ بحالی۔

اگر یقین نہ ہو تو PP-StructureV3 سے شروع کریں۔

اعلی اختیارات

اختیاروضاحت
سمت درستگیجب تصویر گھومی یا ٹیڑھی ہو تو استعمال کریں۔
دستاویز ہموار کرناخم یا جھکاؤ والی فوٹوگراف شدہ دستاویزات کے لیے استعمال کریں۔
لے آؤٹ شناختجب آپ عنوانات، پیراگراف، جدولیں اور تصویری ساخت محفوظ رکھنا چاہیں۔
چارٹ شناختجب تصویر میں چارٹس یا پیچیدہ ساختیں ہوں۔
Markdown بہتر بنائیںبرآمد شدہ Markdown کو پڑھنے میں آسان بناتا ہے۔

عام اسکرین شاٹس کے لیے اختیارات کم رکھیں۔ دستاویز اسکینز کے لیے دستاویز سے متعلق مزید اختیارات فعال کریں۔

نتائج دیکھنا

شناخت مکمل ہونے کے بعد ڈائیلاگ نتیجہ دکھاتا ہے۔

آپ اسے براہ راست کاپی کر سکتے ہیں یا برآمد فارمیٹس منتخب کر سکتے ہیں۔

PDF شناخت

دستاویزی صفحات کے لیے برآمد شدہ PDF صفحے کی شکل محفوظ رکھتے ہوئے متن کو تلاش کے قابل رکھ سکتا ہے۔ یہ اسکینز محفوظ کرنے اور بعد میں مواد تلاش کرنے کے لیے مفید ہے۔

برآمد فارمیٹ کا انتخاب

فارمیٹبہترین استعمال
Markdown (.md)نوٹس، دستاویزی نظام اور بعد کی ترمیم۔
PDF (.pdf)صفحے کی شکل اور اسکین شدہ دستاویز نتائج محفوظ کرنا۔
Word (.docx)لے آؤٹ کی مزید ترمیم، متن میں تبدیلی اور دوسروں کو حوالگی۔
سب برآمد کریںکئی فارمیٹس اور اصل تصویر محفوظ کرتا ہے؛ اہم آرکائیوز کے لیے مناسب ہے۔

اگر صرف متن چاہیے تو Markdown برآمد کریں۔

اگر صفحے کی شکل چاہیے تو PDF یا Word استعمال کریں۔

Word آؤٹ پٹ

برآمد شدہ Word دستاویزات آفس سافٹ ویئر میں کھولی اور ترمیم کی جا سکتی ہیں۔

Word نتیجہ

کچھ دستاویزات Word آؤٹ پٹ میں شناخت شدہ تصاویر، عنوانات اور پیراگراف شامل کرتی ہیں۔

شناخت کا معیار اصل تصویر کی وضاحت، ماڈل کے انتخاب اور دستاویز کی پیچیدگی پر منحصر ہے۔

OCR کے لیے بہترین فائل اقسام

فائل قسمسفارش
واضح اسکرین شاٹسبراہ راست شناخت کریں۔
اسکینزPP-StructureV3 ترجیح دیں۔
فوٹوگراف شدہ دستاویزاتسمت درستگی اور دستاویز ہموار کرنا فعال کریں۔
جدولیں، فارمولے، مہریںساختی ماڈلز کو ترجیح دیں۔
سادہ مختصر متن والی تصاویرPP-OCRv5 عموماً کافی ہے۔

زیادہ واضح تصاویر اور سیدھا متن عموماً بہتر نتائج دیتے ہیں۔

عام صورتیں

صورتمطلب
شناخت ناکامچیک کریں کہ سروس کا ٹوکن یا کلید محفوظ ہے۔
شناخت سست ہےپیچیدہ دستاویزات اور بڑی تصاویر زیادہ وقت لیتی ہیں۔
جدول نامکمل ہےساختی ماڈل آزمائیں۔
متن میں غلطیاں ہیںدھندلا پن، چمک اور ٹیڑھا پن شناخت کی غلطیاں بڑھاتے ہیں۔ زیادہ واضح تصویر آزمائیں۔
Word آؤٹ پٹ میں بہت سی تصاویر ہیںساختی ماڈلز کچھ شناخت شدہ تصاویر محفوظ رکھ سکتے ہیں۔ یہ معمول ہے۔

Google کوٹا معلوم کرنا ناکام ہو جائے

چیک کریں:

  1. سروس اکاؤنٹ JSON درآمد ہو چکا ہے۔
  2. سروس اکاؤنٹ کے پاس Monitoring Viewer کردار ہے۔
  3. پروجیکٹ کے لیے Cloud Vision API فعال ہے۔

اگر آپ کو صرف OCR چاہیے اور استعمال کی معلومات نہیں چاہییں تو سروس اکاؤنٹ JSON نظر انداز کر کے صرف Google Vision API Key بھریں۔

فوری عمل

text
Open System Settings
-> Open Other Settings
-> Fill OCR service credentials
-> Save
-> Return to File Management
-> Select a file and click OCR
-> Choose a model
-> Wait for recognition
-> Copy results or export Markdown / PDF / Word

Released as user documentation for ImgHost.