Skip to content

OCR

تستخرج OCR النصوص من الصور، وعمليات المسح الضوئي، ولقطات شاشة المستندات.

بعد التعرف، يمكنك نسخ النتيجة، أو تصديرها بصيغ Markdown أو PDF أو Word، أو تجميع عدة صيغ معًا في حزمة واحدة للتنزيل.

ما الذي تستطيع OCR فعله؟

الميزةالوصف
التعرف على نص الصوريستخرج النصوص من الصور ولقطات الشاشة وعمليات المسح الضوئي.
التعرف على تخطيط المستنداتأفضل للجداول، والصيغ، والأختام، والتخطيطات المختلطة بين النص والصورة.
خدمات متعددةتدعم Baidu PaddleOCR وMicrosoft Azure Vision وGoogle Vision.
نسخ النتائجنسخ النص المتعرف عليه بعد المعالجة.
تصدير الملفاتتصدير Markdown وPDF وWord.
التجميع الدفعيبعد التعرف على عدة ملفات، يمكن تنزيل النتائج كحزمة.

اضبط خدمات OCR أولًا

افتح:

text
System Settings -> Other Settings -> OCR

تحديد الموقع عبر IP وOCR

املأ بيانات الاعتماد للخدمات التي تريد استخدامها:

الخدمةما الذي تدخلهالأنسب لـ
Baidu PaddleOCRPaddleOCR Tokenالخيار الأول الموصى به. مناسب للمستندات، والصور، والجداول، والتخطيطات المختلطة.
Microsoft Azure VisionAzure Vision Endpoint وAzure Vision API Keyمفيد إذا كنت تستخدم خدمات Microsoft السحابية بالفعل.
Google VisionGoogle Vision API Key. يُستخدم حساب الخدمة JSON للاستعلام عن الحصة فقط.مفيد إذا كنت تستخدم خدمات Google Cloud.

احفظ بعد إدخال بيانات الاعتماد.

يمكنك ضبط خدمة واحدة فقط للاختبار الأولي. لا تحتاج إلى الخدمات الثلاث كلها.

إعداد Google Vision

يتكون إعداد Google من جزأين:

الهدفالمتطلب
استخدام OCRتفعيل Cloud Vision API، ثم إنشاء API Key.
الاستعلام عن الاستخدامإنشاء حساب خدمة، ومنحه دور Monitoring Viewer، ثم تنزيل ملف حساب الخدمة JSON.

مفتاح Google API وحساب الخدمة

استخدام Google للتعرف

  1. افتح Google Cloud Console.
  2. انتقل إلى APIs & Services.
  3. افتح Library، وابحث عن Cloud Vision API، ثم فعّله.
  4. ارجع إلى Credentials.
  5. أنشئ API Key.
  6. افتح مفتاح API وانسخه.
  7. الصقه في Google Vision API Key داخل ImgHost.
  8. احفظ.

بعد ذلك يمكنك اختيار Google Vision في مربع حوار OCR.

الاستعلام عن استخدام Google

الاستعلام عن الحصة غير مطلوب للتعرف.

إنه يعرض فقط عددًا تقريبيًا لاستدعاءات Google Vision المستخدمة خلال آخر 30 يومًا.

  1. في Google Cloud Console، افتح IAM & Admin.
  2. افتح Service Accounts.
  3. أنشئ حساب خدمة، مثل vision-monitor.
  4. امنحه دور Monitoring Viewer.
  5. افتح تفاصيل حساب الخدمة وأنشئ مفتاحًا.
  6. اختر JSON.
  7. نزّل ملف JSON الناتج.
  8. ارجع إلى ImgHost واستورده ضمن حساب الخدمة JSON (اختياري).
  9. بعد نجاح الاستيراد، انقر الاستعلام عن الحصة.

بعد الاستيراد، يعرض ImgHost اسم المشروع الذي يملك حساب الخدمة. وعند الاستعلام عن الاستخدام، يقرأ ImgHost بيانات مراقبة Google ويعرض عدد الاستدعاءات لهذا الشهر.

باختصار:

العنصرالغرض
Google Vision API Keyينفذ التعرف باستخدام OCR.
حساب الخدمة JSONيستعلم عن عدد استدعاءات Google Vision المستخدمة.
دور Monitoring Viewerيسمح لحساب الخدمة بقراءة بيانات الاستخدام.

الحصول على Baidu PaddleOCR Token

يتطلب Baidu PaddleOCR رمز وصول.

الحصول على رمز PaddleOCR

افتح نافذة استدعاء API في صفحة Baidu PaddleOCR، وانقر للحصول على رمز، ثم انسخه.

ارجع إلى ImgHost، والصقه في PaddleOCR Token، ثم احفظ.

بدء التعرف

في إدارة الملفات، اختر صورة أو لقطة شاشة لمستند وانقر OCR.

تعرف OCR

في مربع الحوار، اختر خدمة التعرف والنموذج.

خيارات نماذج PaddleOCR الشائعة:

النموذجالأنسب لـ
PP-StructureV3الخيار الافتراضي الموصى به. مناسب للمستندات، والجداول، والصيغ، والأختام، والتخطيطات المختلطة.
PP-OCRv5الصور البسيطة، والنصوص العادية، والتعرف الخفيف.
PaddleOCR-VLالصور المعقدة متعددة اللغات والمحتوى الشبيه بالمخططات.
PaddleOCR-VL-1.5صفحات المستندات الأكثر تعقيدًا واستعادة التخطيط.

إذا لم تكن متأكدًا، فابدأ بـ PP-StructureV3.

خيارات متقدمة

الخيارالوصف
تصحيح الاتجاهاستخدمه عندما تكون الصورة مدوّرة أو مائلة.
تسطيح المستنداستخدمه للمستندات المصورة التي تحتوي على انحناء أو ميل.
اكتشاف التخطيطاستخدمه عندما تريد الحفاظ على العناوين، والفقرات، والجداول، وبنية الصور.
التعرف على المخططاتاستخدمه عندما تحتوي الصورة على مخططات أو بنى معقدة.
تحسين Markdownيجعل Markdown المصدّر أسهل قراءة.

بالنسبة إلى لقطات الشاشة العادية، أبقِ الخيارات في حدها الأدنى. أما بالنسبة إلى المستندات الممسوحة ضوئيًا، ففعّل مزيدًا من الخيارات المتعلقة بالمستندات.

عرض النتائج

بعد انتهاء التعرف، يعرض مربع الحوار النتيجة.

يمكنك نسخها مباشرة أو اختيار صيغ التصدير.

تعرف PDF

بالنسبة إلى صفحات المستندات، يستطيع ملف PDF المصدّر الحفاظ على مظهر الصفحة مع إبقاء النص قابلًا للبحث. يفيد ذلك في أرشفة المستندات الممسوحة والعثور على المحتوى لاحقًا.

اختيار صيغة التصدير

الصيغةالأنسب لـ
Markdown (.md)الملاحظات، وأنظمة التوثيق، والتحرير اللاحق.
PDF (.pdf)الحفاظ على مظهر الصفحة ونتائج المستندات الممسوحة.
Word (.docx)متابعة تحرير التخطيط، وتعديل النص، وتسليم الملف للآخرين.
تصدير الكلحفظ عدة صيغ والصورة الأصلية، وهو مناسب للأرشيفات المهمة.

إذا كنت تحتاج إلى النص فقط، فصدّر Markdown.

إذا كنت تحتاج إلى مظهر الصفحة، فاستخدم PDF أو Word.

إخراج Word

يمكن فتح مستندات Word المصدّرة وتحريرها باستخدام برامج المكتب.

نتيجة Word

تتضمن بعض المستندات صورًا وعناوين وفقرات تم التعرف عليها في إخراج Word.

تعتمد جودة التعرف على وضوح الصورة الأصلية، واختيار النموذج، وتعقيد المستند.

أفضل أنواع الملفات لـ OCR

نوع الملفالتوصية
لقطات الشاشة الواضحةتعرّف عليها مباشرة.
عمليات المسح الضوئييُفضّل PP-StructureV3.
المستندات المصورةفعّل تصحيح الاتجاه وتسطيح المستند.
الجداول، والصيغ، والأختاميُفضّل استخدام النماذج البنيوية.
صور النصوص القصيرة البسيطةيكون PP-OCRv5 كافيًا عادة.

تنتج الصور الأوضح والنصوص الأكثر استقامة نتائج أفضل عادة.

حالات شائعة

الحالةالمعنى
فشل التعرفتحقق من حفظ رمز الخدمة أو المفتاح.
التعرف بطيءتستغرق المستندات المعقدة والصور الكبيرة وقتًا أطول.
الجدول غير مكتملجرّب نموذجًا بنيويًا.
يحتوي النص على أخطاءيزيد الضباب، والوهج، والميل من أخطاء التعرف. جرّب صورة أوضح.
يحتوي إخراج Word على صور كثيرةقد تحتفظ النماذج البنيوية ببعض الصور المتعرف عليها. هذا طبيعي.

فشل الاستعلام عن حصة Google

تحقق من الآتي:

  1. تم استيراد حساب الخدمة JSON.
  2. يملك حساب الخدمة دور Monitoring Viewer.
  3. تم تفعيل Cloud Vision API للمشروع.

إذا كنت تحتاج إلى OCR فقط ولا تحتاج إلى الاستعلام عن الاستخدام، يمكنك تجاهل JSON الخاص بحساب الخدمة وملء Google Vision API Key فقط.

المسار السريع

text
Open System Settings
-> Open Other Settings
-> Fill OCR service credentials
-> Save
-> Return to File Management
-> Select a file and click OCR
-> Choose a model
-> Wait for recognition
-> Copy results or export Markdown / PDF / Word

Released as user documentation for ImgHost.