استخراج نص من صورة (OCR عربي) بيتا
أداة OCR عربية بيتا — ترفع صورة (JPG/PNG) لمستند ممسوح ضوئياً وتحصل على نصه قابل للنسخ والتعديل. تعمل بالكامل في متصفحك عبر Tesseract.js — ملفك لا يغادر جهازك.
لماذا هذه الأداة آمنة على خصوصيتك
- معالجة 100% داخل متصفحكملفك لا يُرفع لأي خادم في أي مرحلة من مراحل المعالجة.
- خصوصية كاملةلا نرى ملفك ولا نحتفظ بنسخة منه — لأنه لا يغادر جهازك أصلاً.
- أسرع من الرفع والتنزيلبلا انتظار لرفع الملف أو استلامه من خادم بعيد.
- يعمل حتى بلا إنترنتبعد تحميل الأداة أول مرة، تستمر بالعمل من دون اتصال.
اختر ملف
أو اسحب وأفلت الملف هنا
التحضير للمعالجة
جاري المعالجة...
تمت العملية بنجاح!
تحميل الملف جاهزاًعن هذه الأداة
أداة OCR عربية (نسخة تجريبية) تستخرج النص من صور المستندات الممسوحة ضوئياً أو صور الملفات الورقية. تعمل بالكامل داخل متصفحك عبر Tesseract.js — الصورة لا ترتفع لأي سيرفر. الأداة مصممة للجودة على النصوص الحديثة الواضحة، مع تنبيه واضح إن الدقة تقل مع النصوص التاريخية أو الخطوط القديمة.
كيفية الاستخدام
- 1ارفع صورة المستنداسحب صورة JPG أو PNG لصفحة مستند ممسوحة ضوئياً أو مصوَّرة بوضوح. الأداة تقبل حتى 50 ميجابايت للصورة.
- 2ابدأ الاستخراجاضغط "ابدأ المعالجة". أول مرة تستخدم الأداة، محرك OCR + بيانات اللغة العربية بيتحمّلوا محلياً (مرة واحدة، بعدين محفوظين للاستخدامات القادمة).
- 3انتظر انتهاء التعرّفالعملية تستغرق من 5-30 ثانية للصورة الواحدة حسب حجمها ودقتها وقوة جهازك. هيظهرلك شريط تقدم بالنسبة المئوية.
- 4انسخ أو حمّل النصالنص المستخرج يظهر في مربع نص. تقدر تنسخه بضغطة زر أو تحمّله كملف نصي (.txt). درجة الثقة (Confidence) تظهر بجوار النتيجة لمساعدتك في تقدير جودة الاستخراج.
استخدامات عملية
- ✓ الطلاب: استخراج نص من محاضرة مصوَّرة أو صفحة كتاب ممسوحة لإعادة صياغتها في ملاحظات رقمية.
- ✓ المحاسبون: استخراج بيانات من صور فواتير أو إيصالات لإدخالها في نظام محاسبي.
- ✓ الباحثون: تحويل صور مستندات قديمة أو مقالات مصوَّرة إلى نص قابل للبحث والاقتباس.
- ✓ الصحفيون: استخراج نص من صور شاشة (screenshots) أو صور مستندات مسربة لنقلها في تقاريرهم.
- ✓ المحامون: تحويل نسخ ممسوحة ضوئياً من عقود قديمة إلى نص رقمي قابل للتعديل.
الملفات المدعومة
صور JPG، JPEG، أو PNG فقط في هذه النسخة التجريبية. لملفات PDF، حوّل الصفحات إلى صور أولاً باستخدام أداة PDF إلى صورة.
الحدود
الحد الأقصى لحجم الصورة 50 ميجابايت. النصوص طويلة جداً أو صور بدقة عالية جداً قد تستغرق وقتاً أطول للمعالجة.
كيف نتعامل مع ملفاتك
الصورة تُعالج بالكامل في متصفحك عبر Tesseract.js. لا تُرفع لأي خادم — لا PDF مصري ولا أي طرف ثالث. حتى لو الإنترنت اتقطع بعد ما محرك OCR يتحمّل، الأداة تكمل شغلها بشكل طبيعي.
المميزات الفعلية
- +دعم اللغة العربية بالكامل (نسخ، رقعة، ثلث، خطوط حديثة)
- +يعرض درجة ثقة (Confidence) للنتيجة
- +نسخ للحافظة أو تحميل كملف نصي
- +يعمل محلياً بالكامل — لا رفع للخادم
- +أول تحميل للمحرك (~15 ميجابايت) يُحفظ في المتصفح للاستخدامات القادمة
قيود يجب معرفتها
- !نسخة تجريبية — الدقة تقل مع النصوص التاريخية (مخطوطات قديمة، خطوط ديواني أو رقعة قديمة)
- !يقبل صور فقط في هذه النسخة (JPG/PNG) — دعم PDF مباشر يجي في تحديث قادم
- !الصور الضبابية أو المائلة تعطي نتائج أضعف — تأكد من وضوح الصورة وأنها موجهة صح
- !خلفيات معقدة أو صور فيها ألوان قوية قد تشوش على الاستخراج
نصائح للحصول على أفضل نتيجة
- 💡 أفضل نتائج مع صور ممسوحة ضوئياً بدقة 300 DPI على الأقل
- 💡 لو صورت الصفحة بالموبايل، تأكد من الإضاءة الجيدة وعدم الميل
- 💡 لو النص فيه أعمدة، جرّب قص كل عمود على حدة وشغّل الأداة عليه منفصلاً
- 💡 خلي الصورة أفقية لو النص أفقي (مش مقلوبة)
- 💡 بعد التحميل الأول، الأداة تشتغل أسرع بكتير في المرات القادمة
أسئلة شائعة عن هذه الأداة
الأداة بتاخد وقت أول مرة استخدمتها. ليه؟ ▾
أول تشغيل بيحمّل محرك OCR + بيانات اللغة العربية (حوالي 15 ميجابايت). ده بيحصل مرة واحدة بس؛ المتصفح بيحفظ الملفات وبعدها الأداة بتشتغل فوراً.
إيه معنى نسبة "الثقة" اللي بتظهر؟ ▾
نسبة تعبّر عن مدى تأكد المحرك من النص المستخرج. فوق 85% نتيجة ممتازة، 70-85% كويسة تحتاج مراجعة، تحت 70% النتيجة ضعيفة وممكن تحتاج إعادة مسح للصورة.
ليه الأداة "بيتا"؟ ▾
دي نسخة تجريبية بنقيس بيها جودة الاستخراج للعربي في المتصفح مباشرة. لو الاستخدام أثبت أن الجودة كافية، هنطوّرها لنسخة مستقرة. لو محتاجين دقة أعلى، هننقلها لحل server-side.
هل تعمل مع النصوص التاريخية والمخطوطات؟ ▾
الأداة الحالية مصممة للنصوص الحديثة الواضحة (نسخ حديث، طباعة معتادة). دقتها على المخطوطات أو الخطوط التاريخية أضعف — لو ده استخدامك الأساسي، فضّل تنتظر إعلاننا عن نسخة متخصصة.
هل تتعرف على أرقام هندية (١٢٣) أو عربية (123)؟ ▾
أيوه، بتدعم الاتنين. النموذج العربي في Tesseract مدرَّب على الأرقام الهندية والعربية معاً.
ملفي محمي بكلمة مرور. تنفع؟ ▾
الأداة بتقبل صور بس مش PDFs. لو المستند PDF محمي، فك حمايته أولاً بأداة فك الحماية، ثم حوّله لصور بأداة PDF إلى صورة، ثم شغّل OCR على كل صورة.
هل بياناتي في أمان؟ ▾
أيوه، الأداة محلية بالكامل. صورتك ما بتغادرش المتصفح — لا سيرفر PDF مصري ولا أي طرف ثالث. الوحيد اللي بيتحمّل من الإنترنت هو محرك OCR نفسه (مرة واحدة عند أول استخدام).