المشكلة
حوّلت ملف PDF فيه أرقام (فاتورة، كشف حساب، تقرير) إلى Word أو Excel، ولقيت شكل الأرقام اتغيّر:
- الأرقام الهندية (٠١٢٣٤٥٦٧٨٩) اتحولت لأرقام غربية (0123456789) أو العكس
- الأرقام في الجدول بقت نص عادي مش قابلة للجمع أو الحساب في Excel
- ترتيب خانات رقم مكوّن من أكتر من رقم اتقلب (زي 2026 تبقى 6202)
المشكلة دي شائعة جداً في المستندات المالية العربية، وليها سبب تقني واضح.
توضيح أول: مفيش “أرقام عربية” و”أرقام إنجليزية” فعلياً
اللبس الشائع إن الناس بتسمي الشكل ٠١٢٣٤٥٦٧٨٩ “أرقام عربية” والشكل 0123456789 “أرقام إنجليزية”، لكن التسمية التقنية الدقيقة:
- الأرقام الغربية (Western Arabic Numerals): 0123456789 — المستخدمة في مصر والشام غالباً، وعالمياً في كل البرمجة والويب.
- الأرقام الهندية / الشرقية (Eastern Arabic-Indic Numerals): ٠١٢٣٤٥٦٧٨٩ — المستخدمة في السعودية ودول الخليج غالباً في المستندات الرسمية.
كلا الشكلين “عربي” في الأصل — الفرق إقليمي في العرف الكتابي، مش لغوي. أدوات PDF والتحويل أحياناً بتتعامل مع الشكلين كأنهم قيمة واحدة، فتستبدل شكلاً بالتاني حسب إعدادات الأداة أو النظام.
السبب التقني
- إعدادات الترقيم في Word: Word عنده خيار “طريقة عرض الأرقام” (Numeral) تحت File → Options → Advanced، وبيقدر يفرض شكل رقم معيّن (غربي، هندي، أو حسب السياق) بغض النظر عن الشكل الأصلي في الملف المصدر.
- محركات استخراج النص (Text Extraction / OCR): أغلب محركات التعرف على النص اتدربت بيانات أكتر بالأرقام الغربية، فلما تقرأ رقماً هندياً من صورة أو PDF ممسوح، ممكن تفسره أو تخرجه كرقم غربي تلقائياً.
- الخط نفسه: بعض الخطوط بترسم الأرقام الهندية والغربية بنفس شكل الجليف الداخلي (Glyph) مع اختلاف الترميز بس، فأي أداة تحويل بتعتمد على الخط ممكن تلخبط بينهم.
- اتجاه القراءة (RTL) مع أرقام متعددة الخانات: الأرقام دايماً بتتقرأ من الشمال لليمين حتى جوه نص عربي RTL (يعني رقم “2026” هيفضل بنفس الترتيب). لو ظهر الترتيب مقلوباً بعد التحويل، فده عادة خطأ في محرك المعالجة مش سلوكاً طبيعياً للغة.
خطوات الحل السريع
- حدّد شكل الأرقام في Word قبل التصدير لـ PDF: من File → Options → Advanced → Show document content → “Numeral”، اختر “Arabic” للأرقام الغربية أو “Context” للحفاظ على الشكل المستخدم في النص الأصلي.
- حوّل PDF إلى Word عبر محرك موثوق للعربي: استخدم PDF إلى Word، ثم راجع الأرقام في الناتج — لو الشكل مختلف عن المطلوب، حدّده يدوياً بنفس إعداد Word السابق وأعد التصدير.
- لجداول الأرقام (فواتير وكشوف حسابات)، استخدم أداة جداول متخصصة: PDF إلى Excel يستخرج الأرقام كخانات منفصلة أدق من النسخ العادي، لكن تأكد إن الخانة مُنسّقة كـ”رقم” وليس “نص” في Excel حتى تقدر تجمعها.
- لو القيمة صحيحة والشكل بس مختلف، حوّله بدل ما تعيد التحويل كله: في Excel أو Word ممكن تستبدل شكل الأرقام دفعة واحدة عبر Find & Replace بدل إعادة تحويل الملف من الأول.
حالات شائعة تفصيلياً
التحويل لـ Word غيّر شكل كل الأرقام في المستند
هذا يعني إعداد الترقيم الافتراضي في Word (أو في نظام تشغيل جهازك) مضبوط على شكل معيّن بيتفرض على أي نص جديد. الحل: غيّر الإعداد قبل الفتح، أو بعد التحويل مباشرة قبل أي تعديل تاني.
التحويل لـ Excel خلّى عمود الأرقام “نص” مش “رقم”
بيحصل لما الأرقام المستخرجة تحتوي رموزاً غير رقمية مختلطة (فواصل عربية، رموز عملة، مسافات خفية) أو ترميز Unicode مختلف عن اللي Excel بيتوقعه كرقم صالح. الحل: حدد العمود → Data → Text to Columns → Finish، وده بيجبر Excel يعيد تفسير القيم كأرقام.
رقم مكوّن من عدة خانات ظهر بترتيب مقلوب
هذا خطأ حقيقي في معالجة النص (مش سلوكاً طبيعياً)، وغالباً بيحصل مع محركات OCR ضعيفة على ملفات ممسوحة ضوئياً. الحل: أعد المعالجة بمحرك أدق، أو صحّح الأرقام يدوياً لو العدد قليل.
نصائح لتجنب المشكلة من الأساس
- وحّد شكل الأرقام (هندي أو غربي) في المستند الأصلي قبل أي تصدير لـ PDF، بدل تصحيحه بعد التحويل.
- في المستندات المالية الرسمية (فواتير، عقود)، افحص شكل الأرقام مرة يدوياً بعد أول تحويل للتأكد من التوافق مع متطلبات الجهة المستلمة.
- لو بتنشئ نماذج ترقيم صفحات بأرقام هندية، أداة ترقيم الصفحات في PDF مصري بتدعم الاختيار بين الأرقام الغربية والهندية مباشرة.
أسئلة شائعة
ما الفرق الحقيقي بين “الأرقام العربية” و”الأرقام الهندية”؟
من الناحية التقنية، الاسمان يشيران لنفس العائلة اللغوية. المصطلح الدقيق: “أرقام غربية” (0-9) و”أرقام هندية/شرقية” (٠-٩). الاستخدام يختلف حسب الدولة والسياق الرسمي.
ليه Word بيبدّل شكل الأرقام تلقائياً أحياناً؟
لأن Word بيطبّق إعداد “Numeral” العام على أي نص عربي جديد بغض النظر عن شكله الأصلي في الملف المصدر، إلا لو غيّرته يدوياً لخيار “Context” الذي يحافظ على الشكل الأصلي.
هل تغيير شكل الأرقام (هندي/غربي) بيأثر على القيمة الحسابية في Excel؟
لأ، القيمة الرقمية واحدة سواء كان الشكل هندياً أو غربياً — بشرط إن Excel يتعرف عليها كرقم فعلاً وليس كنص. المشكلة الوحيدة اللي بتأثر على الحساب هي لو الخانة اتخزنت كنص.
إزاي أخلي كل الأرقام في مستند Word هندية دفعة واحدة؟
من File → Options → Advanced → Show document content → Numeral، اختر “Arabic” (وهو المصطلح اللي Word بيستخدمه للأرقام الهندية ٠-٩)، وهيتطبق على المستند كله تلقائياً.
هل المشكلة دي بتحصل مع التحويل العادي بس ولا مع OCR كمان؟
بتحصل في الحالتين، لكنها أشيع وأصعب حلاً مع OCR على ملفات ممسوحة ضوئياً، لأن المحرك بيحاول “يتعرف” على شكل الرقم من صورة، وممكن يخطئ بين شكلين متقاربين بصرياً.
خلاصة
اختلاف شكل الأرقام بعد تحويل PDF مش خطأ في القيمة نفسها غالباً — هو مسألة إعداد وتنسيق. تحديد شكل الأرقام في المصدر قبل التصدير، والفحص بعد أي تحويل، بيحلّوا المشكلة في أغلب الحالات.
جرّب الآن: PDF إلى Word أو PDF إلى Excel للتحويل مع الحفاظ على البيانات.
مقالات ذات صلة: