استخراج جداول PDF إلى Excel مع مراجعة الأعمدة
يحفظ PDF شكل الصفحة وليس جدول بيانات. يجمع Utilgo بين خطوط الجدول ومحاذاة النص لتحديد الخلايا. يوضع كل جدول مكتشف في ورقة منفصلة، ويُحتفظ بالنص المقروء في أوراق مرجعية. توضح ورقة Report طريقة الاستخراج والحالات التي تحتاج إلى مراجعة.
خطوة بخطوة
- ارفع الملف وحدد صفحات مثل 1,3-5 عند الحاجة؛ الحد الأقصى 30 صفحة لكل عملية.
- ابدأ بالاكتشاف التلقائي. إذا اختلطت الأعمدة فجرب الجداول ذات الخطوط أو دون حدود أو المسافات بين الأعمدة.
- اختر لغة المستند للصور الممسوحة؛ الحد الأقصى 10 صفحات OCR. نزّل المصنف وقارنه بالأصل.
مثال توضيحي
مثال: يحافظ وضع النص على رمز المنتج 00123 والمبلغ 1,234.56 كما كُتبا. يتيح اختيار الفاصلة العشرية المناسبة إجراء الحسابات، لكنه قد يغيّر المعرّفات التي تشبه الأرقام. عند وجود رموز ومبالغ معاً، احتفظ بالنص وحوّل عمود المبالغ فقط داخل Excel.
راجع النتيجة
راجع أول صف وآخر صف والمجاميع الفرعية وفواصل الصفحات. قد تنقسم العناوين المدمجة والخلايا متعددة الأسطر بشكل خاطئ. قد يخلط OCR بين 0 وO. لا يمكن استرجاع صيغ الحساب من PDF. وجود ورقة نص لا يعني اكتشاف جميع الجداول.
أسئلة شائعة
ماذا يحدث إذا لم يُكتشف جدول؟
يُحفظ النص المقروء في ورقة مرجعية بعمود واحد مع ملاحظة في Report.
هل تُنفّذ صيغ من الملف؟
لا، لا يُنفّذ محتوى PDF المستورد باعتباره صيغة Excel.
احتفظ بنسخة أصلية قبل المعالجة. الأمثلة توضيحية والنتائج تختلف حسب المستند.