PDF إلى JSON

استخراج JSON من ملف PDF

استخرج بيانات منظّمة من أي ملف PDF بصيغة JSON نظيفة — حدّد حقولك ودع الذكاء الاصطناعي يملؤها.

استخراج JSON من ملف PDF عبر الإنترنت

بدل تفريغ المستند كله كنص، يسألك PDF Vision عن الحقول المهمة — invoiceNumber وinvoiceDate وtotalAmount وpartyA — وعن نوع كل منها: string أو number أو boolean أو date أو array أو object. ثم يقرأ الذكاء الاصطناعي ملف PDF ويعيد هذا الشكل بالضبط بصيغة JSON، جاهزًا للصق في جسم طلب، أو صف في قاعدة بيانات، أو خطوة أتمتة. تمنحك القوالب الجاهزة للفواتير وجهات الاتصال والعقود مخططًا تبدأ منه. يجري الاستخراج على خوادمنا عبر خدمة ذكاء اصطناعي مدفوعة، لذا تتطلب هذه الأداة خطة Gold — ويُرفض الحساب المجاني في هذه الأداة.

كيف تعمل

  1. حدّد المخطط

    أضف صفًا لكل حقل، وسمّه بصيغة camelCase وحدّد نوعه، أو حمّل قالب الفاتورة أو جهة الاتصال أو العقد.

  2. ارفع ملف PDF

    اختر المستند المراد قراءته؛ يجري الاستخراج على خوادمنا ضمن خطة Gold الخاصة بك ويستغرق وقتًا أطول مع الملفات الكثيفة أو متعددة الصفحات.

  3. انسخ JSON أو نزّله

    افحص النتيجة في العرض الشجري، ثم انسخها إلى الحافظة أو احفظها كملف .json.

لماذا تستخدمها

أنت تتحكم في المخطط

أسماء الحقول وأنواعها من اختيارك، فتدخل الاستجابة مباشرة في واجهة TypeScript موجودة أو عمود قاعدة بيانات دون كتابة طبقة تحويل بينهما.

أنواع حقيقية لا نصوص فقط

تعريف القيمة كـ number أو boolean أو date يعني أن المجاميع تعود أرقامًا والتواريخ بصيغة قابلة للمقارنة، بدل نصوص يضطر كودك إلى تحليلها والتحقق منها.

كل تشغيل يُحفظ

تبقى عمليات الاستخراج السابقة في لوحة السجل: أعد فتح إحداها لفحص JSON الخاص بها في العرض الشجري أو تنزيل الملف مجددًا، دون إعادة رفع ملف PDF.

الأسئلة الشائعة

كيف أختار الحقول التي أريد استخراجها؟
تدرجها بنفسك، صفًا تلو الآخر: اسم الحقل ونوعه من بين string أو number أو boolean أو date أو array أو object. يجب أن تكون الأسماء معرّفات صالحة، فاكتب invoiceTotal لا "invoice total".
هل توجد نقطة بداية للمستندات الشائعة؟
نعم، ثلاثة قوالب جاهزة تملأ المخطط نيابة عنك: الفاتورة (الرقم، التاريخ، المورّد، المجموع، العملة)، وجهة الاتصال (الاسم الكامل، البريد الإلكتروني، الهاتف، الشركة)، والعقد (العنوان، الطرفان، تاريخا البداية والنهاية). عدّل أي صف بعد ذلك.
هل يعمل مع ملفات PDF الممسوحة ضوئيًا؟
ليس بشكل موثوق. يقرأ الاستخراج النص الموجود أصلًا في ملف PDF، فيعيد المسح الخالص حقولًا شحيحة أو فارغة. شغّل OCR PDF عليه أولًا لإضافة طبقة نص، ثم عُد واستخرج.
ماذا لو لم يكن الحقل موجودًا في المستند؟
لا يستطيع الاستخراج بالذكاء الاصطناعي قراءة إلا ما يظهر على الصفحة، فالحقل الذي لا يذكره المستند إطلاقًا لا يمكن ملؤه. تعامل مع الناتج كبيانات يجب التحقق منها، خاصة الأرقام التي تُبنى عليها مدفوعات أو قيود محاسبية.
هل أحتاج إلى حساب؟
نعم، وحساب مدفوع: يتطلب تحويل PDF إلى JSON خطة Gold. يُرفض الحساب المجاني في هذه الأداة، فالتسجيل وحده لن يمنحك الوصول. ويجري الاستخراج أيضًا على الخادم، ما يعني أن المستند يُرفع للمعالجة بدل أن يُحلَّل داخل متصفحك.
ماذا يمكنني أن أفعل بملف JSON بعد ذلك؟
انسخه من العرض الشجري أو نزّل الملف، ثم أرسله عبر POST إلى واجهة برمجية، أو أدرجه كصف في قاعدة بيانات، أو مرّره إلى استيراد جدول بيانات أو نظام محاسبي أو سير عمل مؤتمت.