حين ينكسر
يقول إنه قرأ ملف PDF، لكنه أجاب عن الصفحات الأولى فقط
ويُسأل أيضًا ChatGPT لا يقرأ ملف PDF كاملًا · الذكاء الاصطناعي تجاهل بقية المستند · لخّص البداية فقط · فاته الجدول في الصفحة 200
السبب موثّق من مزوّد أو ورقة منشورة لم يختبره benchr أول تسجيل آخر فحص
ما الذي يحدث فعلًا
قُبل الملف وقُرئ جزء منه، ثم أجاب النموذج من الجزء الذي وصله دون أن يخبرك أن البقية لم تصل.
لماذا
- لرفع المستندات سقفان منفصلان: حجم الملف وعدد الصفحات، وقد يجتاز الملف أحدهما ويسقط في الآخر.
- بعض المسارات تستخرج النص فقط. الرسم البياني أو الصفحة الممسوحة ضوئيًا أو المصوّرة لا تحمل نصًا يُستخرج، فلا تضيف شيئًا في صمت.
- قد يجتاز المستند الطويل حد الرفع ثم يفيض من نافذة السياق بعد إضافة بقية المحادثة إليه.
الإصلاح السريع
اسأله سؤالًا لا يُجاب إلا من آخر المستند: رقم من الجدول الأخير، أو عنوان القسم الختامي. إن عجز، فالملف لم يصل كاملًا.
الإصلاح الحقيقي
قسّم المستند عند حدود الفصول وعالج كل جزء على حدة، ثم اطلب الخلاصة عبر الأجزاء. وفي الواجهة البرمجية أرسله بوصفه مستندًا لا نصًا ملصوقًا، كي تُحفظ صور الصفحات للرسوم والمسوحات.
خطوة خطوة
- قارن عدد الصفحات الحقيقي وحجم الملف بالحد المتاح في الواجهة التي تستخدمها.
- شغّل اختبار نهاية المستند أعلاه قبل الوثوق بأي تلخيص.
- إن كانت الصفحات مسوحات أو صورًا، فقل ذلك في طلبك؛ هذا يغيّر المسار الذي يعالجها.
- قسّم عند الحدود الطبيعية لا عند أعداد الصفحات، حتى لا تقع إجابة على حافّة القطع.
- اطلب مرجع صفحة أو قسم مع كل ادعاء، فيظهر النقص على هيئة مرجع مفقود.
إن كنت ترى خطأ من الواجهة البرمجية
مستند إلى
- قراءة ملف PDF من ستمئة صفحة بما فيه الرسومسقوف الصفحات والحجم الموثّقة، مقروءة من دليل المزوّد.