عقد برومبت · اختبار A/B · داخل المتصفح

ابنِ برومبتًا تقدر تختبره فعلًا.

حوّل الفكرة إلى مهمة صريحة وعقد إخراج وحدود أدلة ومعايير نجاح. احفظ النسخة A، غيّر عنصرًا مضبوطًا، ثم أرسل نسخة واحدة أو النسختين إلى المختبر.

جارٍ تجهيز المساحة…

01 · حدّد

عقد البرومبت

ابدأ من حالة تقييم مفتوحة أو اكتب مهمتك من الصفر.

بنية متقدمة

ابدأ من عمل حقيقي

توفّر الحِزم المفتوحة حالات اصطناعية ثابتة ومعايير تقييم. هي نقطة بداية، وليست دليلًا على فوز برومبت أو نموذج.

افحص ملف الحِزم ←

غيّر متغيرًا واحدًا

احفظ خط الأساس نفسه، وغيّر قسمًا واحدًا مع تثبيت النموذج والإعدادات والحالات ومعيار التقييم. إذا تحركت أقسام عدة فاعتبر النتيجة استكشافية.

اقرأ دليل الاختبار المضبوط ←

قِس الفشل

قيّم نتائج يمكن ملاحظتها: أخطاء التحليل، الحقول الناقصة، الادعاءات غير المسندة، مخالفات السياسة، وقبول المراجع. لا تجعل قائمة الاكتمال بديلًا عن التقييم.

راجع منهجية benchr ←

لماذا بُنيت المساحة بهذه الطريقة؟

تختلف إرشادات المزوّدين باختلاف النموذج، لكنها تكرر أهمية التعليمات الواضحة والقيود وشكل الإخراج والسياق المرتبط بالمهمة والاختبار التجريبي. توصي OpenAI أيضًا بتحديد النتيجة أولًا وإعادة التقييم عند عزل تغييرات البرومبت؛ وتبدأ Anthropic من معايير نجاح قابلة للقياس واختبارات؛ وتصف Google بناء البرومبت كعملية تكرارية وتقترح تقسيم المهام المعقدة إلى مكونات.

لا يضمن أي نمط تحسنًا. يتأثر السلوك بالنموذج وتعريفات الأدوات وإعدادات التوليد والمهمة نفسها، لذلك تنتج المساحة أثرًا قابلًا للاختبار بدل ادعاء «برومبت أفضل» للجميع.

رُوجعت إرشادات المصادر في 26 أغسطس 2026. راجع دائمًا توثيق النموذج وواجهة API اللذين ستستخدمهما.