Prompt Engineering و Evals
يتناول هذا الدرس تقنيات prompt engineering وبناء eval harness لاختبار جودة الاستجابات.
مثل كاتب يجرّب عدة نسخ من فقرة الافتتاح — يختبر prompt engineering صياغات مختلفة للحصول على أفضل استجابة من الـ AI.
- Few-shot
- تضمين أمثلة في الـ prompt لمساعدة الـ LLM على فهم التنسيق المطلوب.
- Chain-of-thought
- توجيه الـ LLM للتفكير خطوة بخطوة قبل الإجابة — يحسّن الدقة.
- Eval harness
- نظام آلي يشغّل الـ prompts على test cases ويقيس الجودة.
- LLM-as-judge
- استخدام LLM واحد لتقييم استجابات LLM آخر.