اختيار النموذج قرار هندسي، لا مودّة. ابدأ من طبيعة المهمة: توليد نص عربي طويل، تصنيف قصير، استدعاء أدوات، أم تحليل مستندات؟ لكل نوع عتبات مختلفة.
المعيار الأول: جودة العربية على أمثلتك أنت. خمسين مثالاً حقيقياً من عملك أهم من أي لوحة صدارة. شغّلها على نموذجين أو ثلاثة وقارن بقرار بشري محايد.
المعيار الثاني: نافذة السياق الفعلية لا المعلنة. النموذج الذي يفعل مئة ألف رمز قد يتدهور بعد العشرين ألفاً. اختبر بسؤال في آخر المستند وآخر فيه.
المعيار الثالث: التكلفة لكل مهمة مكتملة، لا لكل رمز. المهمة الواحدة قد تحتاج خمس محاولات على نموذج رخيص لتوازي محاولة واحدة على أغلى — فالعبرة بالسعر النهائي للنتيجة.
المعيار الرابع: الاستدعاء البنيوي والأدوات. إن كان عملك يعتمد على JSON صارم أو استدعاء دوال، فاختبر هذا تحديداً؛ التدهور هنا لا يظهر في المحادثة الطبيعية.
الخلاصة: نموذج لكل فئة مهمة. نموذج قوي للمسودات والتحليل، ونموذج سريع صغير للتصنيف والتحويل. هذه البنية تخفض التكلفة وترفع الثبات معاً.

لا تعليقات بعد — كن أول من يشارك.