مقدمة إلى LLM
تقدم هذه الصفحة دليلاً بسيطاً حول النماذج اللغوية الكبيرة (LLM) من الأساسيات إلى التطبيقات للمهتمين بتقنيات الذكاء الاصطناعي.
الفصل 10 — رياضيات ما بعد التدريب والمواءمة
المقالة العاشرة من جولة LLM Primer II. كيف يَتحوَّل متنبئٌ بالرمز التالي إلى مساعد مفيد — الضبط الدقيق الموجَّه، نمذجة المكافأة، RLHF بمقود KL، واشتقاق DPO الأنيق الذي يَطوي المنظومة كلَّها في خسارةٍ مُشرَفة واحدة.
1447-09-23الفصل السادس — الأمان والمواءمة والمعنى الحقيقي لكَون النموذج "مفيداً"
المقالة السادسة من جولة LLM Primer I. لماذا الفصاحة وأن يكون النموذج مفيداً أمران مختلفان، وما الذي تَضبطه المواءمة فعلاً، ولمحةٌ من §6.6 الجديد في طبعة 2026 — الذكاء الاصطناعي الدستوري ونماذج المناظرة وأحدث أبحاث المواءمة.
1447-09-06الفصل الرابع — كيف يَتعلَّم النموذج
المقالة الرابعة من جولة LLM Primer I. لماذا يُحدِّد التدريبُ المسبق سقفَ القدرة، ولماذا يَنحت الضبطُ الدقيق الشخصية، وكيف يُحوِّل RLHF مجرَّدَ "متنبِّئٍ بالرمز التالي" إلى المساعد الذي نَثق به يومياً.
1447-09-04