مقدمة إلى LLM
تقدم هذه الصفحة دليلاً بسيطاً حول النماذج اللغوية الكبيرة (LLM) من الأساسيات إلى التطبيقات للمهتمين بتقنيات الذكاء الاصطناعي.
الفصل 16 — استراتيجيات خفض التكلفة في الإنتاج
المقالة الختامية من جولة LLM Primer VI. التوجيه الذكي للنموذج أعلى رافعة، وضغط السياق وواجهات API الدُّفعية والتخزين المؤقت الدلالي تشتري كلٌّ شريحة كبيرة، والحركات تتراكم مضاعفياً.
1447-11-21الفصل 8 — الجيل التالي من إدارة ذاكرة KV
المقالة الثامنة من جولة LLM Primer VI. PagedAttention يجعل KV ذاكرةً افتراضيّة، وإخلاء H2O وInfiniGen يُزيل الرموز التي لا تهم، والتخزين المؤقت للبادئات هو أعلى رافعة عائد.
1447-11-13الفصل 5 — بروتوكولات النقل والاكتشاف
المقالة الخامسة من جولة LLM Primer IV. النقول الثلاثة التي يَدعمها MCP، وطبقة الاكتشاف .well-known مع بطاقات الخادم، والاهتمامات التشغيلية المُملَّة — CORS، التحقُّق من المَنشأ، التخزين المؤقت — التي تُقرِّر هل الخادم مواطنٌ شبكي متعاون أم عبءٌ.
1447-10-15الفصل 11 — التحديثات المستمرة وتحسين الخط
المقالة الحادية عشرة والأخيرة من جولة LLM Primer III. CDC والفهرسة التزايدية تُبقي المكتبة طازجة، التَّخزين المؤقت الدلالي وتَدريج النماذج يُبقيان زمن الاستجابة منخفضاً، وحلقة تَغذيةٍ راجعة من أربع مراحل تَسد الفجوة بين ما يُخبر به الإنتاج الفريق وما يُغيِّره الفريق فعلاً — مع جسرٍ إلى المجلد الرابع عن Model Context Protocol.
1447-10-09