مقدمة إلى LLM
تقدم هذه الصفحة دليلاً بسيطاً حول النماذج اللغوية الكبيرة (LLM) من الأساسيات إلى التطبيقات للمهتمين بتقنيات الذكاء الاصطناعي.
الفصل 15 — بناء منظّمة ذكاء اصطناعي آمنة
المقال الخامس عشر من جولة LLM Primer VII. الطبقة التنظيمية التي تحمل الاختصاص عبر السنوات: ثقافة، وفرق حمراء، ومخاطر مورّدين، وتقييم مستمرّ، ووصاية طويلة الأمد.
1447-12-07الفصل 4 — حقن التوجيهات وكسر القيود
المقال الرابع من جولة LLM Primer VII. لماذا لا يمتلك حقن التوجيهات إصلاحاً بنيوياً كالاستعلامات الوسيطة، وعائلات كسر القيود، والدفاع الطبقي بأربع طبقات مستقلة.
1447-11-26الفصل 1 — لماذا أمن الذكاء الاصطناعي مختلف
المقال الأول من جولة LLM Primer VII. لماذا لا يكفي الأمن التقليدي، وكيف تكسر LLM الفصل بين الشيفرة والبيانات، ولماذا يصبح غلاف السلوك هو سطح الهجوم بدل خطوط الشيفرة.
1447-11-23الفصل 15 — واجهات API بلا خادم مقابل البنية التحتية المخصَّصة
المقالة الخامسة عشرة من جولة LLM Primer VI. صيغة التعادل نظيفة ولكن مخادعة، وبند هندسة المنصة يُقرِّر الصفقة، وموقف هجين مع مُوجِّه على حد التطبيق.
1447-11-20الفصل 14 — اقتصاديات الرموز وتسعير API
المقالة الرابعة عشرة من جولة LLM Primer VI. لماذا يكلف المُخرَج 4–8× المُدخَل، والتحسين يعتمد على شكل المدخل والمُخرَج، وكيف تُضخِّم رموز التفكير غير المرئية الفاتورة.
1447-11-19الفصل 13 — التوسع التلقائي والتخفيف من البدء البارد
المقالة الثالثة عشرة من جولة LLM Primer VI. لماذا يفشل HPA على LLM بأربع طرق، وKEDA يُوسِّع على عمق الطابور وTTFT وامتلاء KV، وCRIU يضغط بدءاً بارداً إلى 3–6 ثوانٍ.
1447-11-18الفصل 11 — طبقة المنصة والتنسيق
المقالة الحادية عشرة من جولة LLM Primer VI. Ray Serve أولاً Python، KServe أولاً Kubernetes، BentoML يحزم، Triton يُجمِّع نماذج مختلفة — الاختيار عن ملاءمة ثقافة التشغيل.
1447-11-16الفصل 10 — طبقة محرك LLM
المقالة العاشرة من جولة LLM Primer VI. vLLM كافتراضي Python-Native، وTensorRT-LLM يشتري الإنتاجية بخط بناء، وSGLang يفوز على أعباء الوكيل، وشجرة قرار بحسب شكل عبء العمل.
1447-11-15الفصل 9 — فك التشفير التخميني
المقالة التاسعة من جولة LLM Primer VI. رؤية التحقق تحفظ الصحة تماماً، وEAGLE يربط المسوَّدة بالحالة المخفية للهدف، وسقفا α·N و1/α يحكمان تسريع التخمين.
1447-11-14الفصل 7 — استراتيجيات التجميع المتقدمة
المقالة السابعة من جولة LLM Primer VI. لماذا يفشل التجميع الساكن على مشكلة الأسرع انتهاءً، وكيف يُحوِّل التجميع المستمر الدُّفعة إلى فعل، والتعبئة الأمامية المُجزَّأة توحِّد الطورَين.
1447-11-12الفصل 4 — السيليكون المتخصص ودوائر ASIC
المقالة الرابعة من جولة LLM Primer VI. Groq LPU للاستجابة الحتمية، وInferentia2 وTPU وGaudi 3 عندما يستقر النموذج، وأين لا تزال GPU تفوز في نطاق تنوع النماذج.
1447-11-09الفصل 8 — تحسين الأداء والتخديم والتكلفة
المقالة الأخيرة من جولة LLM Primer V. اقتصاديات LLM الإنتاجية بوصفها انضباطاً مُتعدد الطبقات — الاستدعاء الأرخص هو الذي لم يُجرَ (تخزين مؤقت دلالي)، والتالي هو المُجرى ضد أصغر نموذجٍ يفي بالغرض (مُوجِّه)، والأرضية تُوضع داخل خادم الاستدلال بـ KV cache والدُّفَعات المستمرة وفكّ الترميز التخميني.
1447-11-04الفصل 14 — المقارنة والاختبار والأداء
المقالة الخامسة عشرة والأخيرة من جولة LLM Primer IV. معيار MCP-Universe على خوادمٍ حقيقية، وضعيتا الفشل النظاميتان اللتان كَشَفهما، فجوة الإنتاجية بعشرة أضعاف بين الجلسة-لكل-طلب وبِرك الجلسات المُشتركة، والجسر إلى المُجَلَّد الخامس.
1447-10-24الفصل 12 — تَصلُّب البروتوكول والدفاعات
المقالة الثانية عشرة من جولة LLM Primer IV. مجموعات الدفاع الأربع — التَشهيد التَشفيري، انضباط نطاقات OAuth مع جلساتٍ مُقَيَّدة، العزل الصندوقي وقت التشغيل، وبوّابات الإنسان في الحلقة — تَتركَّب في وضعٍ لا يَعتمد على تَصرُّف النموذج صحيحاً تحت الظروف الخصومية.
1447-10-22الفصل 11 — أسطح الهجوم وثغرات البروتوكول
المقالة الحادية عشرة من جولة LLM Primer IV. الهجمات الكلاسيكية مُكَيَّفة لـ MCP — النائب المُلتبس، تَمرير الرمز، اختطاف الجلسة — العيوب على مستوى البروتوكول حول تَصعيد القدرة والمعاينة غير المُصادَق عليها، وتَوارُث الثقة الضمني الذي يَجعل تسميم السياق مشكلةً بنيوية لا نَظافة.
1447-10-21الفصل 6 — استراتيجيات التنسيق الأساسية
المقالة السادسة من جولة LLM Primer IV. الشكلان الأساسيان للتنسيق — الأنابيب المتتابعة وتوازي الاندفاع-الجمع — والسؤال الأسبق الذي ينبغي على كل فريقٍ طرحه: هل نظام الوكلاء المتعدد هو الإجابة الصحيحة أصلاً؟
1447-10-16الفصل 5 — بروتوكولات النقل والاكتشاف
المقالة الخامسة من جولة LLM Primer IV. النقول الثلاثة التي يَدعمها MCP، وطبقة الاكتشاف .well-known مع بطاقات الخادم، والاهتمامات التشغيلية المُملَّة — CORS، التحقُّق من المَنشأ، التخزين المؤقت — التي تُقرِّر هل الخادم مواطنٌ شبكي متعاون أم عبءٌ.
1447-10-15الفصل 2 — كشف بروتوكول سياق النموذج (MCP)
المقالة الثانية من جولة LLM Primer IV. ما الذي يُقَنِّنه MCP فعلاً، تقسيم الأدوار الثلاثة المُضيف والعميل والخادم، لماذا يَختلف الاكتشاف الديناميكي والرسائل ثنائية الاتجاه عن REST في الحالات التي تَهُمّ، ودورة حياة الجلسة التي تَفتتح بالتفاوض على القدرات.
1447-10-12الفصل 1 — أزمة التكامل في الذكاء الاصطناعي وصعود البنية الوكيلية
المقالة الأولى من جولة LLM Primer IV. لماذا يتآكل الوكيل المتجانس مع نمو الموجِّهات، مصفوفة التكامل N×M المختبئة تحت السطح، والانتقال من هندسة الموجِّه إلى هندسة السياق الذي بُني MCP ليُتيحه.
1447-10-11الفصل 11 — التحديثات المستمرة وتحسين الخط
المقالة الحادية عشرة والأخيرة من جولة LLM Primer III. CDC والفهرسة التزايدية تُبقي المكتبة طازجة، التَّخزين المؤقت الدلالي وتَدريج النماذج يُبقيان زمن الاستجابة منخفضاً، وحلقة تَغذيةٍ راجعة من أربع مراحل تَسد الفجوة بين ما يُخبر به الإنتاج الفريق وما يُغيِّره الفريق فعلاً — مع جسرٍ إلى المجلد الرابع عن Model Context Protocol.
1447-10-09الفصل 4 — اختيار قاعدة البيانات الشعاعية المناسبة
المقالة الرابعة من جولة LLM Primer III. الانقسام المعماري بين قواعد البيانات الشعاعية المصمَّمة لغايتها وامتدادات Postgres، والقادة المُدارون (Pinecone وVertex)، والميدان مفتوح المصدر (Qdrant وMilvus وWeaviate)، والخيارات المُضمَّنة، والمحاور التشغيلية الثلاثة — الإقامة والتشغيل والكلفة — التي تَحسم الخيار الحقيقي.
1447-10-02الفصل 3 — أطر التقطيع المتقدمة
المقالة الثالثة من جولة LLM Primer III. طيف التقطيع من الحجم الثابت إلى الواعي بالبنية، خرافة التراكب، حافة السياق التي تُدمر الاسترجاع بصمت، وتقنيتا الاسترجاع السياقي والتقطيع المتأخر اللتان أعادتا تشكيل الجبهة.
1447-10-01الفصل 11 — التقييم والمعايرة والاستدلال
المقالة الحادية عشرة من جولة LLM Primer II. الفصل الذي نَسأل فيه كيف يُمكن قياس آلةٍ قادرةٍ على قول أيِّ شيء — ونَكتشف أنَّ النموذج الواثق كثيراً ما يَكون سيِّء المعايرة.
1447-09-24الفصل الرابع — كيف يَتعلَّم النموذج
المقالة الرابعة من جولة LLM Primer I. لماذا يُحدِّد التدريبُ المسبق سقفَ القدرة، ولماذا يَنحت الضبطُ الدقيق الشخصية، وكيف يُحوِّل RLHF مجرَّدَ "متنبِّئٍ بالرمز التالي" إلى المساعد الذي نَثق به يومياً.
1447-09-04الفصل الثالث — كيف يتدفّق النصّ داخل النموذج
المقالة الثالثة من جولة LLM Primer I. ما الذي يَحدث للرمز حين يَدخل إلى النموذج — التضمينات، الانتباه، Transformer — دون أن نَغرَق في المصفوفات ودون أن نُضيِّع الدقّة.
1447-09-03سلسلة LLM Primer — دليل ميداني للذكاء الاصطناعي التوليدي، مجلَّداً تلوَ مجلَّد
سلسلة LLM Primer — دليل ميداني كامل من سبعة مجلدات حول الذكاء الاصطناعي التوليدي بقلم Sho Shimoda. من الأساسيات إلى الأمان. تشمل Physical AI كمجلد شقيق. جميع المجلدات السبعة متوفرة على أمازون.
1447-08-27