مقدمة إلى LLM
تقدم هذه الصفحة دليلاً بسيطاً حول النماذج اللغوية الكبيرة (LLM) من الأساسيات إلى التطبيقات للمهتمين بتقنيات الذكاء الاصطناعي.
الفصل 12 — التحكم بالوصول والهوية
المقال الثاني عشر من جولة LLM Primer VII. المصادقة والتخويل والعزل وحدود المعدل، مع النموذج بوصفه حساباً تُقيَّد قدراته برموز قدرة يُصدرها الكود المحيط.
1447-12-04الفصل 10 — تصميم بنى LLM آمنة
المقال العاشر من جولة LLM Primer VII. البنية بوصفها الاختصاص الأمني الأول: عزل يحدّ نصف قطر الانفجار، وتحقق مُدرَّج بخمس طبقات، وسياسات مُعلَنة، وثقة صفرية على استدعاءات النموذج.
1447-12-02الفصل 3 — أمن البيانات والخصوصية
المقال الثالث من جولة LLM Primer VII. البيانات بوصفها أصلاً بدورة حياة: مخاطر التدريب والاستذكار والاستخراج، وحادثتا Samsung وGarante، ونظام التشفير والعزل والاحتفاظ.
1447-11-25الفصل 16 — استراتيجيات خفض التكلفة في الإنتاج
المقالة الختامية من جولة LLM Primer VI. التوجيه الذكي للنموذج أعلى رافعة، وضغط السياق وواجهات API الدُّفعية والتخزين المؤقت الدلالي تشتري كلٌّ شريحة كبيرة، والحركات تتراكم مضاعفياً.
1447-11-21الفصل 10 — طبقة محرك LLM
المقالة العاشرة من جولة LLM Primer VI. vLLM كافتراضي Python-Native، وTensorRT-LLM يشتري الإنتاجية بخط بناء، وSGLang يفوز على أعباء الوكيل، وشجرة قرار بحسب شكل عبء العمل.
1447-11-15الفصل 9 — فك التشفير التخميني
المقالة التاسعة من جولة LLM Primer VI. رؤية التحقق تحفظ الصحة تماماً، وEAGLE يربط المسوَّدة بالحالة المخفية للهدف، وسقفا α·N و1/α يحكمان تسريع التخمين.
1447-11-14الفصل 7 — استراتيجيات التجميع المتقدمة
المقالة السابعة من جولة LLM Primer VI. لماذا يفشل التجميع الساكن على مشكلة الأسرع انتهاءً، وكيف يُحوِّل التجميع المستمر الدُّفعة إلى فعل، والتعبئة الأمامية المُجزَّأة توحِّد الطورَين.
1447-11-12الفصل 5 — كشف غموض التكميم
المقالة الخامسة من جولة LLM Primer VI. لماذا ينجو نموذج 70B من 4-bit ولا ينجو نموذج 1B، وماذا يفعل AWQ وGPTQ وSmoothQuant وGGUF فعلاً، وسلَّم الأمان مع انضباط المعايرة.
1447-11-10الفصل 4 — السيليكون المتخصص ودوائر ASIC
المقالة الرابعة من جولة LLM Primer VI. Groq LPU للاستجابة الحتمية، وInferentia2 وTPU وGaudi 3 عندما يستقر النموذج، وأين لا تزال GPU تفوز في نطاق تنوع النماذج.
1447-11-09الفصل 1 — ميكانيكا توليد الرموز
المقالة الأولى من جولة LLM Primer VI. الحلقة الانحدارية الذاتية متسلسلة بالضرورة الرياضية، والتعبئة الأمامية وفك التشفير يُجهدان الشريحة بطرق متعاكسة، ولماذا يترك مستخدم واحد وحدةَ H100 عاطلة بنسبة 99.7٪.
1447-11-06الفصل 8 — تحسين الأداء والتخديم والتكلفة
المقالة الأخيرة من جولة LLM Primer V. اقتصاديات LLM الإنتاجية بوصفها انضباطاً مُتعدد الطبقات — الاستدعاء الأرخص هو الذي لم يُجرَ (تخزين مؤقت دلالي)، والتالي هو المُجرى ضد أصغر نموذجٍ يفي بالغرض (مُوجِّه)، والأرضية تُوضع داخل خادم الاستدلال بـ KV cache والدُّفَعات المستمرة وفكّ الترميز التخميني.
1447-11-04الفصل 7 — أمن LLM ومحاورها الوقائية
المقالة السابعة من جولة LLM Primer V. تسمية محور الأمن الجديد الذي تُدخله تطبيقات LLM — التحكم بأيّ التعليمات تصل إلى النموذج، من أين، حاملةً كم من الصلاحية — وبناء مصفوفة التخفيف رباعية الطبقات حوله.
1447-11-03الفصل 6 — قابلية الرصد والتتبع للذكاء الاصطناعي
المقالة السادسة من جولة LLM Primer V. اعتبار استعلام المستخدم شجرةً سببيةً لا سِجل طلبات، وما يجب تتبعه لتصير الشجرة مقروءة — اصطلاحات OpenTelemetry GenAI، وقياسات LLM، وخط الأنابيب الذي يُحوّل الآثار الإنتاجية إلى مجموعة تقييم الإصدار التالي.
1447-11-02الفصل 5 — تقييم تطبيقات LLM
المقالة الخامسة من جولة LLM Primer V. يعترف الفصل بأن assertEqual مات في مخرجات LLM ويُعيد بناء انضباط الاختبار حول قضاةٍ مُثبَّتين برُبريكات، والثلاثي RAG، واختبارات مسار الوكلاء.
1447-11-01الفصل 4 — الوكلاء واستدعاء الأدوات
المقالة الرابعة من جولة LLM Primer V. الوكيل بوصفه نموذجاً مُلَقَّماً ضدّ أدواتٍ ذات مخططات وطبقات ذاكرة وأسلاك متعددة الوكلاء يجب هندستها قبل أن يُوثَق بالحلقة في أيّ عملٍ حقيقي.
1447-10-29الفصل 3 — التوليد المُعزَّز بالاسترجاع
المقالة الثالثة من جولة LLM Primer V. خط أنابيب RAG من طرفٍ إلى طرف — التحميل والتقطيع والتضمين والاسترجاع والتوليد — وكيف يفصل التقطيع الجيد والاسترجاع الهجين وتحويلات الاستعلام العرضَ الذي يعمل على وثائقك المُفضَّلة عن النظام الذي ينجو من ملامسة مدوَّنتك الحقيقية.
1447-10-28الفصل 2 — النماذج الأساسية وهندسة المُوجِّهات
المقالة الثانية من جولة LLM Primer V. اختيار النموذج بوصفه قراراً هندسياً، ومعاملات المعاينة كملفٍّ متعمَّد، والمُوجِّهات الدفاعية والمخرجات المُهيكَلة على مستوى المُحلِّل بوصفها أسطحاً هندسية.
1447-10-27الفصل 14 — المقارنة والاختبار والأداء
المقالة الخامسة عشرة والأخيرة من جولة LLM Primer IV. معيار MCP-Universe على خوادمٍ حقيقية، وضعيتا الفشل النظاميتان اللتان كَشَفهما، فجوة الإنتاجية بعشرة أضعاف بين الجلسة-لكل-طلب وبِرك الجلسات المُشتركة، والجسر إلى المُجَلَّد الخامس.
1447-10-24الفصل 13 — الأُطُر وتكامل السحابة
المقالة الثالثة عشرة من جولة LLM Primer IV. Strands مع Bedrock، نمط طبقة الحالة في AWS، إطار وكلاء Microsoft، LangChain، Semantic Kernel — وأشكال التكامل الإنتاجي الثلاثة التي تَصل إليها الفِرَق مستقلَّة.
1447-10-23الفصل 7 — الأنماط التعاونية والديناميكية المتقدمة
المقالة السابعة من جولة LLM Primer IV. إجماع المستديرة، توجيه التسليم، والتنسيق ماجنتيك — الأنماط التي تَظهر حين يجب بناء الطوبولوجيا لكل طلب، مع وضعيات الفشل (عدم الإنهاء، سوء التوجيه، التخطيط الجامح) التي تَتجنَّبها الأنماط الأبسط.
1447-10-17الفصل 6 — استراتيجيات التنسيق الأساسية
المقالة السادسة من جولة LLM Primer IV. الشكلان الأساسيان للتنسيق — الأنابيب المتتابعة وتوازي الاندفاع-الجمع — والسؤال الأسبق الذي ينبغي على كل فريقٍ طرحه: هل نظام الوكلاء المتعدد هو الإجابة الصحيحة أصلاً؟
1447-10-16LLM Primer IV — مقدمة السلسلة والفهرس
انطلاق الجولة الفصلية للكتاب الرابع من سلسلة LLM Primer — تصميم الإدراك الاصطناعي بـ MCP. لماذا تحتاج الوكلاء إلى طبقة بروتوكول لتتجاوز العروض التوضيحية، ولمن كُتب هذا الكتاب، وجدول الأربعة عشر مقالاً التالية من 30 مارس حتى 12 أبريل.
1447-10-10الفصل 7 — تطبيق ضوابط الوصول
المقالة السابعة من جولة LLM Primer III. ACL على مستوى الوثيقة بوصفها الأساس، RBAC مع تسميات حساسية Microsoft Purview، ReBAC مع Zanzibar وSpiceDB، وانضباط التَّرشيح المُسبق مقابل اللاحق الذي يَجري تحتها جميعاً.
1447-10-05الفصل 5 — هندسة خط الاسترجاع
المقالة الخامسة من جولة LLM Primer III. لماذا ليس بحثٌ شعاعي واحد خطاً — الاسترجاع الهجين، دمج الرُّتب التبادلي، إعادة الترتيب بمُرمِّز متقاطع، وإعادة الصياغة من جهة الاستعلام وHyDE — مُجمَّعة في البنية الإنتاجية التي تَتقارب عليها أنظمة RAG الناضجة.
1447-10-03الفصل 3 — أطر التقطيع المتقدمة
المقالة الثالثة من جولة LLM Primer III. طيف التقطيع من الحجم الثابت إلى الواعي بالبنية، خرافة التراكب، حافة السياق التي تُدمر الاسترجاع بصمت، وتقنيتا الاسترجاع السياقي والتقطيع المتأخر اللتان أعادتا تشكيل الجبهة.
1447-10-01الفصل 2 — التحليل الذكي للوثائق
المقالة الثانية من جولة LLM Primer III. لماذا ليس ملف PDF ملفاً نصياً، وما الذي يَحفظه فعلاً المُحلِّلات الواعية بالتخطيط، ومشهد الأدوات الحالي (LlamaParse وDocling وUnstructured وMarker-PDF وFirecrawl وDeepSeek-OCR)، والمسار المتعدد الوسائط الذي يَسترجع على صور الصفحات مباشرة.
1447-09-30LLM Primer III — مقدمة السلسلة والفهرس
انطلاقة الجولة الفصلية للكتاب الثالث في سلسلة LLM Primer — تعزيز ذكاء المؤسسة بـ RAG. لماذا يبدو التوليد المعزز بالاسترجاع بسيطاً من الخارج وهو في باطنه طبقة من التخصصات، ولمن كُتب هذا الكتاب، وجدول النشر للمقالات الإحدى عشرة المقبلة من 18 إلى 28 مارس.
1447-09-28سلسلة LLM Primer — دليل ميداني للذكاء الاصطناعي التوليدي، مجلَّداً تلوَ مجلَّد
سلسلة LLM Primer — دليل ميداني كامل من سبعة مجلدات حول الذكاء الاصطناعي التوليدي بقلم Sho Shimoda. من الأساسيات إلى الأمان. تشمل Physical AI كمجلد شقيق. جميع المجلدات السبعة متوفرة على أمازون.
1447-08-27