مقدمة إلى LLM
تقدم هذه الصفحة دليلاً بسيطاً حول النماذج اللغوية الكبيرة (LLM) من الأساسيات إلى التطبيقات للمهتمين بتقنيات الذكاء الاصطناعي.
الفصل 17 — تهديدات المستقبل والدفاعات الناشئة
المقال الأخير من جولة LLM Primer VII وخاتمة سلسلة LLM Primer بمجملها. الوكلاء المستقلّون والوسائط الجديدة والهوية الاصطناعية وضمان الذكاء الاصطناعي، ثم جسر إلى Physical AI.
1447-12-09الفصل 16 — الضبط الدقيق والتكييف الآمنان
المقال السادس عشر من جولة LLM Primer VII. تآكل المحاذاة عبر بيانات حميدة، والتسميم بمائة مثال مصوغ، وبوابات تقييم CI، وسجل نماذج يجعل التراجع دقائق لا يوماً.
1447-12-08الفصل 15 — بناء منظّمة ذكاء اصطناعي آمنة
المقال الخامس عشر من جولة LLM Primer VII. الطبقة التنظيمية التي تحمل الاختصاص عبر السنوات: ثقافة، وفرق حمراء، ومخاطر مورّدين، وتقييم مستمرّ، ووصاية طويلة الأمد.
1447-12-07الفصل 13 — الخريطة التنظيمية
المقال الثالث عشر من جولة LLM Primer VII. قانون AI الأوروبي مِرساةً، وGDPR وقواعد حماية البيانات النظيرة، وبطاقات النماذج والقابلية للتدقيق بوصفها الشكل التشغيلي.
1447-12-05الفصل 11 — الرصد والتسجيل والاستجابة للحوادث
المقال الحادي عشر من جولة LLM Primer VII. سياسة تسجيل مبنية على أعراف OpenTelemetry GenAI، وكشف مركّب بالتوقيع والإحصاء والسلوك، ودليل استجابة حوادث مستوحى من NIST.
1447-12-03الفصل 10 — تصميم بنى LLM آمنة
المقال العاشر من جولة LLM Primer VII. البنية بوصفها الاختصاص الأمني الأول: عزل يحدّ نصف قطر الانفجار، وتحقق مُدرَّج بخمس طبقات، وسياسات مُعلَنة، وثقة صفرية على استدعاءات النموذج.
1447-12-02الفصل 9 — سلامة النموذج ومخاطر سلسلة التوريد
المقال التاسع من جولة LLM Primer VII. أثر النموذج بوصفه ملفاً ثنائياً من طرف ثالث: أبواب خلفية تنجو من التدريب، وpickle مقابل safetensors، وSigstore ورصد الانحراف.
1447-12-01الفصل 8 — الهجمات الخصومية على النماذج
المقال الثامن من جولة LLM Primer VII. النسب من FGSM إلى اللواحق العامّة، والهجمات على الصندوق الأسود بكلفة قليلة، وسرقة النماذج بوصفها هجوماً على السرية يُنتج بديلاً أبيض الصندوق.
1447-11-30الفصل 7 — الهلوسة والموثوقية
المقال السابع من جولة LLM Primer VII. آليات الهلوسة، والفجوة بين الثقة والصحّة، والمعايرة والتحقق الهجين بوصفها الإصلاح التشغيلي.
1447-11-29الفصل 3 — أمن البيانات والخصوصية
المقال الثالث من جولة LLM Primer VII. البيانات بوصفها أصلاً بدورة حياة: مخاطر التدريب والاستذكار والاستخراج، وحادثتا Samsung وGarante، ونظام التشفير والعزل والاحتفاظ.
1447-11-25الفصل 2 — نمذجة التهديد لأنظمة LLM
المقال الثاني من جولة LLM Primer VII. أسئلة Shostack الأربعة، وSTRIDE وPASTA وMITRE ATLAS مطبقة على أنظمة LLM، وقالب نموذج تهديد عملي تشير إليه بقية الكتاب.
1447-11-24LLM Primer VII — تمهيد السلسلة والفهرس
تمهيد سلسلة LLM Primer VII: أمان الذكاء الاصطناعي، وفهرس الجولة الفصلية من 10 إلى 26 مايو، ولماذا يُعيد أمن النماذج اللغوية الكبيرة بناءَ الأرض التي وقف عليها الأمن التقليدي.
1447-11-22الفصل 16 — استراتيجيات خفض التكلفة في الإنتاج
المقالة الختامية من جولة LLM Primer VI. التوجيه الذكي للنموذج أعلى رافعة، وضغط السياق وواجهات API الدُّفعية والتخزين المؤقت الدلالي تشتري كلٌّ شريحة كبيرة، والحركات تتراكم مضاعفياً.
1447-11-21الفصل 15 — واجهات API بلا خادم مقابل البنية التحتية المخصَّصة
المقالة الخامسة عشرة من جولة LLM Primer VI. صيغة التعادل نظيفة ولكن مخادعة، وبند هندسة المنصة يُقرِّر الصفقة، وموقف هجين مع مُوجِّه على حد التطبيق.
1447-11-20الفصل 14 — اقتصاديات الرموز وتسعير API
المقالة الرابعة عشرة من جولة LLM Primer VI. لماذا يكلف المُخرَج 4–8× المُدخَل، والتحسين يعتمد على شكل المدخل والمُخرَج، وكيف تُضخِّم رموز التفكير غير المرئية الفاتورة.
1447-11-19الفصل 11 — طبقة المنصة والتنسيق
المقالة الحادية عشرة من جولة LLM Primer VI. Ray Serve أولاً Python، KServe أولاً Kubernetes، BentoML يحزم، Triton يُجمِّع نماذج مختلفة — الاختيار عن ملاءمة ثقافة التشغيل.
1447-11-16الفصل 10 — طبقة محرك LLM
المقالة العاشرة من جولة LLM Primer VI. vLLM كافتراضي Python-Native، وTensorRT-LLM يشتري الإنتاجية بخط بناء، وSGLang يفوز على أعباء الوكيل، وشجرة قرار بحسب شكل عبء العمل.
1447-11-15الفصل 9 — فك التشفير التخميني
المقالة التاسعة من جولة LLM Primer VI. رؤية التحقق تحفظ الصحة تماماً، وEAGLE يربط المسوَّدة بالحالة المخفية للهدف، وسقفا α·N و1/α يحكمان تسريع التخمين.
1447-11-14الفصل 7 — استراتيجيات التجميع المتقدمة
المقالة السابعة من جولة LLM Primer VI. لماذا يفشل التجميع الساكن على مشكلة الأسرع انتهاءً، وكيف يُحوِّل التجميع المستمر الدُّفعة إلى فعل، والتعبئة الأمامية المُجزَّأة توحِّد الطورَين.
1447-11-12الفصل 6 — التقليم وتقطير المعرفة
المقالة السادسة من جولة LLM Primer VI. تناثر 2:4 على Hopper، وتقطير توزيع المُعلِّم لا مُتغيَّره الأقصى، وترتيب: قطِّر ثم قلِّم ثم كمِّم.
1447-11-11الفصل 5 — كشف غموض التكميم
المقالة الخامسة من جولة LLM Primer VI. لماذا ينجو نموذج 70B من 4-bit ولا ينجو نموذج 1B، وماذا يفعل AWQ وGPTQ وSmoothQuant وGGUF فعلاً، وسلَّم الأمان مع انضباط المعايرة.
1447-11-10الفصل 4 — السيليكون المتخصص ودوائر ASIC
المقالة الرابعة من جولة LLM Primer VI. Groq LPU للاستجابة الحتمية، وInferentia2 وTPU وGaudi 3 عندما يستقر النموذج، وأين لا تزال GPU تفوز في نطاق تنوع النماذج.
1447-11-09الفصل 3 — وحدات GPU لمراكز البيانات للذكاء الاصطناعي التوليدي
المقالة الثالثة من جولة LLM Primer VI. اقرأ ورقة مواصفات GPU بترتيب VRAM ثم عرض نطاق HBM ثم دعم FP8/FP4 ثم FLOP: H100 وH200 وB200 وL40S وMI300X لكل عبء عمل.
1447-11-08الفصل 2 — تحدي ذاكرة KV
المقالة الثانية من جولة LLM Primer VI. صيغة حجم ذاكرة KV، والمقايضات المعمارية بين MHA وGQA وMQA وMLA، ولماذا يهدر التخصيص الساذج معظمَ الميزانية بالتجزئة الداخلية.
1447-11-07الفصل 1 — ميكانيكا توليد الرموز
المقالة الأولى من جولة LLM Primer VI. الحلقة الانحدارية الذاتية متسلسلة بالضرورة الرياضية، والتعبئة الأمامية وفك التشفير يُجهدان الشريحة بطرق متعاكسة، ولماذا يترك مستخدم واحد وحدةَ H100 عاطلة بنسبة 99.7٪.
1447-11-06LLM Primer VI — مقدمة السلسلة والفهرس
مقدمة الجولة الفصلية لـ LLM Primer VI: توسيع أنظمة الذكاء الاصطناعي. لماذا يترك مستخدم واحد وحدةَ H100 عاطلة بنسبة 99.7٪، وكيف تتعامل الفصول الستة عشر مع اختناق عرض النطاق التخديمي.
1447-11-05الفصل 8 — تحسين الأداء والتخديم والتكلفة
المقالة الأخيرة من جولة LLM Primer V. اقتصاديات LLM الإنتاجية بوصفها انضباطاً مُتعدد الطبقات — الاستدعاء الأرخص هو الذي لم يُجرَ (تخزين مؤقت دلالي)، والتالي هو المُجرى ضد أصغر نموذجٍ يفي بالغرض (مُوجِّه)، والأرضية تُوضع داخل خادم الاستدلال بـ KV cache والدُّفَعات المستمرة وفكّ الترميز التخميني.
1447-11-04الفصل 7 — أمن LLM ومحاورها الوقائية
المقالة السابعة من جولة LLM Primer V. تسمية محور الأمن الجديد الذي تُدخله تطبيقات LLM — التحكم بأيّ التعليمات تصل إلى النموذج، من أين، حاملةً كم من الصلاحية — وبناء مصفوفة التخفيف رباعية الطبقات حوله.
1447-11-03الفصل 4 — الوكلاء واستدعاء الأدوات
المقالة الرابعة من جولة LLM Primer V. الوكيل بوصفه نموذجاً مُلَقَّماً ضدّ أدواتٍ ذات مخططات وطبقات ذاكرة وأسلاك متعددة الوكلاء يجب هندستها قبل أن يُوثَق بالحلقة في أيّ عملٍ حقيقي.
1447-10-29الفصل 3 — التوليد المُعزَّز بالاسترجاع
المقالة الثالثة من جولة LLM Primer V. خط أنابيب RAG من طرفٍ إلى طرف — التحميل والتقطيع والتضمين والاسترجاع والتوليد — وكيف يفصل التقطيع الجيد والاسترجاع الهجين وتحويلات الاستعلام العرضَ الذي يعمل على وثائقك المُفضَّلة عن النظام الذي ينجو من ملامسة مدوَّنتك الحقيقية.
1447-10-28الفصل 13 — الأُطُر وتكامل السحابة
المقالة الثالثة عشرة من جولة LLM Primer IV. Strands مع Bedrock، نمط طبقة الحالة في AWS، إطار وكلاء Microsoft، LangChain، Semantic Kernel — وأشكال التكامل الإنتاجي الثلاثة التي تَصل إليها الفِرَق مستقلَّة.
1447-10-23الفصل 12 — تَصلُّب البروتوكول والدفاعات
المقالة الثانية عشرة من جولة LLM Primer IV. مجموعات الدفاع الأربع — التَشهيد التَشفيري، انضباط نطاقات OAuth مع جلساتٍ مُقَيَّدة، العزل الصندوقي وقت التشغيل، وبوّابات الإنسان في الحلقة — تَتركَّب في وضعٍ لا يَعتمد على تَصرُّف النموذج صحيحاً تحت الظروف الخصومية.
1447-10-22الفصل 11 — أسطح الهجوم وثغرات البروتوكول
المقالة الحادية عشرة من جولة LLM Primer IV. الهجمات الكلاسيكية مُكَيَّفة لـ MCP — النائب المُلتبس، تَمرير الرمز، اختطاف الجلسة — العيوب على مستوى البروتوكول حول تَصعيد القدرة والمعاينة غير المُصادَق عليها، وتَوارُث الثقة الضمني الذي يَجعل تسميم السياق مشكلةً بنيوية لا نَظافة.
1447-10-21الفصل 9 — إدارة ميزانية الانتباه
المقالة التاسعة من جولة LLM Primer IV. عَفَن السياق، هاوية «الضائع في المنتصف»، عَفَن طاقم الأدوات، والإجابات المعمارية الثلاث — MCP، RAG، الضبط الدقيق — على سؤال أين تَنتمي معرفة النموذج المفقودة فعلاً.
1447-10-19الفصل 8 — تخطيطات النشر المعمارية
المقالة الثامنة من جولة LLM Primer IV. تخطيطات النشر الثلاثة التي ظَهَرت في نظام MCP البيئي — الوكيل القابل لإعادة الاستخدام، النقاء الصارم، الهجين — والقيود الأربعة المُلزِمة التي تُحَدِّد أيُّها يُناسب أيَّ مشروع.
1447-10-18الفصل 5 — بروتوكولات النقل والاكتشاف
المقالة الخامسة من جولة LLM Primer IV. النقول الثلاثة التي يَدعمها MCP، وطبقة الاكتشاف .well-known مع بطاقات الخادم، والاهتمامات التشغيلية المُملَّة — CORS، التحقُّق من المَنشأ، التخزين المؤقت — التي تُقرِّر هل الخادم مواطنٌ شبكي متعاون أم عبءٌ.
1447-10-15الفصل 4 — أوّليات العميل: السلوكيات الوكيلية والتحكُّم
المقالة الرابعة من جولة LLM Primer IV. المعاينة والجذور والاستنطاق هي الثقوب الثلاثة الصغيرة المضبوطة التي يَفتحها MCP في الجدار بين المُضيف والخادم — كلٌّ قدرةٌ تُعار، وكلٌّ مُجازفةٌ تُقبل نيابةً عن المستخدم.
1447-10-14الفصل 3 — أوّليات الخادم: عرض السياق والقدرات
المقالة الثالثة من جولة LLM Primer IV. الأسماء الثلاثة التي يَستطيع خادم MCP تقديمها — الموارد (قراءة الحالة)، الموجِّهات (سقَّالة قابلة لإعادة الاستخدام)، الأدوات (أفعال الكتابة) — مخططاتها، دورات حياتها، نماذج خطئها، وانضباط اختيار الأوّلية الصحيحة.
1447-10-13الفصل 2 — كشف بروتوكول سياق النموذج (MCP)
المقالة الثانية من جولة LLM Primer IV. ما الذي يُقَنِّنه MCP فعلاً، تقسيم الأدوار الثلاثة المُضيف والعميل والخادم، لماذا يَختلف الاكتشاف الديناميكي والرسائل ثنائية الاتجاه عن REST في الحالات التي تَهُمّ، ودورة حياة الجلسة التي تَفتتح بالتفاوض على القدرات.
1447-10-12الفصل 1 — أزمة التكامل في الذكاء الاصطناعي وصعود البنية الوكيلية
المقالة الأولى من جولة LLM Primer IV. لماذا يتآكل الوكيل المتجانس مع نمو الموجِّهات، مصفوفة التكامل N×M المختبئة تحت السطح، والانتقال من هندسة الموجِّه إلى هندسة السياق الذي بُني MCP ليُتيحه.
1447-10-11LLM Primer IV — مقدمة السلسلة والفهرس
انطلاق الجولة الفصلية للكتاب الرابع من سلسلة LLM Primer — تصميم الإدراك الاصطناعي بـ MCP. لماذا تحتاج الوكلاء إلى طبقة بروتوكول لتتجاوز العروض التوضيحية، ولمن كُتب هذا الكتاب، وجدول الأربعة عشر مقالاً التالية من 30 مارس حتى 12 أبريل.
1447-10-10الفصل 11 — التحديثات المستمرة وتحسين الخط
المقالة الحادية عشرة والأخيرة من جولة LLM Primer III. CDC والفهرسة التزايدية تُبقي المكتبة طازجة، التَّخزين المؤقت الدلالي وتَدريج النماذج يُبقيان زمن الاستجابة منخفضاً، وحلقة تَغذيةٍ راجعة من أربع مراحل تَسد الفجوة بين ما يُخبر به الإنتاج الفريق وما يُغيِّره الفريق فعلاً — مع جسرٍ إلى المجلد الرابع عن Model Context Protocol.
1447-10-09الفصل 9 — ثلاثية تقييم RAG
المقالة التاسعة من جولة LLM Primer III. نظام RAG يَستطيع الفشل في ثلاثة أماكن مختلفة، والإخفاقات تَبدو متطابقة من الخارج — ثلاثية التقييم لملاءمة السياق والإسناد وملاءمة الإجابة هي المفردات الصغيرة التي تَمنع إصلاح خطأٍ بينما تَقيس آخر.
1447-10-07الفصل 8 — إخفاء الهوية في خط RAG
المقالة الثامنة من جولة LLM Primer III. إخفاء الهوية ما قبل التوليد مقابل ما بعد التوليد، عائلات التقنيات الثلاث — التعتيم، الاستبدال التَّوليفي، الخصوصية التَّفاضلية — ومُقايضة المنفعة-الخصوصية التي تُحدِّد ما إذا كان النظام يَبقى نافعاً أصلاً.
1447-10-06الفصل 7 — تطبيق ضوابط الوصول
المقالة السابعة من جولة LLM Primer III. ACL على مستوى الوثيقة بوصفها الأساس، RBAC مع تسميات حساسية Microsoft Purview، ReBAC مع Zanzibar وSpiceDB، وانضباط التَّرشيح المُسبق مقابل اللاحق الذي يَجري تحتها جميعاً.
1447-10-05الفصل 6 — نماذج التهديد والثغرات في RAG
المقالة السادسة من جولة LLM Primer III. سطح الهجوم المُوسَّع للاسترجاع — تَسميم المكتبة، القِطع الخصمية، الحقن غير المباشر للموجِّه، قَلب التضمين، ومشكلة النائب المُلتبس في RAG الوكيلي. هجماتٌ ملموسة، كلٌّ قد بُرهنت، كلٌّ قابلٌ للتكرار.
1447-10-04الفصل 5 — هندسة خط الاسترجاع
المقالة الخامسة من جولة LLM Primer III. لماذا ليس بحثٌ شعاعي واحد خطاً — الاسترجاع الهجين، دمج الرُّتب التبادلي، إعادة الترتيب بمُرمِّز متقاطع، وإعادة الصياغة من جهة الاستعلام وHyDE — مُجمَّعة في البنية الإنتاجية التي تَتقارب عليها أنظمة RAG الناضجة.
1447-10-03الفصل 4 — اختيار قاعدة البيانات الشعاعية المناسبة
المقالة الرابعة من جولة LLM Primer III. الانقسام المعماري بين قواعد البيانات الشعاعية المصمَّمة لغايتها وامتدادات Postgres، والقادة المُدارون (Pinecone وVertex)، والميدان مفتوح المصدر (Qdrant وMilvus وWeaviate)، والخيارات المُضمَّنة، والمحاور التشغيلية الثلاثة — الإقامة والتشغيل والكلفة — التي تَحسم الخيار الحقيقي.
1447-10-02الفصل 3 — أطر التقطيع المتقدمة
المقالة الثالثة من جولة LLM Primer III. طيف التقطيع من الحجم الثابت إلى الواعي بالبنية، خرافة التراكب، حافة السياق التي تُدمر الاسترجاع بصمت، وتقنيتا الاسترجاع السياقي والتقطيع المتأخر اللتان أعادتا تشكيل الجبهة.
1447-10-01الفصل 2 — التحليل الذكي للوثائق
المقالة الثانية من جولة LLM Primer III. لماذا ليس ملف PDF ملفاً نصياً، وما الذي يَحفظه فعلاً المُحلِّلات الواعية بالتخطيط، ومشهد الأدوات الحالي (LlamaParse وDocling وUnstructured وMarker-PDF وFirecrawl وDeepSeek-OCR)، والمسار المتعدد الوسائط الذي يَسترجع على صور الصفحات مباشرة.
1447-09-30