الذكاء الاصطناعي وRAG والبحث المتجهي
يشرح هذا المحور كيف نبني أنظمة ذكاء اصطناعي تسترجع الأدلة، وتعزل بيانات العملاء، وتضبط سلوك النموذج وتقيس جودة الإجابة؛ لا أن تكتفي باستدعاء LLM API.
متى نستخدم Qdrant أو بحث PostgreSQL أو SQL؟
كيف نقيس Groundedness والمراجع واستخدام الأدوات؟
ابدأ بالحدود، ثم اختر التقنية.
استخدم RAG
عندما تتغير المعرفة، وتهم الأدلة، ويجب أن تستند الإجابة إلى مصادر خاصة أو متخصصة.
استخدم Search أو SQL
عندما يحتاج المستخدم إلى سجلات دقيقة أو تجميعات أو فلاتر أو حقائق أعمال حتمية.
أضف Agent
عندما يحتاج النظام إلى اختيار أدوات أو تنفيذ إجراء محدود مع صلاحيات وسجل تدقيق.
مقالات تكمل هذا المسار.
تعدد العملاء في Qdrant: اعزل الاسترجاع والترتيب والتخزين
تصميم إنتاجي لاسترجاع آمن متعدد العملاء في Qdrant: نطاق موثوق، وإحصاءات Sparse مستقلة، وترقية مدروسة للعملاء الكبار.
اقرأ الدليلAI security · Anthropic CVPبرنامج Anthropic CVP: قيود أقل تحتاج معمارية أقوى
وسّعت Anthropic برنامج CVP إلى ثلاثة مستويات؛ لكن عمل الإنتاج الحقيقي هو الهوية والتفويض والعزل وضبط Egress والاحتفاظ والإلغاء.
اقرأ الدليلAI · Decision infrastructureواجهة OpenAI Decisions API: ابنِ نظام قرار لا عتبة سحرية
تحوّل واجهة OpenAI Decisions API النصوص والصور إلى احتمالات واختيارات ودرجات؛ لكن الجزء الأصعب هو سياسة القرار المحيطة بالنتيجة.
اقرأ الدليلAI infrastructure · Vector searchترحيل Embeddings في Qdrant من دون تعطيل البحث
خطة إنتاجية لترحيل نموذج Embeddings جديد: Named Vectors أوBlue/Green، وDual Write وBackfill وتقييم ظل وCutover وRollback.
اقرأ الدليلAI infrastructure · Anthropic APIحقل line في Anthropic Models API: توقّف عن تحليل أسماء النماذج
أضافت Anthropic حقلًا لعائلة النموذج إلى Models API. إليك استخدامه للاكتشاف من دون خلط العائلة بالقدرات أو بسياسة الإصدار.
اقرأ الدليلAI · Content provenancetextGrain من OpenAI: ما الذي تثبته العلامة المائية للنص وما الذي لا تثبته
أتاحت OpenAI العلامة المائية للنص اختياريًا لنماذج API محددة. يشرح الدليل textGrain وحدود الكشف ومعمارية Provenance آمنة.
اقرأ الدليلAI · RAG chunkingتقسيم PDF في RAG: حافظ على البنية والجداول والسياق
دليل إنتاجي لتقسيم ملفات PDF حسب البنية، ومعالجة الجداول، والاسترجاع الأب-الابن، والتداخل والسياق والتقييم القابل للقياس.
اقرأ الدليلAI · Speech generationGemini 3.8 TTS في الإنتاج: الأصوات والبث والموافقة
دليل إنتاجي لـGemini 3.8 Flash TTS وFlash‑Lite يشرح اختيار النموذج، والبث الصوتي، والأصوات الدائمة، والموافقة، والتخزين المؤقت والتقييم.
اقرأ الدليلAI agents · Runtime architectureحلقات GPT‑6 الوكيلة: أدوات غير متزامنة وتوجيه وتعافٍ آمن
دليل إنتاجي لأدوات GPT‑6 غير المتزامنة والتوجيه أثناء التنفيذ مع سجل الأعمال المعلقة والتعافي والموافقات والميزانيات والمراقبة.
اقرأ الدليلAI infrastructure · API latencyوضع OpenAI Ultrafast: هندسة زمن الاستجابة لا سرعة التوكن فقط
دليل إنتاجي لتوجيه طلبات GPT‑6 Astra Ultrafast عبر WebSockets وميزانيات التأخير وحدود المعدل والإقامة والـFallback وضبط التكلفة.
اقرأ الدليلAI · Model routingGPT‑6.1 Sol في الإنتاج: وجّه الطلبات بالدليل لا بالضجيج
معمارية عملية لتبني GPT‑6.1 Sol عبر توجيه النماذج وPrompt Caching وحدود الأدوات وبوابات التقييم وFallback وقياس الكلفة والجودة.
اقرأ الدليلAI developer tools · Claude CodeClaude Code Mods: طبقة أحداث لتخصيص أدوات البرمجة
تستطيع Mods الجديدة من Anthropic إعادة كتابة أحداث Claude Code وواجهته. هذا تصميم آمن للترتيب والاختبار والاختيار بينها وبين Hooks وSkills وMCP.
اقرأ الدليل