الوصف
LlamaIndex هو إطار عمل بيانات مفتوح المصدر لبناء تطبيقات نماذج اللغة الكبيرة فوق بياناتك الخاصة. يتولى مجتمع run-llama صيانته، ويمنح المطورين وحدات البناء لاستيعاب المعلومات الخاصة أو المتخصصة وهيكلتها واسترجاعها، حتى تتمكن نماذج اللغة الكبيرة من الإجابة عن الأسئلة والاستدلال حول محتوى لم تُدرَّب عليه قط. يتمحور الإطار حول نمط التوليد المعزز بالاسترجاع (RAG)، فيربط بياناتك بنموذج اللغة وقت الاستعلام بدلاً من الاعتماد على المعرفة المدمجة في النموذج.
في أساسه توجد موصلات البيانات التي تحمّل المعلومات من مصدرها وتنسيقها الأصليين. ومن خلال LlamaHub، يوفر الإطار كتالوجاً كبيراً من الموصلات الرسمية والمجتمعية للملفات وواجهات البرمجة وقواعد البيانات وتطبيقات SaaS وغيرها. يُحوَّل المحتوى المستوعَب إلى مستندات وعُقد، ثم يُنظَّم في فهارس مثل الفهارس المتجهة والفهارس بالكلمات المفتاحية وفهارس الشجرة وفهارس الرسم البياني المعرفي. تسحب أدوات الاسترجاع أكثر العُقد صلة بسؤال معين، وتجمع محركات الاستعلام ومحركات المحادثة بين هذا الاسترجاع والتوليد لتوفير وصول باللغة الطبيعية إلى بياناتك، مع تطبيق استراتيجيات مثل تفكيك الأسئلة الفرعية وإعادة صياغة الاستعلام وإعادة الترتيب.
إلى جانب الاسترجاع، يتضمن LlamaIndex طبقة وكلاء من عمّال المعرفة المدعومين بنماذج اللغة والمعزَّزين بالأدوات، بالإضافة إلى سير عمل قائم على الأحداث يتيح لك تأليف عمليات متعددة الخطوات عبر الوكلاء ومصادر البيانات. ويأتي مزوّداً بتكاملات للمراقبة والتقييم لتجربة خطوط المعالجة ومراقبتها في بيئة الإنتاج.
صُمم LlamaIndex لخدمة المبتدئين والفرق المتقدمة على حد سواء. تتيح واجهة برمجة عالية المستوى للمبتدئين استيعاب بياناتهم والاستعلام عنها في بضعة أسطر من التعليمات البرمجية فقط، بينما تسمح واجهات البرمجة منخفضة المستوى للمطورين ذوي الخبرة بتخصيص الموصلات والفهارس وأدوات الاسترجاع ومحركات الاستعلام ووحدات إعادة الترتيب لتلائم احتياجات محددة. المشروع مكتوب بلغة بايثون مع نسخة مرافقة بلغة TypeScript، ويتكامل مع مجموعة واسعة من مزودي نماذج اللغة ونماذج التضمين ومخازن المتجهات.
يُستخدم الإطار على نطاق واسع لبناء روبوتات محادثة فوق قواعد المعرفة الداخلية وأنظمة الإجابة عن الأسئلة المستندة إلى المستندات والبحث الدلالي والوكلاء المستقلين الذين يستدلون حول بيانات المؤسسات. وقد جعلته أُسسه مفتوحة المصدر ومجتمعه النشط ومنظومته الواسعة من التكاملات واحداً من أكثر نقاط الانطلاق شيوعاً للفرق التي تسعى لتسخير نماذج اللغة الكبيرة على معلوماتها الخاصة.
الميزات الأساسية لـ LlamaIndex
إطار عمل بيانات مفتوح المصدر لتطبيقات نماذج اللغة الكبيرة
موصلات بيانات للملفات وواجهات البرمجة وقواعد البيانات ومصادر SaaS
كتالوج LlamaHub من الموصلات الرسمية والمجتمعية
مستندات وعُقد لهيكلة البيانات المستوعَبة
فهارس متجهة وبالكلمات المفتاحية وفهارس شجرة ورسم بياني معرفي
أدوات استرجاع لجلب السياق ذي الصلة
محركات استعلام للإجابة عن الأسئلة باللغة الطبيعية
محركات محادثة للوصول التحاوري إلى بياناتك
طبقة وكلاء بعمّال نماذج لغة معزَّزين بالأدوات
سير عمل قائم على الأحداث للعمليات متعددة الخطوات
خطوط معالجة للتوليد المعزز بالاسترجاع (RAG)
استخراج بيانات مُهيكَلة
تكاملات مع مزودي نماذج اللغة ونماذج التضمين ومخازن المتجهات
واجهة برمجة عالية المستوى للبدء السريع وواجهة منخفضة المستوى للتخصيص
إطار عمل بلغة بايثون مع نسخة مرافقة بلغة TypeScript
البدء مع LlamaIndex
التكوين: قم بإعداد وكلاء معالجة واستخراج المستندات الخاصة بك.
المعالجة: قم بتحميل مستنداتك المعقدة للمعالجة.
الاستخراج: استرجع البيانات والرؤى المنظمة.
التكامل: استخدم المخرجات الجاهزة لـ LLM في سير عمل الذكاء الاصطناعي الخاص بك.
التحسين: قم بتحسين تكوينات الوكيل لتحسين الدقة والكفاءة.
حالات استخدام LlamaIndex
- تطبيقات RAG
- الإجابة عن الأسئلة المستندة إلى المستندات
- روبوتات محادثة لقواعد المعرفة
- البحث الدلالي
- وكلاء البيانات
- تكامل بيانات المؤسسات
- الاستخراج المُهيكَل





