Sector Research

Ollama vs LocalAI vs llama.cpp — أي محرّك تشغيل LLM محلي تختار؟

مقدمة تشغيل نماذج اللغات الكبيرة (LLMs) محلياً لم يعد حلماً، بل أصبح واقعاً بفضل مجموعة من المحركات والأدوات مفتوحة المصدر. من بين هذه الأدوات، تبرز ثلاثة أسماء بقوة كخيارات رئيسية للمطورين: Ollama، و LocalAI، و llama.cpp. وتتفاوت هذه الخيارات من…

Open WebUI vs AnythingLLM — أيّهما أنسب لقاعدة معرفة منظمة عربية؟

مقدمة تبحث الكثير من المنظمات العربية اليوم عن طرق لاستثمار مستنداتها وتقاريرها (قاعدة المعرفة) عبر بناء روبوتات دردشة ذكية (RAG) تجيب على استفسارات الموظفين. في هذا السياق، تبرز أداتان مفتوحتا المصدر بقوة: Open WebUI و AnythingLLM. تقدم هذه المقارنة نظرة…

البدء مع Label Studio لتصنيف البيانات العربية

أهمية تصنيف البيانات للذكاء الاصطناعي أداة Label Studio هي من أبرز الأدوات مفتوحة المصدر المتخصصة في “تصنيف البيانات” (Data Labeling). هذه العملية ضرورية لتحضير مجموعات بيانات موسومة تُستخدم في تدريب نماذج تعلم الآلة (ML) أو لضبط النماذج اللغوية لتناسب مهاماً…

دليل بناء قاعدة معرفة عربية للفريق باستخدام Open WebUI أو AnythingLLM

استخراج الكنوز المخفية في أرشيف المنظمة كل منظمة عمرها أكثر من سنتين تملك أرشيفاً معرفياً ضخماً: تقارير، سياسات (Policies)، دروس مستفادة (Lessons Learned)، مسودات مشاريع (Proposals)، ومذكرات اجتماعات. لكن هذه القيمة غالباً ما تكون “مدفونة” في مجلدات Google Drive المنسية.…

كيف تختار نموذج LLM محلي مناسب لمنظمتك — دليل قابل للتحديث

معضلة الاختيار في عصر النماذج المحلية بالنسبة للمنظمات التي تتعامل مع بيانات حساسة (كالمنظمات الإنسانية والجهات الحكومية)، استخدام نماذج سحابية مثل ChatGPT ليس خياراً متاحاً بسبب قيود الخصوصية. الحل هو استضافة “نماذج لغة كبيرة محلية” (Local LLMs) على خوادم المؤسسة.…

منظمة تعليمية حوّلت أرشيف 200 محاضرة فيديو إلى دروس مكتوبة عربية

مقدمة عن السيناريو منظمة تعليمية غير ربحية حوّلت أرشيف محاضرات قديم إلى مكتبة دروس مكتوبة قابلة للبحث، مما زاد الوصول للطلاب ذوي الإعاقة السمعية. توصيف المشكلة المنظمة تملك أرشيفاً من 200 ساعة محاضرات فيديو سُجِّلت خلال 5 سنوات. القيمة المعرفية…

أرشفة وفهرسة سجلات المحادثات مع المساعد الداخلي بحسب الموضوع

مقدمة حول سير العمل Workflow يحوّل سجلات Open WebUI أو أي مساعد AI داخلي إلى أرشيف منظّم قابل للبحث، مع وسوم تلقائية حسب الموضوع والقسم. الهدف من سير العمل تحويل المحادثات المتفرّقة مع المساعد إلى ذاكرة مؤسسية مشتركة، تستفيد منها…

تجميع نشرة الفرص الأسبوعية من مصادر منح متعددة

مقدمة حول سير العمل Workflow في n8n يجمع المنح والوظائف والمؤتمرات من 15–20 مصدر، يُصنّفها حسب الفئة والـ deadline، ويبني نشرة أسبوعية قابلة للنشر. الهدف من سير العمل توفير ساعات أسبوعياً تُهدر في تتبّع مصادر التمويل والفرص لفِرَق صغيرة لا…

تصنيف وتسمية وثائق عربية لتدريب مصنّفات تخصصية

مقدمة حول سير العمل إعداد Label Studio لتصنيف نصوص عربية (تقارير، شكاوى، حالات) يدوياً ثم تدريب مصنّف بسيط للأتمتة المستقبلية. الهدف من سير العمل بناء أصل بيانات عربي مُسمَّى يمكن للمنظمة استخدامه لتصنيف الوثائق الجديدة آلياً مع الوقت. الأدوات والتقنيات…

استخراج بيانات منظّمة من تقارير الأمم المتحدة آلياً

مقدمة حول سير العمل Workflow لاستخراج جداول البيانات والإحصاءات المُضمّنة في تقارير PDF من ReliefWeb وUNHCR وUNICEF وتحويلها إلى CSV قابل للتحليل. الهدف من سير العمل تحويل بيانات المنشورات الإنسانية من PDF غير قابل للبحث إلى ملفات قابلة للاستيراد إلى…