Ollama
سطر أوامر + خادمأمر واحد يعمل النموذج على جهازك. بلا حدود ولا حصص.
localhost:11434/v1
دليل · تحقق 2 Sep 2026
لا حد سرعة تصطدم به، ولا مفتاح تدوّره، ولا شيء يغادر الحاسوب — السقف الوحيد هو عتادك. هذه هي البيئات التي تستحق المعرفة، من سطر أوامر واحد إلى الخادم الذي يستخدمه الإنتاج فعلاً.
اختر بالشكل لا بالمعيار: Ollama إذا أردته يعمل خلال دقيقة، وLM Studio إذا كنت لا تفضل لمس طرفية، وMLX على Mac من سلسلة M، وvLLM عندما تخدم أشخاصاً آخرين.
أمر واحد يعمل النموذج على جهازك. بلا حدود ولا حصص.
localhost:11434/v1
Ollama بواجهة رسومية: اكتشف ونزّل وتحدث محلياً.
localhost:1234/v1
المحرك الذي يعمل تحته كل شيء آخر تقريباً. ++C خالص وبلا تبعيات.
localhost:8080/v1
بديل مفتوح المصدر لـChatGPT يعمل بنسبة 100% دون اتصال.
localhost:1337/v1
حادث مستنداتك محلياً — لا شيء يغادر الحاسوب.
Local RAG
خادم الاستدلال الذي تستخدمه بيئة الإنتاج فعلاً. PagedAttention وتجميع مستمر على GPU الخاصة بك.
localhost:8000/v1
إطار المصفوفات من Apple. على جهاز Mac بشريحة M هو أسرع طريق محلي.
localhost:8080/v1
ملف واحد هو النموذج وبيئة التشغيل معاً. نزّل، chmod +x، شغّل. بلا أي تثبيت.
localhost:8080/v1
ملف تنفيذي واحد حول llama.cpp، مضبوط للنصوص الطويلة والكتابة الإبداعية.
GGUF
نموذج 7B مكمماً بتقنية 4 بت يتسع في نحو 5 غيغابايت، لذا فإن 8 غيغابايت تشغّله براحة. أما نماذج 70B فتريد 40 غيغابايت أو أكثر. Can I Run AI سيقيّم جهازك تحديداً.
ليس عادة. النماذج التي تشغّلها في المنزل أصغر من تلك التي تقدمها NVIDIA أو Groq مجاناً. المحلي يفوز في الخصوصية والاستخدام دون اتصال وعدم وجود حدود إطلاقاً.