🚀 دليل 2026 الشامل — محدّث أولاً بأول

ذكاء اصطناعي محلي على جهازك
ووكلاء يكتبون الكود معك

هل أنت ضائع بين مئات النماذج والأدوات؟ هذا الدليل يختصر عليك الطريق: أفضل النماذج المفتوحة التي تعمل على جهازك حسب قوته، أدوات التشغيل، ووكلاء البرمجة (VS Code / CLI) — كل شيء في مكان واحد.

+14نموذجاً منتقى بعناية
8وكلاء برمجة بمقارنة كاملة
$0تكلفة البداية (محلي 100%)
🔒خصوصية تامة — بياناتك عندك
الخطوة الأولى دائماً

كم ذاكرة VRAM / RAM لديك؟

القاعدة الذهبية (بتقنية Q4_K_M): نموذج 7-8B يحتاج ~8GB، و14B يحتاج ~12-16GB، و32B يحتاج ~24GB، و70B يحتاج 48GB+. اختر فئة جهازك ونعطيك التوصيات فوراً. أجهزة Mac بشريحة M تعتبر الرام = VRAM.

💡 نصيحة: Q4_K_M هو خيار الترجيح (Quantization) الافتراضي — يضغط النموذج لربع حجمه تقريباً مع فقدان جودة ~1% فقط. إذا كان النموذج بطيئاً صغّر الحجم، وإذا كان سريعاً جرّب نموذجاً أكبر.
منتقاة من أفضل المصادر

أفضل النماذج المحلية للتحميل

نماذج مفتوحة الأوزان من Hugging Face وOllama — مجانية، تعمل بدون إنترنت، وبياناتك لا تغادر جهازك أبداً. فلتر حسب استخدامك.

بيانات حية عبر API

الرائج الآن على Hugging Face

هذه البطاقات تُجلب مباشرة من واجهة Hugging Face الرسمية (نماذج بصيغة GGUF الجاهزة للتشغيل المحلي). جرّب تغيير الترتيب:

محركات التشغيل

بمَ تشغّل النماذج؟

النموذج ملف أوزان فقط — تحتاج أداة تشغله. هذه أفضل الخيارات، وكلها مجانية:

🦙 Ollama ابدأ هنا

سطر أوامر + API محلي — المعيار في 2026

الأسهل والأشهر. أمر واحد يحمّل ويشغّل أي نموذج، ويوفر API متوافقاً مع OpenAI للربط مع أي تطبيق أو إضافة.

ollama run qwen3:8b
API: localhost:11434Windows / Mac / Linux

🖥️ LM Studio واجهة رسومية

تطبيق سطح مكتب — الأفضل لمن لا يحب الطرفية

ابحث عن النماذج وحمّلها ودردش معها من واجهة جميلة. يعرض استهلاك VRAM لحظياً ويشغّل سيرفر محلياً متوافقاً مع OpenAI.

API: localhost:1234متصفح نماذج مدمجدردشة جاهزة

⚙️ llama.cpp

المحرك الأساسي الذي تعمل به الأدوات الأخرى

للمتقدمين: تحكم كامل بملفات GGUF، أفضل أداء على CPU وApple Silicon. أساس Ollama وLM Studio من الداخل.

تحكم كاملCPU / GPU / Metal

💬 Jan

بديل ChatGPT محلي ومفتوح المصدر

تطبيق دردشة كامل يعمل 100% محلياً مع متجر نماذج مدمج. مثالي إذا أردت تجربة "شات جي بي تي" دون اشتراك ودون سحابة.

API: localhost:1337خصوصية أولاً

🌐 Open WebUI

واجهة ويب احترافية فوق Ollama

واجهة دردشة ويب تشبه ChatGPT تتصل بـ Ollama: محادثات محفوظة، رفع ملفات، RAG مدمج، ودعم عدة مستخدمين.

docker run -p 3000:8080 ghcr.io/open-webui/open-webui:main

🏭 vLLM / SGLang

للإنتاج والخوادم — ليس للبداية

عندما تبني خدمة حقيقية يستخدمها عشرات المستخدمين: سرعة عالية، تجميع الطلبات (Batching)، واستغلال مثالي للـ GPU.

إنتاج Productionخوادم GPU
مساعدو البرمجة الذكية

وكلاء البرمجة: أيّهم تختار؟

ثلاث فئات: إضافات VS Code (تبقى في محررك)، وكلاء طرفية CLI (تسلّمهم مهمة ويرجعون لك بالنتيجة)، ومحررات كاملة بالذكاء الاصطناعي.

الأداةالنوعالسعرالمصدرنماذج محليةأبرز ميزة
Claude CodeCLI20$ Pro / 100$+ MaxمغلقClaude فقطأقوى وكيل طرفية، Sub-agents، دعم MCP أصيل، متصدر SWE-bench (~80%)
GitHub CopilotVS Code + كل المحررات10$/شهرمغلقلاأفضل إكمال تلقائي، تكامل لا يُضاهى مع GitHub، الخيار الآمن للشركات
ClineVS Codeمجاني (مفتاح API خاص بك)مفتوح (Apache)نعم (Ollama / LM Studio)وكيل شفاف: يعرض خطته ويطلب موافقتك قبل كل خطوة + نقاط استعادة
Continue.devVS Code + JetBrainsمجاني (مفتاح API خاص بك)مفتوح (Apache)الأفضل محلياًإكمال + دردشة + وكيل في إضافة واحدة، اتصال مباشر بـ Ollama
AiderCLIمجاني (مفتاح API خاص بك)مفتوح (Apache)نعم (أي API متوافق)ملك الـ Git: كل تعديل = Commit يمكن التراجع عنه، وضع Architect
Codex CLICLIاشتراك ChatGPT / APIمفتوح (Apache)جزئيصندوق عزل (Sandbox) لتنفيذ آمن، من OpenAI
Cursorمحرر كامل (Fork)20$/شهرمغلقضعيفأفضل تجربة تحرير بالذكاء الاصطناعي، يتنبأ بتعديلك القادم
Gemini CLICLIمجاني سخي من Googleمفتوحلاخطة مجانية واسعة للبدء دون دفع أي شيء

⚡ تركيبات جاهزة حسب حالتك

🆓 مجاني 100% ومحلي بالكامل

لا تدفع شيئاً أبداً وبياناتك لا تخرج من جهازك:

Ollama + Continue.dev (VS Code)
ollama run qwen2.5-coder:7b

💼 الأفضل احترافياً (سحابي)

أقوى النتائج في العمل اليومي مقابل اشتراك معقول:

VS Code + Copilot (10$)
أو Claude Code Pro (20$)

🎛️ تحكم كامل ومفتوح المصدر

تختار النموذج، ترى كل خطوة، وتدفع حسب الاستهلاك:

Cline + مفتاح API خاص بك
أو Aider في الطرفية
أمور ستساعدك في رحلتك

مفاهيم أساسية + خارطة طريق

🗜️

الترجيح Quantization (Q4_K_M)

ضغط أوزان النموذج من 16-بت إلى ~4-بت: الحجم يصبح الربع والجودة تبقى ~99%. لذلك نموذج 7B يعمل على 8GB VRAM. تذكّر: GGUF هي صيغة الملفات القياسية للتشغيل المحلي.

🔌

بروتوكول MCP

Model Context Protocol — معيار من Anthropic أصبح الصناعة في 2026. يتيح لوكيلك الاتصال بأدوات خارجية (قواعد بيانات، متصفح، GitHub، ملفاتك...) بشكل موحد. Claude Code وCline وContinue كلها تدعمه.

📚

RAG + نماذج التضمين

تريد أن يرد النموذج من مستنداتك؟ تحتاج نموذج Embeddings مثل nomic-embed-text مع قاعدة متجهات، ثم RAG. متوفر في Open WebUI وAnything-LLM بضغطة زر.

ollama pull nomic-embed-text
🤖

بناء وكلائك الخاصين

بعد إتقان الأساسيات: LangGraph وCrewAI لبناء وكلاء متعددين، أو n8n لأتمتة بدون كود — كلها تتصل بـ Ollama محلياً عبر localhost:11434.

🔒

لماذا محلي؟

خصوصية كاملة (بياناتك لا تغادر جهازك)، بدون فواتير API، يعمل بدون إنترنت، وبدون حدود استخدام. الثمن: جودة أقل قليلاً من أكبر النماذج السحابية، وتحتاج عتاداً مناسباً.

📊

أين تتابع الجديد؟

هذا المجال يتغير أسبوعياً. تابع: صفحة Trending في Hugging Face، مكتبة Ollama، وترتيب LMArena لمقارنة النماذج.

🗺️ خارطة طريقك من الصفر

ثبّت Ollama وشغّل أول نموذج

حمّل Ollama من موقعه ثم نفّذ ollama run qwen3:8b (أو نموذجاً أصغر حسب جهازك). أول رسالة تصلك = أنت رسمياً تدير ذكاءً اصطناعياً محلياً.

أضف واجهة دردشة جميلة

ثبّت Open WebUI أو Jan لتحصل على تجربة ChatGPT كاملة محلياً: محادثات محفوظة، رفع ملفات، وتبديل بين النماذج.

اربط النموذج بـ VS Code

ثبّت إضافة Continue.dev ووجّهها إلى Ollama — ستحصل على إكمال تلقائي ودردشة برمجية مجانية 100%. جرّب نموذج qwen2.5-coder:7b المتخصص بالكود.

ارتقِ إلى الوكلاء

جرّب Cline (داخل VS Code) أو Aider (طرفية) ليس كتابة أسطر بل إنجاز مهام كاملة: "أضف نظام تسجيل دخول" فينفذها عبر عدة ملفات.

وسّع بـ MCP وRAG

اربط وكيلك بأدواتك عبر MCP، وأضف مستنداتك عبر RAG — هنا تتحول الأدوات إلى نظام ذكي خاص بك بالكامل.