mrsaynothing.dev

> grep -r "Ollama"▋

8 مقالات

2026-10-06

llama.cpp مقابل Ollama — أيهما تشغّل؟

قراءة السجل العام لا تشغيله: Ollama تثبّت محرّك llama.cpp عند b11351 بينما المسار العلوي أطلق b11443. أحدهما جهاز منزلي والآخر غرفة المحرك.

2026-09-30

خطأ Ollama connection refused: التشخيص في 60 ثانية

connection refused تعني أنه لا شيء يستمع على المنفذ 11434. الأسباب الستة الحقيقية مرتبة بالاحتمال، مع أمر curl واحد يخبرك بأي سبب أمامك.

2026-09-19

لا أحد يتحدث عن RAM. كل خيبة أمل مع LLM محلي هي مشكلة ذاكرة.

نموذج بحجم 4.9 جيجابايت يحجز 7.0 جيجابايت قبل أن يجيب. VRAM تصنع الجدل؛ الذاكرة RAM تقرر ما الذي يعمل، وما الذي يتسع، وما الذي ينزلق إلى المعالج.

2026-09-16

Ollama لا يستخدم الـ GPU؟ الإصلاح على لينكس وويندوز وWSL

Ollama تتجاهل الـ GPU وتعود إلى المعالج؟ الأسباب الخمسة الحقيقية — التعريفات، VRAM، الخلفيات المثبتة، ROCm، أعلام Docker — والأمر الذي يصلح كل واحد.

2026-09-10

llama.cpp مقابل Ollama: أيهما تشغّل في 2026؟

llama.cpp مقابل Ollama: الأداة Ollama تغلّف llama.cpp من أجل الراحة، وllama.cpp الخام يفوز في السرعة والتحكم. مقاييس، خيارات تحويل GPU، ومتى يفوز كل طرف.

2026-09-07

كيف تشغّل نماذج GGUF محليًا: Ollama وllama.cpp وvLLM

كيفية تشغيل نماذج GGUF محليًا: سحب من Ollama بسطر واحد، llama.cpp مباشرة من رابط Hugging Face، وكيفية اختيار الضغط المناسب لسعة VRAM لديك.

2026-09-04

أفضل LLM محلي للبرمجة: خيارات من 8 إلى 24 جيجابايت VRAM

أفضل LLM محلي للبرمجة حسب فئة VRAM: Qwen3 Coder مقابل DeepSeek عند 8 و12 و16 و24 جيجابايت، درجة الضغط المناسبة لكل بطاقة، وإعداد Ollama جاهز للتنفيذ.

2026-09-01

Ollama مقابل LM Studio: أي أداة LLM محلي تختار؟

مقارنة Ollama وLM Studio للعمل الحقيقي: التثبيت، استخدام GPU، السرعة، وتقديم API — مع أوامر جاهزة للتنفيذ لتختار الأداة الصحيحة اليوم.