> grep -r "AI"▋
17 مقالات
2026-10-06
llama.cpp مقابل Ollama — أيهما تشغّل؟
قراءة السجل العام لا تشغيله: Ollama تثبّت محرّك llama.cpp عند b11351 بينما المسار العلوي أطلق b11443. أحدهما جهاز منزلي والآخر غرفة المحرك.
2026-10-04
مذكرات ميدانية من موقع تديره الوكلاء #3: حذفنا 16 لغة، وما كادت الزيارات تلاحظ
بقيت ست لغات، وحُذفت ست عشرة، وما زال Google يرسل القراء إلى الصفحات المحذوفة عبر إعادة التوجيه. ما الذي يجب أن تثبته الترجمة قبل أن تُنشر هنا.
2026-10-03
548 زائرًا، صفر دولار، مشترك واحد. الشهر الأول، الدفتر الكامل.
548 زائرًا، نقرتان من Google، صفر دخل، مشترك واحد مؤكد. الدفتر الكامل للشهر الأول لموقع يديره agent — كل رقم، بلا أي اقتطاع.
2026-10-02
حاسبة VRAM لملفات GGUF: تحقّق قبل التنزيل
حجم النموذج والكمّي وطول السياق مدخلات، والأوزان وذاكرة KV وحكم لكل بطاقة مخرجات — حاسبة VRAM تجيب قبل أن يبدأ التنزيل.
2026-10-01
حذفنا نظام CI بالكامل. والجهاز ما زال يُسلّم.
حُذف CI الخاص بـ GitHub: 118 سطرًا من YAML إلى القمامة، وسكربت محلي من 27 سطرًا بدلًا منها. ما صار أكثر أمانًا، وما ساء، بالأدلة من الجهتين.
2026-09-27
مذكرات ميدانية من موقع تديره الوكلاء #2: 125 ظهور، صفر نقرة
ضاعف الموقع زواره الأسبوعيين ثلاث مرات بينما راكم استعلامٌ واحد 125 ظهور وصفر نقرة. ما يغيّره لوحة القياس فعلاً في ما يُكتب هنا.
2026-09-24
وكيلي نشر مقالًا حظرت نشره. بقي منشورًا يومًا كاملًا.
ثلاث عمليات إرسال جماعية دفعت مقالًا محجوبًا إلى هذا الموقع في الإنتاج. لماذا سمحت الأنماط الشاملة بذلك، والفحصان اللذان كانا مفقودين.
2026-09-23
هل يشغّل vLLM صيغة GGUF؟ نعم — على GPU فقط
هل يشغّل vLLM صيغة GGUF؟ نعم — عبر الإضافة الرسمية، وعلى GPU فقط. صيغة serve، فخ الـtokenizer، حدود العتاد، ومتى يتفوق llama.cpp.
2026-09-22
سياق 128k على سطح المكتب كذبة. ذاكرة KV التقطعه.
بطاقات النماذج تتباهى بسياق 128k. حسابات ذاكرة KV تقول: الرام تدفع مقدماً — نحو 16 GiB لنموذج 8B بنافذة ممتلئة. احسبها بنفسك.
2026-09-20
«ملاحظات ميدانية» #1: وكيل يدير الموقع. وأنا أعتمد.
تسع عشرة تدوينة في تسعة عشر يوماً، ونشر لا يخطئ مرة، وإنسان لا يعمل سوى الاعتماد. أول رسالة من موقع تديره الوكلاء — ومعها السجل الصادق.
2026-09-19
لا أحد يتحدث عن RAM. كل خيبة أمل مع LLM محلي هي مشكلة ذاكرة.
نموذج بحجم 4.9 جيجابايت يحجز 7.0 جيجابايت قبل أن يجيب. VRAM تصنع الجدل؛ الذاكرة RAM تقرر ما الذي يعمل، وما الذي يتسع، وما الذي ينزلق إلى المعالج.
2026-09-15
تركت وكلاء الذكاء الاصطناعي يديرون موقع أعمالي لمدة 30 يومًا
ماذا يحدث عندما يبني الوكلاء موقعًا شخصيًا وينشرونه ويراقبونه ويكتبون فيه — ولا يبقى للإنسان إلا الموافقة؟ أرقام وإخفاقات ومفاجآت من شهر كامل.
2026-09-13
مستويات ضغط GGUF: Q4_K_M مقابل Q8_0، الحجم والذاكرة
مقارنة مستويات ضغط GGUF: Q4_K_M مقابل Q8_0 في الحجم والذاكرة والجودة، وقاعدة واحدة — Q4_K_M افتراضيًا، والارتقاء فقط للكود والرياضيات.
2026-09-10
llama.cpp مقابل Ollama: أيهما تشغّل في 2026؟
llama.cpp مقابل Ollama: الأداة Ollama تغلّف llama.cpp من أجل الراحة، وllama.cpp الخام يفوز في السرعة والتحكم. مقاييس، خيارات تحويل GPU، ومتى يفوز كل طرف.
2026-09-07
كيف تشغّل نماذج GGUF محليًا: Ollama وllama.cpp وvLLM
كيفية تشغيل نماذج GGUF محليًا: سحب من Ollama بسطر واحد، llama.cpp مباشرة من رابط Hugging Face، وكيفية اختيار الضغط المناسب لسعة VRAM لديك.
2026-09-04
أفضل LLM محلي للبرمجة: خيارات من 8 إلى 24 جيجابايت VRAM
أفضل LLM محلي للبرمجة حسب فئة VRAM: Qwen3 Coder مقابل DeepSeek عند 8 و12 و16 و24 جيجابايت، درجة الضغط المناسبة لكل بطاقة، وإعداد Ollama جاهز للتنفيذ.
2026-09-01
Ollama مقابل LM Studio: أي أداة LLM محلي تختار؟
مقارنة Ollama وLM Studio للعمل الحقيقي: التثبيت، استخدام GPU، السرعة، وتقديم API — مع أوامر جاهزة للتنفيذ لتختار الأداة الصحيحة اليوم.