Ніхто не говорить про RAM. Усі провали локальних LLM — це про RAM.
Модель на 4,9 ГБ резервує 7,0 ГБ до першої відповіді. VRAM збирає суперечки; RAM вирішує, що запуститься, що поміститься і що тихо поїде на CPU.
19 записів
Модель на 4,9 ГБ резервує 7,0 ГБ до першої відповіді. VRAM збирає суперечки; RAM вирішує, що запуститься, що поміститься і що тихо поїде на CPU.
SSH permission denied (publickey) означає, що кожен запропонований ключ відхилено. Чотири справжні причини, перевірки ssh -vvv, які знаходять вашу, і виправлення.
Gitignore не діє? Відстежувані файли обходять .gitignore. Знімайте відстеження через git rm --cached, перевіряйте через git check-ignore — і завершіть цикл випадкових комітів.
Ollama ігнорує GPU і катить на CPU? П'ять справжніх причин — драйвери, VRAM, пришиті бекенди, ROCm, прапорці Docker — і команда виправлення для кожної.
Git revert проти reset: яка команда скасовує коміти безпечно, коли reset --hard знищує роботу і як кожен переписує спільну історію на GitHub.
Systemd-сервіс не запускається? Читайте journalctl правильно, виправляйте п'ять причин за більшістю збоїв і повертайте юніт у active за хвилини.
Порівняння рівнів квантування GGUF: перплексія Q4_K_M проти Q8_0, математика розміру файлу, VRAM на рівень і одне правило вибору правильного кванту для вашої GPU.
Git cherry-pick пояснено: скопіювати коміт з іншої гілки, обрати кілька комітів чи діапазон, виправити конфлікти і зрозуміти, коли краще merge чи rebase.
Порівняння cron і таймерів systemd: синтаксис, логування, наздоганяння пропущених запусків і залежності — плюс таблиця рішень, щоб наступна задача впала в правильне місце.
llama.cpp чи Ollama: Ollama загортає llama.cpp заради зручності, голий llama.cpp перемагає у швидкості та контролі. Бенчмарки, прапорці GPU offload, і коли хто виграє.
Як безпечно видаляти невідстежувані файли через git clean: спершу dry-run, -fd для тек, -x для ігнорованих — і чому git clean нічого не видаляє.
rsync чи scp: rsync відновлює обірвану передачу і копіює лише зміни — scp просто копіює. Цифри швидкості, важливі прапорці і випадки, коли scp досі виграє.
Як запускати GGUF-моделі локально: завантаження Ollama одним рядком, llama.cpp просто за посиланням Hugging Face і вибір правильного кванту під вашу VRAM.
Синхронізація fork з upstream трьома шляхами: pull двома командами, rebase для чистої історії, кнопка синхронізації GitHub — і виправлення, коли fork не синхронізується.
ss чи netstat: netstat — легасі на сучасному Linux, а ss замінює його прапорець за прапорцем. Таблиця відповідностей, процес за будь-яким портом і шпаргалка.
Найкращий локальний LLM для кодування за рівнем VRAM: Qwen3 Coder проти DeepSeek на 8, 12, 16 і 24 ГБ, правильний квант під кожну карту та робочий налаштунок Ollama.
Як безпечно скасувати останній коміт у Git: зберегти зміни через reset --soft, прибрати зі стейджингу через --mixed або виправити запушений коміт через revert.
Шпаргалка journalctl для реальної роботи: хвіст логів, останні 100 рядків, стеження за живим сервісом і фільтри за юнітом чи часом — команди, що просто працюють.
Порівняння Ollama та LM Studio для реальної роботи: встановлення, використання GPU, швидкість і робота API — з командами, готовими до запуску вже сьогодні.