Không ai nói về RAM. Mọi thất bại với LLM local đều là vấn đề RAM.
Mô hình 4,9 GB chiếm trước 7,0 GB ngay trước khi trả lời câu đầu tiên. VRAM tạo ra tranh cãi; RAM quyết định cái gì chạy được, cái gì vừa, cái gì rơi về CPU.
19 bài
Mô hình 4,9 GB chiếm trước 7,0 GB ngay trước khi trả lời câu đầu tiên. VRAM tạo ra tranh cãi; RAM quyết định cái gì chạy được, cái gì vừa, cái gì rơi về CPU.
SSH permission denied (publickey) nghĩa là mọi key bạn đưa ra đều bị từ chối. Bốn nguyên nhân thật, các bước kiểm tra ssh -vvv để tìm ra thủ phạm, và cách sửa.
Gitignore không ăn? File đã được track sẽ bỏ qua .gitignore. Untrack bằng git rm --cached, xác minh bằng git check-ignore, và chấm dứt vòng lặp commit nhầm.
Ollama bỏ qua GPU và chạy bằng CPU? Năm nguyên nhân thật — driver, VRAM, backend bị ghim, ROCm, cờ Docker — và đúng lệnh khắc phục cho từng trường hợp.
Git revert vs reset giải thích rõ: lệnh nào hoàn tác commit an toàn, khi nào reset --hard phá luôn công sức, và cách mỗi lệnh viết lại lịch sử GitHub chung.
Service systemd không khởi động? Đọc journalctl đúng cách, sửa năm nguyên nhân đứng sau phần lớn lỗi, và đưa unit trở lại trạng thái active trong vài phút.
So sánh các mức GGUF quantization: perplexity của Q4_K_M và Q8_0, cách tính kích thước file, VRAM cho từng mức, và một quy tắc chọn quant đúng cho GPU của bạn.
Git cherry-pick giải thích: copy một commit từ branch khác, chọn nhiều commit hoặc một range, xử lý conflict, và biết khi nào merge hay rebase hợp hơn.
So sánh cron vs systemd timer: cú pháp, log, chạy bù và dependency — kèm bảng quyết định để job định kỳ tiếp theo của bạn rơi vào đúng chỗ cần.
llama.cpp vs Ollama: Ollama bọc llama.cpp cho tiện, llama.cpp thuần thắng về tốc độ và kiểm soát. Benchmark, cờ GPU offload, khi nào cái nào thắng.
Xoá untracked files trong Git an toàn bằng git clean: dry-run trước, -fd cho thư mục, -x cho ignored files — và lý do git clean chẳng xoá đi gì.
Rsync vs scp: rsync nối lại transfer bị đứt và chỉ copy phần thay đổi — scp thì chỉ biết copy. Số liệu tốc độ, các cờ quan trọng, và khi nào scp vẫn thắng.
Chạy mô hình GGUF cục bộ: kéo GGUF bằng Ollama một dòng lệnh, chạy llama.cpp thẳng từ URL Hugging Face, và cách chọn quant phù hợp với VRAM của bạn.
Git sync fork with upstream theo 3 cách: gói hai lệnh, rebase cho lịch sử sạch, nút Sync của GitHub — kèm cách xử lý khi fork của bạn chịu sync.
ss vs netstat: trên Linux hiện đại netstat là legacy, ss thay nó từng flag một. Kèm bảng ánh xạ, cách tìm process đứng sau một port bất kỳ, và cheat sheet.
Local LLM tốt nhất cho coding theo từng mức VRAM: Qwen3 Coder đấu DeepSeek ở 8, 12, 16, 24 GB, quant đúng cho từng card, cùng setup Ollama chạy được ngay.
Git undo last commit an toàn: giữ thay đổi bằng reset --soft, bỏ staged bằng --mixed, hoặc sửa commit đã push bằng revert — lệnh chính xác cho từng trường hợp.
journalctl cheat sheet cho việc thật: tail log, lấy 100 dòng cuối, theo dõi service trực tiếp và lọc theo unit hay thời gian — lệnh copy-paste là chạy ngay.
So sánh Ollama vs LM Studio cho công việc thực tế: cài đặt, GPU, tốc độ và serving API — kèm lệnh chạy được ngay để bạn chọn đúng công cụ hôm nay.