ไม่มีใครพูดถึง RAM ความผิดหวังของ local LLM ทั้งหมดคือปัญหา RAM
โมเดลขนาด 4.9 GB จองพื้นที่ 7.0 GB ก่อนจะตอบคำถามแรก VRAM จุดชนวนการถกเถียง แต่ RAM ตัดสินว่าอะไรรันได้ อะไรลงตัว อะไรเลื่อนไปกองที่ CPU
19 รายการ
โมเดลขนาด 4.9 GB จองพื้นที่ 7.0 GB ก่อนจะตอบคำถามแรก VRAM จุดชนวนการถกเถียง แต่ RAM ตัดสินว่าอะไรรันได้ อะไรลงตัว อะไรเลื่อนไปกองที่ CPU
SSH permission denied (publickey) หมายความว่าทุก key ที่คุณยื่นไปถูกปฏิเสธ สาเหตุจริงสี่ข้อ การเช็กด้วย ssh -vvv เพื่อหาของคุณ และวิธีแก้
Gitignore ไม่เวิร์ก? ไฟล์ที่ถูก track ข้าม .gitignore เลิก track ด้วย git rm --cached ตรวจสอบด้วย git check-ignore และจบวงจร commit พลาด
Ollama เมิน GPU แล้วหันไปใช้ CPU? ห้าสาเหตุจริง — ไดรเวอร์, VRAM, backend ที่ถูกตรึง, ROCm, flag ของ Docker — และคำสั่งแก้สำหรับแต่ละกรณี
อธิบาย git revert กับ reset: คำสั่งไหนย้อนคอมมิตอย่างปลอดภัย reset --hard ทำลายงานเมื่อไร และแต่ละตัวเขียนทับประวัติ GitHub ร่วมกันอย่างไร
systemd service ไม่ยอมสตาร์ต? อ่าน journalctl ให้ถูกทาง แก้สาเหตุห้าข้อที่ซ่อนหลังความล้มเหลวส่วนใหญ่ แล้วคืน unit ให้เป็น active ได้ภายในไม่กี่นาที
เทียบระดับ quantization ของ GGUF: perplexity ของ Q4_K_M vs Q8_0 คณิตขนาดไฟล์ VRAM ต่อระดับ และหนึ่งกฎในการเลือก quant ที่ใช่สำหรับ GPU ของคุณ
อธิบาย git cherry-pick: คัดลอกคอมมิตจากบรานช์อื่น เลือกหลายคอมมิตหรือช่วง แก้คอนฟลิกต์ และรู้ว่าเมื่อไร merge หรือ rebase จะเหมาะกว่า
เทียบ cron กับ systemd timers: ไวยากรณ์ การเก็บ log การรันทดแทนรอบที่พลาด และ dependency — พร้อมตารางตัดสินใจให้งานตามตารางตัวถัดไปไปอยู่ที่ถูกที่
llama.cpp กับ Ollama: Ollama ห่อ llama.cpp เพื่อความสะดวก ส่วน llama.cpp แท้ชนะเรื่องความเร็วและการควบคุม พร้อม benchmark คำสั่ง GPU offload และกรณีที่ฝ่ายใดฝ่ายหนึ่งชนะ
ลบไฟล์ untracked อย่างปลอดภัยด้วย git clean: dry run ก่อน, -fd สำหรับโฟลเดอร์, -x สำหรับไฟล์ที่ถูก ignore — พร้อมเหตุผลที่ git clean ไม่ยอมลบอะไรเลย
rsync กับ scp: rsync กู้การโอนที่หลุดกลางคันได้และคัดลอกเฉพาะสิ่งที่เปลี่ยน — scp แค่คัดลอก ตัวเลขความเร็ว flag ที่สำคัญ และกรณีที่ scp ยังชนะ
วิธีรันโมเดล GGUF ในเครื่อง: ดึงผ่าน Ollama บรรทัดเดียว, llama.cpp ตรงจากลิงก์ Hugging Face และวิธีเลือก quant ให้เหมาะกับ VRAM ของคุณ
ซิงก์ fork กับ upstream สามวิธี: pull สองคำสั่ง, rebase เพื่อประวัติสะอาด, ปุ่มซิงก์ของ GitHub — พร้อมวิธีแก้เมื่อ fork ซิงก์ไม่ได้
ss vs netstat: netstat เป็นของเก่าบน Linux ยุคใหม่ และ ss เข้ามาแทนที่แบบ flag ต่อ flag พร้อมตารางแปลงคำสั่ง วิธีหาโปรเซสที่ยึดพอร์ต และ cheat sheet
คัด LLM ในเครื่องสำหรับเขียนโค้ดตามระดับ VRAM: Qwen3 Coder vs DeepSeek ที่ 8, 12, 16 และ 24 GB เลือก quant ให้เหมาะกับการ์ดแต่ละระดับ พร้อมเซ็ตอัป Ollama ที่รันได้ทันที
ย้อนคอมมิตสุดท้ายใน Git อย่างปลอดภัย: เก็บการเปลี่ยนแปลงด้วย reset --soft ดึงออกจาก staging ด้วย --mixed หรือแก้คอมมิตที่พุชแล้วด้วย revert — คำสั่งตรงปกทุกกรณี
สรุปคำสั่ง journalctl สำหรับงานจริง: ดูท้าย log ดึง 100 บรรทัดสุดท้าย ติดตาม service แบบสด และกรองตาม unit หรือเวลา — คำสั่ง copy-paste ที่ใช้ได้จริง
เปรียบเทียบ Ollama กับ LM Studio สำหรับงานจริง: การติดตั้ง การใช้ GPU ความเร็ว และการเปิด API — พร้อมคำสั่งที่รันได้ทันที เพื่อเลือกเครื่องมือที่ใช่ตั้งแต่วันนี้