> grep -r "Ollama"▋
8 篇
2026-10-06
llama.cpp 对比 Ollama——你该跑哪一个?
读公开记录,不跑分:Ollama 把自己的 llama.cpp 引擎钉在 b11351,上游已发到 b11443。一个是家电,一个是机舱。
2026-09-30
Ollama connection refused?60 秒定位法
connection refused 的意思是:11434 端口上没有任何进程在监听。六种真实成因按概率排序,外加一条 curl 命令,先告诉你中招的是哪一种。
2026-09-19
没人聊 RAM。本地 LLM 的每一个遗憾,都是 RAM 问题
4.9 GB 的模型在回答第一句话之前就占用了 7.0 GB。VRAM 负责吵架;RAM 决定什么能启动、什么装得下、什么悄悄掉回 CPU。
2026-09-16
Ollama 不用 GPU?Linux、Windows 和 WSL 修复指南
Ollama 无视你的 GPU 退回 CPU?五个真实原因——驱动、显存、锁定的后端、ROCm、Docker 参数——以及逐一对应的排查和修复命令。
2026-09-10
llama.cpp 还是 Ollama:2026 年该跑哪一个?
llama.cpp 对比 Ollama:Ollama 为省事封装了 llama.cpp,裸 llama.cpp 赢在速度与可控性。基准测试、GPU offload 参数,以及各自何时更优。
2026-09-07
怎么在本地跑 GGUF 模型:Ollama、llama.cpp 与 vLLM
在本地跑 GGUF 模型:Ollama 一行命令直接拉取,llama.cpp 从 Hugging Face URL 直接启动,以及怎么按自己的显存挑对量化版本。
2026-09-04
写代码的本地 LLM 推荐:8GB 到 24GB 显存选型
按显存档位推荐写代码的本地 LLM:8/12/16/24 GB 各档的 Qwen3 Coder 与 DeepSeek 对比、每档该配的量化,外加一套可直接运行的 Ollama 配置。
2026-09-01
Ollama vs LM Studio:本地大模型工具怎么选?
Ollama 与 LM Studio 的实战对比:安装、GPU 调用、推理速度与 API 服务,每一步都附可直接运行的命令,看完就能选对工具。