Ollama离线模型包无网络住宅主机完整部署教程
如果你有一台放在家里、完全不能上网的台式机或旧笔记本,又想跑本地大模型(比如 Llama 3、Qwen 2),那 Ollama + 离线模型包 是最干净的选择。
本文会从零开始,帮你走完“在哪下载模型包、怎么传过去、怎么装、怎么跑”的每一个步骤。
准备两样东西
- 一台有网络的电脑(笔记本或台式机),用来下载 Ollama 和模型文件。
- U 盘或移动硬盘,容量至少比模型包大一倍(推荐 64GB 以上,因为一个 7B 模型大约 4~8GB)。
- 你的住宅主机,需要确保能插 U 盘、能读取移动硬盘。系统建议 Ubuntu 22.04/24.04 或 Debian 12,Windows 也可以,但本文以 Linux 为例。
如果你的住宅主机也是 Windows,只需把安装包换成 .exe,模型路径调整一下即可,思路完全一样。
第一步:在有网络电脑上下载模型包
Ollama 的模型默认存在 ~/.ollama/models/ 下,我们可以利用 ollama pull 拉到本地后直接打包。
- 在有网络的电脑上装好 Ollama(官网 ollama.com 下载对应系统版本)。
- 打开终端,拉取你要的模型:
ollama pull llama3.2:1b # 1B 模型,适合低配主机,约 0.8GB
# 如果主机内存足够,也可以用 7B 模型:ollama pull qwen2.5:7b
- 找到模型的实际存储目录(默认是
~/.ollama/models/),把整个models文件夹复制出来:
cp -r ~/.ollama/models/ /media/user/U盘/models_backup/
注意:不要只复制单文件,Ollama 的模型包含 manifest 和 blobs 子目录,必须完整复制。
- 同时下载 Ollama 的离线安装包:去 Ollama GitHub Releases 页面找到对应系统的
.deb(Linux)或.exe(Windows),也存到 U 盘里。
第二步:在住宅主机上安装 Ollama
将 U 盘插入住宅主机,把模型文件夹和安装包复制到主机的某个目录(比如 /home/youruser/offline_ollama/)。
- 安装 Ollama(以 Ubuntu/Debian 为例):
sudo dpkg -i /home/youruser/offline_ollama/ollama_*.deb
sudo systemctl start ollama
sudo systemctl enable ollama
- 检查服务是否运行:
sudo systemctl status ollama
# 出现 active (running) 表示成功
Windows 用户直接双击 .exe 安装,完成后 Ollama 会以服务形式运行在后台。
第三步:导入离线模型到新环境
现在住宅主机上的 Ollama 是干净的,没有模型。
我们需要把备份的 models_backup 放回正确位置。
- 先关闭 Ollama 服务,避免冲突:
sudo systemctl stop ollama
- 替换模型目录(假设你的用户名是
localuser):
# 先备份原目录(可选)
mv ~/.ollama/models ~/.ollama/models.bak
# 把U盘里的模型目录复制过去
cp -r /media/udisk/models_backup ~/.ollama/models
- 修改目录权限(非常重要,否则 Ollama 无法读取):
sudo chown -R localuser:localuser ~/.ollama/models
- 重新启动 Ollama:
sudo systemctl start ollama
- 验证模型是否被识别:
ollama list
# 应该能看到之前拉取的模型列表
避坑指南
- 模型目录结构必须完整:
models文件夹下要有manifests和blobs两个子目录,缺少任何一个都会导致ollama list看不到模型。 - 路径不对导致加载失败:如果
ollama list有输出但运行时报错file not found,大概率是blobs或manifests里的哈希文件存放路径不一致。建议完全按照上一步的cp -r操作,不要手动改文件名。 - 内存不足:住宅主机如果是 8GB 内存,建议用 1B~3B 的模型;16GB 可以跑 7B。如果内存不够,Ollama 会直接退出或生成极慢。
- Windows 路径注意:Windows 下模型目录在
%USERPROFILE%\.ollama\models,替换时用文件管理器复制粘贴即可。
效果验证
- 在终端执行:
ollama run llama3.2:1b
- 出现
>>>提示符后,随便问一个问题,比如 “Hello, what is your name?”。 - 如果模型能正常输出回应,并且速度可以接受,说明部署成功。
- 你也可以用
ollama pull qwen2.5:7b测试远程拉取(在有网络环境下),但离线状态下应该始终使用本地模型。
如果你的住宅主机完全断网,整个流程走完后,以后每次启动 Ollama 即可直接使用已经导入的模型,不需要任何网络连接。
如果遇到莫名其妙的报错,先检查系统时间是否准确(证书相关错误)、目录权限是否放开,这两点最容易忽略。
如果你正在处理 Ollama 离线模型包部署,建议先按本文步骤完整执行一遍,再根据自己的硬件调整模型大小。
遇到异常时优先回看避坑和高频问题部分,大概率能找到原因。