Ollama批量拉取模型脚本,内网模型仓库离线分发方案
如果你的服务器无法访问外网,又要部署多个 Ollama 模型,最稳妥的办法是先在一台能联网的机器上批量拉取全部模型,再打包分发给内网机器。
本文给出可直接落地的 Ollama 批量拉取脚本和离线分发操作,让你从拉取、打包到内网导入一步到位,全程不需要手动逐个点击。
离线分发前要确认的三件事
开始操作前,先确认下面三项,避免做到一半发现路径或版本不对。
- 外网机器与内网机器的 Ollama 版本尽量保持一致。模型文件本身对版本敏感,差距过大会出现加载失败或
manifest unknown。建议两边都使用相同的最新稳定版。 - 确定你需要的模型清单。可以用文本文件记录,每行一个模型名,例如
qwen2.5:7b、llama3.1:8b、deepseek-r1:7b。 - 找到模型实际存储路径。默认情况下,root 用户执行的模型目录在
~/.ollama/models,也就是/root/.ollama/models;如果 Ollama 以 systemd 服务运行,可能在/usr/share/ollama/.ollama/models。不确定时执行:
find / -path "*/models/manifests" -type d 2>/dev/null
输出结果的上一级目录就是模型仓库根目录,下面所有操作都以这个目录为准。
写一个批量拉取模型脚本
先创建模型列表文件 models.txt,每行写一个模型名:
vi models.txt
录入内容后,写一个简单的 while 循环脚本 pull_models.sh:
#!/bin/bash
while read model; do
[ -z "$model" ] && continue
echo "正在拉取:$model"
ollama pull "$model"
done < models.txt
给脚本加执行权限并运行:
chmod +x pull_models.sh
./pull_models.sh
脚本会逐条拉取,避免同时下载多个模型导致内存溢出。
拉取完成后用 ollama list 确认所有模型都已存在。
打包并分发到内网机器
打包前建议先停止 Ollama 服务,防止模型文件正在被写入导致压缩包不完整:
systemctl stop ollama
如果你是直接用命令行启动的,则执行 ollama stop 或直接 Ctrl+C。
接着进入模型目录的父目录并打包:
cd /root/.ollama
tar czf ollama_models.tar.gz models
把压缩包传输到内网机器时,推荐用 rsync,支持断点续传,大文件更安全:
rsync -avP ollama_models.tar.gz user@内网IP:/data/
如果只有少量小模型,用 scp 也可以,但中途断开就得重新传。
内网机器导入模型并验证
在内网服务器上解压模型压缩包到指定目录:
mkdir -p /root/.ollama
tar xzf /data/ollama_models.tar.gz -C /root/.ollama/
如果你的内网机器模型目录想放在其他位置,比如 /data/ollama/models,可以修改 Ollama 的环境变量来指定:
export OLLAMA_MODELS=/data/ollama/models
ollama serve
如果 Ollama 以 systemd 方式运行,需要编辑 /etc/systemd/system/ollama.service,在 [Service] 段加一行:
Environment="OLLAMA_MODELS=/data/ollama/models"
然后重载并启动:
systemctl daemon-reload
systemctl start ollama
验证是否导入成功,先看列表:
ollama list
再实际运行一个模型测试:
ollama run qwen2.5:7b "你好"
能正常回复就说明离线分发成功。
也可以用 du -sh 对比源端和内网的模型目录大小,确保文件完整。
常见问题与避坑提醒
manifest unknown报错:多半是模型文件不完整或 Ollama 版本不一致。先重新打包,确认没有遗漏文件,再检查两边 Ollama 版本。- 批量拉取时内存不足:不要用
ollama pull并行拉取,按顺序逐条拉最安全;如果模型很大,可在循环里加sleep 2降低瞬时负载。 - 内网机器找不到模型:检查
OLLAMA_MODELS环境变量是否正确,以及启动服务时是否重新加载了 systemd 配置。 - tar 包解压后 Ollama 无法读取:确认解压后的目录层级必须是
models/,而不是多套一层目录。用tar tzf ollama_models.tar.gz | head查看压缩包结构。
如果你正在做内网模型仓库离线分发,按这个流程先在一台外网机器完成批量拉取,再打包同步到内网,最后用 ollama list 验证。
遇到问题先检查版本和路径,基本都能解决。