Ollama批量拉取模型脚本,内网模型仓库离线分发方案

如果你的服务器无法访问外网,又要部署多个 Ollama 模型,最稳妥的办法是先在一台能联网的机器上批量拉取全部模型,再打包分发给内网机器。
本文给出可直接落地的 Ollama 批量拉取脚本和离线分发操作,让你从拉取、打包到内网导入一步到位,全程不需要手动逐个点击。

离线分发前要确认的三件事

开始操作前,先确认下面三项,避免做到一半发现路径或版本不对。

  • 外网机器与内网机器的 Ollama 版本尽量保持一致。模型文件本身对版本敏感,差距过大会出现加载失败或 manifest unknown。建议两边都使用相同的最新稳定版。
  • 确定你需要的模型清单。可以用文本文件记录,每行一个模型名,例如 qwen2.5:7bllama3.1:8bdeepseek-r1:7b
  • 找到模型实际存储路径。默认情况下,root 用户执行的模型目录在 ~/.ollama/models,也就是 /root/.ollama/models;如果 Ollama 以 systemd 服务运行,可能在 /usr/share/ollama/.ollama/models。不确定时执行:
find / -path "*/models/manifests" -type d 2>/dev/null

输出结果的上一级目录就是模型仓库根目录,下面所有操作都以这个目录为准。

写一个批量拉取模型脚本

先创建模型列表文件 models.txt,每行写一个模型名:

vi models.txt

录入内容后,写一个简单的 while 循环脚本 pull_models.sh

#!/bin/bash
while read model; do
  [ -z "$model" ] && continue
  echo "正在拉取:$model"
  ollama pull "$model"
done < models.txt

给脚本加执行权限并运行:

chmod +x pull_models.sh
./pull_models.sh

脚本会逐条拉取,避免同时下载多个模型导致内存溢出。
拉取完成后用 ollama list 确认所有模型都已存在。

打包并分发到内网机器

打包前建议先停止 Ollama 服务,防止模型文件正在被写入导致压缩包不完整:

systemctl stop ollama

如果你是直接用命令行启动的,则执行 ollama stop 或直接 Ctrl+C。
接着进入模型目录的父目录并打包:

cd /root/.ollama
tar czf ollama_models.tar.gz models

把压缩包传输到内网机器时,推荐用 rsync,支持断点续传,大文件更安全:

rsync -avP ollama_models.tar.gz user@内网IP:/data/

如果只有少量小模型,用 scp 也可以,但中途断开就得重新传。

内网机器导入模型并验证

在内网服务器上解压模型压缩包到指定目录:

mkdir -p /root/.ollama
tar xzf /data/ollama_models.tar.gz -C /root/.ollama/

如果你的内网机器模型目录想放在其他位置,比如 /data/ollama/models,可以修改 Ollama 的环境变量来指定:

export OLLAMA_MODELS=/data/ollama/models
ollama serve

如果 Ollama 以 systemd 方式运行,需要编辑 /etc/systemd/system/ollama.service,在 [Service] 段加一行:

Environment="OLLAMA_MODELS=/data/ollama/models"

然后重载并启动:

systemctl daemon-reload
systemctl start ollama

验证是否导入成功,先看列表:

ollama list

再实际运行一个模型测试:

ollama run qwen2.5:7b "你好"

能正常回复就说明离线分发成功。
也可以用 du -sh 对比源端和内网的模型目录大小,确保文件完整。

常见问题与避坑提醒

  • manifest unknown 报错:多半是模型文件不完整或 Ollama 版本不一致。先重新打包,确认没有遗漏文件,再检查两边 Ollama 版本。
  • 批量拉取时内存不足:不要用 ollama pull 并行拉取,按顺序逐条拉最安全;如果模型很大,可在循环里加 sleep 2 降低瞬时负载。
  • 内网机器找不到模型:检查 OLLAMA_MODELS 环境变量是否正确,以及启动服务时是否重新加载了 systemd 配置。
  • tar 包解压后 Ollama 无法读取:确认解压后的目录层级必须是 models/,而不是多套一层目录。用 tar tzf ollama_models.tar.gz | head 查看压缩包结构。

如果你正在做内网模型仓库离线分发,按这个流程先在一台外网机器完成批量拉取,再打包同步到内网,最后用 ollama list 验证。
遇到问题先检查版本和路径,基本都能解决。

分享到:
上一篇
Gemini接口报错403 quota exceeded
下一篇
中转服务部署Debian Bookworm系统内核参数调优
1
系统公告

机房迁移升级通知

尊敬的用户: IP 段 103.23.148.x、156.224.29.x 原香港一区线路波动、攻击频繁,平台定于 7 月 5 日凌晨分批迁移至香港 GIA 机房,硬件升级 AMD 铂金机型。 迁移均在凌晨操作,最大程度降低业务影响,迁移期间服务器临时关机; 升级后配置不降低、费用不涨价,数据默认同步迁移; 迁移后 IP 全部更换,请及时修改域名解析、防火墙白名单; 建议提前备份重要数据,有问题可联系在线客服。 感谢理解与支持! 泽御云科技 2026.06.30
服务中心
客服
在线客服
24小时为您服务
咨询
联系我们
联系我们,为您的业务提供专属服务。
24/7 技术支持
如果您遇到寻求进一步的帮助,请过工单与我们进行联系。
24/7 即时支持
泽御云
售前客服
泽御云
泽御云
售后客服
泽御云
技术支持
评价
您对当前页面的整体感受是否满意?
😞
非常不满意
😕
不满意
😐
一般
🙂
满意
😊
非常满意