ARVICA / 文档中心

文档 / 软件与任务

在 GPU 上运行 Ollama

启动小模型 验证 API 并将模型数据保存在 Docker 持久卷

1. 准备

完成 GPU 环境检查 将 ARVICA_OLLAMA_IMAGE 设置为已测试的官方镜像版本 Docker 卷在删除容器后保留 但仍属于本机存储 不等于托管网络卷或备份

Official documentation / 官方文档

2. 启动并验证

在 GPU 主机运行 预期返回文本 且 API 模型列表包含 llama3.2:1b 使用前核对模型许可 这是连通性检查 不是性能承诺

#!/usr/bin/env bash
set -euo pipefail
: "${ARVICA_OLLAMA_IMAGE:?Set a tested ollama/ollama image tag or digest}"
docker run -d --name arvica-ollama --gpus all \
  -p 127.0.0.1:11434:11434 -v arvica-ollama:/root/.ollama \
  "$ARVICA_OLLAMA_IMAGE"
docker exec arvica-ollama ollama pull llama3.2:1b
docker exec arvica-ollama ollama run llama3.2:1b "Reply with OK"
curl --fail http://127.0.0.1:11434/api/tags

3. 访问与排查

在电脑创建以下 SSH 隧道 下载失败检查网络和磁盘 GPU 识别失败检查驱动与 Docker GPU 运行时 使用 docker logs arvica-ollama 查看日志 完成后只停止或删除该命名容器 命名卷仍保留

ssh -i ~/.ssh/arvica_ed25519 -N -L 11434:127.0.0.1:11434 ubuntu@INSTANCE_IP
GPU 环境检查