在 Linux 上安装 Ollama 并安全提供服务

在 Linux 上安装 Ollama、运行首个模型、验证本地 API,并理解为什么不能在没有认证的情况下把 11434 端口直接暴露到公网。

先选模型,再选服务器

Ollama 简化了本地模型运行,但不会消除模型本身的资源要求。应根据准备运行的具体模型和量化版本估算内存、硬盘和加速卡需求。小型 CPU 测试与生产推理服务是完全不同的负载。

安全的网络设计

Ollama 默认仅在本机监听。除非已经通过带认证的应用或受保护的反向代理接入,否则应保持这一边界。不要把 11434 端口直接暴露到公网。

运维检查

  • 固定并记录应用使用的模型名称和版本。
  • 为模型文件和后续更新预留足够硬盘空间。
  • 监控内存压力、响应延迟和服务重启情况。
  • 防火墙仅允许真正需要调用 API 的应用主机访问。
  • 测试备份和重建流程;模型文件通常可以重新下载,但配置和应用数据必须备份。

资料来源与下一步

请以 Ollama 官方 Linux 文档快速入门 为准。需要浏览器界面时,可继续阅读 Open WebUI 部署教程

环境与配置要求

  • 操作系统:支持 systemd 的 64 位 Linux
  • CPU:取决于模型,可从 4 核开始测试
  • 内存:必须高于所选模型的实际内存占用
  • 存储:模型文件容量外至少预留 20 GiB
  • 网络:保持 11434 端口私有,通过认证网关访问

第 1 步:确认主机架构与资源

确认 Linux 架构、可用硬盘和内存,并选择适合当前机器的模型,不要假设所有模型都能流畅运行。

bash
uname -m
free -h
df -h

预期结果: 命令无错误完成,并且本步骤描述的服务或文件已经可用。

第 2 步:安装 Ollama

使用官方 Linux 文档中的当前安装命令,并在完成后检查安装版本。

bash
curl -fsSL https://ollama.com/install.sh | sh
ollama --version

预期结果: 命令无错误完成,并且本步骤描述的服务或文件已经可用。

注意:执行远程安装脚本前请先检查内容,并且只使用当前官方来源。

第 3 步:检查系统服务

在使用 systemd 的发行版中确认服务已启动;如果启动失败,请查看近期日志。

bash
systemctl status ollama --no-pager
journalctl -u ollama --no-pager -n 100

预期结果: 命令无错误完成,并且本步骤描述的服务或文件已经可用。

第 4 步:运行首个模型

运行官方模型库中的模型。首次启动会下载模型文件,因此耗时和硬盘占用会因模型而异。

bash
ollama run gemma3

预期结果: 命令无错误完成,并且本步骤描述的服务或文件已经可用。

第 5 步:验证本地 API

从同一主机验证 API。保持端口仅内部可用,远程应用应通过带认证的服务层连接。

bash
curl http://127.0.0.1:11434/api/generate -d '{"model":"gemma3","prompt":"Hello","stream":false}'

预期结果: 命令无错误完成,并且本步骤描述的服务或文件已经可用。

相关服务器方案

需要运行环境时再考虑

以下方案与本文场景相关。价格和配置会变化,请在购买前重新核对;通过链接购买时 AIOOS 可能获得佣金,但不会增加你的价格。

雨云

雨云洛杉矶一区 8 核 16GB

这是与文章场景相关的服务器方案;购买前请核对实时价格、地区、IP、带宽和工作负载。

8 vCPU · 16 GB · 30 GB system disk
查看当前方案
我正在使用 · 推广推荐

准备上线时,可以再比较这两项服务

这不是自动排名,也不是每个人都需要购买。我只列出自己正在使用的入口,并把适用场景和限制说清楚。

云服务器 · 前期项目在用

雨云 RainYun

准备部署网站或小型服务时,可以把它作为入门候选;先按用户地区、配置和真实负载判断,不要只看最低价格。

推广说明:链接包含我的推荐信息。你通过链接注册或开通后,我可能获得平台奖励;不会因此向你额外收费。价格、活动、地区与服务条款请以下单页为准。 查看完整商业披露