1. Linux环境下Ollama安装指南
作为一款新兴的AI模型部署工具,Ollama在Linux系统上的安装过程虽然不复杂,但其中有不少细节值得注意。我在多个Linux发行版上实测了安装过程,总结出这套适合大多数环境的安装方案。
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 准备工作与环境检查
2.1 系统要求确认
Ollama对Linux系统有基本要求:
- 64位操作系统(x86_64或ARM64架构)
- 至少4GB可用内存(推荐8GB以上)
- 20GB可用磁盘空间
- 支持CUDA的NVIDIA显卡(如需GPU加速)
可以通过以下命令检查系统信息:
bash复制uname -m # 检查架构
free -h # 查看内存
df -h # 查看磁盘空间
nvidia-smi # 检查NVIDIA驱动
2.2 依赖项安装
不同Linux发行版需要安装的依赖略有不同:
对于Ubuntu/Debian系:
bash复制sudo apt update
sudo apt install -y curl git build-essential
对于RHEL/CentOS系:
bash复制sudo yum install -y curl git gcc make
3. 安装Ollama的三种方式
3.1 官方脚本一键安装
这是最简单快捷的方式:
bash复制curl -fsSL https://ollama.ai/install.sh | sh
安装完成后会自动:
- 下载最新版Ollama
- 创建ollama用户和用户组
- 设置systemd服务
- 添加环境变量
3.2 手动下载安装
适合需要自定义安装路径的情况:
- 下载对应架构的二进制包:
bash复制wget https://ollama.ai/download/ollama-linux-amd64
- 赋予执行权限:
bash复制chmod +x ollama-linux-amd64
- 移动到PATH目录:
bash复制sudo mv ollama-linux-amd64 /usr/local/bin/ollama
3.3 源码编译安装
适合开发者或需要自定义功能的情况:
bash复制git clone https://github.com/jmorganca/ollama.git
cd ollama
make build
sudo make install
4. 服务配置与管理
4.1 系统服务设置
安装完成后会自动创建systemd服务,常用命令:
bash复制sudo systemctl start ollama # 启动
sudo systemctl stop ollama # 停止
sudo systemctl enable ollama # 开机自启
4.2 环境变量配置
建议在~/.bashrc或~/.zshrc中添加:
bash复制export OLLAMA_HOST=0.0.0.0 # 允许远程访问
export OLLAMA_MODELS=/path/to/models # 自定义模型存储路径
5. 模型下载与使用
5.1 下载预训练模型
bash复制ollama pull llama2 # 下载llama2模型
ollama pull mistral # 下载mistral模型
5.2 运行模型
bash复制ollama run llama2 # 交互式运行
ollama run mistral "你好" # 单次查询
6. 常见问题排查
6.1 端口冲突
Ollama默认使用11434端口,如果冲突可以修改:
bash复制sudo systemctl edit ollama
添加:
code复制[Service]
Environment=OLLAMA_HOST=0.0.0.0:11435
6.2 权限问题
如果遇到权限错误,可以尝试:
bash复制sudo usermod -aG ollama $USER
newgrp ollama
6.3 GPU加速问题
确保已安装NVIDIA驱动和CUDA工具包:
bash复制nvidia-smi # 检查驱动
nvcc --version # 检查CUDA
7. 性能优化建议
7.1 模型量化
使用量化版模型减少内存占用:
bash复制ollama pull llama2:7b-q4_0 # 4位量化版
7.2 批处理设置
调整环境变量优化性能:
bash复制export OLLAMA_NUM_PARALLEL=4 # 并行处理数
export OLLAMA_MAX_LOADED_MODELS=2 # 最大加载模型数
7.3 内存管理
对于小内存设备:
bash复制export OLLAMA_NO_MEMLOCK=1 # 禁用内存锁定
8. 安全配置建议
8.1 访问控制
限制访问IP:
bash复制export OLLAMA_HOST=127.0.0.1 # 仅本地访问
8.2 TLS加密
配置HTTPS访问:
bash复制ollama serve --tls-cert /path/to/cert --tls-key /path/to/key
9. 进阶使用技巧
9.1 自定义模型
创建Modelfile:
text复制FROM llama2
PARAMETER temperature 0.7
SYSTEM """
你是一个乐于助人的AI助手
"""
构建自定义模型:
bash复制ollama create mymodel -f Modelfile
9.2 API集成
Ollama提供REST API:
bash复制curl http://localhost:11434/api/generate -d '{
"model": "llama2",
"prompt": "你好"
}'
10. 卸载与清理
10.1 完全卸载
bash复制sudo systemctl stop ollama
sudo systemctl disable ollama
sudo rm -rf /usr/local/bin/ollama
sudo rm -rf /etc/systemd/system/ollama.service
sudo rm -rf ~/.ollama
10.2 清理模型缓存
bash复制rm -rf ~/.ollama/models
