1. Ollama 基础命令速查手册
Ollama作为当前最热门的本地大模型运行框架,其命令行操作是每位开发者必须掌握的生存技能。经过三个月的深度使用,我整理了这份覆盖90%日常场景的实用命令指南,特别针对国内用户优化了下载和配置方案。
重要提示:所有涉及模型下载的命令均可通过替换镜像源加速,推荐使用
https://ollama.ai/v2/作为基础镜像地址
1.1 环境初始化与配置
安装完成后首先需要设置环境变量,这对后续模型管理至关重要:
bash复制# 设置Ollama运行目录(避免C盘爆满)
export OLLAMA_MODELS=/d/ollama/models
# 指定显卡计算后端(CUDA/Metal)
export OLLAMA_GPU_LAYER=metal # Mac用户
export OLLAMA_GPU_LAYER=cuda # NVIDIA显卡
1.2 模型生命周期管理
模型拉取是最高频操作,这里分享几个提速技巧:
bash复制# 基础拉取命令(可替换镜像源)
ollama pull llama3 --registry=https://mirror.example.com
# 断点续传下载(解决网络不稳定问题)
ollama pull --resume llama3
# 查看已下载模型
ollama list
删除模型时要注意依赖关系:
bash复制# 安全删除模型(自动检查依赖)
ollama rm llama3 --force
# 清理残留文件(释放磁盘空间)
ollama prune
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 模型运行与交互技巧
2.1 启动参数优化
不同硬件配置需要调整运行参数:
bash复制# 基础运行命令
ollama run llama3
# 性能调优参数示例
ollama run llama3 \
--num-gpu-layers 35 \ # GPU加速层数
--num-threads 8 \ # CPU线程数
--main-gpu 0 # 指定主显卡
2.2 交互模式进阶用法
在对话界面中可以使用这些快捷键:
code复制/help 查看帮助
/save 保存当前会话
/load 载入历史会话
/config 修改运行时参数
3. 国内用户特别优化方案
3.1 镜像源配置指南
在~/.ollama/config.json中添加:
json复制{
"registry_mirrors": [
"https://mirror.example.com",
"https://ollama.ai/v2/"
]
}
3.2 离线安装方案
当网络完全不可用时:
- 在其他设备执行
ollama pull --download-only llama3 - 将
~/.ollama/models目录打包拷贝 - 在目标机器执行
ollama load llama3.tar
4. 常见问题排错手册
4.1 下载失败处理流程
bash复制# 查看下载日志
tail -f ~/.ollama/logs/download.log
# 重置下载任务
ollama cancel-pull llama3
ollama pull llama3 --retry 3
4.2 GPU加速异常排查
检查显卡驱动兼容性:
bash复制# CUDA用户验证环境
nvidia-smi
nvcc --version
# Metal用户验证环境
system_profiler SPDisplaysDataType
5. 高阶运维命令
5.1 模型转换与导出
bash复制# 导出模型为便携格式
ollama export llama3 ./llama3.tar
# 从GGUF格式导入
ollama create my_model -f ./Modelfile
5.2 服务化部署
后台运行REST API服务:
bash复制ollama serve &
curl http://localhost:11434/api/generate -d '{
"model": "llama3",
"prompt": "你好"
}'
6. 实战经验分享
经过大量实践验证的黄金配置组合:
| 硬件类型 | num-gpu-layers | num-threads | 适用模型大小 |
|---|---|---|---|
| M1/M2 Mac | 35 | 4 | 7B-13B |
| RTX 3090 | 45 | 12 | 13B-70B |
| CPU Only | 0 | 16 | <7B |
血泪教训:Windows用户务必关闭杀毒软件实时监控,否则会导致模型加载速度下降50%以上
对于需要长期运行的场景,建议使用tmux或screen保持会话:
bash复制tmux new -s ollama
ollama run llama3
# Ctrl+B D 分离会话
