这是一份在 Ubuntu 22.04 系统上安装和配置 Ollama 的详细教程。Ollama 是目前最流行的本地运行大语言模型(LLM)的工具,支持 Llama 3, Mistral, Qwen (通义千问) 等多种模型。

1. 准备工作

在开始之前,建议先更新系统软件包,并安装必要的工具(主要是 curl)。

打开终端,执行以下命令:

# 更新系统
sudo apt update && sudo apt upgrade -y

# 安装 curl (如果尚未安装)
sudo apt install curl -y

关于显卡驱动(可选):
如果你使用的是 NVIDIA 显卡,建议先安装好 NVIDIA 驱动和 CUDA 工具包,这样 Ollama 会自动利用 GPU 进行加速。如果没有显卡,Ollama 也可以在 CPU 上运行,但速度会慢一些。


2. 一键安装 Ollama

Ollama 官方提供了一个极其简单的安装脚本,适用于 Linux 系统。

在终端中执行以下命令:

curl -fsSL https://ollama.com/install.sh | sh

脚本执行过程说明:

  1. 自动检测系统架构。
  2. 下载最新的 Ollama 二进制文件。
  3. 创建一个名为 ollama 的用户。
  4. 配置 Systemd 服务,使 Ollama 可以开机自启并在后台运行。

3. 验证安装

安装完成后,可以通过以下命令检查 Ollama 是否安装成功以及当前版本:

ollama --version

输出示例:ollama version is 0.5.x

检查服务运行状态:

sudo systemctl status ollama

如果看到绿色的 Active: active (running),说明服务已正常启动。


4. 下载并运行模型

Ollama 安装好后,并没有自带模型,你需要下载。目前最流行的是 Meta 的 Llama 3 或阿里的 Qwen 2

运行 Llama 3 (8B 版本)

ollama run llama3

运行通义千问 Qwen 2 (7B 版本)

ollama run qwen2

注意:

  • 第一次运行某个模型时,Ollama 会自动从网络下载模型文件(通常几 GB 到几十 GB 不等),请耐心等待。
  • 下载完成后,会自动进入交互式对话界面,你可以在这里直接输入问题与 AI 对话。
  • Ctrl + d 或输入 /bye 可以退出对话。

5. 常用命令速查

  • 查看已安装的模型:
    ollama list
    
  • 下载模型但不运行:
    ollama pull <模型名称>
    
  • 删除模型:
    ollama rm <模型名称>
    
  • 更新 Ollama:
    只需重新运行安装脚本即可:
    curl -fsSL https://ollama.com/install.sh | sh
    

6. 进阶配置:允许局域网访问(可选)

默认情况下,Ollama 只监听 127.0.0.1:11434,只能在本机访问。如果你想从局域网内的其他电脑连接这台 Ubuntu 服务器(例如使用 WebUI 或 API),需要修改配置。

  1. 编辑 systemd 服务文件:

    sudo systemctl edit ollama.service
    
  2. 在编辑器中添加环境变量:
    在打开的界面中(通常是 nano 编辑器),在 [Service] 下方添加两行:

    [Service]
    Environment="OLLAMA_HOST=0.0.0.0"
    

    (注:0.0.0.0 表示允许所有 IP 访问)

  3. 保存并退出:

    • 如果是 nano 编辑器:按 Ctrl + O 保存,回车确认,然后按 Ctrl + X 退出。
  4. 重启 Ollama 服务:

    sudo systemctl daemon-reload
    sudo systemctl restart ollama
    

此时,你可以在同一局域网下的浏览器访问 http://<Ubuntu的IP地址>:11434,如果看到 "Ollama is running",说明配置成功。


7. 安装 Web 界面 (推荐 Open WebUI)

虽然命令行能用,但配合图形界面体验更好。推荐使用 Open WebUI(以前叫 Ollama WebUI),它长得像 ChatGPT。

最简单的安装方式是使用 Docker

  1. 安装 Docker (如果未安装):

    sudo apt install docker.io -y
    sudo usermod -aG docker $USER
    # 注意:执行完上一行后最好注销并重新登录,或者用 sudo 执行 docker 命令
    
  2. 运行 Open WebUI:

    sudo docker run -d -p 3000:8080 --add-host=host.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main
    
  3. 访问界面:
    打开浏览器访问:http://localhost:3000 (如果是远程访问,请用服务器 IP)。
    你可以在界面上注册管理员账号,然后选择下拉菜单中的模型进行对话。


8. 卸载 Ollama

如果想完全卸载,可以按以下步骤操作:

  1. 停止并禁用服务:
    sudo systemctl stop ollama
    sudo systemctl disable ollama
    
  2. 删除服务文件和二进制文件:
    sudo rm /etc/systemd/system/ollama.service
    sudo rm /usr/local/bin/ollama
    
  3. 删除 Ollama 用户和用户组:
    sudo userdel ollama
    sudo groupdel ollama
    
  4. (可选) 删除下载的所有模型数据:
    sudo rm -r /usr/share/ollama
    sudo rm -r ~/.ollama