← 返回教程目录

Mistral

一句话简介:Mistral AI 是法国的人工智能公司,多款模型按 Apache 2.0 协议开源。

主流功能:欧洲企业定制/私有部署、边缘部署、代码、多语言

可用性:国内可直接使用(Ollama 本地部署 + 国内镜像站下载权重,无需特殊网络;Mistral 官方云端 API 的国内可用性未验证,本文不以其为主要路线)。

适用人群:想在自己电脑上跑一个欧洲开源大模型的用户

前置条件:

  • 硬件:跑 7B 级模型需 8GB+ 内存
  • 系统:Windows 10+ / macOS / Linux
  • 说明:Mistral Large 3 为当前旗舰版本(以官方为准)

教程:Ollama 本地部署 Mistral

步骤 1:安装 Ollama

Linux(一键脚本):

curl -fsSL https://ollama.com/install.sh | sh

Windows / macOS:

  1. 访问 https://ollama.com,下载对应系统的安装包,按提示安装。
  2. macOS/Windows 桌面版安装后会自动在后台运行服务。

国内下载加速(可选):

  • 若官网下载慢,可从 GitHub releases 页面手动下载安装包,再用 ghproxy 等代理加速(可用性未验证,请自行确认)。
  • 安装后验证:
ollama --version

步骤 2:启动服务并验证

# Linux 手动启动(桌面版可跳过)
ollama serve

浏览器打开 http://127.0.0.1:11434,页面显示 Ollama is running 即服务正常。

步骤 3:拉取并运行 Mistral Large

# 拉取官方库中的 Mistral Large(Large 3 具体 tag 以库页面为准)
ollama pull mistral-large

# 运行并进入交互对话
ollama run mistral-large

第一次运行会自动下载权重(体积较大,请耐心等待)。看到 >>> 提示符后直接输入中文问题即可对话;输入 /bye 退出。

小机器可先用 7B 版本练手:

ollama run mistral

步骤 4:HuggingFace 权重的国内镜像下载(GGUF 路线)

如果 ollama pull 太慢,或想用指定的 Large 3 量化版本,走这条路线:

  1. 打开 HF 镜像站 https://hf-mirror.com,搜索 mistralai 官方账号下的 Large 3 仓库(仓库名以镜像站页面为准),下载 GGUF 量化文件(如 xxx-Q4_K_M.gguf;显存紧张选 Q4_K_M,追求效果选 Q8_0)。
  2. 也可在魔搭社区(https://www.modelscope.cn)搜索 "GGUF",找 Mistral Large 的量化版,页面一般直接给出 Ollama 命令。
  3. 在 GGUF 文件所在目录创建 Modelfile:
FROM ./下载的文件名.gguf
PARAMETER temperature 0.7
  1. 导入 Ollama 并运行:
ollama create mistral-large3 -f Modelfile
ollama run mistral-large3

步骤 5:用 API 方式调用(开发接入)

Ollama 提供 OpenAI 兼容接口,跑起来后任何语言都能调:

curl http://localhost:11434/api/chat -d '{
  "model": "mistral-large",
  "messages": [{"role": "user", "content": "用中文介绍一下你自己"}],
  "stream": false
}'

Python 示例:

pip install ollama -i https://pypi.tuna.tsinghua.edu.cn/simple
import ollama
resp = ollama.chat(model="mistral-large",
                   messages=[{"role": "user", "content": "用中文介绍一下你自己"}])
print(resp.message.content)

步骤 6:可选:装个图形界面

docker run -d -p 3000:8080 --add-host=host.docker.internal:host-gateway \
  --name open-webui ghcr.io/open-webui/open-webui:main

浏览器打开 http://localhost:3000,即可用 ChatGPT 风格的网页与本地 Mistral 对话(首次需创建管理员账号)。


常见问题

  1. ollama pull mistral-large 下载太慢/中断? 改走步骤 4 的 GGUF 路线:从 hf-mirror.com 或魔搭社区下好文件再 ollama create 导入,支持断点续传的下载工具(如 wget -c)更稳。

  2. 显存/内存不够跑 Large? 先用 ollama run mistral(7B)验证全流程;Large 级别建议 32GB+ 内存或配大显存 GPU,低配机器可选更小的量化版本(Q4_K_S 等)。

  3. Ollama 官方库的 mistral-large 是不是 Large 3? 未逐项验证。请打开 https://ollama.com/library 搜索 mistral-large,以页面标注的版本与更新时间为准;想锁定 Large 3 请用 GGUF 路线手动导入官方权重。

  4. 模型回答偏英文怎么办? 在 Modelfile 里加系统提示词,或每次对话开头声明:

SYSTEM 你是一个中文 AI 助手,始终用简体中文回答。
  1. Mistral 官方 API(la plateforme)在国内能用吗? 未验证。本文路线完全基于本地部署,不依赖官方云端 API;如需云端 API,请自行确认其在国内的可用性与支付方式。