Mistral
一句话简介:Mistral AI 是法国的人工智能公司,多款模型按 Apache 2.0 协议开源。
主流功能:欧洲企业定制/私有部署、边缘部署、代码、多语言
可用性:国内可直接使用(Ollama 本地部署 + 国内镜像站下载权重,无需特殊网络;Mistral 官方云端 API 的国内可用性未验证,本文不以其为主要路线)。
适用人群:想在自己电脑上跑一个欧洲开源大模型的用户
前置条件:
- 硬件:跑 7B 级模型需 8GB+ 内存
- 系统:Windows 10+ / macOS / Linux
- 说明:Mistral Large 3 为当前旗舰版本(以官方为准)
教程:Ollama 本地部署 Mistral
步骤 1:安装 Ollama
Linux(一键脚本):
curl -fsSL https://ollama.com/install.sh | sh
Windows / macOS:
- 访问
https://ollama.com,下载对应系统的安装包,按提示安装。 - macOS/Windows 桌面版安装后会自动在后台运行服务。
国内下载加速(可选):
- 若官网下载慢,可从 GitHub releases 页面手动下载安装包,再用 ghproxy 等代理加速(可用性未验证,请自行确认)。
- 安装后验证:
ollama --version
步骤 2:启动服务并验证
# Linux 手动启动(桌面版可跳过)
ollama serve
浏览器打开 http://127.0.0.1:11434,页面显示 Ollama is running 即服务正常。
步骤 3:拉取并运行 Mistral Large
# 拉取官方库中的 Mistral Large(Large 3 具体 tag 以库页面为准)
ollama pull mistral-large
# 运行并进入交互对话
ollama run mistral-large
第一次运行会自动下载权重(体积较大,请耐心等待)。看到 >>> 提示符后直接输入中文问题即可对话;输入 /bye 退出。
小机器可先用 7B 版本练手:
ollama run mistral
步骤 4:HuggingFace 权重的国内镜像下载(GGUF 路线)
如果 ollama pull 太慢,或想用指定的 Large 3 量化版本,走这条路线:
- 打开 HF 镜像站
https://hf-mirror.com,搜索mistralai官方账号下的 Large 3 仓库(仓库名以镜像站页面为准),下载 GGUF 量化文件(如xxx-Q4_K_M.gguf;显存紧张选 Q4_K_M,追求效果选 Q8_0)。 - 也可在魔搭社区(
https://www.modelscope.cn)搜索 "GGUF",找 Mistral Large 的量化版,页面一般直接给出 Ollama 命令。 - 在 GGUF 文件所在目录创建
Modelfile:
FROM ./下载的文件名.gguf
PARAMETER temperature 0.7
- 导入 Ollama 并运行:
ollama create mistral-large3 -f Modelfile
ollama run mistral-large3
步骤 5:用 API 方式调用(开发接入)
Ollama 提供 OpenAI 兼容接口,跑起来后任何语言都能调:
curl http://localhost:11434/api/chat -d '{
"model": "mistral-large",
"messages": [{"role": "user", "content": "用中文介绍一下你自己"}],
"stream": false
}'
Python 示例:
pip install ollama -i https://pypi.tuna.tsinghua.edu.cn/simple
import ollama
resp = ollama.chat(model="mistral-large",
messages=[{"role": "user", "content": "用中文介绍一下你自己"}])
print(resp.message.content)
步骤 6:可选:装个图形界面
docker run -d -p 3000:8080 --add-host=host.docker.internal:host-gateway \
--name open-webui ghcr.io/open-webui/open-webui:main
浏览器打开 http://localhost:3000,即可用 ChatGPT 风格的网页与本地 Mistral 对话(首次需创建管理员账号)。
常见问题
ollama pull mistral-large下载太慢/中断? 改走步骤 4 的 GGUF 路线:从 hf-mirror.com 或魔搭社区下好文件再ollama create导入,支持断点续传的下载工具(如 wget -c)更稳。显存/内存不够跑 Large? 先用
ollama run mistral(7B)验证全流程;Large 级别建议 32GB+ 内存或配大显存 GPU,低配机器可选更小的量化版本(Q4_K_S 等)。Ollama 官方库的 mistral-large 是不是 Large 3? 未逐项验证。请打开
https://ollama.com/library搜索mistral-large,以页面标注的版本与更新时间为准;想锁定 Large 3 请用 GGUF 路线手动导入官方权重。模型回答偏英文怎么办? 在 Modelfile 里加系统提示词,或每次对话开头声明:
SYSTEM 你是一个中文 AI 助手,始终用简体中文回答。
- Mistral 官方 API(la plateforme)在国内能用吗? 未验证。本文路线完全基于本地部署,不依赖官方云端 API;如需云端 API,请自行确认其在国内的可用性与支付方式。