← 返回教程目录

MiniMax

一句话简介: 2021 年成立的国产通用 AI 公司,模型覆盖文本、语音、图像、视频。

主流功能:高效代码/Agent 负载、语音与视频生成

可用性:国内可直接使用,无需特殊网络。

适用人群:视频创作者、语音/音乐应用开发者、需要多模态 API 的团队、想本地部署开源权重的用户

前置条件:

  • 网络:普通国内网络
  • 账号:开放平台 API 需注册(platform.minimax.io / 国内版),创建 API Key
  • 费用:海螺 AI 网页端有免费额度,超出按量
  • 许可证注意:MiniMax-M3 使用自有社区许可(非 MIT/Apache):需署名

教程 A:开源模型本地部署

步骤 1:确认硬件与权重来源

  1. 先运行 nvidia-smi 看 GPU 型号与显存。视频类模型(如 MiniMax-H3)建议 24GB+ 显存;文本模型 M2/M3 完整版需服务器级多卡。
  2. 国内下载权重优先走魔搭社区 ModelScope(如 Comfy-Org/MiniMax-H3),HuggingFace 直连不稳定时再用 hf-mirror 镜像:
export HF_ENDPOINT=https://hf-mirror.com
export HF_HUB_DISABLE_XET=1

步骤 2:安装依赖(走国内 pip 源)

pip install torch torchvision torchaudio \
-i https://mirrors.aliyun.com/pypi/simple/ \
--extra-index-url https://mirrors.aliyun.com/pytorch-wheels/cu130

步骤 3:下载权重并部署

pip install modelscope
modelscope download --model Comfy-Org/MiniMax-H3 --local_dir./MiniMax-H3

之后按所选推理框架(Diffusers 管线、ComfyUI 或 vLLM)加载本地权重目录启动服务;社区已有现成项目(如 minimax-music3-api 这类 FastAPI 封装)可参考其 docs 里的部署文档。注意:不同子模型(文本/视频/语音/音乐)的部署方式差异大,以各模型官方仓库的 README 为准。

教程 B:开放平台 API 接入

步骤 1:注册并创建 API Key

  1. 访问 MiniMax 开放平台注册登录(国内用户用国内版)。
  2. 进入「账户管理」→「API Key」菜单,创建新 Key 并立即复制保存(只展示一次)。
  3. 国内版 Base URL:https://api.minimaxi.com/v1;国际版:https://api.minimax.io/v1。

步骤 2:OpenAI 兼容调用(文本)

export MINIMAX_API_KEY="你的MiniMax密钥"
import os
from openai import OpenAI

client = OpenAI(
api_key=os.environ["MINIMAX_API_KEY"],
base_url="https://api.minimaxi.com/v1", # 国内版
)
resp = client.chat.completions.create(
model="MiniMax-M2", # 文本模型;M3 以平台模型列表为准
messages=[{"role": "user", "content": "用 Python 写一个斐波那契函数"}],
max_tokens=1000,
)
print(resp.choices[0].message.content)

curl 版本:

curl https://api.minimaxi.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $MINIMAX_API_KEY" \
-d '{"model":"MiniMax-M2","messages":[{"role":"user","content":"写一个斐波那契函数"}],"max_tokens":1000}'

平台同时兼容 Anthropic 格式(https://api.minimaxi.com/anthropic,Header 用 x-api-key),以官方文档为准。

步骤 3:官方 CLI(mmx-cli,一条命令调全模态)

npm install -g mmx-cli # 需要 Node.js 18+
mmx auth login --api-key sk-你的密钥
mmx text chat --message "你好,MiniMax!"
mmx image "一只穿宇航服的猫"
mmx video generate --prompt "海浪拍打礁石"
mmx speech synthesize --text "你好!" --out hello.mp3
mmx music generate --prompt "欢快的流行乐"
mmx quota # 查剩余额度

教程 C:海螺 AI 网页端使用(视频生成)

海螺 AI(hailuoai.video)是 MiniMax 的视频生成应用,支持文生视频(T2V)与图生视频(I2V)。

步骤 1:注册登录

  1. 浏览器访问 hailuoai.video,手机号/微信注册登录。
  2. 首页即创作界面,可先看免费额度。

步骤 2:文生视频

  1. 选择"文本生成视频"模式。
  2. 在提示框按"主体 + 动作 + 场景 + 运镜 + 风格"写描述,例如:"炎热的夏日,野马在广阔的田野上自由奔跑,镜头逐渐拉近,慢动作,电影质感"。
  3. 选择时长与画幅,点击生成,等待渲染完成后预览、下载 MP4。

步骤 3:图生视频

  1. 选择"图片生成视频"模式,上传一张静态图(人物/风景均可)。
  2. 补充动态指令,如"镜头缓慢推进,人物轻轻转头微笑"。
  3. 点击生成;想做长片可分段生成(每段 5-10 秒),再用剪映拼接。

步骤 4:运镜小技巧

  • 一个镜头只做一个运镜动作(推/拉/摇/移选其一),画面更稳定。
  • 提示词写清运镜词:"镜头缓慢拉远""环绕拍摄""第一人称视角推进"。
  • 人物一致性要求高的内容,先用图生视频锁定首帧再生成。

常见问题

  1. 国内版和国际版 Key 通用吗? 以平台说明为准;Base URL 别混用——国内版用 api.minimaxi.com,国际版用 api.minimax.io。
  2. M3 权重商用有什么限制? 需署名;微调/后训练后做商业部署、且相关产品年收入超 2000 万美元,需 MiniMax 单独书面授权。纯研究/实验无此门槛。
  3. 本地部署 H3 视频模型要什么配置? 建议 NVIDIA GPU 24GB+ 显存、32GB+ 内存;非 NVIDIA 显卡(AMD/Apple)目前跑不了官方 CUDA 管线。
  4. 海螺 AI 生成要等很久? 高峰期排队正常;可错峰生成,或分段生成后拼接。
  5. mmx-cli 报需要 Token 套餐? CLI 的部分能力(视频/音乐等)要求开通 Token 套餐,先在开放平台确认套餐状态(mmx quota 查看)。