☰
MiniMax M Plan全模态额度统一与H3视频、Claude Code/Cursor接入实战
2026/10/8 4:34:03 网站建设 项目流程

MiniMax 这次算是把桌子掀了。大家还在按月计算各家 Token 套餐哪个划算的时候,MiniMax 反手就把 Token Plan 收进历史,推出了新的 M Plan:所有模态的额度揉成一个统一池子,文本、语音、图像、视频全走同一套体系。更关键的是 H3 视频模型直接解禁,同一账号既能跑文本任务,又能生成视频,不再像过去那样每种能力单独开户、单独计费。搭配社区里流行的“免密打通 Claude Code 与 Cursor”玩法,等于你用一个 M Plan 订阅,就能在终端 CLI、IDE 编辑器、视频生成三个入口换来换去。这篇文章不聊虚的,直接拆解 M Plan 的变化、H3 视频的实际用法,以及怎么把 Claude Code 和 Cursor 都接到 MiniMax 上。

1. M Plan 到底改了什么:从“按 Token 记账”到“全模态额度大一统”

1.1 为什么 Token Plan 会被淘汰

过去用 MiniMax 的 Token Plan 时,最烦的一件事就是每个模态单独算账。文本按 Token 扣,语音按秒数扣,图像按张数扣,视频更是单独一个计费体系。你要是同时在做聊天机器人和视频生成实验,脑子里得同时记着三套余额,稍不注意就出现“文本额度还剩一堆,视频额度已经见底”的尴尬局面。

Token Plan 的计费模型本质上还是“资源消耗型”思维:模型厂商按每一次 API 调用的成本来收费,用户则按消耗量来充值。但实际使用的人不是这么想的,大家更在意的是“我这个月要做完什么”,而不是“我调用了多少次”。尤其到了 2025 年,多模态需求已经是常态,一个项目里既要文本摘要、又要图片理解、偶尔还得生成一段短视频,按模态分开算账就成了纯粹的认知负担。

所以 M Plan 把 Token Plan 收掉,本质是计费模型的换代:从“按资源消耗记账”转向“按能力授权记账”。你买的是这个账号在一个周期内的完整能力包,而不是某个模型的按量额度。对轻度用户来说,可能感知不大;但对同时跑多个工具链的开发者,这种统一池子能省掉非常多的管理精力。

1.2 M Plan 的额度模型怎么理解

M Plan 的核心思路是“全模态额度大一统”:一个总用量池,无论是文本对话、语音合成、图像生成,还是 H3 视频生成,都从同一个池子里扣。具体的换算比例每个周期可能有差异,但大方向是这样的:每种模态按复杂度折算成统一的“用量分”,比如一次短文本对话消耗很小,一次视频生成消耗很大,但二者在同一个账本上。

理解这个模型可以类比家里的水费。以前 Token Plan 像去澡堂洗澡,洗头、搓背、泡池子分别交钱;M Plan 像办了张综合健身卡,你进同一个门,用哪个设施都从卡里扣时长。你不需要关心“水用了多少吨”,只需要知道“这个月卡还能用多久”。

对开发者的实际影响在于:只要 M Plan 还有余额,所有模态都能用,不存在“文本额度没用完但视频额度提前耗尽”的情况。反过来,如果你某个月视频生成特别多,文本调用也会被一起拖累。所以在 M Plan 下面,合理的做法不是“哪个模型省我就用哪个”,而是“哪个任务必须用哪个才用哪个”,把额度留给真正高价值的调用。

1.3 对普通开发者的实际影响

从实操角度,M Plan 带来的变化有这么几个:

  • 账号只需要维护一组密钥,不用再分开管理文本、语音、视频的多个 API Key。
  • 计费更透明,控制台里一个总池子的消耗曲线,比过去三个模块的报表好读得多。
  • 适合把 MiniMax 作为“兜底模型”接入自己的工具链,不需要精细计算每次调用成本。

我自己实际用下来的感受是:以前在 Claude Code 里切换模型时,总要担心“这个 key 能不能跑文本”“那个 key 能不能跑视觉”,M Plan 之后这些顾虑少了大半。只要你在环境变量里填的是同一个密钥,Claude Code、Cursor、H3 视频脚本都能共用。这也是后文“免密打通”玩法的前提——所有入口认同一把钥匙。

2. H3 视频解禁:从“演示阶段”到“真正能生成视频”

2.1 H3 是什么,为什么值得关注

H3 是 MiniMax 的视频生成模型,解禁之前只能在特定页面或者限量体验里玩,M Plan 里则直接变成正式能力。你可以通过 API 调用 H3 生成视频,也可以看到它支持多种画幅、多种时长规格,从 5 秒的短片段到一分钟的长镜头都能做。对做短视频、自媒体配图、电商素材、游戏宣传片花的人来说,这意味着“生成视频”从玩具变成了可接入工作流的工具。

H3 值得关注的原因有两个。第一,它和文本模型共用一套账号体系,也就是说 M Plan 用户开箱即用,不需要额外开通视频服务。第二,H3 支持一定的镜头控制能力,在提示词里可以写清楚镜头语言,而不是像早期视频生成模型那样只能碰运气。社区里有人管这个叫 H3 Director 模式,本质上就是让你用文字当导演,把运镜、节奏、场景切换写进提示词。

2.2 视频提示词怎么写:5 秒和一分钟分别需要多少字

这是很多新手最先问的问题。H3 生成 5 秒视频,提示词该写多少字?我自己试下来,5 秒这种短片段,60 到 120 字的中文描述比较合适。不需要写成小作文,但要把“主体、动作、环境、光线、镜头”五个要素写齐。举个例子:

一只橘猫坐在窗台上,午后阳光透过玻璃洒在它身上,它慢慢转头看向镜头,背景是模糊的城市街道,镜头从特写缓缓拉远。

这段大概 50 多个字,生成 5 秒视频已经够用。如果你想要更强的镜头感,就再加一句“镜头先推进再环绕”。H3 对镜头指令的理解能力比早期模型强,你把“推拉摇移”写清楚,它真会照着执行。

一分钟视频就不一样了,这不是把一段提示词拉长 12 倍的问题。一分钟视频必须有分镜结构,我的习惯是把提示词按镜头拆开,一个镜头一个自然段,每段写清楚场景、角色、动作和时间。总的提示词可以到 400 到 600 字,但不是所有模型都会严格按段落执行,所以更稳妥的方式是分多次生成短片段,再用剪辑工具拼起来。H3 生成一分钟视频的能力可以让你直接输出长片段,但分段生成再拼接,可控性会高很多。

还有一个技巧:中文提示词的描述效率比英文高,因为中文表意密度大,同样 100 字能传递的信息量更多。如果你用英文提示词,字数要适当上浮百分之二三十,否则模型可能觉得信息不够。

2.3 本地部署和硬件优化:从 30 系显卡到 ROCm

H3 解禁之后,很多人关心的不只是云端 API,还有本地部署。社区里流传着 H3 的本地推理项目,几个关键词频繁出现:h3 easy、h3 mem eff s、ROCm、海光 K100。这里面透露出一个信号:H3 本地部署的优化方向是“低显存也能跑”。

mem_eff_s这类后缀代表显存优化版本,原理是用分块注意力、算子融合等手段把显存占用压下来。代价通常是推理速度变慢,但好处是让 3090、3080 这种 10G 到 24G 显存的卡也能跑起来。普通用户没必要研究每个算子怎么实现,只要记住一个选择逻辑:显存充足就选原版,速度最快;显存紧张就选 mem_eff 版本,保跑通。30 系显卡用户如果爆显存,优先找带mem_eff的版本或开启 CPU offload 选项。

在非 N 卡环境里,H3 也有适配方案。ROCm 是 AMD GPU 的常用计算平台,如果你用的是 AMD 卡,编译推理服务时要对齐 ROCm 版本。海光 K100 这类加速卡也走类似的 ROCm 兼容路线,能不能跑 H3 主要看算力库版本够不够新。Windows 10 上部署的话,建议直接用预编译的整合包,不要自己从源码折腾,否则光是编译环境就能耗掉一整天。

2.4 Director 模式:用文字当导演

H3 解禁后,最值得玩的是它的导演控制。在提示词里,你可以明确写“镜头:从低角度仰拍”“镜头:跟随主角侧面移动”“镜头:先特写眼睛再快速切换全景”。这些指令对早期视频生成模型往往是无效的,但 H3 在训练时专门吃了大量带镜头语言的视频对,所以它对“镜头感”的描述比一般模型灵敏。

我自己的经验是两类写法最有效:

  • 显式镜头指令:在提示词开头或结尾单独写一行“镜头语言:推近,然后环绕主体一圈”。
  • 场景切换指令:长视频里用“切到”“转场”来标明镜头切换点,比如“第一个镜头是雨夜街道,切到第二个镜头,主角推门进入便利店”。

需要注意的是,Director 模式不是万能的,它更擅长单镜头内的运镜控制,跨镜头的复杂调度仍需要多次生成再剪辑。我的建议是:把导演指令集中在“运镜”上,而不是“叙事”上;叙事靠分镜拆解,运镜靠提示词直写。

3. 免密打通 Claude Code 与 Cursor:实操配置全流程

3.1 前置准备:开通 M Plan 和拿到密钥

前面说那么多,最终要落到“怎么用”上。首先你需要有一个 MiniMax 开放平台的账号,并开通 M Plan。开通后在控制台里创建 API Key,注意保存好,因为很多平台只在创建时完整显示一次。拿到密钥后,你要确定两件事:API 接入域名,以及模型 ID。

MiniMax 的 API 端点可能在不同区域有不同域名,国内常见的是api.minimax.chat,国际区常见的是api.minimaxi.com。具体以你控制台“接入文档”里给的地址为准。文本对话和问答题一般走 OpenAI 兼容接口,路径通常是/v1或/v1/text/chatcompletion_v2。我不建议你死记硬背一个固定的 Base URL,因为平台升级后会调整,正确姿势是把控制台里的接入地址复制下来,保存到本地笔记里。

这里我要强调一个容易踩的坑:很多教程贴出来的 Base URL 其实是旧版的。MiniMax 接口路径改过,早期版本有/v1/text/chatcompletion_v2,新版 OpenAI 兼容接口可能直接就是/v1。你配置 Claude Code 和 Cursor 时,如果一直报 404 或 model not found,先回控制台查最新的接入地址,而不是怀疑密钥有问题。

3.2 Claude Code 接入 MiniMax:环境变量法

Claude Code 是 Anthropic 的命令行编程助手,本来只认 Anthropic 官方的接口,但它支持自定义 Base URL 和认证 Token。这意味着你完全可以把 MiniMax 当作后端模型,让 Claude Code 跑在 MiniMax 的模型上,这就是“免密打通”的核心逻辑:不需要 Anthropic 账号或 Claude 订阅,用 MiniMax 的密钥就能让 Claude Code 跑起来。

安装 Claude Code 本身很简单:

npm install -g @anthropic-ai/claude-code

装完之后,不要直接跑claude命令,先设置环境变量。Linux 和 macOS 下:

export ANTHROPIC_BASE_URL="https://api.minimaxi.com/v1" export ANTHROPIC_AUTH_TOKEN="你的MiniMax密钥" export ANTHROPIC_MODEL="MiniMax-Text-01" claude

Windows 下 PowerShell 语法略有不同:

$env:ANTHROPIC_BASE_URL="https://api.minimaxi.com/v1" $env:ANTHROPIC_AUTH_TOKEN="你的MiniMax密钥" $env:ANTHROPIC_MODEL="MiniMax-Text-01" claude

请把域名和模型名替换成你控制台里的真实值。这里说的MiniMax-Text-01只是我常用的示例,新版 M Plan 可能会有更新的模型 ID,比如 M 系列或者 H 系列对应文本模型,你要以控制台模型列表为准。

设置完成后,Claude Code 会像正常 Claude 一样在终端里工作,能帮你读代码、改文件、执行命令。唯一需要注意的是你要主动告诉它“你是一个通过 API 接入的助手”,因为有些场景下它默认的 system prompt 可能假设自己在 Anthropic 环境里,导致回答风格偏差。

3.3 Cursor 接入 MiniMax:自定义模型设置

Cursor 是 AI 代码编辑器,它的模型设置里支持自定义 API。要把 MiniMax 接进去,路径是:

Settings -> Models -> 开启自定义模型开关 -> 添加模型

添加模型时,你会看到 API Key、Base URL、模型 ID 三个输入框。API Key 填 MiniMax 密钥,Base URL 填 MiniMax 的 OpenAI 兼容地址,模型 ID 填你在控制台里创建的模型名。

配置好之后,回到聊天面板,把模型切换到自定义模型上。注意 Cursor 有一个习惯:如果你不主动切换,它可能还走原来的模型列表。切换之后第一轮响应会比较慢,因为 Cursor 在探测模型能力,别急着关窗口,等几十秒出结果。

还有一个很实用的设置:把 MiniMax 模型配置为“备用模型”。Cursor 的模型选择菜单里通常支持配置多个模型,你可以把官方模型留在主位,MiniMax 放在备用位。当官方模型网络抖动或者额度受限时,手动切换到 MiniMax 兜底。避免因为模型不可用导致整个编码中断。

3.4 VSCode 里配置 Claude Code 的小技巧

Claude Code 除了独立的终端 CLI,还能跑在 VSCode 的终端面板里。很多人装完 Claude Code 后懒得切窗口,直接在 VSCode 里打开终端跑claude,效果完全一样。但有几个小细节:

  • VSCode 终端默认可能不加载你 shell 里的环境变量,如果你在终端里跑claude发现没生效,检查一下环境变量是否写进了.bashrc或.zshrc,而不是只在当前终端 session 里 export。
  • 想让 Claude Code 能直接操作当前项目目录,在 VSCode 终端里启动时,确保当前工作目录就是项目根目录。Claude Code 会基于启动目录来读文件。
  • 如果你用 Windows 且是在 VSCode 的 PowerShell 终端里运行,要记住$env:VAR="value"这种赋值只对当前终端有效,重启 VSCode 后需要重新设置。更好的办法是把变量写到系统环境变量里,或者写一个启动脚本每次自动配置。

3.5 让 Cursor 和 Claude Code 说中文:语言设置与回复风格

除了打通模型,大家问得最多的就是“Cursor 怎么设置中文回复”“Claude Code 怎么改成中文”。这其实分两个层面:界面语言和回复语言。

Cursor 的界面语言,一般在Settings -> General -> Language里切换。如果当前版本没提供中文界面选项,一个变通办法是安装汉化插件,比如在插件市场搜 “Chinese” 或 “Localization”。不过对我来说,IDE 界面保持英文问题不大,真正的痛点是代码注释和聊天回复它是英文的。

回复语言的控制方式更直接:在系统提示词或项目规则里加一句“Always reply in Chinese”。Claude Code 可以在启动时加上--system-prompt参数,或者你直接在第一轮对话里说“之后所有回复都用中文”。我这段时间用下来,推荐在项目根目录放一个CLAUDE.md或AGENTS.md文件,里面写清楚“请用中文回答问题,代码注释用中文,提交信息也用中文”。Claude Code 和 Cursor 都会自动读取这类项目规则文件,一劳永逸。

3.6 桌面版、在线升级和官方文档

如果你不想每次都在终端敲命令,可以关注 Claude Code 桌面版。它本质上是把 CLI 包了一层图形界面,适合不习惯命令行的用户。安装方式和配置环境变量与 CLI 一致,只是启动方式从终端变成了桌面应用。

Claude Code 的升级也很频繁,官方现在支持在线升级。终端里只需要:

claude update

如果在 VSCode 里提示版本太旧,先跑一次升级再继续。注意升级不会重置你的环境变量配置,但如果你用的是旧版 API 参数名,升级后可能出现参数不兼容的警告,这时候回到官方 changelog 看一眼最新参数格式。官方文档链接可以在 Anthropic 官网的 docs 页面找到,我一般只看 Models 和 Base URL 两节,其余不用细读。

4. 常见问题与排查技巧实录

4.1 问题速查表

这一节把我遇到过的典型问题整理成了一张速查表,照着排查比自己瞎试快得多。

现象可能原因解决办法
Claude Code 启动后连接超时Base URL 填成了旧版地址到控制台复制最新接入域名,重新 export
报错 model not found模型 ID 跟控制台不一致列出控制台模型列表,精确复制模型 ID
第一轮回复特别慢模型在探测能力 / Cursor 请求超时等 30 秒以上,或把 Cursor 的超时时间调大
Cursor 聊天面板找不到自定义模型没有开启自定义模型开关Settings -> Models 里打开开关并添加模型
Cursor 注册时手机号总是自动打括号输入框格式要求带国家区号按 +86 格式先填国家区号,再填手机号,去掉手机号首位 0
H3 生成视频报显存不足显存不够或没启用优化版本换 mem_eff 版本,开 CPU offload,降低分辨率
视频生成结果里镜头乱动提示词里镜头指令太含糊单独写一行“镜头语言”,用明确的推拉摇移动词
同一个密钥在 Cursor 能用但 Claude Code 不能用环境变量没设置或格式不对检查是否 export 成功,用echo $ANTHROPIC_BASE_URL确认
Claude Code 不会自动执行终端命令需要用户授权或安全策略限制用/permissions开启命令白名单,或手动确认每条命令

4.2 踩坑心得:模型名、上下文长度和视频提示词

第一个坑是模型名写错。MiniMax 的模型 ID 在不同接口下写法可能不一样,控制台里显示的是MiniMax-Text-01,但 OpenAI 兼容接口里可能要求写成minimax-01或带版本后缀。别想当然,直接把控制台列表里的 id 拉出来粘贴。

第二个坑是上下文长度。Claude Code 和 Cursor 这类工具会一次塞入很多代码文件作为上下文。MiniMax 文本模型虽然支持超长上下文,但单次请求太长时,延迟会明显上升。如果你感觉整个对话越来越慢,先检查是不是项目文件被塞太多。建议把不需要的大文件加进 ignore 列表,或者拆分会话,不要让单个 session 积累几千行上下文。

第三个坑是视频提示词太短。H3 对短提示词的理解能力有限,尤其是“生成一个男人走在街上”这种十几个字的描述,出来的画面往往缺乏细节。我建议最少写到包含“主体 + 动作 + 环境 + 光线”四要素,哪怕字数多一点,也不要偷懒。视频生成的失败和文本生成不一样,文本生成错了还能重写,视频生成一次就是几十秒甚至几分钟,先把提示词打磨好再提交,效率反而最高。

4.3 几个容易忽视的小细节

Cursor 免费额度是个老话题。很多人注册完发现免费额度很快用光,如果不想付费,就在设置里把模型切换成自己接入的 MiniMax,这样消耗的是你自己的订阅额度,而不是 Cursor 的免费额度。这算是 M Plan 用户最划算的用法之一。

关于 Cursor 响应速度慢,除了网络因素外,最常见的原因是 Cursor 同时发送了多个模型请求做对比。如果你只是日常编码,在模型设置里关掉“同时请求多个模型”,只保留一个主模型,响应速度会显著提升。

最后说安全。Cursor 和 Claude Code 都会自动读取项目文件,如果你把 API 密钥写进了.bashrc、settings.json或者项目配置文件,要小心不要把整个项目打包发到公开仓库。最稳妥的方式是用系统环境变量保存密钥,项目里不落任何明文。另外,不要把重要的系统提示词或私有项目规则放在全局模型配置里,放在项目本地更安全,也能避免多项目之间串规则。

最后再聊两句实操心得

整套玩下来,我最满意的地方是用一个 M Plan 密钥,同时在 Claude Code、Cursor 和 H3 视频脚本三处干活。以前开三个平台的账号,密钥记三份,额度算三套,现在切上下文都不用换钥匙。如果你准备迁移,我的建议是从小处开始:先把 Claude Code 接上,跑一个简单任务确认链路通,再逐步把 Cursor 和视频生成加进来,不要一次性全改完。模型接入这种事,一次只动一个变量,出了问题才好定位。

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询