9 月 27 日,MiniMax 在官方文档的模型表里挂上了一个新名字:MiniMax-M3.1-Flash-Preview。它被排在语言模型表第一行,位置在 MiniMax-M3 前面。官方给它的介绍只有一句英文,四个标签:Multimodal、1M context window、Frontier coding、Tunable thinking depth(出处:MiniMax 官方 Models 页)。
真正值得写下来的不是参数,是它卖给了谁。语言模型表上方有一行小字:"MiniMax-M3.1-Flash-Preview is available only through M Plan and MiniMax Code for now."(目前仅通过 M Plan 和 MiniMax Code 提供)。一款新模型首发不进按量付费(pay-as-you-go)列表,先落在自家编程客户端和订阅套餐里——对开发者来说,这意味着账上余额再多也调不动它,前提是先有一张订阅席位。
需要先说明一个口径边界:官方对这一定位的描述是 "Frontier multimodal coding model",它是 coding 定位的模型,官方并没有把它包装成通用旗舰。本文全篇按官方口径称它"新模型"。
这件事发生在国庆前一周;国庆七天不限量的活动窗口,紧跟在它后面。
关键数据表:厂商口径 vs 第三方实测
下表左侧为官方文档与公告原文口径,右侧为第三方上手实测或转述,两栏不混用。表中所有第三方内容均为非标准化试用,不是跑分。
| 项目 | 厂商口径(官方文档 / 公告) | 第三方实测或观察 |
|---|---|---|
| 上下文窗口 | 1,000,000 token(输入 + 输出合计) | 品玩:在 MiniMax Code 内以 1M 上下文运行;未见 API 侧独立复现 |
| 输入模态 | 文本 / 图像 / 视频(URL、base64、mm_file://{file_id} 三种传法) |
品玩实测手绘地图转 3D 导览(图)、NASA NICER 训练视频转操作手册(视频) |
| 输出模态 | 仅文本 | 两份第三方实测的产物均为文本 / 代码,未见反例 |
| 媒资上限 | 视频 50 MB、图片 10 MB、请求体 64 MB;更大的视频走 Files API,Files API 视频上限 512 MB | 未见独立复现 |
| 输出速度 | 本模型未公布;M3 的官方标注为 "(output speed approximately 100+ tps)",即约 100+ tokens/s | 品玩 9/30 观察:MiniMax Code 内、max 档、1M 上下文下"稳定 100 tokens/s"(媒体观察值,非标准化压测) |
| 最大输出长度 | 未公布 | 无 |
| 每 token 价格 | 未公布(官方定价页 LLM 表也未列出该模型) | 无 |
| 订阅价格 | M Plan 常规月付价 Go $22 / Explore $55 / Build $132;10 月 14 日前首月 5 折(官方写明仅月付,年付不参与) | 无 |
| 参数量 / 权重 | 未公布 | 无 |
| 基准跑分 | 未公布(无厂商基准表、无模型卡) | 品玩 9/30 五项场景整体偏正面;AI产品狙击手 9/28 多项任务未通过、整体偏负面。两份结论相反,本文不据此下性能结论 |
本表出处:官方接口概览、官方 Models 页、官方 Anthropic SDK 文档、官方 M Plan 首月优惠页、品玩、AI产品狙击手。
正文
一、事件本体:一个"只写在文档里"的新模型
先说可核验的部分,不渲染"悄悄上线"这种说法。
- 它出现在官方 Models 页语言模型表第一行,排在 MiniMax-M3 之前,四个 Feature 标签齐全;
- 它同样出现在官方接口概览的 LLM 支持模型表里,上下文窗口标注 1,000,000;而同一张表里 M3 那一行多了一句 "(output speed approximately 100+ tps)",M3.1-Flash-Preview 这一行没有速度标注;
- 官方 Release Notes 模型页最近一条还是 2026 年 7 月 31 日的 MiniMax H3,往下翻没有 M3.1-Flash-Preview 的条目。
一个细节可以互相印证来源:源文记录它 9 月 27 日出现在文档里,品玩写的是"9 月 28 日,M3.1 Flash Preview 上线 MiniMax Code、MiniMax Token Plan"。两个日期不冲突,一个是文档挂表,一个是客户端与订阅上架。
这几条摆在一起,说明的是一个很实在的状态:能力已经在文档和客户端里可用了,但"发布"这件事本身还没走完。源文(9 月 28 日)当时的描述是"没出现在常规 release log 里""官方博客连正式页面都没有",我方复核时,Release Notes 仍未见该条目(出处:博客园 BehaviourBlogs 源文、3520.net)。
二、硬规格:1M 上下文 + 图文视频输入,输出只有文本

规格这块我逐条核到了官方原文,不依赖第三方转述:
- 上下文:1,000,000 token,和 MiniMax-M3 同一上限。官方接口概览有一句备注:最大 token 数指输入与输出之和。
- 模态:输入文本 / 图像 / 视频,输出只有文本。官方 Anthropic 兼容文档写明,M3.1-Flash-Preview 与 M3 支持 text、image、video、tool use、tool result、thinking 六类消息块;M2.7 及更早的 M2.x 只支持文本和工具调用,不支持图像、视频输入。
- 媒资上限(官方原文):URL 或 base64 传入时,视频最大 50 MB、图片最大 10 MB、请求体最大 64 MB;更大的视频走 Files API 上传后以
mm_file://{file_id}引用,Files API 视频上限 512 MB。 - 图片 token 换算(官方给的粗略参考):
detail=low通常几百 token、上限约 600;default常见 1k–3k、上限约 5k;high常见几千、上限约 15k+。想精确算就走POST /anthropic/v1/messages/count_tokens。
出处:官方 Models 页、官方接口概览、官方 Anthropic SDK 文档(中英双版内容一致,见中文版)。
官方没给的东西也要说清楚:最大输出长度、输出速度、参数量、每 token 价格、权重,全部未公布。M3 在官方模型表里有"约 100+ tokens/s"的标注,M3.1-Flash-Preview 这一格是空的。所以"更快、更轻量"目前只能算厂商定位口径,没有官方数据支撑。
三、真正的新闻点:这款模型目前不卖给按量付费用户
这一节是全文的重点。
官方那一句 "available only through M Plan and MiniMax Code for now" 的分量,要放在 MiniMax 自己的订阅体系里看。
第一层:它没有"高价位档位专属"的门槛。 官方 M Plan 页面的可用模型表里,Go、Explore、Build 三档的文本模型全部是 M3.1 Flash Preview。差别在别的模态和用量:视频模型 H3 不在 Go 档,Explore / Build 才有;用量相对 Go 分别是 3 倍(Explore)和 7.5 倍(Build)。也就是说,最便宜的 Go 档就能跑这款新模型(官方 M Plan overview)。

第二层:订阅制本身正在换代,而且这是源文来不及覆盖的增量。 源文写作时间是 9 月 28 日,当时官方口径是 Token Plan。9 月 29 日官方发布了《订阅套餐产品升级公告》,口径变成:
- M Plan 即将推出,将承接并拓展 Token Plan 的订阅能力,套餐订阅价格与文本使用额度保持不变;
- 部分档位可以使用包括 H3 在内的 MiniMax 全系列模型;
- Token Plan 停止新购;已订阅且开启自动续费的用户,现有套餐及权益保持不变,也可随时升级到 M Plan;
- 若主动取消自动续费或续费间断,则不再支持购买现有 Token Plan;
- 在 Token Plan 订阅周期内随时可升级,但升级后 Token Plan 的历史优惠和额外权益(如 ∞ 限额、150% 周额度)不再保留;
- 现有 Token Plan 套餐将持续支持后续发布的最新模型。
官方英文文档(models-intro / api-overview / text-anthropic-api / m-plan)已经全面改写为 "M Plan" 口径。换句话说,源文里"仅通过 Token Plan 和 MiniMax Code 提供"这句引用,已经被官方自己更新掉了。
第三层:钱和门槛的关系。 账号余额再多也调不动这个模型,得先有订阅席位。官方把 Key 分成两栏:按量付费走 "API Keys > Create new secret key",M Plan 走 "Billing > M Plan" 查看 Subscription Key;官方原文写明 "It is separate from pay-as-you-go API Keys",并且这个 Key 可以先于付费资源存在,等你有 M Plan 席位或 Credits 权限后才真的能用(官方 Prerequisites、官方接口概览)。
把三层合起来看,这个动作的性质是:厂商把一款前沿模型的定价权和分发权一起收进了自己的订阅闭环——截至目前,未见第三方平台转卖,也没有按 token 的横向比价,想用就得进门。
四、国庆七天:福利拆开看,"免费"的限定词比免费本身重要
官方公告确认的福利共三项,我按原文拆开(出处:官方公告):
| 福利 | 官方原文口径 | 关键限定 |
|---|---|---|
| "国庆七天畅蹬" | 10 月 1 日至 7 日,所有已订阅的用户在 MiniMax Code 内使用 M3.1-Flash-Preview 不限量 | 是"已订阅的用户",不是全体用户;场景限定在 MiniMax Code 客户端内 |
| 首月 5 折 | M Plan 上线起至 10 月 14 日,新订阅或升级为 M Plan 的用户首月立享 5 折,次月起按原价续订 | 官方 M Plan 优惠页写明仅月付,年付不参与;升级用户按新档首月价减去当前订阅剩余价值 |
| 老用户回馈 | 为感谢 Token Plan 用户,届时将为所有 Token Plan 用户发放一笔积分福利 | 公告未写金额与到账时间 |
关于"畅蹬"这两个字:它不是本文的笔误,而是官方公告小标题的原文用词("国庆七天畅蹬:"),本文照引并加引号,官方原文如此。
M Plan 三档的官方价格(常规月付价):Go $22、Explore $55、Build $132,活动期内首月 5 折(官方 M Plan 首月优惠页)。额度按两个窗口控制:非视频模型看 5 小时窗口 + 周窗口,视频模型只看周窗口,未用完的额度不结转(官方 M Plan 用量规则)。
额外转述项,请自行核实:9 月 28 日至 10 月 7 日登录 MiniMax Code 每日签到可领双倍积分、Token Plan 老用户额度被全员重置——这一组来自第三方转载(站长之家、3520.net,后者为薅羊毛类导航站,来源强度弱),我方本次未取到官方活动页原文,以客户端活动页实际展示为准。
五、怎么接:改 base_url 和模型名,三个坑先记住
官方推荐走 Anthropic 兼容端点,同一个 model id 可用在 Anthropic 兼容、OpenAI 兼容、OpenAI Responses 三个端点上,完整路由是 base_url 加 /v1/messages(官方 Anthropic SDK 文档、官方 Responses 端点文档)。
# 官方推荐的写法(国际站)
export ANTHROPIC_BASE_URL=https://api.minimax.io/anthropic
export ANTHROPIC_API_KEY=${YOUR_API_KEY}
域名这件事,本次已逐条核对,不留模糊地带:
- 国际站:官方英文文档给出的示例是
https://api.minimax.io/anthropic(英文前置准备、英文 Anthropic SDK 文档)。 - 中国大陆站:官方中文文档给出的示例是
https://api.minimax.cn/anthropic,前置准备页与 Anthropic SDK 页(含 curl 示例)两处写法一致(中文前置准备、中文 Anthropic SDK 文档)。源文写的api.minimaxi.com没有出现在官方文档的任何示例里;实测platform.minimaxi.com会重定向到platform.minimax.cn(中文文档页首给出的文档索引地址仍写作platform.minimaxi.com/docs/llms.txt,说明 minimaxi.com 这个域名仍在用,第三方页面也常拿它当国内站入口),但官方 API 示例统一写作api.minimax.cn。本文全篇以官方中文文档示例为准:中国大陆站用api.minimax.cn。 - 区域必须对上:Global 用 minimax.io、中国大陆用 minimax.cn,两边混用会认证失败。
- Claude Code 这类工具走
ANTHROPIC_AUTH_TOKEN+ANTHROPIC_BASE_URL。官方接入页给的示例里,四个模型位都指向MiniMax-M3.1-Flash-Preview[1m],并建议把CLAUDE_CODE_AUTO_COMPACT_WINDOW设为 524288(即 512K)(官方 Claude Code 接入)。
坑一:两套 Key 不能互换。 这是最容易踩的,尤其是手上已经有按量付费 Key 的人。按量付费 Key 认余额,Subscription Key 认订阅席位与 Credits,官方明确写 "separate from pay-as-you-go API Keys",用量规则页也强调不可互换使用。源文补充说前缀是 sk-cp-(订阅)与 sk-api-(按量),这一条我方未在官方页面核到前缀原文,请以控制台实际显示为准。
坑二:认证失败的错误码要对上号。 官方错误码表收录了 1004(not authorized)、2049(invalid API Key)和 2056(usage limit exceeded,提示等待下一个 5 小时窗口)。至于"区域搞错必定 401、对应 1004 或 2049"这个说法,源文那段属于实操复盘口径,不是官方文档的逐条映射,参考可以,别当文档。
坑三:Anthropic 兼容端点没有 /models 发现能力。 访问 .../anthropic/v1 会 404,模型名必须手写。别指望像 OpenAI 那边先 list 再挑(出处:源文,属实测复盘口径,暂未见官方文档说明)。
还有一条来自官方文档的实用细节:在多轮 function call 里,必须把完整的 assistant 响应(含 thinking / text / tool_use 全部块)原样追加回对话历史,thinking 块在后续轮次里不要改写(官方 Anthropic SDK 文档)。
我不写"零成本迁移"这种话——迁移的前提是你已经有订阅席位。纯按量付费的用户,这次就是够不着。
六、effort 五档,以及"思考关不掉"这条硬约束
这部分官方原文写得很直白(官方 Anthropic SDK 文档):
output_config.effort接受 low / medium / high / xhigh / max 五档,省略时默认 max——也就是不写就落在最重的一档;- 官方解释是"higher levels make the model think more thoroughly, producing more thinking tokens at higher latency";
none不支持,返回 400; - 思考无法关闭:
MiniMax-M3.1-Flash-Previewalways thinks。发thinking:{"type":"disabled"}返回 400(官方 Claude Code 接入页也有同一句提示:"always enables thinking and cannot turn it off")。官方给出的报错原文如下(照引,不做意译):
model "MiniMax-M3.1-Flash-Preview" requires adaptive thinking; thinking.type="disabled" (including reasoning.effort=none) is not allowed (2013)
注意官方报错文案里写的是 reasoning.effort=none,而正文参数名是 output_config.effort——这是官方自己的拼写,不是笔误转写。
顺带把对照组也列一下,方便你判断迁移成本:
| 模型 | 不传 thinking |
{"type":"adaptive"} |
{"type":"disabled"} |
|---|---|---|---|
| MiniMax-M3.1-Flash-Preview | 思考开启 | 思考开启 | 返回 400 |
| MiniMax-M3 | 思考关闭 | 思考开启 | 保持关闭 |
| M2.x 系列 | 思考开启 | 思考开启 | 接受但忽略,思考仍开启 |
这张表说的是 Anthropic 兼容端点的默认行为(原表出自官方 Anthropic SDK 文档)。换成 OpenAI 兼容口径,M3 省略 thinking 时默认是思考开启,{"type":"disabled"} 则是"跳过思考直接回答"(官方 OpenAI SDK 文档)——同一个模型名,不同兼容层的默认值不一样,迁移时值得留意。
值得摆出来的一个拧巴之处:源文称官方把这款模型定位为面向高吞吐、低延迟的任务——这一定位的官方原话,我方在官方英文文档里没有核到,此处按源文转述记录;但思考深度的默认值是最重的 max,且不允许关闭。想快,你必须主动往下调。最低档 low 到底有多快,官方没有任何数据——第三方那份"稳定 100 tokens/s"的观察值跑的是 max 档,不能拿来当 low 档的答案。
七、官方没给的东西,比给了的更扎眼
到本文发稿为止,M3.1-Flash-Preview 的留白清单是:没有厂商基准表、没有模型卡、没有 per-token 价格、没有公开权重。我核过官方定价页的 LLM 表,只列了 MiniMax-M3(≤512k 与 >512k 两档计费)和 M2.7 / M2.5 / M2.1 / M2,没有 M3.1-Flash-Preview 这一行。
作为对照,M3 在官方定价页上是:输入 $0.30 / 百万 token、输出 $1.20 / 百万 token、Prompt caching 读取 $0.06(≤512k 输入;>512k 输入则翻倍为 $0.60 / $2.40),另外 service_tier=priority 的价格是 standard 的 1.5 倍(出处:官方定价页)。
这件事的实际影响是:没有单价,成本就变成"订阅费 ÷ 用量"。用得多就便宜、用得少就贵,但它没法跟按量付费的单价直接横向比较。M Plan 三档也只给了相对 Go 的 3x / 7.5x 用量倍率,没给绝对值,追平 M3 单价的用量拐点官方没公布,你只能拿自己的真实流量跑一遍才知道。
还有一处口径差异,我已核到官方页面原文:Token Plan 概要页的覆盖范围脚注至今写的是"可用模型覆盖 MiniMax 全系模型(M3 / M2.7 / 图像 / 语音),少量特殊模型(MiniMax H3、音色设计、快速复刻等)暂不支持"——H3 都没列进去,更不用说 M3.1-Flash-Preview(Token Plan 概要页)。而模型页明确说这个模型走 M Plan。对要用的人来说这是实际风险:按脚注判断和按模型页判断,结论对不上。真要上生产,先在 Billing 里确认席位覆盖,再写代码。
最后提醒一句:网上有第三方转述提到稀疏注意力、Q8KV4、NVFP4、DSpark 投机解码之类的架构细节,均无官方口径背书,本文一律不引用。
八、留给你的那个问题
如果"订阅首发、不进按量付费开放列表"这条路跑得通——这次国庆七天不限量就是一次规模不小的压力测试和拉新实验——那按 token 计价的开放 API,还会不会是大模型发布的默认选项?
这个问题现在没有答案。但对你手上的技术选型来说,有一个已经确定的变量:模型的获取方式,正在从"充值即可用"变成"订阅即可用"。
出处与参考链接
- 源文:博客园 BehaviourBlogs《MiniMax M3.1-Flash-Preview 首发只给自家 Code 和 Token Plan:1M 上下文、五档 effort,思考还关不掉》(2026-09-28)
- MiniMax 官方 Models 页
- MiniMax 官方接口概览 / 中文版
- MiniMax 官方 Anthropic SDK 文档 / 中文版(base_url 为 api.minimax.cn)
- MiniMax 官方 OpenAI SDK 文档 / Responses 端点
- MiniMax 官方 Prerequisites(Key 分栏与 base_url) / 中文版
- MiniMax 官方 Claude Code 接入(ANTHROPIC_AUTH_TOKEN、[1m] 模型名)
- MiniMax 官方错误码表
- MiniMax 官方 M Plan overview / 用量规则 / 首月优惠
- MiniMax 官方《订阅套餐产品升级公告》(2026-09-29,福利三项与"国庆七天畅蹬"原文出处)
- MiniMax 官方 Token Plan 概要页
- MiniMax 官方定价页
- MiniMax 官方 Models 更新日志
- 品玩:MiniMax 杀进 Flash 混战,我拿五个项目试了试(2026-09-30,第三方上手实测,正面)
- AI产品狙击手:Minimax M3.1 Flash 测评!究竟有多不能打?(2026-09-28,第三方上手实测,负面;个人博客,非媒体正文页,来源强度一般)
- 3520.net(商娱导航网):《MiniMax M3.1 国庆免费敞用:官网连正式页都没有,敢不敢先试》(转述,薅羊毛类站点;标题中的"敞用"为该站原文用词,非官方表述;福利细节以客户端活动页为准)
- 站长之家:MiniMax 上线 M3.1-Flash-Preview 及签到双倍积分活动(转述)
说明:本文中厂商口径均照引官方文档并注明出处;标注为"源文实测口径""第三方转述/第三方实测"的内容未经我方独立复现;所有"官方未公布"均为核到发稿时的状态。第三方实测结论不一,本文不据此做性能结论。全篇外链均为官方文档/公告与第三方来源,无短链、无跟踪参数。

