MiniMax M3.1-Flash 预览上线:1M 上下文打进 Flash 档
MiniMax 9 月 27 日上线 M3.1-Flash 预览:1M 上下文、五档思考、原生多模态,仅限订阅与 MiniMax Code,暂无跑分与定价。

9 月 27 日,MiniMax 把新模型 M3.1-Flash-Preview 悄悄推上了线——没有发布会,没有跑分表,甚至没有按量计费的价格:想用它,只有 Token Plan 订阅和 MiniMax Code 两条路。国庆假期里,这颗预览模型在中文开发者社区先热了起来:公众号「小互AI」10 月 3 日发出全天实测,称其在 Flash 档里第一次接住了 Opus 5.5 带火的「用代码做视频」活计,一天高强度多任务只花掉周限额的 2%。
要点
- M3.1-Flash-Preview 于 2026-09-27 上线,仅通过 Token Plan 订阅和 MiniMax Code 提供,没有按量计费价、没有官方基准、没有开放权重。
- 官方指南给出的规格:1M token 上下文,思考分 low/medium/high/xhigh/max 五档且默认 max、不可关闭,文本/图片/视频输入,MoE 428B 总参数约 23B 激活,约 150 tokens/秒。
- 独立评测与第三方路由商确认发行方式与规格,但截至 10 月 3 日没有任何独立基准数据,「能打」的说法全部来自体验报告。
背景
这条产品线往上数是 M2 → M2.1 → M2.5 → M2.7,全部停在 204,800 token 上下文;今年发布的 M3 第一次把窗口推到 1M,官方定位「frontier multimodal coding model」,按量计费价为每百万输入 0.30 美元、输出 1.20 美元。M3.1-Flash 是这条线上第一个「Flash 档」命名——高速、低价档位的传统定位。
时间点踩在 Anthropic Opus 5.5 刮起的「代码做视频」浪潮上:前端与动态效果成了模型能力的展示橱窗,我们 9 月底收录过这波趋势的观察与实操手册。国产侧,GLM 5.3 的 Flash 档已经抢占了同样的生态位,M3.1-Flash 上线后的社区对比自然先落到这一对身上。
事实部分
官方指南(agent.minimax.io)与平台文档给出的可验证规格:
| 项目 | 规格 |
|---|---|
| 模型 ID | MiniMax-M3.1-Flash-Preview |
| 上下文窗口 | 1,000,000 token(输出上限 128K,来自 MiniMax Code 仓库的测试固件) |
| 思考档位 | low / medium / high / xhigh / max,默认 max,不可关闭 |
| 输入输出 | 文本、图片、视频输入;文本输出 |
| 架构 | MoE 428B 总参数、约 23B 激活,稀疏注意力,原生视觉编码器 |
| 速度 | 约 150 tokens/秒(官方口径,随负载浮动) |
| 可用性 | 仅 Token Plan 与 MiniMax Code;Anthropic 兼容与 OpenAI 兼容端点同一模型 ID |
| 缓存 | 支持提示缓存 |
几个缺口同样值得记录:截至 10 月 3 日,官方没有发布任何 benchmark,第三方模型索引里查不到它的条目;没有按量计费价格(M3 的 0.30/1.20 美元是现存最近似参照);没有开放权重;定价页脚注尚未把 M3.1-Flash 列入 Token Plan 覆盖清单,与模型页的说法暂不一致——这是两家第三方在 9 月 27 日当天各自指出的。
各方说法
「小互AI」10 月 3 日的全天实测是中文社区目前最细的体验报告(均为作者自述):15 秒动效简历视频的配乐由模型用纯 Python 合成节拍;140 秒六幕烟花秀跑了约两小时;乐高拼装动画里模型自己写了一套 OBB 加 SAT 的几何校验器解决零件「悬浮感」;一个可漫游 16 分钟、约 2.48 平方公里的虚拟世界耗时四小时。作者结论:Flash 档国产第一、好于 GLM 5.3 Flash——这是体验判断,不是基准结论。
第三方路由商 orcarouter 在上线当天点评发行方式本身就是新闻:最新模型捆进订阅而非按量计费,价格、跑分、权重三项全空白,让任何横向对比暂时失效。科技博客 ai-on-mac 的事实核查确认了 MiniMax Code 仓库里的 512K/1M 上下文与 128K 输出上限固件,同时提醒「测试固件不等于公开 API 保证」;TRAE 社区与 Linux DO 的同日现场报告(经其汇总)证实预览标签已对部分账号可见。
编辑判断
对开发者真正新鲜的看点在档位策略:1M 上下文、原生多模态和高档位思考第一次出现在 Flash 命名的档位上,且以订阅制发行——跑分至今缺席,比较无从谈起,这个发行方式本身就是现阶段全部的信息量。如果实际体验站得住,「旗舰探顶、Flash 落地」的节奏就又快了一拍;对按量计费的重度用户,暂时无价可用本身就是门槛。
诚实地说,目前所有「能打 Opus 5.5」的证据都是体验报告:单账号自述、无对照任务、无独立复测。把 2% 周限额、2.48 平方公里这些数字当作上限参考即可。还有一层结构性问题:思考不可关闭、默认 max 档,意味着每次调用的成本里有相当部分固定花在推理上——这解释了 MiniMax 为什么敢把它捆进订阅,也暗示按量计费若开放,定价不会便宜。值得盯的后续:官方基准与定价何时补齐——按 M2 系列的惯例,预览转正时大概率会有答案;以及 Token Plan 与按量计费双轨的分配策略,它决定这颗模型是订阅福利还是独立产品。
怎么试
持有 Token Plan 的账号打开 MiniMax Code 即可在模型列表选择;API 侧模型 ID 为 MiniMax-M3.1-Flash-Preview,Anthropic 兼容与 OpenAI 兼容端点均可直连。没有订阅的话,目前没有正式渠道——等官方把定价页脚注补上再说。