代号K311111 曝光,月之暗面最新旗舰Kimi K3.1 预计近期发布

月之暗面的下一代旗舰,先以一串代号的形式露了面。

9 月 28 日,多名开发者注意到,月之暗面 API 平台的后台模型注册表里冒出了「kimi-k3-1」。这串标识不只在列表里躺着,还被接口探测命中,真的能调通。


图1、IT之家 9 月 28 日报道首段,佐证后台标识与接口探测

同一天晚上,Kimi 开放平台挂出了 K3.1 的模型预告,代号 K311111,写明支持 1M tokens 上下文窗口。再往前倒五天,9 月 23 日,爆料人 @MaxForAI 已经在 X 上贴出过「k3d1-agent」的内部标识,里面带着 Agent 模式的配置开关。


图2、报道转引的开放平台预告页,K3 111111 与同价定价都在图里

代号有了,标识有了,预告也上过平台。官方一句话没说。

代号指向的是旗舰位

预告页里那句描述写得很直接,K3.1 是 Kimi 迄今能力最强的旗舰模型。一串代号能掀起这么大动静,原因就在这,它占的是月之暗面产品线最上面那一格。

定价也跟着露了一角。预告页里 K3.1 与 K3 同价,输入 20 元,输出 100 元,缓存命中 2 元,都以每百万 tokens 计。模型还没官宣,这个数字更像是占位符。

代号带出来的规格,大半是继承

代号底下真正的看点是规格。我把 Kimi 开放平台的文档翻了一遍,翻出一个被多数报道略过的细节,曝光出来的两张王牌,现役 K3 就已经有了。

第一张是三档推理。推理强度文档的第一段写着,Kimi K3 始终进行推理,通过请求顶层 reasoning_effort 配置推理强度,字段支持 low / high / max 三档,默认 max。

图3、官方推理强度文档页首句,三档可调写的是现役 K3

字段说明表里,同一句话出现了第二遍。这不是泄露,是摆在文档里的现成能力。


图4、reasoning_effort 字段说明,默认档位是 max

第二张是百万上下文。定价页里 kimi-k3 的上下文窗口写的是 1,048,576 tokens,1024 的平方,K3 现在就是这个宽度。重要限制一节还给了个数,max_completion_tokens 默认 131072,最大能拉到 1048576,也就是说,输出上限和上下文窗口一样宽。


图5、K3 重要限制一节,输出上限可拉到 1048576

继承不等于没进步。泄露配置里剩下的三项才是新货:原生 Agent 智能体模式、Swarm 多智能体协作、外加搜索与批处理任务模式。

有开发者据此推测,推理强度分档对应的其实是不同的算力配置,选 Low 省钱,拉 Max 换质量,等于把一个模型单打独斗换成一群模型分工。

要提醒一句,这一段全部出自媒体对泄露配置的转述,官方没有确认过任何一个字,别当成已发布的功能来用。

账单上的那个旋钮

现役 K3 的价格摆在这儿,输出 100 元,输入缓存未命中 20 元,命中只要 2 元,都以每百万 tokens 计,差了 10 倍。


图6、Kimi K3 定价表,输出 100 元每百万 tokens

K3 始终思考,默认档位拉满 max,等于每一笔请求都按最重的档位计费。三档旋钮的价值不在能力,在账单,重活拉满,轻活降档,钱包上多了一个能自己拧的阀门。

曝光到发布,还隔着一次官宣

代号曝光和正式发布是两件事,中间隔着的是官方点头。

我 10 月 2 日上午查的模型列表,可用模型一栏只有 kimi-k3,两个 kimi-k2.7-code 变体,再加一个 kimi-k2.6,一共四个,没有 kimi-k3-1。


图7、Kimi 开放平台模型列表,暂无 kimi-k3-1

文档站也搜不到。定价页与 Agent 文档页,再到 llms.txt,整站翻了一遍,k3-1 和 K311111 全是零命中,最初那张预告页也早就撤下。

所以只能写预计。可用列表里出现这一行,才算真的发布。

代号已经摆上桌,旗舰的位置也写清楚了。

发布日期,官方没给。

在那之前,K3 手里的三档旋钮和百万窗口是现成的。想提前对齐 K3.1 的用法,现在就能在 K3 上跑一遍。