月之暗面的下一代旗舰,先以一串代号的形式露了面。
![]()
9 月 28 日,多名开发者注意到,月之暗面 API 平台的后台模型注册表里冒出了「kimi-k3-1」。这串标识不只在列表里躺着,还被接口探测命中,真的能调通。
![]()
图1、IT之家 9 月 28 日报道首段,佐证后台标识与接口探测
同一天晚上,Kimi 开放平台挂出了 K3.1 的模型预告,代号 K311111,写明支持 1M tokens 上下文窗口。再往前倒五天,9 月 23 日,爆料人 @MaxForAI 已经在 X 上贴出过「k3d1-agent」的内部标识,里面带着 Agent 模式的配置开关。
![]()
图2、报道转引的开放平台预告页,K3 111111 与同价定价都在图里
代号有了,标识有了,预告也上过平台。官方一句话没说。
代号指向的是旗舰位
预告页里那句描述写得很直接,K3.1 是 Kimi 迄今能力最强的旗舰模型。一串代号能掀起这么大动静,原因就在这,它占的是月之暗面产品线最上面那一格。
定价也跟着露了一角。预告页里 K3.1 与 K3 同价,输入 20 元,输出 100 元,缓存命中 2 元,都以每百万 tokens 计。模型还没官宣,这个数字更像是占位符。
代号带出来的规格,大半是继承
代号底下真正的看点是规格。我把 Kimi 开放平台的文档翻了一遍,翻出一个被多数报道略过的细节,曝光出来的两张王牌,现役 K3 就已经有了。
第一张是三档推理。推理强度文档的第一段写着,Kimi K3 始终进行推理,通过请求顶层 reasoning_effort 配置推理强度,字段支持 low / high / max 三档,默认 max。
图3、官方推理强度文档页首句,三档可调写的是现役 K3
字段说明表里,同一句话出现了第二遍。这不是泄露,是摆在文档里的现成能力。
![]()
图4、reasoning_effort 字段说明,默认档位是 max
第二张是百万上下文。定价页里 kimi-k3 的上下文窗口写的是 1,048,576 tokens,1024 的平方,K3 现在就是这个宽度。重要限制一节还给了个数,max_completion_tokens 默认 131072,最大能拉到 1048576,也就是说,输出上限和上下文窗口一样宽。
![]()
图5、K3 重要限制一节,输出上限可拉到 1048576
继承不等于没进步。泄露配置里剩下的三项才是新货:原生 Agent 智能体模式、Swarm 多智能体协作、外加搜索与批处理任务模式。
有开发者据此推测,推理强度分档对应的其实是不同的算力配置,选 Low 省钱,拉 Max 换质量,等于把一个模型单打独斗换成一群模型分工。
要提醒一句,这一段全部出自媒体对泄露配置的转述,官方没有确认过任何一个字,别当成已发布的功能来用。
账单上的那个旋钮
现役 K3 的价格摆在这儿,输出 100 元,输入缓存未命中 20 元,命中只要 2 元,都以每百万 tokens 计,差了 10 倍。
![]()
图6、Kimi K3 定价表,输出 100 元每百万 tokens
K3 始终思考,默认档位拉满 max,等于每一笔请求都按最重的档位计费。三档旋钮的价值不在能力,在账单,重活拉满,轻活降档,钱包上多了一个能自己拧的阀门。
曝光到发布,还隔着一次官宣
代号曝光和正式发布是两件事,中间隔着的是官方点头。
我 10 月 2 日上午查的模型列表,可用模型一栏只有 kimi-k3,两个 kimi-k2.7-code 变体,再加一个 kimi-k2.6,一共四个,没有 kimi-k3-1。
![]()
图7、Kimi 开放平台模型列表,暂无 kimi-k3-1
文档站也搜不到。定价页与 Agent 文档页,再到 llms.txt,整站翻了一遍,k3-1 和 K311111 全是零命中,最初那张预告页也早就撤下。
所以只能写预计。可用列表里出现这一行,才算真的发布。
代号已经摆上桌,旗舰的位置也写清楚了。
发布日期,官方没给。
在那之前,K3 手里的三档旋钮和百万窗口是现成的。想提前对齐 K3.1 的用法,现在就能在 K3 上跑一遍。