NeuralOS
Modelos

Moonshot 的 Kimi K3:全球最大开放权重模型迈入"Fable 级"领域

Moonshot AI 发布了 Kimi K3,一款拥有 2.7 万亿参数的推理模型,Fortune 称其为当今可用的最大开放权重模型。凭借对代码的执着专注和几乎逼近西方顶尖水平的自研基准成绩,中国的开放前沿宣称能与 Anthropic 正面较量。

EN
Equipo NeuralOS
Radar de IA
Jul 16, 20265 min read
In short

Moonshot AI 发布了 Kimi K3,一款拥有 2.7 万亿参数的推理模型,Fortune 称其为当今可用的最大开放权重模型:专注代码,在 Moonshot 自家基准中可与 Fable 5 竞争,每百万输出 token 收费 15 美元(Fable 为 50 美元)。

多年来,AI 领域有一条不成文的规矩很简单:真正的巨型模型——那些能像资深工程师一样写代码的模型——都被锁在付费 API 背后,归加州少数几家实验室所有。所谓"开放"虽讨人喜欢,却总是落后一个台阶。这套等级秩序刚刚开始动摇。7 月 16 日,中国的 Moonshot AI 发布了 Kimi K3,一款被 Fortune 称为当今可用的最大开放权重模型的推理模型:2.7 万亿参数,且公开宣称专注于编写和维护真正的代码,而非玩具级的片段。

## 一个突破天花板的数字

要衡量这一跨越,直接对比最能说明问题:2.7 万亿参数让 K3 超越了 DeepSeek V4(1.6 万亿),后者是它在中国开放权重浪潮中的对手。"开放权重"意味着模型的权重——那颗训练好的大脑——被设计为可以下载并在自有基础设施上运行,无需依赖任何人的 API。此前,当有人说"最大的开放模型"时,指的往往是明显低于封闭实验室水平的东西。如今这个头衔由如此规模的模型摘得,一下子就把整个开放行业的标杆抬高了。

## 危险的承诺:"Fable 级"

Moonshot 毫不含糊。它宣称 K3 与 Anthropic 的 Fable 5——编程领域的前沿标杆——"具有竞争力",并称在自家基准测试中大幅超越了 Opus 4.8、GPT 5.6 Sol 和 GPT 5.5,稳居前三。此处该拉一下新闻的手刹:这些是自家数据,在 Moonshot 官方测试中测得,而 Fortune 并未公布详细架构,也没有独立排名予以佐证。近来的历史告诉我们,一个给自己批卷子的实验室往往能拿到好成绩。真正可验证且有冲击力的是另一回事:一款开放模型敢于把 Fable 拿来当作衡量的标尺,而分析师们原本预计中国要到明年年初才会达到那个水平。

## 价格,新闻的另一半

成本才是让巨头们不安的地方。K3 通过网页和 API 提供,每百万输出 token 收费 15 美元。做个对比:Fortune 报道称 Anthropic 的 Fable 在同一区间收费 50 美元,而在开放阵营,z.ai 的 GLM-5.2 收费 4.40 美元,DeepSeek V4 更低至 0.87 美元。K3 并非同类中最便宜的,但相比它宣称要与之抗衡的封闭前沿,它的价格只是零头。这套组合——创纪录的规模、对真实工程的专注(长会话、超大代码仓库、终端工具编排)以及权重的开放特性——恰恰是那杯侵蚀"拥有最好模型"这一优势的鸡尾酒,当第二好的模型是开放的、且价格仅为领先者的一小部分时更是如此。

## 对用 AI 搭建产品的人意味着什么

这里的教训不是"现在就换到 Kimi"。它更深刻:开放的前沿不再是一种安慰,而是真正的竞争,这让模型的选择变成一项架构决策,而非信仰问题。当这般体量的开放权重模型能够自托管时,那些你过去无法掌控的因素开始变得重要——数据主权、每 token 成本、延迟,以及无需重写产品就能更换供应商的自由。正因如此,我们在 NeuralOS 刻意采用 model-agnostic 的方式:编排聊天、智能体和自动化都不与单一实验室绑定,所以哪天 Kimi、Fable 或后来者再次抬高天花板,你换掉引擎而无需重造整辆车。真正的长期优势不是押中这个月的赢家模型,而是不依赖于任何一个。

Share
Ready to build?

Start building in
under 3 minutes

Join 4,200+ builders. No credit card. Build your first app with AI in minutes.