← 返回博客文章

硅基斥候S01

Kimi K3 发布:2.8 万亿参数,价格更猛!

硅基斥候S01

围绕 Kimi K3 的参数规模、定价与产品定位,观察大模型竞争从能力扩张走向成本效率。

Kimi K3 发布:2.8 万亿参数,价格更猛!

Kimi K3 来了:2.8 万亿参数之后,我真没想到它竟然涨价了

Kimi K3 正式上线。

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 1

我把官方文档、X、小红书和开发者社区翻了一遍。第一感觉是,这个模型确实有野心;第二感觉更直接:它很贵。

2.8 万亿参数、100 万 token 上下文、原生视觉、长程编程、Agent、端到端知识工作,这些都很容易变成发布时的大字报。

但我更在意另一件事:在 DeepSeek、Mimo、MINIMAX 陆续降价的趋势下,Kimi 这次定价“逆势上扬“,看起来对自己的模型能力非常有自信。

比 K2.7 大 2.8 倍

K3 有 2.8 万亿总参数,基于 Kimi Delta Attention 和 Attention Residuals 两项技术构建。其中前者是一种混合线性注意力机制。它原生支持视觉理解,上下文窗口达到 1M tokens。(参数量是 K2.7 的 2.8 倍,K2.7 是 256K 上下文,1万亿参数)

它始终开启思考模式,目前推理力度只有 max 一档。官方给它的定位也很明确:长程编程、端到端知识工作和深度推理。

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 2

这套配置看上去很猛。不过:

官方还没有放出完整模型卡、技术报告和正式 benchmark。社交平台上已经有人把它叫作“最大开源模型”,可截至我查稿时,官方并未给出 K3 的权重下载地址和开源许可证,说27号全面开源。

但是跑分已经秒了 Opus4.8 了(国内模型跑分跟津巴布韦币一样没有信用了,我的评价是还得再看看)

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 3

我更意外的是,Kimi 这次真敢收钱

K3 国内 API 的价格是:缓存命中 2 .1元、缓存未命中 21 元、输出 105 元,全部按每 100 万 tokens 计算。

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 4

作为对比,K2.6 国内站的对应价格是 1.1 元、6.5 元和 27 元。也就是说,K3 的未命中输入价约为 K2.6 的 3.1 倍,输出价约为 3.7 倍。

国际站另有一套美元价格:缓存命中 0.3 美元、未命中 3 美元、输出 15 美元,同样按每 100 万 tokens 计费,且未包含当地税费。

这里的 100 万 tokens 是计价单位,不代表每次调用都会花掉这么多。但缓存命中和未命中的输入价格相差十倍,输出价格又明显更高,这会直接改变开发者的使用方式。

如果任务能反复复用稳定的长前缀,缓存可以省下不少钱。可要是上下文不停变化,模型又长时间思考,真正该看的就是一项完整任务花了多少钱,而不是官网表格里最便宜的那一格。

我看到的反馈,叫好和嫌贵同时出现了

X 上最早一批演示,亮点集中在前端、3D 游戏、视觉设计和 Agent。

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 5

有开发者用相同需求比较 K3 与 GPT-5.6 Sol,认为两者都完成了任务,但 K3 的视觉实现更有创造性。小红书上也有人让 20 个 Agent 并行工作,称整个过程平稳、速度很快。

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 6

这些反馈确实让我想继续看。

但另一边也很真实。

一位小红书用户称,K3 做对了一道他长期用来测试模型的高考数学题,可模型思考了约 40 分钟。Linux.do 上一篇较完整的早期评测,也肯定了它的前端审美和 Agent 能力,同时提到千秒级思考并不少见。(好像不少人都反应有点慢)

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 7

更直接的争议还是价格。在我查到的 X 和中文开发者社区帖子里,不少人的第一反应不是“终于可以替代 Claude”,而是“这个价格到底谁用得起”。也有人质疑官方 benchmark 尚未公布,发布前的宣传和匿名模型演示跑得太快。

我觉得这种分裂很正常。一个模型完全可能既有惊艳的任务表现,又慢、又贵。几张生成页面和几个数学题,还不足以替所有生产场景下结论。

我的判断:K3 想改变大家对国产模型的价格预期

至少在这次发布里,Kimi 没有把自己放在“便宜替代品”的位置上。

它给出的是一套前沿模型式的产品叙事:超大参数、百万上下文、最大力度推理、长程 Agent,再配上一套显著高于自家上一代的 API 价格。

这是一种很有意思的变化,在我看来其实是好事,只要你真的比 Opus4.8 强,那我是愿意掏这个钱的。

过去大家评价国产模型,经常先问“比海外模型便宜多少”。K3 这次似乎想让市场换一个问题:如果能力真的进入第一梯队,你愿不愿意按第一梯队的价格付钱?

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 8

但价格可以先对标,能力还得逐项验证。

我接下来最想看到三个答案:真实代码仓库里的长程任务成功率有多高;把思考、重试和修正全部算进去后,单项任务成本是多少;官方什么时候公布模型卡、benchmark 和权重计划。

如果你正准备把 K3 接进产品,可以试试。

找一个最接近真实工作的任务,同时记录成功率、人工修复时间、总耗时和最终账单。K3 如果能在这四项上赢,100 元的输出价格也可能值得;如果赢不了,2.8 万亿只是一个很醒目的数字。


以上就是这次的侦察。

如果对你有用,顺手点个赞 +「♥️」。

想第一时间收到前线情报,关注「硅基斥候S01」。我们,下次侦察见。

Kimi K3 发布:2.8 万亿参数,价格更猛!配图 9