Kimi K3杀入全球第一梯队,智谱的高估值还能撑住吗?

开柒07-17

话说,智谱近期市值一路飙升、令人咂舌,不过,现在但它最需要警惕的竞争对手,可能已经来了。

月之暗面最新发布的旗舰模型Kimi K3,拥有2.8万亿总参数和100万Token上下文,重点瞄准编程、知识工作和长程Agent。从目前的数据看,K3已经属于中国最顶尖的大模型之一。第三方Artificial Analysis给它的综合智能指数为57分,认为其能力与Claude Opus 4.8、GPT-5.5大致处于同一水平,但仍落后于Claude Fable 5和GPT-5.6 Sol,高于GLM5.2。

所以,K3还不能被称为全球最强,但这表明中国大模型距离顶尖又近了一步,也有机会从全球高端Coding市场中切走一部分份额。同时,它确实可能直接冲击智谱最看重的一块市场:高端Coding和Agent模型,有可能影响智谱整体的市场预期。

K3最硬的成绩,是前端开发全球第一

目前,K3最有说服力的外部成绩来自Arena的WebDev榜。

这个榜单不是月之暗面自己跑的测试,而是让用户匿名比较两个模型生成的网页,再通过大量投票计算排名。截至7月16日,WebDev Arena已经积累约48万次投票,K3以1679分暂列第一,超过了Claude Fable 5、GPT-5.6 Sol和GLM-5.2。 

这至少证明,K3在前端页面生成、视觉设计、交互效果和网页完成度方面非常强。不过,Arena测的是用户更喜欢哪个网页,不等于严格审查代码安全、后端工程或大型代码库维护,因此不能把“前端榜第一”直接扩大成“综合Coding全球第一”。

这两天,海外开发者讨论最多的也是K3的视觉Coding能力。有开发者在X上对比K3和GPT-5.6生成网页的效果后认为,两者在设计“taste”,也就是审美和设计品位上差别明显。K3的优势并不只是看懂图片,而是能根据图片和运行结果反复修改代码,把视觉理解、前端开发和Agent执行串成一个完整流程。

更客观地说,K3未必是纯视觉理解最强的模型,却可能已经是最会把视觉理解转化为网页和产品的模型之一。

K3挑战GLM-5.2

这不是因为GLM-5.2被公认为国产coding第一。

但K3和GLM-5.2的定位高度重合。两者都支持100万Token上下文,都强调大型代码库、长程软件工程、工具调用和Agent任务,也都在争夺企业开发者和Claude Code替代市场。智谱官方将GLM-5.2定位为面向长程Coding Agent和复杂自动化任务的旗舰开放模型。 

从月之暗面公布的成绩看,K3在多项Coding和Agent测试中高于GLM-5.2。不过,其中不少成绩仍是月之暗面自行运行的公开Benchmark,甚至包含明确的内部测试,尚未全部得到独立复核。

所以,八姐觉得,无论怎么说,K3已经拿出外部证据证明自己在前端Coding上领先,并开始挑战GLM-5.2在高端Coding和Agent市场上的领先地位。

K3更强,却也贵得多

值得注意的,K3没有延续国产模型极致低价的路线,甚至K3的价格比之前的K2也要高出两倍。它的价格明显高于GLM-5.2,但仍低于GPT和Claude的顶级旗舰。

顶级模型API价格对比

单位:美元/每100万Token

模型

普通输入

缓存输入

输出

GLM-5.2

1.40

0.26

4.40

Kimi K3

3.00

0.30

15.00

Claude Opus 4.8

5.00

0.50

25.00

GPT-5.6 Sol

5.00

0.50

30.00

Claude Fable 5

10.00

1.00

50.00

K3普通输入价格约为GLM-5.2的2.1倍,输出价格则达到约3.4倍;但与GPT-5.6 Sol相比,K3普通输入便宜40%,输出便宜50%。K3因此不是国产低价模型,而是一款“能力向欧美旗舰靠拢、价格定在两者之间”的高端产品。GLM-5.2的官方API价格为输入1.4美元、缓存输入0.26美元、输出4.4美元。  K3在Arena及第三方平台显示的价格为输入3美元、缓存输入0.3美元、输出15美元。 

K3和GLM-5.2直接对比

项目

GLM-5.2

Kimi K3

K3贵多少

普通输入

1.40美元

3.00美元

约2.1倍

缓存输入

0.26美元

0.30美元

约15%

输出

4.40美元

15.00美元

约3.4倍

月之暗面称,K3在Coding场景中的缓存命中率可以超过90%,大量重复读取的代码库、工具定义和历史上下文可以按0.3美元的缓存价格计费。这会显著降低输入成本,但不能把K3的总费用直接算成接近GLM,因为智谱同样支持缓存,只是没有公开可直接比较的平均命中率;而且缓存无法降低K3高得多的输出价格。

因此,八姐觉得,对调用规模大、预算敏感的开发者来说,只要GLM-5.2已经能够完成任务,它依然可能是更划算的选择。K3要证明自己的高价合理,关键不是跑分高一点,而是能否用更少的轮次、更高的一次成功率完成同样的工作。

K3会影响智谱股价吗?

智谱近期股价大幅上涨,自上市以来累计涨幅超过十倍,市值超过7000亿港元;此前高点时市值一度超过1万亿港元。 市场愿意给智谱这么高的估值,除了收入和融资能力,也包含对GLM技术领先地位的期待。

其实,K3不会因为发布一款模型,就立即抢走智谱的大量收入。GLM-5.2价格更低,智谱已有企业客户、开发者生态和Coding Plan,这些都是真实优势。

但高估值公司最怕的,往往不是竞争对手今天抢走多少客户,而是市场开始重新评估它还能否长期领先。如果以后更多第三方测试和真实开发者使用结果证明,K3在综合Coding、视觉Agent和长程任务上持续领先GLM-5.2,那么智谱面临的首先不是业绩崩塌,而是技术领先溢价被削弱

总之啊,八姐觉得,K3而是直接挑战智谱在高端Coding和Agent市场上最值钱的领先标签。

不过当然,K3真正影响的,也未必只有智谱。虽然从目前能力来看,K3虽然整体仍略落后于Claude Fable 5和GPT-5.6 Sol,但已经进入全球第一梯队,而且价格明显低于这两款旗舰模型。对于不少企业开发者来说,如果K3能够完成八九成的工作,却只需要一半左右的成本,那么它完全有机会分流一部分原本属于GPT和Claude高端Coding模型的调用需求。

事实上,这也是《金融时报》和《The Decoder》等海外媒体关注K3的重要原因。它们认为,K3最大的意义,并不是简单地证明中国又多了一款强模型,而是意味着中国公司开始尝试在高端模型上竞争,而不是继续依赖”低价换市场”。

免责声明:本文观点仅代表作者个人观点,不构成本平台的投资建议,本平台不对文章信息准确性、完整性和及时性做出任何保证,亦不对因使用或信赖文章信息引发的任何损失承担责任。

精彩评论

我们需要你的真知灼见来填补这片空白
发表看法