话说,智谱近期市值一路飙升、令人咂舌,不过,现在但它最需要警惕的竞争对手,可能已经来了。
月之暗面最新发布的旗舰模型Kimi K3,拥有2.8万亿总参数和100万Token上下文,重点瞄准编程、知识工作和长程Agent。从目前的数据看,K3已经属于中国最顶尖的大模型之一。第三方Artificial Analysis给它的综合智能指数为57分,认为其能力与Claude Opus 4.8、GPT-5.5大致处于同一水平,但仍落后于Claude Fable 5和GPT-5.6 Sol,高于GLM5.2。
所以,K3还不能被称为全球最强,但这表明中国大模型距离顶尖又近了一步,也有机会从全球高端Coding市场中切走一部分份额。同时,它确实可能直接冲击智谱最看重的一块市场:高端Coding和Agent模型,有可能影响智谱整体的市场预期。
K3最硬的成绩,是前端开发全球第一
目前,K3最有说服力的外部成绩来自Arena的WebDev榜。
这个榜单不是月之暗面自己跑的测试,而是让用户匿名比较两个模型生成的网页,再通过大量投票计算排名。截至7月16日,WebDev Arena已经积累约48万次投票,K3以1679分暂列第一,超过了Claude Fable 5、GPT-5.6 Sol和GLM-5.2。
这至少证明,K3在前端页面生成、视觉设计、交互效果和网页完成度方面非常强。不过,Arena测的是用户更喜欢哪个网页,不等于严格审查代码安全、后端工程或大型代码库维护,因此不能把“前端榜第一”直接扩大成“综合Coding全球第一”。
这两天,海外开发者讨论最多的也是K3的视觉Coding能力。有开发者在X上对比K3和GPT-5.6生成网页的效果后认为,两者在设计“taste”,也就是审美和设计品位上差别明显。K3的优势并不只是看懂图片,而是能根据图片和运行结果反复修改代码,把视觉理解、前端开发和Agent执行串成一个完整流程。
更客观地说,K3未必是纯视觉理解最强的模型,却可能已经是最会把视觉理解转化为网页和产品的模型之一。
K3挑战GLM-5.2
这不是因为GLM-5.2被公认为国产coding第一。
但K3和GLM-5.2的定位高度重合。两者都支持100万Token上下文,都强调大型代码库、长程软件工程、工具调用和Agent任务,也都在争夺企业开发者和Claude Code替代市场。智谱官方将GLM-5.2定位为面向长程Coding Agent和复杂自动化任务的旗舰开放模型。
从月之暗面公布的成绩看,K3在多项Coding和Agent测试中高于GLM-5.2。不过,其中不少成绩仍是月之暗面自行运行的公开Benchmark,甚至包含明确的内部测试,尚未全部得到独立复核。
所以,八姐觉得,无论怎么说,K3已经拿出外部证据证明自己在前端Coding上领先,并开始挑战GLM-5.2在高端Coding和Agent市场上的领先地位。
K3更强,却也贵得多
值得注意的,K3没有延续国产模型极致低价的路线,甚至K3的价格比之前的K2也要高出两倍。它的价格明显高于GLM-5.2,但仍低于GPT和Claude的顶级旗舰。
顶级模型API价格对比
单位:美元/每100万Token
模型 普通输入 缓存输入 输出 | |||
GLM-5.2 | 1.40 | 0.26 | 4.40 |
Kimi K3 | 3.00 | 0.30 | 15.00 |
Claude Opus 4.8 | 5.00 | 0.50 | 25.00 |
GPT-5.6 Sol | 5.00 | 0.50 | 30.00 |
Claude Fable 5 | 10.00 | 1.00 | 50.00 |
K3普通输入价格约为GLM-5.2的2.1倍,输出价格则达到约3.4倍;但与GPT-5.6 Sol相比,K3普通输入便宜40%,输出便宜50%。K3因此不是国产低价模型,而是一款“能力向欧美旗舰靠拢、价格定在两者之间”的高端产品。GLM-5.2的官方API价格为输入1.4美元、缓存输入0.26美元、输出4.4美元。 K3在Arena及第三方平台显示的价格为输入3美元、缓存输入0.3美元、输出15美元。
K3和GLM-5.2直接对比
项目 GLM-5.2 Kimi K3 K3贵多少 | |||
普通输入 | 1.40美元 | 3.00美元 | 约2.1倍 |
缓存输入 | 0.26美元 | 0.30美元 | 约15% |
输出 | 4.40美元 | 15.00美元 | 约3.4倍 |
月之暗面称,K3在Coding场景中的缓存命中率可以超过90%,大量重复读取的代码库、工具定义和历史上下文可以按0.3美元的缓存价格计费。这会显著降低输入成本,但不能把K3的总费用直接算成接近GLM,因为智谱同样支持缓存,只是没有公开可直接比较的平均命中率;而且缓存无法降低K3高得多的输出价格。
因此,八姐觉得,对调用规模大、预算敏感的开发者来说,只要GLM-5.2已经能够完成任务,它依然可能是更划算的选择。K3要证明自己的高价合理,关键不是跑分高一点,而是能否用更少的轮次、更高的一次成功率完成同样的工作。
K3会影响智谱股价吗?
智谱近期股价大幅上涨,自上市以来累计涨幅超过十倍,市值超过7000亿港元;此前高点时市值一度超过1万亿港元。 市场愿意给智谱这么高的估值,除了收入和融资能力,也包含对GLM技术领先地位的期待。
其实,K3不会因为发布一款模型,就立即抢走智谱的大量收入。GLM-5.2价格更低,智谱已有企业客户、开发者生态和Coding Plan,这些都是真实优势。
但高估值公司最怕的,往往不是竞争对手今天抢走多少客户,而是市场开始重新评估它还能否长期领先。如果以后更多第三方测试和真实开发者使用结果证明,K3在综合Coding、视觉Agent和长程任务上持续领先GLM-5.2,那么智谱面临的首先不是业绩崩塌,而是技术领先溢价被削弱。
总之啊,八姐觉得,K3而是直接挑战智谱在高端Coding和Agent市场上最值钱的领先标签。
不过当然,K3真正影响的,也未必只有智谱。虽然从目前能力来看,K3虽然整体仍略落后于Claude Fable 5和GPT-5.6 Sol,但已经进入全球第一梯队,而且价格明显低于这两款旗舰模型。对于不少企业开发者来说,如果K3能够完成八九成的工作,却只需要一半左右的成本,那么它完全有机会分流一部分原本属于GPT和Claude高端Coding模型的调用需求。
事实上,这也是《金融时报》和《The Decoder》等海外媒体关注K3的重要原因。它们认为,K3最大的意义,并不是简单地证明中国又多了一款强模型,而是意味着中国公司开始尝试在高端模型上竞争,而不是继续依赖”低价换市场”。
精彩评论