Kimi K3要来了!
今天,有不少用户发现在Arena大模型竞技场上,出现了一个神秘模型,Kivine。据介绍,该模型来自moonshot实验室。
不出意外,这应该是月之暗面在测试Kimi K3。
随后,社交平台上关于Kimi K3模型的实测和讨论开始刷屏。
这一看,不得了。
这次很多实测用户竟然都将Kimi K3模型与Fable 5进行对比,并且宣称Kimi K3碾压所有开源模型。

甚至还有网友评价为这是另一个DeepSeek R1时刻,超越OpenAI目前的最强模型GPT-5.6。

究竟是不是言过其实,我们来看看具体实测表现。
细节控制与视觉生成
有网友对比了Kimi K3和GPT 5.6 Sol (extra high)生成的动画视频。
网友的评价是,GPT 5.6在光照效果和动画表现方面更出色,而K3则更加流畅。
在与Fable 5的对比中,K3展现出了极强的细节塑造力。
以“盆景生成”为例,测试者称,K3 通过设计出逼真且扭曲的树干以及层次分明的枝叶,完美塑造出了这座盆景的整体形态。这个设计完全符合了设计要求。
物理逻辑与3D建模
在游戏编码场景下,还有博主实测制作了一款类似马里奥赛车的小游戏,测试其碰撞效果等物理逻辑理解能力。
随后博主又测试了3D建模场景,改变光照和时间,考察建模中的人物行为逻辑及场景变化的即时反应。
该网友的评价是,很接近Fable 5。
不过综合多方实测反馈来看,K3目前的生成速度偏慢。甚至比GPT-5.6更慢。
网页制作与UI设计
在网页制作方面,从其他博主分享的视频内容来看,K3模型制作的网页交互效果和审美设计相比于前代K2.7模型有较大不同。
博主Jun Song也把Kimi K3和Opus 4.8放在arena平台对比测试。

营销还是实力?
而在今早,Kimi官方账号在社交平台发布一段视频,非常像是为K3发布的预热视频。

本条推文正好于美国东部时间3:33发布,且视频中“3”的画面一闪而过,充满暗示意味。
此前,在7月14日,Kimi API平台官网也曾短暂挂上了K3模型充值折扣活动界面,而后Kimi官方称是实习生弄错了,下架了该界面。

不怪网友都说Kimi的营销水平进步了。
先是前天“不小心”弄错了,泄露出K3的风声。
现在又在3:33放出视频,在竞技场上线新模型,实测视频满天飞,拉上GPT-5.6和Fable 5对标。
难道Kimi真的开窍了?
此外,据社交平台X上的其他爆料信息,Polymarket预测市场显示,K3本月发布的概率高达97%-98%。

爆料称,Kimi K3拥有100万token的上下文窗口及多种处理模式,其质量介于GPT-5.6与Anthropic Fable 5之间,在部分编码实测中,K3表现甚至优于Opus 4.8和GPT-5.5。
输出实测和数据测试已然刷屏,就看Kimi何时官宣了。







