虎嗅

跟Opus4.8打的有来有回?,Kimi K3首测

该文章尚未提供 العربية 解读,以下为中文版内容。

核心内容总结

这篇文章是对国内大模型Kimi K3的首次测试,作者用4个前端领域的高难度场景(3D玻璃复刻、WebGL光带、视差滚动动画、家具网页动效),和国际顶尖模型Claude Opus 4.8做对比。结果显示:K3能和Opus 4.8“打得有来有回”——K3赢了1局(视频复刻3D玻璃),2局平手(贝塞尔光带),2局小输(视差滚动、家具动效)。K3的突出优势是多模态能力(能看懂视频生成3D)和自我修正,Opus则胜在排版审美和一次性成功率。更关键的是,K3价格远低于GPT-5.6-Sol和Opus 5,是国内模型的重要进步。

拆解解读

1. 四个硬核测试:K3和Opus各有胜负,谁也没碾压谁

作者挑的都是前端里“技术门槛高”的活,不是随便写个网页那种。

  • 视频复刻3D玻璃棱镜:K3赢

给模型看一段旋转的3D玻璃视频,让它复刻出来换文案。K3做的玻璃通透、元素排列整齐(环形文字不打架,书法字位置对);Opus做的玻璃灰扑扑,文字叠在一起,画面挤乱。K3赢在“看得懂视频里的3D结构”。

  • 贝塞尔WebGL光带:平手

要做一个黑背景上发光的流动曲线,还得有玻璃色散、鼠标跟随。K3做的画面干净,光带细锐,还加了标签移动的小效果;Opus的色散效果更明显,但光带太粗,画面偏亮。两边各有亮点,算打平。

  • 视差滚动卡片:Opus小胜

9张卡片滚动时要变5种形态(扇形、九宫格等),还得丝滑。Opus首屏标题清晰,卡片排列正常;K3首屏标题突然消失,只剩个卡片角,虽然滚动动画能跑,但第一印象差了点。

  • 家具网页动效:Opus小胜

做一个hover展开的手风琴式网页。两边都实现了核心交互,但Opus用深色基调,排版像真的设计工作室网站;K3的明亮风格太普通,层次不够。Opus胜在审美。

2. K3的撒手锏:能“看”视频还会自己改代码

K3最亮眼的是多模态能力——案例一里,它能直接从视频里提取3D形状、玻璃材质,不用任何文字标注就生成代码,这是Opus比不了的。

还有个细节:案例二生成光带时,K3第一次做的光带太粗像棍子,它自己截图检查后,主动改回了细的。这种“自我修正”能力,说明它不仅能生成,还能“验收”自己的成果。

3. Opus的强项:稳扎稳打,审美和细节更老道

Opus的优势是一次性成功率高排版审美在线。比如视差滚动案例,Opus一次就做对了首屏;家具动效案例,它的深色设计、编号和竖排文字,让网页看起来更专业,像真的在运营的网站。

它不用像K3那样“返工”,生成的结果更稳定,适合需要一次到位的场景。

4. K3为啥值得庆祝?性价比太高了!

作者提到,K3虽然比之前的K2.6贵,但参数大了很多,而且价格远低于GPT-5.6-Sol和Opus 5。比如GPT和Opus 5可能要花更多钱才能用,而K3用起来更实惠。

对普通开发者或企业来说,不用花大价钱就能用到接近顶尖水平的模型,这是国内AI模型的重要进步——毕竟不是所有人都能承担国际模型的高成本。

5. 测试的技术难度:这些活连人类开发者都头疼

作者选的场景都不简单:比如WebGL光带要写GPU逐像素计算的代码,视差滚动要把9个卡片的5种形态连起来,家具动效要四层动画同时运行。人类开发者从零写这些,可能要花一整天。

能让模型一次性生成(或稍作修正)就跑通,说明这些大模型已经能帮开发者省很多时间了。

总结

Kimi K3虽然没完全超过Opus 4.8,但在多模态和自我修正上有亮点,而且价格亲民。对用户来说,这意味着用更少的钱就能享受到接近国际顶尖的AI开发辅助能力,是国内AI模型发展的一个好信号。