1. Kimi K3连登双榜追平闭源
本周Kimi K3先后登顶Frontend Code Arena和写作基准。歸藏测评显示K3在复杂前端和开发任务中与Opus 4.8互有胜负,称其为较小的DeepSeek时刻。Amjad Masad注意到蒸馏模型甚至超越教师模型。Gary Marcus指出前沿实验室的定价护城河已经崩塌,现在用远低于前沿价位的成本就能获得接近前沿的智能。Thomas Wolf强调K3的内部评估比公开基准更有意义。开源模型在代码和写作两个维度同时逼近闭源前沿,定价差距也在快速收窄。
- 2026-07-16:K3被提及具备Fable 5级别能力,引发社区关注(歸藏(guizang.ai)(@op7418) / Justine Moore(@venturetwins) / Gary Marcus(@GaryMarcus))
- 2026-07-17:K3登顶Frontend Code Arena,与Opus 4.8互有胜负,定价壁垒讨论升温(Amjad Masad(@amasad) / 歸藏(guizang.ai)(@op7418) / Gary Marcus(@GaryMarcus) / Thomas Wolf(@Thom_Wolf))