Kimi K3 单挑 Fable:组合拳才是 SoTA
Kimi K3 Is Competitive with Fable; Kimi K3 and Fable Is SoTA

我们实测了 Kimi K3 与 Fable 5 在约 1000 个智能体任务中的表现。结果显示,单纯对比两者,Kimi K3 作为开源模型在 SWE 等核心基准上已与 Fable 5 打成平手,但在终端安全与加密任务中甚至更胜一筹。更惊人的是,通过智能路由策略,两者结合能实现 93% 的准确率,同时成本比单独使用 Fable 低 50 倍。别再迷信单一模型了,未来的 SOTA 属于懂得根据任务动态调度 Kimi K3 和 Fable 的组合方案。
最好的 AI 不再出自单一实验室,而是多种模型的混合体。
HN 评论区
441- nxtfari
如果你自己没有真正跑过、测过这些模型,那它们全是刷榜出来的。不管它们在各项指标上离前沿模型有多近,一到真实任务场景就原形毕露,而且 token 效率糟糕透顶。Fireworks 有极强的动机在标题里这么吹,因为帮用户托管 K3 对他们来说是纯利润,这跟他们托管闭源模型时完全不同。
- acd
这个基准测试很可能也是服务自吹自擂。Fireworks 刚好有个 router 产品,用了这个 router 性能就会更好。
- JSR_FDED
DeepSeek 发布时,对美国股市造成了立竿见影且巨大的冲击。如今,中国模型几乎已与美国 SOTA 模型平起平坐且势头良好的事实已成共识,为什么市场情绪却没有变化?