Kimi K3 在 AA-Briefcase 中仅次于 Fable 5

Kimi K3: second only to Fable 5 on AA-Briefcase

Kimi K3 在 AA-Briefcase 中仅次于 Fable 5

Moonshot AI 最新推出的 Kimi K3 模型在 AA-Briefcase 智能体知识工作基准测试中表现亮眼,Elo 评分高达 1543,仅次于 Claude Fable 5。尽管其分析质量与 Fable 5 相当,但在演示质量上略显不足。更值得注意的是,Kimi K3 的运行成本极高,平均每个任务耗资 10.57 美元,耗时近一小时,远超 Opus 4.8 等竞品。这款拥有 2.8T 参数的模型虽然性能强劲,但高昂的 Token 消耗和推理时间使其在实际应用中面临成本挑战。

Kimi K3 在 AA-Briefcase 智能体知识工作基准测试中仅次于 Fable 5,但运行成本却高于 Opus 4.8,且每个任务平均耗时近一小时。

同日更多故事

2026-07-22