Moonshot Kimi 依托 Alibaba 的 2 万张 Nvidia 芯片
Moonshot built on 20k Nvidia chip cluster from Alibaba
中国 AI 新锐 Moonshot 与 Alibaba Group Holding Ltd. 达成算力协议,获得约 2 万张 Nvidia Corp. 芯片的使用权。这一合作凸显了中国在 AI 发展上对西方半导体技术的持续依赖。这些硬件构成了 Moonshot 运行 Kimi 模型的核心算力基础。就在本月,Moonshot 团队凭借开源模型 Kimi K3 惊艳全球,其性能在多项指标上已能与 OpenAI 和 Anthropic 的顶尖模型分庭抗礼。
HN 评论区
72- HarHarVeryFunny
如果属实,这挺有意思——Moonshot 仅用 2 万张 NVIDIA GPU 就能训练出约 3T 参数的 SOTA 模型,而像 Musk 这样的人(他公开承认是在蒸馏 OpenAI 的模型)却难以用海量算力(Colossus-1 拥有 10 万至 25 万张 GPU,Colossus-2 更是超过 50 万张)构建出有竞争力的 1T 模型(Grok 4.5)。
我想这至少部分反映了 Kimi 3 架构中的各种优化。
在最近泄露的 DeepSeek 投资者会议上,他们也提到只拥有一个 2 万张 GPU 的集群(不清楚是 NVIDIA 还是华为的)。
- a-priori
这在某种程度上证实了我的一个假设:AI 发展的下一阶段将转向更小(指模型规模和算力),因为更小意味着训练更具资本效率(在同等资本下允许更快的迭代和更多的迭代周期),支持更密集的推理(在同等算力硬件下提供更多推理),并允许更多的边缘推理应用。
目标将是开发具有更高效架构的更小模型,其性能与更大模型相当甚至更好。
- infecto
我的观点依然是:模型构建本身没有护城河。人们继续在大实验室之间流动。在 harness(模型封装/调用框架)的选择以及如何使用模型方面拥有良好的品味,价值巨大。中长期的赢家将是那些掌控算力的人。
- idoxer
- ycui7
K3 原生训练支持 mxfp4,如果他们拿不到 Blackwell 芯片,这就毫无意义。Hopper 不支持原生 4 位浮点运算。
要么他们拥有支持原生 4 位浮点运算的 Blackwell 芯片,要么他们使用了支持原生 mxfp4 的中国国产 NPU。
文章中的说法讲不通。