Kimi K3 模型配置与切换指南
Kimi K3-256k
Kimi Code 正式推出旗舰模型 Kimi K3,支持高达 1M 的上下文窗口,在编程、游戏及知识任务上表现卓越。文档详细对比了 Kimi K3、Kimi K2.7 Code 及其高速版 kimi-for-coding-highspeed 的性能差异。切换模型会导致上下文缓存失效,建议直接开启新会话以避免额外消耗。同时,针对 401 权限错误、HighSpeed 提速不明显等常见问题,文章提供了清晰的排查思路,并指导用户如何在 Kimi Code CLI、VS Code 插件及第三方工具中正确配置 Model ID 和上下文参数,以充分发挥模型能力。
切换模型会使现有的上下文缓存失效,因此建议开启新会话以避免产生额外的 Token 消耗并获得更佳体验。
HN 评论区
150- effnorwood
我让这东西跑起来所耗费的电量(LOE,以 kWh 计)相当可观,但用户对此印象深刻。Eliza 现在长出手了。
- wren6991
这看起来在功能上类似于 OpenAI 的策略:一旦上下文长度超过某个阈值(同样是 272k,即 2^18,也就是 256k),价格就会跳涨。
拥有大量活跃上下文会增加每个 token 的成本(每个输出 token 对应的浮点运算次数和读取的字节数),所以将这些成本转嫁给用户是合情合理的。我其实有点惊讶,他们竟然采用硬性截断而不是平滑的梯度来实施这一策略。
- xyzsparetimexyz
哇。所以 Kimi 突然对所有用户降价一半,直到他们的上下文达到 256k?这幅度太大了。
- hawtads
这应该只是 API 层面的改动吧?模型本身应该没变,我猜是这样。
- wxw
> k3-256k 现已可用。在 256k 上下文范围内,它提供的结果完全一致。k3 (1M) 消耗的配额大约是 k3-256k 的两倍。
- dgritsko
这应该不是量化版本吧?只是上下文变小了?
- try-working
我从未遇到过 256k 上下文的问题。如果升级到 1M 需要额外付费,我看不到有什么理由要升级。
- lukan
既然 Claude 是我第一次真正、彻底地用不了(TIL,尽管我不愿承认,见 https://status.claude.com/),我现在对其他能用的服务产生了兴趣。但是……当我点击价格页面时,看到的是“加入等待名单”。什么鬼?他们真的那么好吗?以至于完全被突如其来的请求震惊和压垮了?还是说这只是个营销噱头?或者是因为他们在中国,硬件资源根本不够?