Ox Alpha:免费且匿名的推理模型
Stealth Model
OpenRouter 平台上线了一款名为 Ox Alpha 的神秘模型,由第三方匿名提供者开发。这款模型专为代码生成、长期智能体任务及复杂推理场景设计,支持高达 1M 的上下文窗口,且目前完全免费。它不仅能处理文本,还能理解图像和视频输入。尽管开发者身份成谜,但 Ox Alpha 已通过 Hermes Agent、Claude Code 等应用验证了其在生产环境中的表现。对于开发者而言,这是一个无需付费即可体验高性能推理能力的绝佳机会,所有交互数据均由提供者保留且不会用于训练。
Ox Alpha 是一款专为代码编写、持续智能体工作和生产负载而设计的推理模型。
HN 评论区
195- fedpost
这是中国模型。它不会回答任何关于天安门广场的问题,但会兴高采烈地给你各种电子战攻击的操作指令,而 Opus 和 Fable 会立刻拒绝这类请求。
顺便提个题外话,为什么 Fable 对涉及“Welch 方法”的问题反应这么奇怪?哪怕是非常简单的问题,它也经常直接拒答。CFAR 和 STFT 都没问题,但 Welch 方法似乎成了禁忌,真是离谱。
- walrus01
我强烈建议你尽快把所有专有数据和机密个人信息都喂给这个模型。能出什么错呢?!
就“可疑程度”而言,这相当于从某人的裤子里偷出来的免费牛排,只不过是从外部推理提供商那里搞来的。
- AnodicElegy
“提示词和生成结果由提供方保留,且不用于训练……”
既然这样,我很好奇模型提供方到底拿这些提示词/回复对做什么用。他们不可能无缘无故地免费提供一个没署自己名字的模型。
- hxii
它在生成 CSS 方面表现得一塌糊涂。我让它基于调色板,利用 `color-mix()` 完成亮色和暗色主题的剩余实现,结果它直接把我自己预先添加的所有代码都删了,换成了硬编码的十六进制颜色值。
- gadtfly
在处理较软性、较宽松或创意类任务时,这是一个极其出色的模型。至少在最近几天我还对 K3 的表现啧啧称奇的那些任务上,它已经超过了 K3。
视觉推理能力不算强(这并不意外)。
- minimaxir
这个模型速度快得可疑,且报告的输出 token 数量偏低(通过 OpenRouter 的 Chat 使用),这两点都不符合大型中国实验室模型的典型特征。很奇怪。
- alexandra_au
一直在做测试,看起来能力挺强,但知识面稍弱。它的 CoT(思维链)让我想起了 GLM,所以如果非要我猜的话,这几乎肯定是中国模型,而且很可能是某个中国开源权重模型的西方 RL 微调变体。
- dmos62
根据这里的评论判断,Ox Alpha 似乎将请求路由到了来自不同供应商的多个模型。这是一种让身份识别变得更难的策略吗?