中国のZ.AI、DeepSeekに匹敵するステルスモデル「Ox Alpha」を公開へ
Z.ai confirms Ox Alpha is a new GLM-series model and will release its weights

中国のAI企業Z.AI(Zhipu)が、オンライン利用ランキングでトップに躍り出た高性能・無料の新モデル「Ox Alpha」が、GLMシリーズの新バージョンであることを認め、本日夜にウェイトを公開すると発表した。Bloombergの取材に対し、同社が確認した。
同社は水曜日、Ox AlphaがGLMシリーズの新モデルであるという憶測を認め、本日夜にウェイトを公開すると述べた。
HNでの議論
146- ricardobeat
Ox AlphaをOpenRouterとOpenCode Zen経由で、コーディングタスクに数日間ノンストップで使ってみた。クラッシャーなハーネスだ。SonnetとOpusの間くらいのレベルでタスクを完了できた。ミスは少ないが、それほど賢いわけではない。
私にとっての主な問題は、何度かドゥームループに陥ったことだ。そのうちの一つは、同じbashコマンドを約千回実行していた。この問題があった最後のモデルはMimo 2.5で、今となってはかなり古い。その結果、放置しておくことはできず、エージェントには使えない。
- _pdp_
Ox Alphaはこの5日間、さまざまな実験で自動操縦で動いている。
非常に印象的なモデルだ。
いくつか例を挙げる。オープンソースで文書化されており、データはHFデータセットで入手できる:
https://openzot.github.io/whetstone/ - https://github.com/openzot/whetstone
https://openzot.github.io/arcade/ - https://github.com/openzot/arcade
https://openzot.github.io/machinery/ - https://github.com/openzot/machinery
- giamma
https://unwall.app/www.bloomberg.com/news/articles/2026-08-2...
- WithinReason
矛盾するシグナルだ。ここではGPT-5.4 Nano以下だ:
一方、ここではFableを大幅に上回っている:
しかし後者が本当なら、人々はそれをFableから「蒸留」されたと言い続けるのだろうか?
- esskay
公開テスト中に何が起こっていたのか知りたい。テストの初期に依頼されたタスクで、後半に比べてかなり改善されたという報告が多数あったからだ。
- freakynit
このプロジェクトのJavaバインディングを一発で生成した:https://github.com/jeffhajewski/latticedb
関連PR:https://github.com/jeffhajewski/latticedb/pull/5
セッションでは約100Kの入力トークン、約60Kの出力トークン、約80Kの思考トークンを使用した。
gpt-sol-mediumでレビューしたが、その作業に満足しているようだ。
- RataNova
かなりきれいなコードを書き、コンテキストも適切に保持するが、パイプラインを含む複雑なbashスクリプトになるとつまずき、筋を見失い始める。重みが公開されて、内部を調べて何が起こっているのか見られるのを待っている。
- harlan_pdx
重みを公開するのは正しい動きだ。オープンな面でDeepSeekと競争力を保てる。