中国のZ.AI、DeepSeekに匹敵するステルスモデル「Ox Alpha」を公開へ

Z.ai confirms Ox Alpha is a new GLM-series model and will release its weights

中国のZ.AI、DeepSeekに匹敵するステルスモデル「Ox Alpha」を公開へ

中国のAI企業Z.AI(Zhipu)が、オンライン利用ランキングでトップに躍り出た高性能・無料の新モデル「Ox Alpha」が、GLMシリーズの新バージョンであることを認め、本日夜にウェイトを公開すると発表した。Bloombergの取材に対し、同社が確認した。

同社は水曜日、Ox AlphaがGLMシリーズの新モデルであるという憶測を認め、本日夜にウェイトを公開すると述べた。
  1. ricardobeat

    Ox AlphaをOpenRouterとOpenCode Zen経由で、コーディングタスクに数日間ノンストップで使ってみた。クラッシャーなハーネスだ。SonnetとOpusの間くらいのレベルでタスクを完了できた。ミスは少ないが、それほど賢いわけではない。

    私にとっての主な問題は、何度かドゥームループに陥ったことだ。そのうちの一つは、同じbashコマンドを約千回実行していた。この問題があった最後のモデルはMimo 2.5で、今となってはかなり古い。その結果、放置しておくことはできず、エージェントには使えない。

  2. _pdp_

    Ox Alphaはこの5日間、さまざまな実験で自動操縦で動いている。

    非常に印象的なモデルだ。

    いくつか例を挙げる。オープンソースで文書化されており、データはHFデータセットで入手できる:

    https://openzot.github.io/whetstone/ - https://github.com/openzot/whetstone

    https://openzot.github.io/arcade/ - https://github.com/openzot/arcade

    https://openzot.github.io/machinery/ - https://github.com/openzot/machinery

  3. giamma

    https://unwall.app/www.bloomberg.com/news/articles/2026-08-2...

  4. WithinReason

    矛盾するシグナルだ。ここではGPT-5.4 Nano以下だ:

    https://livebench.ai/

    一方、ここではFableを大幅に上回っている:

    https://oxalpha.com/

    しかし後者が本当なら、人々はそれをFableから「蒸留」されたと言い続けるのだろうか?

  5. esskay

    公開テスト中に何が起こっていたのか知りたい。テストの初期に依頼されたタスクで、後半に比べてかなり改善されたという報告が多数あったからだ。

  6. freakynit

    このプロジェクトのJavaバインディングを一発で生成した:https://github.com/jeffhajewski/latticedb

    関連PR:https://github.com/jeffhajewski/latticedb/pull/5

    セッションでは約100Kの入力トークン、約60Kの出力トークン、約80Kの思考トークンを使用した。

    gpt-sol-mediumでレビューしたが、その作業に満足しているようだ。

  7. RataNova

    かなりきれいなコードを書き、コンテキストも適切に保持するが、パイプラインを含む複雑なbashスクリプトになるとつまずき、筋を見失い始める。重みが公開されて、内部を調べて何が起こっているのか見られるのを待っている。

  8. harlan_pdx

    重みを公開するのは正しい動きだ。オープンな面でDeepSeekと競争力を保てる。

この日のほかの記事

2026-08-26