Ornith-1.5、自己スキャフォールディングから自己改善へ:397BモデルがClaude Opus 4.8に並ぶ

Ornith-1.5: From Self-Scaffolding to Self-Improvement

Ornith-1.5、自己スキャフォールディングから自己改善へ:397BモデルがClaude Opus 4.8に並ぶ

Ornith-1.5は、自己改善ループを拡張し、モデルがタスク提案、スキャフォールド生成、ソリューションのロールアウトを自ら行い、強化学習で継続的に学習する。397B MoE、35B MoE、9B denseの3スケールで提供され、Terminal-Bench 2.1で86.1、DeepSWEで56.0を達成し、Claude Opus 4.8に匹敵する。9B版はモバイル展開可能で、より大規模なモデルを凌駕する。

各トレーニングサイクルは3段階で進行する。環境やコードベース、タスクタイプに関する高レベルの指示、およびモデルの過去のタスク解決履歴へのアクセスが与えられると、システムはモデルがまだ解決していない、より難しいタスクを段階的に提案し、能力のギャップを露呈させ、トレーニングフロンティアを継続的に押し広げる。

この日のほかの記事

2026-08-19