Aleph Alpha Kolibri - ドイツの主権AIオープンウェイトLLM
Show HN: Germany's new sovereign AI model Kolibri

Aleph Alpha Kolibriは、ドイツとフィンランドのインフラでゼロから訓練された、ドイツ語と英語に特化したオープンウェイトの大規模言語モデルです。78億のパラメータを持ちながら、Mixture of Experts(MoE)アーキテクチャによりトークンごとに約35億のパラメータのみを使用するため、効率的に動作します。Apache 2.0ライセンスで公開され、262,144トークンのコンテキストをネイティブにサポートし、最大1,048,576トークンまで拡張可能です。ドイツ語の長い複合語を効率的に処理する独自のトークナイザーや、ドイツ語での推論能力、不確実な場合に「わからない」と答える能力などが特徴です。EU AI Actを考慮して設計され、データ主権とコンプライアンスを重視する組織に適しています。
ドイツのチームがEU AI Actを念頭に置いて「ゼロから」構築し、Aleph Alpha自身の評価では、両言語で同サイズの比較モデルすべてを上回るスコアを記録しています。
HNでの議論
11- miellaby
この論文は、まるで「自分だけのモダンなエージェント型LLMの作り方」というチュートリアルであるかのように、すべてを徹底的に説明している。データセットをどう作ったかまで書いてある。https://aleph-alpha.com/downloads/tech-report.pdf ; これほどのオープンさは初めて見た。
- tomComb
主権をこれほど大々的に喧伝する投稿で、その会社がカナダのCohereと合併する予定であることに触れないのは、少し誤解を招く。
そしてそれは良いことだ――隠す必要はない。維持コストが増大する中、これら少数の非米国・非中国企業は、もっと努力とコストを共有する必要がある。
カナダもまた、主権的なAIの選択肢を非常に必要としているが、それを単独で資金提供するのはほとんど金の無駄だろう。この新しいドイツ・カナダ企業がMistralや、あるいは韓国のAI企業の一つと協力するのを見てみたい。
- niemandhier
現時点で主権的AIモデルに最も求められるのは、他のモデルの結果を監査する能力だと思う。
今すぐにでも、ほとんどの政府アプリケーション向けにオープンモデルを動かすことはできて、それで十分だろう。ただ、どれも信用できないだけだ。
そこで、主権的に管理されたモデルが最初のモデルを監査すれば、基本的に「信頼アダプター」として機能する。
2番目のモデルが安価で十分速ければ、ビジネスモデルが成り立つ。
中間ステップをすべて監査する必要すらなく、ツール呼び出しと最終結果だけでよい。
- spijdar
Qwen3.8 Flashという、アクティブパラメータ数がやや少ない(6B)別のMoEモデルとの比較が一切ないのは、かなり際立っている。その代わり、ほぼ丸一年前にリリースされたQwen3-Next 80B-A3Bと比較している。
それがモデルの本当の「要点」を無効にするわけではないのは分かるが……。
- 9dev
Aleph Alphaは今やただの悲しいジョークだ。才能はもうそこにはなく、他のラボに追いつくこともできず、いくつかのプロジェクトで成果を出せず、今では投資家のためのただの金儲けに過ぎない。
- Lucasoato
> 4. ドイツ語で考える
つまり、いつも時間に正確で、何にでも頭字語を使い、決定を下す必要があるときは委員会を設置するということだ。
- driverdan
個人的には、この発表の方が良い https://aleph-alpha.com/en/blog/kolibri-has-landed-a-soverei...
- martianvoid
RTX pro 6000の環境でちょっと遊んでみたところ、正しいアプローチを捉えることはできても、考えすぎにあまりにも多くのトークンを使う。
一方で速度はかなり良く、アクティブパラメータがわずか3Bで、fp8だと約170 tkn/s出ている。