Aleph Alpha Kolibri - Sovereign German LLM with 78B Parameters
Show HN: Germany's new sovereign AI model Kolibri

Aleph Alpha Kolibri ist ein offenes Sprachmodell für Deutsch und Englisch, das als Mixture-of-Experts mit 78 Milliarden Parametern nur 3,5 Milliarden pro Token aktiviert. Es wurde von Grund auf in Deutschland und Finnland trainiert, unterliegt der Apache 2.0-Lizenz und ist auf Hugging Face verfügbar. Mit 262.144 Token Kontext, vier Reasoning-Stufen und Tool-Calling eignet es sich für souveräne Anwendungen in Behörden und Unternehmen, die Datenhoheit und IP-Sicherheit benötigen. Kolibri denkt auf Deutsch, sagt „Ich weiß es nicht“ statt zu halluzinieren und läuft auf eigener Infrastruktur.
Kolibri ist eine ziemlich direkte Antwort darauf: Ein deutsches Team hat es mit dem EU AI Act von Grund auf im Sinn gebaut, und in Aleph Alphas eigener Bewertung schneidet es in beiden Sprachen besser ab als jedes verglichene Modell seiner Größe.
- miellaby
Das Paper erklärt wirklich alles, als wäre es ein Tutorial „how to made your own modern agentic LLM“. Sie erzählen sogar, wie sie ihren Datensatz erstellt haben. https://aleph-alpha.com/downloads/tech-report.pdf ; Es ist das erste Mal, dass ich so ein Maß an Offenheit sehe.
- tomComb
Bei einem Post, der so ein großes Ding aus Souveränität macht, ist es etwas irreführend, nicht zu erwähnen, dass das Unternehmen mit Cohere, einem kanadischen Unternehmen, fusionieren soll.
Und das ist eine gute Sache – kein Grund, es zu verheimlichen. Angesichts der steigenden Kosten, mitzuhalten, müssen diese wenigen nicht-US-amerikanischen, nicht-chinesischen Unternehmen wirklich mehr Aufwand und Kosten teilen.
Auch Kanada braucht dringend souveräne KI-Optionen, aber das allein zu finanzieren wäre ziemlich sicher Geldverschwendung. Würde mich freuen, wenn dieses neue deutsch-kanadische Unternehmen auch mit Mistral zusammenarbeiten würde, oder vielleicht mit einem der koreanischen KI-Unternehmen.
- niemandhier
Ich denke, im Moment ist das Wichtigste, worin ein souveränes KI-Modell gut sein muss, die Ergebnisse anderer Modelle zu auditieren.
Im Moment könnte man für die meisten Regierungsanwendungen ein offenes Modell laufen lassen, und es wäre gut genug, man kann diesen Dingern nur einfach nicht trauen.
Also würde ein souverän kontrolliertes Modell, das das erste auditiert, im Grunde wie ein „Trust-Adapter“ wirken.
Wenn das zweite Modell günstig und schnell genug ist, gibt es ein Geschäftsmodell.
Man muss nicht einmal alle Zwischenschritte auditieren, nur Tool Calls und Endergebnisse.
- spijdar
Das Fehlen jeglichen Vergleichs mit Qwen3.8 Flash, einem weiteren MoE-Modell mit einer eher kleinen (6B) Anzahl aktiver Parameter, ist ziemlich auffällig. Stattdessen wird es mit Qwen3-Next 80B-A3B verglichen, einem Modell, das vor fast einem ganzen Jahr veröffentlicht wurde.
Ich verstehe, dass das den eigentlichen „Punkt“ des Modells nicht entkräftet, aber...
- 9dev
Aleph Alpha ist inzwischen nur noch ein trauriger Witz. Das Talent ist nicht mehr da, sie haben es nie geschafft, zu den anderen Labs aufzuschließen, haben bei mehreren Projekten nicht geliefert, und inzwischen sind sie nur noch ein Cash Grab für die Investoren.
- Lucasoato
> 4. It thinks in German
Das bedeutet, dass es immer pünktlich ist, für alles Akronyme benutzt und, wenn eine Entscheidung getroffen werden muss, einen Ausschuss einrichtet.
- driverdan
IMO ist die Ankündigung besser https://aleph-alpha.com/en/blog/kolibri-has-landed-a-soverei...
- martianvoid
Ich habe gerade versucht, auf meinem RTX pro 6000 Setup damit herumzuspielen, es verbraucht viel zu viele Tokens mit Überdenken von Zeug, selbst wenn es in der Lage ist, den richtigen Ansatz zu finden
Die Geschwindigkeit ist andererseits ziemlich gut, mit nur 3B aktiven Parametern bekomme ich etwa 170 tkn/s auf fp8