Kolibri - Sovereign German LLM with 78B parameters
Show HN: Germany's new sovereign AI model Kolibri

Kolibri — это открытая языковая модель от Aleph Alpha для немецкого и английского языков, сочетающая 78 миллиардов параметров с эффективностью: на каждый токен активируется лишь 3,5 миллиарда. Благодаря архитектуре смеси экспертов, специальному токенизатору для длинных немецких слов и обучению на инфраструктуре в Германии и Финляндии, Kolibri обеспечивает высокую производительность, контекст до 1 миллиона токенов и соблюдение европейских норм конфиденциальности. Модель доступна на Hugging Face под лицензией Apache 2.0.
Aleph Alpha называет Kolibri суверенной, и в их понимании это означает две вещи: команды построили модель в Германии, обучили её на инфраструктуре в Германии и Финляндии, в соответствии с европейским и немецким законодательством, без иностранного контроля. А клиенты получают полную свободу развёртывания и защиту интеллектуальной собственности, так что соответствие требованиям становится унаследованным свойством.
- miellaby
В статье абсолютно всё объясняется так, будто это туториал «как сделать свою собственную современную агентную LLM». Они даже рассказывают, как создавали свой датасет. https://aleph-alpha.com/downloads/tech-report.pdf ; Впервые вижу такой уровень открытости.
- tomComb
Для поста, который так раздувает тему суверенитета, немного вводит в заблуждение то, что не упоминается: компания, судя по всему, будет объединена с Cohere, канадской компанией.
И это хорошо — нечего это скрывать. Учитывая растущую стоимость поддержания конкурентоспособности, этим немногим компаниям не из США и не из Китая действительно нужно больше делиться усилиями и затратами.
Канаде тоже очень нужны суверенные AI-решения, но финансировать это в одиночку было бы практически пустой тратой денег. Хотелось бы увидеть, как эта новая немецко-канадская компания сотрудничает ещё и с Mistral, или, может быть, с одной из корейских AI-компаний.
- niemandhier
Думаю, на данный момент главное, в чём должен быть хорош суверенный AI-модель, — это аудит результатов других моделей.
Сейчас для большинства государственных задач можно запустить открытую модель, и её будет достаточно, просто ни одной из них нельзя доверять.
Так что если суверенная контролируемая модель будет проверять первую, это по сути сработает как «адаптер доверия».
Если вторая модель достаточно дешёвая и быстрая, то бизнес-модель есть.
Даже не нужно проверять все промежуточные шаги, только вызовы инструментов и конечные результаты.
- spijdar
Отсутствие любого сравнения с Qwen3.8 Flash, ещё одной MoE-моделью с небольшим (6B) числом активных параметров, довольно бросается в глаза. Вместо этого её сравнивают с Qwen3-Next 80B-A3B, моделью, выпущенной почти год назад.
Понимаю, что это не отменяет реального «смысла» модели, но всё же...
- 9dev
Aleph Alpha к настоящему моменту — просто грустная шутка. Талантов там больше нет, они так и не смогли догнать другие лаборатории, провалили несколько проектов, и теперь это просто способ выкачать деньги из инвесторов.
- Lucasoato
> 4. Она думает по-немецки
Это значит, что она всегда пунктуальна, использует аббревиатуры для всего, а когда нужно принять решение, создаёт комитет.
- driverdan
ИМХО, анонс лучше https://aleph-alpha.com/en/blog/kolibri-has-landed-a-soverei...
- martianvoid
Я только что попробовал поиграться с ней на своей конфигурации с RTX pro 6000 — она тратит слишком много токенов на переобдумывание всякого, даже если способна ухватить правильный подход.
Зато скорость у неё довольно хорошая: всего с 3B активных параметров я получаю около 170 tkn/s на fp8.