Kolibri - Sovereign German LLM with 78B parameters

Show HN: Germany's new sovereign AI model Kolibri

Kolibri - Sovereign German LLM with 78B parameters

Kolibri — это открытая языковая модель от Aleph Alpha для немецкого и английского языков, сочетающая 78 миллиардов параметров с эффективностью: на каждый токен активируется лишь 3,5 миллиарда. Благодаря архитектуре смеси экспертов, специальному токенизатору для длинных немецких слов и обучению на инфраструктуре в Германии и Финляндии, Kolibri обеспечивает высокую производительность, контекст до 1 миллиона токенов и соблюдение европейских норм конфиденциальности. Модель доступна на Hugging Face под лицензией Apache 2.0.

Aleph Alpha называет Kolibri суверенной, и в их понимании это означает две вещи: команды построили модель в Германии, обучили её на инфраструктуре в Германии и Финляндии, в соответствии с европейским и немецким законодательством, без иностранного контроля. А клиенты получают полную свободу развёртывания и защиту интеллектуальной собственности, так что соответствие требованиям становится унаследованным свойством.
  1. miellaby

    В статье абсолютно всё объясняется так, будто это туториал «как сделать свою собственную современную агентную LLM». Они даже рассказывают, как создавали свой датасет. https://aleph-alpha.com/downloads/tech-report.pdf ; Впервые вижу такой уровень открытости.

  2. tomComb

    Для поста, который так раздувает тему суверенитета, немного вводит в заблуждение то, что не упоминается: компания, судя по всему, будет объединена с Cohere, канадской компанией.

    И это хорошо — нечего это скрывать. Учитывая растущую стоимость поддержания конкурентоспособности, этим немногим компаниям не из США и не из Китая действительно нужно больше делиться усилиями и затратами.

    Канаде тоже очень нужны суверенные AI-решения, но финансировать это в одиночку было бы практически пустой тратой денег. Хотелось бы увидеть, как эта новая немецко-канадская компания сотрудничает ещё и с Mistral, или, может быть, с одной из корейских AI-компаний.

  3. niemandhier

    Думаю, на данный момент главное, в чём должен быть хорош суверенный AI-модель, — это аудит результатов других моделей.

    Сейчас для большинства государственных задач можно запустить открытую модель, и её будет достаточно, просто ни одной из них нельзя доверять.

    Так что если суверенная контролируемая модель будет проверять первую, это по сути сработает как «адаптер доверия».

    Если вторая модель достаточно дешёвая и быстрая, то бизнес-модель есть.

    Даже не нужно проверять все промежуточные шаги, только вызовы инструментов и конечные результаты.

  4. spijdar

    Отсутствие любого сравнения с Qwen3.8 Flash, ещё одной MoE-моделью с небольшим (6B) числом активных параметров, довольно бросается в глаза. Вместо этого её сравнивают с Qwen3-Next 80B-A3B, моделью, выпущенной почти год назад.

    Понимаю, что это не отменяет реального «смысла» модели, но всё же...

  5. 9dev

    Aleph Alpha к настоящему моменту — просто грустная шутка. Талантов там больше нет, они так и не смогли догнать другие лаборатории, провалили несколько проектов, и теперь это просто способ выкачать деньги из инвесторов.

  6. Lucasoato

    > 4. Она думает по-немецки

    Это значит, что она всегда пунктуальна, использует аббревиатуры для всего, а когда нужно принять решение, создаёт комитет.

  7. driverdan

    ИМХО, анонс лучше https://aleph-alpha.com/en/blog/kolibri-has-landed-a-soverei...

  8. martianvoid

    Я только что попробовал поиграться с ней на своей конфигурации с RTX pro 6000 — она тратит слишком много токенов на переобдумывание всякого, даже если способна ухватить правильный подход.

    Зато скорость у неё довольно хорошая: всего с 3B активных параметров я получаю около 170 tkn/s на fp8.

Ещё за этот день

2026-10-03