Немцам надоели разговоры про «суверенный ИИ». Они выложили веса: 78 млрд параметров, Ap...
Немцам надоели разговоры про «суверенный ИИ». Они выложили веса: 78 млрд параметров, Apache 2.0, немецкий и английский. Но «на токен работают всего 3,46 млрд» не означает, что Kolibri поселится на домашней RTX. У MoE активна только часть модели, а весь набор весов всё равно тяжёлый: Aleph Alpha указывает примерно 78 ГБ для FP8 и минимум в виде двух A100 по 80 ГБ или одной H200/B200. Kolibri сделали для немецко- и англоязычных задач в компаниях и госструктурах: модель можно развернуть на контролируемой инфраструктуре, а не жить в окошке очередного чужого облака. Есть reasoning, tool calling и контекст до миллиона токенов; для нормальной работы компания рекомендует 256k. Самое полезное тут не рекорд в таблице. Веса и модельную карту уже выложили, так что европейская «суверенность» хотя бы начинается с того, что её можно скачать и потрогать. Правда, потрогать придётся на железе, которое не ставят рядом с чайником.