Z.ai открыла веса GLM-5.3 - теперь модель можно ставить в закрытый контур
Z.ai открыла веса GLM-5.3 - теперь модель можно ставить в закрытый контур Z.ai опубликовала веса полной GLM-5.3 - текстовой MoE-модели примерно на 743 млрд параметров при 39 млрд активных и с контекстом до 1 млн токенов. Это уже не вариант для рабочего ноутбука или борта БпЛА: штатный FP8-чекпойнт занимает около 893 ГБ, vLLM ориентируется минимум на узел с 8×H200, а полный миллионный контекст - на 8×B200. Для военной сферы реалистичное место такой модели - центральный сервер в закрытой сети, к которому подключены инженерные и аналитические рабочие места. Такой подход уже применяется: Армия США разворачивает собственную среду LLM для работы с CUI и на SIPRNET, а Пентагон в 2026 году заключил соглашения на размещение больших моделей непосредственно в сетях уровней IL6/IL7. Также, недавно враг начал чаще интегрировать к себе в системы. Прикладная ниша GLM-5.3 здесь довольно конкретная: проверка собственного ПО и прошивок, поиск дефектов и уязвимостей с последующей подготовкой исправлений, разбор журналов и конфигураций, сопровождение больших репозиториев, автоматизация испытаний и работа с массивами закрытой технической документации. Это не теоретический сценарий - DARPA AI Cyber Challenge уже показал, что системы на базе больших моделей способны автономно находить уязвимости в крупных кодовых базах и выпускать рабочие исправления. Но есть важное ограничение: публичных данных о применении именно GLM-5.3 военными пока нет. Её результаты по киберзащите - в основном испытания самого Z.ai, а открытые веса не делают китайскую модель автоматически доверенной. Для военного контура всё равно нужны проверка весов и программного стека, запрет самовольного выхода в сеть, жёсткие права на инструменты и проверка человеком. В контур непосредственного управления оружием такую систему ставить незачем - её нормальная роль сейчас именно инженерный и киберзащитный сервер, а не элемент контура поражения(но никто конечно же не мешает это сделать с интеграцией агентов в бора; точнее почти ничего). На фоне GLM-5.3-Flash разница в военном применении получается довольно понятной. Полная GLM-5.3 - 743 млрд параметров и 39 млрд активных - имеет смысл прежде всего как тяжёлый сервер для разработки и проверки собственного ПО, поиска уязвимостей, работы с большими репозиториями и длительных агентных задач. Flash - 321/18 млрд и около 306 ГиБ FP8-весов - заметно проще по инфраструктуре и при этом мультимодальна, то есть принимает текст, изображения и видео. Поэтому для технической разведки, разбора фото техники и маркировок, схем, документов, телеметрии и больших архивов Flash практически интереснее, а полная 5.3 - когда основной массив работы приходится на код и киберзащиту. Контекст у обеих до 1 млн токенов, но у Flash вычисления механизма внимания примерно в 3 раза ниже, а KV-кэш - в 4,4 раза меньше. Полезная Нагрузка