Нейро-Инсайдер: Слухи об ИИ, Новости про нейросети.
IT и технологии · 4 октября 2026 г.
Запуск Qwen3.8-27B на потребительском железе — 4 октября 2026 г. в 02:09:42.069
Запуск Qwen3.8-27B на потребительском железе Проведены тесты производительности модели Qwen3.8-27B на одной видеокарте RTX 4090 (24 ГБ VRAM). При использовании квантования EXL3 3 bpw и движка SGLang модель потребляет 22,9 ГБ памяти. Система демонстрирует скорость генерации до 135,4 токенов в секунду на коротких промптах и поддерживает работу с контекстным пулом объемом до 207 356 токенов. При глубоком контексте скорость составляет около 91–118 токенов в секунду в зависимости от типа задачи. ⚡ 📰 Подписаться на канал