Нейро-Инсайдер: Слухи об ИИ, Новости про нейросети.
IT и технологии · 4 октября 2026 г.
Тесты Qwen3.8-Flash-Next с использованием SSD — 4 октября 2026 г. в 04:02:20.913
Тесты Qwen3.8-Flash-Next с использованием SSD Модель Qwen3.8-Flash-Next использует n-gram память в формате гигантской таблицы поиска объемом 102 ГБ. Система считывает с диска только минимально необходимые фрагменты данных для генерации каждого токена. Архитектура позволяет распределять нагрузку: VRAM используется для «горячих» экспертов, оперативная память — для остальных, а NVMe-накопитель — для хранения разреженной памяти поиска. В ходе тестов конфигурация с весами на SSD обеспечила скорость декодирования около 35 токенов в секунду при контексте в 230 000 токенов. ⚡ 📰 Подписаться на канал