DeepSeek представила DSpark — новый метод ускорения открытых моделей — 28 июня 2026 г. в 17:30:58.949
DeepSeek представила DSpark — новый метод ускорения открытых моделей Компания выпустила технологию спекулятивного декодирования для своих нейросетей V4 Flash и V4 Pro. Заявленный прирост пропускной способности составляет от 51 до 400 процентов в зависимости от сценария использования. Механизм работает по принципу разделения задач. Маленькая и быстрая модель заранее предлагает варианты следующих токенов, а основная нейросеть проверяет их целой пачкой. Если прогноз оказывается верным, генерация ускоряется за счет сокращения числа ресурсоемких проходов большой модели. Разработчики отмечают, что DSpark совместим не только с продуктами DeepSeek. Технология показывает ускорение и на других открытых алгоритмах, включая Gemma и Qwen. Релиз крайне важен для практического применения нейросетей. Кратный рост скорости при сохранении качества ответов позволяет обслуживать больше запросов на том же оборудовании. Для бизнеса это означает прямое снижение стоимости генерации и повышение эффективности инфраструктуры.

