🚀 DeepSeek представила метод DSpark для ускорения генерации — 28 июня 2026 г. в 04:00:01.735
🚀 DeepSeek представила метод DSpark для ускорения генерации DeepSeek анонсировала новый метод speculative decoding под названием DSpark, который демонстрирует прирост throughput от 51% до 400% для моделей V4 Flash и V4 Pro в зависимости от условий использования. Суть метода заключается в том, что небольшая или ускоренная модель делает предположения следующих токенах, а основная модель проверяет эти предположения пачками. Это позволяет сократить количество дорогих проходов и при этом ускорить генерацию. DeepSeek утверждает, что улучшения наблюдаются не только у своих моделей, но и у других, таких как Gemma и Qwen. Такой подход может быть полезен для различных open-weight моделей, что открывает новые возможности в продакшене.

