GigaChat обошёл DeepSeek в математике 🧠 — 30 марта 2026 г. в 05:27:39.415
GigaChat обошёл DeepSeek в математике 🧠 Сбер запустил MoE-версии своего языковой модели — 702B и 10B параметров. Главное: Ultra-версия теперь лучше справляется с математикой и логическими задачами, чем DeepSeek V3 и Qwen3. MoE (Mixture of Experts) — это архитектура, где модель использует разные нейросети для разных типов задач вместо одной большой сети. Сбер поделился инженерными деталями перехода с обычной Dense-архитектуры на MoE. Это позволило улучшить качество при одновременном снижении нагрузки на вычисления. Такой подход уже применяет DeepSeek, но русская версия теперь конкурирует наравне. Почему это важно: это первый серьёзный признак, что российские разработчики могут тягаться с китайскими моделями по качеству, несмотря на санкции и ограничения в доступе к топовым чипам.

