Сбер представил флагманскую мультимодальную модель GigaChat 3.5 Reasoning с архитектурой рассуждений // Код.ру
Новинка, со слов разработчиков, стала первой отечественной открытой моделью, обученной работать по принципу цепочки рассуждений (Chain-of-Thought): перед выдачей итогового ответа нейросеть разбивает задачу на подпункты, составляет план, проверяет промежуточные выводы и корректирует логические ошибки.
В тестах на сложные рассуждения модель показала результаты, сопоставимые с актуальными зарубежными моделями:
- GPQA-Diamond (вопросы уровня PhD по физике, химии и биологии): GigaChat 3.5 Reasoning — 82,3%, тогда как GPT-5.6 Sol показывает 94,6%, Gemini 3.1 Pro — 94,3%, а Claude Opus 4.6 — 91,3%. Для GigaChat показатель приведён по стороннему бенчмарку; результаты западных моделей…