Прогнали записи своих встреч за день через четыре модели для того чтобы понять, кто луч... — 26 сентября 2026 г. в 06:29:11.839
Прогнали записи своих встреч за день через четыре модели для того чтобы понять, кто лучше подходит. Участвовали: GPT-6-SOL, OPUS 5.5, MUSE 1.3, DEEPSEEK 4.1 FLASH. А потом сначала глазами сами, а потом через эти же модели прогнал созданные документы. Короткий вывод: никому из них, кроме GPT доверять нельзя. Модели себя любят:) И сильно отличаются в одной и той же, задаче. GPT конкретный. Claude более дружелюбный, но фантазёр и приписывает решения, которых по факту не было. MUSE самый подробный, но детали надо вытаскивать самому, DS 4.1 Flash часто ошибается. Конечно промтами можно всё дотюнить., но ключевые проблемы так и останутся. И я всё сильнее понимаю почему люби разбиваются на два лагеря, GPT и Claude. У Клода при вагоне его минусов есть его электронная душа, которая пытается о тебе позаботится так, как посчитает нужным, добавить что-то "от себя". И ровно это же мешает ему чётко выполнять инструкции, что вызывает большие вопросы, можно ли его использовать в качестве профессионального инструмента. GPT меч самурая, лишённый эмоций и чётко делающий свою работу. И скучный. Ну и решайте сами, какой подход вам ближе.