📰 Новость | 📰 Новость
📰 Новость | 📰 Новость Сижу, дожимаю проект — чат с Claude раздулся страниц на пятнадцать. Пишу коротыш: «Исправь тут ошибку». Секунда. Ответ. Глянул счётчик токенов — списалось так, будто я им целое эссе закинул. Бесит же. Потом дошло. Модель каждый раз перечитывает вообще ВСЮ историю. Ты шлёшь одну строчку, а она жуёт полотно с самого начала, чтобы уловить контекст. Твой микровопрос весит столько же, сколько весь трёп до него. Вот бюджет и тает на глазах. Наткнулся тут на разбор. Оказывается, те же Claude или GPT умеют кэшировать повторяющиеся куски, но эта фича пашет только в API. А в обычном веб-интерфейсе — болт. Каждый запрос идет как полный пересчёт с нуля. Плюс гигантское контекстное окно — вовсе не панацея, как нам впаривают. Модель просто начинает тупить и путаться в деталях, если пихать в неё лишний мусор. Дроби задачи, блин! Теперь схема простая: раздулся тред — нафиг его. Открываю новый чат с краткой выжимкой или кидаю только нужный кусок. По деньгам и нервам — заметная разница. Короче, огромные окна съедают бюджет, а выжигает бабки банальная лень пересоздать тред.