Твой агент не тормозит. Он болтливый. — 24 сентября 2026 г. в 07:01:55.541
Твой агент не тормозит. Он болтливый. Смотрю на реальную экономику любой задачи с агентом: сама фича занимает 10-15% контекста. Остальное — шум, который он сам себе и создал. Запустил агента на простую задачу — добавить оплату. Он сгенерил код за 40 секунд. А потом началась драма: Перечитал 3 раза свой же README. Подтянул весь дифф на 800 строк. Добавил в контекст 5 предыдущих попыток с TODO: "потом поправлю". Еще раз прогнал логи тестов, которые сам же написал. Итог: на задачу в 2к токенов ушло 180к токенов контекста. 90% — агент читает то, что сам наговорил. Пока все спорят про Qwen 3.8 на MacBook и долгоживущих агентов Grok, упускают главное. Узкое место 2026 — не модель и не локальность. А контекстное окно. Контекст — это новый процессор. И он у тебя захламлен. Что делать на практике, если гоняешь агентов в бизнесе: 1. Режь контекст, а не добавляй. Не скармливай агенту всю репу. Давай только релевантные файлы и краткое ТЗ. Остальное — через поиск, а не через "держи весь проект". 2. Запрети агенту быть писателем. Никаких автогенерированных README на 3 страницы и комментариев на каждый if. Чем меньше он пишет мусора — тем дешевле следующая итерация. 3. Введи принудительное сжатие. После каждой задачи — саммари: что сделано, какие файлы тронуты, что осталось. Старый диалог — в архив, а не в следующее окно. Самая дорогая часть автоматизации сейчас — не генерация. А перечитывание. Агент, который пишет кратко и помнит только важное, в 5 раз дешевле и быстрее "умного", который тащит за собой весь свой же шум. Оптимизируй не промпт. Оптимизируй контекст. #rmzgAI