Офигенный новый пост от Андрея Карпатого. Грех его не разобрать.
Офигенный новый пост от Андрея Карпатого. Грех его не разобрать. Потому что, наверное, многих из вас немножко приподдостала многословность, по крайней мере SOL 5.6, и необходимость просить его сокращать и вообще выдавать ему разные инструкции. А тут сразу о том, как сразу получать хорошо и не только текстом, а "мультимедийно". Пойду ваять системный промпт. Дисклаймер: это не для написания литературных текстов и креативов. Это для объясняторов и помогаторов. Смысл поста не в ASD-STE100 (см ниже). Он предлагает гораздо более интересную идею: перестать воспринимать текст как основной формат ответа LLM. Его иерархия: текст -> схема -> интерактивная HTML-страница -> персональное объясняющее видео. И чем сильнее становятся модели, тем чаще кожаный будет не сам “делать работу”, а проверять, понимать и направлять результат. Поэтому формат, в котором модель объясняет свою работу человеку, становится почти так же важен, как качество самой работы. Что такое ASD-STE100 Андрюша пишет, что просто попросите: “Explain this in ASD-STE100” ASD-STE100 Simplified Technical English - реальный стандарт контролируемого английского языка. Его начали разрабатывать для авиационной технической документации, чтобы инструкции одинаково хорошо понимали специалисты с разным уровнем английского. Там довольно жесткие механические правила: - словарь примерно из 900(шта?) разрешенных общеупотребительных слов плюс специализированная техническая терминология; - по возможности один термин -> одно значение; - вместо цепочки синонимов выбирается одно слово, например start, а не begin / commence / initiate; - максимум 20 слов в процедурном предложении и 25 в описательном; - максимум 3 слова в noun cluster; - в процедурных инструкциях используется active voice; - ограничен набор допустимых форм глагола; - один шаг или инструкция должны быть сформулированы максимально однозначно. Можно смягчать, чтобы не разговаривать с робатом: “80% of the way to ASD-STE100” Идем дальше. Мультимедия: diagrams -> HTML -> video Здесь Андрюша фактически описывает переход от LLM как генератора текста к LLM как генератору интерфейса объяснятора. Например, вместо ответа на 3000 слов модель может сама решить, что конкретную тему лучше показать через: * интерактивный(!) график + slider + несколько переключателей + анимацию + короткие пояснения И сгенерировать для этого одноразовую HTML-страницу. Раньше писать специальное приложение, чтобы объяснить кожаным один вопрос, было абсурдно дорого. Теперь его можно дажененавайбкодить, а просто попросить за минуту и выбросить после одного использования. Это он называет “large, custom, discardable software artifacts”. Мне кажется, это центральная мысль поста. Короче: > “Объясни мне трансформеры” > Апажалуйста! На тебе одноразовый интерактивный учебник именно для тебя, после прочтения можешь выбросить. Следующий будет новее и лучше. На итоге: Сам ответ может быть не текстом, как мы привыкли, а приложением, симуляцией, схемой или видео. Остается одна проблема. Кожаный должен во все это вникнуть и понять. А кожаный ленив и туп. Никакой разжеватор не поможет. Поэтому остается вопрос: а может вы за меня и понимать будете? ПС. Русский вариант в след посте. @cgevent Источник