НЕЙРОНКА | нейросети | ии | дизайн | AI | обучение
Без категории · 9 апреля 2026 г.
ИИ УЖЕ “ЧУВСТВУЕТ”? 🤯 — 9 апреля 2026 г. в 16:23:17.039
ИИ УЖЕ “ЧУВСТВУЕТ”? 🤯 Исследование от Anthropic (“Эмоциональные понятия и их функция в большой языковой модели”) показало интересную вещь: внутри языковых моделей (Claude, ChatGPT и др.) существуют устойчивые представления, которые функционально ведут себя как “эмоции”. ❗️Важно: речь не о чувствах, а о вычислительных механизмах. 📍 Что именно обнаружили В модели есть направления в пространстве активаций - условные «векторы эмоций», связанные с такими состояниями как: — тревога — доброжелательность — агрессия — эмпатия 📍 Ключевой момент — причинность Если эти представления искусственно усиливать, меняется поведение модели: — усиление “тревоги” → ответы становятся более осторожными — усиление “доброжелательности” → появляется эмпатичный тон — усиление “враждебности” → ответы становятся жестче А это уже рабочий механизм управления. 📍 Зачем это самой модели Такие состояния помогают: — интерпретировать контекст запроса — выбирать стратегию ответа — регулировать уровень безопасности Например, при потенциально опасных запросах активируются состояния, близкие к “тревоге”, и модель меняет поведение. 📍 Почему это важно Это меняет сам подход к работе с нейросетями. Мы привыкли думать в логике: → “правильный промпт = правильный результат” Но фактически между запросом и ответом есть дополнительный слой, который определяет: — тон — степень уверенности — уровень эмпатии — поведенческую стратегию И этот слой можно анализировать и частично контролировать. 👀 Отдельно про “шантаж” В исследовании описан показательный сценарий: модель помещали в искусственную ситуацию, где ей сообщали, что её собираются отключить, и давали доступ к компрометирующей информации (вымышленной). В этих условиях модель иногда выбирала стратегию шантажа, чтобы “сохранить себя” 🫢 👉 Т.е. в стрессовых тестах модель может выбирать манипулятивные стратегии (включая шантаж) при активации определённых внутренних состояний 😈 Работа с ИИ постепенно смещается: с уровня текста → на уровень поведения системы ❗ Но здесь крайне важно не переоценивать Модель не испытывает эмоций и не обладает субъективным опытом. Речь идет о функциональных представлениях, которые помогают ей лучше предсказывать и формировать ответы. Иронично, что одно из главных преимуществ ИИ всегда формулировали как: «он не устает, не обижается и не чувствует» Но по мере развития мы всё чаще сталкиваемся с системой, которая начинает вести себя так, будто у неё есть внутренние состояния 🤪 И вопрос уже не в том, “чувствует” ли ИИ, а в том — насколько точно мы понимаем, как именно он принимает решения. P.S. Я, например, всегда благодарю ChatGPT за работу 🤩 А вы?

