🧠 Нейросеть-учёный: ИИ начал изучать свой собственный «мозг»
🧠 Нейросеть-учёный: ИИ начал изучать свой собственный «мозг» ИИ уже пишет код, рисует и ставит диагнозы — но как именно он «думает», мы почти не знаем. Пока модели развиваются быстрее, чем наше понимание, разрыв только растёт. Учёные представили Mechanist — агентную (самостоятельно действующую) систему, которая превращает ИИ в научный прибор для изучения… самого ИИ. Что случилось. Механистическая интерпретируемость — это наука о том, как нейросеть хранит знания и принимает решения. Сейчас такие исследования почти полностью ручные: люди «вскрывают» модель, как часовщик — механизм. Mechanist автоматизирует этот процесс: он собрал граф знаний из ~13 000 статей по интерпретируемости и подключил базу из 43 миллионов научных работ по 26 дисциплинам. Внутри — библиотека из 32 методов анализа и проверки гипотез. Почему это важно. По словам авторов, в сравнении с Claude Code и другими «ИИ-учёными» Mechanist выдаёт более ценные гипотезы и надёжнее проводит эксперименты. Он уже нашёл неочевидный риск: опасные свойства модели могут «перетекать» между типами данных (текст ↔ изображения) через на вид безобидные обучающие примеры. А ещё система построила теорию убеждений — как модель формирует знания о мире — и научилась «рулить» научными моделями, например заставлять их генерировать ДНК-последовательности с нужными свойствами. Прогноз. Мы переходим от «запустил и надеюсь» к «понимаю и контролирую». А контролируемый ИИ — это безопасный ИИ. А вы верите, что ИИ сможет полностью объяснить свой собственный «мозг»? Делитесь 👇 #ИИ #интерпретируемость #наука