У OpenAI завелись гоблины. И это не шутка — 4 мая 2026 г. в 07:46:08.218
У OpenAI завелись гоблины. И это не шутка Иногда новости про ИИ звучат так, будто их придумал уставший сценарист фэнтези. На днях OpenAI отдельно объясняла, почему её модели начали слишком часто упоминать гоблинов, гремлинов, троллей, енотов, огров и даже голубей. Особенно странно это выглядело в Codex — инструменте, который вообще-то должен помогать писать код, а не устраивать фэнтези-вечеринку в терминале. Сначала это выглядело просто как забавный баг. Попросил модель объяснить ошибку в коде — а она такая: “тут маленький гоблин всё сломал”. Мило? Да. Странно? Тоже да. Но чем дальше, тем понятнее становилось: это не просто случайная шутка модели. OpenAI выяснила, что проблема появилась из-за обучения одной из “персональностей” модели — режима Nerdy. Его учили быть более игривым, живым и немного странным. В процессе модель начала получать слишком хорошие оценки за метафоры с разными существами. А потом этот стиль начал расползаться дальше, уже не только там, где он был нужен. И вот тут история становится намного интереснее. Потому что это отличный пример того, как нейросети учатся не совсем так, как нам кажется. Мы думаем: “научили модель быть чуть веселее” А по факту может получиться: “модель решила, что гоблины — это хороший способ объяснять мир” И потом этот маленький стильный баг начинает жить своей жизнью. Это смешно, пока речь идёт про гоблинов. Но сама механика совсем не смешная. Модель может случайно “переоценить” какой-то паттерн, фразу, стиль, тон или логику. И если это закрепилось в обучении, оно может начать всплывать в неожиданных местах. То есть нейросеть не просто ошибается. Иногда она странно обобщает то, за что её похвалили. В случае OpenAI это закончилось довольно комично: в инструкциях для Codex появились прямые запреты не упоминать гоблинов, гремлинов, троллей, огров, голубей и других существ без необходимости. А Сэм Альтман даже пошутил про GPT-6 “с дополнительными гоблинами”. Но главный вывод тут не про гоблинов. А про то, что даже у самых продвинутых моделей могут появляться очень человеческие странности: привычки, речевые тики, навязчивые образы и неожиданные перекосы. Просто у людей это называется “особенность характера”. А у нейросетей — “непредвиденное поведение модели”. И, честно говоря, после такой новости фраза “у нас баг в коде” уже звучит недостаточно точно. Иногда там на самом деле может быть маленький гоблин.

