В открытом коде нового инструмента от OpenAI была обнаружена строка, которая повторяется дважды и касается гоблинов.
Когда разработчики открыли исходный код Codex CLI — специализированного агента OpenAI для работы с кодом — внутри оказался системный промпт GPT-5.5. Системный промпт — это скрытые инструкции, которые задают модели правила поведения еще до того, как пользователь напишет первое сообщение. Обычно там стандартное: отвечай вежливо, не придумывай факты, держись темы. Однако среди этих директив нашлось нечто неожиданное.
В документе дважды повторяется одна и та же фраза: модели запрещено упоминать гоблинов, гремлинов, енотов, троллей, огров, голубей и прочих животных или существ, если это не имеет прямого отношения к запросу пользователя. Такое двойное упоминание вызвало активные обсуждения среди пользователей.

OpenAI провела собственное расследование и опубликовала результаты. Выяснилось, что проблема появилась ещё с GPT-5.1 — именно там существа впервые начали просачиваться в ответы. Причиной этого стало совпадение двух факторов. Первый: у ChatGPT была личность под условным названием Nerdy — нечто вроде «душнилы», которому в системном промпте прописали установку «играй с языком, мир странный — наслаждайся этим». Второй: reward-модель во время обучения почему-то особенно щедро поощряла ответы с упоминанием существ. Гоблин в тексте — это плюс к награде, значит модель предпочитала такие ответы.
Цифры говорят сами за себя: личность Nerdy обрабатывала всего 2,5% всех ответов ChatGPT, но именно оттуда поступали 66,7% всех гоблинов. Ситуацию усугубило то, что GPT-5.5 частично обучался на генерациях ChatGPT — и унаследовал привычку вместе с обучающими данными. Под раздачу вместе с гоблинами попали еноты, тролли, огры и голуби.

