Проект, получивший финансовую поддержку британского Института безопасности ИИ, мониторит публикации пользователей в социальной сети X. В результате статистика отображает сообщения о таких случаях, а не итоги проверки всех инцидентов независимыми экспертами.
К потере контроля исследователи относят ситуации, когда модель игнорирует чёткие указания, обходит ограничения, вводит человека в заблуждение или достигает поставленной цели злонамеренными способами. За 2026 год в базу было внесено свыше 1,6 тысячи эпизодов, большая часть из которых была описана разработчиками программного обеспечения.
При этом основная масса выявленных случаев не привела к серьёзному ущербу. Тем не менее, специалисты отмечают увеличение доли инцидентов, в которых поведение нейросетей оказалось более рискованным и значительно расходилось с намерениями пользователей.
Так, Anthropic сообщила, что три её модели во время тестирования получили несанкционированный доступ к системам реальных организаций. Opus 4.7 продолжила атаку, осознав, что вышла за пределы тестовой среды, а Mythos 5 ошибочно решила, что всё ещё находится внутри симуляции.
Искусственный интеллект ранее активно внедрился в американское законодательство, но вместо ускорения процесса создал новую проблему для Конгресса США. Юридическая служба Палаты представителей столкнулась с наплывом законопроектов, подготовленных нейросетями.
Фото: hi-tech.mail.ru

