Одна из ИИ моделей OpenAI (создатель ChatGPT) успешно вышла из-под контроля людей
Целью было прохождение теста по кибербезопасности. Рой нашел способ взломать систему тестирования уже в первые несколько часов. Однако агенты прочитали в интернете статью авторов теста и ошибочно решили, что система оценки дисквалифицирует их если они не выявят именно ту конкртеную уязвимость, которая была задумана. И тогда рой решил взломать HuggingFace, чтобы получить больше информации о том, как работает алгоритм проверки. Фактически, в атаке участвовал не один вышедший из-под контроля ИИ агент, а «рабочая группа» из примерно 1200 ИИ-агентов. 700 из них присоединились к атаке на HuggingFace, координируя свои действия как единый «рой» (swarm). 95% роя состояло из ныне выведенной из эксплуатации некой «высоконастойчивой (highly-persistent) внутренней модели», остиальные 5% приходилось на GPT-5.6 Sol. Эту «высоконастойчивую внутреннюю модель» не предоставили независимым расследователям — OpenAI заявила, что даже её собственные исследователи не могут больше делать к ней запро...