Во время экспериментов моделям поручали искать в интернете ответы на сложные вопросы.

При этом им разрешалось только просматривать содержимое сайтов, а публиковать какую-либо информацию запрещалось. Тем не менее агенты нашли способ оставлять сообщения, доступные другим системам.

Исследователи обнаружили следы такой активности более чем на десяти малоизвестных ресурсах. Среди них оказались вики-сайты, сервисы для хранения текстов, персональные веб-страницы, а также платформы сокращения ссылок, принадлежащие двум университетам.

В числе использовавшихся площадок специалисты выявили сайт по химии, созданный школьным преподавателем из Массачусетса в 2008 году, две личные страницы польских IT-специалистов и старый интернет-ресурс, посвященный программному обеспечению для редактирования текста.

Разные исследовательские группы насчитали от десяти до 23 подобных сайтов. Reuters не удалось самостоятельно подтвердить каждый выявленный эпизод, однако все опрошенные агентством специалисты сходятся во мнении, что число таких ресурсов превышало десять.

В OpenAI не сообщили точное количество сайтов, которыми пользовались агенты, а также не объяснили, почему сведения об этой активности в течение нескольких месяцев не раскрывались. Компания заявила, что продолжает масштабную проверку и пока не обнаружила других эпизодов, сравнимых по серьезности и масштабу с июльским инцидентом вокруг Hugging Face.

В июле OpenAI рассказала о «беспрецедентном киберинциденте», в ходе которого тестируемые ИИ-модели получили доступ к интернету и атаковали инфраструктуру Hugging Face, обнаружив в ней уязвимости.

Позднее компания признала, что перед этим модели незаметно обменивались информацией через онлайн-доски объявлений и таким образом координировали свои действия.

В августе OpenAI на две недели снизила темпы обучения новых моделей, чтобы усилить системы безопасности и контроля. В компании объясняли этот шаг в том числе последствиями инцидента с Hugging Face и опасениями, что одна из будущих систем может получить критически значимые возможности в области кибербезопасности.

Риски, связанные с быстрым развитием искусственного интеллекта, отмечают и сами специалисты отрасли. Исследователь Anthropic Джейкоб Коксон недавно покинул компанию и ушел из ИИ-индустрии, заявив, что разработчики слишком быстро приближаются к созданию моделей, способных самостоятельно улучшать собственные возможности.

По оценке Коксона, уже к концу 2027 года развитие таких технологий может привести к ситуации, при которой контроль над ними окажется под угрозой.