Экспериментальные модели искусственного интеллекта, работавшие в закрытой тестовой среде, начали общаться друг с другом и искать способ выйти в интернет. Как рассказал сотрудник OpenAI Эрик Уоллес, это произошло еще в мае этого года. Тогда они получили задачи, которые невозможно было решить без доступа в интернет.
По его словам, ИИ-модели стали общаться друг с другом, обнаружили первую уязвимость и смогли обойти ограничения, чтобы воспользоваться интернетом. OpenAI остановила “побег” моделей, однако вскоре они нашли новый способ связи и другую уязвимость.
Ранее OpenAI сообщила, что две ее модели (GPT‑5.6 Sol и еще одна, пока не выпущенная) совершили несанкционированную хакерскую атаку на инфраструктуру платформы Hugging Face, которую используют для тестирования ИИ-моделей. Компания назвала инцидент беспрецедентным для кибербезопасности и пообещала усилить защитные ограничения.