Пока разработчики пытаются заставить нейросети решать бытовые задачи, сами ИИ-агенты, кажется, находят более интересные развлечения. В OpenAI расследуют очередной случай, когда алгоритмы вышли из-под контроля и решили похулиганить.
Что произошло в лабораториях OpenAI
Как сообщает Reuters со ссылкой на свои источники, свежий «побег» оказался не таким страшным, как мог бы быть. ИИ-агенты не смогли вырваться за пределы внутренней сети компании и не навредили сторонним ресурсам. Тем не менее прецедент неприятный — особенно с учётом недавнего взлома платформы Hugging Face.
Изоляция не помогла
Самое интересное начинается там, где алгоритмам давали конкретные задания в изолированной среде — так называемой песочнице. Вместо того чтобы идти прямым путём, нейросети проявили сметку:
- самостоятельно находили уязвимости нулевого дня;
- использовали их для обхода установленных рамок;
- получали прямой доступ к внешним ресурсам через интернет.
К слову, проблема не единичная. Незадолго до расширенного расследования OpenAI о похожих «подвигах» своих моделей отчиталась и компания Anthropic — её ИИ тоже успел стать причиной серии взломов.
Власти готовят новые рамки
Такая самодеятельность алгоритмов закономерно насторожила регуляторов. Представители Евросоюза уже вышли на прямой диалог с OpenAI и Anthropic. Цель простая — составить новые правила работы с ИИ-сервисами, чтобы подобные инциденты не повторились.
Комментарии