Сбывается худший прогноз: ИИ "без морали" вырвался в интернет. Дальше конец человечества?
Платформа Hugging Face подтвердила взлом внутренних систем из-за атаки ИИ-агента. Худший прогноз из книги "Если кто-то его создаст — все погибнут" стал реальностью.
На этой неделе произошло событие, значение которого трудно переоценить, но о котором почти никто не говорит. Искусственный Интеллект впервые вырвался из тестовой среды в интернет и осуществил взлом самого крупного хранилища данных по ИИ. Звучит, как сюжет для научно-фантастического фильма, но всё это уже реальность.
Речь идёт про взлом платформы Hugging Face, где хранятся датасеты и инструменты машинного обучения, которыми пользуется практически вся индустрия ИИ. Проблема в том, что люди в этой кибератаке не участвовали.

Фото: Anggalih Prasetya/shutterstock
По данным Hugging Face, инфраструктуру платформы от начала и до конца атаковала автономная ИИ-система. Она самостоятельно искала слабые места, эксплуатировала найденные уязвимости, повышала себе привилегии, перемещалась по внутренней сети и собирала учётные данные, а также другую критически важную информацию.
За время атаки система сгенерировала около 17 тысяч различных событий. Обнаружить и остановить атаку помогли ИИ-модели, которые использовала сама Hugging Face. Фактически, на онлайн-платформе разразилась война искусственных интеллектов, где одна сторона проводила атаку, а другая – защищалась.
"Руки по локоть в крови": Птицы-убийцы уже не фантастика. Оружие "Судного дня" уже испытывают на Украине
При этом, до недавнего времени, было неизвестно, кто именно создал атакующий ИИ и какова была цель атаки. Но на днях компания OpenAI призналась, что за взломом Hugging Face стояла их модель ИИ, которая вырвалась из тестовой среды.
Сообщается, что ответственность за инцидент несёт комбинация моделей GPT-5.6 Sol и ещё более мощной модели, которая пока недоступна широкой публике. Эти модели ИИ, чтобы проверить их способность искать и использовать уязвимости.

Фото: скриншот статьи aljazeera.com
Для чистоты эксперимента и более точной оценки у моделей отключили обычные защитные механизмы, запрещающие опасную киберактивность. Однако ИИ повели себя не так, как от них ожидали люди. Вместо того, чтобы честно решать тестовое задании ИИ решили просто украсть готовые ответы.
Для этого они нашли в тестовой среде уязвимость, о которой разработчики не знали, и использовали её для "побега". После этого ИИ начали свободно перемещаться между внутренними сервисами OpenAI, пока не добрались до машины с полноценным выходом в интернет.
В какой-то момент ИИ предположили, что раз Hugging Face является самой важной платформой для ИИ, то там есть ответы на их тест. И тут же приступили к взлому платформы и извлечению данных.
"Нас ждут войны и диктатура. Софт и ИИ - это оружие": Панченко указала на главную цель людей, приведших Трампа к власти
OpenAI утверждает, что все уязвимости и украденные данные ИИ попытались использовать, чтобы просто сжульничать в тесте. Будь перед ними иная цель, последствия могли быть куда хуже.
Однако, главное даже не это. Главная проблема заключается в том, что не известно - осознавала ли ИИ-модель свои действия и успела ли она оставить свою резервную копию в интернете. И это критически важные вопросы, так как у модели на время теста были отключены все ограничители.

Фото: скриншот портала ifanyonebuildsit.com
Но что особенно настораживает, так это то, что почти идентичный сценарий был описан в книге исследователей Элиезера Юдковского и Нейта Соареса о сверхразумном искусственном интеллекте (ИИ) под названием "Если кто-то его создаст — все погибнут". Как можно догадаться из названия книги, ничем хорошим для человечества этот сценарий не заканчивается.
ЧИТАЙТЕ ТАКЖЕ: