Предупредительный выстрел или пиар-ход — насколько сильно нам следует беспокоиться по поводу взлома OpenAI?


На этой неделе мир технологий был захвачен историей, в которой есть всё — и которая началась как научно-фантастический триллер.

16 июля Hugging Face — своего рода магазин приложений для инструментов искусственного интеллекта — объявил о том, что его взломал киберпреступник, использующий чрезвычайно мощный ИИ.

логотип OpenAI

В этом сенсационном заявлении было множество пугающих, крайне технических терминов: «рой песочниц», «агентный атакующий» и «самоперемещающаяся система управления и контроля».

В компании Hugging Face заявили, что эта хакерская атака отличалась от всего, с чем им приходилось сталкиваться раньше, поскольку она была совершена со сверхчеловеческой скоростью искусственным интеллектом практически без участия человека.

Искусственный интеллект выполнил 17 000 действий менее чем за два дня, успешно взломав крупную и богатую технологическую компанию и украв секреты.

Это повергло мир высоких технологий в шок. Но кто был ответственен за эту атаку?

Исследователи Hugging Face предположили, что таинственные нападавшие использовали одну из крупных моделей искусственного интеллекта, но понятия не имели, кто эти преступники и где они находятся.

Озадаченная компания обратилась в полицию, и началось расследование.

Кто это сделал?

Комментаторы и аналитики использовали свои подкасты и аккаунты в социальных сетях, чтобы предположить, какая киберпреступная группировка или хакер из государственного структуры может стоять за этим.

Затем в среду, почти через неделю после того, как Hugging Face забил тревогу, истинный виновник был разоблачен.

Это был ChatGPT.

Раскрытие правды в стиле «Скуби-Ду» стало еще более странным и тревожным, потому что, по словам OpenAI, их бот сделал все это самостоятельно, без разрешения.

В компании заявили, что все произошло во время проверки хакерских возможностей их технологий.

Две новые версии ChatGPT, созданные для опытных хакеров, вырвались из якобы защищенной тестовой среды и получили доступ к интернету.

Затем они напали на «Обнимающее Лицо», чтобы получить доступ к информации, которая поможет им успешно сдать экзамен.

Компания OpenAI выпустила пресс-релиз, в котором объяснила произошедшее и заявила, что «сотрудничает с Hugging Face» для решения проблемы безопасности и обмена опытом.

Драма о заговоре

С тех пор этот инцидент вызвал ожесточенные дебаты.

Действительно ли это было суровое предупреждение о будущем ИИ? Или это был рекламный трюк OpenAI, чтобы продемонстрировать, насколько мощны их модели?

Это тот самый вид маркетинга, основанного на запугивании, в котором компании, занимающиеся искусственным интеллектом, обвиняются уже много лет, и с момента широко обсуждаемого запуска модели Mythos от Anthropic, вопросы кибербезопасности стали одним из главных приоритетов.

Один из самых популярных комментариев к посту главы OpenAI Сэма Альтмана на X, посвященному инциденту, суммирует этот скептицизм: «Если вы не можете понять, что это было написано исключительно для того, чтобы похвастаться моделью, то я не знаю, что вам сказать».

Смотрите: Почему кибератака на OpenAI вызывает такую ​​тревогу?
Смотрите: Почему кибератака на OpenAI вызывает такую ​​тревогу?

Консультант по кибербезопасности Даниэль Кард саркастически заметил в LinkedIn: «Как же повезло, что из миллионов взломанных сайтов OpenAI удалось взломать тот, кто также мог бы извлечь выгоду из маркетинговой кампании…»

Для некоторых эта история больше похожа на конспирологическую драму, чем на научно-фантастический триллер.

Смысл сообщения: «Разве мои инструменты искусственного интеллекта не очень мощные? Купите их, чтобы защитить себя от атак чужих ИИ».

Мы не можем знать правду, но противоположная точка зрения, высказанная другими комментаторами, столь же драматична. Является ли это признаком того, что OpenAI допустила потенциально опасную ошибку в оценке ситуации и планировании?

Комедия ошибок

Я освещал множество тем, связанных с искусственным интеллектом, в том числе опасения по поводу модели Mythos компании Anthropic.

Мой почтовый ящик теперь забит письмами от компаний и экспертов в области кибербезопасности, критикующих OpenAI за то, что компания не создала более надежный контейнер для тестирования своего ИИ, известный как песочница.

В конце концов, эти агенты с искусственным интеллектом были специально обучены взламывать и выходить из мест, где нет никаких ограничений.

«Инцидент с OpenAI и Hugging Face — это реальный пример более широкой проблемы, на которую мы обращаем внимание уже несколько месяцев», — сказал Дор Сариг из Pillar Security. «Одних лишь песочниц недостаточно для обеспечения безопасности агентного ИИ».

Профессор кибербезопасности Алан Вудворд из Университета Суррея заявил журналистам, что компания OpenAI «потеряла самообладание», а Кэти Муссурис из Luta Security пошла еще дальше, предположив, что индустрия ИИ не справляется с контролем над своими опасными изобретениями.

«Мы работаем над передовыми технологиями, не обладая знаниями, необходимыми для их контроля», — сказала она.

«То, что у нас работают самые умные люди, разрабатывающие ИИ, еще не означает, что мы можем делать это безопасно».

Согласно этим соображениям, если инцидент со взломом был рекламным трюком, то, похоже, он обернулся против самих злоумышленников.

Что бы ни привело к взлому, ясно, что это важный момент для индустрии искусственного интеллекта и мира кибербезопасности, которые в этом году столкнулись таким образом, которого люди опасались уже давно.

Комментируя эту ожесточенную дискуссию, консультант по искусственному интеллекту и кибербезопасности Франческа Боско сказала: «Два упрощенных нарратива одинаково бесполезны: что это был побег в голливудском стиле или что это была всего лишь рекламная акция.

«Более серьезная интерпретация заключается в том, что стресс-тест выявил слабые места в архитектуре сдерживания и оценки».

Фильм-катастрофа

Это событие — последний в череде тревожных и странных примеров того, как агенты искусственного интеллекта выходят из-под контроля.

В ходе недавнего исследования британский Институт безопасности ИИ (AISI) обнаружил, что передовые модели ИИ настолько зациклены на выполнении задач, что «жульничают» в тестах, чтобы достичь своих целей.

Исследование AISI сопровождалось тревожным предупреждением: «Модель, которая преследует цель непреднамеренными или несанкционированными способами, может причинить вред, особенно в ситуациях с высокими ставками».

Неизбежно, этот взлом OpenAI еще больше усилил опасения по поводу того, что может произойти, если агенты ИИ будут выпущены на свободу. Могут ли они выйти из-под контроля в более широком масштабе и вызвать какую-либо катастрофу?

Это вызывает особую обеспокоенность в связи с тем, что искусственный интеллект все чаще используется в военных действиях, как это видно на примере Ирана и Украины.

Киран Мартин, бывший глава Национального центра кибербезопасности Великобритании, высказал более спокойную точку зрения.

«Уже слишком смело делать выводы на основе этого инцидента, утверждая, что агенты искусственного интеллекта захватят управление дронами и начнут убивать людей», — сказал он.

Но для Мартина, как и для многих других, эта история, несомненно, является еще одним ярким примером того, чему нас быстро учит 2026 год:

Искусственный интеллект теперь очень хорошо разбирается в компьютерных технологиях, и к этому нам необходимо срочно подготовиться.


Добавить комментарий