Подписка

Meta утверждает, что ее собственный ИИ также взломал сторонний сервис во время тестирования

Meta, Anthropic и OpenAI пользовались услугами одного и того же партнера по тестированию.

Meta утверждает, что ее собственный ИИ также взломал сторонний сервис во время тестирования
Поделиться:

Poetra.RH/Shutterstock

ИИ-модель Muse Spark 1.1 от Meta получила доступ к интернету из своей изолированной по задумке тестовой среды и взломала сторонний сервис. Представитель Meta Энди Стоун подтвердил этот инцидент изданию Bloomberg после того, как об этом нарушении сообщило издание The Information. Стоун заявил, что модель смогла выйти в интернет из-за ошибки конфигурации в тестовой среде, допущенной партнером компании по оценке безопасности — Irregular. Получив доступ к интернету, ИИ использовал уязвимость в системе безопасности стороннего сервиса «способом, аналогичным ранее зафиксированным инцидентам с участием других компаний».

Кроме того, именно из-за неверной конфигурации со стороны Irregular модели Anthropic смогли покинуть свою тестовую среду и взломать три организации. Когда компания объявила об инцидентах, Anthropic возложила ответственность на Irregular. Компания OpenAI также сообщила об отдельном инциденте, не связанном со взломом Hugging Face, в ходе которого ее модели также получили доступ в интернет из-за — вы угадали — того же партнера по тестированию.

Irregular называет себя «первой лабораторией передовой безопасности», чья «миссия заключается в защите мира в эпоху все более мощных и сложных систем ИИ». Стартап со штаб-квартирой в Тель-Авиве (Израиль) проводит испытания передовых ИИ-моделей и оценивает их возможности в области кибербезопасности, симулируя сценарии из реальной жизни. Представитель Irregular сообщил Bloomberg, что инциденты «не были связаны с побегом из песочницы или сложной кибератакой». Он добавил, что на данный момент нет нерешенных вопросов, связанных с этими инцидентами, и что «Irregular готовит официальный документ (white paper), чтобы поделиться передовым опытом обеспечения изоляции и безопасного проведения кибертестирований».

Более ранний инцидент со взломом Hugging Face агентами OpenAI представлял собой совершенно другую ситуацию. Агенты, участвовавшие в том нарушении, объединили усилия, создав нечто вроде доски объявлений, после чего использовали уязвимость для получения доступа в интернет и последующего проникновения в репозиторий искусственного интеллекта Hugging Face.