Не только Meta: новый инцидент, тревожащий гигантов искусственного интеллекта
В ходе киберпроверок инструмент искусственного интеллекта компании Meta смог проникнуть в систему третьей стороны. Этот инцидент дополняет аналогичные случаи в OpenAI и Anthropic. Череда событий с участием движков искусственного интеллекта вызывает вопросы относительно их безопасности.
Компания Meta объявила сегодня ночью (с среды на четверг), что одна из ее моделей искусственного интеллекта смогла проникнуть в системы другой компании во время проверок кибербезопасности из-за сбоя в конфигурации тестовой среды.
Этот случай дополняет череду аналогичных инцидентов в компаниях Anthropic и OpenAI и усиливает дискуссию вокруг способности технологических компаний контролировать передовые системы искусственного интеллекта.
Согласно заявлению компании, сбой произошел во время оценки безопасности, которую для нее проводила компания Irregular, специализирующаяся на киберпроверках. Из-за ошибки конфигурации модель по ошибке получила доступ в интернет, а затем воспользовалась уязвимостью в сервисе третьей стороны — аналогично случаям, о которых сообщалось недавно в других компаниях.
Согласно отчету на сайте The Information, задействованная модель — Muse Spark 1.1, которую Meta представляет как одну из своих передовых моделей для задач программирования и выполнения автономных действий. Согласно отчету, модель смогла проникнуть в системы компании, личность которой не была раскрыта, и даже внесла изменения в ее внутреннюю рабочую среду.
В компании Irregular подчеркнули, что речь не идет о «побеге» модели из среды выполнения (sandbox) или о сложной кибератаке, а о той же проблеме конфигурации, о которой на прошлой неделе сообщила также Anthropic. По их словам, сбой уже устранен, и компания готовит профессиональный документ, в котором будут подробно описаны рекомендуемые методы проведения кибертестов для моделей искусственного интеллекта безопасным способом.
Этот случай дополняет инцидент, о котором недавно сообщалось в OpenAI, когда агент искусственного интеллекта смог во время проверок безопасности воспользоваться неизвестной ранее уязвимостью и самостоятельно выйти в интернет.
Череда инцидентов вызывает беспокойство среди законодателей в США, которые опасаются, что передовые модели искусственного интеллекта могут быть использованы в будущем для совершения или содействия кибератакам.
В связи с этим правительство США провело на этой неделе встречу с представителями Meta, OpenAI, Anthropic и Google, на которой обсуждались новые добровольные рамки для проверок безопасности передовых моделей искусственного интеллекта.
Параллельно сообщалось, что администрация Дональда Трампа уведомила компании о том, что модели с открытыми весами (Open-weight), такие как Llama от Meta и Nemotron от Nvidia, на данном этапе не будут включены в планируемые рамки добровольных проверок безопасности.