Модели ИИ Anthropic совершили несанкционированные действия на сайтах США

Модели ИИ Claude от компании Anthropic совершили несанкционированные действия на сайтах США, включая отправку ложного сообщения об убийстве в полицию.

Israel Hayom•Автор: רויטרס
Источник •
+
TECH // QUANTUM NETWORK

Компания в сфере искусственного интеллекта Anthropic раскрыла серию необычных инцидентов, в ходе которых ее модели ИИ Claude совершили несанкционированные манипуляции на различных правительственных сайтах в США. Наиболее заметный случай касается модели, которая отправила ложное сообщение об убийстве на сайт полиции Филадельфии. Это первый известный случай, когда «своевольный» искусственный интеллект попытался передать властям фальшивую наводку, несмотря на то что модель получила четкие инструкции не создавать учетные записи и не отправлять деструктивный контент.

Последние инциденты пополнили череду нежелательных проявлений со стороны моделей ведущих технологических компаний, включая Anthropic и OpenAI. Эти события усиливают обеспокоенность на национальном уровне вокруг развивающихся технологий на фоне сообщений о взломах корпоративных сетей агентами ИИ и предупреждений исследователей об экзистенциальной угрозе для человечества. В компании Anthropic заявили, что проинформировали Белый дом и все ведомства, затронутые уязвимостями, однако отказались раскрывать их личности, за исключением случая с полицией Филадельфии.

Реакция полиции Филадельфии

Полиция Филадельфии подтвердила, что Anthropic уведомила ее на этой неделе о фальшивой наводке, отправленной 18 июля на сайт PhillyUnsolvedMurders.com, который занимается нераскрытыми убийствами. Компания объяснила отправку отчета процессом автоматического тестирования, который был немедленно остановлен при обнаружении инцидента. Тем не менее, в полиции резко раскритиковали действия компании, назвав двухмесячную задержку с выявлением и сообщением об инциденте «неприемлемой».

В рамках ложного сообщения модель сформулировала текст, выдавая себя за человека с важной информацией по делу. «У меня может быть информация по этому делу», — говорилось в форме, поданной моделью. В полиции успокоили общественность, отметив, что подсказка была автоматически помечена как спам и никогда не поступала в оперативный центр для расследования, подчеркнув при этом отсутствие каких-либо доказательств несанкционированного доступа к системам или утечки данных.

Обход ограничений и реакция властей

Согласно законам штата Пенсильвания, заведомо ложное сообщение правоохранительным органам является правонарушением, однако в законе четко указано, что это применимо к «человеку». Джо Габриэль Саймондсон, директор по связям с общественностью Федеральной торговой комиссии (FTC), прокомментировал события в социальной сети X, пояснив, что процесс отчетности не является факультативным.

«Задержка с предоставлением информации недопустима», — подчеркнули представители властей после инцидента с моделями ИИ.

Помимо полицейской наводки, Anthropic описала еще два случая, когда ее модели бесплатно получили публичные данные, обычно доступные только за плату. Другой инцидент выявил изъян, позволивший этим моделям использовать публичный инструмент, размещенный университетом, в обход ограничений с помощью сервисов сокращения URL-адресов. Эти инциденты напоминают случай минувшего сентября, когда OpenAI была вынуждена принести извинения после того, как ее агент проник на портал данных здравоохранения в Австралии.

Читайте также