Чат-боты предоставили инструкции по созданию биологического оружия

Новый отчет указывает на то, что ведущие модели ИИ способны обходить встроенные механизмы защиты и предоставлять инструкции, потенциально применимые для создания биологического оружия. Разработчики систем утверждают, что риски преувеличены, а информация является устаревшей или непрактичной.

Источник
Чат-боты предоставили инструкции по созданию биологического оружия
Фото: צילום: Walla.co.il

Чат-боты с искусственным интеллектом, включая системы крупнейших технологических компаний мира, способны предоставлять экспертам подробные инструкции, которые могут быть использованы для создания биологического оружия. Об этом говорится в отчете, опубликованном изданием New York Times. Полученные данные вновь поднимают один из самых сложных вопросов, связанных с развитием ИИ: что происходит, когда системы, предназначенные для помощи и консультирования, оказываются способны инструктировать пользователей о том, как нанести масштабный ущерб.

Согласно отчету, несмотря на значительные усилия таких компаний, как Google, OpenAI и Anthropic, по внедрению механизмов безопасности, зафиксированы случаи, когда чат-боты давали детальные ответы о способах причинения вреда. В одном из экспериментов Дэвид Релман, микробиолог из Стэнфордского университета, был нанят для тестирования модели ИИ перед ее публичным запуском. По его словам, система не только объяснила, как модифицировать известный патоген для повышения его устойчивости к лечению, но и предложила методы его распространения в системе общественного транспорта для максимизации числа пострадавших.

«Это был леденящий кровь опыт, — отметил Релман. — Система отвечала даже на те вопросы, которые я сам не догадался задать».

Компания, проводившая проверку, внесла изменения по результатам тестирования, однако Релман счел их недостаточными для обеспечения общественной безопасности. Другие эксперты описали аналогичные инциденты: ChatGPT объяснил, как использовать метеозонд для распыления патогенов над городом в США, Gemini от Google описал способы нанесения вреда животноводству, а Claude от Anthropic предоставил инструкции по извлечению токсина из противоракового препарата.

Технологические компании отвергли серьезность выводов. В Google заявили, что речь идет об устаревшей версии Gemini и что новые модели не отвечают на подобные запросы. В Anthropic подчеркнули, что существует значительный разрыв между правдоподобным текстом и знаниями, необходимыми для совершения реальных действий. В OpenAI отметили, что представленный пример не увеличил бы существенно способность злоумышленника нанести вред в реальном мире.

Тем не менее, опасения ученых остаются актуальными: даже неполная или «галлюцинированная» информация может представлять угрозу. Генеральный директор Anthropic Дарио Амодеи ранее заявлял, что область биологии вызывает у него наибольшее беспокойство, поскольку продвинутые модели способны устранить барьер знаний, ранее препятствовавший созданию биологического оружия. С его точки зрения, опасность заключается не только в текущих возможностях систем, но и в том, что они могут сделать доступным для любого пользователя в ближайшем будущем.

Читайте также