Утечка кода Claude: Anthropic раскрыла внутренние методы работы ИИ-агента
Компания Anthropic столкнулась с утечкой исходного кода своего ИИ-агента Claude Code, вызванной человеческой ошибкой при обновлении системы. Разработчик был вынужден потребовать удаления тысяч копий кода с платформы GitHub, чтобы защитить свои уникальные алгоритмы и внутренние инструкции.

Компания Anthropic, разработчик ИИ-системы Claude, активно работает над устранением последствий утечки внутреннего кода Claude Code. Инцидент произошел из-за человеческой ошибки, которая привела к раскрытию основных инструкций, управляющих работой популярного ИИ-агента. Об этом сегодня утром, в четверг, сообщило издание The Wall Street Journal.
Согласно отчету, компания была вынуждена направить запросы на удаление контента, защищенного авторским правом, в отношении более чем восьми тысяч копий и дубликатов кода, опубликованных на платформе GitHub. Позже Anthropic скорректировала запрос, сократив его до 96 копий, после того как выяснилось, что первоначальное обращение было слишком широким и затронуло больше пользователей, чем планировалось.
В Anthropic подчеркнули, что утечка не затронула данные клиентов или конфиденциальную информацию, а также не раскрыла сами модели — математические веса, обеспечивающие работу искусственного интеллекта. Тем не менее, были обнародованы внутренние методы работы, уникальные инструменты и инструкции, позволяющие Claude функционировать как эффективный агент по написанию кода.
По заявлению компании, причиной инцидента стал «сбой в процессе упаковки», вызванный человеческой ошибкой, а не брешь в системе безопасности. Однако последствия могут быть значительными, так как утекшая информация предоставляет конкурентам и стартапам подробную дорожную карту для копирования возможностей продукта без необходимости проведения обратной разработки.
Что именно было раскрыто и почему это важно?
Утекший код включает в себя систему «Harness» — набор инструментов и инструкций, позволяющих пользователям направлять модели ИИ для выполнения сложных задач по программированию. Этот компонент считается значимым конкурентным активом, отличающим систему от аналогов.
Разработчики, изучившие опубликованный код, отметили в социальных сетях наличие уникальных техник, включая механизм, позволяющий системе «видеть сны» — заново просматривать задачи и организовывать свою память. Кроме того, были обнаружены инструкции, предписывающие системе в определенных случаях не раскрывать свою природу искусственного интеллекта при публикации кода.
Также были найдены упоминания будущих разработок и неожиданные функции, включая интерактивного персонажа в стиле тамагочи по имени Buddy, предназначенного для взаимодействия с пользователями. Утечка произошла после обновления, в рамках которого по ошибке был загружен файл, ссылающийся на полный исходный код, что позволило внешним пользователям скачать и проанализировать его. Первым неисправность выявил пользователь социальной сети X, после чего информация быстро распространилась.
Гонка на время и последствия для рынка
Инцидент спровоцировал ситуацию «погони кошки за мышкой» между компанией и разработчиками, которые продолжали распространять версии кода. Одному из них удалось переписать функциональность Claude Code на другие языки программирования, чтобы сохранить информацию и избежать удаления — этот шаг приобрел популярность на GitHub.
Несмотря на опасения, в индустрии звучат и успокаивающие мнения. Эксперт по кибербезопасности Дэн Гвидо отметил, что утечка, хотя и является досадной, не обязательно несет критическую угрозу, так как обратная разработка системы была возможна и ранее, а код обновляется с высокой частотой, что делает информацию быстро устаревающей.
Тем не менее, для Anthropic это имиджевый и деловой удар, особенно в период ускоренного роста и высокого спроса на продукты компании. Согласно отчету, Anthropic недавно завершила раунд привлечения инвестиций при оценке в 380 миллиардов долларов в преддверии возможного выхода на биржу.





